ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

颠覆认知!小模型反杀大模型,DeepSeek Flash上演离谱逆袭

颠覆认知!小模型反杀大模型,DeepSeek Flash上演离谱逆袭 文章目录1. 先唠唠最近AI圈的离谱大瓜1.1 俩模型本来的人设很清晰1.2 反转来得比偶像剧还快2. 凭啥小个头能打赢大块头2.1 最离谱的是底子半毛钱没变2.2 后训练的效果到底有多夸张2.3 为啥这招对智能体这么好使3. 难道大参数就彻底没用了3.1 Pro依然稳赢的几个场子3.2 本质就是个时间差4. 最后说两句实在的P.S. 无意间发现了一个巨牛的人工智能教程非常通俗易懂对AI感兴趣的朋友强烈推荐去看看 传送门https://blog.csdn.net/qq_344193121. 先唠唠最近AI圈的离谱大瓜1.1 俩模型本来的人设很清晰今年四月DeepSeek出了V4系列两款都是混合专家架构。一款叫Pro1.6T总参数、49B激活明摆着是旗舰大哥。另一款叫Flash284B总参数、13B激活主打高性价比走量。搁以前这剧情不用想大哥全方位碾压弟弟天经地义。就像买手机看Pro和青春版闭着眼都知道谁更强。1.2 反转来得比偶像剧还快结果七月底Flash更了个0731正式版直接把所有人看傻了。9项智能体相关的基准测试新版Flash全面超过了Pro预览版。价格还只有Pro的三分之一。相当于你买了台千元机跑分直接打平自家万元旗舰。搁谁不得揉三遍眼睛以为自己看反了名次。2. 凭啥小个头能打赢大块头2.1 最离谱的是底子半毛钱没变说出来你可能不信新版Flash和旧版Flash架构、参数规模完全一样。既没加专家数也没涨参数量就做了个“重新后训练”。人还是那个人脑子还是那个脑子就是暑假补了个课。补完成绩直接坐火箭搁学校里得被老师怀疑抄答案。2.2 后训练的效果到底有多夸张给大家报几个数感受一下。DeepSWE测试从7.3干到54.4直接涨了6倍多。Cybergym分数翻倍DSBench-Hard也涨了一倍还多。就算提升最少的项目也涨了三成多。别家模型升级是挤牙膏一次涨几个点就敢吹半年。DeepSeek这波是直接把牙膏管扔了往你脸上怼牙膏。2.3 为啥这招对智能体这么好使智能体任务和普通聊天不一样不是光会接话就行。要会调用工具要懂多步推理错了还得会自己圆回来。这些本事预训练的时候基本学不着。就像你背了十年字典不代表你会写代码。后训练就是专门喂这类实操轨迹数据喂多了自然就开窍了。说白了就是针对性刷题提分当然快。3. 难道大参数就彻底没用了3.1 Pro依然稳赢的几个场子先别急着喊“大参数已死”Pro也不是全输了。事实知识问答Pro领先二十多分优势巨大。百万级长上下文检索Pro的表现也更稳。特别复杂的深度推理Pro的上限还是更高。毕竟块头在那摆着装的知识多底子厚。就像偏科学霸实操课翻车但考知识点照样拿第一。3.2 本质就是个时间差说穿了很简单Flash更了新的后训练Pro还没更。一个补过课刷过题一个还停留在开学摸底考的水平。不是大参数没用是大参数没来得及点智能体这个技能点。等Pro后续也补上这套后训练该赢的地方还是能赢回来。4. 最后说两句实在的以前大家聊模型张口闭口就是参数量觉得越大越牛。这事儿之后这话得改改了。参数规模是底子但训练质量才是真正的战斗力。堆硬件堆参数谁都会把现有潜力挖透才是真本事。以后选模型别光看参数表吹牛皮。先看看你要干啥活再看看模型有没有针对性练过。毕竟适合的才是最好的。P.S. 无意间发现了一个巨牛的人工智能教程非常通俗易懂对AI感兴趣的朋友强烈推荐去看看传送门https://blog.csdn.net/qq_34419312
返回列表