选题:AI 热搜「DeepSeek-V4-Flash 正式版 · 后训练」

大雄兴奋地举手机:「哆啦A梦,你听说了没,DeepSeek-V4-Flash,能力媲美顶级模型,价格还便宜?」哆啦A梦点破:「听说了!但你肯定不知道——它骨架一点没换,全靠『后天教育』开了挂。」

哆啦A梦亮两张卡片:预训练=先天脑子(2840亿参数骨架原封不动),后训练=后天教育(精细调优)。同一副脑子,换个学法,直接从学渣变学霸。

证据来了:Agent 能力 DeepSWE 7.3→54.4,暴涨 6 倍;价格只要 0.2 元/百万 token,顶级模型的零头;还能一口气读 100 万字的上下文。大雄:那普通人也能用得起了?

金句收尾:AI 不是越堆越大才强,『调教』对了,小模型也能干大事。聪明的不是参数,是后训练。
> 本页为《同一个模型,换个学法就开挂?》漫画的事实底稿。所有数据均来自下方「来源清单」,漫画中的夸张表达与原文事实的对应关系见文末对照表。
2026 年 7 月 31 日,DeepSeek 通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版上线公测。仅隔一天,Artificial Analysis 与 Arena.ai 两大评测平台同步更新基准结果。8 月 1—2 日,国内媒体密集报道:一个「廉价版」模型,Agent 能力却比三个月前的 Pro 预览版高出数倍,而价格低到个人开发者也用得起。
最让人意外的是:这次升级模型骨架一字未改,只重做了「后训练」。官方确认 V4-Flash-0731 的模型结构、尺寸与预览版完全一致,仅完成新一轮后训练优化——换句话说是「后天教育」带来的脱胎换骨。
以下为漫画中出现的数字与结论,均可在来源中查证:
| 格 | 画面 | 事实依据 | 说明 |
|---|---|---|---|
| 1 | 大雄惊讶「便宜又强」,哆啦A梦点破「骨架没换、靠后天教育」 | 模型结构/尺寸与预览版完全一致,仅后训练 | 原文核心反差,事实准确 |
| 2 | 预训练=先天脑子 / 后训练=后天教育 | 2840 亿参数骨架原封不动 + 后训练优化 | 教学化类比,概念准确 |
| 3 | DeepSWE 7.3→54.4、0.2 元/百万 token、100 万上下文 | DeepSWE、价格、上下文均为公开数据 | 数字均来自来源,准确 |
| 4 | 金句「聪明的不是参数,是后训练」 | 后训练带来能力跃迁的现象总结 | 观点性收尾,非原文引述 |