今日 AI 热搜 · 科普漫画

同一个模型,换个学法就开挂?

选题:AI 热搜「DeepSeek-V4-Flash 正式版 · 后训练」

1第1格

大雄兴奋地举手机:「哆啦A梦,你听说了没,DeepSeek-V4-Flash,能力媲美顶级模型,价格还便宜?」哆啦A梦点破:「听说了!但你肯定不知道——它骨架一点没换,全靠『后天教育』开了挂。」

2第2格

哆啦A梦亮两张卡片:预训练=先天脑子(2840亿参数骨架原封不动),后训练=后天教育(精细调优)。同一副脑子,换个学法,直接从学渣变学霸。

3第3格

证据来了:Agent 能力 DeepSWE 7.3→54.4,暴涨 6 倍;价格只要 0.2 元/百万 token,顶级模型的零头;还能一口气读 100 万字的上下文。大雄:那普通人也能用得起了?

4第4格

金句收尾:AI 不是越堆越大才强,『调教』对了,小模型也能干大事。聪明的不是参数,是后训练。

今日资讯

今日资讯来源 · DeepSeek-V4-Flash 正式版

> 本页为《同一个模型,换个学法就开挂?》漫画的事实底稿。所有数据均来自下方「来源清单」,漫画中的夸张表达与原文事实的对应关系见文末对照表。

事件速览

2026 年 7 月 31 日,DeepSeek 通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版上线公测。仅隔一天,Artificial Analysis 与 Arena.ai 两大评测平台同步更新基准结果。8 月 1—2 日,国内媒体密集报道:一个「廉价版」模型,Agent 能力却比三个月前的 Pro 预览版高出数倍,而价格低到个人开发者也用得起。

最让人意外的是:这次升级模型骨架一字未改,只重做了「后训练」。官方确认 V4-Flash-0731 的模型结构、尺寸与预览版完全一致,仅完成新一轮后训练优化——换句话说是「后天教育」带来的脱胎换骨。

关键事实核对

以下为漫画中出现的数字与结论,均可在来源中查证:

来源清单

四格 ↔ 新闻要点对应

画面事实依据说明
1大雄惊讶「便宜又强」,哆啦A梦点破「骨架没换、靠后天教育」模型结构/尺寸与预览版完全一致,仅后训练原文核心反差,事实准确
2预训练=先天脑子 / 后训练=后天教育2840 亿参数骨架原封不动 + 后训练优化教学化类比,概念准确
3DeepSWE 7.3→54.4、0.2 元/百万 token、100 万上下文DeepSWE、价格、上下文均为公开数据数字均来自来源,准确
4金句「聪明的不是参数,是后训练」后训练带来能力跃迁的现象总结观点性收尾,非原文引述

延伸选题

待修正 / 备注

返回合集