科技腾讯新闻·21世纪经济报道··AI 生成
DeepSeek又发重磅更新,行业梦回2025年春天
DeepSeek 于 7 月 31 日低调上线 V4-Flash 正式版,在总参数和激活参数均未增加的情况下,其代码和智能体能力大幅超越自家 1.6 万亿参数的 V4-Pro 预览版,逼近全球顶尖模型。这再次挑战了“规模法则”的惯性认知,但文章指出,这并非“规模法则”失灵,而是后训练、智能体专家训练等工程创新的叠加。此举将 AI 性价比推至“临界点”,可能使更多软件公司从“AI 利空”转向“AI 受益”,并让创始人梁文锋站在了“所有模型玩家的对立面”。原文 ↗原文 ↗
核心观点
- ▍DeepSeek V4-Flash 正式版在参数不变的情况下,通过后训练和智能体专家训练等工程创新,实现了“突变式”能力跃升,再次挑战了最近流行的“堆参数”逻辑惯性。
- 01V4-Flash 正式版在九项智能体与代码基准得分上,全部超过自家 1.6 万亿总参数的 V4-Pro 预览版,其中在“DeepSWE”基准上分差达 41.6 分。
- 02V4-Flash 正式版仅使用了 Pro 预览版六分之一的总参数和不到四分之一的激活参数,便实现了反超。
- 03在“ALE”基准上,V4-Flash 正式版与全球顶级的 Claude Opus 4.8 仅差半分,但其输入和输出价格仅为后者的数十分之一。
- 04文章提到,部分欧美公司已开始将中国大模型用于大部分普通任务,仅在复杂任务时调用顶尖模型,原因是成本低且使用权限可控。
- 05天风证券计算机团队认为,DeepSeek 的性价比已足以让软件公司本身使用并提效,过去因 Token 成本太高而无法实现的 AI 智能体需求将变为现实。
反方 / 局限
- — 部分海外开发者指出,V4-Flash 正式版存在输入缓存命中率低、安全分类器超时等问题,反映出算力和参数储备不足仍是模型能力上限的瓶颈。
- — 梁文锋在融资会议纪要中表示,规模法则远未到上限,国内模型规模受限只是算力不足,并非规律走到尽头。
概念锚点
前置背景
平行视角
未来推演
延伸追问