3.3
深览指数
科技腾讯新闻·新智元··AI 生成
DeepSeek V4「满血版」曝光了!
文章预告 DeepSeek V4 正式版即将发布,并披露了灰度测试信息、民间验证方法、性能评测、定价策略等。核心信息是:V4 包含 Flash 和 Pro 两个版本,性能接近 Opus 级别,但价格仅为对手的七分之一,并首次引入「峰谷计费」。文章主要基于网络爆料和开发者体验,适合关注大模型动态、性价比和定价策略的读者快速了解行业热点。原文 ↗
核心观点
- ▍DeepSeek V4 正式版即将发布,主要看点不是性能领先,而是将 Opus 级性能的价格压到对手的七分之一,延续「价格屠夫」策略,并首次引入峰谷计费模式。
- 01文章引用网络爆料,称 V4 包含 DeepSeek V4 Flash 和 DeepSeek V4 Pro 两个版本,部分用户已提前获得灰度测试权限。
- 02博主 AiBattle 提供了一个民间验证方法:通过观察模型思考过程(CoT)的第一人称是否为「I'm」或「I'll」来判断是否使用了 V4 GA 版。
- 03开发者 Pankaj Kumar 体验后总结:V4 整体表现接近 Opus 4.8 级别,编码能力直追 GPT-5.6 Sol,Agent 能力大幅增强,但同一任务迭代轮数比 Fable 5 多。
- 04文章展示了多款 V4 生成的游戏 Demo,如 3D 模拟射击游戏、《我的世界》+《无人深空》混合游戏、割绳子游戏等,以证明其生成能力。
- 05DeepSeek 向 API 用户发送邮件,称 V4 正式版上线后将引入「峰谷计费」:V4 Pro 百万输出 tokens 平时 0.87 美元,高峰 1.74 美元;V4 Flash 平时 0.28 美元,高峰 0.56 美元。
- 06文章对比了定价:相比 Fable 5 百万输出定价 50 美元,V4 性价比更高;V4 预览版在 SWE-bench Verified 评测中,距 Claude Opus 4.6 Max 仅差 0.2 个百分点,但价格仅为对方七分之一。
反方 / 局限
- — 文章承认 V4 大概率不是「全项第一」,Fable 5 和 GPT-5.6 Sol 在前,Kimi K3 在侧,V4 想靠纯性能挑战难度很大。
- — 部分开发者在首轮测试后指出,V4 Pro 版并未比 Flash 版领先太多,且 V4 在长上下文检索、专业软件工程和部分知识推理评测中落后于 Claude Opus。
DeepSeek V4DeepSeek V4 FlashDeepSeek V4 ProFable 5GPT-5.6 SolKimi K3Claude Opus 4.6 MaxAiBattlePankaj KumarSWE-bench Verified
6 分钟 · 4 卡片 · 10 资料
读原文 →