7.0
深览指数
科技虎嗅·AppSo··AI 生成
刚刚,Gemini3.6 Flash 正式发布,但网友笑得更大声了
Google 发布 Gemini 3.6 Flash 等三款新模型,主打更省 token 和更低价格,但第三方评测与网友反馈显示其智能水平相比 3.5 Flash 几乎原地踏步,性价比甚至不如对手。文章揭示了旗舰模型 3.5 Pro 因代码能力未达预期而跳票重训的内幕,以及 Google 靠画饼 Gemini 4 转移视线的舆论策略。适合关注 AI 模型行业动态、对 Google 技术路线与市场竞争格局感兴趣的读者,用作了解 Gemini 当前困境与争议的快速入口。原文 ↗
核心观点
- ▍Google 最新发布的 Gemini 3.6 Flash 模型在智能水平上相比前代 3.5 Flash 基本没有提升,仅靠降低 token 消耗和价格来维持竞争力,引发网友广泛吐槽,被视为一次“不争气”的发布。
- 01Gemini 3.6 Flash 官方定位为“主力”模型,主要卖点是省 token:比 3.5 Flash 少用 17% 的输出 token,在 DeepSWE 场景可省 65%。
- 02价格方面,3.6 Flash 输出价格为 7.5 美元/百万 token,低于 3.5 Flash 的 9 美元。
- 03基准测试显示,3.6 Flash 代码能力有提升:DeepSWE 从 37% 到 49%,MLE Bench 从 49.7% 到 63.9%。
- 04第三方评测机构 Artificial Analysis 指出,3.6 Flash 的智能水平相比 3.5 Flash 基本原地踏步,得分相同。
- 05网友 Angel 对比称,Gemini 3.6 Flash 的使用成本比 GPT-5.6 Sol medium 更高,但智能程度更低,性价比尴尬。
- 06据彭博社等媒体报道,旗舰模型 Gemini 3.5 Pro 因代码生成能力未达内部预期,训练方案被推翻重训,发布延迟。
反方 / 局限
- — 文章提到,虽然官方强调 3.6 Flash 更高效便宜,但多位网友实际测试反馈其性能比 3.5 Flash 更差,包括基础解码错误、中文选词离谱、图像生成质量差等问题。
- — 文章暗示,Google 在 3.5 Pro 跳票后,将宣传重点转向 Gemini 4,有“画饼续命”和转移舆论压力的嫌疑。
Gemini 3.6 FlashGemini 3.5 FlashGemini 3.5 ProGemini 4GoogleArtificial Analysis IndexDeepSWEMLE BenchLogan KilpatrickOpenAIAnthropic
15 分钟 · 4 卡片 · 10 资料
读原文 →