Lazy loaded image
Gemini 3.8 Flash 发布:六周第三弹,编码能力登顶
字数 1022阅读时长≈ 3 分钟
2026-9-3
2026-9-3
9 月 2 日,Google 发布 Gemini 3.8 Flash——六周之内的第三个 Flash 版本。这一次的主角不是「更大」,而是「更努力」:Google 称新模型会在复杂任务上执行更多推理步骤、迭代式调用工具,编码能力登上 DeepSWE 软件工程排行榜第一;同时登场的还有网络安全专用版 Gemini 3.8 Flash Cyber。同一时间,传闻中的 Gemini 3.5 Pro 依然没有消息。

六周三连发:Flash 快跑,Pro 缺席

自 2026 年初以来,Google 再没有发布过前沿级的 Gemini Pro 模型,但 Flash 系列几乎以每两周一个的速度迭代。两周前刚发布 3.7 Flash,如今 3.8 Flash 接踵而至。Google 内部据传因编码性能无法与竞品匹敌而推迟了 3.5 Pro,如今 Flash 系列自己站上了与市场头部模型同台竞争的舞台——以远低于旗舰的价格。

编码登顶 DeepSWE,价格只有旗舰的零头

Google 公布的基准显示,Gemini 3.8 Flash 已位列 DeepSWE 排行榜榜首——该榜单衡量模型解决复杂软件工程问题的能力。独立评测机构 Artificial Analysis 的评价更为直白:以这个智能水平衡量,3.8 Flash 是他们测过最便宜的模型;智能水平相较 3.7 Flash 提升约 40%,而单任务输出 token 增加约 30%。Aigora.ai 的 CEO 则把它与 Anthropic 对比:「Opus 级别的编码质量,但成本只是零头,速度还快。」

「更努力」的代价:定价没变,账单可能更贵

3.8 Flash 延续了 3.7 Flash 的入门价:每百万输入 token 0.75 美元、输出 token 3.75 美元(年底前有效,之后恢复 1.50 / 7.50 美元)。但 Google 明确提醒:「模型为了最大化性能可能消耗更多 token,尤其是在高努力级别下。」也就是说,单价不变,但一次任务的 token 用量上去了,实际支出可能比 3.7 Flash 高出约 40%。想省 token 的开发者可以继续留在 3.7 Flash。

Cyber 版:给政府和安全团队的漏洞猎人

Gemini 3.8 Flash Cyber 基于同一底座,专门针对漏洞检测与修复调优,取代此前的 3.5 Cyber 版。Google 给出的内部数据相当亮眼:Chrome 安全团队看到补丁准确率提升 2.6 倍;Cloud 团队用它在两小时内发现了一个关键漏洞;Wiz、Palo Alto Networks 等安全厂商也为其背书。该版本目前仅向可信测试者与政府开放,并纳入 Google 新推出的 Fairwind 计划。

局限与观察

并非所有领域都领先:在 OSWorld-2.0 电脑代理使用测试中,3.8 Flash 较 3.7 有进步,但仍明显落后于市场标杆 Claude Opus(GPT 在该项测试表现也不佳)。3.8 Flash 今天起在 Google 生态全线可用,Gemini 应用内需要 Pro 或 Ultra 订阅,AI Studio 则免费可玩。对开发者而言,真正的信号是:模型竞争已从「参数越大越好」转向「在合理成本内做到顶尖」——Flash 系列正在证明这条路走得通。
🤖
一句话总结:Gemini 3.8 Flash 用旗舰级的编码能力、1/10 的价格和一个更烧 token 的脾气,把「够用且便宜」的模型竞争推到了新高度;而 3.8 Flash Cyber 的出现,则预示着 AI 安全即将成为各家模型军备竞赛的下一个主战场。

参考来源

  • Ars Technica:Google releases Gemini 3.8 Flash, its third Flash model in six weeks(2026-09-02)
  • The Verge:Google says its new Gemini 3.8 Flash model 'works harder' but might cost more(2026-09-02)
  • Artificial Analysis 独立评测数据(经 The Verge 引用)
上一篇
GPT-6 Astra 发布:首个「关键级」网络能力模型
下一篇
Vision Pro首次获FDA授权进手术室,Stryker完成首例临床应用