Skip to content

Gemini 3.8 Flash 最新消息:长程编程、智能体与网络安全模型详解

最后更新时间:2026年9月9日

Google 在 2026 年 9 月 2 日发布了 Gemini 3.8 Flash 和面向网络防御的 Gemini 3.8 Flash Cyber。这次更新的重点不是单纯扩大模型规模,而是让模型在长时间、多步骤的工作中更愿意“多想几步”:持续调用工具、检查中间结果,并在必要时修正方案。

本文依据 Google 官方公告整理。价格、开放范围和模型能力可能继续调整,接入生产环境前请以 Google Gemini 模型文档 为准。

一句话结论

  • 普通用户和大多数开发者:Gemini 3.8 Flash 是本轮真正的主力型号,适合编码、资料分析和 Agent 工作流。
  • 安全团队:Gemini 3.8 Flash Cyber 专门面向漏洞发现与修复,目前通过 Fairwind 计划向受信任的防御方开放。
  • 成本敏感场景:3.8 Flash 在 2026 年 12 月 31 日前的介绍价为输入每百万 Token 0.75 美元、输出每百万 Token 3.75 美元。

一、这次到底发布了什么?

型号官方定位当前可用范围
Gemini 3.8 Flash通用工作模型,强化推理、编码、长程 AgentGemini App、AI Studio、API、Gemini Enterprise 等,按地区和套餐开放
Gemini 3.8 Flash Cyber网络安全专用模型,强化漏洞发现和自动修复通过 Google DeepMind 的 Fairwind 计划向受信任的政府、关键基础设施和软件维护者开放

两款模型共享同一套基础智能,但部署目标不同。Flash 面向广泛的生产任务,Cyber 则在网络安全场景采用更专业的训练和安全策略。

二、Gemini 3.8 Flash 强在哪里?

1. 更适合长程编程

Google 表示,3.8 Flash 在 DeepSWE v1.1 长程软件工程评测中,能够端到端解决复杂工程问题,并以较低成本接近甚至超过部分更大型的前沿模型。这里的“长程”并不是一次生成更长代码,而是能够连续完成定位问题、修改文件、运行工具、复查结果等步骤。

实际使用时,它更适合:

  • 阅读多个模块后定位 Bug;
  • 根据需求拆分任务并生成测试;
  • 配合 IDE、代码仓库和命令工具迭代修改;
  • 对复杂重构给出风险说明和验证步骤。

2. 推理会主动增加计算量

3.8 Flash 的设计取向是“在难题上投入更多工作”。当任务复杂时,模型可能执行更多推理步骤、反复调用工具,并消耗更多输出 Token,以换取更高的完成质量。开发者可以降低 effort 级别控制延迟和成本;如果首要目标是极致吞吐,仍可继续使用 3.7 Flash。

3. 专业领域分析更可靠

官方公告提到,3.8 Flash 在 Vals Finance Agent V2、Harvey Legal Agent Benchmark 等专业评测中优于 3.7 Flash,并在 HLE-Verified 上取得 54.9%。这些成绩说明它开始覆盖金融、法律和 STEM 等多步骤分析任务,但不代表模型可以替代专业人员做最终决策。

三、Flash Cyber 是什么?

Gemini 3.8 Flash Cyber 的目标是帮助防御者更快发现和修复漏洞,而不是提供面向攻击的自动化工具。

  • 在 CyberGym 漏洞发现评测中达到前沿水平;
  • 在覆盖 20 种编程语言的 Google 内部测试中,漏洞发现成功率超过 70%;
  • 在 CWE-Bench 自动修复评测中 pass@1 为 47.2%,接近领先前沿模型的 47.8%,但成本更低;
  • Google Chrome 安全团队称,它产出的正确漏洞补丁数量是大型商业模型最佳成绩的 2.6 倍。

这些数字来自 Google 公布的内部或合作方评测,不能直接等同于所有代码库中的真实成功率。安全团队仍应采用隔离环境、人工复核、回滚机制和完整审计日志。

四、价格与可用入口

3.8 Flash 的介绍价为:

项目2026年12月31日前2027年1月1日起
输入$0.75 / 1M Token$1.50 / 1M Token
输出$3.75 / 1M Token$7.50 / 1M Token

官方列出的体验和接入入口包括 Gemini AppGoogle AI Studio、Gemini API、Android Studio、Google Sheets 和 Gemini Enterprise。具体账号、地区、套餐和配额限制,以页面实际显示为准。

Flash Cyber 不在普通 API 用户的默认模型列表中,申请入口是 Fairwind Program。不要把网上出现的模型名称或第三方转发接口,误认为已经获得官方安全模型权限。

五、普通用户和开发者如何选?

如果任务是写作、翻译、学习、图片理解、代码问答或日常资料整理,优先从 Gemini 3.8 Flash 开始。需要长链路自动化时,再逐步提高推理 effort,并记录延迟、Token 消耗和人工修改率。

如果是安全团队的漏洞排查、补丁生成和代码审计,才考虑 Flash Cyber,并先确认是否符合 Fairwind 的申请条件。高风险系统不要直接让模型提交补丁或上线变更,应把模型输出当作候选方案交给工程师审核。

六、这次更新意味着什么?

Gemini 3.8 Flash 的信号很清晰:模型竞争正在从“单轮回答谁更聪明”,转向“谁能在真实工作流中稳定完成更多步骤”。更强的 Agent 能力会带来更高效率,也会放大工具权限、提示注入、数据泄露和错误执行等风险。

对个人用户,最直观的变化是模型更能处理复杂任务;对开发者,关键则是围绕 Token 预算、工具白名单、人工确认点和失败回滚设计完整流程。模型版本升级只是起点,可靠的产品仍需要评测集、监控和安全边界。

参考资料

Gemini 中文版博客