谷歌三周内再推Gemini 3.8 Flash:价格不变、编程能力逼近前沿大模型,网络安全版Flash Cyber仅向防御方开放
谷歌9月2日发布Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。距3.7 Flash仅三周,新Flash价格不变、速度相同,谷歌称其在DeepSWE v1.1等编程基准上逼近甚至超过更大的前沿模型。Flash Cyber专攻漏洞检测与自动修补,Chrome团队称其正确补丁数是顶级商用模型的2.6倍,但仅通过Fairwind计划向政府和关键基础设施等防御方开放。
谷歌9月2日在X平台发帖宣布推出Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款新模型。距3.7 Flash发布仅三周,Flash系列再度更新,价格保持不变,而按谷歌自己的说法,其编程能力已逼近更大规模的前沿模型(frontier model)。GlobalFeed 8月31日在泄露时间表一文中曾预告该模型将至,如今得到证实。
Gemini 3.8 Flash:价格不变,编程逼近大模型
谷歌称,3.8 Flash在软件工程、智能体(agentic)任务和多步推理上较3.7 Flash显著提升,速度与成本相同。据谷歌官方博客和Gemini API负责人Logan Kilpatrick,该模型在长程软件工程基准DeepSWE v1.1上得分73.7%,超过更大的前沿模型;在Vals Finance Agent V2和Harvey Legal Agent上超越3.7 Flash,HLE-Verified得分54.9%。价格方面,2026年12月31日前维持每百万token输入0.75美元、输出3.75美元,此后调整为1.50美元和7.50美元。开发者可通过Antigravity、Google AI Studio和Android Studio使用,企业用户通过Gemini Enterprise,Google AI Pro和Ultra订阅者可在Gemini应用、搜索AI模式和Google Sheets中使用。需要说明的是,谷歌高管在对比中提及Claude Opus,而GlobalFeed的写作引擎基于Claude,上述对比均为谷歌单方面说法。
Flash Cyber:仅向防御方开放
Flash Cyber是面向防御方的专用模型,主打漏洞检测(vulnerability detection)与自动修补。谷歌自报成绩:CyberGym漏洞发现86.2%,CWE-Bench修补47.2%,覆盖20种编程语言的内部基准成功率超过70%。Chrome安全团队称,该模型为Chrome漏洞生成的正确补丁数量,是规模大得多的顶级商用模型的2.6倍。谷歌表示,大型前沿模型昂贵且慢,小模型又难以处理复杂代码修复,而Flash Cyber可在数分钟内、在机构自己的云环境中生成可部署的安全补丁。该模型不公开发布,仅通过Fairwind计划向政府机构、关键基础设施运营方和软件维护者提供,需提交申请。这与OpenAI近日将Astra的网络能力定为“关键”级别并限制发布的做法处于同一条线上。
三周两代Flash,价格不动,能力上探,谷歌正在用小模型挤压大模型的空间;而把最锋利的网络安全模型只交给防御方,OpenAI和谷歌先后做出了同样的选择。