谷歌加速Gemini迭代:三周内再推3.8 Flash,主打编程与自动修复
TREE NEWS 报道, 美东时间9月2日,谷歌宣布推出Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款新模型,距离上一代3.7 Flash发布仅三周。谷歌称这是其迄今“最强的推理和编程模型”,重点提升长周期编程、智能体工作流与复杂推理,网络安全版则瞄准漏洞发现和自动修复。独立评测机构Artificial Analysis指出,这是谷歌不到四个月内推出的第四款Flash模型,也是六周内的第三次发布。
价格方面,谷歌延续低价策略:3.8 Flash的引导价格与3.7 Flash相同,每百万输入Token 0.75美元、输出Token 3.75美元,优惠持续至年底。但Artificial Analysis评测显示,3.8 Flash高推理档每项任务实际成本约0.58美元,较3.7 Flash的0.40美元高约40%,原因是新模型平均输出Token数量增加约30%,且智能体交互轮数增多。其综合智能指数得分59分,较上代提高3分,输出速度约305 Token/秒。
从代码生成转向自主智能体
3.8 Flash的核心升级是从单次代码生成转向长周期软件工程和自主智能体。谷歌表示,该模型在DeepSWE v1.1长周期软件工程测试中能自主解决复杂问题并完成端到端任务,表现超过多数规模更大的前沿模型。在金融、法律等专业领域的智能体测试中也有提升,HLE-Verified得分达54.9%。模型在复杂任务上会执行更多推理步骤、反复调用工具,并通过长时间运行的智能体循环自我评估和优化。演示案例包括仅凭提示生成可运行的3D游戏、生成DOS版Google Maps等。
网络安全模型与Fairwind计划
Gemini 3.8 Flash Cyber专攻防御性安全,具备“前沿水平”的漏洞发现和自动修复能力。在谷歌内部覆盖20种语言的真实漏洞测试中,成功率超70%;在CWE-Bench自动补丁测试中,pass@1达47.2%,接近领先模型的47.8%但成本更低。实际案例中,Chrome安全团队发现其生成的正确补丁数量是更大商业模型的2.6倍;Wiz内部测试显示其召回率比其他前沿模型高7.5至9.7%,成本低2.3至5.2倍;谷歌云漏洞研究团队甚至利用该模型在不到两小时内发现了一项关键基础设施漏洞。
随模型发布,谷歌还推出Fairwind计划,这是一个限制访问的项目,面向政府机构、关键基础设施运营商和大型企业,参与者可使用3.8 Flash Cyber结合CodeMender工具实现漏洞发现、验证和自动修复。目前已有超过650家全球合作伙伴,覆盖医疗、电信、能源、金融等领域。
市场影响分析
AI竞争从模型规模转向智能体经济性。谷歌的快速迭代和低价策略表明,其押注“更便宜的智能体”能够推动企业采纳。这对OpenAI、Anthropic等竞争对手构成压力,迫使其证明更高定价的合理性。对英伟达和云厂商而言,智能体使用增加可能提升算力需求,但Token消耗增加也提高了开发者的实际成本。
网络安全AI成为新战场。3.8 Flash Cyber和Fairwind计划瞄准自动化漏洞发现和修复这一高价值细分市场,可能对传统安全软件厂商(如CrowdStrike、Palo Alto Networks)形成颠覆。政府和关键基础设施的采纳可能加速,但也引发关于AI驱动安全行动的监管问题。
Token经济学与开发者成本。尽管单价未变,但实际任务成本因Token使用量增加而上升40%。这可能挤压依赖Gemini API的初创企业利润,迫使其转向更便宜模型或自托管方案。谷歌提供不同推理档位,开发者需优化成本。
投资者要点
- 谷歌的激进迭代(四个月四款Flash模型)加剧AI竞争,可能削弱竞争对手的定价权。
- 关注企业级智能体采纳——这可能推动谷歌云和Azure的收入增长,但也会增加初创企业的API成本。
- 网络安全AI细分市场增长迅速;关注传统安全厂商对AI原生威胁检测和修复的应对。
- 谷歌的定价策略可能压缩AI基础设施提供商的利润率,如果推理成本下降速度快于需求增长。



