
(AI云资讯消息)谷歌正式发布 Gemini 3.8 Flash,距上一代模型推出仅隔几周。谷歌表示,这款新模型相比 Gemini 3.7 Flash 算力投入更高,能够针对复杂任务执行更多推理步骤,并可 循环调用工具。该模型初始定价与 3.7 Flash 保持一致,输入token每百万 0.75 美元、输出token每百万 3.75 美元,但用户最终使用成本仍有可能上升。谷歌提醒:“为实现最佳性能,该模型可能会消耗更多token,高算力档位下尤为明显。” 如果开发者希望控制token消耗量,可继续选用 Gemini 3.7 Flash。
Gemini 3.8 Flash 发布后,网上随即出现了一批初步评测反馈。人工智能分析机构 Artificial Analysis 针对该模型的定价作出点评,称 Gemini 3.8 Flash 是目前我们测评过的、同等智能水平下成本最低的模型。虽然单token定价维持不变,但相较于 Gemini 3.7 Flash,单次任务开销上涨约 40%;造成该现象的原因是每项任务的输出token量提升 30%,并且智能体评估环节中交互轮次有所增加。”
Aigora.ai 首席执行官约翰・恩尼斯(John Ennis)将 Gemini 3.8 Flash 与 Anthropic 旗下模型进行对比,称其具备Opus 5 级别的代码生成质量,成本却仅为Opus 5的一小部分,并且运行速度极快”。他还补充道:“该模型在制作远程演示视频这类场景中将大有可为。”
谷歌表示,Gemini 3.8 Flash 在软件工程与自主智能体两大领域实现 大幅提升。在 DeepSWE v1.1 软件工程基准测试中,该模型性能超越上一代产品以及多款前沿模型,其中便包括 Anthropic 的 Fable 5。就在前几天,Fable 5 完成更新升级,通过下调缓存数据调用费用,同样实现了以更低成本换取更强性能的目标。
谷歌这款新模型在 Vals Finance Agent V2 金融智能体基准测试以及哈维法律智能体基准测试中的表现同样优于竞品。与此同时,该模型内置安全防护机制,可防范其被滥用于化学、生物、辐射、核(CBRN)领域以及网络攻击活动。
谷歌在推出全新 Fairwind 计划的同时,发布了 Gemini 3.8 Flash Cyber 版本。该计划仅面向各国政府及受信任的合作方开放。计划目前已有 650 家成员,包括克劳德斯特莱克(CrowdStrike)与互联网安全中心。加入成员可使用 Gemini 3.8 Flash Cyber 以及谷歌智能体 CodeMender。谷歌称,CodeMender 能够 自主查找并修复漏洞,为关键基础设施、公共服务以及国家安全提供防护。普通用户订阅 Google AI Pro 或 Ultra 套餐后,现已可使用 Gemini 3.8 Flash;开发者与企业用户也同步开放访问权限。