Aioga
AI资讯 / 行业动态
返回 AI资讯

Google 发布 Gemini 3.8 Flash,推理更努力但 token 用量可能更高

The Verge:AI(RSS)Aioga 编辑团队2026-09-02T20:11:40.000Z热度 58

Google 发布 Gemini 3.8 Flash,称其比 3.7 Flash 在复杂任务上执行更多推理步骤并迭代调用工具,定价维持每百万输入 token $0.75、输出...

行业动态The Verge:AI(RSS)

今日 AI 情报摘要

Google 发布 Gemini 3.8 Flash,称其比 3.7 Flash 在复杂任务上执行更多推理步骤并迭代调用工具,定价维持每百万输入 token $0.75、输出

$3.75,但警告模型可能消耗更多 token 导致实际成本上升。

中文正文 · AI 翻译

谷歌推出了 Gemini 3.8 Flash:https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/,距离其前身上市仅几周时间:/tech/979735/gemini-spark-is-now-powered-by-googles-upgraded-flash-model。公司声称,新模型比 Gemini 3.7 Flash“工作更努力”,在复杂任务上执行更多推理步骤并“迭代调用工具”。其入门定价与 3.7 Flash 相同,每百万输入令牌 $0.75,每百万输出令牌 $3.75,但仍可能让用户支付更多费用。谷歌警告称,“该模型可能会使用更多令牌以最大化性能,尤其是在更高努力级别。”如果开发者想减少令牌使用量,可以继续使用 Gemini 3.7 Flash。

Gemini 3.8 Flash 推出后,网上出现了一些早期评价。Artificial Analysis:https://x.com/ArtificialAnlys/status/2095177422270607803?s=20 强调了该模型的定价,表示 Gemini 3.8 Flash 是“我们在这个智力水平上测量到的最便宜的模型。尽管每令牌定价未变,但相比 Gemini 3.7 Flash,成本上涨约 40%,这主要是由于每个任务的输出令牌增加了 30% 以及代理评估次数增加所致。”

Aigora.ai CEO John Ennis:https://x.com/johnennis/status/2095182837112508749?s=20 将 Gemini 3.8 Flash 与 Anthropic 的模型进行了比较,称它提供“Opus 5 级别的编码质量,但成本仅为一小部分且速度超快”,并补充道:“这对于制作远程视频等用途将非常棒。”

谷歌表示,Gemini 3.8 Flash 在软件工程和自主 AI 代理方面提供了“显著改进”。在 DeepSWE v1.1 软件工程基准测试中,它的表现优于其前身以及其他前沿模型,包括本周早些时候升级的 Anthropic 的 Fable 5:/ai-artificial-intelligence/987830/anthropic-claude-fable-mythos-5-1,该升级也承诺通过降低使用缓存数据的价格,实现更强性能和更低成本。

谷歌的新模型在 Vals Finance Agent V2 基准测试和 Harvey 的法律代理基准测试中也表现优于竞争对手。不过,该新模型还“配备了针对化学、生物、放射性和核(CBRN)领域以及网络攻击不当使用的安全防护措施。”

谷歌还发布了 Gemini 3.8 Flash Cyber,同时推出了其新的 Fairwind 计划:https://blog.google/innovation-and-ai/technology/safety-security/fairwind-program/,该计划仅限于政府和“可信合作伙伴”。该计划拥有 650 名成员,包括 CrowdStrike 和 网络安全中心(Center for Internet Security),提供对 3.8 Flash Cyber 和谷歌的 CodeMender 代理的访问,谷歌表示该代理可以帮助“自主发现和修复漏洞,保护关键基础设施、公共服务和国家安全。” Gemini 3.8 Flash 现在可供拥有 Google AI Pro 或 Ultra 订阅的消费者、开发者和企业用户使用。

Stevie Bonifield

情报判断

Aioga 编辑摘要

Google 发布 Gemini 3.8 Flash,称其在复杂任务中执行更多推理步骤并迭代调用工具。输入定价为每百万 token 0.75 美元、输出定价为每百万 token 3.75 美元,但模型可能消耗更多 token。

背景分析

来源明确称,Gemini 3.8 Flash 在 DeepSWE v1.1 软件工程基准上超过前代及其他前沿模型,并在 Vals Finance Agent V2 和 Harvey’s Legal Agent 基准上超过竞争对手。模型还配备针对 CBRN 和网络攻击滥用的安全防护。

Aioga 观点

Aioga 判断:标价维持不变并不等于单项任务成本不变。更高的推理投入和迭代工具调用,可能让复杂任务获得更多处理,但也需要结合实际 token 用量评估其经济性。

影响与后续

可能影响:采用较高努力等级或代理式流程的用户可能面临更高 token 消耗。开发者需要监控任务级用量与预算,并区分不同基准的比较范围;来源信息不足以证明新模型在所有任务中都更经济。 后续观察:需要关注 Google 后续披露的不同努力等级下 token 消耗和成本表现,以及开发者对 DeepSWE v1.1、Vals Finance Agent V2 和 Harvey’s Legal Agent 结果的独立验证,同时留意 Gemini 3.8 Flash Cyber 的限定使用范围。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: RSS · 原始域名: theverge.com

来源: The Verge:AI(RSS)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-09-02T20:11:40.000Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

Google 发布 Gemini 3.8 Flash,称其比 3.7 Flash 在复杂任务上执行更多推理步骤并迭代调用工具,定价维持每百万输入 token $0.75、输出...

The Verge:AI(RSS)2026-09-02T20:11:40.000Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。