Aioga
AI资讯 / 模型更新
返回 AI资讯

Gemma 4 静默更新:修复工具调用错误并提升 Hopper GPU 性能

The Decoder:AI News(RSS)Aioga 编辑团队2026-07-16T09:07:58.000Z热度 48

Google 为开源模型 Gemma 4 推送更新,在 Nvidia Hopper GPU 上启用 Flash Attention 4 后,提示词处理速度提升 25-70%,首...

模型更新The Decoder:AI News(RSS)

今日 AI 情报摘要

Google 为开源模型 Gemma 4 推送更新,在 Nvidia Hopper GPU 上启用 Flash Attention 4 后,提示词处理速度提升 25-70%,首 token 延迟降低 31%。

更新还修复了工具调用错误和响应截断问题,Gemma 4 31B 在电信场景的智能体推理性能提升 10.1%。

中文正文 · AI 翻译

谷歌发布了其开源 AI 模型 Gemma 4 的更新,该更新加快了在 Nvidia Hopper GPU 上的性能,修复了工具调用错误,并解决了回答被截断的问题。谷歌表示,开启 Flash Attention 4 可以将模型处理输入提示的速度提升 25% 到 70%。首次生成令牌的时间最多可减少 31%。谷歌还修复了工具调用功能中的错误,该功能允许模型自行触发外部工具。

Gemma 4 31B: BFCL 74,2 %(+0,4), TB2 25,8 %(+4,5), Tau2 Retail 77,6 %(+3,1), Airline 84 %(+2,0), Telecom 62,7 %(+10,1).

谷歌表示,还减少了模型回答被截断或返回不完整响应的情况。对于图像处理,用户可以手动将 "max_soft_tokens" 参数从 280 提高到 1,120,以获得更清晰的 OCR 结果,并支持最高 2.51 兆像素的分辨率。谷歌在 Hugging Face 上提供了一个互动配置器:https://huggingface.co/spaces/google/gemma4_vision_token_budget。已发布的基准测试仅比较了 31B 和 E4B 版本与其前代模型的性能,但 Hugging Face 仓库:https://huggingface.co/collections/google/gemma-4 显示该代模型所有参数大小都已更新,包括最新的 12B 版本:https://the-decoder.com/google-deepminds-gemma-4-12b-squeezes-multimodal-ai-on-to-a-laptop-with-just-16-gb-of-ram/。社区对谷歌以相同的 "Gemma 4" 名称发布更新表示不满,而不是将其标记为单独的版本,如 "Gemma 4.1":https://the-decoder.com/googles-gemma-4-is-now-available-with-apache-2-0-licensing-for-the-first-time/。

保持 AI 动态。内容清晰、有用,无废话。

关注 The Decoder 获取 AI 新闻、背景故事和专家分析。

The Decoder:https://the-decoder.com/

情报判断

Aioga 编辑摘要

Aioga 编辑摘要:Google 为开源模型 Gemma 4 推送更新,在 Nvidia Hopper GPU 上启用 Flash Attention 4 后,提示词处理速度提升 25-70%,首 token 延迟降低 31%。 Aioga 将其归入「模型更新」方向,重点关注它对真实使用和行业竞争的影响。

背景分析

背景分析:模型与研究类动态需要结合能力边界、开放方式、成本、可用性和真实任务表现判断,单项指标领先不等于已经形成稳定采用。

Aioga 观点

Aioga 判断:这条动态更适合作为行业观察信号,当前信息足以建立线索,但不足以推导长期结论。

影响与后续

影响分析:对相关团队而言,短期应先核对来源、可用范围和实际成本,再判断是否值得接入或跟进。 后续观察:继续观察官方文档、实际可用性、价格变化、开发者反馈和竞品回应。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: RSS · 原始域名: the-decoder.com

来源: The Decoder:AI News(RSS)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-07-16T09:07:58.000Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

Google 为开源模型 Gemma 4 推送更新,在 Nvidia Hopper GPU 上启用 Flash Attention 4 后,提示词处理速度提升 25-70%,首...

The Decoder:AI News(RSS)2026-07-16T09:07:58.000Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。