Mozilla 第二版《开源 AI 现状》报告:中美最佳模型能力差距缩至 4.4 个月 这条更新来自 ithome.com,发布时间为 2026-09-16,Aioga 保留原文入口以便核验。

摘要:Mozilla 9 月 15 日发布第二版《开源 AI 现状》报告,称中国最佳开放权重模型与美国前沿闭源模型的能力差距已缩至 4.4 个月。
背景:背景分析:模型与研究类动态需要结合能力边界、开放方式、成本、可用性和真实任务表现判断,单项指标领先不等于已经形成稳定采用。

Aioga 观察:Aioga 判断:这条动态更适合作为行业观察信号,当前信息足以建立线索,但不足以推导长期结论。

影响与后续:影响分析:对相关团队而言,短期应先核对来源、可用范围和实际成本,再判断是否值得接入或跟进。 后续观察:继续观察官方文档、实际可用性、价格变化、开发者反馈和竞品回应。
IT之家:https://www.ithome.com/ 9 月 16 日消息,Mozilla 昨日(9 月 15 日)发布第二版《开源 AI 现状》报告,报道称中国公司最佳开放权重模型与美国科技公司的前沿闭源模型, 能力差距已缩至 4.4 个月。

相比较今年 7 月发布的第一版《开源 AI 现状》报告,第二版报告把宏观判断进一步落到了具体模型、具体任务时长和单任务成本上。
第二版报告重点提及了月之暗面的 Kimi K3 模型,在 Artificial Analysis 智能指数上的得分仅比 Anthropic 的 Fable 5 低三分,而成本却仅为后者的约 30%。

在能力范围方面,METR 以模型可靠完成任务的时长衡量“时间范围”,可靠成功率标准为 50%。目前,最佳闭源模型可完成的任务时长,是最佳开放模型的 1.7 倍。开放模型可处理 7 小时任务,闭源模型可处理约 12 小时任务。

Mozilla 首席技术官 Raffi Krikorian 将这一差异定性为取决于具体任务场景:闭源模型的溢价主要体现在需要 8 到 12 小时才能完成的专业型任务上,而开源模型则能以极低的价格处理日常工作。
Krikorian 称,4 个月后开放模型可处理 12 小时任务,闭源模型可处理约 20 小时任务。目前,8 至 12 小时任务通常仍是闭源模型可完成、开放模型尚难处理的区间。
这一转变已经开始重塑企业的使用行为。DoorDash 目前已采用 Kimi 处理日常任务,同时将 Fable 保留用于更复杂的工作。2026 年 8 月,路由平台 OpenRouter 上按 token 用量排名前十的模型中,有八个为开源模型。
点此前往阅读第二版《开源 AI 现状》:https://stateofopensource.ai/
《Mozilla 发布 2026 开源 AI 报告:DeepSeek V4 Flash 全球月用量 18.4T Tokens 登顶:https://www.ithome.com/0/976/962.htm》