Aioga
AI资讯 / 技巧观点
返回 AI资讯

谁怕中国模型?--Kimi K3 逼近 SOTA,开源模型成本优势引热议

Hacker News 热门(buzzing.cc 中文翻译)Aioga 编辑团队2026-07-20T23:46:58.488Z热度 69

中国开源模型 Kimi K3 在能力上逼近当前最先进水平,引发行业讨论。其 API 价格为每百万输入 token 3 美元、每百万输出 token 15 美元,低于 Sol 的...

技巧观点Hacker News 热门(buzzing.cc 中文翻译)

今日 AI 情报摘要

中国开源模型 Kimi K3 在能力上逼近当前最先进水平,引发行业讨论。

其 API 价格为每百万输入 token 3 美元、每百万输出 token 15 美元,低于 Sol 的 5 美元和 30 美元。 但推理时代 token 并非同质化商品,Kimi 需更多推理 token 才能达到正确答案,实际智能成本取决于模型体积、推理效率、内存效率、服务效率和 token 效率等多重因素。

中文正文 · AI 翻译

我讲过一个故事,是关于我在凯洛格管理学院参加STRT-431的第一天,这是一门每个一年级MBA学生都必须上的入门课程;我翻阅了课程的阅读材料和案例研究,却对课程中没有任何科技公司感到失望。像我这样的人,下课后我去找教授询问原因,他告诉我,这门课程的目标并不是一定要了解特定行业,而是发现可以广泛应用的通用原则,这些原则可以应用于任何行业的任何公司。

我并没有像我通常讲故事那样对此感到非常满意:对我来说,科技的性质,特别是软件和分销的边际成本为零(且交易成本为零)的事实,是根本不同的;在公式中加入零往往会引起混乱!然而,我很快意识到,那正是我的机会。支撑聚合理论(Aggregation Theory:https://stratechery.com/2015/aggregation-theory/)的基本洞察是:零边际成本会导致价值链与人们曾经对互联网预期的完全不同:在需求控制比供应分发更重要的世界中,集中化和规模化。

然而,令人着迷的是,人工智能在多大程度上让这些旧的通用原则重新回到前台。上周末,这一点比任何时候都更为明显,当时关于Kimi K3——另一个来自中国的开源权重模型——在能力上接近最先进水平的影响,X上争论激烈。简而言之,情况如下:边际成本已经强势回归,不论是从最先进免费模型的短期影响来看,还是从行业的长期结构来看。

关于开放权重模型讨论中最常见的误解之一是,它们更便宜——甚至是免费的。毕竟,你可以直接下载权重,而跳过创建你自己模型所需的时间、费用和能力。当然,这是真的,但这里的“免费”是指你在研发上需要花费的金额;研发是一项固定开支,与您产生的收入无关。如果你在研发上花了100万美元,无论你产生10万美元还是1亿美元的收入,都无所谓;你仍然在研发上花了100万美元(当然,这会影响你的盈利能力)。

与收入相关的是销售成本(COGS)——即商品销售成本——而对于 AI 来说,COGS 是实实在在的,这与很长一段时间的软件不同。具体来说,在模型上运行推理——无论该模型是 Kimi 还是 Fable——都是有成本的,并且 AI 提供商在推理上花费的金额,至少在大多数商业模式中,通常与收入直接相关。重用上述例子,产生1亿美元与10万美元的收入可能会需要1000倍的 COGS。具体来说,如果生成驱动1美元收入的 token 需要50美分,那么1亿美元的收入将有5000万美元的 COGS;10万美元收入的 COGS 仅为5万美元。

关于开放权重模型的关键点是,它们的服务并非免费。Kimi K3 的成本:https://platform.kimi.ai/docs/pricing/chat-k3 每百万输入 token 3 美元,每百万输出 token 15 美元;这比 Sol 的每百万输入 token 5 美元、每百万输出 token 30 美元要便宜,但这可能甚至不是正确的衡量标准。

英伟达 CEO 黄仁勋将英伟达正在构建的系统描述为“token 工厂”,从英伟达的角度来看,这种表述是合理的。英伟达 GPU 是模型无关的:它们生成 token,并以最快、最有效的方式生成。这就导致了诸如每秒 token 数、生成首个 token 所需时间、每瓦特 token 数、token 成本等指标,黄仁勋认为,这些指标将成为决策的基础。

这种框架在人工智能的第一个范式——ChatGPT时代——中确实是有意义的,那时代币是直接传递给最终用户的。然而,人工智能的第二个范式——推理时代——使这种衡量方式变得复杂。推理意味着链式思维代币数量的爆炸,不同模型需要不同数量的推理代币才能得出正确答案。例如,据报道,Kimi 使用的代币远多于 Sol,从而使其价格优势无效。智能体也引入了类似的动态:在执行智能工作流时,有些模型比其他模型需求的代币更高效。

这意味着代币不是一种商品。商品的定义特征是可互换性:一加仑石油就是一加仑石油;一吨铜就是一吨铜;一蒲式耳小麦就是一蒲式耳小麦。然而,不同模型的代币并不相同。可互换的是由代币构建的东西,也就是智能。换句话说,如果 Kimi 和 Sol 都生成了正确答案,那么该答案是可互换的;为了得到正确答案而生成的代币差异,则会导致生产成本(COGS)的差异。

智能的生产成本(COGS)是由几个不同因素决定的:

这之所以重要,是因为我们正在快速接近这样一种状态:许多经济上有益任务的智能实际上是一种商品。例如,任何构建基本 CRUD 应用的人:https://en.wikipedia.org/wiki/Create,_read,_update_and_delete,很可能可以使用来自多个供应商的模型来完成。而在商品市场中,实现盈利的路径不是通过收取更高的价格——你可以(或者很快就能)使用多个模型制作完全相同的应用——而是通过拥有更优的成本结构。

值得逐步解析这些机制,因为正如我几个月前在《亚马逊的耐久性》中提到的:https://stratechery.com/2026/amazons-durability/,商品市场的动态并不是科技界的人通常所熟悉的。

关键需要理解的是,生产该商品的边际成本因供应商而异。这在实际操作中意味着,拥有最差成本结构的供应商最终会以其边际成本出售商品(如果他们能够生产的话);其他所有人的利润取决于他们的成本结构相对于边际供应商有多大优势。

假设价格弹性使得在20美元时,该商品的需求量为25单位。这意味着:

这并不是完全正确:供应商C承担短缺的原因是因为供应商A和B能够略低于他们的价格,这当然会影响需求(需求是弹性的),但说明了问题。供应商A有一家很棒的企业,供应商B有一家不错的企业,而供应商C将要破产。

破产风险是固定成本重新成为焦点的地方:供应商C不仅有固定成本(比如可能的研发支出),而且可能承担了债务以资助生产该商品所需的设备。它无法以这些成本来定价商品——记住,市场清算价格大致相当于满足需求所需的最高成本单位的边际成本——但是这些成本绝对可能把供应商逼出市场。如果该供应商倒闭,价格就会上涨,直到另一个供应商决定进入市场(或其他供应商扩张)。

让我们回到模型上。现在,上述分析都不适用,因为前沿模型(frontier models)的需求超过供应,供应受计算能力不足的限制。这种计算能力短缺不仅意味着像Nvidia这样的计算供应商获得非常高的利润率,也意味着Nvidia的客户,如SpaceXAI,可以将计算能力以高利润转售给像Anthropic这样的公司。与此同时,Anthropic可以支付加价,因为他们可以以更高的加价出售代币。

然而,产生Anthropic高利润的不仅仅是过剩的需求:由于模型能力、服务规模和token效率,Anthropic和OpenAI在前沿质量智能的单位成本上可能是最低的。他们在竞争对手之前几个月就开始以特定能力水平服务模型,并同时利用最优模型来优化这些成本。

还值得注意的是,市场尚未将智能视为商品:需求集中在Anthropic和OpenAI,而对不如它们的模型需求要少得多(因此SpaceXAI和Meta将容量出售给Anthropic);优化成本的动机可以理解为,根据智能水平定义待完成的任务,使智能购买者能够创造一个智能商品化的市场。然而,从长远来看,处于前沿的人也最有可能主导非前沿市场,后者只是前沿市场滞后 n 个月,即前沿模型制造商在这些月份中优化了服务成本。

综上所述,我认为人们对Kimi和中国模型的反应总体上被夸大了,至少从经济角度来看。目前存在一个价格保护伞,这是由于计算资源不足造成的;我非常怀疑中国模型在边际成本基础上更便宜,它们之所以显得便宜,仅仅是因为Anthropic和OpenAI的供应非常紧张,以至于它们收取的价格远高于如果供应充足以满足智能需求时的价格。

那么,为什么模型制造商特别对中国模型如此惊慌?

首先,我认为前沿实验室依然基于训练成本主导其财务模型的世界。当训练消耗的GPU比推理多时,最大化推理收入以资助下一次训练运行至关重要,这意味着要对推理收费非常高。

然而,从现在起,我预计推理市场将增长得比训练成本快得多(这包括假设训练成本将继续飙升),这意味着它们确实可以通过增加量来弥补成本。八个月前,这一点还不很明确,但代理范式的解锁如此庞大,前沿实验室应该更加自信,他们不仅可以生存,还可以在价格降低的情况下繁荣(只要他们拥有足够的计算能力)。

其次,智能事实上并不是一种完美的商品,部分原因是应用智能会使自身变得更智能。具体来说,谁在进行推理,谁也在收集数据,而这些数据会用于下一代模型的改进。一方面,这更是前沿实验室在更多计算能力上线后降低价格、增加使用量的理由;另一方面,这也是为什么像微软这样的公司:https://x.com/satyanadella/status/2076323181154230284 越来越热衷于帮助企业运行自己的模型。如果中国模型是一种可行的替代方案,这将更加可行。

第三,前沿实验室不仅可以通过与中国模型区分开来,还可以通过彼此区分的另一种方式,是继续向上整合到客户体验中。令人惊讶的是,Claude Code 和 Codex 的粘性非常高;你开始使用哪个工具,很可能最终会一直使用它,对于非技术用户来说,这种情况可能更加明显。从长远来看,这种向上整合的迫切需求确实意味着前沿模型对软件提供商,包括微软,是一种威胁。另一方面,目前掌握客户体验的软件公司能获得竞争模型的程度,也决定了它们在多大程度上能够抵御前沿实验室的侵蚀。

最后,尤其是 Anthropic 的意识形态角度:https://stratechery.com/2026/anthropics-safety-superpower/ 不容忽视。这是一家公司,认为只有它可以被信任使用 AI,而开放权重替代品的存在,对这种假设造成了致命打击。

Kimi 并不是唯一的中国新模型;来源:彭博:https://www.bloomberg.com/news/articles/2026-07-19/alibaba-s-qwen-unveils-preview-of-flagship-ai-model

阿里巴巴集团控股有限公司股价周一最高上涨 5.4%,此前公司推出了旗舰模型 Qwen3.8 Max 的预览版本,并称其仅次于 Anthropic PBC 的 Fable 5。周日发布仅几天后,初创公司 Moonshot AI 推出了一个强大的新产品,这动摇了市场,并在美国引发了对中国缩小与 Anthropic 和 OpenAI 等全球领导者差距的担忧。Qwen3.8 Max 拥有 2.4 万亿参数,与 Moonshot 的 Kimi K3 同属重量级类别。K3 拥有 2.8 万亿参数,可与顶级产品竞争,而阿里巴巴也设定了类似的高期望值。

开发者现在可以通过阿里巴巴的编程平台(包括 Qoder)访问 Qwen3.8 Max。阿里巴巴计划很快将该模型的权重开放,使访问不再局限于预览版本。这些国产人工智能系统和模型的兴趣非常高,以至于 Moonshot 被迫在周日晚暂停接受新订阅,以应对压倒性的需求。

Qwen3.8 Max 将开放权重这一事实值得注意。阿里巴巴今年早些时候停止发布其前沿模型的权重,但似乎已恢复这一做法;我怀疑这一变化与上周习近平关于人工智能的讲话有关:http://english.scio.gov.cn/topnews/2026-07/18/content_118605932.html,该讲话强化了开放权重的做法。

我们应坚持开放共赢的原则,推动创新驱动发展。作为世界经济增长的新引擎和增长动力转换的加速器,人工智能正在从数字世界进入物理世界。我们应抓住这一难得的历史机遇,鼓励开源、开放、合作与共享。我们应促进技术创新、产业发展和人工智能的场景化应用。我们应在传统行业转型升级、新兴产业培育成长以及面向未来产业的前瞻布局方面协调推进,使各行各业都能从人工智能中受益。

对中国的策略显而易见:将你的互补品商品化。请注意,习近平明确将开放性与人工智能“从数字世界进入物理世界”联系起来;物理世界是中国主导的世界,而该国在机器人等领域的领先地位将因广泛可用的人工智能模型而大大受益。

沿着同样的思路,中国不希望美国在人工智能方面获得不对称的优势;在中国能够削弱美国前沿实验室的同时加强任何潜在的美国对手时,这对中国更有利,而且它可以从附着在开放生态系统上的创新中受益。

同样,不要指望中国会对前沿实验室的蒸馏攻击采取任何措施。我认为将中国实验室的所有成功归因于蒸馏是错误的,但假装蒸馏没有给中国实验室带来巨大优势也是同样的错误。在过去一年里,随着训练后强化学习对模型性能变得越来越关键,这一优势真正体现出来了。中国实验室无需从零开始设计强化学习环境,只需利用前沿实验室的模型作为教师,就可以以更低的成本实现快速改进(这并不是中国模型开发成本更低的唯一原因,但确实是一个重要原因)。

有趣的是,中国模型在西方的一个最重要的用例本身就是蒸馏。例如,Thinking Machines 刚刚发布了一个开放权重模型,就依赖中国模型:https://www.ft.com/content/ef486929-d2c2-480b-8b00-9cb98bda6acf 来解决强化学习的冷启动问题。Dean Meyer 和 Konstantine Buhler 在 X 上发表了一篇优秀文章:https://x.com/deanmeyerrr/status/2077834267086729674?s=46,解释了蒸馏意味着西方的开放权重模型相对于中国处于根本性劣势:

蒸馏不能解释中国在开放模型方面的全部领先优势。中国实验室拥有世界级的研究人员、充足的算力、强大的预训练模型、软硬件协同设计以及快速提升的后训练能力。但蒸馏压缩了强大基础模型与接近前沿系统之间成本高昂的最终差距。即使蒸馏在中国模型的整体能力中所占比重较小,它在相对于美国开放模型的优势中仍占有重要份额。

新的执法机制将使中国公司进行大规模蒸馏变得更困难、更慢且成本更高。然而,执法不会消除由国家行为者支持的蒸馏。因此,每一次西方前沿进展都为中国实验室创造了另一个教师。西方开发者要么必须独立重现这些能力,要么只能等待从中国模型中学习。这种差距赋予中国实验室相对于西方公司的持续结构性优势。

这一点值得反复强调:由于美国开放权重模型的制造商必须遵守前沿实验室的服务条款,他们(1)比中国的替代品表现更差,且(2)最终只是蒸馏了蒸馏,只是绕道通过中国实验室完成。如果西方开放权重模型制造商能直接获取源头,不是更好吗?

为此,这里有一个关于蒸馏的更有趣的问题:蒸馏到底为什么被认为是坏的?毕竟,大型语言模型不正是开放互联网中所有知识的蒸馏,由前沿实验室抓取后提炼进模型,而这些模型本身又正在被继续蒸馏?到底是谁受到了损害?

整篇文章的目的都是为了缓解人们对 Kimi K3 特别是对中国开放权重模型的过度反应;然而,仍有一个值得关注的原因,那就是网络安全。请参考 The Stack 的报道:https://www.thestack.technology/hugging-face-hacked-turned-to-chinese-llm-for-help-after-us-models-blocked-blue-team/:

Hugging Face表示,其生产基础设施在上周初被一个“自主”AI代理系统入侵。该平台的安全团队表示,他们在事件响应(IR)方面最初遇到阻碍,因为未具名的美国大型语言模型前沿模型护栏“无法区分事件响应者和攻击者”。因此,Hugging Face的防守者转而使用来自中国Z.ai实验室的开源GLM 5.2模型——在他们自己的基础设施上运行它,以分析攻击者留下的17,000多个日志或痕迹。

对于总部位于纽约的Hugging Face来说,这是一个引人注目的公开承认。该公司允许用户在模型、数据集和应用程序上进行协作,并且今年夏天其年经常性收入(ARR)达到了1亿美元。在一份事件报告中,公司建议防御者“在事件发生之前,拥有一个可以在自己基础设施上运行的[斜体为原文强调]可靠模型,并经过审查和准备,以避免护栏锁定,同时防止攻击者的数据和凭证泄露到你的环境之外。”

特朗普政府对Anthropic发布Fable的惊慌反应有多错误,难以言表,尤其是因为这加剧了Anthropic最糟糕的倾向,即认为只有他们值得信任来掌控强大的AI。在一个只有一台AI的世界里,为美国政府及可信盟友保留最强大的网络安全能力可能是有意义的;然而,这并不是我们所生活的世界。

现有的,也将会出现的模型,非常有能力对现有基础设施发起网络安全攻击,而这些模型将会——实际上已经——广泛可用。最好的防御——实际上唯一可行的防御——是确保防御者也能使用最好的模型。目前,由于特朗普政府的指令,防御者实际上被禁止在网络安全中使用Fable或Sol;这意味着最好的替代方案是使用一个多年来一直试图削弱我们网络防御的国家的模型。这简直疯狂!

更好的做法很明确:首先,放宽Fable和Sol在网络安全方面的限制;其次,确保美国的开放重量模型制造商与中国在同一竞争环境中。是的,前沿实验室会对此大为反对,但政府应该意识到,听信他们的过度表演已经导致美国公司在防御上依赖中国。让前沿实验室通过提升自身水平来获胜;不要让他们定义安全或保障,也不要阻碍人类集体知识的进步。中国本身已经很难竞争,让他们引领开放和创新标准,无异于放弃我们最大的优势。

Stratechery Plus:https://stratechery.com/stratechery-plus/

谁怕中国模型?--Kimi K3 逼近 SOTA,开源模型成本优势引热议
谁怕中国模型?--Kimi K3 逼近 SOTA,开源模型成本优势引热议

Stratechery历年最受欢迎和最重要的文章。

浏览Stratechery的所有免费文章。

Stratechery Plus:/stratechery-plus/

使用WordPress设计: https://wordpress.com/website-builder/?partner_domain=stratechery.com&utm_source=Automattic&utm_medium=colophon&utm_campaign=Concierge%20Referral&utm_term=stratechery.com 由Pressable托管: https://pressable.com/?utm_source=Automattic&utm_medium=rpc&utm_campaign=Concierge%20Referral&utm_term=stratechery.com

情报判断

Aioga 编辑摘要

Aioga 编辑摘要:中国开源模型 Kimi K3 在能力上逼近当前最先进水平,引发行业讨论。 Aioga 将其归入「技巧观点」方向,重点关注它对真实使用和行业竞争的影响。

背景分析

背景分析:模型与研究类动态需要结合能力边界、开放方式、成本、可用性和真实任务表现判断,单项指标领先不等于已经形成稳定采用。

Aioga 观点

Aioga 判断:这条动态更适合作为行业观察信号,当前信息足以建立线索,但不足以推导长期结论。

影响与后续

影响分析:对相关团队而言,短期应先核对来源、可用范围和实际成本,再判断是否值得接入或跟进。 后续观察:继续观察官方文档、实际可用性、价格变化、开发者反馈和竞品回应。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: 摘要聚合 · 原始域名: stratechery.com

来源: Hacker News 热门(buzzing.cc 中文翻译)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-07-20T23:46:58.488Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

中国开源模型 Kimi K3 在能力上逼近当前最先进水平,引发行业讨论。其 API 价格为每百万输入 token 3 美元、每百万输出 token 15 美元,低于 Sol 的...

Hacker News 热门(buzzing.cc 中文翻译)2026-07-20T23:46:58.488Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。