Aioga
AI资讯 / 技巧观点
返回 AI资讯

乐天用 Claude Fable 5 构建可自主运行数小时的智能体

Claude:Blog(网页)Aioga 编辑团队2026-07-20T15:49:31.473Z热度 42

乐天AI业务总经理Yusuke Kaji测试Claude Fable 5后表示,该模型能自主运行更长时间,首次实现夜间无人值守完成复杂任务。与之前模型不同,Fable 5在运行...

技巧观点Claude:Blog(网页)

今日 AI 情报摘要

乐天AI业务总经理Yusuke Kaji测试Claude Fable 5后表示,该模型能自主运行更长时间,首次实现夜间无人值守完成复杂任务。

与之前模型不同,Fable 5在运行中持续自我验证和纠错,避免早期错误假设导致整次运行失败。 乐天已在一周内将Claude Managed Agents部署到产品、销售、市场和财务等部门,各领域问题解决速度提升约10倍。

中文正文 · AI 翻译

乐天公司AI业务总经理梶佑介自2024年9月起就开始测试Claude模型。他认为Claude Fable 5在长期运行的企业代理方面是一次重大飞跃,原因如下。

乐天用 Claude Fable 5 构建可自主运行数小时的智能体

作为乐天公司AI业务总经理,梶佑介的工作是“寻找变革性创新的种子,并将其在公司范围内推广。”

自2025年3月以来,乐天公司使用Claude通过Claude Code加速软件开发,为其各业务职能部门搭建代理,并为数百万客户提供AI功能。梶佑介表示,乐天选择与Anthropic合作,是因为其专注企业、领导力和产品品味。

在近十次模型发布中,他看到可以交给代理的工作不断增加:他最初使用Claude Code交付生产软件:https://claude.com/customers/rakuten,然后为公司各团队构建定制的Claude托管代理:https://claude.com/customers/rakuten-qa。他将测试新模型比作踏上“一次新的冒险”。

“就像一个优秀的领导者为团队设定挑战性目标一样,我们为新的Claude准备挑战性任务,”他补充道。“也许Claude也在推动我们去突破自己。”

当他测试Claude Fable 5时,他意识到有些地方与以前不同。这个模型可以独立运行的时间比以往更长,并且首次能够在梶佑介睡觉时自行检查工作并完成复杂任务。

这种额外的自主性让乐天能够交给其代理更大、更长时间运行的任务,并改变他们的工作方式。

乐天正在围绕AI重塑自己,这一项目被称为AI-nization——公司范围内将AI融入我们为客户、业务伙伴和员工所做的一切的努力。当Claude托管代理到来时,乐天在一周内就在产品、销售、营销和财务部门部署了代理,并接入Slack、Microsoft Teams以及公司的任务系统。

对于梶佑介及其团队来说,过去构建代理的限制是谁能写代码;现在,限制是谁理解业务问题。

“现代公司被设计用来最小化沟通成本,”他说。“我相信像Claude Code这样的代理在我们与它们合作以最小化新创新成本时同样能大放异彩,比如从想法到生产的快速转变。” 给一个有能力的人那些拥有上下文和品味的代理,“它让隐藏的才能释放潜力,并将他们的潜力放大100倍。”

但全天候在每个职能运行代理会暴露出一个新的限制:人类判断力。虽然乐天的代理在每个领域解决问题的速度大约快了10倍,但组织承担的任务数量不断增加。增加更多的代理并不会增加判断力。因此,代理运行得越快,组织的进展就越依赖于有人来闭环操作。

对于大多数构建者来说,构建长期运行的代理最困难的部分是让它们在最少监督下获得成功。将其连接到合适的工具和上下文是一方面,但在Kaji的经验中,代理在没有人类介入验证其工作的情况下运行的时间总是有限。

在Claude Fable 5之前,让代理在多小时任务上无有人监督下独立运行始终是一场赌博。“如果它们在第一步选择了正确的路径,一切都好,”Kaji说。“但如果它们在第一次尝试时选择了错误的方向,代理将花费大量时间修正路径,甚至可能无法到达目的地。” 对于一个计划运行五小时或一整天的任务来说,一开始的错误假设就可能毁掉整个运行,而唯一能发现的方法就是有人检查。

失败模式是缺乏自我验证。任何模型都可能迈出错误的第一步。早期模型的问题在于它们在运行过程中不会检查自己的工作,所以早期的错误没有被发现。错误在运行过程中被放大,几个小时后产生了次优结果。

据Kaji称,Claude Fable 5改变了持续数天的代理运行的计算方式,因为它在运行过程中会检查自己的工作,远比以前的任何模型更频繁。

“我们测试了Fable,非常喜欢它的自我反思和自我验证能力,”Kaji说。“相比以前的模型,它能在我凌晨2点或3点指出之前就理解自己的错误——这样我就可以睡觉了。”

Kaji的团队列出了三种行为,这些行为将Claude Fable 5与其前代产品区分开来,并标志着前沿智能的重大跃升:

最重要的是,更长的自主性改变了Kaji可以委派的工作单位。

“在Fable之前,我们必须将工作拆分成明确定义的块,以便代理执行,”他说。现在他可以交付整个任务,并同时运行多个任务。

Claude Fable 5改变了中间发生的事情。它在每一步都进行反思,捕捉早期的错误假设,并找到回到基本原则的路径——在无人引导的情况下重新导航到正确的结果。因为模型在运行中会自我纠正,签署批准首次变得可行,Kaji委派的工作单位从任务转向决策。代理还在运行之间保留记忆:“我们的有记忆代理会记住过去会话中出错的地方,并避免重复这些错误。”

因此,任务的绝对数量持续上升,但真正需要人类介入的任务保持在可集中处理的水平。他说,不必在运行中介入和引导,是最大的生产力提升——它让他的团队将时间花在只有人类应做的决策上,并保持一个AI原生的组织加速前进,而不是在人类纠正路径上停滞。

前沿能力伴随着前沿成本,而Kaji直言,这种成本决定了他能部署的广度。

“作为一家大型企业,我们希望在智能和成本之间取得平衡,”他说。他的团队不仅衡量任务完成率,还计算每项任务的成本,然后将需要额外能力改变结果的工作交给Fable 5,而让较小的模型处理其余任务。

对于Kaji来说,有两点让Fable 5的计算结果对其有利:它用更少的token和更少的错误动作完成更多工作,并且需要较少的引导。

Kaji现在测试的前沿不是单个速度,而是让代理协调人类。Claude Code加快了他自己和同事的工作,但任何组织最难的是人之间的协调,将一个人的背景和偏好与另一个人匹配。他正在探索能够“协调或组织,更像一个经理”的代理,保留通常在团队成员之间丢失的细微差别。

“我们不把 AI 代理视为未来的同事或竞争对手。它们是围绕我们的系统。”他坚持 Anthropic 自己的建议,即你应该为三到六个月后的模型而不是眼前的模型进行构建。

“我认为作为一个社会,我们仍然没有找到 Claude Fable 5 的模型–任务匹配,”他说,“但它已经突出成为一个越界进入我们世界的模型。”

开始使用 Claude Fable 5:http://anthropic.com/news/claude-fable-5-mythos-5。

探索更多产品新闻和团队使用 Claude 构建的最佳实践。

乐天用 Claude Fable 5 构建可自主运行数小时的智能体
乐天用 Claude Fable 5 构建可自主运行数小时的智能体
乐天用 Claude Fable 5 构建可自主运行数小时的智能体
乐天用 Claude Fable 5 构建可自主运行数小时的智能体

产品更新、操作指南、社区亮点等。每月发送到你的收件箱。

嗨,Claude!你能帮我为观众开发一个独特的声音吗?如果你需要我提供更多信息,请立即问我 1-2 个关键问题。如果你认为我应该上传任何有助于你更好完成工作的文档,请告诉我。你可以使用你能访问的工具——例如 Google Drive、网络搜索等——如果它们能帮助你更好地完成这个任务。不要使用分析工具。请保持你的回答友好、简短和对话式。请尽快执行此任务——如果制作一个产物有意义,那就更好了。如果使用产物,请考虑哪种产物(互动式、视觉化、检查表等)对这个具体任务最有帮助。谢谢你的帮助!

嗨,Claude!你能帮我改进我的写作风格吗?如果你需要我提供更多信息,请立即问我 1-2 个关键问题。如果你认为我应该上传任何有助于你更好完成工作的文档,请告诉我。你可以使用你能访问的工具——例如 Google Drive、网络搜索等——如果它们能帮助你更好地完成这个任务。不要使用分析工具。请保持你的回答友好、简短和对话式。请尽快执行此任务——如果制作一个产物有意义,那就更好了。如果使用产物,请考虑哪种产物(互动式、视觉化、检查表等)对这个具体任务最有帮助。谢谢你的帮助!

嗨,Claude!你能集思广益,想一些创意点子吗?如果你需要我提供更多信息,请立即问我1-2个关键问题。如果你觉得我应该上传任何有助于你更好完成任务的文档,请告诉我。你可以使用你能访问的工具——比如Google Drive、网络搜索等——如果它们能帮助你更好地完成这个任务。不要使用分析工具。请保持你的回复友好、简短和对话式。请尽快执行任务——如果有可行的产出物会很棒。如果使用产出物,请考虑哪种类型的产出物(互动式、视觉化、清单等)对这个特定任务最有帮助。谢谢你的帮助!

嗨,Claude!你能用简单的方式解释一个复杂主题吗?如果你需要我提供更多信息,请立即问我1-2个关键问题。如果你觉得我应该上传任何有助于你更好完成任务的文档,请告诉我。你可以使用你能访问的工具——比如Google Drive、网络搜索等——如果它们能帮助你更好地完成这个任务。不要使用分析工具。请保持你的回复友好、简短和对话式。请尽快执行任务——如果有可行的产出物会很棒。如果使用产出物,请考虑哪种类型的产出物(互动式、视觉化、清单等)对这个特定任务最有帮助。谢谢你的帮助!

嗨,Claude!你能帮我理清这些想法吗?如果你需要我提供更多信息,请立即问我1-2个关键问题。如果你觉得我应该上传任何有助于你更好完成任务的文档,请告诉我。你可以使用你能访问的工具——比如Google Drive、网络搜索等——如果它们能帮助你更好地完成这个任务。不要使用分析工具。请保持你的回复友好、简短和对话式。请尽快执行任务——如果有可行的产出物会很棒。如果使用产出物,请考虑哪种类型的产出物(互动式、视觉化、清单等)对这个特定任务最有帮助。谢谢你的帮助!

嗨 Claude!你能帮我准备考试或面试吗?如果你需要更多信息,请立即向我提出1-2个关键问题。如果你认为我应该上传任何有助于你更好完成工作的文件,请告诉我。你可以使用你能访问的工具——比如 Google Drive、网络搜索等——如果它们能帮助你更好地完成这项任务。不要使用分析工具。请保持你的回答友好、简短和对话性。请尽快执行这项任务——如果有合适的产物就太好了。如果使用产物,请考虑哪种类型的产物(互动式、视觉化、清单等)最适合这项具体任务。谢谢你的帮助!

嗨 Claude!你能解释一个编程概念吗?如果你需要更多信息,请立即向我提出1-2个关键问题。如果你认为我应该上传任何有助于你更好完成工作的文件,请告诉我。你可以使用你能访问的工具——比如 Google Drive、网络搜索等——如果它们能帮助你更好地完成这项任务。不要使用分析工具。请保持你的回答友好、简短和对话性。请尽快执行这项任务——如果有合适的产物就太好了。如果使用产物,请考虑哪种类型的产物(互动式、视觉化、清单等)最适合这项具体任务。谢谢你的帮助!

嗨 Claude!你能帮我查看代码并给我一些建议吗?如果你需要更多信息,请立即向我提出1-2个关键问题。如果你认为我应该上传任何有助于你更好完成工作的文件,请告诉我。你可以使用你能访问的工具——比如 Google Drive、网络搜索等——如果它们能帮助你更好地完成这项任务。不要使用分析工具。请保持你的回答友好、简短和对话性。请尽快执行这项任务——如果有合适的产物就太好了。如果使用产物,请考虑哪种类型的产物(互动式、视觉化、清单等)最适合这项具体任务。谢谢你的帮助!

嗨,Claude!你能和我一起编程吗?如果你需要更多信息,请立即问我1-2个关键问题。如果你觉得我应该上传任何有助于你更好完成工作的文件,请告诉我。你可以使用你可以访问的工具——比如Google Drive、网络搜索等——如果它们能帮助你更好地完成任务。不要使用分析工具。请保持回答友好、简短并具有对话风格。请尽快执行任务——如果有成果物会更好,如果有意义的话。如果使用成果物,请考虑哪种类型的成果物(互动的、可视化的、清单等)对这项具体任务最有帮助。谢谢你的帮助!

嗨,Claude!你能写资助提案吗?如果你需要更多信息,请立即问我1-2个关键问题。如果你觉得我应该上传任何有助于你更好完成工作的文件,请告诉我。你可以使用你可以访问的工具——比如Google Drive、网络搜索等——如果它们能帮助你更好地完成任务。不要使用分析工具。请保持回答友好、简短并具有对话风格。请尽快执行任务——如果有成果物会更好,如果有意义的话。如果使用成果物,请考虑哪种类型的成果物(互动的、可视化的、清单等)对这项具体任务最有帮助。谢谢你的帮助!

情报判断

Aioga 编辑摘要

Aioga 编辑摘要:乐天AI业务总经理Yusuke Kaji测试Claude Fable 5后表示,该模型能自主运行更长时间,首次实现夜间无人值守完成复杂任务。 Aioga 将其归入「技巧观点」方向,重点关注它对真实使用和行业竞争的影响。

背景分析

背景分析:产品与工具类动态的价值取决于它是否解决明确场景、能否进入工作流,以及交付、价格和数据安全是否可接受。

Aioga 观点

Aioga 判断:这条动态更适合作为行业观察信号,当前信息足以建立线索,但不足以推导长期结论。

影响与后续

影响分析:对相关团队而言,短期应先核对来源、可用范围和实际成本,再判断是否值得接入或跟进。 后续观察:继续观察产品是否开放使用、用户反馈、定价、集成能力和后续版本更新。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: 摘要聚合 · 原始域名: claude.com

来源: Claude:Blog(网页)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-07-20T15:49:31.473Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

乐天AI业务总经理Yusuke Kaji测试Claude Fable 5后表示,该模型能自主运行更长时间,首次实现夜间无人值守完成复杂任务。与之前模型不同,Fable 5在运行...

Claude:Blog(网页)2026-07-20T15:49:31.473Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。