OpenAI 通过启用两项 API 设置,使 GPT-5.6 在 ARC-AGI-3 基准测试上的得分提升至原来的三倍。
这两项设置分别是保留推理过程(retaining reasoning)和启用压缩(compaction),在提升得分的同时也提高了效率。
该发现基于 OpenAI 官方对 GPT-5.6 模型 API 参数的测试结果。
OpenAI heeft door het inschakelen van twee API-instellingen ervoor gezorgd dat GPT-5.6 zijn score op de ARC-AGI-3 benchmark verdrievoudigde. Deze twee inst...
OpenAI heeft door het inschakelen van twee API-instellingen ervoor gezorgd dat GPT-5.6 zijn score op
de ARC-AGI-3 benchmark verdrievoudigde. Deze twee instellingen zijn respectievelijk het behouden van het redeneringsproces (retaining reasoning) en het inschakelen van compressie (compaction). Deze instellingen verbeteren niet alleen de score, maar verhogen ook de efficiëntie. Deze bevinding is gebaseerd op de testresultaten van de officiële OpenAI API-parameters voor het GPT-5.6-model.
OpenAI 通过启用两项 API 设置,使 GPT-5.6 在 ARC-AGI-3 基准测试上的得分提升至原来的三倍。
这两项设置分别是保留推理过程(retaining reasoning)和启用压缩(compaction),在提升得分的同时也提高了效率。
该发现基于 OpenAI 官方对 GPT-5.6 模型 API 参数的测试结果。
OpenAI 官网材料称,在 ARC-AGI-3 基准测试中,同时启用保留推理过程与压缩两项 API 设置后,GPT-5.6 的得分提升至原来的三倍,并且测试效率有所提高。
这项结果来自 OpenAI 对 GPT-5.6 模型 API 参数的官方测试。现有材料仅说明测试涉及 ARC-AGI-3,以及 retaining reasoning 和 compaction 两项设置,未披露具体分数、成本或测试配置。
Aioga 判断,这一结果说明 API 配置可能显著影响模型在特定基准上的表现,评估模型时值得关注参数设置,而不能只比较模型名称;但现有材料不足以证明该提升可推广到其他任务。
对使用模型 API 的开发者而言,两项设置可能成为优化特定任务表现与效率的测试方向。值得关注的是,材料没有说明两项设置各自的贡献,因此无法判断三倍提升由哪项设置主导。 Aioga 建议后续核对 OpenAI 是否公开完整测试方法、具体分数、效率指标及对照配置,并在自身任务中分别测试两项设置及其组合,避免直接将单一基准结果视为通用能力提升。
当前抓取源提供的是标题、摘要、来源和原文入口,不直接搬运完整原文。完整报道请通过下方原文链接前往来源站点查看。
抓取通道: RSS · 原始域名: openai.com
Bron: OpenAI:官网动态(RSS · 排除企业/客户案例)
原文链接: Open oorspronkelijke bron
Aioga 归档: 查看情报页
Content record: summary-fallback · Updated: 2026-07-29T15:00:00.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。