OpenAI 通过启用两项 API 设置,使 GPT-5.6 在 ARC-AGI-3 基准测试上的得分提升至原来的三倍。
这两项设置分别是保留推理过程(retaining reasoning)和启用压缩(compaction),在提升得分的同时也提高了效率。
该发现基于 OpenAI 官方对 GPT-5.6 模型 API 参数的测试结果。
OpenAI благодаря включению двух настроек API повысила результаты GPT-5.6 в бенчмарке ARC-AGI-3 в три раза по сравнению с исходным уровнем. Эти две настройк...
OpenAI благодаря включению двух настроек API повысила результаты GPT-5.6 в бенчмарке ARC-AGI-3 в три
раза по сравнению с исходным уровнем. Эти две настройки — сохранение процесса рассуждения и активация сжатия — одновременно повышают эффективность. Это открытие основано на результатах тестирования параметров API модели GPT-5.6, проведенного официальной командой OpenAI.
OpenAI 通过启用两项 API 设置,使 GPT-5.6 在 ARC-AGI-3 基准测试上的得分提升至原来的三倍。
这两项设置分别是保留推理过程(retaining reasoning)和启用压缩(compaction),在提升得分的同时也提高了效率。
该发现基于 OpenAI 官方对 GPT-5.6 模型 API 参数的测试结果。
OpenAI 官网材料称,在 ARC-AGI-3 基准测试中,同时启用保留推理过程与压缩两项 API 设置后,GPT-5.6 的得分提升至原来的三倍,并且测试效率有所提高。
这项结果来自 OpenAI 对 GPT-5.6 模型 API 参数的官方测试。现有材料仅说明测试涉及 ARC-AGI-3,以及 retaining reasoning 和 compaction 两项设置,未披露具体分数、成本或测试配置。
Aioga 判断,这一结果说明 API 配置可能显著影响模型在特定基准上的表现,评估模型时值得关注参数设置,而不能只比较模型名称;但现有材料不足以证明该提升可推广到其他任务。
对使用模型 API 的开发者而言,两项设置可能成为优化特定任务表现与效率的测试方向。值得关注的是,材料没有说明两项设置各自的贡献,因此无法判断三倍提升由哪项设置主导。 Aioga 建议后续核对 OpenAI 是否公开完整测试方法、具体分数、效率指标及对照配置,并在自身任务中分别测试两项设置及其组合,避免直接将单一基准结果视为通用能力提升。
当前抓取源提供的是标题、摘要、来源和原文入口,不直接搬运完整原文。完整报道请通过下方原文链接前往来源站点查看。
抓取通道: RSS · 原始域名: openai.com
Источник: OpenAI:官网动态(RSS · 排除企业/客户案例)
原文链接: Открыть оригинал
Aioga 归档: 查看情报页
Content record: summary-fallback · Updated: 2026-07-29T15:00:00.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。