OpenAI 通过启用两项 API 设置,使 GPT-5.6 在 ARC-AGI-3 基准测试上的得分提升至原来的三倍。
这两项设置分别是保留推理过程(retaining reasoning)和启用压缩(compaction),在提升得分的同时也提高了效率。
该发现基于 OpenAI 官方对 GPT-5.6 模型 API 参数的测试结果。
OpenAI는 두 가지 API 설정을 활성화함으로써 GPT-5.6의 ARC-AGI-3 벤치마크 점수를 원래의 세 배로 향상시켰습니다. 이 두 가지 설정은 각각 추론 과정 보존(retaining reasoning)과 압축(compaction) 활성화이며, 점수를 향상시키는 동시에...
OpenAI는 두 가지 API 설정을 활성화함으로써 GPT-5.6의 ARC-AGI-3 벤치마크 점수를 원래의 세 배로 향상시켰습니다. 이 두 가지 설정은 각각 추론 과정
보존(retaining reasoning)과 압축(compaction) 활성화이며, 점수를 향상시키는 동시에 효율성도 높였습니다. 이 발견은 OpenAI 공식 GPT-5.6 모델 API 매개변수 테스트 결과를 기반으로 한 것입니다.
OpenAI 通过启用两项 API 设置,使 GPT-5.6 在 ARC-AGI-3 基准测试上的得分提升至原来的三倍。
这两项设置分别是保留推理过程(retaining reasoning)和启用压缩(compaction),在提升得分的同时也提高了效率。
该发现基于 OpenAI 官方对 GPT-5.6 模型 API 参数的测试结果。
OpenAI 官网材料称,在 ARC-AGI-3 基准测试中,同时启用保留推理过程与压缩两项 API 设置后,GPT-5.6 的得分提升至原来的三倍,并且测试效率有所提高。
这项结果来自 OpenAI 对 GPT-5.6 模型 API 参数的官方测试。现有材料仅说明测试涉及 ARC-AGI-3,以及 retaining reasoning 和 compaction 两项设置,未披露具体分数、成本或测试配置。
Aioga 判断,这一结果说明 API 配置可能显著影响模型在特定基准上的表现,评估模型时值得关注参数设置,而不能只比较模型名称;但现有材料不足以证明该提升可推广到其他任务。
对使用模型 API 的开发者而言,两项设置可能成为优化特定任务表现与效率的测试方向。值得关注的是,材料没有说明两项设置各自的贡献,因此无法判断三倍提升由哪项设置主导。 Aioga 建议后续核对 OpenAI 是否公开完整测试方法、具体分数、效率指标及对照配置,并在自身任务中分别测试两项设置及其组合,避免直接将单一基准结果视为通用能力提升。
수집 피드는 제목, 요약, 출처와 원문 링크를 제공합니다. Aioga는 원문 전체를 재게시하지 않습니다.
수집 채널: RSS · 원본 도메인: openai.com
출처: OpenAI:官网动态(RSS · 排除企业/客户案例)
원문 링크: 원문 열기
Aioga 아카이브: 정보 페이지 보기
Content record: summary-fallback · Updated: 2026-07-29T15:00:00.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga는 전 세계 AI 동향을 집계하고 확인과 인용을 위해 출처 정보를 보존합니다.