OpenAI 通过启用两项 API 设置,使 GPT-5.6 在 ARC-AGI-3 基准测试上的得分提升至原来的三倍。
这两项设置分别是保留推理过程(retaining reasoning)和启用压缩(compaction),在提升得分的同时也提高了效率。
该发现基于 OpenAI 官方对 GPT-5.6 模型 API 参数的测试结果。
OpenAI は 2 つの API 設定を有効にすることで、GPT-5.6 の ARC-AGI-3 ベンチマークでのスコアを元の 3 倍に向上させました。この 2 つの設定は、それぞれ推論プロセスを保持すること(retaining reasoning)と圧縮を有効にすること(compaction)であり、スコ...
OpenAI は 2 つの API 設定を有効にすることで、GPT-5.6 の ARC-AGI-3 ベンチマークでのスコアを元の 3 倍に向上させました。
この 2 つの設定は、それぞれ推論プロセスを保持すること(retaining reasoning)と圧縮を有効にすること(compaction)であり、スコアを向上させると同時に効率も高めました。 この発見は、OpenAI が公式に行った GPT-5.6 モデル API パラメータのテスト結果に基づくものです。
OpenAI 通过启用两项 API 设置,使 GPT-5.6 在 ARC-AGI-3 基准测试上的得分提升至原来的三倍。
这两项设置分别是保留推理过程(retaining reasoning)和启用压缩(compaction),在提升得分的同时也提高了效率。
该发现基于 OpenAI 官方对 GPT-5.6 模型 API 参数的测试结果。
OpenAI 官网材料称,在 ARC-AGI-3 基准测试中,同时启用保留推理过程与压缩两项 API 设置后,GPT-5.6 的得分提升至原来的三倍,并且测试效率有所提高。
这项结果来自 OpenAI 对 GPT-5.6 模型 API 参数的官方测试。现有材料仅说明测试涉及 ARC-AGI-3,以及 retaining reasoning 和 compaction 两项设置,未披露具体分数、成本或测试配置。
Aioga 判断,这一结果说明 API 配置可能显著影响模型在特定基准上的表现,评估模型时值得关注参数设置,而不能只比较模型名称;但现有材料不足以证明该提升可推广到其他任务。
对使用模型 API 的开发者而言,两项设置可能成为优化特定任务表现与效率的测试方向。值得关注的是,材料没有说明两项设置各自的贡献,因此无法判断三倍提升由哪项设置主导。 Aioga 建议后续核对 OpenAI 是否公开完整测试方法、具体分数、效率指标及对照配置,并在自身任务中分别测试两项设置及其组合,避免直接将单一基准结果视为通用能力提升。
取得元が提供するタイトル、要約、出典、元記事リンクを掲載しています。記事全文は転載していません。
取得経路: RSS · 元ドメイン: openai.com
出典: OpenAI:官网动态(RSS · 排除企业/客户案例)
元記事: 元記事を開く
Aioga アーカイブ: 情報ページを開く
Content record: summary-fallback · Updated: 2026-07-29T15:00:00.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga は世界の AI 動向を集約し、確認と引用のため出典情報を保持します。