OpenAI 通过启用两项 API 设置,使 GPT-5.6 在 ARC-AGI-3 基准测试上的得分提升至原来的三倍。
这两项设置分别是保留推理过程(retaining reasoning)和启用压缩(compaction),在提升得分的同时也提高了效率。
该发现基于 OpenAI 官方对 GPT-5.6 模型 API 参数的测试结果。
OpenAI ने दो API सेटिंग्स को सक्षम करके GPT-5.6 के ARC-AGI-3 बेंचमार्क परीक्षण में स्कोर को मूल के तीन गुणा बढ़ा दिया। ये दो सेटिंग्स हैं: तर्क प्रक्रिया क...
OpenAI ने दो API सेटिंग्स को सक्षम करके GPT-5.6 के ARC-AGI-3 बेंचमार्क परीक्षण में स्कोर को मूल के
तीन गुणा बढ़ा दिया। ये दो सेटिंग्स हैं: तर्क प्रक्रिया को बनाए रखना (retaining reasoning) और संपीड़न सक्षम करना (compaction), जिससे न केवल स्कोर बढ़ता है बल्कि दक्षता भी बढ़ती है। यह निष्कर्ष GPT-5.6 मॉडल API पैरामीटर पर OpenAI के आधिकारिक परीक्षण के परिणामों पर आधारित है।
OpenAI 通过启用两项 API 设置,使 GPT-5.6 在 ARC-AGI-3 基准测试上的得分提升至原来的三倍。
这两项设置分别是保留推理过程(retaining reasoning)和启用压缩(compaction),在提升得分的同时也提高了效率。
该发现基于 OpenAI 官方对 GPT-5.6 模型 API 参数的测试结果。
OpenAI 官网材料称,在 ARC-AGI-3 基准测试中,同时启用保留推理过程与压缩两项 API 设置后,GPT-5.6 的得分提升至原来的三倍,并且测试效率有所提高。
这项结果来自 OpenAI 对 GPT-5.6 模型 API 参数的官方测试。现有材料仅说明测试涉及 ARC-AGI-3,以及 retaining reasoning 和 compaction 两项设置,未披露具体分数、成本或测试配置。
Aioga 判断,这一结果说明 API 配置可能显著影响模型在特定基准上的表现,评估模型时值得关注参数设置,而不能只比较模型名称;但现有材料不足以证明该提升可推广到其他任务。
对使用模型 API 的开发者而言,两项设置可能成为优化特定任务表现与效率的测试方向。值得关注的是,材料没有说明两项设置各自的贡献,因此无法判断三倍提升由哪项设置主导。 Aioga 建议后续核对 OpenAI 是否公开完整测试方法、具体分数、效率指标及对照配置,并在自身任务中分别测试两项设置及其组合,避免直接将单一基准结果视为通用能力提升。
当前抓取源提供的是标题、摘要、来源和原文入口,不直接搬运完整原文。完整报道请通过下方原文链接前往来源站点查看。
抓取通道: RSS · 原始域名: openai.com
स्रोत: OpenAI:官网动态(RSS · 排除企业/客户案例)
原文链接: मूल स्रोत खोलें
Aioga 归档: 查看情报页
Content record: summary-fallback · Updated: 2026-07-29T15:00:00.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。