OpenAI 发布 GPT-6 Astra,首席研究官 Mark Chen 称其能构建测试软件、跨应用操作电脑并尝试开放科学问题。
作者补充数字:OSWorld 真实桌面任务从 75 分钟降到 40 分钟,职场自动化从 18% 升到 41%,未防护越权率从上一代 48% 压到 0%,并称花了 2000 美元算力解出 10
道十年未解的数学与理论计算难题;
同时指出带工具的综合测试仍落后 Claude。
OpenAIはGPT-6 Astraをリリースし、チーフリサーチオフィサーのMark Chenは、テストソフトウェアの構築、アプリケーション間のコンピュータ操作、オープンサイエンスの問題の実験が可能だと主張しました。著者は数値を追加しています。OSWorldの実際のデスクトップ作業は75分から40分に減少し、...
OpenAIはGPT-6 Astraをリリースし、チーフリサーチオフィサーのMark Chenは、テストソフトウェアの構築、アプリケーション間のコンピュータ操作、オープンサイエンスの問題の実験が可能だと主張しました。
著者は数値を追加しています。 化は18%から41%に増加し、無保護な過剰介入率は前世代の48%から0%に減少し、10年間解決されなかった10の数学的・理論的問題を解決するために2,000ドルの計算能力が費やされたと言われています。 同時に、ツールを用いた包括的なテストは依然としてClaudeに遅れをとっていることも指摘しました。
OpenAI 发布 GPT-6 Astra,首席研究官 Mark Chen 称其能构建测试软件、跨应用操作电脑并尝试开放科学问题。
作者补充数字:OSWorld 真实桌面任务从 75 分钟降到 40 分钟,职场自动化从 18% 升到 41%,未防护越权率从上一代 48% 压到 0%,并称花了 2000 美元算力解出 10
道十年未解的数学与理论计算难题;
同时指出带工具的综合测试仍落后 Claude。
来源材料称,OpenAI 发布 GPT-6 Astra,首席研究官 Mark Chen 表示该模型能够构建测试软件、跨应用操作电脑,并尝试处理开放科学问题。
材料还提到,作者补充了 OSWorld 桌面任务用时、职场自动化比例及未防护越权率等对比数据,并称其以 2000 美元算力完成 10 道数学与理论计算难题;同时指出带工具的综合测试仍落后 Claude。
Aioga 判断:目前材料同时包含发布信息、作者补充数据和对比结论,但未提供完整测试方法、评测条件或独立验证,因此不宜仅凭这些内容确认模型能力的普遍性。
可能影响:若相关能力和数据经后续核验,GPT-6 Astra 可能加强电脑操作与科研辅助方向的竞争;但单一来源信息不足以证明其已稳定适用于职场或开放科学场景。 后续观察:需要关注 OpenAI 是否公开正式技术报告、评测口径、工具使用条件和安全测试细节,并核对作者所述数据及其与 Claude 对比的具体范围。
取得元が提供するタイトル、要約、出典、元記事リンクを掲載しています。記事全文は転載していません。
取得経路: 要約集約 · 元ドメイン: x.com
出典: @AYi_AInotes)
元記事: 元記事を開く
Aioga アーカイブ: 情報ページを開く
Content record: social-summary · Updated: 2026-09-04T02:22:24.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga は世界の AI 動向を集約し、確認と引用のため出典情報を保持します。