OpenAI 发布 GPT-6 Astra,首席研究官 Mark Chen 称其能构建测试软件、跨应用操作电脑并尝试开放科学问题。
作者补充数字:OSWorld 真实桌面任务从 75 分钟降到 40 分钟,职场自动化从 18% 升到 41%,未防护越权率从上一代 48% 压到 0%,并称花了 2000 美元算力解出 10
道十年未解的数学与理论计算难题;
同时指出带工具的综合测试仍落后 Claude。
أصدرت OpenAI GPT-6 Astra، حيث ادعى كبير مسؤولي الأبحاث مارك تشين أنها تستطيع بناء برامج اختبار، وتشغيل الحواسيب عبر التطبيقات، والتجربة في مشاكل العلوم الم...
أصدرت OpenAI GPT-6 Astra، حيث ادعى كبير مسؤولي الأبحاث مارك تشين أنها تستطيع بناء برامج اختبار،
وتشغيل الحواسيب عبر التطبيقات، والتجربة في مشاكل العلوم المفتوحة. يضيف المؤلف أرقاما: انخفضت مهام سطح المكتب الحقيقية في OSWorld من 75 دقيقة إلى 40 دقيقة، وارتفعت أتمتة مكان العمل من 18٪ إلى 41٪، وانخفض معدل تجاوز الحدود غير المحمية من 48٪ في الجيل السابق إلى 0٪، وقيل إنه تم إنفاق 2000 دولار من قوة الحوسبة لحل 10 مشاكل رياضية ونظرية بقيت دون حل خلال عشر سنوات؛ وفي الوقت نفسه، أشار إلى أن الاختبارات الشاملة باستخدام الأدوات لا تزال متأخرة عن كلود.
OpenAI 发布 GPT-6 Astra,首席研究官 Mark Chen 称其能构建测试软件、跨应用操作电脑并尝试开放科学问题。
作者补充数字:OSWorld 真实桌面任务从 75 分钟降到 40 分钟,职场自动化从 18% 升到 41%,未防护越权率从上一代 48% 压到 0%,并称花了 2000 美元算力解出 10
道十年未解的数学与理论计算难题;
同时指出带工具的综合测试仍落后 Claude。
来源材料称,OpenAI 发布 GPT-6 Astra,首席研究官 Mark Chen 表示该模型能够构建测试软件、跨应用操作电脑,并尝试处理开放科学问题。
材料还提到,作者补充了 OSWorld 桌面任务用时、职场自动化比例及未防护越权率等对比数据,并称其以 2000 美元算力完成 10 道数学与理论计算难题;同时指出带工具的综合测试仍落后 Claude。
Aioga 判断:目前材料同时包含发布信息、作者补充数据和对比结论,但未提供完整测试方法、评测条件或独立验证,因此不宜仅凭这些内容确认模型能力的普遍性。
可能影响:若相关能力和数据经后续核验,GPT-6 Astra 可能加强电脑操作与科研辅助方向的竞争;但单一来源信息不足以证明其已稳定适用于职场或开放科学场景。 后续观察:需要关注 OpenAI 是否公开正式技术报告、评测口径、工具使用条件和安全测试细节,并核对作者所述数据及其与 Claude 对比的具体范围。
当前抓取源提供的是标题、摘要、来源和原文入口,不直接搬运完整原文。完整报道请通过下方原文链接前往来源站点查看。
抓取通道: 摘要聚合 · 原始域名: x.com
المصدر: @AYi_AInotes)
原文链接: فتح المصدر الأصلي
Aioga 归档: 查看情报页
Content record: social-summary · Updated: 2026-09-04T02:22:24.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。