OpenAI 发布 GPT-6 Astra,首席研究官 Mark Chen 称其能构建测试软件、跨应用操作电脑并尝试开放科学问题。
作者补充数字:OSWorld 真实桌面任务从 75 分钟降到 40 分钟,职场自动化从 18% 升到 41%,未防护越权率从上一代 48% 压到 0%,并称花了 2000 美元算力解出 10
道十年未解的数学与理论计算难题;
同时指出带工具的综合测试仍落后 Claude。
OpenAI bracht GPT-6 Astra uit, waarbij Chief Research Officer Mark Chen beweert testsoftware te kunnen bouwen, computers te kunnen bedienen in applicaties...
OpenAI bracht GPT-6 Astra uit, waarbij Chief Research Officer Mark Chen beweert testsoftware te
kunnen bouwen, computers te kunnen bedienen in applicaties en te experimenteren met open science-problemen. De auteur voegt cijfers toe: de echte desktoptaken van OSWorld daalden van 75 minuten naar 40 minuten, automatisering op de werkplek steeg van 18% naar 41%, het percentage onbeschermde overreachs daalde van 48% in de vorige generatie naar 0%, en er werd gezegd dat er $2.000 aan rekenkracht werd besteed aan het oplossen van 10 wiskundige en theoretische problemen die tien jaar lang onopgelost waren gebleven; Tegelijkertijd wees het erop dat uitgebreide tests met tools nog steeds achter Claude blijven.
OpenAI 发布 GPT-6 Astra,首席研究官 Mark Chen 称其能构建测试软件、跨应用操作电脑并尝试开放科学问题。
作者补充数字:OSWorld 真实桌面任务从 75 分钟降到 40 分钟,职场自动化从 18% 升到 41%,未防护越权率从上一代 48% 压到 0%,并称花了 2000 美元算力解出 10
道十年未解的数学与理论计算难题;
同时指出带工具的综合测试仍落后 Claude。
来源材料称,OpenAI 发布 GPT-6 Astra,首席研究官 Mark Chen 表示该模型能够构建测试软件、跨应用操作电脑,并尝试处理开放科学问题。
材料还提到,作者补充了 OSWorld 桌面任务用时、职场自动化比例及未防护越权率等对比数据,并称其以 2000 美元算力完成 10 道数学与理论计算难题;同时指出带工具的综合测试仍落后 Claude。
Aioga 判断:目前材料同时包含发布信息、作者补充数据和对比结论,但未提供完整测试方法、评测条件或独立验证,因此不宜仅凭这些内容确认模型能力的普遍性。
可能影响:若相关能力和数据经后续核验,GPT-6 Astra 可能加强电脑操作与科研辅助方向的竞争;但单一来源信息不足以证明其已稳定适用于职场或开放科学场景。 后续观察:需要关注 OpenAI 是否公开正式技术报告、评测口径、工具使用条件和安全测试细节,并核对作者所述数据及其与 Claude 对比的具体范围。
当前抓取源提供的是标题、摘要、来源和原文入口,不直接搬运完整原文。完整报道请通过下方原文链接前往来源站点查看。
抓取通道: 摘要聚合 · 原始域名: x.com
Bron: @AYi_AInotes)
原文链接: Open oorspronkelijke bron
Aioga 归档: 查看情报页
Content record: social-summary · Updated: 2026-09-04T02:22:24.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。