OpenAI 发布 GPT-6 Astra,首席研究官 Mark Chen 称其能构建测试软件、跨应用操作电脑并尝试开放科学问题。
作者补充数字:OSWorld 真实桌面任务从 75 分钟降到 40 分钟,职场自动化从 18% 升到 41%,未防护越权率从上一代 48% 压到 0%,并称花了 2000 美元算力解出 10
道十年未解的数学与理论计算难题;
同时指出带工具的综合测试仍落后 Claude。
OpenAI는 GPT-6 Astra를 출시했으며, 최고 연구 책임자 마크 첸은 이 소프트웨어가 테스트 소프트웨어를 구축하고, 여러 애플리케이션 간 컴퓨터를 조작하며, 오픈 사이언스 문제를 실험할 수 있다고 주장했습니다. 저자는 다음과 같은 수치를 덧붙입니다: OSWorld의 실...
OpenAI는 GPT-6 Astra를 출시했으며, 최고 연구 책임자 마크 첸은 이 소프트웨어가 테스트 소프트웨어를 구축하고, 여러 애플리케이션 간 컴퓨터를 조작하며, 오픈 사이언스
문제를 실험할 수 있다고 주장했습니다. 저자는 다음과 같은 수치를 덧붙입니다: OSWorld의 실제 데스크톱 작업은 75분에서 40분으로 줄었고, 직장 자동화율은 18%에서 41%로 증가했으며, 무보호 과잉 적용률은 이전 세대 48%에서 0%로 감소했으며, 10년간 해결되지 않은 10개의 수학 및 이론 문제를 해결하는 데 2,000달러의 컴퓨팅 파워가 투입되었다고 합니다; 동시에 도구에 대한 포괄적인 테스트는 여전히 클로드에 뒤처져 있다고 지적했습니다.
OpenAI 发布 GPT-6 Astra,首席研究官 Mark Chen 称其能构建测试软件、跨应用操作电脑并尝试开放科学问题。
作者补充数字:OSWorld 真实桌面任务从 75 分钟降到 40 分钟,职场自动化从 18% 升到 41%,未防护越权率从上一代 48% 压到 0%,并称花了 2000 美元算力解出 10
道十年未解的数学与理论计算难题;
同时指出带工具的综合测试仍落后 Claude。
来源材料称,OpenAI 发布 GPT-6 Astra,首席研究官 Mark Chen 表示该模型能够构建测试软件、跨应用操作电脑,并尝试处理开放科学问题。
材料还提到,作者补充了 OSWorld 桌面任务用时、职场自动化比例及未防护越权率等对比数据,并称其以 2000 美元算力完成 10 道数学与理论计算难题;同时指出带工具的综合测试仍落后 Claude。
Aioga 判断:目前材料同时包含发布信息、作者补充数据和对比结论,但未提供完整测试方法、评测条件或独立验证,因此不宜仅凭这些内容确认模型能力的普遍性。
可能影响:若相关能力和数据经后续核验,GPT-6 Astra 可能加强电脑操作与科研辅助方向的竞争;但单一来源信息不足以证明其已稳定适用于职场或开放科学场景。 后续观察:需要关注 OpenAI 是否公开正式技术报告、评测口径、工具使用条件和安全测试细节,并核对作者所述数据及其与 Claude 对比的具体范围。
수집 피드는 제목, 요약, 출처와 원문 링크를 제공합니다. Aioga는 원문 전체를 재게시하지 않습니다.
수집 채널: 요약 집계 · 원본 도메인: x.com
출처: @AYi_AInotes)
원문 링크: 원문 열기
Aioga 아카이브: 정보 페이지 보기
Content record: social-summary · Updated: 2026-09-04T02:22:24.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga는 전 세계 AI 동향을 집계하고 확인과 인용을 위해 출처 정보를 보존합니다.