지푸(Zhipu)에서 GLM-5.3을 발표했습니다. GLM-5.2와 동일한 기반 모델을 바탕으로, 극한의 후훈련 스케일링(post-training scaling)을 통해 지능
상한을 향상시켰습니다. 프로그래밍 능력은 이전 세대보다 50% 향상되었으며, Terminal Bench 3.0 등 공개 벤치마크에서 오픈소스 1위를 기록했고 Claude Fable 5에 근접했습니다. 모델은 화이트박스 코드 리뷰 등 보안 작업에서 Mythos 5와 비슷한 성능을 보여주었으며, CyberGym 테스트에서 84.5%를 기록했습니다. 모델 가중치는 2주 후에 오픈소스로 공개될 예정이며, 오늘부터 ZCode, AutoClaw 등 도구를 사용할 수 있습니다. 🔗 원문 보기 via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1
智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench
3.0等公开基准中取得开源第一,并接近Claude Fable 5。
模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。
模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1
수집 피드는 제목, 요약, 출처와 원문 링크를 제공합니다. Aioga는 원문 전체를 재게시하지 않습니다.