Zhipu merilis GLM-5.3, berdasarkan fondasi yang sama dengan GLM-5.2, melalui Scaling Pasca-Pelatihan
yang ekstrem untuk meningkatkan batas kecerdasan, kemampuan pemrogramannya meningkat 50% dibanding generasi sebelumnya, menempati posisi pertama open source di benchmark publik seperti Terminal Bench 3.0, dan mendekati Claude Fable 5. Model ini berkinerja setara dengan Mythos 5 dalam tugas keamanan seperti pemeriksaan kode white-box, dan meraih skor 84,5% di tes CyberGym. Bobot model akan dibuka source dalam dua minggu, mulai hari ini tersedia alat seperti ZCode, AutoClaw, dll. 🔗 Baca artikel asli via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1
智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench
3.0等公开基准中取得开源第一,并接近Claude Fable 5。
模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。
模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1