Zhìpǔ ha rilasciato GLM-5.3, basato sulla stessa base di GLM-5.2, migliorando al massimo il limite
di intelligenza attraverso lo Scaling post-addestramento, con un aumento del 50% nelle capacità di programmazione rispetto alla generazione precedente, ottenendo il primo posto open source in benchmark pubblici come Terminal Bench 3.0 e avvicinandosi a Claude Fable 5. Il modello si comporta in modo comparabile a Mythos 5 in attività di sicurezza come la revisione del codice white-box, ottenendo l'84,5% nei test CyberGym. I pesi del modello saranno resi open source tra due settimane, e a partire da oggi sono attivi strumenti come ZCode e AutoClaw. 🔗 Leggi l'articolo originale via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1
智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench
3.0等公开基准中取得开源第一,并接近Claude Fable 5。
模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。
模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1