Zhipu a publié GLM-5.3, basé sur la même base que GLM-5.2, en améliorant la limite intelligente
grâce à un scaling post-entraînement extrême. La capacité de programmation a augmenté de 50 % par rapport à la génération précédente, obtenant la première place en open source sur des benchmarks publics tels que Terminal Bench 3.0, et se rapprochant de Claude Fable 5. Le modèle performe de manière comparable à Mythos 5 dans des tâches de sécurité comme l'audit de code en boîte blanche, et obtient 84,5 % au test CyberGym. Les poids du modèle seront open source dans deux semaines, et dès aujourd'hui, des outils comme ZCode et AutoClaw sont disponibles. 🔗 Lire l'article original via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1
智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench
3.0等公开基准中取得开源第一,并接近Claude Fable 5。
模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。
模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1
La source fournit un titre, un résumé, une attribution et un lien original. Aioga ne republie pas l’article intégral.