Zhipu lanza GLM-5.3, basado en la misma base que GLM-5.2, mejorando el límite de inteligencia
mediante un escalado post-entrenamiento extremo, aumentando la capacidad de programación en un 50% respecto a la generación anterior, logrando el primer lugar en código abierto en benchmarks públicos como Terminal Bench 3.0, y acercándose a Claude Fable 5. El modelo se desempeña igual que Mythos 5 en tareas de seguridad como revisión de código en caja blanca, y obtiene una puntuación del 84.5% en la prueba CyberGym. Los pesos del modelo se abrirán en dos semanas, y a partir de hoy se lanzan herramientas como ZCode y AutoClaw. 🔗 Leer el artículo original via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1
智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench
3.0等公开基准中取得开源第一,并接近Claude Fable 5。
模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。
模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1
La fuente proporciona título, resumen, atribución y enlace original. Aioga no republica el artículo completo.