Zhipu wypuściło GLM-5.3, oparte na tej samej bazie co GLM-5.2, które zwiększyło inteligentne górne
granice poprzez ekstremalne skalowanie po szkoleniu, poprawiając możliwości programistyczne o 50% w porównaniu z poprzednią generacją, zajmując pierwsze miejsce w open source w publicznych testach takich jak Terminal Bench 3.0 i zbliżając się do Claude Fable 5. Model osiągnął wyniki porównywalne z Mythos 5 w zadaniach bezpieczeństwa, takich jak przegląd kodu w białej skrzynce, zdobywając 84,5% w teście CyberGym. Wagi modeli zostaną udostępnione jako open source za dwa tygodnie, a narzędzia takie jak ZCode i AutoClaw będą dostępne od dziś. 🔗 Przeczytaj oryginalny artykuł za pośrednictwem AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1
智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench
3.0等公开基准中取得开源第一,并接近Claude Fable 5。
模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。
模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1