Zhipu
Archive thématique • 1 résultats
Généré par IA : résumés rédigés par une IA à partir des sources citées. Notre usage de l'IA
2026-09-18
Technologie
Zhipu AI a lancé GLM-5.3-FlashX, affirmant une inférence de près de 200 tokens par seconde sur ~100,000 accélérateurs nationaux. Le modèle Flash de base est un MoE de 320B avec 18B de paramètres actifs, optimisé par une stack de service Infra Agent.
Publication de modèle • Pandaily
Lien permanent