Zhipu
Themen-Archiv • 1 Treffer
KI-generiert: Die Zusammenfassungen schreibt eine KI auf Grundlage der verlinkten Quellen. So nutzen wir KI
2026-09-18
Technologie
Zhipu AI hat GLM-5.3-FlashX veröffentlicht und behauptet, auf rund 100.000 einheimischen Beschleunigern eine Inferenz von fast 200 Tokens pro Sekunde zu erreichen. Das Basis-Flash-Modell ist ein 320B-MoE mit 18B aktiven Parametern, optimiert durch einen Infra-Agent-Serving-Stack.
Modellveröffentlichung • Pandaily
Direktlink