Skip to content
Intelligence IAAug 8, 2026M&A
Article

AMD -> Taalas

AMD acquiert la startup canadienne Taalas, qui encode en dur les poids des modèles directement dans les puces d'inférence, ce qui les rend extrêmement rapides mais verrouillées à un seul modèle. Une puce de démonstration a atteint plus de 16,000 tokens par seconde par utilisateur en exécutant Llama 3.1-8B.

Redaction Data Cube AISource: the-decoder.com
01

Brief source

AMD acquiert la startup canadienne Taalas, qui encode en dur les poids des modèles directement dans les puces d'inférence, ce qui les rend extrêmement rapides mais verrouillées à un seul modèle. Une puce de démonstration a atteint plus de 16,000 tokens par seconde par utilisateur en exécutant Llama 3.1-8B.