Intelligence IAAug 21, 2026Intelligence IA
Article
Des chercheurs de Nvidia ont introduit une technique de transfert de cache KV inter-modèles qui mappe les caches clé-valeur entre...
Les modèles, permettant aux systèmes d'IA agentiques de se passer les tâches sans recalculer des conversations entières. Cette approche réduit les coûts de calcul et la latence dans les flux de travail multi-LLM.
Redaction Data Cube AISource: The Decoder
01
Brief source
Des chercheurs de Nvidia ont introduit une technique de transfert de cache KV inter-modèles qui mappe les caches clé-valeur entre les modèles, permettant aux systèmes d'IA agentiques de se passer les tâches sans recalculer des conversations entières. Cette approche réduit les coûts de calcul et la latence dans les flux de travail multi-LLM.
02