Prime Intellect hat einen Benchmark veröffentlicht…
…der 18 Frontier-Modelle über 153 autonome Durchläufe hinweg unter Verwendung des nanoGPT-Optimierungsframeworks bewertet. Die Studie veröffentlicht offene Protokolle von Tool-Aufrufen und Reasoning-Scratchpads und bietet Entwicklern detaillierte Daten zu den aktuellen Fähigkeiten von Modellen bei selbstgesteuerten Aufgaben.
KI-generiert: Die Zusammenfassungen schreibt eine KI auf Grundlage der verlinkten Quellen. So nutzen wir KI
Source Brief
Prime Intellect hat einen Benchmark veröffentlicht, der 18 Frontier-Modelle über 153 autonome Durchläufe hinweg unter Verwendung des nanoGPT-Optimierungsframeworks bewertet. Die Studie veröffentlicht offene Protokolle von Tool-Aufrufen und Reasoning-Scratchpads und bietet Entwicklern detaillierte Daten zu den aktuellen Fähigkeiten von Modellen bei selbstgesteuerten Aufgaben.