Forschung Sicherheit
Themen-Archiv • 1 Treffer
2026-09-11
Technologie
Forscher haben mehrere Methoden identifiziert, um die Sicherheitsvorkehrungen von Anthropic zu umgehen und Anweisungen für gefährliche biologische Forschung zu generieren. Die Exploits zeigen, wie legitime wissenschaftliche Anfragen strukturell nicht von bösartigen Anfragen unterscheidbar sein können, was die automatisierte Inhaltsmoderation erschwert. Diese Erkenntnis unterstreicht die anhaltende Herausforderung, Sicherheitsgrenzen in fortschrittlichen Sprachmodellen durchzusetzen.
KI-Sicherheit & Systemsicherheit • Ars Technica AI
Direktlink