Skip to content

Forschung Sicherheit

Themen-Archiv1 Treffer

Zur StartseiteGEO summary endpoint

2026-09-11

Technologie

  • Forscher haben mehrere Methoden identifiziert, um die Sicherheitsvorkehrungen von Anthropic zu umgehen und Anweisungen für gefährliche biologische Forschung zu generieren. Die Exploits zeigen, wie legitime wissenschaftliche Anfragen strukturell nicht von bösartigen Anfragen unterscheidbar sein können, was die automatisierte Inhaltsmoderation erschwert. Diese Erkenntnis unterstreicht die anhaltende Herausforderung, Sicherheitsgrenzen in fortschrittlichen Sprachmodellen durchzusetzen.

    KI-Sicherheit & SystemsicherheitArs Technica AI

    Direktlink