Investigacion De Ia
Archivo temático • 1 resultados
2026-09-11
Tecnología
Los investigadores han identificado múltiples métodos para eludir las barreras de seguridad de Anthropic con el fin de generar instrucciones para investigaciones biológicas peligrosas. Las vulnerabilidades demuestran cómo las consultas científicas legítimas pueden ser estructuralmente indistinguibles de las solicitudes maliciosas, lo que complica la moderación automática de contenido. Este hallazgo subraya el desafío persistente de hacer cumplir los límites de seguridad en modelos de lenguaje avanzados.
Seguridad y Protección de IA • Ars Technica AI
Enlace permanente