Moderacion
Archivo temático • 2 resultados
2026-09-09
Tecnología
Meta publicó anuncios en Facebook e Instagram promoviendo aplicaciones 'nudify' que utilizaban fotos reales de niñas menores, y puso trabas para eliminarlas. El incidente plantea serias preguntas sobre el cumplimiento normativo de la plataforma y las imágenes no consensuadas generadas por IA.
Seguridad de IA • Ars Technica AI
Enlace permanente
2026-09-11
Tecnología
Los investigadores han identificado múltiples métodos para eludir las barreras de seguridad de Anthropic con el fin de generar instrucciones para investigaciones biológicas peligrosas. Las vulnerabilidades demuestran cómo las consultas científicas legítimas pueden ser estructuralmente indistinguibles de las solicitudes maliciosas, lo que complica la moderación automática de contenido. Este hallazgo subraya el desafío persistente de hacer cumplir los límites de seguridad en modelos de lenguaje avanzados.
Seguridad y Protección de IA • Ars Technica AI
Enlace permanente