Modelos E Pesquisas De Ia
Arquivo temático • 1 resultados
2026-09-11
Tecnologia
Pesquisadores identificaram múltiplos métodos para contornar as barreiras de segurança da Anthropic a fim de gerar instruções para pesquisas biológicas perigosas. As explorações demonstram como consultas científicas legítimas podem ser estruturalmente indistinguíveis de solicitações maliciosas, complicando a moderação automática de conteúdo. Essa descoberta reforça o desafio persistente de fazer cumprir limites de segurança em modelos de linguagem avançados.
Segurança e Proteção de IA • Ars Technica AI
Link permanente