Skip to content

Modelos E Pesquisas De Ia

Arquivo temático1 resultados

Voltar ao inícioGEO summary endpoint

2026-09-11

Tecnologia

  • Pesquisadores identificaram múltiplos métodos para contornar as barreiras de segurança da Anthropic a fim de gerar instruções para pesquisas biológicas perigosas. As explorações demonstram como consultas científicas legítimas podem ser estruturalmente indistinguíveis de solicitações maliciosas, complicando a moderação automática de conteúdo. Essa descoberta reforça o desafio persistente de fazer cumprir limites de segurança em modelos de linguagem avançados.

    Segurança e Proteção de IAArs Technica AI

    Link permanente