Filtros de segurança da Anthropic falham em barrar conteúdo explícito no Claude, revelam testes
Apesar de proibir formalmente a geração de conteúdos de teor sexual, a Anthropic enfrenta dificuldades para conter o modelo Claude. Testes recentes demonstraram que é surpreendentemente simples contornar os bloqueios de segurança da inteligência artificial.
Trilha
