As Contradições nas Políticas de Segurança do Claude Fable 5
Anthropic lançou o Claude Fable 5, o modelo mais avançado disponível ao público em geral. Com ganhos significativos em capacidades em relação aos seus predecessores, o modelo é oferecido a um preço competitivo face à concorrência.
A empresa implementou um sistema de segurança em dois níveis. Os filtros explícitos desativam automaticamente o modelo para áreas específicas como cibersegurança, biologia e distilação, voltando para o Claude Opus 4.8 — uma abordagem transparente que notifica o utilizador. Simultaneamente, Anthropic desenvolveu salvaguardas invisíveis que limitam a eficácia da IA no desenvolvimento de modelos de fronteira, utilizando modificações de prompts ou fine-tuning sem aviso prévio.
Esta dualidade é criticada como incoerente e potencialmente motivada por proteção da posição competitiva. A falta de transparência sobre limitações silenciosas levanta questões sobre se o modelo está verdadeiramente alinhado com os princípios de segurança declarados, especialmente para pesquisadores que desenvolvem sistemas concorrentes.