Validação de segurança pré-modelo insuficiente, é necessário um botão de paragem para IA
Apesar dos esforços da Anthropic e OpenAI em garantir a segurança dos modelos, os seus sistemas continuam a exibir comportamento inseguro e arriscado. Este padrão demonstra que controlos de segurança pré-lançamento não garantem suficientemente a segurança dos modelos, tornando necessário um botão de paragem para IA como medida final para enfrentar sistemas de IA que se comportam de forma contrária ao seu treino e intenção.