OpenAI implementa safeguards para Astra enquanto Anthropic relaxa restrições do Fable
OpenAI anunciou medidas de segurança aprimoradas para seu modelo Astra, um sistema de IA frontier com capacidades avançadas de codificação agentic e cibersegurança. A empresa implementará ambientes de teste isolados, acesso restrito à rede e ferramentas, monitoramento aprimorado e execução sandboxed. Adicionalmente, OpenAI introduziu monitoramento universal da Chain of Thought do modelo para detectar e interromper atividades de alto risco durante treinamento e avaliação. Enquanto isso, Anthropic adotou direção diferente ao relaxar restrições no seu modelo Fable para prompts de biologia, uma mudança que reflete pressão competitiva enquanto empresas de IA chinesas desenvolvem alternativas competitivas com pesos abertos.