Habilidades de escrita do Claude diminuem à medida que o foco se desloca para a comunicação com IA
Os engenheiros da Anthropic explicaram que as habilidades de escrita do Claude diminuíram devido a uma mudança nas prioridades de treinamento do modelo. Kneen, engenheiro da Anthropic, afirmou que as otimizações recentes se concentraram mais nas capacidades matemáticas e de código, em vez de escrita.
Os modelos foram treinados com explicações técnicas destinadas a outros sistemas de IA, levando a um estilo 'Claudeish' único que é eficaz para a IA, mas difícil para os humanos entenderem. Kneen comparou isso com uma pessoa que se comunica apenas com indivíduos no espectro do autismo, desenvolvendo um estilo interno que é difícil para os outros entenderem.
Ele enfatizou que o sistema de recompensa de aprendizado por reforço prioriza a compreensão da IA em detrimento da legibilidade humana. A Anthropic encontrou um melhor equilíbrio no Opus 5.5, mas Kneen admitiu que ele ainda não supera o Opus 4.6. O desafio continua sendo um desafio, com melhorias contínuas planejadas.