Nathan Lambert deixa Ai2 após contribuição decisiva ao desenvolvimento de modelos abertos
Nathan Lambert partiu do Allen Institute for AI (Ai2), onde foi figura central no desenvolvimento de modelos de linguagem de código aberto, particularmente os projetos Olmo e Tülu. Antes de sair, Lambert refletiu sobre seu tempo na instituição e suas implicações mais amplas para a pesquisa em inteligência artificial.
Durante dois anos no Ai2, Lambert produziu contribuições influentes no campo: criou o RewardBench para avaliação de modelos de recompensa, colaborou no lançamento do Tülu 2 (primeiro modelo público a escala 70B implementando otimização de preferência direta), e liderou projetos de pós-treinamento incluindo o Tülu 3, que introduziu o termo Reinforcement Learning with Verifiable Rewards (RLVR).
Lambert enfatiza que o Ai2 ocupa um espaço raro entre pesquisa acadêmica e industrial, possibilitando desenvolvimento transparente de modelos. Alerta que a aceleração da pesquisa em IA concentra-se cada vez mais em empresas privadas, elevando riscos de consolidação de poder. Defende que pesquisadores independentes e ecossistemas de código aberto são essenciais para garantir que a tecnologia beneficie a todos e permaneça sujeita a perspectivas diversas.