Investigador abandona Ai2 alertando sobre concentración de poder en desarrollo de IA
Nathan Lambert ha dejado el Instituto Allen para IA (Ai2), donde fue figura central en el desarrollo de modelos de lenguaje de código abierto como Olmo y Tülu. Antes de partir, Lambert reflexionó sobre su experiencia en la institución y sus preocupaciones más amplias sobre la dirección de la investigación en inteligencia artificial.
Durante dos años en Ai2, Lambert realizó aportaciones influyentes: creó RewardBench para evaluación de modelos de recompensa, facilitó el lanzamiento de Tülu 2 como primer modelo público a escala 70B usando optimización de preferencia directa efectivamente, y lideró iniciativas de post-entrenamiento incluyendo Tülu 3, que introdujo el término Aprendizaje por Refuerzo con Recompensas Verificables (RLVR).
Lambert subraya que Ai2 opera en un espacio raro entre la investigación académica e industrial, permitiendo desarrollo transparente de modelos. Advierte que el avance acelerado de la IA se confina cada vez más a corporaciones privadas, concentrando poder en pocas manos. Argumenta que investigadores independientes y ecosistemas de código abierto son críticos para garantizar que la tecnología de IA beneficie a todos y permanezca sujeta a perspectivas diversas.