lupAI
Pesquisa & Papers

Reka apresenta o rho-1: um modelo unificado para texto, vídeo e ações de robôs

RekaFonte: MarkTechPost06/10/2026, 12:36
A Reka apresentou o Rho-1, um modelo omnisciente de 19 bilhões de parâmetros, capaz de compreender, gerar e executar tarefas em texto, imagens, vídeo e ações de robôs. Ao contrário dos sistemas multimodais tradicionais, que dependem de vários modelos especializados, o Rho-1 opera como uma única rede neural, eliminando a necessidade de transferências entre diferentes modelos. O modelo pode gerar um farol, empacotá-lo, animá-lo e explicar as alterações em apenas cinco etapas, sem a necessidade de ferramentas externas. O Rho-1 utiliza dois formatos nativos para entrada e saída, com blocos de transformadores contendo dois fluxos de pesos de especialista—um para compreensão e outro para geração. O modelo gera vídeo em tempo real a uma taxa de 0,79x, com o primeiro clipe aparecendo em cerca de 7 segundos, superando uma pipeline multi-agente que levou 13,8 segundos. Uma versão condensada do modelo reduz os passos de desruído de 99 para 8, alcançando um clipe de 5,3 segundos em menos de um segundo. O modelo também suporta streaming contínuo e atualizações durante a execução, demonstrando sua versatilidade em tarefas de robótica e simulação.
Reka apresenta o rho-1: um modelo unificado para texto, vídeo e ações de robôs — lupAI