Novos Desenvolvimentos

Liquid AI Lança LFM2.5-VL-3B: Um Modelo Vision-Language de 3B para Compreensão de Ecrãs e Documentos em Dispositivos

LFM2.5-VL-3B + Liquid AIFonte: MarkTechPost13/08/2026, 12:56
A Liquid AI lançou o LFM2.5-VL-3B, um modelo vision-language com 3,1 bilhões de parâmetros otimizado para implantação em dispositivos em plataformas móvel, web e desktop. O modelo lê ecrãs digitais, fixa objetos a coordenadas de ecrã, analisa documentos e gráficos, e executa invocações de ferramentas a partir de entrada visual mantendo latência baixa. Alcança uma pontuação média de 69,4 em 28 benchmarks de visão, equiparando o desempenho de modelos maiores com 4,7 bilhões de parâmetros. Opera dentro de aproximadamente 3 GB de memória e decodifica a 228 tokens por segundo num processador Apple M5 Max. A janela de contexto de 32.768 tokens suporta 16 idiomas, e os pesos estão disponíveis em formatos nativo, GGUF, ONNX e MLX compatíveis com principais motores de inferência incluindo vLLM, SGLang e llama.cpp.
Liquid AI Lança LFM2.5-VL-3B: Um Modelo Vision-Language de 3B para Compreensão de Ecrãs e Documentos em Dispositivos — lupAI