Novos Desenvolvimentos

Meta lança Muse Glimmer, um modelo 30B com pesos abertos para fluxos de trabalho de agentes locais

MetaFonte: MarkTechPost10/08/2026, 12:11
A Meta lançou o Muse Glimmer, um modelo multimodal de 30 bilhões de parâmetros destilado do Muse Spark e otimizado para fluxos de trabalho de agentes sempre ativos locais. O modelo combina um transformador causal denso com um codificador de percepção dedicado, apresentando atenção de consulta agrupada e um padrão de atenção repetido para processamento eficiente. Comprimido para aproximadamente 4 bits de precisão com decodificação especulativa ao nível de bloco, o Muse Glimmer funciona em uma única GPU de consumidor ou Mac sem exigir chamadas de rede. O modelo oferece suporte a até 131.072 tokens de contexto e inclui uma torre de visão de 1.8B aceitando até 4.096 tokens visuais por imagem. Duas construções quantizadas estão disponíveis: K-Quant-Dynamic tem como alvo 32 GB VRAM com degradação média de 0.2%, enquanto K-Quant-17GB tem como alvo 24 GB VRAM com degradação de 1.0%. Os pesos são lançados sob Apache 2.0 com suporte para pesos BF16, k-quants GGUF, construções ExecuTorch e drafter DFlash disponíveis no Hugging Face.
Meta lança Muse Glimmer, um modelo 30B com pesos abertos para fluxos de trabalho de agentes locais — lupAI