Meta lança Muse Glimmer, modelo de IA open-weight de 30B criado para rodar localmente
A Meta lançou o Muse Glimmer, um novo modelo de inteligência artificial open-weight com 30 bilhões de parâmetros, projetado para executar cargas de trabalho agênticas localmente em PCs e estações de trabalho em vez de enviar cada tarefa para a nuvem.
O destaque está em combinar uma arquitetura dense relativamente compacta com pesos abertos, contexto longo e recursos voltados a agentes. Desenvolvedores podem criar sistemas capazes de raciocinar em várias etapas, chamar ferramentas, trabalhar com informações multimodais e continuar fluxos mantendo mais processamento no hardware local.
Muse Glimmer mira agentes de IA locais sempre ativos
Muse Glimmer é um modelo dense de 30 bilhões de parâmetros do Meta Superintelligence Labs, criado para cargas agênticas que podem permanecer ativas na máquina do usuário. A Meta o posiciona para raciocínio em múltiplas etapas, programação, uso de ferramentas, compreensão multimodal e recuperação de falhas, e não apenas perguntas e respostas curtas.
Modelo 30B projetado para uma única GPU
O modelo foi projetado para rodar localmente em uma única GPU suficientemente capaz, aproximando de PCs e workstations tarefas de IA que normalmente dependem da nuvem. A Meta fornece os pesos sob Apache 2.0, permitindo uso, modificação e redistribuição, inclusive comercial, conforme os termos da licença.
Destilado do Muse Spark com contexto longo
Muse Glimmer foi destilado do modelo maior Muse Spark. Documentos da Meta e do ecossistema descrevem mais de 120 mil tokens de contexto e um componente de percepção dedicado a entradas multimodais. A combinação busca manter grande contexto de trabalho ao longo de cadeias extensas de decisões, chamadas de ferramentas e resultados.
AMD e NVIDIA impulsionam implantação local
A AMD informou testes preliminares no Windows de até 24 tokens/s em Ryzen AI Max+ 395 e até 53 tokens/s em Radeon AI PRO R9700 com dFlash. A NVIDIA também destacou Muse Glimmer para fluxos agênticos locais. O desempenho real varia conforme quantização, memória, software e configuração de hardware.
Por que a IA local open-weight importa
Rodar um agente localmente pode reduzir custos recorrentes de tokens na nuvem e manter mais dados no dispositivo. Isso é relevante para arquivos locais, mensagens ou material proprietário e oferece maior controle sobre inferência, personalização e integração. Porém, um modelo 30B ainda exige bastante memória e hardware capaz e não terá o mesmo desempenho em qualquer notebook comum.
Meta prepara Muse Spark 1.2 open-weight
O lançamento do Glimmer também mostra uma nova ofensiva open-weight da Meta. Mark Zuckerberg afirmou que a empresa planeja lançar em breve uma versão open-weight do mais poderoso Muse Spark 1.2. Assim, Glimmer é um modelo local prático disponível agora e um sinal de que a Meta pretende levar mais da família Muse para além de um ambiente fechado apenas em nuvem.







