IA

Meta lança Muse Glimmer: agente de IA com 30B de parâmetros que roda na sua GPU

Adrian Kessler

A Meta construiu um agente de IA de 30 bilhões de parâmetros que roda inteiramente em hardware de consumo — e liberou o código-fonte gratuitamente. O modelo, chamado Muse Glimmer, não roteia suas tarefas pelos servidores da Meta. Ele executa localmente em sua própria GPU e, com uma pegada de memória quantizada de 18 a 20 gigabytes, cabe no envelope das placas gráficas de consumo atuais de alto padrão.

Isso é importante porque a geração anterior de modelos locais — as variantes de 7 bilhões e 13 bilhões de parâmetros que lotaram a biblioteca Ollama nos últimos dois anos — eram bons geradores de texto, mas agentes autônomos fracos. Eles enfrentavam dificuldades com raciocínio de múltiplas etapas, chamadas de ferramentas que falhavam no meio do caminho e tarefas que exigiam lembrar o que havia acontecido três passos atrás. O Muse Glimmer é projetado especificamente para esses fluxos de trabalho: codificação, chamada de funções, gerenciamento de agenda, organização de arquivos e sequências de tarefas em várias etapas que se recuperam automaticamente quando uma chamada de ferramenta quebra.

A arquitetura subjacente é uma destilação do Muse Spark, o modelo comercial ao qual a Meta começou a vender acesso via API no mês passado. Por meio de destilação de logits e aprendizado por reforço, a empresa comprimiu seu carro-chefe fechado em uma forma que cabe em uma GPU de 24 gigabytes — a RTX 5090, Apple M5 Max ou M4 Max. A decodificação especulativa aumenta ainda mais a produtividade: a RTX 5090 roda o modelo 3,1 vezes mais rápido do que sem ela, a M5 Max 1,8 vezes, a M4 Max 1,5 vezes. Na prática, essa diferença é a linha entre um agente que parece responsivo e um que exige paciência.

O modelo processa texto e imagens intercalados — capturas de tela, documentos, entradas de conteúdo misto — e opera em mais de 100 idiomas. Ele se conecta nativamente às estruturas que os usuários de IA local já executam: Ollama, LM Studio, llama.cpp, MLX. Se você já baixa modelos do Hugging Face e executa em seu hardware, o Muse Glimmer se encaixa nesse fluxo de trabalho sem ferramentas adicionais.

A licença é Apache 2.0, o que significa que não há restrições comerciais. Indivíduos, empresas e pesquisadores podem usá-lo sem pagar à Meta. Isso o coloca em uma categoria diferente dos modelos da OpenAI e da Anthropic, que exigem pagamento por token mesmo para trabalhos de desenvolvimento. Em comparação com o Gemma4-31B do Google e o Qwen3.6-27B da Alibaba — seus concorrentes de código aberto mais próximos em escala — a Meta posiciona o Muse Glimmer como forte para seu tamanho em benchmarks de modelos de linguagem agentivos e gerais, sem fazer alegações mais específicas sobre em quais tarefas ele vence.

O limite de hardware continua seletivo. Encaixar 18 gigabytes de pesos de modelo em uma GPU parece acessível até que você calcule qual GPU isso exige. Uma RTX 5090 atualmente custa acima de dois mil dólares. Os equipamentos com Apple M5 Max começam perto de três mil. Esta é uma IA local para uma faixa de renda específica, não uma substituição da nuvem para a maioria dos usuários. A versão quantizada também é um irmão de fidelidade reduzida do Muse Spark: herda o sinal de treinamento do modelo comercial, mas não é o modelo comercial. A Meta continua vendendo acesso à versão de maior capacidade.

O que muda com este lançamento é o nível de agente capaz dos modelos locais. Executar um modelo de 30 bilhões de parâmetros treinado para conclusão autônoma de tarefas é diferente de executar um modelo de chat com a mesma contagem de parâmetros. A distinção está em como o modelo lida com falhas de ferramentas e sequências de várias etapas — não em quão bem ele completa uma única frase.

Os pesos estão disponíveis no Hugging Face a partir de 10 de agosto, sob licença Apache 2.0. A Meta confirmou parcerias de otimização em nível de dispositivo com AMD, Arm, Dell, Intel e Nvidia, com builds ajustados adicionais para configurações específicas de hardware a seguir. A comunidade de IA local testará o modelo em poucos dias, como faz com todo lançamento significativo — os resultados dos benchmarks dessa comunidade fornecerão uma imagem mais clara de onde o Muse Glimmer realmente está dentro de duas semanas a partir de hoje.

Tags: , , , , ,

Discussão

Há 0 comentários.