Meta Superintelligence Labs · July 2026

Muse Glimmer — IA frontier no seu próprio hardware

O modelo open-weight 30B da Meta roda localmente em uma única GPU consumer. Sem cloud, sem chaves API, sem custos recorrentes. Baixe do Hugging Face e comece a construir.

User
User
User
User
User
Muse Glimmer by Meta Superintelligence Labs · #1 on Arena Elo

Try Muse Glimmer Now

Chat with Meta's 30B model directly in your browser — no setup needed.

A IA local ficou séria de vez

Muse Glimmer entrega desempenho frontier em um pacote de 30B que cabe em hardware consumer. Chamadas de função, codificação com contexto longo e workflows agênticos — tudo rodando offline na sua máquina.

🤖

Baixe os pesos do Hugging Face — Apache 2.0, sem restrições

❤️

Carregue via Ollama, vLLM ou llama.cpp na sua GPU

🔮

Execute agentes locais permanentes com uso de ferramentas e suporte a contexto longo

O que é o Muse Glimmer?

Muse Glimmer é um modelo denso de 30 bilhões de parâmetros lançado pela Meta Superintelligence Labs em 10 de agosto de 2026. Destilado do modelo fechado Muse Spark 1.2, ele foi projetado para workflows de agentes locais: chamadas de função, geração de código, orquestração de ferramentas e avaliação LLM-as-a-judge — tudo em uma única GPU consumer.

Como o Muse Glimmer funciona localmente?

Muse Glimmer cabe em 16 GB de VRAM com Q4 quantization via llama.cpp. Suporta nativamente 128K de contexto, executa loops de chamada de ferramentas estruturados e se integra com Ollama para configuração em um único comando. Usuários AMD Ryzen AI Max+ têm desempenho otimizado desde o primeiro dia graças à parceria de hardware da Meta.

Por que rodar o Muse Glimmer localmente

Desempenho em benchmarks a 30B

  • IFBench 77.0 — supera GPT-5.6 Sol (76.0)
  • AIME 2026 com pontuação de 94.7
  • GPQA Diamond em 83.5
  • Janela de contexto nativa de 128K
  • AA-LCR long-context recall em 80.0

Feito para workflows agênticos

  • Chamadas de função estruturadas e uso de ferramentas
  • Assistente de código local com contexto completo do repositório
  • Análise de documentos offline e RAG
  • LLM-as-a-judge para avaliação automatizada

Quem deve usar o Muse Glimmer?

Muse Glimmer foi feito para desenvolvedores e power users que precisam de IA capaz sem dependências de cloud:

  • Desenvolvedores criando assistentes de código locais
  • Times processando documentos de forma privada
  • Pesquisadores fazendo fine-tuning em datasets próprios
  • Qualquer pessoa que queira IA frontier sem custos de API

Pesos abertos, controle total

Muse Glimmer é lançado sob Apache 2.0 — use comercialmente, modifique os pesos, implante onde quiser. Sem restrições, sem lista de espera, sem rastreamento de uso.

  • Licença permissiva Apache 2.0
  • Pesos completos no Hugging Face
  • Sem telemetria ou rastreamento de uso
  • Funciona completamente offline

Comece a usar o Muse Glimmer hoje

Um comando para baixar, um comando para executar. IA frontier no seu próprio hardware — gratuito e aberto para sempre.

O que os desenvolvedores dizem sobre o Muse Glimmer

Primeiras reações da comunidade de IA open source

  • Rodando o Muse Glimmer na minha RTX 4070 — as chamadas de função funcionam perfeitamente. Finalmente um modelo local que lida com uso de ferramentas do jeito certo.

    Marcus Chen
    @local_dev
    M
  • O score do IFBench a 30B parâmetros é impressionante. Substituí minhas chamadas de API na nuvem pelo Muse Glimmer local e a diferença de qualidade é negligenciável.

    Sarah Kim
    @ai_researcher
    S
  • Migramos nosso assistente de código interno para o Muse Glimmer. Zero custos de API, privacidade total, e o contexto de 128K aguenta bases de código inteiras.

    David Okafor
    @startup_cto
    D
  • Um comando do Ollama e o Muse Glimmer estava rodando no meu Mac. A otimização AMD é impressionante — respostas fluidas no meu Ryzen AI Max.

    Lisa Wang
    @hobbyist
    L

FAQ do Muse Glimmer

Perguntas frequentes sobre o modelo IA local da Meta

  • Muse Glimmer foi construído especificamente para workflows de agentes locais. Com 30B parâmetros, iguala ou supera modelos muito maiores nos benchmarks principais — IFBench 77.0, AIME 2026 94.7 — enquanto cabe em uma única GPU consumer. A licença Apache 2.0 garante liberdade comercial total sem restrições.

  • Muse Glimmer roda em qualquer GPU com 16+ GB de VRAM com Q4 quantization — uma RTX 4060 Ti, Radeon RX 7900 ou AMD Ryzen AI Max+ com memória unificada. Para precisão FP16 completa, você vai precisar de 64 GB de VRAM. O Ollama torna a configuração um único comando.

  • Sim. A Meta lançou o Muse Glimmer sob Apache 2.0 sem restrições no Hugging Face. Baixe os pesos, use comercialmente, modifique-os, implante onde quiser — sem chaves API, sem assinaturas, sem limites de uso.

  • Muse Glimmer oferece qualidade frontier para codificação, chamadas de função e análise de documentos — sem custos por token nem preocupações com privacidade. Seus dados nunca saem da sua máquina. O tradeoff é que a velocidade de inferência depende do seu hardware local em vez de GPUs na nuvem.

  • Com certeza. Uma vez baixados os pesos, o Muse Glimmer funciona sem nenhuma dependência de internet. Isso o torna ideal para ambientes air-gapped, processamento de dados sensíveis e locais com conectividade instável.

  • Muse Glimmer foi destilado do modelo fechado Muse Spark 1.2 da Meta. A destilação preserva as capacidades de raciocínio e uso de ferramentas do modelo maior, comprimindo-as em uma arquitetura de 30B que cabe em hardware consumer.