Muse Glimmer — IA frontier en tu propio hardware
El modelo open-weight 30B de Meta corre localmente en una sola GPU de consumo. Sin cloud, sin claves API, sin costos recurrentes. Descárgalo de Hugging Face y empieza a construir.
Try Muse Glimmer Now
Chat with Meta's 30B model directly in your browser — no setup needed.
La IA local acaba de ponerse seria
Muse Glimmer entrega rendimiento de nivel frontier en un paquete de 30B que cabe en hardware de consumo. Llamadas a funciones, codificación con contexto largo y workflows agénticos — todo corriendo offline en tu máquina.
Descarga los pesos de Hugging Face — Apache 2.0, sin restricciones
Carga con Ollama, vLLM o llama.cpp en tu GPU
Ejecuta agentes locales permanentes con uso de herramientas y soporte de contexto largo
¿Qué es Muse Glimmer?
Muse Glimmer es un modelo denso de 30 mil millones de parámetros lanzado por Meta Superintelligence Labs el 10 de agosto de 2026. Destilado a partir del modelo cerrado Muse Spark 1.2, apunta a workflows de agentes locales: llamadas a funciones, generación de código, orquestación de herramientas y evaluación LLM-as-a-judge — todo en una sola GPU de consumo.
¿Cómo funciona Muse Glimmer en local?
Muse Glimmer cabe en 16 GB de VRAM con Q4 quantization via llama.cpp. Soporta nativamente 128K de contexto, ejecuta bucles de llamadas a herramientas estructurados y se integra con Ollama para una configuración en un solo comando. Los usuarios de AMD Ryzen AI Max+ obtienen rendimiento optimizado desde el primer día gracias al acuerdo de hardware de Meta.
Por qué ejecutar Muse Glimmer en local
Rendimiento en benchmarks a 30B
- IFBench 77.0 — supera a GPT-5.6 Sol (76.0)
- AIME 2026 con puntuación de 94.7
- GPQA Diamond en 83.5
- Ventana de contexto nativa de 128K
- AA-LCR long-context recall en 80.0
Diseñado para workflows agénticos
- Llamadas a funciones estructuradas y uso de herramientas
- Asistente de codificación local con contexto completo del repositorio
- Análisis de documentos offline y RAG
- LLM-as-a-judge para evaluación automatizada
¿Quién debería usar Muse Glimmer?
Muse Glimmer está hecho para desarrolladores y usuarios avanzados que necesitan IA potente sin dependencias del cloud:
- Desarrolladores construyendo asistentes de codificación locales
- Equipos que procesan documentos de forma privada
- Investigadores haciendo fine-tuning con conjuntos de datos propios
- Cualquiera que quiera IA frontier sin costos de API
Pesos abiertos, control total
Muse Glimmer se publica bajo Apache 2.0 — úsalo comercialmente, modifica los pesos, despliégalo donde quieras. Sin restricciones, sin lista de espera, sin rastreo de uso.
- Licencia permisiva Apache 2.0
- Pesos completos en Hugging Face
- Sin telemetría ni rastreo de uso
- Funciona completamente offline
Empieza a usar Muse Glimmer hoy
Un comando para descargar, un comando para ejecutar. IA frontier en tu propio hardware — gratis y abierto para siempre.
Lo que dicen los desarrolladores sobre Muse Glimmer
Primeras reacciones de la comunidad de IA open source
Ejecutando Muse Glimmer en mi RTX 4070 — las llamadas a funciones funcionan a la perfección. Por fin un modelo local que maneja el uso de herramientas correctamente.
Marcus Chen@local_devMEl score de IFBench a 30B parámetros es sorprendente. Reemplacé mis llamadas a API cloud con Muse Glimmer local y la diferencia de calidad es despreciable.
Sarah Kim@ai_researcherSMigramos nuestro asistente de codificación interno a Muse Glimmer. Cero costos de API, privacidad total, y el contexto de 128K maneja bases de código completas.
David Okafor@startup_ctoDUn comando de Ollama y Muse Glimmer corría en mi Mac. La optimización AMD es impresionante — respuestas fluidas en mi Ryzen AI Max.
Lisa Wang@hobbyistL
FAQ de Muse Glimmer
Preguntas frecuentes sobre el modelo IA local de Meta
Muse Glimmer está diseñado específicamente para workflows de agentes locales. Con 30B parámetros, iguala o supera a modelos mucho más grandes en benchmarks clave — IFBench 77.0, AIME 2026 94.7 — mientras cabe en una sola GPU de consumo. La licencia Apache 2.0 garantiza libertad comercial total sin restricciones.
Muse Glimmer corre en cualquier GPU con 16+ GB de VRAM con Q4 quantization — una RTX 4060 Ti, Radeon RX 7900 o AMD Ryzen AI Max+ con memoria unificada. Para precisión FP16 completa, necesitarás 64 GB de VRAM. Ollama convierte la configuración en un solo comando.
Sí. Meta lanzó Muse Glimmer bajo Apache 2.0 sin restricciones en Hugging Face. Descarga los pesos, úsalos comercialmente, modifícalos, despliégalos — sin claves API, sin suscripciones, sin límites de uso.
Muse Glimmer ofrece calidad frontier para codificación, llamadas a funciones y análisis de documentos — sin costos por token ni preocupaciones de privacidad. Tus datos nunca abandonan tu máquina. El tradeoff es que la velocidad de inferencia depende de tu hardware local en lugar de GPUs en cloud.
Absolutamente. Una vez descargados los pesos, Muse Glimmer funciona sin ninguna dependencia de internet. Esto lo hace ideal para entornos air-gapped, procesamiento de datos sensibles y lugares con conectividad poco fiable.
Muse Glimmer está destilado del modelo cerrado Muse Spark 1.2 de Meta. La destilación preserva las capacidades de razonamiento y uso de herramientas del modelo más grande mientras las comprime en una arquitectura 30B que cabe en hardware de consumo.