Meta Superintelligence Labs · July 2026

Muse Glimmer — Frontier-KI auf deiner eigenen Hardware

Metas 30B Open-Weight-Modell läuft lokal auf einer Consumer-GPU. Keine Cloud, keine API-Schlüssel, keine laufenden Kosten. Von Hugging Face herunterladen und loslegen.

User
User
User
User
User
Muse Glimmer by Meta Superintelligence Labs · #1 on Arena Elo

Try Muse Glimmer Now

Chat with Meta's 30B model directly in your browser — no setup needed.

Lokale KI auf neuem Niveau

Muse Glimmer liefert Frontier-Performance in einem 30B-Paket, das auf Consumer-Hardware passt. Funktionsaufruf, Long-Context-Coding und agentische Workflows — alles offline auf deiner Maschine.

🤖

Weights von Hugging Face herunterladen — Apache 2.0, kein Gating

❤️

Laden via Ollama, vLLM oder llama.cpp auf deiner GPU

🔮

Dauerhaft laufende lokale Agenten mit Tool-Use und Long-Context-Unterstützung

Was ist Muse Glimmer?

Muse Glimmer ist ein Dichtmodell mit 30 Milliarden Parametern, das am 10. August 2026 von Meta Superintelligence Labs veröffentlicht wurde. Destilliert aus dem geschlossenen Muse Spark 1.2, zielt es auf lokale Agenten-Workflows ab: Funktionsaufruf, Code-Generierung, Tool-Orchestrierung und LLM-as-a-Judge-Evaluierung — alles auf einer einzelnen Consumer-GPU.

Wie funktioniert Muse Glimmer lokal?

Muse Glimmer passt mit Q4 quantization via llama.cpp in 16 GB VRAM. Es unterstützt nativ 128K Kontext, führt strukturierte Tool-Calling-Loops aus und integriert sich mit Ollama für die Einrichtung per Einzel-Befehl. AMD Ryzen AI Max+ Nutzer erhalten ab dem ersten Tag optimierte Performance durch Metas Hardware-Partnerschaft.

Warum Muse Glimmer lokal betreiben

Benchmark-Performance bei 30B

  • IFBench 77.0 — schlägt GPT-5.6 Sol (76.0)
  • AIME 2026 Score von 94.7
  • GPQA Diamond bei 83.5
  • 128K nativer Kontextfenster
  • AA-LCR Long-Context-Recall bei 80.0

Gebaut für Agenten-Workflows

  • Strukturierter Funktionsaufruf und Tool-Use
  • Lokaler Coding-Assistent mit vollem Repository-Kontext
  • Offline-Dokumentenanalyse und RAG
  • LLM-as-a-Judge für automatische Evaluierung

Für wen ist Muse Glimmer geeignet?

Muse Glimmer ist für Entwickler und Power-User gebaut, die leistungsfähige KI ohne Cloud-Abhängigkeiten benötigen:

  • Entwickler, die lokale Coding-Assistenten bauen
  • Teams, die private Dokumentenanalysen durchführen
  • Forscher, die auf eigenen Datensätzen fine-tunen
  • Alle, die Frontier-KI ohne API-Kosten möchten

Offene Weights, volle Kontrolle

Muse Glimmer wird unter Apache 2.0 veröffentlicht — kommerziell nutzen, Weights modifizieren, überall einsetzen. Kein Gating, keine Warteliste, kein Usage-Tracking.

  • Apache 2.0 permissive Lizenz
  • Vollständige Weights auf Hugging Face
  • Keine Telemetrie oder Nutzungsverfolgung
  • Funktioniert vollständig offline

Starte noch heute mit Muse Glimmer

Ein Befehl zum Herunterladen, ein Befehl zum Ausführen. Frontier-KI auf deiner eigenen Hardware — kostenlos und offen für immer.

Was Entwickler über Muse Glimmer sagen

Erste Reaktionen aus der Open-Source-KI-Community

  • Muse Glimmer läuft auf meiner RTX 4070 — Funktionsaufruf funktioniert tadellos. Endlich ein lokales Modell, das Tool-Use richtig beherrscht.

    Marcus Chen
    @local_dev
    M
  • Der IFBench-Score bei 30B Parametern ist beeindruckend. Ich habe meine Cloud-API-Aufrufe durch lokales Muse Glimmer ersetzt — der Qualitätsunterschied ist vernachlässigbar.

    Sarah Kim
    @ai_researcher
    S
  • Wir haben unseren internen Coding-Assistenten auf Muse Glimmer umgestellt. Null API-Kosten, volle Privatsphäre, und der 128K-Kontext verarbeitet ganze Codebasen.

    David Okafor
    @startup_cto
    D
  • Ein Ollama-Befehl und Muse Glimmer lief auf meinem Mac. Die AMD-Optimierung ist beeindruckend — flüssige Antworten auf meinem Ryzen AI Max.

    Lisa Wang
    @hobbyist
    L

Muse Glimmer FAQ

Häufige Fragen zu Metas lokalem KI-Modell

  • Muse Glimmer ist gezielt für lokale Agenten-Workflows entwickelt. Mit 30B Parametern erreicht oder übertrifft es deutlich größere Modelle in wichtigen Benchmarks — IFBench 77.0, AIME 2026 94.7 — und passt dabei auf eine einzelne Consumer-GPU. Die Apache 2.0 Lizenz bietet volle kommerzielle Freiheit ohne Einschränkungen.

  • Muse Glimmer läuft auf jeder GPU mit 16+ GB VRAM bei Q4 quantization — einer RTX 4060 Ti, Radeon RX 7900 oder AMD Ryzen AI Max+ mit Unified Memory. Für volle FP16-Präzision werden 64 GB VRAM benötigt. Ollama macht die Einrichtung zu einem einzigen Befehl.

  • Ja. Meta hat Muse Glimmer unter Apache 2.0 ohne Gating auf Hugging Face veröffentlicht. Weights herunterladen, kommerziell nutzen, modifizieren, einsetzen — keine API-Schlüssel, keine Abonnements, keine Nutzungslimits.

  • Muse Glimmer bietet Frontier-Qualität für Coding, Funktionsaufruf und Dokumentenanalyse — ohne Token-Kosten oder Datenschutzbedenken. Deine Daten verlassen niemals deine Maschine. Der Kompromiss: Die Inferenzgeschwindigkeit hängt von deiner lokalen Hardware ab, nicht von Cloud-GPUs.

  • Absolut. Sobald du die Weights heruntergeladen hast, läuft Muse Glimmer ohne jegliche Internetabhängigkeit. Das macht es ideal für Air-Gapped-Umgebungen, sensible Datenverarbeitung und Standorte mit unzuverlässiger Verbindung.

  • Muse Glimmer wurde aus Metas geschlossenem Muse Spark 1.2 Modell destilliert. Die Destillation bewahrt die Reasoning- und Tool-Use-Fähigkeiten des größeren Modells und komprimiert sie in eine 30B-Architektur, die auf Consumer-Hardware passt.