Meta öffnet die Gewichte wieder – reicht das zum Comeback?
Muse Glimmer bringt 30 Milliarden Parameter unter Apache 2.0 und läuft auf einer 24-GB-GPU. An der Leistungsspitze steht Meta weiter nicht.
Am 10. August 2026 hat Meta ein Modell mit offenen Gewichten auf Hugging Face gelegt. Muse Glimmer bringt 30 Milliarden Parameter, läuft multimodal und zielt auf lokale Agenten. Zuvor war Meta im Modellwettbewerb zurückgefallen. Der eigene Blogtext spricht von tiefem Zugriff auf persönlichen Kontext. Reicht das für ein Comeback?
Das Wichtigste in Kürze
- Apache 2.0 seit dem 10. August 2026. Muse Glimmer steht unter einer permissiven Lizenz ohne Nutzungsvorbehalte. Die Llama-Lizenz verlangte oberhalb von 700 Millionen monatlich aktiven Nutzern eine gesonderte Genehmigung von Meta.
- 16 bis 20 GB nach 4-Bit-Quantisierung. Das dense Modell mit 30 Milliarden Parametern läuft damit auf einer einzelnen Consumer-GPU mit 24 GB.
- Index 35 im August 2026. Muse Glimmer liegt bei Artificial Analysis auf Index 35. Das geschlossene Flaggschiff Muse Spark 1.2 erreicht Index 57 und Platz 12.
Verwandt:Zuckerberg will Superintelligenz für alle schaffen / Claude Code fährt jetzt auch Alibabas Qwen
Offene Gewichte für den lokalen Stack
Meta Superintelligence Labs hat Muse Glimmer am 10. August 2026 veröffentlicht und über Hugging Face verteilt. Das Modell ist dense und multimodal. Dense heißt: Bei jeder Anfrage arbeiten alle 30 Milliarden Parameter mit, anders als bei einem Mixture-of-Experts-Modell, das nur einen Teil aktiviert. Es bringt 30 Milliarden Parameter mit. Die Gewichte stehen offen. Die Muse-Reihe ersetzt den Markennamen Llama. Ein Team, das bisher Llama-Gewichte im eigenen Stack geführt hat, trifft auf einen neuen Produktnamen und auf eine andere rechtliche Basis. Der Betreiber lädt, quantisiert und hostet selbst.
Was ist Muse Glimmer? Muse Glimmer ist ein am 10. August 2026 von Meta Superintelligence Labs veröffentlichtes, dense und multimodales Modell mit 30 Milliarden Parametern und offenen Gewichten unter Apache 2.0. Es ist aus dem größeren, geschlossenen Modell Muse Spark destilliert, richtet sich an lokale Agenten und läuft offline.
Das Kontextfenster umfasst 131.072 Token. Das Vokabular zählt 202.048 Token. Der Wissensstand endet am 4. Januar 2026. Muse Spark kam im April 2026 als geschlossenes Flaggschiff. Glimmer trägt damit die Destillation eines Modells, dessen Gewichte Meta nicht offen legt.
Gebaut ist Muse Glimmer für lokale Agenten. Es übernimmt Werkzeugaufrufe, Coding, Dateiarbeit und Bildschirminhalte. Es kann offline laufen. Für einen Betreiber im eigenen Rechenzentrum zählt zuerst diese Kombination aus offenen Gewichten, lokaler Ausführung und festem Aufgabenprofil. Ein Modell, das Dateien anfasst und Bildschirminhalte liest, muss dort laufen, wo diese Daten liegen. Das Kontextfenster von 131.072 Token fasst Kalender, Nachrichtenentwürfe und Dateiauszüge in einer Sitzung.
Die Lizenz gibt den Ausschlag
Llama trug eine eigene Meta-Lizenz mit Vorbehalten. Wer mit seinem Produkt mehr als 700 Millionen monatlich aktive Nutzer erreichte, musste eine gesonderte Genehmigung bei Meta beantragen. Meta erteilt sie nach eigenem Ermessen. Dazu kam eine Attributionspflicht in jeder verteilten Kopie. Muse Glimmer steht unter Apache 2.0, einer permissiven Lizenz ohne solche Vorbehalte. Für ein Unternehmen, das ein offenes Modell im eigenen Rechenzentrum betreiben will, verschiebt das die Prüfung.
Im Einkauf und im Betrieb entscheidet zuerst, ob die Rechtsabteilung das Modell freigibt. Eine Lizenz mit Schwellenwert und Genehmigungsvorbehalt zieht diese Prüfung in die Länge. Apache 2.0 verkürzt sie. Der Betreiber kann die Gewichte laden, quantisieren und hinter die eigene Firewall legen. Ein Nutzungsvorbehalt der Herkunftslizenz steht dem nicht mehr im Weg.
Die Benchmarks messen Qualität. Sie messen nicht die Freigabe. Ein Modell mit starkem Index bleibt schwer einsetzbar, solange seine Lizenz einen Genehmigungsvorbehalt trägt. Ein Modell mit mittlerem Index wird planbar, sobald Apache 2.0 gilt. Für den deutschen Mittelstand und für Konzerne mit eigener Inferenz ist das die erste Filterfrage. Alles andere kommt danach.
Ein Unternehmen, das die kommerziellen Vorbehalte der Llama-Lizenz scheute, erhält mit Glimmer ein Meta-Modell mit offenen Gewichten unter Apache 2.0. Diese Lizenz baut solche Hürden nicht auf. Der Markenwechsel von Llama zu Muse ändert daran nichts. Die Lizenz ändert den Betrieb. Genau dort entscheidet sich, ob ein offenes Modell überhaupt in die Architektur eingeht.
Speicherbedarf, Tempo und der Kalender-Satz
Unquantisiert liegt der Speicherbedarf bei etwa 55 bis 60 GB. Mit 4-Bit-Quantisierung sinkt er auf 16 bis 20 GB. Damit läuft Muse Glimmer auf einer einzelnen Consumer-GPU mit 24 GB. Das ist die Zahl, an der ein Architekturteam die Hardware festmacht.
Dazu kommt DFlash, ein kleiner Vorschlagsdienst, der 16 Token auf einmal vorschlägt und vom Hauptmodell in einem Durchgang prüfen lässt. Auf einer RTX 5090 hebt das den Durchsatz von 74,9 auf 233,4 Token pro Sekunde, also um den Faktor 3,1. Der Gewinn hängt an der Hardware: Auf einem M5 Max sind es 1,8-mal, auf einem M4 Max 1,5-mal. Gemessen wurde mit Batchgröße eins und Greedy-Decoding. Für Werkzeugaufrufe, Coding und Dateiarbeit liefert das eine belastbare Betriebsspanne auf lokaler Hardware.
Meta schreibt im eigenen Blog, ein Agent, der den Kalender verwaltet, Nachrichten entwirft, Dateien ordnet und lernt, wie man arbeitet, brauche tiefen Zugriff auf persönlichen Kontext. Der Satz hat Aufmerksamkeit erzeugt. Er beschreibt eine echte Anforderung. Ein Agent ohne Zugriff auf Kalender, Postfach und Dateien kann genau diese Arbeit nicht leisten. Der Satz gehört deshalb in die Architekturdiskussion und bleibt dort eine Betriebsfrage.
Das Modell läuft lokal. Es kann offline laufen. Persönlicher Kontext bleibt auf der Maschine, auf der das Modell inferiert. Die Sorge zielt auf die Tiefe des Zugriffs. Die Antwort liegt in der Ausführungsart. Ein Agent im eigenen Netz gibt den Kontext nicht an einen fremden Endpunkt.
Glimmer im Vergleich der Indizes
The Register beschreibt den Schritt als Rückkehr zu Metas offenen Wurzeln und spricht ausdrücklich von „ein wenig Hoffnung“. Die Bewertung bleibt zurückhaltend. Dasselbe Medium nennt Llama 4 gescheitert. Der Markenwechsel zu Muse steht damit in einer Linie, die The Register nicht als Triumph liest.
Im Vergleich schlägt Muse Glimmer Googles Gemma 4 31B in den meisten Szenarien. Gegen Alibabas Qwen 3.6-27B wechseln sich die Ergebnisse ab. Das platziert Glimmer neben offenen Modellen ähnlicher Größe.
Artificial Analysis führt im August 2026 Claude Opus 5 mit Index 63. GPT-5.6 Sol erreicht Index 61. Muse Spark 1.2, Metas geschlossenes Flaggschiff, erreicht Index 57 und liegt auf Platz 12. Muse Glimmer selbst erreicht Index 35.
Bei Modellen mit offenen Gewichten führt Kimi K3 mit Index 60. Danach folgen GLM-5.2 mit 53 und DeepSeek V4 Flash mit 52. Glimmer liegt mit Index 35 unter diesen drei. Ein Team, das ein offenes Modell für den eigenen Stack sucht, findet in Glimmer ein betreibbares 30-Milliarden-Modell.
Die öffentliche Zeitlinie seit 2025
Die Fallhöhe steht in den öffentlichen Daten. Meta holte Alexandr Wang als Chief AI Officer an Bord. Das geschah im Zuge einer Beteiligung an Scale AI im Wert von rund 12,4 Milliarden Euro. The Information berichtete am 15. Mai 2025, dass Meta die größte Version von Llama 4 wegen Leistungsproblemen verschoben hat. Zwischen diesem Bericht und der Veröffentlichung von Glimmer liegen rund 15 Monate.
Wired berichtete am 26. August 2025, dass mindestens drei Forscher die Superintelligence Labs verlassen haben. Das lag zwei Monate nach dem Start der Einheit. Reuters berichtete am 22. Oktober 2025, dass Meta rund 600 Stellen in dieser Einheit streicht.
Meta plant für 2026 Investitionen von rund 100 bis 117 Milliarden Euro. Das ist fast doppelt so viel wie im Vorjahr. Das berichtete die New York Times am 28. Januar 2026. Muse Spark, das geschlossene Flaggschiff, kam im April 2026. Muse Glimmer folgte am 10. August 2026 als destilliertes Modell mit offenen Gewichten.
Diese Folge beschreibt die öffentliche Zeitlinie. Dazwischen liegen Abgänge, ein Stellenabbau und ein Investitionsrahmen, der das Vorjahr fast verdoppelt. Es trägt außerdem eine Lizenz, die den Betrieb in der EU wieder zulässt. Beide Aussagen gehören nebeneinander. Keine der beiden ersetzt die andere.
Die Antwort auf die Comeback-Frage
Die Frage nach dem Comeback braucht zwei Maßstäbe. Der erste Maßstab ist der Betrieb offener Gewichte. Hier hat sich etwas geändert. Apache 2.0 nimmt Schwellenwert und Genehmigungsvorbehalt aus der Rechnung. Die 4-Bit-Variante macht es auf einer einzelnen Consumer-GPU lauffähig. Offline-Betrieb und lokale Agenten treffen den Stack, den Konzerne hinter der eigenen Firewall halten. Werkzeugaufrufe, Coding, Dateiarbeit und Bildschirminhalte liegen in genau diesem Profil.
Der zweite Maßstab ist die Leistungsspitze. Hier steht Meta weiter nicht. Claude Opus 5 führt mit Index 63. GPT-5.6 Sol erreicht Index 61. Unter den offenen Gewichten führt Kimi K3 mit Index 60. Muse Spark 1.2 erreicht Index 57 und Platz 12. Muse Glimmer erreicht Index 35. Ein Comeback an der Spitze würde Werte in der Nähe von Claude Opus 5, GPT-5.6 Sol oder Kimi K3 verlangen. Die vorliegenden Werte liegen darunter.
The Register spricht von „ein wenig Hoffnung“ und bleibt zurückhaltend. Diese Haltung passt zu den Zahlen. Für den Betrieb offener Gewichte ist Glimmer ein greifbarer Schritt. An der Spitze der Indizes steht Glimmer nicht. Wer die Gewichte selbst fährt, gewinnt Lizenz, Hardware-Passung und lokale Ausführung. Wer die Spitze kauft, findet sie bei anderen Modellen.
Zum 12. August 2026 gab es keinen Katalogeintrag für Muse Glimmer bei AWS Bedrock, Azure AI Foundry oder Google Vertex AI. Die Verteilung läuft über Hugging Face. Ein Einsatz von Glimmer holt die Gewichte selbst und betreibt sie selbst. Genau dort hat sich etwas verbessert. An der Leistungsspitze steht Meta weiter nicht.
Häufige Fragen
Unter welcher Lizenz steht Muse Glimmer?
Muse Glimmer steht unter Apache 2.0, einer permissiven Lizenz ohne Nutzungsvorbehalte. Die Llama-Lizenz verlangte oberhalb von 700 Millionen monatlich aktiven Nutzern eine gesonderte Genehmigung von Meta und schrieb eine Attribution in jeder verteilten Kopie vor. Apache 2.0 kennt beides nicht.
Auf welcher Hardware läuft Muse Glimmer?
Unquantisiert braucht das Modell etwa 55 bis 60 GB. Mit 4-Bit-Quantisierung sinkt der Bedarf auf 16 bis 20 GB. Damit reicht eine einzelne Consumer-GPU mit 24 GB.
Wie stark ist Muse Glimmer im Vergleich?
Muse Glimmer erreicht bei Artificial Analysis im August 2026 den Index 35 und liegt damit unter Kimi K3, GLM-5.2 und DeepSeek V4 Flash. Gegen Gemma 4 31B gewinnt es in den meisten Szenarien. Gegen Qwen 3.6-27B wechseln sich die Ergebnisse ab.
Gab es Muse Glimmer am 12. August 2026 bei AWS, Azure oder Google?
Zum 12. August 2026 gab es keinen Katalogeintrag bei AWS Bedrock, Azure AI Foundry oder Google Vertex AI. Die Verteilung läuft über Hugging Face. Das beschreibt den Stichtag und keine spätere Entscheidung.
Was folgt aus Metas Satz zum persönlichen Kontext?
Meta schreibt, ein Agent für Kalender, Nachrichten, Dateien und Arbeitsweise brauche tiefen Zugriff auf persönlichen Kontext. Das Modell läuft lokal und kann offline laufen. Der Zugriff bleibt damit auf der eigenen Maschine.
Lesetipps der Redaktion
cloudmagazinFrontier Labs fressen ihre besten KundencloudmagazinMistral füttert Microsoft mit europäischen GPUscloudmagazinFast Spitzenleistung für ein Drittel des PreisesMehr aus dem MBF Media Netzwerk
MyBusinessFutureCopilot im Mittelstand: Was Sitze wirklich kostenDigital ChiefsNVIDIAs Milliarden-Pläne und was Betreiber jetzt prüfen müssenSecurityTodayAI-first Security Review: Vibe-Coded App im PraxistestBildquelle: KI-generiert (August 2026)

