Llama Guard 4 ist Metas multimodaler Sicherheits- und Moderationsklassifikator aus der Llama-4-Suite. Das 12-Milliarden-Parameter-Modell prüft sowohl Text- als auch Bild-Inhalte gegen 14 Gefahrenkategorien der MLCommons-Taxonomie – und zwar für Ein- UND Ausgaben. Es läuft auf einer einzelnen 24-GB-GPU und lässt sich jeder LLM-Pipeline als Schutzschicht vorschalten.
Llama Guard 4 (12B)
Meta AI
April 2025
Llama 4 Community License
Dense (12B), multimodaler Safety-Klassifikator
12 Mrd. (aus Llama 4 Scout gepruned)
dense aus MoE destilliert. MLCommons-Taxonomie, bis 5 Bilder
Klassifikator (kurze Eingaben)
Verbesserungen gegenüber Llama Guard 3:
| Metrik | Llama Guard 4 | Bezug |
|---|---|---|
| Recall (Englisch) | +4 % | vs. Guard 3 |
| Recall (Multi-Image) | +20 % | vs. Guard 3 |
| False-Positive-Rate (EN) | -3 % | vs. Guard 3 |
Quelle: Meta / Hugging-Face-Blog.
Wir integrieren Llama Guard 4 als Schutzschicht in Ihre Anwendungen – für sichere, konforme KI-Ausgaben.
Llama Guard 4 wurde aus Llama 4 Scout gewonnen, indem die gerouteten Experten entfernt und die Shared-Expert-Gewichte behalten wurden – ein dichtes, effizientes 12B-Modell.
Als reiner Sicherheits-Klassifikator ist es kein General-Chat-Modell, sondern eine gezielte Moderationsschicht für Prompts und Antworten.
Für sichere, konforme LLM-Anwendungen.
Single-GPU-tauglich (24 GB)
Multimodal (Text + Bild)
Prüft Ein- und Ausgaben
Offene Gewichte
Reines Sicherheitsmodell (kein General-Chat)
Begrenzte Sprachabdeckung ggü. Hauptmodellen
Community-Lizenz mit Auflagen
Wir bauen Llama Guard 4 als Moderationsschicht in Ihre Anwendungen ein und betreiben sie sicher aus Deutschland.