Llama Guard 4

Multimodale Guardrails für LLM-Pipelines – Ein- und Ausgaben prüfen

Llama-4-Sicherheits-Suite

Das Llama Guard 4 Modell im Überblick

Llama Guard 4 ist Metas multimodaler Sicherheits- und Moderationsklassifikator aus der Llama-4-Suite. Das 12-Milliarden-Parameter-Modell prüft sowohl Text- als auch Bild-Inhalte gegen 14 Gefahrenkategorien der MLCommons-Taxonomie – und zwar für Ein- UND Ausgaben. Es läuft auf einer einzelnen 24-GB-GPU und lässt sich jeder LLM-Pipeline als Schutzschicht vorschalten.

Name:

Llama Guard 4 (12B)

Entwickler:

Meta AI

Veröffentlichung:

April 2025

Lizenz:

Llama 4 Community License

Modelltyp:

Dense (12B), multimodaler Safety-Klassifikator

Parameter:

12 Mrd. (aus Llama 4 Scout gepruned)

Architektur:

dense aus MoE destilliert. MLCommons-Taxonomie, bis 5 Bilder

Kontextlänge:

Klassifikator (kurze Eingaben)

Spezialitäten von Llama Guard 4

Ein- & Ausgaben

Prüft sowohl Nutzer-Prompts als auch Modell-Antworten auf Verstöße.

Multimodale Moderation

Klassifiziert Text und Bilder (bis zu 5 Bilder pro Anfrage).

14 Kategorien

Deckt die MLCommons-Gefahrentaxonomie plus Code-Interpreter-Missbrauch ab.

Single-GPU

Läuft auf einer einzelnen GPU mit 24 GB VRAM.
Individuelle KI-Beratung

Brauchen Ihre LLM-Pipelines Guardrails?

Wir integrieren Llama Guard 4 als Schutzschicht in Ihre Anwendungen – für sichere, konforme KI-Ausgaben.

Die Post-Training Pipeline für Llama Guard 4

Trainingsdaten & Trainingsprozess

Llama Guard 4 wurde aus Llama 4 Scout gewonnen, indem die gerouteten Experten entfernt und die Shared-Expert-Gewichte behalten wurden – ein dichtes, effizientes 12B-Modell.

Als reiner Sicherheits-Klassifikator ist es kein General-Chat-Modell, sondern eine gezielte Moderationsschicht für Prompts und Antworten.

Hardware & Deployment

  • Transformers, vLLM
  • Läuft auf einer einzelnen GPU mit 24 GB VRAM
  • Als vorgeschaltete Schutzschicht in bestehende Pipelines integrierbar
Anwendungsfälle

Empfohlene Anwendungsfälle für Llama Guard 4

Für sichere, konforme LLM-Anwendungen.

Input-/Output-Guardrails für LLM-Pipelines
Bild-Sicherheitsprüfung
Absicherung von Chatbots und Agenten
Content-Moderation
Compliance-Filter
Meta
Llama Guard 4

Stärken & Schwächen von Llama Guard 4

Mit dem richtigen Modell Ergebnisse maximieren

KI-Ausgaben absichern – DSGVO-konform

Wir bauen Llama Guard 4 als Moderationsschicht in Ihre Anwendungen ein und betreiben sie sicher aus Deutschland.