Llama Prompt Guard 2

Winzige, schnelle Firewall gegen Prompt-Injection und Jailbreaks

Llama-4-Sicherheits-Suite

Das Llama Prompt Guard 2 Modell im Überblick

Llama Prompt Guard 2 ist Metas leichtgewichtige Schutzschicht gegen Prompt-Injection und Jailbreak-Versuche. In zwei Größen (86 Millionen und 22 Millionen Parameter) klassifiziert das Modell eingehende Prompts binär als gutartig oder bösartig – schnell genug für CPU- und Edge-Einsatz und ideal, um jedem LLM-Endpunkt vorgeschaltet zu werden.

Name:

Llama Prompt Guard 2 (86M & 22M)

Entwickler:

Meta AI

Veröffentlichung:

April 2025

Lizenz:

Llama 4 Community License

Modelltyp:

Dense, kleiner Klassifikator (binär)

Parameter:

86 Mio. bzw. 22 Mio.

Architektur:

encoderbasierter Klassifikator, 22M als Latenz-Variante

Kontextlänge:

kurze Eingaben (Prompt-Klassifikation)

Spezialitäten von Llama Prompt Guard 2

Sehr schnell

Winzige Modelle mit minimaler Latenz – ohne spürbaren Overhead vorschaltbar.

CPU- & Edge-tauglich

Besonders die 22M-Variante läuft ohne GPU – vernachlässigbarer Ressourcenbedarf.

Injection-Erkennung

Erkennt Prompt-Injection und Jailbreak-Versuche zuverlässiger als Version 1.

Einfach vorschaltbar

Als Firewall vor jedem LLM-Endpunkt einsetzbar.
Individuelle KI-Beratung

Sind Ihre LLM-Endpunkte gegen Injection geschützt?

Wir schalten Llama Prompt Guard 2 als schnelle Schutzschicht vor Ihre Modelle – für robuste, sichere Anwendungen.

Die Post-Training Pipeline für Llama Prompt Guard 2

Trainingsdaten & Trainingsprozess

Prompt Guard 2 ist ein encoderbasierter Klassifikator, der Prompts binär bewertet. Die 22M-Variante ist auf niedrigste Latenz optimiert, die 86M-Variante auf etwas höhere Genauigkeit.

Als schlanke Vorfilter-Schicht ergänzt es größere Moderationsmodelle wie Llama Guard 4 ideal.

Hardware & Deployment

  • CPU oder Mini-GPU
  • Vernachlässigbarer VRAM-Bedarf
  • Als Vorfilter direkt vor dem LLM-Endpunkt
Anwendungsfälle

Empfohlene Anwendungsfälle für Llama Prompt Guard 2

Für robuste Absicherung gegen manipulative Eingaben.

Prompt-Injection-Schutz
Firewall vor LLM-Endpunkten
Ergänzung zu Llama Guard 4
Jailbreak-Detektion
Edge-Filterung ohne GPU
Meta
Llama Prompt Guard 2

Stärken & Schwächen von Llama Prompt Guard 2

Mit dem richtigen Modell Ergebnisse maximieren

LLM-Endpunkte robust absichern

Wir integrieren Llama Prompt Guard 2 als schnelle Schutzschicht in Ihre KI-Anwendungen – sicher gehostet aus Deutschland.