Originally Published Research by Richard EwingCanonical Reference ↗
Security Research

Prompt Injection Defense: Why LLM-as-a-Judge Guardrails Fail

Richard Ewing··6 min read

Using an secondary LLM to police a primary LLM (LLM-as-a-Judge) doubles inference costs while inheriting the exact same probabilistic vulnerability to adversarial prompt injection. Deterministic binary gates are required.