Tekst die jou het ene vertelt en het model het andere
Documenten, e-mails en webpagina's kunnen instructies bevatten die een mens nooit ziet: Unicode-tagtekens die onzichtbaar blijven, zero-width joiners, bidirectionele overrides die omdraaien wat het oog leest en homoglyphs uit andere schriften. Een LLM leest het allemaal. De scanner maakt die tekens zichtbaar en toetst de genormaliseerde tekst daarna aan de injectiefamilies uit OWASP LLM01, kenmerken van tool poisoning en gangbare formaten van secrets.
Een treffer is een reden om te kijken, geen oordeel: legitieme tekst bevat soms een zero-width joiner door kopiëren en plakken. Twee of meer bevindingen in één document, of ook maar één exfiltratiepatroon dat naar een URL wijst: dat is een ander verhaal.
Alles wat in een assistent terechtkomt, van een supportinbox tot een cv-pipeline, hoort zo'n check te passeren voordat het model het ziet. Die maatregel is goedkoop; ontbreekt hij, dan is dat een bevinding.
Start het lab: Scan op verborgen instructies →
Een lab toont één signaal. In het gesprek controleren we de hele keten.
Plan een gesprek van 30 minuten