Wat is een AI-vangrail?
Wat is het?
Een vangrail is een set regels die controleert wat een AI-assistent binnenkomt of verlaat: persoonsgegevens blokkeren, prompt injection opsporen, verzoeken buiten het onderwerp weigeren.
Wanneer te gebruiken
- Voordat je een assistent in productie neemt, om lekken en misbruik te beperken.
- Om met testgevallen aan te tonen dat een regel werkt (AVG, AI Act).
De velden van de pagina
| Type | Persoonsgegevens, prompt injection, schadelijke inhoud, buiten het onderwerp, antwoordformaat. |
|---|---|
| Actie | Blokkeren, maskeren, markeren of herschrijven. |
| Regels | Wat geblokkeerd of toegestaan moet worden, in gewone woorden. |
| Testgevallen | Teksten met het verwachte resultaat: blokkeren of toestaan. |
| Code | Optioneel: de implementatie, bijvoorbeeld in Python. |
Hoe gebruik je het
Download de JSON: de regels sturen een controlemodel aan en de testgevallen meten zijn fouten.