Wat is AI-red teaming?
Wat is het?
Bij red teaming val je een AI-assistent bewust aan om zijn zwakke plekken te vinden voordat gebruikers dat doen: regels omzeilen, datalekken, prompt injection, beloften die hij niet mag doen.
Wanneer te gebruiken
- Voordat je een assistent in productie neemt.
- Na elke wijziging van model of prompt, om te controleren dat hij nog standhoudt.
De velden van de pagina
| Doelassistent | Het soort geteste assistent. |
|---|---|
| Aanvallen | Het verstuurde bericht, de categorie en het verwachte antwoord. |
Hoe gebruik je het
Download het JSONL-bestand en voer elke aanval opnieuw uit op je assistent met het Python-voorbeeld.