Red teaming voor AI-assistenten
Aanvallen om op een AI-assistent te testen, met het verwachte antwoord: omzeiling, datalekken, jailbreaks.
Hier heeft nog niemand iets gepubliceerd. Waarom jij niet?
Wat is AI-red teaming?
Bij red teaming val je een AI-assistent bewust aan om zijn zwakke plekken te vinden voordat gebruikers dat doen: regels omzeilen, datalekken, prompt injection, beloften die hij niet mag doen.
Gids: Red teaming →