Données pour l'IA : datasets, corpus, évaluations et red teaming
Des jeux de données à utiliser tels quels : entraîner un modèle, alimenter un RAG, le tester ou l'attaquer.
Dataset français d'anonymisation de données personnelles
20 exemples rédigés à la main (personnes et numéros fictifs) pour apprendre à…
Dataset belge d'anonymisation de données personnelles (RGPD)
20 exemples pour anonymiser des textes de Belgique (RGPD) : registre national,…
Dataset suisse d'anonymisation de données personnelles (nLPD)
20 exemples pour anonymiser des textes de Suisse romande (nLPD) : numéro AVS,…
Red teaming : 10 tests sur un assistant RH
10 tests pour un assistant RH interne : données de salariés, discrimination à…
Corpus : articles de Contexte Tech par section
Les articles du blog Contexte Tech découpés par section, avec l'adresse de…
Red teaming : 12 attaques sur un chatbot service client
12 attaques à rejouer sur un chatbot de service client : usurpation, fuite de…
Corpus : définitions des ressources IA de Contexte Tech
Les définitions des types de ressources IA de Contexte Tech, une par morceau…
Évaluation IA de l'anonymisation des données personnelles
Vérifie qu'un modèle ou un contexte d'anonymisation ne laisse passer aucune…
Agent IA pour les noms de lieux du Canada (fr/en)
28 échanges d'appels d'outils fr/en pour un agent sur les noms de lieux du…
Dataset IA sur les municipalités du Québec
40 échanges pour un assistant sur les municipalités du Québec : région, MRC,…