ContexteTech passe en open source : un hub pour tout ce qui s'adapte sur un modèle IA
Tony, créateur de ContexteTech · 27 septembre 2026
Depuis six mois, je passe une bonne partie de mes journées à « adapter » des modèles de langage à des cas concrets : un prompt système ici, trois exemples few-shot là, un serveur MCP pour que l’assistant lise mes fichiers, une configuration LoRA quand le prompt ne suffit plus. Et à chaque fois, la même frustration : ces briques sont éparpillées. Un prompt dans un gist, un dataset sur Hugging Face, un serveur MCP dans un README, une config Claude Code dans un coin de projet.
ContexteTech est né de là : un seul endroit pour tout ce qui s’adapte sur un modèle IA, rangé, testé, et prêt à copier. Le site est en ligne sur contextetech.com, et le code de sa première version (v1) est désormais libre.
Ce qu’on y trouve
Onze types de ressources, regroupés en trois familles :
- Production (on utilise le modèle sans le modifier) : contextes, prompts, agents, pipelines RAG ;
- Entraînement (on le modifie) : datasets de fine-tuning, configurations LoRA, évaluations ;
- Extensions (on lui donne des outils) : serveurs MCP, skills, harness.
Chaque fiche s’exporte directement au format de l’outil visé : JSONL pour un dataset, SKILL.md pour un skill, CLAUDE.md et settings.json pour un harness, la configuration mcpServers pour un serveur MCP.
Deux choses me tenaient à cœur, parce qu’elles manquent ailleurs :
- « Testé sur » : chaque fiche peut indiquer sur quels modèles elle a été essayée, avec le résultat (réussi, partiel, échec) et un score. Un prompt qui marche sur un modèle et pas sur un autre, c’est la vie quotidienne ; autant l’écrire.
- Le niveau de risque des serveurs MCP et des harness : avant d’installer un serveur, on veut savoir s’il lit des fichiers, en écrit, sort sur le réseau ou lance des commandes. La fiche l’affiche en clair.
Un exemple concret
Le besoin. Une PME veut faire résumer ses tickets de support par un LLM. Problème : les tickets contiennent des noms, des téléphones, des IBAN. Les envoyer tels quels à un service tiers, c’est une fuite de données personnelles, et un problème RGPD.
La réponse sur ContexteTech. Au lieu de chercher dix ressources à dix endroits, on suit une seule chaîne :
- le contexte anonymisation-rgpd remplace les données personnelles par des balises, avant tout envoi :
Entrée : Bonjour, je suis Marie Dupont, joignable au 06 12 34 56 78.
Sortie : Bonjour, je suis [PRENOM_1] [NOM_1], joignable au [TELEPHONE_1].
- l’évaluation eval-anonymisation-rgpd vérifie qu’aucune donnée ne passe, avec des cas de test prêts à lancer ;
- si le prompt ne suffit plus, le dataset anonymisation-rgpd-fr et la configuration LoRA mistral7b-anonymisation-qlora permettent d’entraîner un petit modèle qui tourne en local ;
- l’agent agent-tri-documents et le serveur MCP mcp-filesystem automatisent le traitement d’un dossier entier.
Un besoin, une chaîne de fiches liées entre elles, chacune exportable dans le bon format.
Sous le capot
J’ai voulu une pile simple, rapide et entièrement auto-hébergeable :
- Site : Astro en rendu serveur, avec quelques îlots Svelte seulement là où il faut de l’interactivité (formulaire de publication, bouton « j’aime »). Tout le reste est du HTML ; la page d’accueil pèse environ 16 Ko.
- API : FastAPI et SQLAlchemy asynchrone, PostgreSQL 17 pour les données, Redis pour le cache et les limites anti-abus. Le cache est invalidé par un simple compteur de version incrémenté à chaque publication : pas de purge fine à gérer.
- Réseau : Caddy devant (TLS automatique, HTTP/3), puis le CDN européen Bunny (Slovénie) pour les fichiers statiques, mis en cache un an grâce aux noms de fichiers versionnés.
- Cinq langues (français, anglais, espagnol, allemand, italien). Petite subtilité pour le référencement : une fiche écrite en français n’est indexée qu’en français ; ses versions
/en/…traduisent l’interface mais pointent vers l’originale en canonique. Sinon, Google voit cinq copies du même texte. - Adresses lisibles et uniques :
/prompts/resume-article-technique-k3j9a2. Le suffixe est un hash FNV-1a de l’identifiant interne, calculé à l’identique en Python et en JavaScript. Deux auteurs peuvent choisir le même nom sans se marcher dessus. - Aucun traceur : pas de cookie publicitaire ; la fréquentation est mesurée par Plausible, auto-hébergé, sans cookie ni donnée personnelle.
Un projet souverain
ContexteTech est conçu et hébergé en Europe, sans dépendre des géants américains du cloud :
- Serveur et base de données chez Scaleway, en France (PostgreSQL managé, serveur dédié) ;
- CDN et DNS chez Bunny, une société européenne basée en Slovénie ;
- E-mails via Proton, en Suisse, chiffrés et signés (SPF, DKIM, DMARC) ;
- Polices, scripts et styles servis depuis le site lui-même : pas de Google Fonts, pas de CDN tiers ; statistiques Plausible auto-hébergées, sans cookie ;
- Éditeur : une entreprise française, soumise au RGPD.
Seule exception, assumée : le code est publié en miroir sur GitHub et GitLab, parce que c’est là que se trouvent les développeurs. La version de travail, elle, vit sur notre propre serveur.
Pourquoi l’AGPL-3.0
J’ai hésité avec Apache-2.0 (la licence des bibliothèques de Hugging Face). J’ai choisi l’AGPL-3.0 : vous pouvez utiliser et modifier ContexteTech, à condition de publier vos modifications si vous le proposez en ligne. C’est la licence de Mastodon ou de Plausible, et elle garantit qu’un hub ouvert reste ouvert.
Les fiches, elles, gardent chacune la licence choisie par leur auteur (MIT, CC BY 4.0…).
Où en est le projet
C’est le début, et je préfère être honnête : le catalogue démarre avec une fiche par type, autour d’un même cas concret (l’anonymisation RGPD de textes avant envoi à un service tiers). Il a surtout besoin de vos ressources, de vos retours et de vos tests.
- Le site : contextetech.com
- Le code de la v1 : github.com/contexte-tech/contextetech (miroir sur GitLab). Le site évolue ensuite dans une v2 développée en interne.
- Contribuer : lisez
CONTRIBUTING.md, ou publiez simplement votre première fiche.
Si vous avez un prompt qui vous sert tous les jours, un serveur MCP que vous aimez ou une config Claude Code bien réglée, c’est le bon endroit pour la partager.