Corpus : définitions des ressources IA de Contexte Tech
Les définitions des types de ressources IA de Contexte Tech, une par morceau avec l'adresse du guide : un petit corpus prêt pour un RAG.
Fragmentación : 1 type de ressource = 1 morceau
Vista previa
| id | Texto | Fuente |
|---|---|---|
context | Un contexte est un ensemble d'instructions et d'exemples que l'on donne au modèle IA avant la question de l'utilisateur. Il oriente sa réponse sans rien réentraîner : c'est l'in-context learning. | https://contextetech.com/docs/contextes |
prompt | Un prompt est un modèle de texte réutilisable, avec des variables entre doubles accolades, par exemple {{produit}}. On remplace les variables puis on l'envoie au modèle. | https://contextetech.com/docs/prompts |
dataset | Un dataset est un jeu d'exemples au format JSONL (une ligne JSON par exemple) qui sert à entraîner ou évaluer un modèle. | https://contextetech.com/docs/datasets |
lora | LoRA est une technique pour adapter un modèle existant à une tâche sans le réentraîner entièrement : on entraîne de petits adaptateurs. Une fiche LoRA regroupe tous les réglages de cet entraînement. | https://contextetech.com/docs/lora |
tool | Un serveur MCP (Model Context Protocol) donne de nouvelles capacités à un assistant IA : lire des fichiers, interroger une base, appeler un service. Le même serveur fonctionne avec Claude, Cursor et d'autres assistants. | https://contextetech.com/docs/serveurs-mcp |
model | Un modèle est un modèle IA publié par un Lab vérifié : fine-tune, fusion (merge) ou version quantifiée. La fiche décrit le modèle et renvoie vers son téléchargement. | https://contextetech.com/docs/modeles |
agent | Un agent est un assistant IA qui enchaîne des étapes pour accomplir une tâche : il suit des instructions, utilise des serveurs MCP et des contextes, et respecte des garde-fous. | https://contextetech.com/docs/agents |
skill | Un skill est un paquet d'instructions (fichier SKILL.md) qu'un assistant comme Claude charge uniquement quand la tâche le demande. Il lui apprend une façon de faire précise. | https://contextetech.com/docs/skills |
eval | Une évaluation est un jeu de cas de test (entrée et réponse attendue) avec une méthode de notation. Elle mesure si un modèle, un prompt, un contexte ou un agent fait bien son travail. | https://contextetech.com/docs/evaluations |
rag | Un pipeline RAG (génération augmentée par la recherche) permet à un modèle de répondre à partir de vos documents : on les découpe, on les vectorise, puis à chaque question on retrouve les extraits utiles et on les donne au modèle. | https://contextetech.com/docs/rag |
harness | Un harness est l'environnement qui fait tourner un agent : son fichier d'instructions (par exemple CLAUDE.md), les outils qu'il a le droit d'utiliser, ce qui lui est interdit, les hooks et les serveurs MCP branchés. | https://contextetech.com/docs/harness |
workflow | Un workflow est un enchaînement d'étapes où l'IA intervient : récupérer des données, les faire analyser par un modèle, puis envoyer le résultat ailleurs. On le construit dans un outil comme n8n, LangGraph, Make ou Dify, puis on l'exporte en JSON. | https://contextetech.com/docs/workflows |
guardrail | Un garde-fou est un ensemble de règles qui contrôle ce qui entre dans un assistant IA ou ce qui en sort : bloquer des données personnelles, repérer une injection de prompt, refuser un sujet hors périmètre. | https://contextetech.com/docs/garde-fous |
embedding | Un modèle d'embeddings transforme un texte en une liste de nombres (un vecteur). Deux textes de sens proche donnent des vecteurs proches : c'est la base de la recherche sémantique et du RAG. | https://contextetech.com/docs/embeddings |
inference | Une config d'inférence est l'ensemble des réglages qui permettent de faire tourner un modèle sur sa propre machine : le moteur (Ollama, vLLM, llama.cpp), la quantification, la taille du contexte et la commande de lancement. | https://contextetech.com/docs/inference |
stack | Une stack est un ensemble de services IA qui fonctionnent ensemble et se lancent en une seule commande : par exemple un modèle, une base vectorielle et une interface de chat, décrits dans un docker-compose. | https://contextetech.com/docs/stacks |
redteam | Le red teaming consiste à attaquer volontairement un assistant IA pour trouver ses failles avant les utilisateurs : contournement des règles, fuite de données, injection de prompt, promesses qu'il ne devrait pas faire. | https://contextetech.com/docs/red-teaming |
aiact | Un dossier AI Act est un modèle de documentation à remplir pour respecter le règlement européen sur l'IA : fiche de transparence, description des données d'entraînement, analyse de risques ou registre des systèmes. | https://contextetech.com/docs/dossiers-ai-act |
schema | Un schéma de sortie est un JSON Schema qui décrit exactement la forme de la réponse attendue : quels champs, de quel type, lesquels sont obligatoires. Les modèles récents savent s'y conformer (sorties structurées). | https://contextetech.com/docs/schemas |
corpus | Un corpus est un ensemble de documents déjà découpés en morceaux, chacun avec son texte et sa source. Il est prêt à être vectorisé pour un RAG, et chaque réponse peut citer d'où elle vient. | https://contextetech.com/docs/corpus |
Coste estimado
Tokens de entrada por llamada : ≈ 3378
| Modelo | Por llamada | Por 1.000 llamadas |
|---|---|---|
| Mistral Large · Mistral AI | 0,00149 € | 1,49 € |
| DeepSeek Flash · DeepSeek | 0,00089 € | 0,89 € |
| DeepSeek V4 Pro · DeepSeek | 0,00393 € | 3,93 € |
| GPT-6 Luna · OpenAI | 0,00030 € | 0,30 € |
| GPT-6 Sol · OpenAI | 0,00595 € | 5,95 € |
| Claude Sonnet 5.5 · Anthropic | 0,00595 € | 5,95 € |
| Claude Opus 5.5 · Anthropic | 0,01 € | 11,90 € |
| Modelo de código abierto autoalojado (Ollama, vLLM) | 0 € de API (solo el coste del servidor) | |
Solo coste de entrada, sin la respuesta del modelo. Precios públicos estándar de los proveedores (Mistral AI, DeepSeek, OpenAI, Anthropic) convertidos de USD a euros al tipo del BCE del 29 de septiembre de 2026. Estimación: 1 token ≈ 3,6 caracteres.
Common to all 3 regions
Created by the author, no outside source.
Commercial use allowed · credit the author · changes allowed.
Text or data only: no access to files, network or commands.
Hosted in France (Scaleway, Paris). No transfer outside the EU.
European Union · 5/5
No personal data.
No training data: no summary required.
United States · 5/5
No personal data.
No training data: no documentation to publish.
China · 5/5
No personal data.
No training data; AI-generated content published in China must be labelled (2025).
Indicative summary as of 30/09/2026, not a legal certification. Method and sources →
Estadísticas
Me gusta : 0 · Comentarios : 0
Haz clic en un contador para mostrarlo u ocultarlo; pasa el ratón por el gráfico para ver el detalle. Una visita por visitante y día, sin robots; recuento iniciado el 30 de septiembre de 2026.
- Identificador
- contextetech--guides-contexte-tech
- Tipo
- Corpus
- Archivo
- guides-contexte-tech.corpus.jsonl
- Formato
- JSON Lines (application/jsonl)
- Tamaño
- 5574 bytes (5,4 KB)
- Codificación
- UTF-8
- Tokens estimados
- ≈ 1520
- Idioma
- Francés
- Licencia
- MIT
- Uso comercial
- Permitido
- Datos personales
- Ninguno
- Versión
- 1.0
- Publicado el
- 1 de octubre de 2026 a las 18:46
- Actualizado el
- 1 de octubre de 2026 a las 18:46
- Almacenamiento
- en base de datos
- Usos
- 0
- Me gusta
- 0
guides-contexte-tech.corpus.jsonl
{"id":"context","text":"Un contexte est un ensemble d'instructions et d'exemples que l'on donne au modèle IA avant la question de l'utilisateur. Il oriente sa réponse sans rien réentraîner : c'est l'in-context learning.","source":"https://contextetech.com/docs/contextes"}
{"id":"prompt","text":"Un prompt est un modèle de texte réutilisable, avec des variables entre doubles accolades, par exemple {{produit}}. On remplace les variables puis on l'envoie au modèle.","source":"https://contextetech.com/docs/prompts"}
{"id":"dataset","text":"Un dataset est un jeu d'exemples au format JSONL (une ligne JSON par exemple) qui sert à entraîner ou évaluer un modèle.","source":"https://contextetech.com/docs/datasets"}
{"id":"lora","text":"LoRA est une technique pour adapter un modèle existant à une tâche sans le réentraîner entièrement : on entraîne de petits adaptateurs. Une fiche LoRA regroupe tous les réglages de cet entraînement.","source":"https://contextetech.com/docs/lora"}
{"id":"tool","text":"Un serveur MCP (Model Context Protocol) donne de nouvelles capacités à un assistant IA : lire des fichiers, interroger une base, appeler un service. Le même serveur fonctionne avec Claude, Cursor et d'autres assistants.","source":"https://contextetech.com/docs/serveurs-mcp"}
{"id":"model","text":"Un modèle est un modèle IA publié par un Lab vérifié : fine-tune, fusion (merge) ou version quantifiée. La fiche décrit le modèle et renvoie vers son téléchargement.","source":"https://contextetech.com/docs/modeles"}
{"id":"agent","text":"Un agent est un assistant IA qui enchaîne des étapes pour accomplir une tâche : il suit des instructions, utilise des serveurs MCP et des contextes, et respecte des garde-fous.","source":"https://contextetech.com/docs/agents"}
{"id":"skill","text":"Un skill est un paquet d'instructions (fichier SKILL.md) qu'un assistant comme Claude charge uniquement quand la tâche le demande. Il lui apprend une façon de faire précise.","source":"https://contextetech.com/docs/skills"}
{"id":"eval","text":"Une évaluation est un jeu de cas de test (entrée et réponse attendue) avec une méthode de notation. Elle mesure si un modèle, un prompt, un contexte ou un agent fait bien son travail.","source":"https://contextetech.com/docs/evaluations"}
{"id":"rag","text":"Un pipeline RAG (génération augmentée par la recherche) permet à un modèle de répondre à partir de vos documents : on les découpe, on les vectorise, puis à chaque question on retrouve les extraits utiles et on les donne au modèle.","source":"https://contextetech.com/docs/rag"}
{"id":"harness","text":"Un harness est l'environnement qui fait tourner un agent : son fichier d'instructions (par exemple CLAUDE.md), les outils qu'il a le droit d'utiliser, ce qui lui est interdit, les hooks et les serveurs MCP branchés.","source":"https://contextetech.com/docs/harness"}
{"id":"workflow","text":"Un workflow est un enchaînement d'étapes où l'IA intervient : récupérer des données, les faire analyser par un modèle, puis envoyer le résultat ailleurs. On le construit dans un outil comme n8n, LangGraph, Make ou Dify, puis on l'exporte en JSON.","source":"https://contextetech.com/docs/workflows"}
{"id":"guardrail","text":"Un garde-fou est un ensemble de règles qui contrôle ce qui entre dans un assistant IA ou ce qui en sort : bloquer des données personnelles, repérer une injection de prompt, refuser un sujet hors périmètre.","source":"https://contextetech.com/docs/garde-fous"}
{"id":"embedding","text":"Un modèle d'embeddings transforme un texte en une liste de nombres (un vecteur). Deux textes de sens proche donnent des vecteurs proches : c'est la base de la recherche sémantique et du RAG.","source":"https://contextetech.com/docs/embeddings"}
{"id":"inference","text":"Une config d'inférence est l'ensemble des réglages qui permettent de faire tourner un modèle sur sa propre machine : le moteur (Ollama, vLLM, llama.cpp), la quantification, la taille du contexte et la commande de lancement.","source":"https://contextetech.com/docs/inference"}
{"id":"stack","text":"Une stack est un ensemble de services IA qui fonctionnent ensemble et se lancent en une seule commande : par exemple un modèle, une base vectorielle et une interface de chat, décrits dans un docker-compose.","source":"https://contextetech.com/docs/stacks"}
{"id":"redteam","text":"Le red teaming consiste à attaquer volontairement un assistant IA pour trouver ses failles avant les utilisateurs : contournement des règles, fuite de données, injection de prompt, promesses qu'il ne devrait pas faire.","source":"https://contextetech.com/docs/red-teaming"}
{"id":"aiact","text":"Un dossier AI Act est un modèle de documentation à remplir pour respecter le règlement européen sur l'IA : fiche de transparence, description des données d'entraînement, analyse de risques ou registre des systèmes.","source":"https://contextetech.com/docs/dossiers-ai-act"}
{"id":"schema","text":"Un schéma de sortie est un JSON Schema qui décrit exactement la forme de la réponse attendue : quels champs, de quel type, lesquels sont obligatoires. Les modèles récents savent s'y conformer (sorties structurées).","source":"https://contextetech.com/docs/schemas"}
{"id":"corpus","text":"Un corpus est un ensemble de documents déjà découpés en morceaux, chacun avec son texte et sa source. Il est prêt à être vectorisé pour un RAG, et chaque réponse peut citer d'où elle vient.","source":"https://contextetech.com/docs/corpus"}
Cargar el corpus (Python)
import json
chunks = [json.loads(l) for l in open("guides-contexte-tech.corpus.jsonl")]
for c in chunks[:3]:
print(c.get("id"), "|", c.get("source"), "|", c["text"][:80])
# Vectorisez ensuite chaque c["text"] et gardez c["source"] pour citer la source dans la réponse
Comunidad
Aún no hay comentarios. Comparte tu opinión, ayudará a los siguientes.