Contexte Tech jest teraz open source: centrum wszystkiego, co dostosowuje model AI
Tony, twórca Contexte Tech · 27 września 2026
Przez ostatnie sześć miesięcy spędzałem sporą część dni na „dostosowywaniu” modeli językowych do prawdziwych zastosowań: tu prompt systemowy, tam trzy przykłady few-shot, serwer MCP, żeby asystent mógł czytać moje pliki, konfiguracja LoRA, gdy sam prompt nie wystarcza. I za każdym razem ta sama frustracja: te elementy są rozrzucone wszędzie. Prompt w gist, zbiór danych na Hugging Face, serwer MCP w README, konfiguracja Claude Code zakopana w jakimś projekcie.
Tak powstał Contexte Tech: jedno miejsce na wszystko, co dostosowuje model AI, uporządkowane, przetestowane i gotowe do skopiowania. Serwis działa pod adresem contextetech.com, a kod jego pierwszej wersji (v1) jest teraz wolnym oprogramowaniem.
Co w nim jest
Jedenaście typów zasobów w trzech rodzinach:
- Produkcja (używanie modelu bez jego zmieniania): konteksty, prompty, agenci, potoki RAG;
- Trenowanie (zmienianie modelu): zbiory danych do fine-tuningu, konfiguracje LoRA, ewaluacje;
- Rozszerzenia (dawanie mu narzędzi): serwery MCP, skille, harnessy.
Każda strona eksportuje bezpośrednio do formatu docelowego narzędzia: JSONL dla zbioru danych, SKILL.md dla skilla, CLAUDE.md i settings.json dla harnessu, blok mcpServers dla serwera MCP.
Zależało mi na dwóch rzeczach, bo gdzie indziej ich brakuje:
- „Przetestowano na”: każdy zasób może wymienić modele, na których go wypróbowano, z wynikiem (zaliczony, częściowo, niezaliczony) i oceną. Prompt, który działa na jednym modelu, a na innym nie, to codzienność, więc warto to zapisać.
- Poziom ryzyka serwerów MCP i harnessów: przed instalacją serwera chcesz wiedzieć, czy czyta pliki, zapisuje je, łączy się z internetem albo uruchamia polecenia. Strona pokazuje to wprost.
Konkretny przykład
Potrzeba. Mała firma chce, żeby LLM streszczał jej zgłoszenia do wsparcia. Haczyk: zgłoszenia zawierają imiona i nazwiska, numery telefonów i dane bankowe. Wysłanie ich w takiej postaci do zewnętrznej usługi to wyciek danych osobowych i problem z RODO.
Odpowiedź na Contexte Tech. Zamiast szukać dziesięciu zasobów w dziesięciu miejscach, podążasz za jednym łańcuchem:
- kontekst anonymisation-rgpd zastępuje dane osobowe etykietami, zanim cokolwiek zostanie wysłane:
Input: Bonjour, je suis Marie Dupont, joignable au 06 12 34 56 78.
Output: Bonjour, je suis [PRENOM_1] [NOM_1], joignable au [TELEPHONE_1].
- ewaluacja eval-anonymisation-rgpd sprawdza, czy nic nie wycieka, za pomocą gotowych do uruchomienia przypadków testowych;
- gdy sam prompt nie wystarcza, zbiór danych anonymisation-rgpd-fr i konfiguracja LoRA mistral7b-anonymisation-qlora pozwalają dostroić mały model działający lokalnie;
- agent agent-tri-documents i serwer MCP mcp-filesystem automatyzują przetwarzanie całego folderu.
Jedna potrzeba, jeden łańcuch powiązanych zasobów, każdy do wyeksportowania we właściwym formacie.
Pod maską
Chciałem prostego, szybkiego stacku, który w całości da się hostować samodzielnie:
- Serwis: Astro renderowane na serwerze, z kilkoma wyspami Svelte tylko tam, gdzie potrzebna jest interaktywność (formularz publikacji, przycisk polubienia). Cała reszta to zwykły HTML; strona główna waży około 16 KB.
- API: FastAPI z asynchronicznym SQLAlchemy, PostgreSQL 17 na dane, Redis do pamięci podręcznej i limitów zapytań. Pamięć podręczna jest unieważniana jednym licznikiem wersji zwiększanym przy każdym zapisie: żadnego szczegółowego czyszczenia do zarządzania.
- Sieć: na froncie Caddy (automatyczny TLS, HTTP/3), potem europejski CDN Bunny (Słowenia) dla plików statycznych, buforowanych przez rok dzięki haszowanym nazwom plików.
- Pięć języków (francuski, angielski, hiszpański, niemiecki, włoski). Jeden niuans SEO: zasób napisany po francusku jest indeksowany tylko po francusku; jego wersje
/en/…tłumaczą interfejs, ale wskazują oryginał jako kanoniczny. W przeciwnym razie Google widzi pięć kopii tego samego tekstu. - Czytelne, unikalne adresy:
/prompts/resume-article-technique-k3j9a2. Przyrostek to hasz FNV-1a wewnętrznego identyfikatora, obliczany identycznie w Pythonie i JavaScripcie, dzięki czemu dwóch autorów może wybrać tę samą nazwę bez kolizji. - Bez trackerów: bez reklamowych plików cookie; ruch jest mierzony samodzielnie hostowanym Plausible, bez plików cookie i danych osobowych.
Projekt suwerenny
Contexte Tech jest tworzony i hostowany w Europie, bez zależności od wielkich amerykańskich dostawców chmury:
- Serwer i baza danych w Scaleway, we Francji (zarządzany PostgreSQL, serwer dedykowany);
- CDN i DNS w Bunny, europejskiej firmie z siedzibą w Słowenii;
- Poczta e-mail przez Proton, w Szwajcarii, szyfrowana i podpisana (SPF, DKIM, DMARC);
- Czcionki, skrypty i style serwowane przez sam serwis: bez Google Fonts, bez zewnętrznego CDN; samodzielnie hostowane statystyki Plausible, bez plików cookie;
- Wydawca: francuska firma, podlegająca RODO.
Jeden świadomy wyjątek: kod ma kopie lustrzane na GitHubie i GitLabie, bo tam są programiści. Kopia robocza znajduje się na naszym własnym serwerze.
Dlaczego AGPL-3.0
Wahałem się między nią a Apache-2.0 (licencją bibliotek Hugging Face). Wybrałem AGPL-3.0: możesz używać i modyfikować Contexte Tech, pod warunkiem że opublikujesz swoje zmiany, jeśli udostępniasz go w sieci. To licencja Mastodona i Plausible, która sprawia, że otwarte centrum pozostaje otwarte.
Same zasoby zachowują licencję wybraną przez autora (MIT, CC BY 4.0…).
Na jakim etapie jest projekt
To dopiero początek i wolę być szczery: katalog startuje z jednym zasobem na typ, zbudowanym wokół jednego konkretnego zastosowania (anonimizacji francuskiego tekstu przed wysłaniem go do zewnętrznej usługi). Najbardziej potrzebuje Twoich zasobów, opinii i testów.
- Serwis: contextetech.com
- Kod v1: github.com/contexte-tech/contextetech (kopia lustrzana na GitLabie). Serwis rozwija się dalej w wersji v2, tworzonej wewnętrznie.
- Współtworzenie: przeczytaj
CONTRIBUTING.mdalbo po prostu opublikuj swój pierwszy zasób.
Jeśli masz prompt, którego używasz codziennie, serwer MCP, który uwielbiasz, albo dobrze dopracowaną konfigurację Claude Code, to jest miejsce, by się nimi podzielić.