Ces outils sous licence Apache ou MIT couvrent le cycle de vie des projets IA, de la gestion des connaissances au pilotage d'agents.
The post 15 outils open source à mettre dans sa toolbox IA appeared first on Silicon.fr.
OpenClaw, Superpowers, Hermes, ECC, DeepSeek Harness, la skill Claude Code d’Andrej Karpathy… Sur GitHub, l’outillage agentique a actuellement une popularité sans égale.
Nous élargissons ici la perspective à l’ensemble des briques de l’écosystème IA : inférence hétérogène, passerelles de routage, gestion des connaissances, etc. En voici quelques-unes dont les dépôts sont actifs. Elles sont classées par nombre d’étoiles.
MarkItDownUtilitaire Python sous licence MIT qui convertit divers formats de fichiers en Markdown. Signé Microsoft, il est comparable à textract, avec un focus sur la préservation de la structure (entités, listes, tables, liens).
Quelques plug-in sont disponibles, notamment pour l’OCR et pour la jonction avec les services cognitifs Azure. Lesquels apportent, entre autres, la gestion de la vidéo et des champs structurés.
OpenHands Agent CanvasFront-end autohébergé (package npm) sous licence MIT pour piloter les agents de codage compatibles ACP. Il utilise par défaut l’agent d’OpenHands, mais peut en exploiter d’autres, sur back-end local ou distant. On peut lui greffer un serveur d’automatisation (GitHub, Slack, Linear…) et un service ingress.
Colibri
![]()
Vincenzo Fornaro, ingénieur spécialisé en vision par ordinateur, est à l’origine de ce moteur d’inférence axé sur les modèles à mélange d’experts (MoE). Sous licence Apache 2.0, il gère les back-ends CPU, CUDA, Metal et NUMA. Sa principale caractéristique est d’assembler RAM, VRAM et NVMe en une même hiérarchie de stockage, avec un fonctionnement juste-à-temps distribuant les paramètres. Principales familles de modèles prises en charge : DeepSeek, GLM, Inkling, Kimi, OLMoE et Qwen.
Tencent a développé cet outil de gestion des connaissances. Sous licence MIT, il associe recherche hybride (lexicale et sémantique ; éventuellement agentique) et création automatisée de wikis avec graphes de connaissances.
Modèles, bases vectorielles et back-ends de stockage sont interchangeables. Une extension permet de piloter les navigateurs web. Diverses intégrations existent avec des outils de productivité (Confluence, GitLab, Notion...) et des messageries instantanées. WeKnora a un serveur MCP, une skill ClawHub et un plug-in pour le harnais DeepSeek.
9RouterCette passerelle LLM locale est sous licence MIT. Elle bascule automatiquement entre trois niveaux de facturation :
On peut utiliser plusieurs comptes par fournisseur, avec équilibrage automatique de la charge. Et en chaîner plusieurs en un « fournisseur virtuel ». 9Router gère le suivi des quotas et le rafraîchissement automatique des jetons OAuth. Il peut effectuer l'embedding en local et compresser les résultats des outils avant envoi aux LLM.
ObscuraLicence Apache 2.0 pour ce navigateur headless. Il est présenté comme une alternative à Chrome, moins gourmande en mémoire, avec une initialisation plus rapide et une meilleure isolation des sessions.
Obscura est compatible avec le protocole Chrome DevTools. On peut y connecter Puppeteer et Plawright. Cloudflare le cite comme une source d'inspiration dans le cadre du développement de Kitesurf, son propre navigateur headless.
Llamafile
![]()
À l'origine, il y avait Cosmopolitan. Ce projet fondé sur le format APE (Actually Portable Executable) visait à faire de C un langage vraiment « portable » en reconfigurant GCC et Clang pour produire un format POSIX utilisable sur de multiples OS et architectures CPU.
Appliqué au framework llama.cpp, cela donne Llamafile, qui permet de distribuer des LLM (poids + code d'inférence) en un seul fichier, exécutable sans installation.
Sous licence Apache 2.0, Llamafile existe en version « légère », sans bibliothèques CUDA et Vulkan embarquées. Pour contourner la limite à 4 Go des fichiers exécutables sous Windows, il permet d'utiliser des poids externes. La dernière version du serveur gère un catalogue d'une douzaine de modèles, dont du Mistral et du Qwen.
WebLLMAutre moteur d'inférence, qui cible quant à lui les navigateurs via WebAssembly et WebGPU. Sous licence Apache 2.0, il gère Web Workers, permettant de déporter des tâches dans des threads distincts.
C'est un projet de la communauté MLC (Machine Learning Compilation), à l'origine de laquelle on trouve notamment OctoML et Carnegie-Mellon. Elle exploite le principe de la compilation ML (capture d'un graphe des opérations tensorielles ensuite transformé en représentations de bas niveau) pour favoriser l'exécution hétérogène.
ChatGPTBoxCette extension de navigateur (Chromium, Firefox, Safari) sous licence MIT donne divers moyens d'accéder à ChatGPT : fenêtres de discussion flottantes, page dédiée, actions dans le menu contextuel (résumé, traduction, analyse de sentiment, explication de code...).
ChatGPTBox a des intégrations spécifiques avec certains sites (GitHub, Reddit, Stack Overflow, YouTube, moteurs de recherche...). Elles sont désactivables. On peut le connecter à des modèles tiers au format OpenAPI et à des serveurs Ollama.
Local Deep ResearchCet assistant de recherche local sous licence MIT a plusieurs modes de fonctionnement : résumé rapide, recherche détaillée, création de rapport, analyse de document, questions-réponses. Il peut exploiter plusieurs stratégies, dont une autonome à base de LangGraph.
Local Deep Research comprend une API REST, un serveur MCP, un tableau de bord et des évaluations. Censé pouvoir fonctionner sur une RTX 3090, il gère notamment des modèles DeepSeek, Gemma, Llama, Mistral et Qwen, via Ollama, LM Studio et llama.cpp.
OpenWhispr
![]()
Application de dictée vocale sous licence MIT pour Windows, Mac et Linux. Elle peut traiter l'audio en local (modèles Whisper, Orukeet, NVIDIA Parakeet et Cohere Transcribe ; usage illimité) ou en ligne (GPT-5, Claude, Gemini, Groq, Tinfoil, OpenRouter ; usage limité à 2000 mots par semaine).
La diarisation se fait en local. OpenWhispr peut retranscrire automatiquement les réunions Zoom, Teams et FaceTime, en plus des fichiers importés. On peut lui transmettre des captures d'écran en guise de contexte. Tous les éléments transcrits sont stockés dans une base SQLite avec option de synchronisation cloud. Par défaut, les réponses apparaissent là où se trouve le curseur. Elles vont sinon dans le presse-papiers.
Code2PromptOlivier D'Arcona, ingénieur ML suisse doctorant à l'université de Fribourg (thèse sur l'analyse de documents par LLM dans la finance et le juridique) est le principal développeur de Code2Prompt.
Sous licence MIT, l'outil promet d'optimiser la conversion des codebases en prompts, en permettant la personnalisation par templates Handlebars et patterns Glob. Il est disponible en API, DSK Python, skill et serveur MCP.
stable-diffusion.cpp
![]()
L'approche llamafile.cpp (inférence en C/C++ pur) appliquée aux modèles de diffusion - image et vidéo - sur la base de GGML, pour une variété de back-ends (CPU, CUDA, Vulkan, Metal, OpenCL, SYCL).
Sous licence MIT, stable-diffusion.cpp a diverses extensions, dont :
Cette application de bureau (Windows, Mac, Linux) sous licence MIT réunit sur une même interface les versions web de divers chatbots (ChatGPT, Claude, Perplexity, Bing, etc.). Sa particularité : elle leur envoie les prompts en simultané.
Les web apps ont été préférées aux API parce que certaines fonctionnalités y sont intégrées en avance, voire leur sont réservées. Cela permet aussi de couvrir les services qui n'ont pas d'API (Poe, par exemple) et ceux qui n'en ont que pour certains modèles (Perplexity).
Listes « Awesome Prompt Engineering » et « Awesome Local LLM »Sur GitHub, nombre de thématiques ont leur(s) « liste(s) Awesome », qui prennent généralement la forme de compilations de liens.
Il y en a, par exemple, pour l'autohébergement, le hacking, l'OSINT, les outils en ligne de commande ou les microservices. Nous en mettons ici deux en avant, dédiées respectivement au prompt engineering / context engineering et à l'IA locale. Leur contenu est similaire : articles de référence, outils, modèles, datasets, benchmarks, tutoriels...
Illustration principale générée par IA
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | OpenAI alerte plus de 100 organisations sur les compromissions de ses agents IA | 0 | 7.05 | 02-10-2026 |
| 2 | Les modèles ouverts s’emparent de la majorité du trafic d’IA en production, selon Vercel | 0 | 5.31 | 23-09-2026 |
| 3 | Après son vote en faveur de l’IA, Debian ouvre un portail d’inférence | 0 | 5.82 | 25-09-2026 |
| 4 | Quand les agents IA agissent en notre nom, qui est responsable ? | 0 | 8.44 | 07-10-2026 |
| 5 | Agents IA : la FTC ouvre une enquête au lendemain de l’accord de la Maison-Blanche | 0 | 6.67 | 01-10-2026 |
| 6 | Face à l’IA, les bug bountys se remettent diversement en question | 0 | 6.08 | 05-10-2026 |
| 7 | OpenAI signe avec Synopsys : l’effet Jalapeño ? | 0 | 10.96 | 05-10-2026 |
| 8 | Le Barreau de Paris veut former ses avocats à l’IA | 0 | 5.82 | 24-09-2026 |
| 9 | Tokenomics : les chiffres d’une discipline FinOps en construction | 0 | 7.44 | 25-09-2026 |
| 10 | NetApp a choisi son camp pour investir les « usines IA » | 0 | 5.98 | 01-10-2026 |