74 000 datasets publics dans Claude en cinq minutes : le MCP officiel data.gouv.fr
Le 18 mai 2026, l’équipe data.gouv.fr a publié la version 0.2.25 de son serveur MCP officiel. Ce serveur permet à Claude d’interroger directement 74 000 jeux de données publics français en langage naturel. Il est gratuit, ouvert, ne demande aucune clé API, et c’est le premier serveur MCP officiel d’un État au monde.
Aucun grand média ne l’a relayé. La plupart des dirigeants de PME qui paient un outil SaaS pour qualifier prospects, surveiller clients ou consulter marchés publics ignorent qu’une partie de ce qu’ils achètent est disponible gratuitement, branchée à leur assistant IA, en cinq minutes.
Le serveur que la presse n’a pas relayé
L’annonce initiale du serveur est de février 2026. La version actuelle, 0.2.25, est sortie le 18 mai. Entre les deux, l’équipe data.gouv.fr a stabilisé dix outils typés, opérationnels, exposés sur un endpoint public unique : https://mcp.data.gouv.fr/mcp.
Quand Anthropic ajoute Spotify, Uber ou TurboTax à Claude, la presse spécialisée en parle trois semaines, voir Spotify, Uber, TurboTax dans Claude : votre stack B2B change de voisin. Quand un État livre un MCP officiel sur son catalogue national, silence. Conséquence : la plupart des PME francophones paient toujours un connecteur tiers pour interroger ce qui est désormais gratuit à la source.
Le serveur est opéré par Etalab, la mission open data de la DINUM, sous licence MIT. Il n’expose que des outils en lecture seule, d’où l’absence de clé API : rien à protéger côté utilisateur, rien à casser côté plateforme. C’est aussi pourquoi l’installation tient en quelques lignes.
Rappel pour les lecteurs qui découvrent le protocole : MCP est le standard ouvert qui branche un assistant IA à des outils externes sans développement par couple (voir MCP : le protocole qui connecte vos outils métier à l’IA). C’est la même mécanique qui anime Zapier SDK, MCP, code custom : le decision tree pour PME en 4 questions ou les workflows décrits dans « Connecte mon CRM à Slack » : n8n crée le workflow en 30 secondes. La nouveauté ici : un État livre son propre serveur MCP, sans intermédiaire commercial.
MCP et Skill : deux briques, un seul Claude
L’équipe data.gouv.fr publie en réalité deux composants distincts. Confondre les deux, c’est passer à côté de la moitié de la valeur.
| Critère | Le serveur MCP | Le Skill |
|---|---|---|
| Nature | Serveur distant qui expose des outils typés | Fichier Markdown (SKILL.md) que Claude lit |
| Qui exécute la requête | Le serveur, côté data.gouv.fr | Claude lui-même, qui formule les appels HTTP |
| Format | 10 outils nommés (search_datasets, query_resource_data…) |
Documentation des trois APIs (Main, Metrics, Tabular) |
| Activation | Config mcpServers ou commande CLI |
Copie d’un fichier dans le répertoire skills/
|
| Avantage | Exécution garantie, types stricts, moins d’erreurs | Plus de contexte, workflows riches, cas hors outils |
Les deux fonctionnent ensemble. Quand vous posez une question simple, « cherche les datasets sur les valeurs foncières », Claude appelle l’outil MCP search_datasets. Quand vous posez une question complexe qui combine catalogue + métriques + filtrage CSV custom, le Skill donne à Claude la documentation pour orchestrer lui-même la séquence. Les deux installations prennent ensemble moins de cinq minutes. On commence par le serveur MCP.
Guide gratuit
Le Guide du Vibe Coding pour PME
Découvrez comment les PME utilisent l'IA pour créer des outils sur mesure sans développeur.
Recevoir le guide gratuitementInstaller le serveur MCP dans Claude Desktop
Ouvrez votre fichier de configuration Claude Desktop :
- macOS :
~/Library/Application Support/Claude/claude_desktop_config.json - Linux :
~/.config/Claude/claude_desktop_config.json - Windows :
%APPDATA%\Claude\claude_desktop_config.json
Ajoutez l’entrée suivante. Si vous avez déjà d’autres serveurs MCP, ajoutez datagouv dans la liste existante :
{
"mcpServers": {
"datagouv": {
"command": "npx",
"args": ["mcp-remote", "https://mcp.data.gouv.fr/mcp"]
}
}
}
Sauvegardez, fermez et rouvrez Claude Desktop. Dans la barre d’outils du chat, vous devriez voir apparaître les outils data.gouv.fr disponibles.
Cas Windows particulier
: si la connexion échoue silencieusement, ajoutez à la racine du fichier de config le flag "isUsingBuiltInNodeForMcp": false. Le Node.js embarqué dans Claude Desktop sur Windows ne joue pas toujours bien avec mcp-remote ; le flag force l’utilisation du Node système.
Notez que le serveur ne supporte que le transport Streamable HTTP. STDIO et SSE ne fonctionnent pas. Inutile d’essayer une autre configuration que celle ci-dessus : le serveur renverra une erreur de transport.
Installer le serveur MCP dans Claude Code
Pour Claude Code, l’installation tient en une commande shell :
claude mcp add --transport http datagouv https://mcp.data.gouv.fr/mcp
Vérifiez l’enregistrement avec claude mcp list. Vous devriez voir datagouv dans la liste des serveurs disponibles, avec le statut HTTP. À partir de là, dans n’importe quelle session Claude Code, les dix outils data.gouv.fr sont accessibles.
Aucun redémarrage de session n’est nécessaire pour Claude Code : la commande met à jour la config locale et le prochain message du chat charge les outils.
Installer le Skill data.gouv.fr
Le Skill est un fichier SKILL.md que vous copiez dans le répertoire skills de Claude. Récupérez-le depuis le dépôt github.com/datagouv/datagouv-skill (clonez le repo ou téléchargez le fichier directement).
Pour Claude Desktop sur macOS :
mkdir -p ~/Library/Application\ Support/Claude/skills/datagouv-apis && cp SKILL.md ~/Library/Application\ Support/Claude/skills/datagouv-apis/
Pour Claude Code :
mkdir -p ~/.claude/skills/datagouv-apis && cp SKILL.md ~/.claude/skills/datagouv-apis/
Redémarrez le client après installation : Claude Desktop charge ses Skills au démarrage, et Claude Code recharge la liste à l’ouverture d’une nouvelle session. Pour vérifier que le Skill est bien chargé, demandez simplement à Claude « avez-vous accès au Skill data.gouv.fr ? », il devrait confirmer en listant les trois APIs couvertes (Main, Metrics, Tabular).
Le Skill et le serveur MCP sont compatibles. Activer les deux donne à Claude le meilleur des deux mondes : exécution typée pour les requêtes simples, documentation riche pour les requêtes hors-modèle.
Premier test : prix au m² à Bordeaux en 2025
Une fois les deux briques installées, ouvrez Claude et lancez le prompt suivant :
Cherche sur data.gouv.fr les jeux de données « valeurs foncières » et donne-moi un échantillon des prix au m² à Bordeaux en 2025.
Ce que vous allez observer côté Claude :
- Appel à
search_datasetsavec « valeurs foncières » comme mot-clé. - Identification du jeu de données DVF (Demandes de Valeurs Foncières) publié par la DGFiP.
- Appel à
list_dataset_resourcespour identifier le fichier 2025. - Appel à
query_resource_data(Tabular API) avec un filtre sur le département 33 et la commune de Bordeaux. - Restitution d’un échantillon de lignes avec calcul d’un prix moyen au m².
Le prompt n’a pas eu besoin d’URL, de format de fichier ni de syntaxe d’API. C’est la promesse MCP en condition réelle, sur un cas d’usage immobilier que la plupart des PME du secteur paient à un agrégateur privé. Sans le Skill installé, le prompt fonctionne aussi : Claude utilise directement les outils du serveur. Le Skill ajoute de la précision sur les filtres Tabular et les exports CSV, surtout pour les manipulations complexes (jointures entre datasets, agrégations multi-années).
Les limites que personne ne raconte
L’enthousiasme sur la souveraineté ne doit pas faire oublier ce que le serveur ne fait pas. La documentation officielle est claire : « This MCP server is still experimental. Scope, uses and configuration may evolve. Responses may be incomplete or erroneous. Always verify results before reuse. »
Six limites à intégrer dans votre usage opérationnel :
- Statut expérimental assumé. La version 0.2.25 du 18 mai 2026 est stable pour l’usage quotidien, mais le comportement des outils peut évoluer. Verrouillez les prompts critiques de votre équipe sur des cas testés.
- Read-only. Aucun outil n’écrit sur data.gouv.fr (pas de publication, pas de commentaire, pas d’édition de dataset). Le serveur sert à interroger, jamais à publier.
- Plafonds Tabular. Les CSV interrogeables via
query_resource_datasont limités à 100 MB. Les XLSX à 12,5 MB. Pour les datasets plus lourds (DVF nationale, BODACC complet), il faut filtrer dès la requête. - Pagination 200 lignes. La pagination par défaut est de 20 lignes, le maximum de 200 par appel. Sur les gros volumes, prévoyez plusieurs appels successifs et expliquez-le à Claude dans le prompt.
- Métriques production uniquement. L’outil
get_metricsn’expose que l’environnement de prod (max 100 records par appel). Pas de demo ni de preprod. - Vérification humaine systématique. La phrase officielle ne laisse aucune ambiguïté : avant réutilisation métier (devis, rapport, décision), un humain valide.
Aucune de ces limites n’est rédhibitoire pour un usage PME. Toutes méritent d’être documentées avant la première utilisation en clientèle.
Souveraineté pratique, pas slogan
Le mot souveraineté fatigue quand il est slogan. Ici, il a une mécanique précise.
Aucune donnée ne quitte le périmètre des serveurs data.gouv.fr pour rejoindre l’endpoint MCP. La requête part de Claude, atteint mcp.data.gouv.fr, est servie par l’infrastructure DINUM, et revient à Claude. Anthropic voit passer le contenu de la conversation (c’est inévitable avec un LLM hébergé US), mais le catalogue, les datasets et les requêtes structurées, eux, restent dans le tissu public français. Pour un cabinet d’architectes qui consulte les valeurs foncières, ou pour une PME industrielle qui consulte les marchés publics, c’est une couche d’intermédiation en moins.
Le pendant infrastructure de cette logique data est la bascule Linux de la DINUM (2,5 millions de postes Linux : ce que l’État fait, votre PME le faisait déjà). Côté outils IA, la prochaine étape DINUM est le couplage MCP + Albert, le modèle de langage souverain de la DINUM, dont un prototype circule déjà. Une PME qui adopte aujourd’hui le MCP data.gouv.fr sur Claude pourra demain rebrancher la même couche data sur un modèle hébergé en France, sans rien changer aux prompts.
Autre dimension pratique : coût zéro, pas d’inscription, pas de quota. À comparer avec les connecteurs tiers facturés 30 à 80 euros par mois et par siège pour exposer les mêmes données.
Ce qui suit dans la série
Installer le serveur, c’est le pas un. La valeur opérationnelle vient ensuite, dataset par dataset. Dans les semaines qui viennent, nous publions quatre cas d’usage concrets, prompt par prompt, sur les jeux de données les plus rentables pour une PME :
- SIRENE : qualifier un prospect (effectif, NAF, date de création, état) en langage naturel, sans abonnement à un agrégateur.
- DVF : sortir un prix au m² par adresse pour un dossier client, sans passer par un portail immobilier privé.
- BODACC : détecter la défaillance d’un client clé avant qu’elle frappe votre poste.
- DECP : repérer les marchés publics adressables à votre PME, par secteur et par région.
Pour chacun, le prompt, le résultat, et la grille de vérification avant utilisation métier. Le serveur MCP installé aujourd’hui sera le socle des quatre.
Pour intégrer cette couche dans un agent IA déployé pour votre équipe, c’est le type de chantier que nous menons côté intégration IA. Cinq minutes pour installer le MCP. Le reste, c’est le métier.
Restez informé des dernières actualités gratuitement
Automatisation, IA, développement web et stratégie digitale pour PME. Un email par semaine, zéro spam.
Brancher l'IA sur vos données (MCP)
MCP : le protocole qui connecte vos outils métier à l'IA
"Connecte mon CRM à Slack" : n8n crée le workflow en 30 secondes
Le client de 50 k€ qui passe en redressement vendredi : BODACC l'a publié avant que vous le sachiez
Articles similaires
43 % des serveurs MCP troués : la checklist 48 h pour MCP 2.4
Votre serveur MCP a une clé dans un .env ? Vous êtes dans la majorité, et la fenêtre se ferme
Claude Opus chez vous, données chez vous : Anthropic tranche le 19 mai