Le blog Sourcing.sh
Brancher Claude sur vos données entreprises : mode d'emploi
MCP a standardisé la tuyauterie entre un assistant IA et vos données. Reste l'essentiel : concevoir l'index qu'on met au bout du tuyau. Guide pas à pas, sans code.

« Peut-on brancher Claude sur notre base clients ? » La question revient dans la plupart des équipes commerciales et data depuis deux ans. La réponse est oui, et le chantier est bien plus court qu'on ne l'imagine — à une condition : disposer d'un index de données propre. Le protocole MCP (Model Context Protocol) a standardisé toute la partie tuyauterie. Ce qui reste à concevoir, c'est ce que l'on met au bout du tuyau.
Le principe : trois briques, pas une de plus
MCP fonctionne comme une prise universelle. D'un côté, un client — Claude Desktop, Claude Code, ou n'importe quelle application compatible. De l'autre, un serveur MCP qui expose des outils : rechercher une entreprise, enrichir un contact, lister des offres d'emploi. Au milieu, le modèle décide seul quand appeler quel outil, en fonction de la question posée.
L'architecture tient donc en trois briques : le modèle, le serveur MCP, et l'index de données derrière. Notez ce que cette liste ne contient pas : une application. L'interface — chat, CRM, tableur — devient une couche secondaire, interchangeable. C'est la base de données qui porte la valeur.
Prérequis : un index, pas un export CSV
L'erreur la plus fréquente consiste à exposer directement la base de production, ou pire, un export figé datant du dernier trimestre. Un agent qui raisonne sur des données périmées produit des réponses fausses avec un aplomb parfait.
Un index exploitable par un agent réunit quatre propriétés :
- Des identifiants stables : SIREN, domaine web, identifiant interne — quelque chose qui permet de relier les entités entre elles sans ambiguïté.
- Une déduplication faite en amont : l'agent ne doit jamais avoir à arbitrer entre trois fiches « Acme SAS » légèrement différentes.
- Un horodatage de fraîcheur sur chaque champ sensible (effectifs, levée de fonds, statut de l'entreprise).
- Un schéma documenté : chaque champ a un nom explicite et une définition. Un modèle lit la documentation ; il ne devine pas ce que signifie « rev_2 ».
Ordre de grandeur utile : un index entreprises pertinent pour prospecter en France, ce sont quelques centaines de milliers d'entités réellement actives et tenues à jour — pas dix millions de lignes dont la moitié sont des sociétés radiées.
Les quatre étapes du branchement
1. Définir trois à cinq outils, pas quarante. Un outil de recherche multicritères, un outil d'enrichissement par identifiant, éventuellement un outil de listing paginé. Chaque outil supplémentaire dilue la capacité du modèle à choisir le bon.
2. Rédiger les descriptions comme de la documentation. La description d'un outil MCP est lue par le modèle à chaque appel. Précisez les unités, les valeurs possibles des filtres, les limites de pagination. Une description vague coûte des dizaines d'appels ratés par jour.
3. Brancher le client. Côté Claude, cela se résume à déclarer l'URL du serveur dans la configuration. Comptez une heure, authentification comprise, si le serveur respecte le standard.
4. Tester avec de vraies questions métier. Pas « liste les entreprises », mais « quelles scale-up lyonnaises de 50 à 200 salariés ont ouvert des postes commerciaux ce trimestre ? ». C'est ce type de requête qui révèle les trous du schéma.
Les pièges classiques
- Renvoyer des réponses de 200 Ko : le contexte du modèle sature, la qualité s'effondre. Paginez, tronquez, résumez côté serveur.
- Deux champs pour la même notion (« employees » et « headcount ») : le modèle en choisira un au hasard.
- Aucune indication de fraîcheur : l'agent présentera une donnée de 2024 comme un fait actuel.
- Exposer l'écriture par défaut : commencez en lecture seule, toujours.
Et dans le CRM ?
Le chat n'est que la vitrine. Le vrai gain apparaît quand le même index alimente le CRM : fiches entreprises enrichies automatiquement, comptes créés avec les bons identifiants, signaux de croissance remontés là où les équipes travaillent déjà. Le serveur MCP et le connecteur CRM ne sont que deux robinets branchés sur la même source.
C'est précisément le pari de sourcing.sh : plutôt qu'une application de plus, un index — environ 200 000 entreprises, 123 000 profils, 1,4 million d'offres d'emploi — nourri en continu par des agents, et livré frais là où vous travaillez : votre CRM, votre ATS, Claude via MCP, ou votre propre code via API. Au forfait, sans compteur de crédits. La tuyauterie est standardisée ; nous nous occupons de ce qu'il y a au bout du tuyau.