Brancher la mémoire de son entreprise sur Claude par MCP

Claude se souvient de vous. Il retient vos préférences, votre style, vos projets en cours. Ce dont il ne se souvient pas, c'est de votre entreprise : la décision de prix prise à trois en février, la raison pour laquelle vous avez écarté ce fournisseur, ce que la dernière campagne a appris à l'équipe. Cette connaissance n'appartient pas à une conversation ni à une personne, et c'est précisément pour ça qu'aucune mémoire personnelle d'assistant ne la porte.

La réponse propre à ce problème tient en un protocole : MCP. La mémoire de l'entreprise vit dans un système dédié, hors de l'assistant, et Claude l'interroge pendant la conversation, comme il consulterait un collègue qui sait. Ce guide montre comment brancher ça en cinq étapes, ce que ça change concrètement, et ce qu'il faut exiger de n'importe quel serveur MCP avant de lui confier la mémoire d'une entreprise.

Pourquoi passer par MCP plutôt que par la mémoire de Claude

Trois raisons, dans l'ordre d'importance.

La mémoire d'entreprise est partagée, celle de l'assistant est personnelle. Ce que Claude retient de vos conversations ne sert qu'à vous. Une décision d'entreprise doit être lisible par l'associé, la personne qui arrive le mois prochain, et l'outil d'IA qu'elle utilisera, qui ne sera peut-être pas Claude.

La mémoire survit à l'abonnement. Ce qu'un assistant apprend de votre activité reste chez lui. Une mémoire branchée par MCP vit dans un système que vous contrôlez : changez d'assistant, elle reste. Le même serveur se branche à ChatGPT, Cursor ou Gemini, qui lisent et enrichissent la même mémoire sans qu'aucun ne la possède.

Les réponses sont sourcées. Une mémoire d'entreprise digne de ce nom rattache chaque affirmation à sa preuve : la décision, sa date, ce qui l'a motivée. Claude répond alors en citant, au lieu de reconstruire de mémoire un contexte qu'il n'a jamais eu.

Le branchement en cinq étapes

Les étapes ci-dessous sont celles de Verbasil, mais leur forme vaut pour tout serveur MCP de mémoire sérieux : un jeton généré côté mémoire, un connecteur déclaré côté client.

  1. Ouvrez votre outil de mémoire, section Intégrations, outils IA.
  2. Générez un jeton d'accès, en choisissant sa portée : lecture seule, ou lecture et écriture. Copiez-le immédiatement, il n'est montré qu'une fois.
  3. Dans Claude, ouvrez les paramètres, puis les connecteurs.
  4. Ajoutez un connecteur personnalisé avec l'adresse MCP du serveur et votre jeton.
  5. Ouvrez une conversation et posez une question de contrôle : « Qu'est-ce que ma mémoire contient ? » Si les outils apparaissent et que la réponse cite des éléments réels, c'est branché.

Deux détails qui évitent les tickets de support : Claude Desktop et Claude Code utilisent le même connecteur, un seul jeton suffit pour les deux. Et si vous branchez plusieurs clients IA, donnez un jeton à chacun plutôt que de partager : les plafonds d'appels sont posés par jeton, et deux clients sur le même jeton se volent la cadence.

Ce que vous demandez à Claude une fois branché

Le branchement ne vaut que par les questions qu'il rend possibles. Celles qui reviennent le plus :

  • Avant de trancher : « Qu'avons-nous déjà décidé sur les prix, quand, et pourquoi ? » La réponse cite la décision datée et ce qui la motivait, au lieu de rouvrir le débat de zéro.
  • Avant un rendez-vous : « Donne-moi le contexte sur ce contact avant que je lui écrive. » Historique, engagements pris, ce qui reste ouvert.
  • Avant de refaire une erreur : « Qu'a-t-on appris la dernière fois qu'on a essayé ça ? »
  • Pour reprendre le fil : « Qu'est-ce qui reste ouvert cette semaine, et qu'est-ce qui attend une réponse de ma part ? »

Le motif commun : chaque question aurait autrement coûté une interruption de collègue, une fouille dans les emails, ou une décision reprise en aveugle.

L'écriture : la règle qui rend la chose tenable

Un serveur MCP d'écriture permet à Claude de proposer d'enregistrer ce qui vient de se dire : une décision actée en conversation, un apprentissage, un compte rendu. C'est le sens vertueux, la mémoire se nourrit pendant le travail au lieu d'exiger une discipline de saisie.

Mais la règle qui sépare un système sain d'un système qui se dégrade : une écriture d'IA n'est jamais appliquée directement. Chez Verbasil, elle arrive dans Sources et attend qu'un humain la relise. Un assistant qui écrirait sans filet dans la mémoire d'une entreprise la rendrait inutilisable en un mois : la mémoire vaut ce que vaut sa validation.

Ce qu'il faut exiger de n'importe quel serveur MCP de mémoire

Que vous choisissiez notre outil ou un autre, ces cinq exigences ne se négocient pas.

  • Des jetons à portée limitée. Lecture seule ou lecture et écriture, au choix, et rattachés à une mémoire précise, pas à tout le compte.
  • Une révocation immédiate. Un jeton révoqué doit cesser de répondre à l'instant, et ce qui est en mémoire doit y rester.
  • Des plafonds d'appels par jeton. Chez nous, 30 appels par minute et 400 par heure : un agent laissé en boucle ne doit pas pouvoir consommer votre mémoire sans fin.
  • Le serveur ne voit que les questions. Le serveur MCP reçoit ce que l'assistant lui demande, jamais le reste de votre conversation. Si un fournisseur ne peut pas l'affirmer par écrit, c'est une réponse en soi.
  • Une validation humaine sur toute écriture. Voir ci-dessus. Sans elle, le jeton d'écriture est un risque, pas une fonctionnalité.

Ces exigences sont le début d'un sujet plus large, la sécurité des serveurs MCP en entreprise, que nous traitons à part.

Les limites, dites franchement

Claude est le client le plus simple à brancher, les autres varient. ChatGPT passe par son mode développeur, ce qui ajoute plusieurs étapes ; la marche complète est sur les fiches Claude et ChatGPT.

La mémoire ne rend que ce qu'elle contient. Un serveur MCP branché sur une mémoire vide répond du vide. Le branchement vient après la matière : décisions, réunions, notes. Le guide bien nourrir votre mémoire traite ce versant.

Le sens de lecture est unique. C'est Claude qui interroge la mémoire, pas la mémoire qui fouille vos conversations Claude. Ce qui doit entrer en mémoire y entre par vos sources réelles ou par une proposition validée, jamais par aspiration silencieuse.

Réserver un audit de mémoire : gratuit, trente minutes, on regarde ensemble ce que votre mémoire devrait contenir avant même de la brancher.

FAQ

Comment connecter une mémoire d'entreprise à Claude ?

Par MCP, en cinq étapes : générez un jeton d'accès dans votre outil de mémoire en choisissant sa portée, ouvrez les paramètres de Claude puis les connecteurs, ajoutez un connecteur personnalisé avec l'adresse MCP du serveur et le jeton, redémarrez le client, et posez une question de contrôle. Claude Desktop et Claude Code partagent le même connecteur.

Qu'est-ce qu'un serveur MCP de mémoire d'entreprise ?

Un serveur qui expose la mémoire de l'entreprise, ses décisions datées, ses apprentissages, ses contacts, à tout assistant IA compatible MCP, sous forme d'outils de lecture et d'écriture. La mémoire vit hors de l'assistant : plusieurs IA lisent et enrichissent la même, et aucune ne la possède. C'est la différence avec la mémoire personnelle d'un assistant, qui ne retient que vous et reste chez lui.

Claude peut-il écrire dans la mémoire de l'entreprise ?

Oui, si le jeton a la portée écriture, et à une condition qui devrait être non négociable : aucune écriture appliquée sans validation humaine. Claude propose d'enregistrer une décision ou un apprentissage, la proposition attend une relecture, et c'est un humain qui l'intègre. Un jeton en lecture seule reste possible si vous ne voulez aucune écriture.

Verbasil lit-il mes conversations Claude ?

Non. Le serveur MCP ne reçoit que les questions que l'assistant lui pose, jamais le reste de l'échange. Le sens de lecture est unique : Claude interroge la mémoire, la mémoire ne fouille pas vos conversations.

Faut-il un serveur différent pour ChatGPT et pour Claude ?

Non, c'est l'intérêt du protocole : le même serveur MCP sert ChatGPT, Claude, Cursor et Gemini. En revanche, donnez un jeton distinct à chaque client : les plafonds d'appels sont posés par jeton, et deux clients qui partagent un jeton partagent aussi sa cadence.

Read this article in English