Agent commercial automatisé avec Claude (qualif, relance)

Un agent commercial Claude ne remplace pas un SDR, il absorbe la qualification et les relances. Voici les briques (API, MCP, CRM), un prompt BANT prêt à copier, une séquence de 4 touches et un plan de pilote de 3 semaines avec les KPIs à suivre.

Un cabinet de conseil reçoit 40 demandes par semaine via son formulaire. Un dirigeant les traite en 3 heures, en survole 15, en oublie 8 et rappelle 4 jours plus tard des leads déjà partis chez le concurrent. C'est là qu'un agent commercial Claude devient intéressant : pas pour remplacer un commercial, mais pour absorber la partie répétitive du travail de qualification et de relance. Avant de plonger dans les briques techniques, si tu débutes avec l'outil, commence par le guide complet pour apprendre Claude pour poser les bases, puis reviens ici pour la partie agent.

Cet article ne vend pas l'idée d'un SDR full auto. Il décrit ce qu'un agent commercial fait vraiment, avec quelles briques (API Anthropic, MCP, CRM), et comment monter un pilote de 3 semaines sans se planter.

Ce qu'un agent commercial Claude peut réellement faire (et ce qu'il ne doit pas faire)

Le périmètre utile est étroit et il faut l'assumer. Un agent commercial Claude gère bien la qualification entrante (formulaire de contact, email inbound, chat), l'enrichissement basique (LinkedIn, site de l'entreprise, taille approximative), le scoring selon une grille définie, la rédaction de relances contextualisées, et la prise de rendez-vous quand tu lui donnes accès à un Calendly ou un Cal.com.

Ce qu'il ne doit pas faire : négocier un prix, gérer une objection sensible (« votre concurrent est 30 % moins cher »), promettre un livrable, ou clôturer un deal au-delà d'un certain seuil. Sur ces moments, l'agent escalade à un humain. La règle qu'on applique en pilote : tout lead au-dessus de 15 000 € de valeur potentielle bascule en revue humaine avant toute réponse envoyée.

Reprends l'exemple du cabinet de 40 demandes hebdo. Un agent bien cadré qualifie les 40, en tag 12 comme prioritaires (budget confirmé, décideur identifié, échéance sous 90 jours), 18 comme tièdes (à mettre en séquence de nurturing), et 10 comme hors cible (renvoi vers du contenu, pas de relance). Le dirigeant ne passe plus 3 heures à trier mais 30 minutes à valider les 12 prioritaires. C'est ça le gain. Pas la révolution, juste 2h30 récupérées.

L'architecture minimale : Claude + API + MCP + CRM

La pile technique tient sur quatre briques, dont trois sont probablement déjà chez toi.

BriqueRôleExemple
RaisonnementQualifie, score, rédigeAPI Anthropic (Sonnet 5 ou Haiku 4.5)
Connexion outilsLit et écrit dans le CRMProtocole MCP
Source de véritéStocke les leads, historiqueHubSpot, Pipedrive, Folk, Airtable
DéclencheurEnvoie les leads à l'agentWebhook formulaire, IMAP, Make

Le vrai changement depuis 2025, c'est MCP. Avant, connecter Claude à HubSpot demandait un développeur backend qui écrivait des wrappers autour de l'API HubSpot. Depuis l'extension du connecteur HubSpot MCP en juillet 2026, Claude peut lire une fiche Deal, créer un contact, mettre à jour un pipeline, ou rédiger un email depuis HubSpot, sans code custom. Tu autorises le connecteur une fois, tu décris ce que tu veux, l'agent exécute. Le même principe existe pour Notion, Slack, Google Workspace.

Pour le choix de modèle : Sonnet 5 (à partir de 2 $ / 10 $ le million de tokens) suffit largement pour la qualification et la rédaction. Haiku 4.5 (à partir de 1 $ / 5 $) est encore plus économique si tu traites de gros volumes de leads simples. Garde Opus 5 ou Fable 5.1 pour les tâches où le raisonnement long compte, comme l'analyse d'un RFP entrant de 40 pages. La logique générale de construction d'agents Claude autonomes s'applique ici : un agent monolithique qui fait tout est plus fragile qu'une chaîne d'agents spécialisés.

Le prompt de qualification : structurer le raisonnement de l'agent

Le piège classique : chercher le prompt magique. Le vrai levier, c'est la clarté de la grille business. Un BANT flou (« budget adéquat », « décideur ») donne un scoring flou. Un BANT explicite avec seuils chiffrés donne un scoring reproductible.

Tu es un agent de qualification pour {cabinet}, spécialisé en {niche}.

Pour chaque lead reçu, produis un JSON strict :
{
  "score": 0-100,
  "tags": ["prioritaire" | "tiede" | "hors_cible"],
  "budget_estime_eur": number | null,
  "decideur_identifie": boolean,
  "echeance_jours": number | null,
  "next_action": "rdv_direct" | "sequence_nurturing" | "contenu_educatif" | "escalade_humaine",
  "raison": "1 phrase",
  "reponse_suggeree": "corps d'email en français, tutoiement, max 120 mots"
}

Grille de scoring :
- Budget confirmé > 20k€ : +30
- Décideur (fondateur, DG, CxO) : +25
- Échéance < 90 jours : +20
- Entreprise 10-200 salariés (ICP) : +15
- Formulaire rempli entièrement : +10

Escalade humaine OBLIGATOIRE si :
- Budget > 50k€
- Mention d'un appel d'offres ou d'un concurrent nommé
- Demande légale, RH sensible, ou plainte

Ne cite JAMAIS de prix. Ne promets JAMAIS de délai de livraison.
Si tu manques d'info pour scorer, mets null et explique dans "raison".

Ce prompt fait 300 tokens. Il n'a rien de brillant. Sa force, c'est qu'il rend la sortie prévisible : tu peux la parser, la stocker dans le CRM, la router vers Slack. Un lead scoré 78 avec tag « prioritaire » et next_action « rdv_direct » déclenche une notif au commercial humain. Un lead à 34 avec « sequence_nurturing » part automatiquement dans la séquence décrite plus bas.

La séquence de relance : cadence, personnalisation, arrêt

Une séquence de 4 touches sur 21 jours (J+2, J+7, J+14, J+21) donne de bons résultats sur du B2B services. L'agent rédige chaque email en s'appuyant sur trois sources : la conversation initiale du lead, les échanges précédents de la séquence, et un contexte marché injecté dans le prompt.

La différence entre une relance générique et une relance qui convertit tient à trois lignes. Générique : « Bonjour, je me permets de revenir vers vous suite à notre échange. Avez-vous eu le temps de réfléchir à notre proposition ? » Personnalisée : « Bonjour Marie, tu mentionnais que ton équipe RH passait 6 heures par semaine à trier les CVs. J'ai rédigé un exemple de scoring appliqué à ton secteur (SaaS B2B, 50 salariés), tu veux que je te l'envoie ? »

La règle : chaque relance doit référencer un détail spécifique du lead. Si Claude n'a pas ce détail, il ne relance pas, il pose une question ou passe le lead en révision humaine. Sinon autant garder Mailchimp.

Règles d'arrêt strictes, codées dans le workflow :

  • Toute réponse humaine du lead arrête immédiatement la séquence et notifie un commercial.
  • Un clic « désabonnement » retire le lead de toute séquence future (obligation RGPD, pas une option).
  • Deux relances sans ouverture d'email : bascule en séquence « contenu éducatif » (newsletter, pas de push commercial).
  • Après J+21 sans engagement : lead marqué « froid », sortie de la séquence, remis en base pour retargeting trimestriel.

Garde-fous : ce qui casse un pilote d'agent commercial

Les incidents qui plombent un pilote se répètent d'un projet à l'autre.

L'agent invente des références. Sans contrainte explicite, Claude peut halluciner un client « Renault » ou une étude « McKinsey 2024 » pour crédibiliser une réponse. La parade : whitelister les références autorisées dans le prompt système et interdire toute mention d'entreprise ou de chiffre hors de cette liste. Un simple « ne cite que les logos suivants : {liste} » réduit drastiquement le problème.

L'agent promet un tarif ou un délai. Un lead demande « c'est combien ? » et l'agent, poussé par sa serviabilité, sort un prix plausible qui n'a jamais été validé. Solution : instruction dure dans le prompt (« si le lead demande un prix ou un délai, réponds systématiquement qu'un consultant reviendra vers lui sous 24h ») et test unitaire sur ce cas avant mise en prod.

Trois relances le même jour à cause d'un webhook bugué. Un lead qui reçoit trois emails identiques en 4 heures, c'est un lead perdu. Prévois un rate limit côté orchestrateur : max 1 email par lead par 24h, tous canaux confondus. Loggue chaque envoi avec timestamp et checksum du contenu.

Le ton culturel qui rate. Un agent entraîné sur des templates SaaS américains qui tutoie un directeur financier de PME lyonnaise, ça ferme la porte. Précise dans le prompt le registre attendu (vouvoiement pour B2B corporate France, tutoiement pour SaaS ou startup, adaptations pour Québec ou Suisse romande).

Sur les enjeux plus larges de sécurité des agents autonomes, la lecture des incidents documentés par Anthropic sur les tests isolés est utile pour comprendre pourquoi la validation humaine reste indispensable en phase pilote.

Plan de pilote en 3 semaines et indicateurs à suivre

Trois semaines suffisent pour un pilote sérieux. Moins que ça, tu manques de recul statistique. Plus que ça, tu procrastines.

SemaineObjectifLivrable
S1Cartographier, cadrer, brancherGrille BANT écrite, API + MCP connectés au CRM sandbox, prompt v1 testé sur 10 leads historiques
S2Mode shadow : agent propose, humain valide20 leads réels traités, comparaison qualif agent vs humain, ajustement du prompt
S3Bascule progressive avec seuil de confianceLeads sous 15k€ : agent autonome. Leads au-dessus : revue humaine. Reporting hebdo

Les KPIs à instrumenter dès la semaine 1, sinon tu piloteras à l'aveugle :

  • Taux de qualif correcte vs humain (mesuré sur les 20 leads shadow). Objectif : > 85 % d'accord.
  • Temps médian de première réponse. Un lead qui reçoit une réponse en 4 minutes convertit 6 à 8 fois plus qu'un lead recontacté à J+2. C'est là que l'agent gagne son ROI.
  • Taux de réponse aux relances. Séquence bien calibrée : 15 à 25 % de réponse sur les 4 touches. En dessous de 8 %, le prompt de relance est à revoir.
  • Coût par lead qualifié. En Sonnet 5 avec cache activé, compte environ 0,03 € à 0,08 € par lead qualifié complet (qualif + 4 relances rédigées). À comparer au coût horaire d'un SDR : 25 à 40 € brut chargé, 6 à 8 leads qualifiés par heure sur un flux entrant classique.

Si le pilote confirme les chiffres, l'étape suivante est industrielle : orchestration multi-agents, connecteurs enrichis, monitoring continu. C'est le moment où un accompagnement structuré fait gagner des mois. Notre programme dédié à la conception d'agents autonomes en cohorte de 5 semaines aide les dirigeants à sortir 5 agents opérationnels en production. Si tu veux passer du pilote à l'industriel avec un cadre et un mentor, découvre comment piloter vos agents autonomes avec Ottho.

Pilier stratégique

Construire des agents IA autonomes avec Claude

Architecture d'agent, multi-agents, sécurisation, déploiement en production. Le territoire de Claude Agent.

Découvrir le pilier complet →Formation Claude Mastery →