Allez maintenant sur HubSpot et ouvrez une dizaine de fiches entreprises au hasard. Répondez franchement : combien, ou un SIREN ? Combien, ou un effectif à jour ? Est-ce que vous avez toujours le nom du gérant actuel ? En général, la réponse, c’est non. C’est soit vide, soit pas à jour. Même pas un problème de rire commercial. C’est simplement que les données bouclent rapidement, et que, si vous n’avez pas un système de mise à jour et d’enrichissement quotidien, vous finirez par avoir des données dégradées dans votre CRM.
Voici comment je le fais, avec Pappers et HubSpot (Ceux qui n’utilisent pas HubSpot, ça fonctionne pareil avec les autres SIREN ?)
Pourquoi Pappers plutôt qu’un enrichisseur US ?
Vous avez sûrement déjà vu Apollo, ZoomInfo, Clearbit. Il y a plein de solutions hyper classiques en enrichissement qu’on voit partout tourner sur LinkedIn. En fait, c’est des providers qui sont hyper intéressants. Ils ne sont pas très chers, ils ont énormément de données, mais ils fonctionnent surtout pour les États-Unis. Donc, si vous êtes en France et que vos cibles sont en France, ce n’est pas forcément les meilleurs providers à aller chercher. Et en particulier, sur la partie légale, ils sont vraiment mauvais :
- Les effectifs sont approximatifs.
- Les dirigeants ne sont pas bons.
- Les SIREN ne sont jamais présents.
Pappers agrège des données officielles (INSEE, INPI, greffes, BODACC, comptes annuels, etc.) :
| Donnée | Utilité commerciale directe |
|---|---|
| SIREN / SIRET | Identifiant unique, fin des doublons entre « Acme » et « ACME SAS » |
| Tranche d’effectif INSEE | Segmentation ICP fiable, plus de « environ 50 » invérifiable |
| Code NAF | Ciblage sectoriel propre |
| Dirigeants et mandats | Le bon interlocuteur, pas un ex-DG parti depuis 18 mois |
| Chiffre d’affaires, résultat | Priorisation des comptes, détection des sociétés en difficulté |
| Procédures collectives | Éviter de vendre à une entreprise en redressement |
| Date de création | Signal « jeune entreprise » pour vos séquences |
Ils ont une API documentée et, depuis peu, un serveur MCP officiel qui permet à n’importe quel agent IA d’interroger ces données directement (j’y reviens dans mon article sur MCP et la prospection).
Un SIREN sur chaque fiche entreprise est le prérequis numéro un d’un CRM propre si vous prospecter en France. Sans cet identifiant unique, la déduplication est plus complexe (mais pas impossible heureusement).
Préparer HubSpot : les propriétés à créer
Le travail préparatoire est assez simple. Il faut créer des propriétés de destination sur l’objet entreprise. Vous pouvez ajouter un préfixe pappers_ pour les retrouver facilement et ne jamais écraser une propriété native.
pappers_siren Texte sur une ligne
pappers_siret_siege Texte sur une ligne
pappers_code_naf Texte sur une ligne
pappers_effectif_estime Nombre
pappers_chiffre_affaires Nombre (devise)
pappers_dirigeant_principal Texte sur une ligne
pappers_fonction_dirigeant Texte sur une ligne
pappers_date_enrichissement Date et heure
La dernière propriété, elle est souvent oubliée (la date d’enrichissement), mais elle est hyper importante. Elle vous servira souvent de référence pour savoir quelle entreprise mettre à jour vos données.
Pour les tranches d’effectif, reprenez telles quelles les tranches officielles INSEE (« 10 à 19 salariés », « 20 à 49 salariés », etc.). Vous pourrez ensuite segmenter sans jamais vous poser des questions bête comme “50 veut dire 40 ou 120” ?
Le workflow d’enrichissement
En général, J’aime bien construire ce type de flux dans n8n, auto-hébergé ou cloud, parce qu’il gère les appels HTTP, les boucles et la gestion d’erreurs sans dépendance à un connecteur tiers. Vous pouvez utiliser aussi Zapier ou Make, ou n’importe quel autre logiciel vous maîtrisez déjà.
Étape 1 : le déclencheur
Deux options :
- Temps réel : un workflow HubSpot déclenche un webhook à la création d’une entreprise (ou quand la propriété
pappers_sirenest vide). - Batch : toutes les nuits, une seach HubSpot via l’API
crm/v3/objects/companies/searchremonte les fiches dontpappers_date_enrichissementest vide ou date de plus de 120 jours.
Étape 2 : trouver SIREN
C’est une étape critique en Fracnce donc atachez-y une importante particulière. Vous partez rarement d’un SIREN, vous partez d’un nom et d’un domaine web. L’endpoint recherche de Pappers accepte un nom de société ; je lui passe aussi le code postal quand je l’ai pour lever les homonymes.
GET https://api.pappers.fr/v2/recherche
?q=Acme
&code_postal=69001
&api_token=VOTRE_CLE
Règle que j’applique : si la recherche renvoie un seul résultat avec un score de confiance élevé, j’enrichis. Si elle en renvoie plusieurs, je crée une tâche HubSpot « SIREN à confirmer » assignée au propriétaire de la fiche plutôt que de deviner. Un mauvais SIREN est pire qu’un SIREN vide. Si la tâche SIREN à confirmer est trop récurrente, j’ajoute un agent IA pour qu’il gère cette partie. Ca va vraiment dépendre des industries ciblées.
Pour les comptes où vous avez le domaine, vous pouvez aussi passer par l’API Recherche d’entreprises de l’État, gratuite et sans clé, en première passe, puis Pappers pour les données financières et les dirigeants.
Étape 3 : extraire toute la fiche.
GET https://api.pappers.fr/v2/entreprise
?siren=123456789
&api_token=VOTRE_CLE
La réponse contient tout ce qu’il faut : siege.siret, code_naf, tranche_effectif,.. Un nœud « Code » ou « Edit Fields » dans n8n remet ça à plat.
Étape 4 : update d’HubSpot
Une bête requête PATCH sur crm/v3/objects/companies/{id} avec vos propriétés pappers_* fait l’affaire. Attention, quand même :
- Ne jamais écraser une valeur saisie par un humain sur les propriétés natives (
numberofemployees,annualrevenue). Écrivez dans vos propriétéspappers_, puis décidez dans un workflow HubSpot si vous recopiez. - Horodater avec
pappers_date_enrichissementà chaque écriture comme on l’a déjà vu plus haut
Étape 5 : les dirigeants
Le dirigeant principal mérite mieux qu’un champ texte sur la fiche entreprise. Je crée souvent (ou associe) un contact avec le rôle « Dirigeant », ce qui permet ensuite de lancer une séquence ciblée ou de détecter un changement de dirigeant. Même si vos décideurs / champions ne sont pas les dirigeants, c’est toujours intéressant de les garder de côté, ne serait ce que pour la connaissance du compte (savoir qui dirige une boite est quand même la base quand vous voulez travailler avec).
Combien ça coûte, combien ça rapporte
Pappers facture à l’appel API, avec des tarifs dégressifs. Pour un CRM de 5 000 entreprises, on est autour de quelques dizaines, voire quelques centaines d’euros maximum.
On compare ça au coût d’une donnée de mauvaise qualité. Le ROI est instantané. Crois que j’avais vu une étude Gartner qui estime le coût moyen de la mauvaise qui a été donné à environ 12,9 millions de dollars par an pour une organisation. C’est pas des montants qui sont les votres, mais c’est l’idée qu’il faut retenir.
Les pièges que je vois souvent
- Enrichir tout le CRM d’un coup sans SIREN fiable. Commencez par les 500 comptes ouverts, vérifiez la qualité du matching. Ensuite, seulement élargissez.
- Oublier les établissements. Un groupe a un SIREN et des dizaines de SIRET. Stockez le SIRET du siège, toujours.
- Confondre effectif INSEE et effectif estimé. La tranche INSEE date parfois de l’exercice précédent. Pappers fournit aussi une estimation plus récente ; gardez les deux et étiquetez-les.
- Ne pas prévoir le refresh. Les dirigeants changent, les effectifs bougent : le chrun des le dirigeant est plus faible que celui des commerciaux, mais il faut quand même, de temps en temps, mettre à jour toutes les données. Ca permet même de faire apparaitre des opportunités ! (par exemple le dirigeant qui faisait véto est parti)