Meilleurs scrapers PagesJaunes 2026 [Édition No-Code + API]

Nathan Eshetu
21 Jul 2026

(updated)

32 min read

lobstr.io est le meilleur scraper PagesJaunes en 2026, testé sur les données, le coût, la facilité d'utilisation, l'évolutivité, la vitesse et le support. Il l'emporte sur le jeu de données le plus riche testé (46 champs, seul outil à extraire les emails), et la meilleure valeur à l'échelle, à égalité avec Apify à 1,50 $/1K mais avec 10 champs de plus. Apify est le second choix, avec 36 champs et 74,32 résultats/min, mais n'extrait pas les emails et ses tarifs ne baissent jamais avec le volume.

⚡ Résumé en 30 secondes

  1. J'ai testé quatre scrapers PagesJaunes sur les données, le coût, la facilité d'utilisation, l'évolutivité, la vitesse et le support.
  2. lobstr.io est le meilleur scraper PagesJaunes dans l'ensemble. Il retourne le jeu de données le plus riche testé (46 champs), c'est le seul outil qui extrait les emails, et il est le plus rapide en mode base (428,57/min) et offre la meilleure valeur à l'échelle. L'enrichissement complet (email inclus) fait chuter sa vitesse à 9,44/min, derrière les 74,32/min d'Apify.
  3. Apify est le meilleur second choix. Il retourne un jeu de données propre de 36 champs en un seul mode sans réglages à gérer, et offre la réponse support la plus rapide testée (0,89 heure). Le compromis : pas d'extraction d'email, et les tarifs ne baissent jamais avec le volume.
  4. Piloterr est une option API uniquement, pas un outil no-code. Il retourne 20 champs répartis sur deux appels distincts, à un coût et une vitesse dans la moyenne, mais nécessite du code pour être utilisé, tout simplement.
  5. WebScraper.io est l'outil le plus faible testé, sur tous les critères. Il ne retourne que 10 champs, il est le plus lent (5,24/min) et le plus cher (10,54 $–5,27 $/1K), et son fonctionnement est réparti sur plusieurs onglets techniques.
  6. PhantomBuster n'a pas fait la liste finale. Il a échoué face à la protection CAPTCHA, même après être passé par le proxy basé en France que ses propres instructions exigent.

Obtenir quelques résultats PagesJaunes, c'est facile.

Obtenir une liste propre et exploitable à l'échelle, sans code ni coûts surprises, voilà le vrai problème.

La plupart des outils de scraping qu'on trouve en ligne sont soit conçus pour les développeurs, soit peu fiables au-delà de quelques centaines de lignes, soit hors de prix dès qu'il faut du volume.

Publication Reddit montrant un utilisateur en difficulté pour scraper PagesJaunes avec du vibe coding et demandant des recommandations de scraper no-code

J'ai testé les meilleures options no-code pour vous éviter de passer par les mêmes essais-erreurs.

Voici ce qui fonctionne vraiment.


Comparaison rapide

Critères lobstr.io Apify Piloterr WebScraper.io
Note utilisateur 5/5 5/5 4,8 N/A
Champs de données 46 36 20 10
Extraction d'email
Extraction de téléphone
Extraction de site web
Coordonnées géographiques
Texte d'avis individuel
Nombre d'avis sur chaque résultat
Données légales/entreprise
Coût par 1 000 (entrée) 6,00 $ 1,50 $ 2,92 $ 10,54 $
Coût par 1 000 (échelle) 1,50 $ 1,50 $ 2,43 $ 5,27 $
Offre gratuite
Vitesse (résultats/min) 9 74 17 5
Vitesse (pour 1 000 résultats) 1 h 45 min 54 s 13 min 27 s 58 min 20 s 3 h 10 min 47 s
Contrôle des résultats Max résultats + max pages Coût max par run Aucune limite intégrée Aucune limite de pages/résultats
Concurrence
Planification
Formats d'export CSV, JSON, XLSX, JSONL CSV, JSON, XLSX, XML, JSONL JSON CSV, JSON, XLSX
Webhook
Accès programmatique API + SDK + CLI + MCP API + SDK + MCP API + MCP API + SDK + MCP
Support client Chat en direct + Email Onglet Issues (maintenu par la communauté) Email + chat en direct Email

Comment les scores se comparent-ils ?

Critère lobstr.io Apify Piloterr WebScraper.io
Données 4/5 3/5 1/5 2/5
Coût 5/5 3/5 3/5 1/5
Facilité d'utilisation 5/5 3/5 1/5 2/5
Vitesse 4/5 3/5 3/5 1/5
Évolutivité 5/5 4/5 3/5 2/5
Support 4/5 5/5 4/5 2/5
Global 4,5/5 3,5/5 2,5/5 1,7/5

Chaque catégorie est notée sur 5 en fonction des résultats de test ci-dessous. Le score global est une moyenne simple des six catégories.


Dites-moi simplement lequel utiliser

Si vous voulez... Choisissez Pourquoi
Les données les plus complètes, email inclus lobstr.io 46 champs, et c'est toujours le seul à vous donner une boîte mail à contacter.
La meilleure valeur à l'échelle lobstr.io Même prix qu'Apify par 1 000 résultats, vous obtenez juste dix champs de plus pour le même prix.
Les doublons gérés automatiquement lobstr.io Déduplication intégrée. Apify n'a pas d'équivalent, vous devrez nettoyer les doublons vous-même.
Téléphone et données entreprise à l'échelle lobstr.io 95,85/min — toujours plus rapide que les 74,32/min d'Apify, et monte jusqu'à ~4,1 M/mois.

⚠️ Avertissement

Les informations de cette section sont fournies à titre purement informatif. Elles reflètent des sources publiquement accessibles et ma propre interprétation de celles-ci.

Elles ne constituent pas un conseil juridique et ne doivent pas être considérées comme tel. Les lois varient selon les juridictions et peuvent changer.

Pour toute question de conformité, d'usage des données, de contrats ou de risques spécifiques à une plateforme, consultez un professionnel du droit qualifié capable d'évaluer votre situation en détail.

Est-il légal de scraper PagesJaunes ?

Oui, c'est légal sous certaines conditions.

En vertu de l'article L342-3 du Code de la propriété intellectuelle, la collecte de données publiquement accessibles est autorisée, à condition d'y avoir un accès licite et de ne pas extraire la totalité de la base de données.
Article L342-3 du Code de la propriété intellectuelle

Pour la plupart des cas d'usage professionnels, comme la génération de leads, l'étude de marché ou l'analyse concurrentielle, vous restez largement dans ces limites.

Quelques points à garder en tête :

  1. Utilisez les données en interne, pas pour republier les fiches publiquement
  2. N'extrayez pas le catalogue complet
  3. Ne construisez pas un annuaire concurrent à partir des données scrapées

Pour aller plus loin :


Comment j'ai choisi les meilleurs scrapers PagesJaunes

J'ai commencé par lire des publications de la communauté, des avis, et des pages produit pour comprendre ce à quoi les utilisateurs sont réellement confrontés quand ils scrapent PagesJaunes.
Publications de la communauté sur le scraping de PagesJaunes

À partir de là, j'ai réduit la comparaison à six critères :

  1. Données
  2. Coût
  3. Facilité d'utilisation
  4. Vitesse
  5. Évolutivité
  6. Support

Voici ce que j'ai vérifié pour chacun.

Données

Pour les données, j'ai compté combien de champs chaque outil retourne, lesquels sont exclusifs, et si la sortie est assez propre pour être utilisée sans nettoyage.

Exemple de champs de données

Coût

J'ai normalisé les tarifs en coût par 1 000 résultats et comparé les prix d'entrée de gamme avec les prix à l'échelle.

Niveaux de tarification de base de lobstr.io

Facilité d'utilisation

Pour la facilité d'utilisation, j'ai examiné le parcours complet depuis le début.

Je voulais voir si chaque outil pouvait gérer plus qu'un scraping ponctuel : mise en place, entrées, contrôles d'exécution, exports, et jobs répétés.

J'ai évalué :

  1. Options d'entrée : pages de recherche, pages d'entreprise, ou listes en masse.
  2. Contrôles d'exécution : limites, planification, et réglages de scraping.
  3. Options d'export : téléchargements, livraison cloud, ou intégrations de workflow.
  4. Automatisation : API, webhooks, SDK, ou outils externes.
  5. Friction : réglages peu clairs, mise en place maladroite, ou travail manuel supplémentaire.

L'objectif était de juger chaque scraper comme un workflow répétable, pas seulement comme un export de données.

Parcours de facilité d'utilisation no-code

Vitesse

Pour la vitesse, j'ai effectué des tests chronométrés et converti chaque résultat en résultats par minute, puis normalisé le tout en minutes par 1 000 résultats afin que les chiffres soient faciles à comparer côte à côte.

Exemple de vitesse chez lobstr.io

Évolutivité

Pour l'évolutivité, j'ai converti la vitesse mesurée de chaque outil en plafond mensuel, en utilisant 43 200 min/mois (24h/24, 7j/7 pendant 30 jours).

Cela permet d'estimer combien de résultats chaque outil peut produire en un mois.

J'ai aussi noté si des contrôles de concurrence existent pour augmenter le débit, ou si la montée en charge reste surtout linéaire.

Slot lobstr.io

Support

J'ai aussi examiné le support client, car la fiabilité réelle d'un outil se révèle surtout dans sa façon de gérer les problèmes, pas seulement quand tout se passe bien.

Pour chaque outil, j'ai noté quels canaux de support existent réellement, comme le chat en direct, l'email, les tickets et la communauté.

Ensuite, j'ai vérifié ce qui est documenté : les temps de réponse quand ils sont publiés, et les avis tiers mentionnant l'expérience de support.

Exemple d'avis sur le support client

Ce que j'ai exclu et pourquoi

Après avoir défini les critères, j'ai listé tous les scrapers PagesJaunes que j'ai pu trouver via les résultats Google et les recommandations d'IA.

Recommandations d'outils IA pour les scrapers PagesJaunes

Ensuite, j'ai réduit la liste.

  1. Les extensions de navigateur et scrapers visuels ont été exclus car ils ne sont pas fiables à l'échelle. Ils peuvent fonctionner pour de petits jobs manuels, mais ils ont tendance à casser dès qu'il faut des scrapings répétables.
  2. Les applications de bureau à la mise en place peu fiable ont été exclues. Plusieurs outils ont échoué avant même le début des tests, soit au téléchargement, soit au lancement. Si un scraper ne s'installe pas proprement, il est difficile de le recommander pour un workflow répétable.
  3. Les dépôts GitHub abandonnés ont aussi été exclus. J'ai trouvé l-portet/yellow-scraper et Sorelz/PagesJaunes-Scraper, mais les deux semblaient anciens et non maintenus depuis des années.
  4. Les actors Apify peu utilisés ont aussi été écartés. Il existe plusieurs actors PagesJaunes communautaires sur Apify, j'ai donc choisi celui avec le plus d'utilisateurs pour cette comparaison. Ce n'est pas un signal parfait, mais c'est mieux que de choisir un actor fantôme au hasard.

La liste finale ne comprend que des outils accessibles, maintenus, et adaptés à une collecte de données PagesJaunes à l'échelle.


Les meilleurs scrapers PagesJaunes

Critères lobstr.io Apify Piloterr WebScraper.io
Note utilisateur 5/5 5/5 4,8 N/A
Champs de données 46 36 20 10
Extraction d'email
Extraction de téléphone
Extraction de site web
Coordonnées géographiques
Texte d'avis individuel
Nombre d'avis sur chaque résultat
Données légales/entreprise
Coût par 1 000 (entrée) 6,00 $ 1,50 $ 2,92 $ 10,54 $
Coût par 1 000 (échelle) 1,50 $ 1,50 $ 2,43 $ 5,27 $
Offre gratuite
Vitesse (résultats/min) 9 74 17 5
Vitesse (pour 1 000 résultats) 1 h 45 min 54 s 13 min 27 s 58 min 20 s 3 h 10 min 47 s
Contrôle des résultats Max résultats + max pages Coût max par run Aucune limite intégrée Aucune limite de pages/résultats
Concurrence
Planification
Formats d'export CSV, JSON, XLSX, JSONL CSV, JSON, XLSX, XML, JSONL JSON CSV, JSON, XLSX
Webhook
Accès programmatique API + SDK + CLI + MCP API + SDK + MCP API + MCP API + SDK + MCP
Support client Chat en direct + Email Onglet Issues (maintenu par la communauté) Email + chat en direct Email

1. lobstr.io

Note utilisateur : 5/5 ⭐⭐⭐⭐⭐ (33 avis, Capterra)

Catégorie Score
Données 4/5
Coût 5/5
Vitesse 4/5
Évolutivité 5/5
Facilité d'utilisation 5/5
Support 4/5
Global 4,5/5
lobstr.io est une plateforme française de web scraping proposant plus de 50 scrapers prêts à l'emploi, disponible en application no-code ou via API.
Image produit lobstr.io
Avantages Inconvénients
Seul outil avec extraction d'email Plus lent qu'Apify une fois l'email inclus (9,44/min contre 74,32/min)
Seul outil avec des données d'avis, pas seulement un décompte COMPANY HQ toujours vide
46 champs en enrichissement complet, plus que tout autre outil testé
Vitesse mesurée la plus rapide en mode base, ~428,57/min
Coordonnées géographiques, moyens de paiement, produits, marques
Import CSV en masse
Concurrence ajustable via les Slots
Support par chat en direct solide

Données

Richesse

lobstr.io retourne jusqu'à 46 champs PagesJaunes, répartis sur trois niveaux selon les réglages activés.

En mode base (aucun réglage), il retourne 13 champs. Activer Collect Additional Details en ajoute 31 de plus (44 au total). Activer Collect Emails from Website en plus ajoute 2 champs supplémentaires (46 au total).

Champs (46 au total)

Catégorie Champs
Identité & fiche TITLE, ITEM ID, URL, REF, TAGS, ACTIVITY, DESCRIPTION
Localisation FULL ADDRESS, STREET ADDRESS, ZIP CODE, CITY, LATITUDE, LONGITUDE
Contact PHONE, ADDITIONAL PHONE, EMAIL, WEBSITE, EXTERNAL LINKS, FACEBOOK, INSTAGRAM
Entreprise & juridique SIRET, SIREN, NAF CODE, RAISON SOCIAL, FORME JURIDIQUE, AUTRES DENOMINATIONS, COMPANY CREATION DATE, COMPANY SIZE, NOMBRE ETABLISSEMENTS, IS VERIFIED, LISTING TYPE
Détails commerciaux SHOP TYPE, SHOP SIZE, PAYMENT METHODS, PRESTATIONS, PRODUCTS, BRANDS, ACCEPTS QUOTE REQUESTS, MULTI ACTIVITE, OPENING HOURS
Médias IMAGE URL, IMAGES
Avis & notes SCORE, RATINGS, REVIEWS
Toujours vide COMPANY HQ
PHONE et DESCRIPTION nécessitent le réglage Collect Additional Details. Ils ne font pas partie du mode base.

Exclusif

Catégorie Champs
Identité & fiche TAGS, LISTING TYPE
Localisation STREET ADDRESS, LATITUDE, LONGITUDE
Contact EMAIL
Entreprise & juridique COMPANY SIZE, NOMBRE ETABLISSEMENTS, AUTRES DENOMINATIONS
Détails commerciaux SHOP TYPE, SHOP SIZE, PAYMENT METHODS, PRESTATIONS, PRODUCTS, BRANDS, ACCEPTS QUOTE REQUESTS
Avis & notes SCORE, REVIEWS
REVIEWS retourne des objets d'avis individuels (auteur, note, date, texte), pas seulement un décompte.

lobstr.io retourne aussi un nombre d'avis pour chaque entreprise testée (100 %), y compris un 0 confirmé quand il n'y en a aucun. Apify et WebScraper.io ne retournent un décompte que pour respectivement 19,7 % et 39,2 % des entreprises.

Envie de vérifier les chiffres vous-même ?

Score Données : 4/5 — 46 champs (18 exclusifs), zéro doublon sur l'ensemble du run, seul outil avec email, coordonnées géographiques et texte d'avis individuel ; un champ toujours vide (COMPANY HQ) est la seule lacune

Coût

lobstr.io fonctionne sur un modèle d'abonnement mensuel, de 20 $/mois jusqu'à 500 $/mois.

  1. Offre gratuite disponible
  2. À partir de 2,00 $ pour 1 000 résultats
  3. À l'échelle → 0,50 $ pour 1 000 résultats
Niveaux de tarification de base de lobstr.io

lobstr.io propose deux réglages d'enrichissement optionnels : Collect Additional Details et Collect Emails from Website. Activer les deux augmente le coût car vous obtenez plus de données par résultat.

Avec l'enrichissement activé :

  1. À partir de 6,00 $ pour 1 000 résultats
  2. À l'échelle → 1,50 $ pour 1 000 résultats
Tarification lobstr.io avec enrichissement activé

Score Coût : 5/5 — à égalité avec Apify à 1,50 $/1K à l'échelle, mais livre 46 champs email inclus contre 36 sans email pour Apify ; tombe à 0,50 $/1K sur le mode base plus léger

Facilité d'utilisation

lobstr.io garde un fonctionnement simple et pratique.

Façons de lui donner un job

  1. URL de recherche PagesJaunes

Vous pouvez aussi importer un CSV si vous voulez traiter plusieurs URL de recherche en masse.

Options d'entrée URL et d'import CSV de lobstr.io

Réglages avant scraping

  1. Plafond de résultats uniques
  2. Plafond de pages (combien de pages de résultats de recherche PagesJaunes lobstr.io est autorisé à parcourir)
  3. Réglage Collect Additional Details
  4. Réglage Collect Emails from Website
  5. Nombre de slots de traitement
  6. Résultats uniques uniquement
  7. Suppression des retours à la ligne
Réglages avant scraping de lobstr.io

Le système de planification prend en charge les minutes, heures, jours, semaines et mois, avec gestion du fuseau horaire. Cela le rend pratique pour de la surveillance continue, pas seulement pour une extraction ponctuelle.

Options de planification de lobstr.io

Fonctionnalités marquantes

  1. Arrêt des runs à tout moment
  2. Déduplication intégrée
  3. Import en masse par fichier
  4. Alertes webhook et email
  5. Exports vers CSV, JSON, Excel, JSONL, Sheets, S3, SFTP, ou email
  6. Support API, SDK Python, CLI, et MCP

Score Facilité d'utilisation : 5/5 — ensemble de réglages le plus complet, planification avec gestion du fuseau horaire, déduplication intégrée

Vitesse

La vitesse de lobstr.io dépend des réglages activés :

  1. Base (aucun réglage) : 500 résultats en 1 minute 10 secondes → ~428,57 résultats/min
    1. Collect Additional Details : 500 résultats en 5 minutes 13 secondes → ~95,85 résultats/min
    1. Collect Additional Details + Collect Emails from Website : 500 résultats en 52 minutes 57 secondes → ~9,44 résultats/min
Résultats du test de vitesse, run de 500 résultats

Le compromis entre niveaux est direct : plus de données par résultat coûte plus de temps. La vitesse est ajustable via les Slots, qui permettent d'exécuter plus de travail en parallèle.

Score Vitesse : 4/5 — 428,57/min en mode base est le plus rapide testé, de loin, mais l'enrichissement complet tombe à 9,44/min, plus lent que le mode unique d'Apify à 74,32/min

Évolutivité

À la vitesse de base de 428,57 résultats/min, lobstr.io peut collecter environ ~18,5 M de résultats/mois en fonctionnement continu.

Ce plafond change selon la quantité de données supplémentaires collectées.

Avec Collect Additional Details activé, le débit tombe à 95,85 résultats/min, soit environ ~4,1 M de résultats/mois.
En ajoutant Collect Emails from Website, il retombe à 9,44 résultats/min, soit environ ~408 K résultats/mois.

C'est le compromis : les données PagesJaunes de base montent très vite en charge, mais l'enrichissement ralentit le run.

Le vrai levier de montée en charge, ce sont les Slots. Chaque Slot exécute un autre scraper en parallèle, jusqu'à 20 par tâche, donc le débit n'est pas plafonné aux taux mono-worker ci-dessus.
Slot lobstr.io

En pratique, lobstr.io monte en charge avec les requêtes concurrentes.

Score Évolutivité : 5/5 — plafond le plus élevé testé (~18,5 M/mois, mode base) plus la concurrence des Slots, jusqu'à 20 en parallèle

Support client

lobstr.io propose un support via un chat en direct sur le site web, plus l'email.

Le support est l'une des choses que les utilisateurs saluent constamment. L'équipe est reconnue pour ses réponses rapides, ses réponses techniques, et son aide concrète quand quelque chose casse.

Avis Capterra d'utilisateurs de lobstr.io saluant le support client

Score Support : 4/5 — chat en direct + email, les utilisateurs saluent spécifiquement le support dans les avis Capterra

Idéal pour : les équipes qui veulent les données PagesJaunes les plus riches sans construire un workflow d'enrichissement séparé.

C'est le meilleur généraliste ici : le plus rapide en scraping de base, le moins cher à l'échelle, le meilleur pour l'extraction d'email, le plus fiable sur les données d'avis, et le plus simple à exécuter de façon répétée.

Le compromis, c'est que l'enrichissement complet ralentit fortement, donc utilisez le mode approfondi quand la qualité compte plus que la vitesse.


2. Apify

Note utilisateur : 5/5 ⭐⭐⭐⭐⭐ (6 avis, Apify)

Catégorie Score
Données 3/5
Coût 3/5
Vitesse 3/5
Évolutivité 4/5
Facilité d'utilisation 3/5
Support 5/5
Global 3,5/5
Apify est une plateforme de web scraping proposant des scrapers no-code prêts à l'emploi, dont un extracteur PagesJaunes fournissant des jeux de données structurés.
Page produit Apify
Avantages Inconvénients
Schéma le plus large en un seul mode, aucun réglage nécessaire Pas d'import CSV en masse
Plusieurs formats d'export (CSV, JSON, XML, Excel, JSON Lines) Pas d'extraction d'email
Réponse aux tickets rapide (0,89 h en moyenne) Tarif fixe, le coût unitaire ne baisse jamais à l'échelle
Concurrence incluse par défaut Nombre d'avis disponible sur seulement 19,7 % des entreprises

Données

Richesse

Apify retourne 36 champs de données uniques.

L'export brut compte bien plus de colonnes (jusqu'à 176) car les données répétées, comme les liens externes, les horaires d'ouverture et les images, sont réparties sur plusieurs colonnes numérotées par entreprise.

Champs (36 au total)

Catégorie Champs
Identité & fiche id, ref, url, raison_social, type, activite, multi_activite, description
Localisation adresse, city, postal_code
Contact tel, site_externe, instagram, facebook, linkedin, twitter, youtube, tiktok, minisite, pinterest, site_essentiel
Entreprise & juridique NAF, forme_juridique, creation_date, employee_count, siren, siret, is_verified
Médias image, images
Avis & notes ratingValue, reviewCount, bestRating, worstRating
Horaires opening_hours (7 jours)
Toujours vide Aucun

Exclusif

Champs que seul Apify possède :

Catégorie Champs
Contact tiktok, minisite, site_essentiel
Avis & notes bestRating, worstRating

Apify n'a toujours pas d'extraction d'email. Si la prospection au-delà du téléphone fait partie de votre workflow, il vous faudra enrichir les données séparément.

Envie de vérifier les chiffres vous-même ?

Score Données : 3/5 — 36 champs, zéro doublon sur l'ensemble du run, 0 champ toujours vide, mais reviewCount ne se remplit que sur 19,7 % des entreprises, seulement 5 champs exclusifs, et aucune extraction d'email

Coût

Apify utilise un modèle de tarification abonnement mensuel + paiement au résultat.

Page de tarification Apify
  1. Offre gratuite disponible (5 $/mois de crédit plateforme)
  2. Tarif fixe → 1,50 $ pour 1 000 résultats

Le coût ne baisse pas avec l'échelle. Que vous scrapiez 1 000 ou 100 000 résultats, le tarif par résultat reste le même.

Score Coût : 3/5 — 1,50 $/1K fixe, aucune remise à l'échelle quand le volume augmente

Facilité d'utilisation

Apify garde une interface simple, et la majeure partie de la mise en place est directe.

Façons de lui donner un job

  1. URL de recherche PagesJaunes
  2. URL de fiches spécifiques

Il n'y a pas d'import CSV dans la configuration principale. Il faut à la place coller les URL de fiches PagesJaunes via Bulk edit.

Saisie d'URL en masse Apify

Réglages avant scraping

  1. Coût maximum par run (pas de réglage direct de limite de lignes)
Interface de facilité d'utilisation Apify

Fonctionnalités marquantes

  1. Planification et webhooks via Apify
  2. Export en JSON, CSV, Excel, XML, et JSON Lines
  3. Accès API avec SDK Python et JavaScript
  4. Serveur MCP disponible

À garder en tête

Limiter le scraping est la partie la moins intuitive. Il n'y a pas de réglage clair « max résultats/URL » dans la configuration principale.

À la place, vous plafonnez le run via un coût maximum par exécution, ce qui fonctionne, mais c'est moins naturel que de définir une simple limite de lignes.

Réglage du coût maximum par run Apify

Score Facilité d'utilisation : 3/5 — pas d'import CSV dans la configuration principale, limitation par coût au lieu d'un plafond de lignes direct

Vitesse

Apify a collecté 680 résultats PagesJaunes en 9 minutes 9 secondes (un run limité par le coût, puisqu'Apify n'a pas de contrôle fixe du nombre de lignes), soit environ ~74,32 résultats par minute.

Résultats du test de vitesse Apify, run de 680 résultats

Score Vitesse : 3/5 — 74,32/min, correct mais bien derrière le mode base de lobstr.io

Évolutivité

À 74,32 résultats/min, Apify peut extraire environ ~3,2 M de résultats/mois en fonctionnement 24h/24, 7j/7.

Les runs concurrents sont inclus par défaut : 25 sur le forfait Free jusqu'à 256 sur Business, avec un module complémentaire à 5 $/run disponible au-delà.

En pratique, Apify monte en charge de la même façon que lobstr.io : plus de runs en parallèle, plus de débit.

Score Évolutivité : 4/5 — plafond de ~3,2 M/mois avec concurrence incluse par défaut, mais toujours en dessous des ~4,1 M/mois de lobstr.io

Support client

Apify propose un support via l'onglet Issues.

Apify ne fournit pas de support technique direct par chat en direct pour les Actors maintenus par la communauté. Les développeurs indépendants possédant ces outils sont responsables de leur propre maintenance et des demandes des utilisateurs.

Pour cet actor PagesJaunes, le temps de réponse moyen aux tickets est de 0,89 heure.

Apify affichant un temps de réponse moyen de 0,89 heure

Score Support : 5/5 — onglet Issues uniquement (Actor maintenu par la communauté), temps de réponse moyen aux tickets de 0,89 heure

Idéal pour : les utilisateurs qui veulent un scraper PagesJaunes simple avec une large couverture de données et un support solide. Il fournit un jeu de données propre de 36 champs en un seul mode, donc moins de réglages avant un run.

Le compromis : les tarifs restent fixes quand le volume augmente, pas d'extraction d'email, et la montée en charge reste surtout linéaire.


3. Piloterr

Note utilisateur : 4,8/5 (Capterra) · 3,6/5 (G2)

Catégorie Score
Données 1/5
Coût 3/5
Vitesse 3/5
Évolutivité 3/5
Facilité d'utilisation 1/5
Support 4/5
Global 2,5/5
Piloterr est une API de scraping basée sur des crédits, proposant des données de recherche PagesJaunes structurées, au sein d'une bibliothèque plus large de points de terminaison de scraping pour d'autres plateformes.
Page d'accueil Piloterr
Avantages Inconvénients
Serveur MCP disponible Aucune interface no-code, API/développeur uniquement
Aucun SDK, webhook, ou planification
Seulement 347 des 500 résultats étaient des entreprises uniques

Données

Richesse

L'endpoint de recherche PagesJaunes de Piloterr retourne 10 champs par entreprise.

Champs (10 au total)

Catégorie Champs
Identité & fiche id, name, url, activity, tags, description
Localisation address
Médias image_url
Avis & notes rating, reviews_count
Toujours vide Aucun

Aucun champ téléphone, email, ou site web sur cet endpoint.

Page Info ajoute 10 champs supplémentaires, dont le téléphone.

Champs Page Info (10 au total)

Catégorie Champs
Contact phone
Réseaux sociaux & web websites
Entreprise & juridique siren, forme_juridique, effectif_entreprise, creation_d_entreprise, autres_denominations
Détails commerciaux services, payment_methods
Toujours vide opening_hours

Toujours aucun email, sur aucun des deux endpoints.

Exclusif

Aucun trouvé.

À noter : la pagination a retourné des doublons. Sur 500 résultats collectés sur 25 pages, seulement 347 étaient des entreprises uniques (69,4 %).

Cela signifie qu'environ 3 résultats sur 10 étaient des répétitions d'une page à l'autre.

Score Données : 1/5 — 10 champs, aucun exclusif, aucune donnée de contact, et un problème de résultats en double.

Coût

Piloterr fonctionne sur un modèle d'abonnement basé sur des crédits. Aucune offre gratuite.

Forfaits tarifaires Piloterr
  1. À partir de 49 $/mois pour 18 000 crédits, 7 req/s
  2. À l'échelle → 249 $/mois pour 110 000 crédits, 15 req/s

Une fiche entreprise complète nécessite deux appels : la recherche pour la trouver, puis Page Info pour le détail.

Je n'ai compté que les 347 entreprises uniques, en retirant les doublons des 500 résultats bruts.

Pour ces 347 fiches complètes, le run a utilisé 372 crédits au total : 25 pour la recherche et 347 pour Page Info.

Cela revient à environ 1 072 crédits pour 1 000 résultats.

  1. À partir de ~2,92 $ pour 1 000 résultats
  2. À l'échelle → ~2,43 $ pour 1 000 résultats

Score Coût : 3/5 — le prix d'entrée est le 2e moins cher des quatre, mais le prix à l'échelle (2,43 $/1K) est plus élevé que ceux de lobstr.io et Apify, sans réelle remise à l'échelle

Facilité d'utilisation

La recherche PagesJaunes de Piloterr est API uniquement. Il n'y a aucune interface no-code pour cet endpoint.

Façons de lui donner un job

  1. Une URL de recherche PagesJaunes, passée en tant que paramètre query à l'API

Réglages avant scraping

Aucun. Il s'agit d'une simple requête GET par page.

Fonctionnalités marquantes

  1. Serveur MCP disponible
  2. API disponible

À garder en tête

Il n'y a aucun SDK, webhook, ou planification intégrée pour des runs récurrents.

Les exports sont en JSON brut uniquement, donc tout ce qui va au-delà nécessite votre propre traitement ou workflow de livraison.

Score Facilité d'utilisation : 1/5 — aucune interface no-code, aucun SDK, webhook, ou planification, et exports en JSON brut uniquement

Vitesse

Obtenir une fiche complète nécessite toujours deux appels : la recherche, puis Page Info.

372 appels (25 pour la recherche plus 347 pour Page Info) ont pris 1 214,82 secondes, soit environ 20,25 minutes.

Cela revient à environ 17,14 résultats par minute pour une fiche complète.

Score Vitesse : 3/5 — 17,14/min dépasse le mode enrichissement complet de lobstr.io et WebScraper.io, mais reste bien derrière Apify et le mode base de lobstr.io

Évolutivité

À 17,14 résultats/min pour une fiche complète, Piloterr pourrait théoriquement produire ~740 K résultats/mois en fonctionnement continu.

Piloterr n'a aucune concurrence intégrée. Monter en charge prend simplement plus de temps, de façon linéaire.

Score Évolutivité : 3/5 — le plafond de ~740 K/mois dépasse le mode enrichissement complet de lobstr.io et WebScraper.io, mais aucune concurrence pour aller plus loin

Support client

Piloterr propose un support par email (hello@piloterr.com) sur tous les forfaits, et un chat en direct spécifiquement sur le forfait à 249 $/mois.

Un avis G2 souligne également un support rapide.

Avis G2 soulignant le support de Piloterr

Score Support : 4/5 — deux canaux, avis positifs sur le support, mais le chat en direct nécessite le forfait à 249 $/mois

Idéal pour : les développeurs qui veulent des données de recherche PagesJaunes brutes via API et qui sont à l'aise pour gérer la déduplication et la pagination eux-mêmes. Pas fait pour ceux qui cherchent un workflow no-code.


4. WebScraper.io

Note utilisateur : N/A (0 avis sur G2, non répertorié sur Capterra)

Catégorie Score
Données 2/5
Coût 1/5
Vitesse 1/5
Évolutivité 2/5
Facilité d'utilisation 2/5
Support 2/5
Global 1,7/5
WebScraper.io est surtout connu pour son extension de navigateur point-and-click, mais cette évaluation se concentre sur le service d'automatisation hébergé.
Page produit WebScraper.io
Avantages Inconvénients
Contrôles de qualité des données Vitesse la plus lente
Import en masse disponible (jusqu'à 20 000 URL) Le plus cher
Contrôle de concurrence via des tâches parallèles Interface lourde
Nombre d'avis disponible sur seulement 39,2 % des entreprises

Données

Richesse

WebScraper.io retourne 10 champs de données par fiche. L'adresse arrive sous forme d'une seule chaîne non structurée, sans champ séparé pour la ville, le code postal, ou la rue.

Champs (10 au total)

Catégorie Champs
Identité & fiche business_url, business_id, business_name, category, description
Localisation address
Contact phone_number, website_url
Avis & notes rating, review_count
Toujours vide Aucun

Exclusif

Aucun trouvé.

Envie de vérifier les chiffres vous-même ?

Score Données : 2/5 — seulement 10 champs, zéro doublon sur l'ensemble du run, adresse non structurée, aucun champ exclusif

Coût

WebScraper.io fonctionne sur un modèle d'abonnement mensuel, avec un essai gratuit de 7 jours.

La tarification est basée sur des crédits d'URL, où 1 crédit = 1 page chargée par le scraper cloud, pas 1 résultat d'entreprise.

Forfaits tarifaires WebScraper.io

Mesuré dans ce test : 517 pages chargées → 472 fiches (1,0953 page/fiche).

Job de scraping WebScraper.io montrant les pages chargées et les fiches

Cela donne environ :

  1. À partir de 10,54 $ pour 1 000 fiches
  2. À l'échelle → 5,27 $ pour 1 000 fiches

À l'échelle, le coût est déterminé par les jobs en parallèle plutôt que par les crédits d'URL.

Score Coût : 1/5 — 10,54 $/5,27 $ pour 1K (dérivé des tests), le plus cher testé de loin, aucune offre gratuite

Facilité d'utilisation

WebScraper.io fonctionne d'abord par URL, mais le parcours semble plus technique que les autres.

Façons de lui donner un job

  1. URL PagesJaunes

Import en masse par collage de texte ou upload CSV, avec des modes Replace et Append

Import d'URL en masse WebScraper.io

Réglages avant scraping

WebScraper.io n'a aucun réglage de mise en forme des résultats, pas même un plafond clair de résultats ou de pages maximum.

À la place, il y a des réglages sur la façon dont le run s'exécute :

  1. Intervalle de requête et délai de chargement de page (ms), régule le rythme des requêtes, 2000 ms par défaut
  2. Driver, rendu complet (JavaScript) ou mode plus léger fetch-only
  3. Proxy, Datacenter ou Résidentiel, par pays
  4. Priorité, priorité de file d'attente pour le run
Réglages de scraping WebScraper.io

Chaque réglage ici demande de comprendre pourquoi il compte (type de proxy, rendu JS, rythme des requêtes), pas seulement quel résultat vous voulez.

Les choix avant scraping correspondent à la mécanique du scraper plutôt qu'à une décision métier comme plus de données ou plus de budget.

Fonctionnalités marquantes

  1. Parser : post-traitement intégré (regex, suppression HTML, colonnes virtuelles)
  2. Contrôle de qualité des données : vérifications automatiques des runs avec notifications email ou Cloud
  3. Export vers CSV, JSON, ou XLSX
  4. Livraison automatisée vers Dropbox, Google Sheets, Google Drive, Google Cloud Storage, Amazon S3, Azure Blob Storage
  5. API, webhooks, SDK PHP, et MCP disponibles

À garder en tête

La facturation se base sur les pages chargées, pas sur les résultats retournés. Sans contrôle « arrêter après X pages », les gros runs sont plus difficiles à plafonner ou à anticiper avec certitude.

Le parcours est réparti sur plusieurs onglets : Scrape, Schedule, Parser, Data Quality Control, Edit, Bulk Start URL Import, Tags.

Onglets du tableau de bord WebScraper.io

C'est désordonné.

Score Facilité d'utilisation : 2/5 — aucun contrôle de mise en forme des résultats, réglages techniques, parcours réparti sur de nombreux onglets

Vitesse

WebScraper.io est l'outil le plus lent testé : 472 résultats en 1 heure, 30 minutes, 3 secondes, soit environ 5,24 résultats par minute.

Résultats du test de vitesse WebScraper.io

Score Vitesse : 1/5 — 5,24/min, confirmé comme l'outil le plus lent testé

Évolutivité

À 5,24 résultats/min, cet outil peut collecter environ ~226 K résultats/mois en fonctionnement 24h/24, 7j/7.

La principale limite, c'est la vitesse. Au taux d'un seul run, les gros jobs avancent régulièrement, mais pas rapidement.

Les tâches parallèles aident sur le forfait Scale. Elles permettent de faire tourner plusieurs jobs à la fois, donc les gros volumes n'ont pas à voir leur temps d'attente augmenter de façon linéaire.

En pratique, c'est exploitable pour de grosses listes si vous avez accès à la concurrence. Sans elle, la patience fait partie du modèle tarifaire.

Score Évolutivité : 2/5 — plafond de ~226 K/mois, environ 14x plus bas que celui d'Apify

Support client

WebScraper.io propose des réponses IA pour les questions rapides, une documentation d'aide, et un support par email.

La présence tierce est faible : 0 avis sur G2, et non répertorié sur Capterra.

Absence d'avis G2 pour WebScraper.io

Score Support : 2/5 — email + réponses IA uniquement, aucun canal avec agent en direct, aucune présence d'avis tiers

Idéal pour : les utilisateurs déjà sur WebScraper.io qui veulent garder le scraping PagesJaunes dans le même workflow hébergé.

Il offre des outils utiles de nettoyage et de planification, mais il est lent, cher, et limité en données. Ce n'est pas le premier outil que je choisirais, sauf si votre équipe l'utilise déjà.


Le scraper qui n'a pas fait la liste

PhantomBuster

PhantomBuster est une plateforme cloud d'automatisation et de scraping de données, extrayant des données et automatisant des actions sur plus de 15 plateformes sans code.
Page produit PhantomBuster

PhantomBuster n'a pas fait la liste finale car il a échoué face à la protection CAPTCHA.

J'ai vérifié les instructions PagesJaunes de PhantomBuster, qui indiquent que le scraper nécessite un proxy basé en France.

Instructions PhantomBuster exigeant un proxy basé en France

J'ai configuré une localisation France, gardé la même IP fixe, et relancé le scraper avec la configuration recommandée.

Le second run a échoué avec la même erreur CAPTCHA et n'a retourné aucun résultat.

Run PhantomBuster échouant avec une erreur CAPTCHA

Puisque PhantomBuster n'a toujours pas pu réaliser un scraping basique après la configuration requise, je l'ai exclu de la liste finale.


FAQ

Quel est le meilleur scraper PagesJaunes pour la prospection par email ?

lobstr.io est le meilleur choix si la prospection par email compte.

C'est le seul outil de cette liste qui extrait les contacts email depuis les sites web des entreprises, même s'il ne réussit que sur 43 % des entreprises testées.

Que devraient rechercher les débutants dans un scraper PagesJaunes ?

Les débutants devraient privilégier une entrée par URL, des limites de résultats simples, un export CSV, et un bon support.

Si vous débutez dans le scraping, évitez les outils qui exigent une configuration API, une gestion de proxy, ou du code personnalisé juste pour obtenir une liste d'entreprises basique.

Les scrapers PagesJaunes no-code peuvent-ils remplacer un scraper sur mesure ?

Pour la plupart des cas d'usage professionnels, oui.

Si votre objectif est de collecter des leads, comparer des entreprises locales, ou exporter des données CSV propres, les outils no-code vous évitent ce travail. Vous n'avez pas besoin de maintenir des scripts, des relances, ou une infrastructure de scraping.

Un scraper sur mesure ne se justifie que si vous avez besoin d'un contrôle total sur la logique de scraping ou de champs très spécifiques.

Quel est le scraper PagesJaunes le moins cher à l'échelle ?

lobstr.io et Apify sont à égalité à 1,50 $ pour 1 000 résultats à l'échelle, mais lobstr.io inclut 46 champs avec email, tandis qu'Apify en inclut 36 sans aucun, ce qui fait de lobstr.io le meilleur rapport qualité-prix à ce tarif.

Le mode base plus léger de lobstr.io (moins de champs, pas de données de contact) descend à 0,50 $ pour 1 000 pour ceux qui n'ont pas besoin de cette profondeur supplémentaire.

WebScraper.io est le plus cher testé, à 10,54 $–5,27 $ pour 1 000, puisque sa tarification se base sur les pages chargées plutôt que sur les résultats. Piloterr se situe entre les deux, à 2,92 $–2,43 $ pour 1 000 pour une fiche complète.

Quel est le scraper PagesJaunes le plus rapide ?

Apify est le plus rapide, à 74,32 résultats par minute.

C'est l'extraction d'email qui ralentit lobstr.io. Sans elle, le niveau Collect Additional Details de lobstr.io (téléphone, données entreprise) tourne à 95,85/min, déjà devant Apify. Ajoutez l'extraction d'email, et il tombe à 9,44/min.

En mode base (aucun module complémentaire), lobstr.io est de loin le plus rapide des deux, à 428,57 résultats par minute.

Quel scraper PagesJaunes a les données d'avis les plus fiables ?

lobstr.io est le seul outil qui retourne un nombre d'avis pour chaque entreprise testée (100 %), y compris un 0 confirmé quand une entreprise n'en a réellement aucun. Apify ne retourne un décompte que pour 19,7 % des entreprises, WebScraper.io pour 39,2 %, et Piloterr pour 18,8 %. Pour le reste, impossible de savoir si l'entreprise n'a aucun avis ou si la donnée n'a simplement pas été capturée.

lobstr.io est aussi le seul outil qui retourne le texte des avis individuels (auteur, note, date), pas seulement un chiffre.


Conclusion

Et voilà pour ce comparatif complet. Si vous pensez que j'ai manqué une bonne option, n'hésitez pas à me contacter sur LinkedIn.

Related Articles

Related Squids