Meilleurs scrapers PagesJaunes 2026 [Édition No-Code + API]
(updated)
lobstr.io est le meilleur scraper PagesJaunes en 2026, testé sur les données, le coût, la facilité d'utilisation, l'évolutivité, la vitesse et le support. Il l'emporte sur le jeu de données le plus riche testé (46 champs, seul outil à extraire les emails), et la meilleure valeur à l'échelle, à égalité avec Apify à 1,50 $/1K mais avec 10 champs de plus. Apify est le second choix, avec 36 champs et 74,32 résultats/min, mais n'extrait pas les emails et ses tarifs ne baissent jamais avec le volume.
⚡ Résumé en 30 secondes
- J'ai testé quatre scrapers PagesJaunes sur les données, le coût, la facilité d'utilisation, l'évolutivité, la vitesse et le support.
- lobstr.io est le meilleur scraper PagesJaunes dans l'ensemble. Il retourne le jeu de données le plus riche testé (46 champs), c'est le seul outil qui extrait les emails, et il est le plus rapide en mode base (428,57/min) et offre la meilleure valeur à l'échelle. L'enrichissement complet (email inclus) fait chuter sa vitesse à 9,44/min, derrière les 74,32/min d'Apify.
- Apify est le meilleur second choix. Il retourne un jeu de données propre de 36 champs en un seul mode sans réglages à gérer, et offre la réponse support la plus rapide testée (0,89 heure). Le compromis : pas d'extraction d'email, et les tarifs ne baissent jamais avec le volume.
- Piloterr est une option API uniquement, pas un outil no-code. Il retourne 20 champs répartis sur deux appels distincts, à un coût et une vitesse dans la moyenne, mais nécessite du code pour être utilisé, tout simplement.
- WebScraper.io est l'outil le plus faible testé, sur tous les critères. Il ne retourne que 10 champs, il est le plus lent (5,24/min) et le plus cher (10,54 $–5,27 $/1K), et son fonctionnement est réparti sur plusieurs onglets techniques.
- PhantomBuster n'a pas fait la liste finale. Il a échoué face à la protection CAPTCHA, même après être passé par le proxy basé en France que ses propres instructions exigent.
Obtenir quelques résultats PagesJaunes, c'est facile.
Obtenir une liste propre et exploitable à l'échelle, sans code ni coûts surprises, voilà le vrai problème.
La plupart des outils de scraping qu'on trouve en ligne sont soit conçus pour les développeurs, soit peu fiables au-delà de quelques centaines de lignes, soit hors de prix dès qu'il faut du volume.

J'ai testé les meilleures options no-code pour vous éviter de passer par les mêmes essais-erreurs.
Voici ce qui fonctionne vraiment.
Comparaison rapide
| Critères | lobstr.io | Apify | Piloterr | WebScraper.io |
|---|---|---|---|---|
| Note utilisateur | 5/5 | 5/5 | 4,8 | N/A |
| Champs de données | 46 | 36 | 20 | 10 |
| Extraction d'email | ✅ | ❌ | ❌ | ❌ |
| Extraction de téléphone | ✅ | ✅ | ✅ | ✅ |
| Extraction de site web | ✅ | ✅ | ✅ | ✅ |
| Coordonnées géographiques | ✅ | ❌ | ❌ | ❌ |
| Texte d'avis individuel | ✅ | ❌ | ❌ | ❌ |
| Nombre d'avis sur chaque résultat | ✅ | ❌ | ❌ | ❌ |
| Données légales/entreprise | ✅ | ✅ | ✅ | ❌ |
| Coût par 1 000 (entrée) | 6,00 $ | 1,50 $ | 2,92 $ | 10,54 $ |
| Coût par 1 000 (échelle) | 1,50 $ | 1,50 $ | 2,43 $ | 5,27 $ |
| Offre gratuite | ✅ | ✅ | ❌ | ❌ |
| Vitesse (résultats/min) | 9 | 74 | 17 | 5 |
| Vitesse (pour 1 000 résultats) | 1 h 45 min 54 s | 13 min 27 s | 58 min 20 s | 3 h 10 min 47 s |
| Contrôle des résultats | Max résultats + max pages | Coût max par run | Aucune limite intégrée | Aucune limite de pages/résultats |
| Concurrence | ✅ | ✅ | ❌ | ✅ |
| Planification | ✅ | ✅ | ❌ | ✅ |
| Formats d'export | CSV, JSON, XLSX, JSONL | CSV, JSON, XLSX, XML, JSONL | JSON | CSV, JSON, XLSX |
| Webhook | ✅ | ✅ | ❌ | ✅ |
| Accès programmatique | API + SDK + CLI + MCP | API + SDK + MCP | API + MCP | API + SDK + MCP |
| Support client | Chat en direct + Email | Onglet Issues (maintenu par la communauté) | Email + chat en direct |
Comment les scores se comparent-ils ?
| Critère | lobstr.io | Apify | Piloterr | WebScraper.io |
|---|---|---|---|---|
| Données | 4/5 | 3/5 | 1/5 | 2/5 |
| Coût | 5/5 | 3/5 | 3/5 | 1/5 |
| Facilité d'utilisation | 5/5 | 3/5 | 1/5 | 2/5 |
| Vitesse | 4/5 | 3/5 | 3/5 | 1/5 |
| Évolutivité | 5/5 | 4/5 | 3/5 | 2/5 |
| Support | 4/5 | 5/5 | 4/5 | 2/5 |
| Global | 4,5/5 | 3,5/5 | 2,5/5 | 1,7/5 |
Chaque catégorie est notée sur 5 en fonction des résultats de test ci-dessous. Le score global est une moyenne simple des six catégories.
Dites-moi simplement lequel utiliser
| Si vous voulez... | Choisissez | Pourquoi |
|---|---|---|
| Les données les plus complètes, email inclus | lobstr.io | 46 champs, et c'est toujours le seul à vous donner une boîte mail à contacter. |
| La meilleure valeur à l'échelle | lobstr.io | Même prix qu'Apify par 1 000 résultats, vous obtenez juste dix champs de plus pour le même prix. |
| Les doublons gérés automatiquement | lobstr.io | Déduplication intégrée. Apify n'a pas d'équivalent, vous devrez nettoyer les doublons vous-même. |
| Téléphone et données entreprise à l'échelle | lobstr.io | 95,85/min — toujours plus rapide que les 74,32/min d'Apify, et monte jusqu'à ~4,1 M/mois. |
⚠️ Avertissement
Les informations de cette section sont fournies à titre purement informatif. Elles reflètent des sources publiquement accessibles et ma propre interprétation de celles-ci.
Elles ne constituent pas un conseil juridique et ne doivent pas être considérées comme tel. Les lois varient selon les juridictions et peuvent changer.
Pour toute question de conformité, d'usage des données, de contrats ou de risques spécifiques à une plateforme, consultez un professionnel du droit qualifié capable d'évaluer votre situation en détail.
Est-il légal de scraper PagesJaunes ?
Oui, c'est légal sous certaines conditions.

Pour la plupart des cas d'usage professionnels, comme la génération de leads, l'étude de marché ou l'analyse concurrentielle, vous restez largement dans ces limites.
Quelques points à garder en tête :
- Utilisez les données en interne, pas pour republier les fiches publiquement
- N'extrayez pas le catalogue complet
- Ne construisez pas un annuaire concurrent à partir des données scrapées
Pour aller plus loin :
Comment j'ai choisi les meilleurs scrapers PagesJaunes

À partir de là, j'ai réduit la comparaison à six critères :
- Données
- Coût
- Facilité d'utilisation
- Vitesse
- Évolutivité
- Support
Voici ce que j'ai vérifié pour chacun.
Données
Pour les données, j'ai compté combien de champs chaque outil retourne, lesquels sont exclusifs, et si la sortie est assez propre pour être utilisée sans nettoyage.

Coût
J'ai normalisé les tarifs en coût par 1 000 résultats et comparé les prix d'entrée de gamme avec les prix à l'échelle.

Facilité d'utilisation
Pour la facilité d'utilisation, j'ai examiné le parcours complet depuis le début.
Je voulais voir si chaque outil pouvait gérer plus qu'un scraping ponctuel : mise en place, entrées, contrôles d'exécution, exports, et jobs répétés.
J'ai évalué :
- Options d'entrée : pages de recherche, pages d'entreprise, ou listes en masse.
- Contrôles d'exécution : limites, planification, et réglages de scraping.
- Options d'export : téléchargements, livraison cloud, ou intégrations de workflow.
- Automatisation : API, webhooks, SDK, ou outils externes.
- Friction : réglages peu clairs, mise en place maladroite, ou travail manuel supplémentaire.
L'objectif était de juger chaque scraper comme un workflow répétable, pas seulement comme un export de données.

Vitesse
Pour la vitesse, j'ai effectué des tests chronométrés et converti chaque résultat en résultats par minute, puis normalisé le tout en minutes par 1 000 résultats afin que les chiffres soient faciles à comparer côte à côte.

Évolutivité
Pour l'évolutivité, j'ai converti la vitesse mesurée de chaque outil en plafond mensuel, en utilisant 43 200 min/mois (24h/24, 7j/7 pendant 30 jours).
Cela permet d'estimer combien de résultats chaque outil peut produire en un mois.
J'ai aussi noté si des contrôles de concurrence existent pour augmenter le débit, ou si la montée en charge reste surtout linéaire.

Support
J'ai aussi examiné le support client, car la fiabilité réelle d'un outil se révèle surtout dans sa façon de gérer les problèmes, pas seulement quand tout se passe bien.
Pour chaque outil, j'ai noté quels canaux de support existent réellement, comme le chat en direct, l'email, les tickets et la communauté.
Ensuite, j'ai vérifié ce qui est documenté : les temps de réponse quand ils sont publiés, et les avis tiers mentionnant l'expérience de support.

Ce que j'ai exclu et pourquoi
Après avoir défini les critères, j'ai listé tous les scrapers PagesJaunes que j'ai pu trouver via les résultats Google et les recommandations d'IA.

Ensuite, j'ai réduit la liste.
- Les extensions de navigateur et scrapers visuels ont été exclus car ils ne sont pas fiables à l'échelle. Ils peuvent fonctionner pour de petits jobs manuels, mais ils ont tendance à casser dès qu'il faut des scrapings répétables.
- Les applications de bureau à la mise en place peu fiable ont été exclues. Plusieurs outils ont échoué avant même le début des tests, soit au téléchargement, soit au lancement. Si un scraper ne s'installe pas proprement, il est difficile de le recommander pour un workflow répétable.
- Les dépôts GitHub abandonnés ont aussi été exclus. J'ai trouvé l-portet/yellow-scraper et Sorelz/PagesJaunes-Scraper, mais les deux semblaient anciens et non maintenus depuis des années.
- Les actors Apify peu utilisés ont aussi été écartés. Il existe plusieurs actors PagesJaunes communautaires sur Apify, j'ai donc choisi celui avec le plus d'utilisateurs pour cette comparaison. Ce n'est pas un signal parfait, mais c'est mieux que de choisir un actor fantôme au hasard.
La liste finale ne comprend que des outils accessibles, maintenus, et adaptés à une collecte de données PagesJaunes à l'échelle.
Les meilleurs scrapers PagesJaunes
| Critères | lobstr.io | Apify | Piloterr | WebScraper.io |
|---|---|---|---|---|
| Note utilisateur | 5/5 | 5/5 | 4,8 | N/A |
| Champs de données | 46 | 36 | 20 | 10 |
| Extraction d'email | ✅ | ❌ | ❌ | ❌ |
| Extraction de téléphone | ✅ | ✅ | ✅ | ✅ |
| Extraction de site web | ✅ | ✅ | ✅ | ✅ |
| Coordonnées géographiques | ✅ | ❌ | ❌ | ❌ |
| Texte d'avis individuel | ✅ | ❌ | ❌ | ❌ |
| Nombre d'avis sur chaque résultat | ✅ | ❌ | ❌ | ❌ |
| Données légales/entreprise | ✅ | ✅ | ✅ | ❌ |
| Coût par 1 000 (entrée) | 6,00 $ | 1,50 $ | 2,92 $ | 10,54 $ |
| Coût par 1 000 (échelle) | 1,50 $ | 1,50 $ | 2,43 $ | 5,27 $ |
| Offre gratuite | ✅ | ✅ | ❌ | ❌ |
| Vitesse (résultats/min) | 9 | 74 | 17 | 5 |
| Vitesse (pour 1 000 résultats) | 1 h 45 min 54 s | 13 min 27 s | 58 min 20 s | 3 h 10 min 47 s |
| Contrôle des résultats | Max résultats + max pages | Coût max par run | Aucune limite intégrée | Aucune limite de pages/résultats |
| Concurrence | ✅ | ✅ | ❌ | ✅ |
| Planification | ✅ | ✅ | ❌ | ✅ |
| Formats d'export | CSV, JSON, XLSX, JSONL | CSV, JSON, XLSX, XML, JSONL | JSON | CSV, JSON, XLSX |
| Webhook | ✅ | ✅ | ❌ | ✅ |
| Accès programmatique | API + SDK + CLI + MCP | API + SDK + MCP | API + MCP | API + SDK + MCP |
| Support client | Chat en direct + Email | Onglet Issues (maintenu par la communauté) | Email + chat en direct |
1. lobstr.io
Note utilisateur : 5/5 ⭐⭐⭐⭐⭐ (33 avis, Capterra)
| Catégorie | Score |
|---|---|
| Données | 4/5 |
| Coût | 5/5 |
| Vitesse | 4/5 |
| Évolutivité | 5/5 |
| Facilité d'utilisation | 5/5 |
| Support | 4/5 |
| Global | 4,5/5 |

| Avantages | Inconvénients |
|---|---|
| Seul outil avec extraction d'email | Plus lent qu'Apify une fois l'email inclus (9,44/min contre 74,32/min) |
| Seul outil avec des données d'avis, pas seulement un décompte | COMPANY HQ toujours vide |
| 46 champs en enrichissement complet, plus que tout autre outil testé | |
| Vitesse mesurée la plus rapide en mode base, ~428,57/min | |
| Coordonnées géographiques, moyens de paiement, produits, marques | |
| Import CSV en masse | |
| Concurrence ajustable via les Slots | |
| Support par chat en direct solide |
Données
Richesse
lobstr.io retourne jusqu'à 46 champs PagesJaunes, répartis sur trois niveaux selon les réglages activés.
Champs (46 au total)
| Catégorie | Champs |
|---|---|
| Identité & fiche | TITLE, ITEM ID, URL, REF, TAGS, ACTIVITY, DESCRIPTION |
| Localisation | FULL ADDRESS, STREET ADDRESS, ZIP CODE, CITY, LATITUDE, LONGITUDE |
| Contact | PHONE, ADDITIONAL PHONE, EMAIL, WEBSITE, EXTERNAL LINKS, FACEBOOK, INSTAGRAM |
| Entreprise & juridique | SIRET, SIREN, NAF CODE, RAISON SOCIAL, FORME JURIDIQUE, AUTRES DENOMINATIONS, COMPANY CREATION DATE, COMPANY SIZE, NOMBRE ETABLISSEMENTS, IS VERIFIED, LISTING TYPE |
| Détails commerciaux | SHOP TYPE, SHOP SIZE, PAYMENT METHODS, PRESTATIONS, PRODUCTS, BRANDS, ACCEPTS QUOTE REQUESTS, MULTI ACTIVITE, OPENING HOURS |
| Médias | IMAGE URL, IMAGES |
| Avis & notes | SCORE, RATINGS, REVIEWS |
| Toujours vide | COMPANY HQ |
Exclusif
| Catégorie | Champs |
|---|---|
| Identité & fiche | TAGS, LISTING TYPE |
| Localisation | STREET ADDRESS, LATITUDE, LONGITUDE |
| Contact | |
| Entreprise & juridique | COMPANY SIZE, NOMBRE ETABLISSEMENTS, AUTRES DENOMINATIONS |
| Détails commerciaux | SHOP TYPE, SHOP SIZE, PAYMENT METHODS, PRESTATIONS, PRODUCTS, BRANDS, ACCEPTS QUOTE REQUESTS |
| Avis & notes | SCORE, REVIEWS |
lobstr.io retourne aussi un nombre d'avis pour chaque entreprise testée (100 %), y compris un 0 confirmé quand il n'y en a aucun. Apify et WebScraper.io ne retournent un décompte que pour respectivement 19,7 % et 39,2 % des entreprises.
Envie de vérifier les chiffres vous-même ?
Coût
lobstr.io fonctionne sur un modèle d'abonnement mensuel, de 20 $/mois jusqu'à 500 $/mois.
- Offre gratuite disponible
- À partir de 2,00 $ pour 1 000 résultats
- À l'échelle → 0,50 $ pour 1 000 résultats

lobstr.io propose deux réglages d'enrichissement optionnels : Collect Additional Details et Collect Emails from Website. Activer les deux augmente le coût car vous obtenez plus de données par résultat.
Avec l'enrichissement activé :
- À partir de 6,00 $ pour 1 000 résultats
- À l'échelle → 1,50 $ pour 1 000 résultats

Score Coût : 5/5 — à égalité avec Apify à 1,50 $/1K à l'échelle, mais livre 46 champs email inclus contre 36 sans email pour Apify ; tombe à 0,50 $/1K sur le mode base plus léger
Facilité d'utilisation
lobstr.io garde un fonctionnement simple et pratique.
Façons de lui donner un job
- URL de recherche PagesJaunes
Vous pouvez aussi importer un CSV si vous voulez traiter plusieurs URL de recherche en masse.

Réglages avant scraping
- Plafond de résultats uniques
- Plafond de pages (combien de pages de résultats de recherche PagesJaunes lobstr.io est autorisé à parcourir)
- Réglage Collect Additional Details
- Réglage Collect Emails from Website
- Nombre de slots de traitement
- Résultats uniques uniquement
- Suppression des retours à la ligne

Le système de planification prend en charge les minutes, heures, jours, semaines et mois, avec gestion du fuseau horaire. Cela le rend pratique pour de la surveillance continue, pas seulement pour une extraction ponctuelle.

Fonctionnalités marquantes
- Arrêt des runs à tout moment
- Déduplication intégrée
- Import en masse par fichier
- Alertes webhook et email
- Exports vers CSV, JSON, Excel, JSONL, Sheets, S3, SFTP, ou email
- Support API, SDK Python, CLI, et MCP
Score Facilité d'utilisation : 5/5 — ensemble de réglages le plus complet, planification avec gestion du fuseau horaire, déduplication intégrée
Vitesse
La vitesse de lobstr.io dépend des réglages activés :
- Base (aucun réglage) : 500 résultats en 1 minute 10 secondes → ~428,57 résultats/min
- Collect Additional Details : 500 résultats en 5 minutes 13 secondes → ~95,85 résultats/min
- Collect Additional Details + Collect Emails from Website : 500 résultats en 52 minutes 57 secondes → ~9,44 résultats/min

Le compromis entre niveaux est direct : plus de données par résultat coûte plus de temps. La vitesse est ajustable via les Slots, qui permettent d'exécuter plus de travail en parallèle.
Score Vitesse : 4/5 — 428,57/min en mode base est le plus rapide testé, de loin, mais l'enrichissement complet tombe à 9,44/min, plus lent que le mode unique d'Apify à 74,32/min
Évolutivité
À la vitesse de base de 428,57 résultats/min, lobstr.io peut collecter environ ~18,5 M de résultats/mois en fonctionnement continu.
Ce plafond change selon la quantité de données supplémentaires collectées.
C'est le compromis : les données PagesJaunes de base montent très vite en charge, mais l'enrichissement ralentit le run.

En pratique, lobstr.io monte en charge avec les requêtes concurrentes.
Score Évolutivité : 5/5 — plafond le plus élevé testé (~18,5 M/mois, mode base) plus la concurrence des Slots, jusqu'à 20 en parallèle
Support client
lobstr.io propose un support via un chat en direct sur le site web, plus l'email.
Le support est l'une des choses que les utilisateurs saluent constamment. L'équipe est reconnue pour ses réponses rapides, ses réponses techniques, et son aide concrète quand quelque chose casse.

Score Support : 4/5 — chat en direct + email, les utilisateurs saluent spécifiquement le support dans les avis Capterra
Idéal pour : les équipes qui veulent les données PagesJaunes les plus riches sans construire un workflow d'enrichissement séparé.
C'est le meilleur généraliste ici : le plus rapide en scraping de base, le moins cher à l'échelle, le meilleur pour l'extraction d'email, le plus fiable sur les données d'avis, et le plus simple à exécuter de façon répétée.
Le compromis, c'est que l'enrichissement complet ralentit fortement, donc utilisez le mode approfondi quand la qualité compte plus que la vitesse.
2. Apify
Note utilisateur : 5/5 ⭐⭐⭐⭐⭐ (6 avis, Apify)
| Catégorie | Score |
|---|---|
| Données | 3/5 |
| Coût | 3/5 |
| Vitesse | 3/5 |
| Évolutivité | 4/5 |
| Facilité d'utilisation | 3/5 |
| Support | 5/5 |
| Global | 3,5/5 |

| Avantages | Inconvénients |
|---|---|
| Schéma le plus large en un seul mode, aucun réglage nécessaire | Pas d'import CSV en masse |
| Plusieurs formats d'export (CSV, JSON, XML, Excel, JSON Lines) | Pas d'extraction d'email |
| Réponse aux tickets rapide (0,89 h en moyenne) | Tarif fixe, le coût unitaire ne baisse jamais à l'échelle |
| Concurrence incluse par défaut | Nombre d'avis disponible sur seulement 19,7 % des entreprises |
Données
Richesse
Apify retourne 36 champs de données uniques.
L'export brut compte bien plus de colonnes (jusqu'à 176) car les données répétées, comme les liens externes, les horaires d'ouverture et les images, sont réparties sur plusieurs colonnes numérotées par entreprise.
Champs (36 au total)
| Catégorie | Champs |
|---|---|
| Identité & fiche | id, ref, url, raison_social, type, activite, multi_activite, description |
| Localisation | adresse, city, postal_code |
| Contact | tel, site_externe, instagram, facebook, linkedin, twitter, youtube, tiktok, minisite, pinterest, site_essentiel |
| Entreprise & juridique | NAF, forme_juridique, creation_date, employee_count, siren, siret, is_verified |
| Médias | image, images |
| Avis & notes | ratingValue, reviewCount, bestRating, worstRating |
| Horaires | opening_hours (7 jours) |
| Toujours vide | Aucun |
Exclusif
Champs que seul Apify possède :
| Catégorie | Champs |
|---|---|
| Contact | tiktok, minisite, site_essentiel |
| Avis & notes | bestRating, worstRating |
Apify n'a toujours pas d'extraction d'email. Si la prospection au-delà du téléphone fait partie de votre workflow, il vous faudra enrichir les données séparément.
Envie de vérifier les chiffres vous-même ?
Score Données : 3/5 — 36 champs, zéro doublon sur l'ensemble du run, 0 champ toujours vide, mais reviewCount ne se remplit que sur 19,7 % des entreprises, seulement 5 champs exclusifs, et aucune extraction d'email
Coût
Apify utilise un modèle de tarification abonnement mensuel + paiement au résultat.

- Offre gratuite disponible (5 $/mois de crédit plateforme)
- Tarif fixe → 1,50 $ pour 1 000 résultats
Le coût ne baisse pas avec l'échelle. Que vous scrapiez 1 000 ou 100 000 résultats, le tarif par résultat reste le même.
Score Coût : 3/5 — 1,50 $/1K fixe, aucune remise à l'échelle quand le volume augmente
Facilité d'utilisation
Apify garde une interface simple, et la majeure partie de la mise en place est directe.
Façons de lui donner un job
- URL de recherche PagesJaunes
- URL de fiches spécifiques
Il n'y a pas d'import CSV dans la configuration principale. Il faut à la place coller les URL de fiches PagesJaunes via Bulk edit.

Réglages avant scraping
- Coût maximum par run (pas de réglage direct de limite de lignes)

Fonctionnalités marquantes
- Planification et webhooks via Apify
- Export en JSON, CSV, Excel, XML, et JSON Lines
- Accès API avec SDK Python et JavaScript
- Serveur MCP disponible
À garder en tête
Limiter le scraping est la partie la moins intuitive. Il n'y a pas de réglage clair « max résultats/URL » dans la configuration principale.
À la place, vous plafonnez le run via un coût maximum par exécution, ce qui fonctionne, mais c'est moins naturel que de définir une simple limite de lignes.

Score Facilité d'utilisation : 3/5 — pas d'import CSV dans la configuration principale, limitation par coût au lieu d'un plafond de lignes direct
Vitesse
Apify a collecté 680 résultats PagesJaunes en 9 minutes 9 secondes (un run limité par le coût, puisqu'Apify n'a pas de contrôle fixe du nombre de lignes), soit environ ~74,32 résultats par minute.

Score Vitesse : 3/5 — 74,32/min, correct mais bien derrière le mode base de lobstr.io
Évolutivité
À 74,32 résultats/min, Apify peut extraire environ ~3,2 M de résultats/mois en fonctionnement 24h/24, 7j/7.
Les runs concurrents sont inclus par défaut : 25 sur le forfait Free jusqu'à 256 sur Business, avec un module complémentaire à 5 $/run disponible au-delà.
En pratique, Apify monte en charge de la même façon que lobstr.io : plus de runs en parallèle, plus de débit.
Score Évolutivité : 4/5 — plafond de ~3,2 M/mois avec concurrence incluse par défaut, mais toujours en dessous des ~4,1 M/mois de lobstr.io
Support client
Apify ne fournit pas de support technique direct par chat en direct pour les Actors maintenus par la communauté. Les développeurs indépendants possédant ces outils sont responsables de leur propre maintenance et des demandes des utilisateurs.
Pour cet actor PagesJaunes, le temps de réponse moyen aux tickets est de 0,89 heure.

Score Support : 5/5 — onglet Issues uniquement (Actor maintenu par la communauté), temps de réponse moyen aux tickets de 0,89 heure
Idéal pour : les utilisateurs qui veulent un scraper PagesJaunes simple avec une large couverture de données et un support solide. Il fournit un jeu de données propre de 36 champs en un seul mode, donc moins de réglages avant un run.
Le compromis : les tarifs restent fixes quand le volume augmente, pas d'extraction d'email, et la montée en charge reste surtout linéaire.
3. Piloterr
Note utilisateur : 4,8/5 (Capterra) · 3,6/5 (G2)
| Catégorie | Score |
|---|---|
| Données | 1/5 |
| Coût | 3/5 |
| Vitesse | 3/5 |
| Évolutivité | 3/5 |
| Facilité d'utilisation | 1/5 |
| Support | 4/5 |
| Global | 2,5/5 |

| Avantages | Inconvénients |
|---|---|
| Serveur MCP disponible | Aucune interface no-code, API/développeur uniquement |
| Aucun SDK, webhook, ou planification | |
| Seulement 347 des 500 résultats étaient des entreprises uniques |
Données
Richesse
L'endpoint de recherche PagesJaunes de Piloterr retourne 10 champs par entreprise.
Champs (10 au total)
| Catégorie | Champs |
|---|---|
| Identité & fiche | id, name, url, activity, tags, description |
| Localisation | address |
| Médias | image_url |
| Avis & notes | rating, reviews_count |
| Toujours vide | Aucun |
Aucun champ téléphone, email, ou site web sur cet endpoint.
Page Info ajoute 10 champs supplémentaires, dont le téléphone.
Champs Page Info (10 au total)
| Catégorie | Champs |
|---|---|
| Contact | phone |
| Réseaux sociaux & web | websites |
| Entreprise & juridique | siren, forme_juridique, effectif_entreprise, creation_d_entreprise, autres_denominations |
| Détails commerciaux | services, payment_methods |
| Toujours vide | opening_hours |
Toujours aucun email, sur aucun des deux endpoints.
Exclusif
Aucun trouvé.
À noter : la pagination a retourné des doublons. Sur 500 résultats collectés sur 25 pages, seulement 347 étaient des entreprises uniques (69,4 %).
Cela signifie qu'environ 3 résultats sur 10 étaient des répétitions d'une page à l'autre.
Score Données : 1/5 — 10 champs, aucun exclusif, aucune donnée de contact, et un problème de résultats en double.
Coût
Piloterr fonctionne sur un modèle d'abonnement basé sur des crédits. Aucune offre gratuite.

- À partir de 49 $/mois pour 18 000 crédits, 7 req/s
- À l'échelle → 249 $/mois pour 110 000 crédits, 15 req/s
Une fiche entreprise complète nécessite deux appels : la recherche pour la trouver, puis Page Info pour le détail.
Je n'ai compté que les 347 entreprises uniques, en retirant les doublons des 500 résultats bruts.
Pour ces 347 fiches complètes, le run a utilisé 372 crédits au total : 25 pour la recherche et 347 pour Page Info.
Cela revient à environ 1 072 crédits pour 1 000 résultats.
- À partir de ~2,92 $ pour 1 000 résultats
- À l'échelle → ~2,43 $ pour 1 000 résultats
Score Coût : 3/5 — le prix d'entrée est le 2e moins cher des quatre, mais le prix à l'échelle (2,43 $/1K) est plus élevé que ceux de lobstr.io et Apify, sans réelle remise à l'échelle
Facilité d'utilisation
La recherche PagesJaunes de Piloterr est API uniquement. Il n'y a aucune interface no-code pour cet endpoint.
Façons de lui donner un job
- Une URL de recherche PagesJaunes, passée en tant que paramètre query à l'API
Réglages avant scraping
Aucun. Il s'agit d'une simple requête GET par page.
Fonctionnalités marquantes
- Serveur MCP disponible
- API disponible
À garder en tête
Il n'y a aucun SDK, webhook, ou planification intégrée pour des runs récurrents.
Les exports sont en JSON brut uniquement, donc tout ce qui va au-delà nécessite votre propre traitement ou workflow de livraison.
Score Facilité d'utilisation : 1/5 — aucune interface no-code, aucun SDK, webhook, ou planification, et exports en JSON brut uniquement
Vitesse
Obtenir une fiche complète nécessite toujours deux appels : la recherche, puis Page Info.
372 appels (25 pour la recherche plus 347 pour Page Info) ont pris 1 214,82 secondes, soit environ 20,25 minutes.
Cela revient à environ 17,14 résultats par minute pour une fiche complète.
Score Vitesse : 3/5 — 17,14/min dépasse le mode enrichissement complet de lobstr.io et WebScraper.io, mais reste bien derrière Apify et le mode base de lobstr.io
Évolutivité
À 17,14 résultats/min pour une fiche complète, Piloterr pourrait théoriquement produire ~740 K résultats/mois en fonctionnement continu.
Piloterr n'a aucune concurrence intégrée. Monter en charge prend simplement plus de temps, de façon linéaire.
Score Évolutivité : 3/5 — le plafond de ~740 K/mois dépasse le mode enrichissement complet de lobstr.io et WebScraper.io, mais aucune concurrence pour aller plus loin
Support client
Piloterr propose un support par email (hello@piloterr.com) sur tous les forfaits, et un chat en direct spécifiquement sur le forfait à 249 $/mois.
Un avis G2 souligne également un support rapide.

Score Support : 4/5 — deux canaux, avis positifs sur le support, mais le chat en direct nécessite le forfait à 249 $/mois
Idéal pour : les développeurs qui veulent des données de recherche PagesJaunes brutes via API et qui sont à l'aise pour gérer la déduplication et la pagination eux-mêmes. Pas fait pour ceux qui cherchent un workflow no-code.
4. WebScraper.io
Note utilisateur : N/A (0 avis sur G2, non répertorié sur Capterra)
| Catégorie | Score |
|---|---|
| Données | 2/5 |
| Coût | 1/5 |
| Vitesse | 1/5 |
| Évolutivité | 2/5 |
| Facilité d'utilisation | 2/5 |
| Support | 2/5 |
| Global | 1,7/5 |

| Avantages | Inconvénients |
|---|---|
| Contrôles de qualité des données | Vitesse la plus lente |
| Import en masse disponible (jusqu'à 20 000 URL) | Le plus cher |
| Contrôle de concurrence via des tâches parallèles | Interface lourde |
| Nombre d'avis disponible sur seulement 39,2 % des entreprises |
Données
Richesse
WebScraper.io retourne 10 champs de données par fiche. L'adresse arrive sous forme d'une seule chaîne non structurée, sans champ séparé pour la ville, le code postal, ou la rue.
Champs (10 au total)
| Catégorie | Champs |
|---|---|
| Identité & fiche | business_url, business_id, business_name, category, description |
| Localisation | address |
| Contact | phone_number, website_url |
| Avis & notes | rating, review_count |
| Toujours vide | Aucun |
Exclusif
Aucun trouvé.
Envie de vérifier les chiffres vous-même ?
Score Données : 2/5 — seulement 10 champs, zéro doublon sur l'ensemble du run, adresse non structurée, aucun champ exclusif
Coût
WebScraper.io fonctionne sur un modèle d'abonnement mensuel, avec un essai gratuit de 7 jours.
La tarification est basée sur des crédits d'URL, où 1 crédit = 1 page chargée par le scraper cloud, pas 1 résultat d'entreprise.

Mesuré dans ce test : 517 pages chargées → 472 fiches (1,0953 page/fiche).

Cela donne environ :
- À partir de 10,54 $ pour 1 000 fiches
- À l'échelle → 5,27 $ pour 1 000 fiches
À l'échelle, le coût est déterminé par les jobs en parallèle plutôt que par les crédits d'URL.
Score Coût : 1/5 — 10,54 $/5,27 $ pour 1K (dérivé des tests), le plus cher testé de loin, aucune offre gratuite
Facilité d'utilisation
WebScraper.io fonctionne d'abord par URL, mais le parcours semble plus technique que les autres.
Façons de lui donner un job
- URL PagesJaunes
Import en masse par collage de texte ou upload CSV, avec des modes Replace et Append

Réglages avant scraping
WebScraper.io n'a aucun réglage de mise en forme des résultats, pas même un plafond clair de résultats ou de pages maximum.
À la place, il y a des réglages sur la façon dont le run s'exécute :
- Intervalle de requête et délai de chargement de page (ms), régule le rythme des requêtes, 2000 ms par défaut
- Driver, rendu complet (JavaScript) ou mode plus léger fetch-only
- Proxy, Datacenter ou Résidentiel, par pays
- Priorité, priorité de file d'attente pour le run

Chaque réglage ici demande de comprendre pourquoi il compte (type de proxy, rendu JS, rythme des requêtes), pas seulement quel résultat vous voulez.
Les choix avant scraping correspondent à la mécanique du scraper plutôt qu'à une décision métier comme plus de données ou plus de budget.
Fonctionnalités marquantes
- Parser : post-traitement intégré (regex, suppression HTML, colonnes virtuelles)
- Contrôle de qualité des données : vérifications automatiques des runs avec notifications email ou Cloud
- Export vers CSV, JSON, ou XLSX
- Livraison automatisée vers Dropbox, Google Sheets, Google Drive, Google Cloud Storage, Amazon S3, Azure Blob Storage
- API, webhooks, SDK PHP, et MCP disponibles
À garder en tête
La facturation se base sur les pages chargées, pas sur les résultats retournés. Sans contrôle « arrêter après X pages », les gros runs sont plus difficiles à plafonner ou à anticiper avec certitude.
Le parcours est réparti sur plusieurs onglets : Scrape, Schedule, Parser, Data Quality Control, Edit, Bulk Start URL Import, Tags.

C'est désordonné.
Score Facilité d'utilisation : 2/5 — aucun contrôle de mise en forme des résultats, réglages techniques, parcours réparti sur de nombreux onglets
Vitesse
WebScraper.io est l'outil le plus lent testé : 472 résultats en 1 heure, 30 minutes, 3 secondes, soit environ 5,24 résultats par minute.

Score Vitesse : 1/5 — 5,24/min, confirmé comme l'outil le plus lent testé
Évolutivité
À 5,24 résultats/min, cet outil peut collecter environ ~226 K résultats/mois en fonctionnement 24h/24, 7j/7.
La principale limite, c'est la vitesse. Au taux d'un seul run, les gros jobs avancent régulièrement, mais pas rapidement.
Les tâches parallèles aident sur le forfait Scale. Elles permettent de faire tourner plusieurs jobs à la fois, donc les gros volumes n'ont pas à voir leur temps d'attente augmenter de façon linéaire.
En pratique, c'est exploitable pour de grosses listes si vous avez accès à la concurrence. Sans elle, la patience fait partie du modèle tarifaire.
Score Évolutivité : 2/5 — plafond de ~226 K/mois, environ 14x plus bas que celui d'Apify
Support client
WebScraper.io propose des réponses IA pour les questions rapides, une documentation d'aide, et un support par email.
La présence tierce est faible : 0 avis sur G2, et non répertorié sur Capterra.

Score Support : 2/5 — email + réponses IA uniquement, aucun canal avec agent en direct, aucune présence d'avis tiers
Idéal pour : les utilisateurs déjà sur WebScraper.io qui veulent garder le scraping PagesJaunes dans le même workflow hébergé.
Il offre des outils utiles de nettoyage et de planification, mais il est lent, cher, et limité en données. Ce n'est pas le premier outil que je choisirais, sauf si votre équipe l'utilise déjà.
Le scraper qui n'a pas fait la liste
PhantomBuster

PhantomBuster n'a pas fait la liste finale car il a échoué face à la protection CAPTCHA.
J'ai vérifié les instructions PagesJaunes de PhantomBuster, qui indiquent que le scraper nécessite un proxy basé en France.

J'ai configuré une localisation France, gardé la même IP fixe, et relancé le scraper avec la configuration recommandée.
Le second run a échoué avec la même erreur CAPTCHA et n'a retourné aucun résultat.

Puisque PhantomBuster n'a toujours pas pu réaliser un scraping basique après la configuration requise, je l'ai exclu de la liste finale.
FAQ
Quel est le meilleur scraper PagesJaunes pour la prospection par email ?
lobstr.io est le meilleur choix si la prospection par email compte.
C'est le seul outil de cette liste qui extrait les contacts email depuis les sites web des entreprises, même s'il ne réussit que sur 43 % des entreprises testées.
Que devraient rechercher les débutants dans un scraper PagesJaunes ?
Les débutants devraient privilégier une entrée par URL, des limites de résultats simples, un export CSV, et un bon support.
Si vous débutez dans le scraping, évitez les outils qui exigent une configuration API, une gestion de proxy, ou du code personnalisé juste pour obtenir une liste d'entreprises basique.
Les scrapers PagesJaunes no-code peuvent-ils remplacer un scraper sur mesure ?
Pour la plupart des cas d'usage professionnels, oui.
Si votre objectif est de collecter des leads, comparer des entreprises locales, ou exporter des données CSV propres, les outils no-code vous évitent ce travail. Vous n'avez pas besoin de maintenir des scripts, des relances, ou une infrastructure de scraping.
Un scraper sur mesure ne se justifie que si vous avez besoin d'un contrôle total sur la logique de scraping ou de champs très spécifiques.
Quel est le scraper PagesJaunes le moins cher à l'échelle ?
lobstr.io et Apify sont à égalité à 1,50 $ pour 1 000 résultats à l'échelle, mais lobstr.io inclut 46 champs avec email, tandis qu'Apify en inclut 36 sans aucun, ce qui fait de lobstr.io le meilleur rapport qualité-prix à ce tarif.
Le mode base plus léger de lobstr.io (moins de champs, pas de données de contact) descend à 0,50 $ pour 1 000 pour ceux qui n'ont pas besoin de cette profondeur supplémentaire.
WebScraper.io est le plus cher testé, à 10,54 $–5,27 $ pour 1 000, puisque sa tarification se base sur les pages chargées plutôt que sur les résultats. Piloterr se situe entre les deux, à 2,92 $–2,43 $ pour 1 000 pour une fiche complète.
Quel est le scraper PagesJaunes le plus rapide ?
Apify est le plus rapide, à 74,32 résultats par minute.
En mode base (aucun module complémentaire), lobstr.io est de loin le plus rapide des deux, à 428,57 résultats par minute.
Quel scraper PagesJaunes a les données d'avis les plus fiables ?
lobstr.io est le seul outil qui retourne un nombre d'avis pour chaque entreprise testée (100 %), y compris un 0 confirmé quand une entreprise n'en a réellement aucun. Apify ne retourne un décompte que pour 19,7 % des entreprises, WebScraper.io pour 39,2 %, et Piloterr pour 18,8 %. Pour le reste, impossible de savoir si l'entreprise n'a aucun avis ou si la donnée n'a simplement pas été capturée.
lobstr.io est aussi le seul outil qui retourne le texte des avis individuels (auteur, note, date), pas seulement un chiffre.