Les pages de tarification des outils de scraping web ont tendance à enterrer la seule information que vous voulez vraiment connaître : qu'est-ce que cela me coûtera pour le travail que je vais faire ? Crawlbase répond à cela avec un modèle facile à appréhender une fois que vous en voyez les trois composantes mobiles : des requêtes gratuites pour commencer, un paiement uniquement pour les résultats qui arrivent, et un coût par requête qui s'adapte à la difficulté de crawl d'un site.

Ce guide explique comment fonctionne le modèle de tarification Crawlbase depuis ses principes fondamentaux : le forfait gratuit, pourquoi vous êtes facturé pour les requêtes réussies plutôt que pour les tentatives, comment les requêtes normales et JavaScript consomment des crédits différemment, ce que signifient les niveaux de complexité des domaines, et comment ce même modèle se décline sur la Crawling API, le Smart AI Proxy et Cloud Storage. Il évite délibérément de citer des chiffres en dollars, car ceux-ci se trouvent dans le calculateur en direct et la page de tarification où ils restent à jour ; l'objectif ici est de vous donner un modèle mental durable que vous pouvez utiliser pour estimer n'importe quel plan.

Commencez gratuitement, sans carte de crédit

Chaque compte Crawlbase commence avec jusqu'à 20 000 requêtes gratuites et sans carte de crédit requise. C'est suffisant pour intégrer la Crawling API dans un projet, faire passer quelques centaines de vraies pages, et confirmer que les données reviennent comme vous l'attendez avant qu'aucun argent ne change de mains. Vous ne passez à un plan payant qu'une fois que vous avez validé l'outil sur vos propres cibles, ce qui est l'ordre que la plupart des équipes préfèrent : valider d'abord, s'engager ensuite.

Lorsque vous passez à un plan payant, rien dans le modèle ne vous enferme. Les abonnements sont sans engagement, vous pouvez donc changer de plan ou arrêter entièrement quand votre volume change. Il n'y a pas de contrat annuel dans lequel vous devez vous développer ni de pénalité pour réduire après un mois chargé.

Vous payez pour les résultats, pas pour les tentatives. Un flux de requêtes entre dans Crawlbase ; seules celles qui reviennent sous forme de page livrée sont facturées. Les requêtes qui échouent ou sont bloquées passent sans consommer de requête payante, donc le coût que vous voyez correspond directement aux données que vous recevez effectivement.

Vous ne payez que pour les requêtes réussies

Le cœur du modèle est simple : une requête réussie correspond à une page livrée, et vous n'êtes facturé que pour celles-là. Un succès peut être du HTML simple ou une page entièrement rendue par JavaScript, mais dans les deux cas le trait distinctif est que le contenu est revenu. Si une requête échoue ou si le site cible la bloque avant qu'une page ne soit livrée, vous n'en êtes pas facturé.

Cela importe plus qu'il n'y paraît au premier abord. Le scraping à toute échelle réelle implique de gérer des sites qui résistent, et sur un modèle qui facture par tentative, chaque blocage, délai d'attente et relance gonfle silencieusement votre facture tout en ne vous donnant rien. Le paiement à la réussite inverse l'incitation. L'infrastructure qui relance, fait tourner les proxies et contourne les blocages se trouve du côté du fournisseur, et vous ne payez que lorsque cet effort produit effectivement une page. Votre coût suit les données que vous recevez plutôt que la difficulté à les obtenir.

Cela rend aussi la budgétisation honnête. Si vous avez besoin de 50 000 pages ce mois-ci, vous pouvez raisonner sur le coût en termes de 50 000 livraisons réussies plutôt que d'estimer un taux d'échec et d'arrondir votre estimation. Le chiffre sur lequel vous planifiez est le nombre de pages que vous voulez, pas le nombre de tentatives nécessaires pour les obtenir.

Comment les crédits sont consommés : requêtes normales versus JavaScript

Toutes les requêtes réussies ne coûtent pas le même nombre de crédits. Le premier levier est la façon dont la page doit être récupérée. Une requête normale récupère le HTML brut qu'un serveur envoie, ce qui suffit pour les sites qui livrent leur contenu directement dans la réponse initiale. Une requête JavaScript fait tourner la page dans un vrai environnement de navigateur pour que le contenu rendu par les scripts côté client (le genre que vous ne verriez autrement qu'après la fin du chargement de la page) soit présent dans ce qui revient.

Rendre une page dans un navigateur coûte plus cher que de récupérer du HTML statique, donc les requêtes JavaScript consomment plus de crédits que les requêtes normales. La recommandation pratique s'ensuit naturellement : utilisez des requêtes normales là où les données sont déjà dans le HTML, et optez pour le rendu JavaScript uniquement sur les sites qui en ont vraiment besoin. Si vous n'êtes pas sûr de ce qu'une cible requiert, notre guide sur comment crawler des sites web JavaScript explique comment faire la différence et quand le rendu vaut le coût supplémentaire.

Niveaux de complexité des domaines

Le second levier sur le coût est le site cible lui-même. Les sites web ne sont pas tous aussi difficiles à crawler : certains servent une page stable à quiconque la demande, tandis que d'autres utilisent des systèmes anti-bots en couches qui détectent et bloquent activement le trafic automatisé. Obtenir une page de manière fiable de ces derniers requiert bien plus d'infrastructure, donc Crawlbase regroupe les domaines en niveaux de complexité et fixe les prix des requêtes pour refléter les ressources que chaque niveau exige. Estimer vos coûts commence par savoir où se situent vos cibles.

Standard

Les domaines Standard ont des structures stables et une protection anti-bot minimale ou nulle. Ils sont simples à crawler, ne nécessitent aucun traitement spécial et sont servis efficacement avec une infrastructure standard, ce qui en fait la catégorie la plus rentable à requêter.

Modéré

Les domaines Modérés utilisent des mesures anti-bot légères ou dépendent d'un contenu dynamique rendu par JavaScript. Les crawler de manière fiable nécessite des couches de ressources supplémentaires et une gestion plus intelligente des requêtes pour maintenir des taux de succès stables, donc une requête sur un domaine Modéré coûte plus qu'une sur un site Standard.

Complexe

Les domaines Complexes détectent et bloquent activement le trafic automatisé en utilisant des techniques comme l'empreinte digitale de navigateur, la limitation de débit et les CAPTCHA. Obtenir une page de retour dépend d'une rotation adaptative des proxies, de stratégies de requêtes pilotées par l'IA et d'une infrastructure considérablement plus importante que ce que les sites Standard ou Modérés requièrent. Les domaines les plus fortement défendus, ceux qui investissent le plus dans le blocage des accès automatisés, se situent au sommet de cette gamme et nécessitent des modèles continuellement entraînés, des réseaux de proxies premium et une surveillance active pour rester fiables.

Fixe

Fixe est une catégorie spéciale pour les domaines qui nécessitent une configuration de crawl dédiée avec une tarification fixe. LinkedIn en est l'exemple principal. Les requêtes ici fonctionnent différemment du crawl standard : elles utilisent des bots IA entraînés qui imitent le comportement humain, se reposent uniquement sur des proxies résidentiels premium, et nécessitent souvent plusieurs tentatives par requête car les taux de succès sont intrinsèquement faibles. La structure à prix fixe existe précisément parce que ces domaines ne se comportent pas comme les catégories à niveaux ci-dessus.

Connaître le niveau de complexité d'une cible est le moyen le plus fiable d'estimer vos coûts de crawl avant de vous engager. La page de tarification et le calculateur de tarification sur le site vous permettent de combiner le type de requête et la complexité pour obtenir un chiffre mensuel concret pour votre propre utilisation.

Crawlbase Crawling API

C'est là que ce modèle prend vie. Vous envoyez une requête nommant la page que vous voulez, et Crawlbase gère le rendu JavaScript, la rotation des proxies et les CAPTCHA en coulisses, puis ne retourne la page que lorsqu'elle réussit. Vous payez pour les pages livrées, pas pour les tentatives échouées, et vous obtenez jusqu'à 20 000 requêtes gratuites sans carte de crédit.

Facturation mensuelle ou annuelle

Les plans peuvent être facturés mensuellement ou annuellement, et l'option annuelle est remisée par rapport au paiement mois par mois. Si votre scraping est un besoin stable et continu, le plan annuel abaisse votre coût effectif par requête ; si votre utilisation est saisonnière ou encore en cours d'évaluation, la facturation mensuelle vous garde flexible. Comme les abonnements sont sans engagement dans les deux cas, le choix concerne la cadence de facturation qui convient à votre trésorerie, pas un verrouillage.

Pour les chiffres actuels derrière les deux options, la page de tarification affiche les montants des niveaux en direct et la remise annuelle, et le calculateur transforme votre mix de requêtes prévu en estimation mensuelle. Ces chiffres sont intentionnellement tenus à jour en un seul endroit, c'est pourquoi cet article vous y renvoie plutôt que de citer des montants qui deviendraient obsolètes.

Un modèle commun à tous les produits

La même logique de requête réussie et de sensibilité à la complexité se décline sur toute la gamme de produits Crawlbase, de sorte que la comprendre une fois vous dit comment lire la tarification pour chaque outil.

Crawling API

La Crawling API est l'expression directe du modèle. Les niveaux de complexité des domaines s'y appliquent directement, les requêtes JavaScript coûtent plus que les requêtes normales, et vous n'êtes facturé que pour les pages livrées. C'est le bon point de départ pour la plupart des projets qui ont besoin de pages en HTML.

Smart AI Proxy et AI Proxy

Le Smart AI Proxy expose la même capacité de crawl via un endpoint de proxy standard, ce qui vous permet de router des outils existants via Crawlbase sans les réécrire pour appeler une API. Comme il fonctionne sur la même infrastructure de crawl, sa tarification reflète les mêmes coûts liés à la complexité sous-jacente. Si vous pesez une intégration de type proxy contre l'API, notre comparaison de pourquoi les équipes choisissent Crawlbase plutôt que des proxies bruts et des concurrents couvre les compromis.

Cloud Storage

Cloud Storage conserve les pages que vous crawlez pour que vous puissiez les récupérer à nouveau sans re-crawler. Il dispose de son propre forfait gratuit allant jusqu'à 10 000 documents stockés avec une rétention de 14 jours, ce qui est suffisamment généreux pour couvrir de nombreux projets entièrement. Au-delà, le stockage se développe sur son propre plan, séparé de vos dépenses de crawl.

Estimer votre coût et aller plus loin

En assemblant les pièces, une estimation Crawlbase se réduit à trois questions : de combien de pages avez-vous besoin, ces pages nécessitent-elles un rendu JavaScript, et à quel point les domaines cibles sont-ils défendus ? Multipliez les requêtes réussies prévues par le coût par requête pour votre type de requête et votre niveau de complexité, et vous obtenez un chiffre mensuel. Le calculateur sur le site fait exactement ce calcul pour vous, et la page de tarification contient les montants des niveaux en direct qui l'alimentent.

Si votre volume dépasse les niveaux publiés, ou si vous avez besoin d'un arrangement dédié pour une cible de haute complexité, vous pouvez contacter l'équipe pour des options à volume élevé et entreprise. Pour un contexte plus large sur le choix d'un service de scraping géré plutôt que de construire le vôtre, consultez nos guides sur le meilleur web scraper API en 2025 et comment scraper des sites web sans être bloqué.

Récapitulatif

Points clés

  • Commencez gratuitement, restez flexible. Chaque compte reçoit jusqu'à 20 000 requêtes gratuites sans carte de crédit, et les abonnements payants sont sans engagement, vous pouvez donc arrêter ou changer de plan à tout moment.
  • Vous payez pour les succès, pas pour les tentatives. Une requête réussie équivaut à une page livrée ; les requêtes échouées ou bloquées ne sont pas facturées, donc le coût suit les données que vous recevez effectivement.
  • Le type de requête change le coût. Les requêtes HTML normales consomment moins de crédits que les requêtes rendues par JavaScript, donc ne rendez que lorsqu'un site en a vraiment besoin.
  • La complexité du domaine fixe le tarif. Les domaines Standard, Modéré et Complexe coûtent progressivement plus cher, et les domaines Fixes comme LinkedIn utilisent une configuration dédiée avec une tarification fixe.
  • Un modèle, tous les produits. La même logique couvre la Crawling API, le Smart AI Proxy et Cloud Storage ; consultez la page de tarification et le calculateur pour les chiffres en direct et contactez l'équipe pour un volume plus élevé.

Foire aux questions

Crawlbase est-il gratuit à essayer ?

Oui. Chaque compte commence avec jusqu'à 20 000 requêtes gratuites et aucune carte de crédit n'est requise. C'est suffisant pour intégrer la Crawling API et faire passer de vraies pages pour confirmer qu'elle fonctionne sur vos propres cibles avant de payer quoi que ce soit.

Qu'est-ce qui compte comme une requête réussie ?

Une requête réussie est une page livrée, qu'il s'agisse de HTML simple ou d'une page entièrement rendue par JavaScript. Le trait distinctif est que le contenu est revenu. Les requêtes qui échouent ou sont bloquées avant qu'une page ne soit livrée ne sont pas facturées, donc vous ne payez que pour les pages que vous recevez effectivement.

Pourquoi les requêtes JavaScript coûtent-elles plus cher ?

Une requête normale récupère le HTML brut qu'un serveur retourne, tandis qu'une requête JavaScript fait tourner la page dans un vrai environnement de navigateur pour que le contenu rendu par scripts soit présent dans la réponse. Faire tourner un navigateur est plus gourmand en ressources que de récupérer du HTML statique, donc les requêtes JavaScript consomment plus de crédits. Utilisez-les uniquement sur les sites qui ont vraiment besoin d'un rendu.

Que sont les niveaux de complexité des domaines ?

Ce sont des catégories qui reflètent la difficulté de crawler un site. Les domaines Standard ont peu ou pas de protection anti-bot, les domaines Modérés utilisent des défenses légères ou du contenu dynamique, et les domaines Complexes utilisent des systèmes en couches comme l'empreinte digitale et les CAPTCHA qui nécessitent bien plus d'infrastructure pour être contournés. Fixe est une catégorie spéciale pour des domaines comme LinkedIn qui nécessitent une configuration dédiée avec une tarification fixe. Une requête coûte plus cher sur un domaine plus défendu.

Combien coûte un plan ?

Les montants des niveaux changent dans le temps et dépendent de votre type de requête et de la complexité de vos cibles, donc les chiffres actuels se trouvent sur la page de tarification et dans le calculateur sur le site plutôt que dans cet article. Entrez votre mix de requêtes prévu dans le calculateur et il retourne une estimation mensuelle ; la page de tarification affiche les montants des niveaux en direct et la remise annuelle.

Puis-je annuler à tout moment, et qu'en est-il des gros volumes ?

Oui. Les abonnements sont sans engagement, vous pouvez donc changer de plan ou arrêter quand vos besoins changent, sans contrat annuel requis. Si votre volume dépasse les niveaux publiés ou si vous avez besoin d'un arrangement dédié pour une cible de haute complexité, vous pouvez contacter l'équipe pour des options à volume élevé et entreprise.

Commencer à construire

Crawlez n'importe quel site à grande échelle, sans combattre l'infrastructure.

Crawlbase gère les proxies, les empreintes et les CAPTCHA afin que votre équipe livre des pipelines de données au lieu de maintenir la plomberie de crawl. 1 000 requêtes gratuites, sans carte requise.

En libre-service · Sans appel commercial requis · Volumes de crawl entreprise disponibles