Produit / Crawling API

Crawling API.
Toute URL, entièrement rendue.

Envoyez n'importe quelle URL et récupérez le HTML entièrement rendu, via 140M d'IP résidentielles avec gestion anti-bot intégrée.
Ajoutez un scraper ou autoparse pour du JSON structuré, ou une capture d'écran.

99% de taux de réussite140M d'IP résidentielles30 zones géographiques
URL quelconqueHTML · JSON · Imageany-website.com/any/pathCrawlbaseRouterRenduExtraireHTML renduJSON structuréCapture d'écrancrawling-apigeneric-extractorscreenshot=trueany-website.com · rendered · 200
Flux de crawl en direct1.24M req/minStreaming
200amazon.com/dp/B08N5WRWNWES104ms
200amazon.com/dp/B08N5WRWNWBR89ms
200linkedin.com/jobs/searchGB165ms
200glassdoor.com/Reviews/index.htmNL117ms
200stackoverflow.com/questions/11227809US78ms
404indeed.com/jobs?q=developerUS79ms
200ebay.com/itm/204512389011AU102ms
200github.com/crawlbaseGB72ms
200indeed.com/jobs?q=developerAU45ms
200amazon.com/dp/B08N5WRWNWNL168ms
200glassdoor.com/Reviews/index.htmGB145ms
200linkedin.com/jobs/searchBR136ms
200glassdoor.com/Reviews/index.htmBR70ms
200walmart.com/ip/55048794JP83ms
200amazon.com/dp/B08N5WRWNWJP210ms
200walmart.com/ip/55048794GB141ms
200indeed.com/jobs?q=developerBR54ms
200ebay.com/itm/204512389011IN219ms
200indeed.com/jobs?q=developerCA192ms
200ebay.com/itm/204512389011NL116ms
301producthunt.com/posts/notionDE71ms
200github.com/crawlbaseGB64ms
200stackoverflow.com/questions/11227809AU103ms
200tripadvisor.com/Restaurants-g60763NL188ms
200tripadvisor.com/Restaurants-g60763CA87ms
200linkedin.com/jobs/searchBR185ms
200amazon.com/dp/B08N5WRWNWES104ms
200amazon.com/dp/B08N5WRWNWBR89ms
200linkedin.com/jobs/searchGB165ms
200glassdoor.com/Reviews/index.htmNL117ms
200stackoverflow.com/questions/11227809US78ms
404indeed.com/jobs?q=developerUS79ms
200ebay.com/itm/204512389011AU102ms
200github.com/crawlbaseGB72ms
200indeed.com/jobs?q=developerAU45ms
200amazon.com/dp/B08N5WRWNWNL168ms
200glassdoor.com/Reviews/index.htmGB145ms
200linkedin.com/jobs/searchBR136ms
200glassdoor.com/Reviews/index.htmBR70ms
200walmart.com/ip/55048794JP83ms
200amazon.com/dp/B08N5WRWNWJP210ms
200walmart.com/ip/55048794GB141ms
200indeed.com/jobs?q=developerBR54ms
200ebay.com/itm/204512389011IN219ms
200indeed.com/jobs?q=developerCA192ms
200ebay.com/itm/204512389011NL116ms
301producthunt.com/posts/notionDE71ms
200github.com/crawlbaseGB64ms
200stackoverflow.com/questions/11227809AU103ms
200tripadvisor.com/Restaurants-g60763NL188ms
200tripadvisor.com/Restaurants-g60763CA87ms
200linkedin.com/jobs/searchBR185ms
01 Démo en direct

Une URL en entrée. Du HTML ou du JSON en sortie.

La Crawling API, tapée en direct. Crawlez une page pour obtenir du HTML rendu, ou scrapez-la pour du JSON structuré. Survolez pour mettre en pause et lire.

prêt
touches 1-2 pour changer · cliquez pour mettre en pauselancez votre propre URL
Lancez votre premier request en quelques minutes. Jusqu'à 20,000 requests gratuites, sans carte bancaire.Commencer gratuitement
02 Capacités

Un seul endpoint, toute la pile en dessous.

Chaque partie difficile du crawl à grande échelle, prise en charge pour vous : un vrai navigateur, un réseau résidentiel et des défenses anti-bot franchies à chaque request.

render

Rendering JavaScript complet

Un vrai navigateur exécute la page, de sorte que le contenu chargé dynamiquement, le défilement infini et les single-page apps sont capturés, pas seulement le HTML initial.

proxies

140M d'IP résidentielles

Chaque request effectue une rotation d'IP résidentielle sur 30 zones géographiques, pour que vous atteigniez n'importe quel site comme un vrai visiteur local.

anti-bot

Blocages et CAPTCHA gérés

Les murs anti-bot, les CAPTCHA et les limites de débit sont franchis automatiquement. Rien à résoudre, rien à maintenir lorsqu'un site change.

extract

Autoparse et scrapers

Obtenez le HTML entièrement rendu, ou ajoutez autoparse=true ou scraper=… pour renvoyer le titre, le contenu, les prix, les images et les liens en JSON.

capture

Captures d'écran

Ajoutez screenshot=true pour capturer une image pleine page de la page rendue, stockée et prête à télécharger.

scale

Asynchrone et cloud storage

Exécutez de façon asynchrone avec des webhooks et le crawler, et conservez chaque page crawlée dans le cloud storage. Voir la démo en direct.

03 Paramètres

Chaque request, entièrement paramétré.

Un seul endpoint, contrôlé par des paramètres de requête. Geotargeting, rendering, parsing, capture d'écran, stockage et session, le tout depuis le même appel.

token=PRIVATE_TOKEN
Requis. Votre token d'accès à l'API.
url=https://crawlbase.com/ip
Requis. Une URL à crawler.
country=US
Pays de localisation du proxy, +48 pays.
scraper=scraper-name
Crawler puis extraire avec un scraper.
screenshot=true
Capturer des screenshots du navigateur sous forme d'images.
format=html
Format de réponse : html, json ou md (Markdown).
store=true
Stocker vos données crawlées ou scrapées dans le cloud.
device=mobile
Crawler sur mobile ou sur desktop.
autoparse=true
La Crawling API peut autoparser n'importe quelle page web.
tor_network=true
Crawler des sites onion via le réseau Tor.

Voir tous les paramètres →

04 Comment ça marche

De l'URL à la donnée en un seul appel.

Chaque request suit le même chemin. Vous envoyez une URL, nous gérons tout le reste.

01

Vous envoyez l'URL

Transmettez n'importe quelle URL avec votre token, ainsi que les paramètres dont vous avez besoin : pays, temps d'attente du rendering, parsing, captures d'écran ou stockage.

02

Nous effectuons la rotation d'un proxy

Une IP résidentielle et une zone géographique qui atteignent le site proprement, puisées parmi 140M d'IP réparties sur 30 régions.

03

Nous rendons la page

Un vrai navigateur charge la page pour que le JavaScript, le contenu dynamique et le défilement infini soient rendus avant la capture.

04

Nous franchissons les anti-bots

Les vérifications anti-bot, les CAPTCHA et les limites de débit sont gérés automatiquement. Rien à résoudre, rien à maintenir.

05

Nous renvoyons du HTML ou du JSON

Le HTML entièrement rendu revient, du JSON typé lorsque vous ajoutez un scraper ou autoparse, du Markdown propre lorsque vous le demandez, ou une image lorsque vous demandez une capture d'écran.

05 Cas d'usage

Ce que les équipes construisent sur la Crawling API.

USE / 01Commerce

Suivi des prix et des catalogues

Suivez les prix, les stocks et les annonces chez les distributeurs et sur les marketplaces, parsés en JSON à chaque crawl.

USE / 02Recherche

Suivi SERP et SEO

Crawlez les résultats de recherche et les pages concurrentes pour surveiller les classements, les snippets et le contenu à grande échelle.

USE / 03IA

Données d'entraînement et RAG

Alimentez des modèles, des pipelines RAG et des agents en pages rendues propres et en JSON structuré via une seule API.

USE / 04Croissance

Découverte de leads et de contacts

Crawlez annuaires, profils et annonces pour construire et enrichir vos pipelines.

USE / 05Recherche

Intelligence marché et contenu

Agrégez actualités, avis et données publiques pour orienter le produit, les prix et la stratégie.

USE / 06Couverture

N'importe quel site, une seule API

Crawlez n'importe quelle URL publique avec le même token, d'une seule page à des millions avec le crawler asynchrone.

06 Tarifs

Ajoutez les sites que vous crawlez, voyez le prix.

Ajoutez les sites que vous crawlez avec leur volume mensuel et leur type de request. Nous les regroupons par difficulté et par type, puis fixons le prix de chaque groupe selon son volume combiné, de sorte que plus vous crawlez, moins c'est cher.

100k / mo

Aucun site pour l'instant. Ajoutez-en un ci-dessus pour lancer votre estimation.

Coût mensuel estimé
$0/ mo
≈ $0.00 moyen par 1,000 requests

Jusqu'à 20,000 requests gratuites. Sans carte bancaire.

Commencer gratuitementVous crawlez plus d'1B par mois ? Contactez-nous →
07 Notes

Bon à savoir.

Testez gratuitement

Jusqu'à 20,000 requests sont gratuites, sans carte bancaire. Le même token fonctionne sur la Crawling API et sur tous les scrapers.

Tarification simple, basée sur l'usage

Payez ce que vous crawlez, sans contrat à long terme, résiliable à tout moment. Consultez le détail complet sur la page des tarifs.

Entièrement documenté

Chaque paramètre et chaque réponse est couvert dans la documentation de la Crawling API, avec des exemples prêts à copier-coller pour chaque SDK.

Conforme au RGPD et au CCPA

Crawlbase applique des standards de protection des consommateurs à l'échelle mondiale, avec équité et transparence intégrées à la manière dont les données sont traitées.

08 Pourquoi Crawlbase

Conçu pour crawler le web à grande échelle.

La Crawling API repose sur le même réseau qui sert plus de 46,000 clients payants et 70,000 développeurs. Aucun proxy à acheter, aucun navigateur à faire tourner, rien à corriger lorsqu'un site change.

99%
Taux de réussite moyen des requests
46K+
Clients payants sur le réseau
30
Zones géographiques pour des résultats locaux précis
99.99%
Disponibilité du réseau

Un token, des SDK officiels pour Node, Python, Ruby, PHP, Java, .NET et Go, et un réseau résidentiel en dessous.

09 FAQ

Questions sur la Crawling API.

Une seule API REST qui crawle n'importe quelle URL via des proxies résidentiels dans un vrai navigateur, franchit les vérifications anti-bot et les CAPTCHA, et renvoie le HTML entièrement rendu. Ajoutez un scraper ou autoparse pour du JSON structuré, ou screenshot=true pour une image.
Oui. Un vrai navigateur exécute la page, de sorte que le contenu chargé dynamiquement, le défilement infini et les single-page apps sont capturés, pas seulement le HTML initial. Ajoutez ajax_wait ou page_wait pour les pages lentes.
Oui. Ajoutez scraper=generic-extractor pour du JSON universel, autoparse=true pour les sites populaires comme Amazon et Google, ou un scraper nommé pour un site spécifique. Sinon, vous obtenez le HTML entièrement rendu à parser vous-même.
Crawlbase route chaque request via des IP résidentielles en rotation sur 30 zones géographiques et franchit les vérifications anti-bot automatiquement. Vous ne gérez pas de proxies et ne résolvez pas de CAPTCHA, et il n'y a rien à maintenir lorsqu'un site modifie sa configuration.
Oui. Ajoutez screenshot=true et l'API capture une capture d'écran pleine page de la page rendue sous forme d'image, stockée pour vous pendant jusqu'à une heure.
Tous. La Crawling API est un simple endpoint REST, avec des SDK officiels pour Node, Python, Ruby, PHP, Java, .NET et Go, si bien qu'elle s'intègre à votre stack existante.
Commencez gratuitement avec jusqu'à 20,000 requests et sans carte bancaire. Les plans payants évoluent avec l'usage, et le même token fonctionne sur la Crawling API et sur tous les scrapers Crawlbase.

Commencez à crawler le web.
Oubliez les proxies et les blocages.

Gratuit pour démarrer avec jusqu'à 20,000 requests. Un seul token pour la Crawling API et tous les scrapers.