Crawling API.
Toute URL, entièrement rendue.
Envoyez n'importe quelle URL et récupérez le HTML entièrement rendu, via 140M d'IP résidentielles avec gestion anti-bot intégrée.
Ajoutez un scraper ou autoparse pour du JSON structuré, ou une capture d'écran.
Une URL en entrée. Du HTML ou du JSON en sortie.
La Crawling API, tapée en direct. Crawlez une page pour obtenir du HTML rendu, ou scrapez-la pour du JSON structuré. Survolez pour mettre en pause et lire.
Un seul endpoint, toute la pile en dessous.
Chaque partie difficile du crawl à grande échelle, prise en charge pour vous : un vrai navigateur, un réseau résidentiel et des défenses anti-bot franchies à chaque request.
Rendering JavaScript complet
Un vrai navigateur exécute la page, de sorte que le contenu chargé dynamiquement, le défilement infini et les single-page apps sont capturés, pas seulement le HTML initial.
140M d'IP résidentielles
Chaque request effectue une rotation d'IP résidentielle sur 30 zones géographiques, pour que vous atteigniez n'importe quel site comme un vrai visiteur local.
Blocages et CAPTCHA gérés
Les murs anti-bot, les CAPTCHA et les limites de débit sont franchis automatiquement. Rien à résoudre, rien à maintenir lorsqu'un site change.
Autoparse et scrapers
Obtenez le HTML entièrement rendu, ou ajoutez autoparse=true ou scraper=… pour renvoyer le titre, le contenu, les prix, les images et les liens en JSON.
Captures d'écran
Ajoutez screenshot=true pour capturer une image pleine page de la page rendue, stockée et prête à télécharger.
Asynchrone et cloud storage
Exécutez de façon asynchrone avec des webhooks et le crawler, et conservez chaque page crawlée dans le cloud storage. Voir la démo en direct.
Chaque request, entièrement paramétré.
Un seul endpoint, contrôlé par des paramètres de requête. Geotargeting, rendering, parsing, capture d'écran, stockage et session, le tout depuis le même appel.
De l'URL à la donnée en un seul appel.
Chaque request suit le même chemin. Vous envoyez une URL, nous gérons tout le reste.
Vous envoyez l'URL
Transmettez n'importe quelle URL avec votre token, ainsi que les paramètres dont vous avez besoin : pays, temps d'attente du rendering, parsing, captures d'écran ou stockage.
Nous effectuons la rotation d'un proxy
Une IP résidentielle et une zone géographique qui atteignent le site proprement, puisées parmi 140M d'IP réparties sur 30 régions.
Nous rendons la page
Un vrai navigateur charge la page pour que le JavaScript, le contenu dynamique et le défilement infini soient rendus avant la capture.
Nous franchissons les anti-bots
Les vérifications anti-bot, les CAPTCHA et les limites de débit sont gérés automatiquement. Rien à résoudre, rien à maintenir.
Nous renvoyons du HTML ou du JSON
Le HTML entièrement rendu revient, du JSON typé lorsque vous ajoutez un scraper ou autoparse, du Markdown propre lorsque vous le demandez, ou une image lorsque vous demandez une capture d'écran.
Ce que les équipes construisent sur la Crawling API.
Suivi des prix et des catalogues
Suivez les prix, les stocks et les annonces chez les distributeurs et sur les marketplaces, parsés en JSON à chaque crawl.
Suivi SERP et SEO
Crawlez les résultats de recherche et les pages concurrentes pour surveiller les classements, les snippets et le contenu à grande échelle.
Données d'entraînement et RAG
Alimentez des modèles, des pipelines RAG et des agents en pages rendues propres et en JSON structuré via une seule API.
Découverte de leads et de contacts
Crawlez annuaires, profils et annonces pour construire et enrichir vos pipelines.
Intelligence marché et contenu
Agrégez actualités, avis et données publiques pour orienter le produit, les prix et la stratégie.
N'importe quel site, une seule API
Crawlez n'importe quelle URL publique avec le même token, d'une seule page à des millions avec le crawler asynchrone.
Ajoutez les sites que vous crawlez, voyez le prix.
Ajoutez les sites que vous crawlez avec leur volume mensuel et leur type de request. Nous les regroupons par difficulté et par type, puis fixons le prix de chaque groupe selon son volume combiné, de sorte que plus vous crawlez, moins c'est cher.
Aucun site pour l'instant. Ajoutez-en un ci-dessus pour lancer votre estimation.
Jusqu'à 20,000 requests gratuites. Sans carte bancaire.
Commencer gratuitementVous crawlez plus d'1B par mois ? Contactez-nous →Bon à savoir.
Testez gratuitement
Jusqu'à 20,000 requests sont gratuites, sans carte bancaire. Le même token fonctionne sur la Crawling API et sur tous les scrapers.
Tarification simple, basée sur l'usage
Payez ce que vous crawlez, sans contrat à long terme, résiliable à tout moment. Consultez le détail complet sur la page des tarifs.
Entièrement documenté
Chaque paramètre et chaque réponse est couvert dans la documentation de la Crawling API, avec des exemples prêts à copier-coller pour chaque SDK.
Conforme au RGPD et au CCPA
Crawlbase applique des standards de protection des consommateurs à l'échelle mondiale, avec équité et transparence intégrées à la manière dont les données sont traitées.
Conçu pour crawler le web à grande échelle.
La Crawling API repose sur le même réseau qui sert plus de 46,000 clients payants et 70,000 développeurs. Aucun proxy à acheter, aucun navigateur à faire tourner, rien à corriger lorsqu'un site change.
Un token, des SDK officiels pour Node, Python, Ruby, PHP, Java, .NET et Go, et un réseau résidentiel en dessous.
Questions sur la Crawling API.
Commencez à crawler le web.
Oubliez les proxies et les blocages.
Gratuit pour démarrer avec jusqu'à 20,000 requests. Un seul token pour la Crawling API et tous les scrapers.