Crawler.
Poussez des URLs, récupérez des données, en asynchrone à grande échelle.
Poussez des millions d'URLs vers une file push/pull gérée bâtie sur la Crawling API, et recevez les données rendues sur votre webhook ou dans le cloud storage.
Aucune file, retry ou proxy à faire tourner.
Poussez une URL. Recevez-la livrée.
Le Crawler, tapé en direct. Poussez une URL vers la file, puis recevez le résultat rendu sur votre webhook. Survolez pour mettre en pause et lire.
Crawling à grande échelle, files incluses.
Tout ce qui rend les gros crawls difficiles, pris en charge pour vous : une file asynchrone, les retries, la livraison et le monitoring, le tout par-dessus la Crawling API.
Push et pull asynchrones
Poussez autant d'URLs que vous le souhaitez et continuez. Crawlbase les met en file, les planifie et les rend en arrière-plan, pour que votre client ne bloque jamais.
Bâti sur la Crawling API
Chaque fonctionnalité de la Crawling API est conservée : rendering JavaScript, proxies résidentiels, geotargeting, paramètres et gestion anti-bot sur chaque request.
Livraison par webhook
Pointez le crawler vers votre endpoint et chaque résultat y est envoyé. Crawlbase surveille votre webhook pour que la livraison reste précise et fiable.
Cloud storage
Vous préférez le pull ? Gardez chaque page crawlée dans le cloud storage Crawlbase et récupérez-la selon votre propre rythme. Voir Cloud Storage.
Crawlers personnalisés, stats en direct
Nommez un crawler par charge de travail et suivez-le en temps réel. Consultez les stats via l'API, et mettez en pause ou reprenez selon votre budget.
Données fraîches, moins de retries
Chaque page est crawlée en direct, rien n'est mis en cache. Le système push/pull rapproche les taux de succès de 100%, si bien que les retries côté client disparaissent presque.
Migrez avec deux paramètres supplémentaires.
Gardez vos appels à la Crawling API. Ajoutez un callback et un nom de crawler, et vous voilà en asynchrone.
Créez un crawler
Ouvrez le dashboard Crawler, créez un crawler nommé et pointez-le vers votre webhook ou votre cloud storage.
Poussez les URLs
Appelez la Crawling API avec callback=true et crawler=YourCrawlerName, pour une URL ou des millions.
Nous mettons en file et rendons
Crawlbase planifie chaque request, fait tourner un proxy résidentiel, rend la page et retente les échecs.
Livrez le résultat
Chaque page rendue est envoyée à votre webhook ou écrite dans le cloud storage, en HTML ou en JSON structuré.
Récupérez et surveillez
Récupérez depuis le storage quand vous êtes prêt et suivez chaque crawler en direct, avec pause et reprise à la demande.
Ce que les équipes construisent avec le Crawler.
Des millions de pages
Poussez des catalogues entiers ou des sitemaps et laissez la file les traiter, sans planification côté client.
Des données dans votre stack
Livrez les pages rendues directement vers un webhook ou un storage, prêtes pour votre entrepôt, votre index ou votre modèle.
Monitoring continu
Re-crawlez les prix, les stocks et les annonces selon un planning, avec des données fraîches à chaque passage.
Corpus d'entraînement et RAG
Constituez de grands ensembles de pages propres pour l'entraînement et la récupération, tirés du storage en masse.
Quittez votre propre crawler
Remplacez votre système push/pull par le nôtre avec deux paramètres et laissez tomber les proxies, files et retries.
Des millions de sites
Crawlez sur des millions de sites pris en charge avec un seul crawler et un seul token.
Ajoutez les sites que vous crawlez, voyez le prix.
Ajoutez les sites que vous crawlez avec leur volume mensuel et leur type de request. Nous les regroupons par difficulté et par type, puis tarifons chaque groupe selon son volume combiné : plus vous crawlez, moins c'est cher.
Aucun site pour l'instant. Ajoutez-en un ci-dessus pour démarrer votre estimation.
Jusqu'à 10,000 requests gratuits. Sans carte bancaire.
Démarrer gratuitementVous crawlez plus d'1 milliard par mois ? Parlons-en →Bon à savoir.
Testez gratuitement
Jusqu'à 10,000 requests sont gratuits, sans carte bancaire. Le même token fonctionne sur le Crawler, la Crawling API et chaque scraper.
Tarification à l'usage
Payez ce que vous crawlez, sans contrat à long terme, annulez à tout moment. Mettez en pause et reprenez selon votre budget. Voir le détail complet sur la page tarifs.
Entièrement documenté
La création de crawlers, les callbacks et la livraison sont tous couverts dans la documentation du Crawler, avec des exemples à copier-coller.
Conforme GDPR et CCPA
Crawlbase applique les normes de protection des consommateurs à l'échelle mondiale, avec équité et transparence intégrées à la façon dont les données sont traitées.
Conçu pour crawler le web à grande échelle.
Le Crawler tourne sur le même réseau qui sert 70,000+ développeurs et les charges de crawling les plus exigeantes au monde. Aucune file à faire tourner, aucun proxy à acheter, rien à corriger quand un site change.
Un seul token sur le Crawler, la Crawling API et chaque scraper, avec livraison vers votre webhook ou votre storage.
Questions sur le Crawler.
Crawlez le web en asynchrone.
Poussez des URLs, nous livrons les données.
Gratuit au départ avec jusqu'à 10,000 requests. Un seul token pour le Crawler, la Crawling API et chaque scraper.