Cloud Storage.
Chaque crawl conservé, aucun re-téléchargé.
Ajoutez store=true à n'importe quel crawl et Crawlbase conserve la page rendue, le JSON et les captures d'écran dans le cloud.
Récupérez par RID, lancez une recherche full-text, et oubliez la base de données, le bucket S3 et les sauvegardes.
Stockez avec un flag. Récupérez par RID.
Cloud Storage, tapé en direct. Stockez un crawl avec un seul paramètre, puis récupérez-le plus tard par son RID. Survolez pour mettre en pause et lire.
Un stockage conçu pour les crawls.
Conservez, retrouvez et récupérez vos données crawlées sans monter votre propre stockage.
Stockez avec un seul flag
Ajoutez store=true à n'importe quel appel Crawling API, ou pointez un Crawler vers le cloud storage, et la page rendue est conservée automatiquement.
Récupérez par RID
Chaque crawl stocké obtient un RID. Envoyez une requête GET avec celui-ci et la page revient directement, sans re-crawl requis.
Recherche full-text
Recherchez parmi tout ce que vous avez crawlé pour trouver les pages exactes dont vous avez besoin, sans parcourir votre propre base de données.
Pages et captures d'écran
Conservez le HTML rendu, le JSON structuré et les captures d'écran pleine page ensemble, tous récupérables par le même RID.
Mise à l'échelle gérée
Crawlbase gère la mise à l'échelle, les sauvegardes et le nettoyage de votre espace, pour que vous puissiez retirer le bucket S3 et la maintenance.
Cible du webhook Crawler
Utilisez le stockage comme cible de livraison pour le Crawler asynchrone Crawler, pour que les gros crawls arrivent prêts à être récupérés.
Un flag pour stocker, un appel pour récupérer.
Gardez votre crawl tel quel. Ajoutez un paramètre pour stocker, et un GET pour récupérer.
Ajoutez store=true
Crawlez n'importe quelle URL avec store=true, ou définissez le cloud storage comme cible du webhook de votre Crawler.
Nous stockons et indexons
La page rendue, le JSON et la capture d'écran sont stockés et indexés pour la recherche full-text, avec la mise à l'échelle gérée.
Enregistrez le RID
La réponse renvoie un RID de stockage qui identifie de manière unique la page que vous venez de conserver.
Récupérez ou recherchez
Envoyez un GET à l'endpoint de stockage avec le RID, recherchez parmi vos crawls, ou récupérez depuis le dashboard.
Ce que les équipes conservent dans Cloud Storage.
Un tampon pour votre stack
Faites atterrir les pages crawlées dans le stockage et récupérez-les dans votre entrepôt, index ou modèle selon votre propre calendrier.
Snapshots dans le temps
Conservez chaque crawl pour pouvoir comparer une page à différentes dates sans la crawler à nouveau.
Retrouvez parmi vos crawls
Lancez une recherche full-text sur tout ce qui est stocké pour localiser les pages et champs exacts dont vous avez besoin.
Retirez votre propre stockage
Abandonnez le bucket S3 et la base de données. Le stockage se met à l'échelle, se sauvegarde et se nettoie tout seul pour vous.
Corpus pour l'entraînement et le RAG
Construisez et re-récupérez de grands ensembles de pages propres pour l'entraînement et la retrieval directement depuis le stockage.
Livraison Crawler
Associez le stockage au Crawler pour que les crawls asynchrones à haut volume arrivent prêts à être récupérés.
Gratuit pour démarrer, économique à l'échelle.
Cloud Storage est gratuit pour les développeurs et peu coûteux pour les entreprises. Vous payez pour le volume de crawl, pas pour une base de données à gérer.
- 10k requests
- 14 jours de rétention
- Get API
- Delete API
- Bulk API
- 100k requests
- 30 jours de rétention
- Get API
- Delete API
- Bulk API
- 1M requests
- 30 jours de rétention
- Get API
- Delete API
- Bulk API
- Volume sur mesure
- Rétention sur mesure
- Get API
- Delete API
- Bulk API
Un stockage que vous n'avez pas à gérer.
Cloud Storage tourne sur le même réseau qui sert plus de 70,000 développeurs. Aucun S3 à provisionner, aucune base de données à sauvegarder, rien à nettoyer quand elle se remplit.
Ajoutez store=true une fois, et chaque crawl est conservé, indexé et prêt à être récupéré.
Questions sur Cloud Storage.
Conservez chaque page que vous crawlez.
Oubliez la base de données.
Gratuit pour commencer, stockez jusqu'à 10,000 documents pendant 14 days. Un seul token pour Cloud Storage et tous les produits.