DuckDuckGo Scraper.
Chaque résultat, entièrement rendu.
Envoyez n'importe quelle URL de résultats DuckDuckGo et récupérez le HTML entièrement rendu, via des proxys résidentiels avec gestion anti-bot intégrée.
Transformez-le en JSON avec le generic extractor.
Une URL DuckDuckGo en entrée. HTML ou JSON en sortie.
La Crawling API, tapée en direct. Obtenez le HTML rendu, ou passez au generic extractor pour du JSON. Survolez pour mettre en pause et lire.
Une seule API, pour tout ce que DuckDuckGo vous oppose.
DuckDuckGo rend ses résultats en JavaScript et déclenche des limites de débit et des contrôles anti-bot en volume. La Crawling API le rend dans un vrai navigateur, l'atteint via des IP résidentielles, et vous remet du HTML ou du JSON propre.
Rendu JavaScript complet
Un vrai navigateur exécute la page, si bien que les résultats organiques chargés dynamiquement, les titres, les snippets et les liens sont tous capturés, pas seulement la coquille initiale.
140M d'IP résidentielles
Chaque request fait tourner une IP résidentielle sur 30 zones géographiques, pour que vous atteigniez DuckDuckGo comme un véritable chercheur local et voyiez les classements locaux.
Les blocages gérés pour vous
Les CAPTCHA, les murs anti-bot et les limites de débit sont franchis automatiquement. Rien à résoudre, rien à maintenir.
HTML ou JSON
Obtenez le HTML entièrement rendu, ou ajoutez scraper=generic-extractor pour renvoyer le titre, le contenu, les images et les liens en JSON structuré.
Screenshots et asynchrone
Le même appel peut capturer un screenshot pleine page, ou s'exécuter de façon asynchrone avec des webhooks et du cloud storage.
Une seule API pour chaque site
La Crawling API fonctionne sur n'importe quelle URL, si bien que le même token couvre DuckDuckGo et tout le reste que vous crawlez. Voir la démo en direct.
HTML rendu, ou JSON propre.
Par défaut vous obtenez le HTML rendu. Ajoutez le generic-extractor et la même page revient en JSON typé.
Page
title · string canonical · string favicon · string
Meta
meta.description · string meta.keywords · string
Contenu
content · string
Média
images · array og_images · array
Liens
links · array
De l'URL aux données en un seul appel.
Chaque request DuckDuckGo suit le même chemin. Vous envoyez une URL, nous gérons tout ce qui se passe entre les deux.
Envoyez l'URL
Passez n'importe quelle URL publique de résultats DuckDuckGo avec votre token : une requête, l'endpoint HTML, une verticale ou une recherche filtrée.
Faites tourner un proxy
Une IP résidentielle et une zone géographique qui atteignent DuckDuckGo proprement, tirées de 140M d'IP sur 30 régions.
Rendez la page
Un vrai navigateur charge la page pour que les résultats organiques rendus en JavaScript, les titres et les snippets s'affichent avant la capture.
Franchissez l'anti-bot
Les limites de débit et les contrôles anti-bot de DuckDuckGo sont gérés automatiquement. Rien à résoudre, rien à maintenir.
Renvoyez du HTML ou du JSON
Le HTML entièrement rendu revient, ou du JSON typé lorsque vous ajoutez le generic extractor.
Ce que les équipes construisent sur les données DuckDuckGo.
Suivi de position par mot-clé
Crawlez une URL de résultats par requête et par zone géographique de façon planifiée pour suivre les positions et les changements de classement dans le temps.
Surveillance des SERP
Surveillez les pages de résultats pour repérer les nouveaux entrants, les changements de fonctionnalités et les mouvements sur les requêtes qui vous importent.
Recherche SEO
Extrayez les titres classés, les snippets et les URL de résultats pour étudier l'intention, les concurrents et les lacunes de contenu.
Découverte de leads & de liens
Faites remonter les domaines, les profils et les pages classés sur vos termes pour alimenter la prospection et la recherche de liens.
Données d'entraînement & RAG
Alimentez les modèles, les pipelines RAG et les agents avec du texte de résultats propre et des URL de résultats via une seule API.
N'importe quelle URL, une seule API
Crawlez les requêtes, l'endpoint HTML, les verticales et les filtres, ainsi que tout autre site dont vous avez besoin.
Bon à savoir pour scraper DuckDuckGo.
Rendu comme un vrai navigateur
DuckDuckGo charge ses résultats dynamiquement en JavaScript ; la Crawling API exécute un vrai navigateur pour que les résultats organiques s'affichent avant la capture.
HTML par défaut, JSON sur demande
Vous obtenez le HTML entièrement rendu. Ajoutez scraper=generic-extractor pour obtenir un titre, un contenu, des images et des liens parsés, ou parsez le HTML vous-même pour les titres de résultats, les snippets et les URL.
Localisez les résultats par région
Le géociblage choisit la région du proxy, pour que vous puissiez lire les classements tels qu'un chercheur d'un pays donné les verrait.
Atteignez DuckDuckGo depuis n'importe où
La rotation sur 30 régions et 140M d'IP résidentielles garantit un accès constant en volume sans gérer de proxys ni déclencher de limites de débit.
Conçu pour crawler DuckDuckGo à grande échelle.
La Crawling API tourne sur le même réseau qui sert plus de 46,000 clients payants et plus de 70,000 développeurs. Pas de proxys à acheter, pas de navigateurs à faire tourner, rien à corriger quand DuckDuckGo change.
Un seul token, des SDK officiels pour Python, Node et Ruby, et un réseau à 99.99% de disponibilité en dessous.
Questions sur le scraping de DuckDuckGo.
Commencez à scraper DuckDuckGo.
Suivez les classements sans les blocages.
Gratuit pour commencer avec jusqu'à 10,000 requests. Un seul token pour la Crawling API et chaque scraper.