Crawling API / Daum

Daum Scraper.
N'importe quelle page, entièrement rendue.

Envoyez n'importe quelle URL Daum et récupérez le HTML entièrement rendu, via des proxies résidentiels basés en Corée avec gestion anti-bot intégrée.
Transformez-le en JSON avec le generic extractor.

99% de taux de réussite140M IPs résidentielles30 zones géographiques
URL DaumHTML or JSONwww.daum.net/search?q=weatherCrawlbaseRoutageRenduExtractionHTML renduJSON structurécrawling-apigeneric-extractordaum.net · rate limit rerouté · 200
Feed de crawl en direct · Daum1.24M req/minStreaming
200sports.daum.net/team/12BR46ms
200search.daum.net/search?w=news&q=AIGB153ms
200search.daum.net/search?w=img&q=hanokUS44ms
200finance.daum.net/domestic/allGB69ms
200cafe.daum.net/subdued20clubAU44ms
200search.daum.net/search?w=img&q=hanokCA175ms
200search.daum.net/search?w=news&q=AIGB146ms
200search.daum.net/search?w=news&q=AIES97ms
200news.daum.net/v/20260626093015421CA119ms
404www.daum.net/search?q=weatherNL198ms
200sports.daum.net/team/12BR134ms
200www.daum.net/search?q=%EC%84%9C%EC%9A%B8+%EB%A7%9B%EC%A7%91CA92ms
200finance.daum.net/domestic/allGB91ms
200www.daum.net/search?q=weatherBR165ms
200www.daum.net/search?q=weatherAU135ms
200news.daum.net/v/20260625174208910BR77ms
200search.daum.net/search?w=news&q=AINL211ms
200www.daum.net/search?q=weatherIN146ms
200sports.daum.net/schedule/kboCA158ms
200finance.daum.net/exchangesCA56ms
200sports.daum.net/team/12SG77ms
200news.daum.net/economicSG197ms
404news.daum.net/v/20260625174208910US53ms
200search.daum.net/search?q=%EB%82%A0%EC%94%A8JP45ms
200finance.daum.net/exchangesDE40ms
200www.daum.net/search?q=%EC%9C%A0%EA%B0%80US150ms
200sports.daum.net/team/12BR46ms
200search.daum.net/search?w=news&q=AIGB153ms
200search.daum.net/search?w=img&q=hanokUS44ms
200finance.daum.net/domestic/allGB69ms
200cafe.daum.net/subdued20clubAU44ms
200search.daum.net/search?w=img&q=hanokCA175ms
200search.daum.net/search?w=news&q=AIGB146ms
200search.daum.net/search?w=news&q=AIES97ms
200news.daum.net/v/20260626093015421CA119ms
404www.daum.net/search?q=weatherNL198ms
200sports.daum.net/team/12BR134ms
200www.daum.net/search?q=%EC%84%9C%EC%9A%B8+%EB%A7%9B%EC%A7%91CA92ms
200finance.daum.net/domestic/allGB91ms
200www.daum.net/search?q=weatherBR165ms
200www.daum.net/search?q=weatherAU135ms
200news.daum.net/v/20260625174208910BR77ms
200search.daum.net/search?w=news&q=AINL211ms
200www.daum.net/search?q=weatherIN146ms
200sports.daum.net/schedule/kboCA158ms
200finance.daum.net/exchangesCA56ms
200sports.daum.net/team/12SG77ms
200news.daum.net/economicSG197ms
404news.daum.net/v/20260625174208910US53ms
200search.daum.net/search?q=%EB%82%A0%EC%94%A8JP45ms
200finance.daum.net/exchangesDE40ms
200www.daum.net/search?q=%EC%9C%A0%EA%B0%80US150ms
01 Démo en direct

N'importe quelle URL Daum en entrée. HTML ou JSON en sortie.

La Crawling API, tapée en direct. Récupérez le HTML rendu, ou passez au generic extractor pour du JSON. Survolez pour mettre en pause et lire.

ready
keys 1-2 switch · click to pauserun your own URL
Run your first request in minutes. Up to 20,000 free requests, no credit card.Commencer gratuitement
02 Capacités

Une seule API, pour tout ce que Daum vous oppose.

Daum est un portail coréen rendu en JavaScript dont les feeds de news et de recherche se chargent dynamiquement et sont géo-restreints à la Corée. La Crawling API le rend dans un vrai browser, le rejoint via des IPs résidentielles basées en Corée et vous remet du HTML ou du JSON propre.

rendu

Rendu JavaScript complet

Un vrai browser exécute la page, si bien que les titres de news, les résultats de recherche et les feeds du portail chargés dynamiquement sont tous capturés, pas seulement le HTML initial.

proxies

IPs résidentielles basées en Corée

Daum est géo-restreint à la Corée : chaque requête fait tourner une IP résidentielle basée en Corée, et vous atteignez le portail comme un vrai visiteur local.

anti-bot

Les blocages gérés pour vous

Les CAPTCHAs, murs anti-bot et limites de débit sont levés automatiquement. Rien à résoudre, rien à maintenir.

format

HTML ou JSON

Récupérez le HTML entièrement rendu, ou ajoutez scraper=generic-extractor pour renvoyer le titre, le contenu, les images et les liens en JSON structuré.

extras

Captures et asynchrone

Le même appel peut capturer une capture pleine page, ou tourner de façon asynchrone avec des webhooks et du cloud storage.

un seul token

Une seule API pour chaque site

La Crawling API fonctionne sur n'importe quelle URL : le même token couvre donc Daum et tout le reste de ce que vous crawlez. Voir la démo en direct.

03 Sortie

HTML rendu, ou JSON propre.

Par défaut, vous obtenez le HTML rendu. Ajoutez le generic-extractor et la même page revient sous forme de JSON typé.

{ "title": "Daum: news, search and mail", "favicon": "https://www.daum.net/favicon.ico", "meta": { "description": "Daum portal: news, search, mail and more.", "keywords": "..." }, "content": "Portal sections, news headlines, search results and links...", "canonical": "https://www.daum.net/", "images": [ "..." ], "og_images": [ "..." ], "links": [ "..." ] }

Page

title · string  canonical · string  favicon · string

Meta

meta.description · string  meta.keywords · string

Contenu

content · string

Média

images · array  og_images · array

Liens

links · array

04 Comment ça marche

De l'URL aux données en un seul appel.

Chaque requête Daum suit le même chemin. Vous envoyez une URL, nous exploitons tout ce qu'il y a entre les deux.

01

Envoyez l'URL

Passez n'importe quelle URL Daum publique avec votre token : la page d'accueil, un article de news, une page de résultats de recherche ou un cafe.

02

Faites tourner un proxy

Une IP résidentielle basée en Corée qui atteint Daum proprement, tirée de 140M IPs réparties sur 30 régions.

03

Rendez la page

Un vrai browser charge la page pour que les titres de news, les résultats de recherche et les feeds du portail soient rendus avant la capture.

04

Levez l'anti-bot

La géo-restriction, les vérifications anti-bot et les limites de débit de Daum sont gérées automatiquement. Rien à résoudre, rien à maintenir.

05

Renvoyez du HTML ou du JSON

Le HTML entièrement rendu revient, ou du JSON typé quand vous ajoutez le generic extractor.

05 Cas d'usage

Ce que les équipes construisent sur les données Daum.

USE / 01Corée

Étude du marché coréen

Suivez ce qui est tendance sur le portail, les news et les communautés cafe pour lire le marché coréen en temps réel.

USE / 02News

Veille de news

Surveillez les titres de news et les pages de recherche Daum pour suivre les sujets, la couverture et le sentiment dès leur apparition.

USE / 03Localisation

Localisation et QA

Rendez Daum comme un visiteur basé en Corée pour valider les pages localisées, le contenu régional et le comportement géo-restreint.

USE / 04Recherche

Données de portail et de SERP

Collectez les résultats de recherche, les sections et les liens Daum pour évaluer la visibilité et le classement sur le marché coréen.

USE / 05Finance

Feeds finance et sport

Récupérez les pages finance et sport pour les prix, les calendriers et les chiffres qui évoluent au fil de la journée.

USE / 06Couverture

N'importe quelle URL, une seule API

Crawlez la page d'accueil, les news, la recherche, le cafe et la finance, ainsi que tout autre site dont vous avez besoin.

06 Notes

Bon à savoir pour scraper Daum.

Rendu comme un vrai browser

Daum est un portail rendu en JavaScript ; la Crawling API exécute un vrai browser pour que les titres de news, les résultats de recherche et les feeds du portail se chargent avant la capture.

Géociblage Corée

Daum est géo-restreint à la Corée. Crawlbase fait tourner des IPs résidentielles basées en Corée pour que le portail se charge proprement, sans que vous ayez à acheter ou gérer des proxies.

HTML par défaut, JSON sur demande

Vous obtenez le HTML entièrement rendu. Ajoutez scraper=generic-extractor pour un titre, un contenu, des images et des liens parsés, ou parsez le HTML vous-même.

Pages publiques uniquement

La Crawling API lit les pages publiquement visibles, sans login, si bien que vous obtenez ce que voit un visiteur déconnecté en Corée.

07 Pourquoi Crawlbase

Conçu pour crawler Daum à grande échelle.

La Crawling API tourne sur le même réseau qui sert plus de 46,000 clients payants et plus de 70,000 développeurs. Pas de proxies à acheter, pas de browsers à faire tourner, rien à patcher quand Daum change.

99%
Taux de réussite moyen des requêtes
140M
IPs résidentielles, plus 98M en datacenter
30
Zones géographiques pour des résultats locaux précis
20/s
Requêtes par seconde par défaut, plus sur demande

Un seul token, des SDKs officiels pour Python, Node et Ruby, et un réseau à 99.99% de disponibilité en dessous.

08 FAQ

Questions sur le scraping de Daum.

Envoyez l'URL Daum à la Crawling API de Crawlbase avec votre token. Crawlbase fait tourner un proxy résidentiel basé en Corée, rend la page dans un vrai browser, lève les vérifications anti-bot et renvoie le HTML entièrement rendu. Ajoutez scraper=generic-extractor pour obtenir du JSON structuré à la place.
Oui. Par défaut, la Crawling API renvoie du HTML rendu ; ajoutez le generic extractor (scraper=generic-extractor) pour recevoir le titre, les meta, le contenu, les images et les liens en JSON, ou parsez le HTML vous-même.
Oui. Un vrai browser exécute la page, si bien que les titres de news, les résultats de recherche et les feeds du portail chargés dynamiquement sont capturés, pas seulement le HTML initial.
Daum est géo-restreint à la Corée : les requêtes doivent donc provenir d'une IP basée en Corée pour charger proprement. Crawlbase géocible la Corée et fait tourner des IPs résidentielles pour vous, si bien que vous atteignez Daum comme un visiteur local sans acheter ni gérer de proxies.
Crawlbase route chaque requête via des IPs résidentielles rotatives et lève les vérifications anti-bot automatiquement. Vous ne gérez pas de proxies et ne résolvez pas de CAPTCHAs, et il n'y a rien à maintenir quand Daum change sa configuration.
N'importe quelle URL publique du portail : la page d'accueil, les articles de news, les pages de résultats de recherche, le sport, la finance et les pages cafe. La même API fonctionne aussi sur tout autre site.
Commencez gratuitement avec jusqu'à 20,000 requêtes et sans carte bancaire. Les plans payants évoluent avec votre usage, et le même token fonctionne sur la Crawling API et sur chaque scraper Crawlbase.

Commencez à scraper Daum.
Atteignez la Corée sans les proxies.

Gratuit pour commencer avec jusqu'à 20,000 requêtes. Un seul token pour la Crawling API et chaque scraper.