Crawling API / Yahoo

Yahoo Scraper.
Toute page, entièrement rendue.

Envoyez n'importe quelle URL Yahoo et récupérez le HTML entièrement rendu, via des proxies résidentiels avec gestion anti-bot intégrée.
Transformez-le en JSON avec le generic extractor.

99% de taux de réussite140M d'IP résidentielles30 zones géographiques
URL YahooHTML ou JSONwww.yahoo.com/news/sample-top-storyCrawlbaseRouterRenduExtraireHTML renduJSON structurécrawling-apigeneric-extractoryahoo.com · limite de débit reroutée · 200
Flux de crawl en direct · Yahoo1.24M req/minStreaming
200finance.yahoo.com/quote/AAPLNL128ms
200www.yahoo.com/news/election-results-live-093000456.htmlSG161ms
200www.yahoo.com/news/sample-top-story-120000123.htmlBR43ms
200finance.yahoo.com/news/fed-holds-rates-steady-110000321.htmlFR70ms
301www.yahoo.com/news/sample-top-story-120000123.htmlDE210ms
200finance.yahoo.com/quote/BTC-USDES122ms
200www.yahoo.com/lifestyle/sample-feature-073000789.htmlSG88ms
404search.yahoo.com/search?p=best+laptops+2026US174ms
200search.yahoo.com/search?p=best+laptops+2026IN68ms
200finance.yahoo.com/quote/MSFTJP84ms
200finance.yahoo.com/quote/BTC-USDNL114ms
200finance.yahoo.com/news/fed-holds-rates-steady-110000321.htmlCA140ms
200news.yahoo.com/world/ES162ms
200www.yahoo.com/news/election-results-live-093000456.htmlJP152ms
200finance.yahoo.com/quote/BTC-USDSG66ms
200finance.yahoo.com/quote/AAPLIN49ms
200www.yahoo.com/lifestyle/sample-feature-073000789.htmlGB42ms
200finance.yahoo.com/quote/BTC-USDUS49ms
200sports.yahoo.com/soccer/CA52ms
200www.yahoo.com/news/election-results-live-093000456.htmlSG43ms
200finance.yahoo.com/news/fed-holds-rates-steady-110000321.htmlFR188ms
404www.yahoo.com/lifestyle/sample-feature-073000789.htmlUS134ms
200www.yahoo.com/lifestyle/sample-feature-073000789.htmlBR200ms
404finance.yahoo.com/quote/AAPLAU125ms
200search.yahoo.com/search?p=best+laptops+2026GB84ms
200finance.yahoo.com/quote/TSLAGB196ms
200finance.yahoo.com/quote/AAPLNL128ms
200www.yahoo.com/news/election-results-live-093000456.htmlSG161ms
200www.yahoo.com/news/sample-top-story-120000123.htmlBR43ms
200finance.yahoo.com/news/fed-holds-rates-steady-110000321.htmlFR70ms
301www.yahoo.com/news/sample-top-story-120000123.htmlDE210ms
200finance.yahoo.com/quote/BTC-USDES122ms
200www.yahoo.com/lifestyle/sample-feature-073000789.htmlSG88ms
404search.yahoo.com/search?p=best+laptops+2026US174ms
200search.yahoo.com/search?p=best+laptops+2026IN68ms
200finance.yahoo.com/quote/MSFTJP84ms
200finance.yahoo.com/quote/BTC-USDNL114ms
200finance.yahoo.com/news/fed-holds-rates-steady-110000321.htmlCA140ms
200news.yahoo.com/world/ES162ms
200www.yahoo.com/news/election-results-live-093000456.htmlJP152ms
200finance.yahoo.com/quote/BTC-USDSG66ms
200finance.yahoo.com/quote/AAPLIN49ms
200www.yahoo.com/lifestyle/sample-feature-073000789.htmlGB42ms
200finance.yahoo.com/quote/BTC-USDUS49ms
200sports.yahoo.com/soccer/CA52ms
200www.yahoo.com/news/election-results-live-093000456.htmlSG43ms
200finance.yahoo.com/news/fed-holds-rates-steady-110000321.htmlFR188ms
404www.yahoo.com/lifestyle/sample-feature-073000789.htmlUS134ms
200www.yahoo.com/lifestyle/sample-feature-073000789.htmlBR200ms
404finance.yahoo.com/quote/AAPLAU125ms
200search.yahoo.com/search?p=best+laptops+2026GB84ms
200finance.yahoo.com/quote/TSLAGB196ms
01 Démo en direct

Une URL Yahoo en entrée. HTML ou JSON en sortie.

La Crawling API, tapée en direct. Récupérez le HTML rendu, ou passez au generic extractor pour du JSON. Survolez pour mettre en pause et lire.

prêt
touches 1-2 pour changer · cliquez pour mettre en pauseexécutez votre propre URL
Exécutez votre premier request en quelques minutes. Jusqu'à 10,000 requests gratuits, sans carte bancaire.Commencer gratuitement
02 Capacités

Une seule API, pour tout ce que Yahoo vous oppose.

Yahoo est un portail riche en JavaScript : les cours financiers et les fils d'actualité se chargent dynamiquement et la recherche est limitée en débit à grande échelle. La Crawling API le rend dans un vrai navigateur, l'atteint via des IP résidentielles et vous livre du HTML ou du JSON propre.

render

Rendu JavaScript complet

Un vrai navigateur exécute la page, de sorte que les fils d'actualité, les cours financiers et les résultats de recherche chargés dynamiquement sont tous capturés, pas seulement le HTML initial.

proxies

140M d'IP résidentielles

Chaque request fait tourner une IP résidentielle sur 30 zones géographiques, pour que vous atteigniez Yahoo comme un vrai visiteur local.

anti-bot

Blocages gérés pour vous

Les CAPTCHA, murs anti-bot et limites de débit sont franchis automatiquement. Rien à résoudre, rien à maintenir.

format

HTML ou JSON

Récupérez le HTML entièrement rendu, ou ajoutez scraper=generic-extractor pour renvoyer le titre, le contenu, les images et les liens sous forme de JSON structuré.

extras

Captures d'écran et asynchrone

Le même appel peut capturer une capture d'écran pleine page, ou s'exécuter de façon asynchrone avec des webhooks et du cloud storage.

one token

Une seule API pour chaque site

La Crawling API fonctionne sur n'importe quelle URL, donc le même token couvre Yahoo et tout le reste que vous crawlez. Voir la démo en direct.

03 Sortie

HTML rendu, ou JSON propre.

Par défaut, vous obtenez le HTML rendu. Ajoutez le generic-extractor et la même page revient sous forme de JSON typé.

{ "title": "Yahoo News, Finance and Search", "favicon": "https://s.yimg.com/rz/l/favicon.ico", "meta": { "description": "Latest news, finance and search from Yahoo.", "keywords": "..." }, "content": "News headlines, finance quotes, search results and links...", "canonical": "https://www.yahoo.com/news/sample-top-story-120000123.html", "images": [ "..." ], "og_images": [ "..." ], "links": [ "..." ] }

Page

title · string  canonical · string  favicon · string

Meta

meta.description · string  meta.keywords · string

Contenu

content · string

Média

images · array  og_images · array

Liens

links · array

04 Comment ça marche

De l'URL aux données en un seul appel.

Chaque request Yahoo suit le même chemin. Vous envoyez une URL, nous gérons tout ce qui se passe entre les deux.

01

Envoyez l'URL

Passez n'importe quelle URL Yahoo publique avec votre token : un article d'actualité, un cours financier, une recherche ou une page sport.

02

Faites tourner un proxy

Une IP résidentielle et une zone géographique qui atteignent Yahoo proprement, tirées de 140M d'IP sur 30 régions.

03

Rendez la page

Un vrai navigateur charge la page pour que les fils d'actualité, les cours financiers et les résultats de recherche soient rendus avant la capture.

04

Franchissez l'anti-bot

Les contrôles anti-bot de Yahoo et les limites de débit de recherche sont gérés automatiquement. Rien à résoudre, rien à maintenir.

05

Renvoyez du HTML ou du JSON

Le HTML entièrement rendu revient, ou du JSON typé lorsque vous ajoutez le generic extractor.

05 Cas d'usage

Ce que les équipes construisent avec les données Yahoo.

USE / 01Actualités

Surveillance des actualités

Suivez les titres et articles de Yahoo News sur différents sujets pour suivre les dernières actualités et leur couverture.

USE / 02Finance

Données financières et de cotation

Extrayez cotations, tickers et actualités financières de Yahoo Finance pour alimenter tableaux de bord et modèles.

USE / 03SERP

Recherche SERP et de classement

Crawlez les pages de résultats de Yahoo Search pour étudier les classements, la visibilité et la couverture des requêtes.

USE / 04Sentiment

Analyse de sentiment

Exploitez les textes d'actualité et de finance pour des signaux de sentiment sur les entreprises, les marchés et les sujets.

USE / 05Entraînement

Données d'entraînement et RAG

Alimentez vos modèles, pipelines RAG et agents en texte Yahoo propre via une seule API.

USE / 06Couverture

Toute URL, une seule API

Crawlez actualités, finance, recherche et sport sur Yahoo, ainsi que n'importe quel autre site dont vous avez besoin.

06 À noter

Bon à savoir pour scraper Yahoo.

Rendu comme un vrai navigateur

Yahoo est un portail riche en JavaScript ; la Crawling API exécute un vrai navigateur pour que les fils d'actualité, les cours financiers et les résultats de recherche se chargent avant la capture.

HTML par défaut, JSON à la demande

Vous obtenez le HTML entièrement rendu. Ajoutez scraper=generic-extractor pour un titre, un contenu, des images et des liens analysés, ou analysez le HTML vous-même.

La recherche à grande échelle

Yahoo Search est limité en débit et contrôlé par anti-bot à grande échelle ; la rotation des IP résidentielles et la gestion automatique de l'anti-bot font revenir les pages de résultats proprement.

Atteignez Yahoo depuis partout

Le géociblage sur 30 régions et 140M d'IP résidentielles garantit un accès constant aux actualités et à la finance localisées, sans gérer de proxies.

07 Pourquoi Crawlbase

Conçu pour crawler Yahoo à grande échelle.

La Crawling API s'appuie sur le même réseau qui sert plus de 46,000 clients payants et plus de 70,000 développeurs. Aucun proxy à acheter, aucun navigateur à faire tourner, rien à corriger quand Yahoo change.

99%
Taux de réussite moyen des requests
140M
IP résidentielles, plus 98M en datacenter
30
Zones géographiques pour des résultats locaux précis
20/s
Requests par seconde par défaut, plus sur demande

Un seul token, des SDK officiels pour Python, Node et Ruby, et un réseau à 99.99% de disponibilité en dessous.

08 FAQ

Questions sur le scraping de Yahoo.

Envoyez l'URL Yahoo à la Crawling API de Crawlbase avec votre token. Crawlbase fait tourner un proxy résidentiel, rend la page dans un vrai navigateur, franchit les contrôles anti-bot et renvoie le HTML entièrement rendu. Ajoutez scraper=generic-extractor pour obtenir du JSON structuré à la place.
Oui. Par défaut, la Crawling API renvoie du HTML rendu ; ajoutez le generic extractor (scraper=generic-extractor) pour recevoir titre, meta, contenu, images et liens en JSON, ou analysez le HTML vous-même.
Oui. Un vrai navigateur exécute la page, de sorte que les fils d'actualité, les cours financiers et les résultats de recherche chargés dynamiquement sont capturés, pas seulement le HTML initial.
Crawlbase achemine chaque request via des IP résidentielles en rotation sur 30 zones géographiques et franchit les contrôles anti-bot automatiquement. Vous ne gérez pas de proxies ni ne résolvez de CAPTCHA, et il n'y a rien à maintenir quand Yahoo modifie sa configuration.
Oui. Les pages de cotation et d'actualité financière chargent leurs chiffres dynamiquement ; un vrai navigateur les rend avant la capture, de sorte que les tableaux de cotation et les fils d'actualité reviennent dans le HTML ou en JSON.
N'importe quelle URL publique sur les propriétés Yahoo : articles d'actualité, cours et actualités financières, pages de résultats de recherche et sport. La même API fonctionne aussi sur n'importe quel autre site.
Commencez gratuitement avec jusqu'à 10,000 requests et sans carte bancaire. Les offres payantes évoluent avec l'usage, et le même token fonctionne sur la Crawling API et sur chaque scraper Crawlbase.

Commencez à scraper Yahoo.
Actualités, finance et recherche dans une seule API.

Gratuit pour démarrer avec jusqu'à 10,000 requests. Un seul token pour la Crawling API et chaque scraper.