Scraper les pages sports sur sfchronicle.com
L’appel qui renvoie les pages sports de sfchronicle.com aujourd’hui, avec les paramètres, les motifs et les modes d’échec lus dans le journal des requêtes depuis le 14 Aug 2026.
Mesuré sur Crawlbase
Taux de réussite sur chaque requête de chaque compte en August 2026 : 99.7%. Motifs, pays et échecs viennent du journal des requêtes depuis le 14 Aug 2026 ; 17.8% des appels réussis ont utilisé le token JavaScript et la réponse médiane a pris 2.1s.
Parmi les 74 sites actualités et médias du Cookbook, sfchronicle.com se place 21 sur 74 au taux de réussite ; la médiane de la catégorie est de 98.9%. Sa réponse médiane de 2.1s est au niveau de la médiane de la catégorie, 2.3s. 58 des 74 acceptent le token simple ; celui-ci seulement sur certaines pages.
L’appel
Les pages d’article sont la forme que les comptes récupèrent le plus ici, avec le pays et le token qui réussissent le plus souvent. Remplacez le chemin fictif par une vraie URL d’article du site.
curl "https://api.crawlbase.com/?token=YOUR_TOKEN&url=https%3A%2F%2Fwww.sfchronicle.com%2Fsports"from crawlbase import CrawlingAPI api = CrawlingAPI({'token': 'YOUR_TOKEN'}) r = api.get('https://www.sfchronicle.com/sports') html = r['body']
const { CrawlingAPI } = require('crawlbase'); const api = new CrawlingAPI({ token: 'YOUR_TOKEN' }); const r = await api.get('https://www.sfchronicle.com/sports');
Les paramètres qui comptent
| Paramètre | Valeur | Pourquoi |
|---|---|---|
country | laisser vide | La plupart des appels réussis ne définissent aucun country (100%) et réussissent à 99.6%. |
javascript | laisser vide | Les appels avec le token simple réussissent à 99.8% et représentent 95.1% du trafic. Un browser coûte plus cher et, sur ce site, n’apporte rien. |
Motifs d’URL que les comptes récupèrent
| Motif | Part des réussites | Token JavaScript | Country | Paramètres de requête |
|---|---|---|---|---|
/sports | 24.0% | 0.0% | aucun | aucun |
/opinion | 23.8% | 0.0% | aucun | aucun |
/{slug} | 23.5% | 0.0% | aucun | aucun |
/entertainment | 23.5% | 0.0% | aucun | aucun |
/food/{slug}/{slug} | 3.8% | 100% | aucun | aucun |
Les champs que vous obtenez
Une page d’article porte un titre, une date et un auteur, en général dans un bloc ld+json Article, et le corps dans le HTML. Le bloc nomme souvent aussi la rubrique.
Ce qui casse, et la solution
Sur les échecs depuis le 14 Aug 2026, le site a répondu :
Lancez-la de façon planifiée
L’actualité bouge d’heure en heure. Interrogez la rubrique ou le sitemap pour les nouveaux liens, puis envoyez les URL d’articles au Crawler avec un callback pour que les récupérations soient régulées. La réponse médiane sur ce site est de 2.1s.
Questions
Ai-je besoin d’un browser pour scraper sfchronicle.com ?
Non. 99.8% des appels avec le token simple réussissent et les comptes envoient 95.1% de leur trafic sans browser.
Combien coûte une page sfchronicle.com sur Crawlbase ?
1 crédit sans browser. sfchronicle.com est dans le tier standard.
Quel country dois-je définir pour sfchronicle.com ?
Aucun n’est nécessaire : la plupart des appels réussis le laissent vide.