Scraper les articles sur azcentral.com
L’appel qui renvoie les articles de azcentral.com aujourd’hui, avec les paramètres, les motifs et les modes d’échec lus dans le journal des requêtes depuis le 14 Aug 2026.
Mesuré sur Crawlbase
Taux de réussite sur chaque requête de chaque compte en August 2026 : 94.3%. Motifs, pays et échecs viennent du journal des requêtes depuis le 14 Aug 2026 ; 77.3% des appels réussis ont utilisé le token JavaScript et la réponse médiane a pris 32.4s.
Parmi les 74 sites actualités et médias du Cookbook, azcentral.com se place 62 sur 74 au taux de réussite ; la médiane de la catégorie est de 98.9%. Sa réponse médiane de 32.4s est plus lente que la médiane de la catégorie, 2.3s. 58 des 74 acceptent le token simple ; celui-ci seulement sur certaines pages.
L’appel
Les pages d’article sont la forme que les comptes récupèrent le plus ici, avec le pays et le token qui réussissent le plus souvent. Remplacez le chemin fictif par une vraie URL d’article du site.
curl "https://api.crawlbase.com/?token=YOUR_TOKEN&url=https%3A%2F%2Fwww.azcentral.com%2Fexample-page%2Fexample-page"from crawlbase import CrawlingAPI api = CrawlingAPI({'token': 'YOUR_TOKEN'}) r = api.get('https://www.azcentral.com/example-page/example-page') html = r['body']
const { CrawlingAPI } = require('crawlbase'); const api = new CrawlingAPI({ token: 'YOUR_TOKEN' }); const r = await api.get('https://www.azcentral.com/example-page/example-page');
Les paramètres qui comptent
| Paramètre | Valeur | Pourquoi |
|---|---|---|
country | laisser vide | La plupart des appels réussis ne définissent aucun country (99.6%) et réussissent à 93.0%. |
javascript | laisser vide | Les appels avec le token simple réussissent à 94.6%, ceux avec le token JavaScript à 92.1%. Les deux fonctionnent ; commencez sans browser et basculez par motif d’URL là où le tableau ci-dessous l’indique. |
Motifs d’URL que les comptes récupèrent
| Motif | Part des réussites | Token JavaScript | Country | Paramètres de requête |
|---|---|---|---|---|
/{slug}/{slug} | 25.3% | 79.2% | aucun | aucun |
/local/{slug} | 22.8% | 79.1% | aucun | aucun |
/politics/{slug} | 10.3% | 73.2% | aucun | aucun |
/business/{slug} | 8.5% | 82.4% | aucun | aucun |
/{slug}/{slug}/{slug} | 5.8% | 65.2% | aucun | aucun |
/arizona | 5.0% | 70.0% | aucun | aucun |
/{slug} | 4.3% | 88.2% | aucun | aucun |
/politics | 4.0% | 75.0% | aucun | aucun |
Les champs que vous obtenez
Une page d’article porte un titre, une date et un auteur, en général dans un bloc ld+json Article, et le corps dans le HTML. Le bloc nomme souvent aussi la rubrique.
Ce qui casse, et la solution
Sur les échecs depuis le 14 Aug 2026, le site a répondu :
Lancez-la de façon planifiée
L’actualité bouge d’heure en heure. Interrogez la rubrique ou le sitemap pour les nouveaux liens, puis envoyez les URL d’articles au Crawler avec un callback pour que les récupérations soient régulées. La réponse médiane sur ce site est de 32.4s.
Questions
Ai-je besoin d’un browser pour scraper azcentral.com ?
Cela dépend de la page. Les appels avec le token simple réussissent à 94.6%, ceux avec le token JavaScript à 92.1% ; le tableau des motifs d’URL montre quels chemins les comptes récupèrent avec un browser.
Combien coûte une page azcentral.com sur Crawlbase ?
1 crédit sans browser. azcentral.com est dans le tier standard.
Quel country dois-je définir pour azcentral.com ?
Aucun n’est nécessaire : la plupart des appels réussis le laissent vide.