Scraper les articles sur patch.com

L’appel qui renvoie les articles de patch.com aujourd’hui, avec les paramètres, les motifs et les modes d’échec lus dans le journal des requêtes depuis le 14 Aug 2026.

99.7% de réussite · Aug 2026Browser sur 93% des appelsPrix Standard · 1 crédit

Mesuré sur Crawlbase

Taux de réussite sur chaque requête de chaque compte en August 2026 : 99.7%. Motifs, pays et échecs viennent du journal des requêtes depuis le 14 Aug 2026 ; 92.9% des appels réussis ont utilisé le token JavaScript et la réponse médiane a pris 25.6s.

Parmi les 74 sites actualités et médias du Cookbook, patch.com se place 20 sur 74 au taux de réussite ; la médiane de la catégorie est de 98.9%. Sa réponse médiane de 25.6s est plus lente que la médiane de la catégorie, 2.3s. 58 des 74 acceptent le token simple ; celui-ci seulement sur certaines pages.

L’appel

Les pages d’article sont la forme que les comptes récupèrent le plus ici, avec le pays et le token qui réussissent le plus souvent. Remplacez le chemin fictif par une vraie URL d’article du site.

Lancer dans le Playground
curl "https://api.crawlbase.com/?token=YOUR_TOKEN&url=https%3A%2F%2Fwww.patch.com%2Fexample-page%2Fexample-page%2Fexample-page"

Les paramètres qui comptent

ParamètreValeurPourquoi
countrylaisser videLa plupart des appels réussis ne définissent aucun country (100%) et réussissent à 99.7%.
javascriptlaisser videLes appels avec le token simple réussissent à 100%, ceux avec le token JavaScript à 99.7%. Les deux fonctionnent ; commencez sans browser et basculez par motif d’URL là où le tableau ci-dessous l’indique.

Motifs d’URL que les comptes récupèrent

MotifPart des réussitesToken JavaScriptCountryParamètres de requête
/{slug}/{slug}/{slug}3.0%83.3%aucunaucun
/south-dakota/{slug}/{slug}2.8%90.9%aucunaucun
/oklahoma/{slug}/{slug}2.8%90.9%aucunaucun
/illinois/{slug}/{slug}2.8%90.9%aucunaucun
/delaware/{slug}/{slug}2.8%90.9%aucunaucun
/alabama/{slug}/{slug}2.8%90.9%aucunaucun
/vermont/{slug}/{slug}2.5%90.0%aucunaucun
/texas/{slug}/{slug}2.5%90.0%aucunaucun

Les champs que vous obtenez

Une page d’article porte un titre, une date et un auteur, en général dans un bloc ld+json Article, et le corps dans le HTML. Le bloc nomme souvent aussi la rubrique.

Ce qui casse, et la solution

Sur les échecs depuis le 14 Aug 2026, le site a répondu :

504 : 100% des échecs Un 504 est un timeout : la page n’a pas fini de charger dans la limite. Réessayez une fois, et gardez le timeout de votre propre client au-dessus du temps de réponse médian affiché pour ce site.

Lancez-la de façon planifiée

L’actualité bouge d’heure en heure. Interrogez la rubrique ou le sitemap pour les nouveaux liens, puis envoyez les URL d’articles au Crawler avec un callback pour que les récupérations soient régulées. La réponse médiane sur ce site est de 25.6s.

Questions

Ai-je besoin d’un browser pour scraper patch.com ?

Cela dépend de la page. Les appels avec le token simple réussissent à 100%, ceux avec le token JavaScript à 99.7% ; le tableau des motifs d’URL montre quels chemins les comptes récupèrent avec un browser.

Combien coûte une page patch.com sur Crawlbase ?

1 crédit sans browser. patch.com est dans le tier standard.

Quel country dois-je définir pour patch.com ?

Aucun n’est nécessaire : la plupart des appels réussis le laissent vide.

Les noms de sites identifient les pages qu’une recette récupère. Crawlbase n’est affilié à aucun site listé. Utilisez les recettes dans le cadre de la politique d’utilisation acceptable.Chiffres mesurés de August 2026, actualisés chaque mois