Scraper les pages produit sur walmart.com
L’appel qui renvoie les pages produit de walmart.com aujourd’hui, avec les paramètres, les motifs et les modes d’échec lus dans le journal des requêtes depuis le 14 Aug 2026.
Mesuré sur Crawlbase
Taux de réussite sur chaque requête de chaque compte en August 2026 : 92.1%. Motifs, pays et échecs viennent du journal des requêtes depuis le 14 Aug 2026 ; 19.3% des appels réussis ont utilisé le token JavaScript et la réponse médiane a pris 12.2s.
Parmi les 20 sites e-commerce du Cookbook, walmart.com se place 19 sur 20 au taux de réussite ; la médiane de la catégorie est de 96.3%. Sa réponse médiane de 12.2s est plus lente que la médiane de la catégorie, 2.9s. 9 des 20 acceptent le token simple ; celui-ci seulement sur certaines pages.
L’appel
Les pages produit sont la forme que les comptes récupèrent le plus ici, avec le pays et le token qui réussissent le plus souvent. Remplacez le chemin fictif par une vraie URL produit du site.
curl "https://api.crawlbase.com/?token=YOUR_JS_TOKEN&url=https%3A%2F%2Fwww.walmart.com%2Fip%2Fexample-page%2F1234567"from crawlbase import CrawlingAPI api = CrawlingAPI({'token': 'YOUR_JS_TOKEN'}) r = api.get('https://www.walmart.com/ip/example-page/1234567') html = r['body']
const { CrawlingAPI } = require('crawlbase'); const api = new CrawlingAPI({ token: 'YOUR_JS_TOKEN' }); const r = await api.get('https://www.walmart.com/ip/example-page/1234567');
Les paramètres qui comptent
| Paramètre | Valeur | Pourquoi |
|---|---|---|
country | laisser vide | La plupart des appels réussis ne définissent aucun country (100%) et réussissent à 92.9%. |
javascript | utiliser le token JavaScript | Les appels avec le token JavaScript réussissent à 98.2% contre 91.3% pour le token simple, et 23.6% des appels l’utilisent. |
Motifs d’URL que les comptes récupèrent
| Motif | Part des réussites | Token JavaScript | Country | Paramètres de requête |
|---|---|---|---|---|
/ip/{slug}/{id} | 68.3% | 39.6% | aucun | classType, from, athbdg |
/ip/product/{id} | 25.0% | 0.0% | aucun | aucun |
/reviews/product/{id} | 6.8% | 0.0% | aucun | sort, page |
Les champs que vous obtenez
Une page produit porte en général un bloc ld+json Product avec le nom, le prix, la devise et la disponibilité, et les mêmes valeurs dans le balisage visible. Lisez d’abord le bloc ; il change moins souvent que la mise en page.
Ce qui casse, et la solution
Sur les échecs depuis le 14 Aug 2026, le site a répondu :
Lancez-la de façon planifiée
Un rafraîchissement de catalogue est une liste d’URL produit. Envoyez-la au Crawler avec un callback, laissez-le réguler les appels et réessayer ce que le site refuse, et lisez les résultats depuis le Cloud Storage. La réponse médiane sur ce site est de 12.2s.
Questions
Ai-je besoin d’un browser pour scraper walmart.com ?
Oui pour la plupart des pages. Les appels avec le token JavaScript réussissent à 98.2% tandis que ceux avec le token simple atteignent 91.3%.
Combien coûte une page walmart.com sur Crawlbase ?
4.5 crédits sans browser. walmart.com est dans le tier complexe ii.
Quel country dois-je définir pour walmart.com ?
Aucun n’est nécessaire : la plupart des appels réussis le laissent vide.