Vous n'avez plus besoin d'être programmeur pour automatiser un vrai travail. Scraper un site, traiter les données, et les transformer en résumé lisible nécessitait autrefois d'écrire un script ou d'engager quelqu'un pour le faire. Avec les bons outils, vous pouvez tout assembler vous-même sur un canevas visuel.
Ce guide vous montre comment construire un agent Amazon IA avec n8n et Crawlbase : un workflow qui prend un mot-clé produit, extrait les résultats de recherche Amazon publics via Crawlbase, les transmet à un modèle IA pour analyse, et vous envoie les insights par e-mail. Un formulaire collecte le mot-clé, la Crawling API récupère les annonces derrière un vrai navigateur et une IP de confiance, l'IA résume les tendances et les prix, et le résultat arrive dans une boîte mail. C'est une boucle automatisée propre qui s'exécute sans que vous n'ayez à surveiller un scraper ou un pool de proxys.
Ce que fait l'agent et à qui il s'adresse
Chaque nœud a une seule tâche. Le déclencheur de formulaire collecte un mot-clé et les coordonnées du destinataire, Crawlbase récupère les annonces Amazon sous forme de données structurées propres, un nœud switch réessaie sur une requête échouée, le modèle IA rédige l'analyse, et un nœud e-mail la livre. Câblé ensemble, le workflow transforme "qu'est-ce qui se vend pour ce mot-clé" en un résumé dans votre boîte mail quelques secondes plus tard.
C'est utile pour les chercheurs de produits qui évaluent une niche, les équipes e-commerce qui suivent les concurrents, les agences qui valident une catégorie, ou quiconque préfère lire un court brief plutôt que de faire défiler manuellement des annonces. Le même pattern couvert dans l'automatisation de la recherche de produits e-commerce s'applique ici ; c'est la version spécifique à Amazon.
Scraper Amazon de manière responsable
Avant tout code, la limite. Ce workflow est limité aux données produits Amazon publiques : les titres, prix, notes, nombres d'avis et statuts Prime que tout le monde peut voir sur une page de résultats de recherche sans se connecter. Lisez cette section avant de pointer l'agent sur un volume de production.
Les conditions d'utilisation d'Amazon restreignent l'accès automatisé, donc le scraping peut aller à l'encontre de ces conditions peu importe le soin apporté à votre outillage. Rien dans cette configuration ne change cela ; cela rend simplement la partie technique fonctionnelle. Quelques lignes à respecter : collectez uniquement les données d'annonces publiques, respectez le robots.txt d'Amazon et ses attentes de débit, et maintenez le volume de requêtes suffisamment bas pour ne pas surcharger les serveurs de personne. Si vous prévoyez de réutiliser les données commercialement, obtenez une permission ou un accord de données officiel plutôt que de supposer que le silence vaut consentement.
Ce que ce guide ne couvre pas, délibérément : tout ce qui est derrière une connexion, les données de compte ou de commande, les données personnelles liées à des acheteurs ou évaluateurs identifiables, tout contournement d'authentification, et toute action d'achat ou de compte. Si votre projet a besoin de plus que des annonces publiques, la bonne démarche est une API Amazon officielle ou un accord de données, pas un scraper plus habile.
La ligne qui rend ce travail défendable est le mur de connexion. Tout ce que cet agent lit est visible pour n'importe quel visiteur anonyme sur une page de recherche. Dès qu'une tâche nécessite un compte, un historique de commandes, ou les données personnelles d'un acheteur, elle est hors portée ici et appartient derrière une API officielle ou un accord de données.
Ce dont vous avez besoin avant de commencer
Mettez ces éléments en place en premier et le reste de la construction avance rapidement :
- Un compte et un token Crawlbase. C'est ce qui récupère les résultats Amazon. Après vous être inscrit, copiez votre token Normal depuis le tableau de bord. Crawlbase ne facture pas les requêtes échouées, ce sur quoi la logique de réessai s'appuie.
- Une instance n8n. Auto-hébergée ou n8n Cloud fonctionnent tous les deux ; c'est là que vous câblez les nœuds ensemble.
- Une clé de fournisseur IA. L'étape d'analyse nécessite un modèle. Tout fournisseur avec un endpoint de chat ou de message fonctionne ; ce guide utilise OpenAI.
- Un compte d'envoi d'e-mails. Pour livrer le résumé. Un service comme SendGrid sur son niveau gratuit suffit.
- Une familiarité basique avec n8n. Si vous pouvez glisser des nœuds sur le canevas et remplir des champs, vous êtes prêt.
Comment les données circulent dans le workflow
Plutôt que d'écrire une intégration HTTP avec des en-têtes, du parsing et une logique de réessai à la main, vous laissez chaque nœud faire une partie :
- Le nœud Form Trigger collecte le mot-clé produit et le nom et l'e-mail du destinataire.
- Le nœud HTTP Request envoie le mot-clé à la Crawling API et récupère les annonces Amazon analysées.
- Le nœud Switch vérifie le statut de la réponse et boucle pour réessayer en cas d'échec.
- Le nœud modèle IA lit les annonces et rédige l'analyse.
- Le nœud e-mail envoie le résumé à l'adresse du formulaire.
Parce que Crawlbase retourne les résultats de recherche Amazon déjà analysés en JSON propre, l'étape IA lit des champs structurés plutôt que de se battre avec du HTML brut. C'est le même moteur derrière la Crawling API, exposé ici comme paramètre scraper sur l'appel à la Crawling API.
Étape 1 : Commencer avec un déclencheur de formulaire
Créez un nouveau workflow dans n8n, cliquez sur Add first step, et choisissez On form submission dans la liste de déclencheurs. Cela vous donne un formulaire hébergé qui lance le workflow quand quelqu'un le soumet. Configurez le déclencheur avec ces valeurs :
- Authentication : None
- Form Title : Amazon SERP AI Agent with n8n and Crawlbase
- Form Description : Enter a product keyword to analyze on Amazon. n8n uses Crawlbase to extract titles, prices, and ratings, then an AI agent summarizes the results.
- Respond When : Workflow Finishes
Ajoutez trois éléments de formulaire pour que le workflow ait un mot-clé à rechercher et un endroit où envoyer le résultat :
Product Keyword | Text | placeholder: wireless earbuds | required Your Name | Text | placeholder: John Doe | required Email | Email | placeholder: [email protected] | required
Faites défiler jusqu'à Options et, sous Form Response, définissez Respond With sur "Form Submitted Text" et Text to Show sur quelque chose comme "Please check your email." C'est ce que le visiteur voit après avoir soumis, pendant que le workflow s'exécute en arrière-plan.
Étape 2 : Récupérer les résultats Amazon avec la Crawling API
Cliquez sur le bouton plus (+) après le déclencheur de formulaire, recherchez HTTP, et ajoutez un nœud HTTP Request. Il envoie le mot-clé à Crawlbase et récupère les résultats de recherche Amazon en JSON analysé. Configurez-le pour faire une requête GET à l'endpoint de la Crawling API avec des paramètres de requête fournis depuis les champs ci-dessous :
Method: GET URL: https://api.crawlbase.com Send Query Parameters: Yes Specify Query Parameters: Using Fields Below
Faites ensuite défiler jusqu'à l'onglet Query Parameters et ajoutez-en trois. Le paramètre scraper est ce qui indique à Crawlbase de retourner des données Amazon SERP analysées plutôt que du HTML brut, de sorte que l'étape IA obtient des champs propres :
token | YOUR_CRAWLBASE_NORMAL_TOKEN url | https://www.amazon.com/s?k={{ $json['Product Keyword'] }} scraper | amazon-serp
Pour la valeur url, tapez l'expression à la main ou faites glisser le champ Product Keyword depuis le panneau de gauche dans la boîte et n8n l'insère pour vous. Cela construit une URL de recherche Amazon à partir du mot-clé saisi par le visiteur.
Amazon rend les résultats côté client et bloque agressivement le trafic automatisé, donc une requête simple vous donne un shell vide. La Crawling API rend la page derrière un vrai navigateur et une IP de confiance, et le scraper amazon-serp retourne les annonces déjà analysées dans un tableau products avec les noms, prix, notes et statuts Prime. Cela signifie que l'IA n'a jamais à analyser du HTML, et vos sélecteurs ne dérivent jamais.
Étape 3 : Réessayer les requêtes échouées avec un nœud switch
Ajoutez le bouton plus (+) après le nœud HTTP Request et recherchez Switch. L'idée est simple : si Crawlbase retourne autre chose qu'un succès propre, revenez en arrière et réessayez. Puisque Crawlbase ne facture pas les requêtes échouées, vous n'avancez que lorsqu'un résultat valide est disponible.
Définissez le Mode du nœud sur Rules, puis ajoutez deux règles de routage qui se branchent sur le statut de la réponse :
{{ $json.original_status }} | is equal to | 200 | output: success {{ $json.original_status }} | is not equal to | 200 | output: failed
Définissez le type de comparaison sur Number. C'est important : laissez-le comme string et la vérification d'égalité peut mal fonctionner, cassant la logique de réessai. Connectez ensuite la sortie failed au début du nœud HTTP Request afin qu'une mauvaise réponse déclenche automatiquement une nouvelle tentative. La sortie success continue vers l'étape IA.
Amazon nécessite une page rendue derrière une IP de confiance, et idéalement les annonces déjà analysées. La Crawling API fait les deux en un seul appel : passez votre token plus scraper=amazon-serp, et elle rend la page de recherche dans un vrai navigateur, fait tourner les IPs résidentielles côté serveur, et retourne du JSON propre, de sorte que votre agent n8n lit des produits structurés sans flotte headless ni pool de proxys. Les requêtes échouées ne sont pas facturées, ce qui rend la boucle de réessai gratuite. Commencez avec le niveau gratuit et pointez-la sur une recherche publique.
Étape 4 : Analyser les données avec un modèle IA
Avec la boucle de réessai en place, cliquez sur le bouton plus (+) sur la sortie success du nœud switch. Recherchez votre fournisseur IA, par exemple OpenAI, et choisissez Message a model. Ce nœud prend les données produits analysées de Crawlbase et demande au modèle de résumer les tendances, les fourchettes de prix, les marques communes et les moyennes d'avis, ou les insights que vous voulez.
Si vous n'avez pas encore ajouté vos identifiants de fournisseur à n8n, le nœud vous y invitera. Configurez-le pour envoyer un seul message utilisateur à un modèle de chat actuel :
Credential: your configured AI provider key Resource: Text Operation: Message a Model Model: a current chat model (for example gpt-4o) Role: User
Dans la boîte de message, collez un prompt qui mappe le tableau products de Crawlbase en une liste lisible et demande une analyse ciblée. L'expression tire le mot-clé du formulaire et les champs produits de la sortie HTTP Request :
You are a product research analyst. Here is the data from an Amazon search for "{{ $('On form submission').item.json['Product Keyword'] }}": {{ $('HTTP Request').item.json.body.products.map((item, index) => "\n" + (index + 1) + ". " + item.name + " | " + item.price + " | " + (item.isPrime ? "Amazon Prime" : "Not Amazon Prime") + " | " + item.customerReview + " | " + item.boughtInfo) }} Analyze this data and summarize the key insights: - Top 3 popular brands - Average price range - Notable deals or trends - Short market summary (3 to 4 sentences)
Le prompt fait plusieurs choses délibérément. Il définit le rôle pour que le modèle reste concis, nomme les insights exacts que vous voulez pour que la sortie soit cohérente entre les exécutions, et fournit au modèle une liste propre de champs analysés plutôt que du HTML brut.
Étape 5 : Envoyer le résumé par e-mail
L'analyse est terminée ; la dernière étape est la livraison. Cliquez sur le bouton plus (+) après le nœud IA, recherchez votre service d'e-mail, par exemple SendGrid, et sous Mail Actions choisissez Send an email. Il envoie le résumé à l'adresse du formulaire, donc assurez-vous que vos identifiants e-mail sont configurés.
Remplissez le nœud en tirant les valeurs des étapes précédentes. Le destinataire et le nom d'expéditeur viennent du formulaire, le sujet réutilise le mot-clé, et le corps est la sortie du modèle :
Credential: your configured email-service key Resource: Mail Operation: Send Sender Email: the verified sender you set up with the service Sender Name: {{ $('On form submission').item.json['Your Name'] }} Recipient Email: {{ $('On form submission').item.json.Email }} Subject: Amazon analysis for '{{ $('On form submission').item.json['Product Keyword'] }}' Mime Type: Plain Text Message Body: {{ $json.output[0].content[0].text }}
Une fois tout câblé, le workflow s'assemble proprement : le formulaire collecte le mot-clé, Crawlbase récupère et analyse les annonces, le switch gère les réessais, l'IA résume, et le nœud e-mail l'envoie.
Tester le workflow de bout en bout
Activez le workflow, ouvrez l'URL de production depuis le nœud On form submission, et vous obtenez un formulaire hébergé avec les trois champs que vous avez définis. Entrez un mot-clé tel que "wireless earbuds", ajoutez un nom et un e-mail, et soumettez.
Attendez quelques secondes. Le mot-clé va à Crawlbase, les produits analysés reviennent, le switch confirme une réponse propre, le modèle rédige l'analyse, et le nœud e-mail l'envoie. Vous devriez recevoir un court brief : les meilleures marques pour ce mot-clé, une fourchette de prix moyenne, les offres notables, et quelques phrases de résumé de marché. Si rien n'arrive, ouvrez le journal d'exécution pour voir quel nœud s'est arrêté et ce qu'il a retourné.
Où aller ensuite
Vous avez construit un assistant de recherche produit qui tourne en pilote automatique. De là, c'est à vous. Exécutez-le sur un calendrier pour suivre les prix des concurrents dans le temps. Envoyez la sortie vers un canal Slack ou une base de données plutôt que par e-mail. Remplacez le déclencheur de formulaire par une liste de mots-clés et analysez toute une catégorie en une seule passe.
Et Crawlbase ne sert pas qu'Amazon. Le même paramètre scraper gère d'autres grands sites, et pour tout ce qui n'a pas de parseur dédié, la Crawling API retourne du HTML rendu ou du markdown prêt pour les LLM qu'une étape IA peut lire directement. Si vous préférez que l'agent atteigne lui-même les outils de crawl, connecter n8n avec Crawlbase Web MCP montre la version pilotée par agent utilisant le serveur Web MCP, et construire des workflows d'agents IA avec Crawlbase Web MCP va plus loin sur les agents multi-étapes. Pour des constructions personnalisées hors n8n, la Crawling API et le Smart AI Proxy vous donnent le même moteur à appeler directement.
L'attrait est que cela fonctionne sans code : n8n pilote l'automatisation, Crawlbase fait le crawling et le parsing, et l'IA fait la lecture. Crawlbase est utilisé par plus de 70 000 développeurs, de sorte que la couche de crawling sous votre workflow est la même qui alimente les scrapers de production à grande échelle.
Points clés
- Cinq nœuds, une boucle. Déclencheur de formulaire, HTTP Request vers Crawlbase, switch pour les réessais, modèle IA, e-mail. Chacun fait une seule tâche et les données circulent directement.
-
Laissez Crawlbase parser Amazon. Passez
scraper=amazon-serppour que les annonces reviennent en JSON propre ; l'IA lit des champs structurés plutôt que du HTML brut, et les sélecteurs ne dérivent jamais. - Les réessais sont gratuits. Crawlbase ne facture pas les requêtes échouées, donc le nœud switch peut boucler sur un statut non-200 jusqu'à obtenir un résultat valide.
- L'IA fait l'analyse. Un prompt ciblé qui nomme les insights exacts que vous voulez produit un brief cohérent à chaque exécution.
- Restez sur les données publiques. Respectez les CGU et robots.txt d'Amazon ; pas de comptes, pas de données de commande ou personnelles, pas de contournement d'auth, pas d'actions d'achat.
Foire aux questions
Dois-je écrire du code pour construire cet agent Amazon IA ?
Non. L'ensemble du workflow est construit visuellement dans n8n en faisant glisser des nœuds sur le canevas et en remplissant des champs. Le seul "code" est une courte expression dans le prompt IA qui mappe le tableau de produits Crawlbase en une liste lisible, et vous pouvez la coller telle quelle. Crawlbase gère le scraping et le parsing, le modèle IA gère l'analyse, et n8n connecte les deux.
Pourquoi utiliser Crawlbase plutôt qu'une requête HTTP simple vers Amazon ?
Amazon rend ses résultats côté client et bloque agressivement le trafic automatisé, donc une requête simple retourne généralement un 200 sans données produits. La Crawling API rend la page dans un vrai navigateur derrière une IP résidentielle de confiance, et le scraper amazon-serp retourne les annonces déjà analysées en JSON. Vous obtenez des champs propres sans avoir à exécuter vous-même un navigateur headless ou un pool de proxys.
Quelles données Amazon l'agent peut-il collecter ?
Uniquement les données de résultats de recherche publics : titres de produits, prix, notes, nombres d'avis, statuts Prime et champs similaires que tout le monde peut voir sans se connecter. Il ne collecte pas de données de compte, d'historique de commandes, d'informations personnelles liées aux acheteurs ou évaluateurs, ni rien derrière une connexion. Limitez l'agent aux annonces publiques et respectez les conditions d'utilisation et robots.txt d'Amazon.
Pourquoi le nœud switch réessaie-t-il les requêtes échouées ?
Occasionnellement une requête retourne un statut non-200. Le nœud switch vérifie original_status et renvoie tout ce qui n'est pas 200 vers le nœud HTTP Request pour réessayer, de sorte que le workflow n'avance que lorsqu'il a un résultat valide. Parce que Crawlbase ne facture pas les requêtes échouées, cette boucle de réessai ne coûte rien. Assurez-vous que le type de comparaison est défini sur Number ou la vérification d'égalité peut mal fonctionner.
Puis-je utiliser un fournisseur IA autre qu'OpenAI ?
Oui. L'étape d'analyse fonctionne avec n'importe quel modèle que n8n supporte via un nœud de chat ou de message. Remplacez le nœud OpenAI par le nœud de votre fournisseur, ajoutez ses identifiants, et gardez le même prompt. Le reste du workflow, y compris la récupération Crawlbase et la livraison par e-mail, reste exactement le même.
Comment envoyer les résultats ailleurs que par e-mail ?
Remplacez le nœud e-mail par la destination que vous voulez. n8n dispose de nœuds pour Slack, Google Sheets, des bases de données, des webhooks, et bien d'autres. Pointez la sortie du modèle IA vers ce nœud à la place, et vous pouvez publier le résumé dans un canal, l'ajouter à une feuille, ou le stocker pour plus tard. Les étapes de formulaire, récupération Crawlbase, switch et IA ne changent pas.
Crawlez n'importe quel site à grande échelle, sans combattre l'infrastructure.
Crawlbase gère les proxies, les empreintes et les CAPTCHA afin que votre équipe livre des pipelines de données au lieu de maintenir la plomberie de crawl. 1 000 requêtes gratuites, sans carte requise.

