Email Extractor
Extrayez toutes les adresses e-mail visibles sur une page web. Utile pour les pages de contact, les annuaires d'équipe et les listings publics.
Utilisation de l'API
Ajoutez &scraper=email-extractor à une requête Crawling API. Encodez en URL l'URL cible dans le paramètre url.
curl 'https://api.crawlbase.com/?token=YOUR_TOKEN' \
--data-urlencode 'url=https://letsencrypt.org/contact/' \
--data-urlencode 'scraper=email-extractor' -Gfrom crawlbase import CrawlingAPI
api = CrawlingAPI({'token': 'YOUR_TOKEN'})
res = api.get(
'https://letsencrypt.org/contact/',
{'scraper': 'email-extractor'}
)
import json
data = json.loads(res['body'])const { CrawlingAPI } = require('crawlbase');
const api = new CrawlingAPI({ token: 'YOUR_TOKEN' });
const res = await api.get(
'https://letsencrypt.org/contact/',
{ scraper: 'email-extractor' }
);
const data = JSON.parse(res.body);require 'crawlbase'
api = Crawlbase::API.new(token: 'YOUR_TOKEN')
res = api.get('https://letsencrypt.org/contact/', scraper: 'email-extractor')
data = JSON.parse(res.body)Exemple d'URL d'entrée
L'URL passée dans le paramètre url (décodée pour plus de lisibilité) :
https://letsencrypt.org/contact/Structure de la réponse
Corps de la réponse JSON. Les types de champs peuvent être null lorsque la page source ne contient pas la valeur.
URL finale.
Titre de la page.
Chaînes d'adresses e-mail (dédupliquées).
E-mail + texte environnant.
Adresse e-mail.
Texte environnant.
Exemple de réponse
{
"url": "https://letsencrypt.org/contact/",
"title": "Contact - Let's Encrypt",
"emails": [
"[email protected]",
"[email protected]"
]
}