Scraper Exercism.
Chaque track, entièrement rendu.
Envoyez n'importe quelle URL Exercism et récupérez le HTML entièrement rendu, via des proxys résidentiels avec gestion anti-bot intégrée.
Ou obtenez du JSON structuré avec les scrapers exercism-serp, exercism-exercise, exercism-solutions et exercism-solution.
Quatre scrapers Exercism. Un JSON propre chacun.
Les quatre scrapers Exercism, tapés en direct. exercism-serp liste les exercices d'un track, exercism-exercise récupère un exercice avec ses instructions, exercism-solutions classe les soumissions de la communauté, et exercism-solution renvoie une solution publiée avec son code source. Changez d'onglet, ou survolez pour mettre en pause et lire.
Une API, chaque recoin d'Exercism.
Quatre scrapers dédiés couvrent les pages qui comptent : listes d'exercices par track, exercices individuels, listes de solutions de la communauté et solutions publiées individuelles. La Crawling API rend chaque page dans un vrai navigateur, l'atteint via des IP résidentielles et vous renvoie du HTML ou du JSON propre.
Chaque track de langage
exercism-serp transforme la liste d'exercices de n'importe quel track en JSON : chaque exercice avec son slug, son type, son titre, sa difficulté, son résumé et son état de déblocage, plus le nombre d'exercices du track.
Instructions d'exercice complètes
exercism-exercise renvoie l'aperçu d'un seul exercice avec son titre, sa difficulté et les instructions complètes en texte et en HTML.
Listes de solutions de la communauté
exercism-solutions renvoie une liste paginée des solutions de la communauté pour un exercice, chacune avec son auteur, son langage, ses stars, ses commentaires, ses vues, ses itérations et un extrait.
Solutions publiées complètes
Ajoutez scraper=exercism-solution pour renvoyer une solution publiée avec son code source complet, son historique d'itérations, son statut de tests et son auteur.
140M IP résidentielles
Chaque requête fait tourner une IP résidentielle sur 30 zones géographiques et franchit les contrôles de bot automatiquement. Rien à résoudre, rien à maintenir.
Une API pour chaque page
La Crawling API fonctionne sur n'importe quelle URL, donc le même token couvre chaque track Exercism et tout ce que vous crawlez d'autre. Voir la démo en direct.
Chaque champ de solution, en JSON propre.
Envoyez une URL de solution avec scraper=exercism-solution et la solution revient en JSON typé, code source inclus. Remplacez par exercism-serp, exercism-exercise ou exercism-solutions pour les listes, les instructions et les solutions de la communauté.
Solution
url · string track.title · string language · string numStars · number
Exercice
exercise.slug · string exercise.title · string exercise.type · string exercise.difficulty · string
Auteur
author.handle · string publishedAt · string numIterations · number
Itérations
iterations[].idx · number iterations[].testsStatus · string iterations[].isPublished · boolean
Code
code · string isOutOfDate · boolean publishedIterationIdx · number
De l'URL aux données en un seul appel.
Chaque requête Exercism suit le même chemin. Vous envoyez une URL, nous gérons tout le reste.
Envoyez l'URL
Passez n'importe quelle URL publique Exercism avec votre token : une liste d'exercices de track, un exercice, une liste de solutions ou une seule solution publiée.
Faites tourner un proxy
Une IP et une zone résidentielles qui atteignent le site proprement, tirées de 140M IP sur 30 régions.
Rendez la page
Un vrai navigateur charge la page pour que exercices, solutions et code soient rendus avant la capture.
Franchissez l'anti-bot
Les contrôles de bot et les limites de débit du site sont gérés automatiquement. Rien à résoudre, rien à maintenir.
Renvoyez HTML ou JSON
Le HTML entièrement rendu revient, ou du JSON typé quand vous ajoutez exercism-serp, exercism-exercise, exercism-solutions ou exercism-solution.
Ce que les équipes construisent avec les données Exercism.
Données d'entraînement de code et RAG
Alimentez modèles, pipelines RAG et agents de code en prompts d'exercice propres et vraies solutions publiées via une seule API.
Benchmarks de solutions
Assemblez des jeux de données de solutions structurés multi-langages, avec stars, itérations et statut de tests, pour évaluation et benchmarks.
Sync de curriculum et de catalogue
Mirrorez listes d'exercices, types, difficulté et ordre de déblocage par track pour garder plateformes d'apprentissage et catalogues synchronisés.
Recherche sur les langages et le style
Comparez comment le même exercice est résolu selon les langages et les auteurs pour étudier idiomes, patterns et historique d'itérations.
Docs et pipelines de contenu
Récupérez les instructions d'exercice en texte et en HTML pour alimenter tutoriels, docs et guides d'étude.
N'importe quelle URL, une API
Crawlez tracks, exercices, listes de solutions et solutions individuelles, plus tout autre site dont vous avez besoin.
Bon à savoir pour scraper Exercism.
Quatre scrapers, quatre types de page
exercism-serp lit une liste d'exercices de track, exercism-exercise un seul exercice, exercism-solutions une liste de solutions de la communauté, et exercism-solution une solution publiée avec son code.
HTML par défaut, JSON à la demande
Vous obtenez le HTML entièrement rendu. Ajoutez scraper=exercism-serp, exercism-exercise, exercism-solutions ou exercism-solution pour du JSON parsé, ou parsez le HTML vous-même.
Les listes de solutions sont paginées
exercism-solutions renvoie page, totalPages, totalCount et solutionCount à côté du tableau des solutions, pour que vous puissiez parcourir chaque page d'un exercice.
Atteignez le site de n'importe où
Le geotargeting sur 30 régions et 140M IP résidentielles signifie un accès constant sans gérer de proxys.
Conçu pour crawler Exercism à grande échelle.
La Crawling API tourne sur le même réseau qui sert plus de 46 000 clients payants et 70 000 développeurs. Aucun proxy à acheter, aucun navigateur à faire tourner, rien à corriger quand le site change.
Un token, des SDK officiels pour Python, Node et Ruby, et un réseau à 99,99 % de disponibilité en dessous.
Questions sur le scraping de Exercism.
Commencez à scraper Exercism.
Oubliez les proxys et les limites de débit.
Gratuit pour démarrer avec jusqu'à 20 000 requêtes. Un token pour la Crawling API et chaque scraper.