TRAWL
I built TRAWL, a fast self-hosted scraper for apps and AI agents
r/SideProjectu/trawlarr30 septembre 2026
Résumé
TRAWL est un outil de scraping open source et auto-hébergé qui permet de récupérer des données de pages web de manière rapide et fiable. Il utilise une combinaison de requêtes HTTP et de sessions de navigateur pour contourner les protections anti-scraping. TRAWL est conçu pour être utilisé avec des agents IA et des applications qui ont besoin de récupérer des données de pages web.
Pourquoi c’est intéressant
TRAWL est intéressant car il propose une solution rapide et fiable pour récupérer des données de pages web, ce qui peut être utile pour de nombreux cas d'utilisation. Il est également open source et auto-hébergé, ce qui signifie que les utilisateurs ont le contrôle total sur leurs données et peuvent personnaliser l'outil selon leurs besoins.
Comment Claude est utilisé
Le projet utilise MCP pour permettre aux agents IA de lire des pages web et d'extraire des informations de manière structurée.
Idées dérivées
- 01
CAPTCHASolver
Un outil de scraping spécialisé pour les sites web qui utilisent des CAPTCHAs pour empêcher le scraping.
- 02
ScrapingCloud
Un service de scraping en ligne qui utilise TRAWL pour fournir des données à des applications et des agents IA.
- 03
DataExtractor
Un plugin pour les navigateurs web qui utilise TRAWL pour extraire des informations de pages web et les présenter sous forme de données structurées.