Extrahieren Sie jede Website.
Erfassen Sie Quellcode, vollständige Struktur und Assets einer Website — unter Umgehung von Anti-Bot-Schutz — und exportieren Sie alles als Markdown, JSON oder LLM-Snapshot.
assets/
style.css
app.js
pages/
index.html
contact.html
index.html
Von der Website zum nutzbaren Ordner in drei Schritten.
Keine komplexe Einrichtung. Ein sauberes, wiederverwendbares Ergebnis in wenigen Minuten.
Konfigurieren
Geben Sie die URL der Ziel-Website und den Zielordner ein. Legen Sie optional ein Seitenlimit fest.
Extrahieren und umgehen
Die Playwright- und Crawlee-Engine durchsucht die Website und umgeht Erkennungen: Stealth, Cookie-Banner, Wartestrategien.
Exportieren
Laden Sie index.md, llm-snapshot.txt und elements.json herunter — oder speichern Sie die vollständige Struktur in einem Ordner Ihrer Wahl.
Eine komplette Engine, ein einziges Tool.
Vier Bausteine: Extraktion, Schutzschild, Datenextraktion und API. Ganz ohne zu wartende Proxies oder Skripte.
Vollständige Extraktion
Struktur, Assets, URL-Umschreibung: eine originalgetreue, navigierbare Kopie der Website.
Stealth-Schild
Erkennungsvermeidung, Cookie-Banner-Verwerfung und Wartestrategien, um unter dem Radar zu bleiben.
KI-Extraktion
DOM-Bereinigung, Tagging interaktiver Elemente, Serialisierung bereit für Sprachmodelle.
REST-API
Starten Sie Extraktionen im Hintergrund und verfolgen Sie den Status über eine einfache, robuste API.
Entwickelt für Entwickler und KI-Agenten.
Automatisieren Sie Ihre Extraktionen über die REST-API oder speisen Sie Ihre LLMs mit den Extraktionsartefakten.
REST-API
Starten Sie asynchrones Scraping und verfolgen Sie den Status. Ein einziger Endpoint, JSON-Artefakte, eine begrenzte Warteschlange und integriertes Anti-SSRF.
curl -X POST http://localhost:2027/api/scrape \
-H "Content-Type: application/json" \
-d '{
"url": "https://exemple.com",
"folderName": "mon-site",
"maxPages": 50
}'
LLM-Artefakte
Jede Extraktion erzeugt Dateien, die sofort von einem KI-Agenten oder einer Datenpipeline verarbeitet werden können.
mon-site/ ├── index.md # Markdown-Inhalt ├── llm-snapshot.txt # LLM-Snapshot ├── elements.json # interaktive Elemente └── assets/ # statische Dateien
Zahlen Sie für das, was Sie extrahieren.
Starten Sie mit einer kostenlosen Testphase und wachsen Sie dann in Volumen, Geschwindigkeit und Support.
Kostenlos
Testphase.
100 Tokens/Monat · 1 Website · ohne Karte.
- 1 Website, ein einzelner Test-Scrape
- Jeden Monat 100 Tokens gratis (max. 25 Seiten pro Website)
- Markdown · JSON · LLM-Extraktion
- Ergebnisse 7 Tage aufbewahrt
- Online-Dokumentation (kein Support)
Starter
Für Selbstständige.
1 000 Tokens/Monat · 5 Websites · API.
- 1 000 Tokens / Monat, unbegrenzte Scrapes
- Bis zu 5 Websites
- Vollständige REST-API
- Ergebnisse 30 Tage aufbewahrt
- E-Mail-Support
Scale
Für Teams.
6 000 Tokens/Monat · 3 Benutzer.
- 6 000 Tokens / Monat
- Unbegrenzte Websites · 3 Benutzer
- Schnellere Extraktion
- Ergebnisse 1 Jahr aufbewahrt
- Prioritäts-Support (Antwort < 24 h)
Kostenlose Testphase ohne Karte · Volumen, API und Support ab Starter — vollständige Preise ansehen. — Preise ansehen.
Fragen, Antworten.
Was ist ScraperFlow?
ScraperFlow extrahiert eine gesamte Website — Quellcode, Struktur und Assets — unter Umgehung von Anti-Bot-Schutz. Es erzeugt wiederverwendbare Artefakte: Markdown, LLM-Snapshot und interaktive Elemente als JSON.
Brauche ich technische Kenntnisse?
Nein. Die Weboberfläche genügt: URL und Zielordner eingeben und auf Herunterladen klicken. Die REST-API steht bereit, wenn Sie automatisieren möchten.
Welche Artefakte werden erzeugt?
Drei Dateien: index.md (Markdown-Inhalt), llm-snapshot.txt (LLM-optimierter Snapshot) und elements.json (strukturierte interaktive Elemente). Struktur und Assets bleiben erhalten.
Wie funktioniert das Anti-Erkennungs-Schild?
Es kombiniert Playwright-Stealth, automatisches Verwerfen von Cookie-Bannern und frameworkabhängige Wartestrategien, um das Blockierungsrisiko zu senken.
Ist es legal?
Das Extrahieren öffentlicher Inhalte ist in der Regel legal, beachten Sie jedoch stets die Nutzungsbedingungen der Ziel-Website und geltende Vorschriften (DSGVO, Urheberrecht).
Ist es kostenlos?
Der kostenlose Tarif ist eine Testphase: 1 Website, 3 Seiten, ohne Kreditkarte. Darüber hinaus schalten kostenpflichtige Tarife Monatsvolumen, API, längere Aufbewahrung und Support frei.
Das Web hat die Daten.
Sie haben den Quellcode.
Starten Sie Ihre erste Extraktion in Sekunden.