Optisch hat Craigslist seit 2003 kaum dazugelernt – und trotzdem schlummern in diesen kargen Textanzeigen Daten von erstaunlichem Wert. Rund 127 Millionen Besuche pro Monat, dazu zig Millionen frische Einträge monatlich: Die Plattform zählt weiter zu den größten Kleinanzeigen-Portalen der USA. Eine offizielle API zum Abgreifen dieser Daten? Fehlanzeige.
Bei Thunderbit baue ich seit Jahren an Automatisierungswerkzeugen, und von Vertriebs-, Operations- und Immobilienteams kommt fast immer dieselbe Bitte: „Pack mir die Craigslist-Daten in eine Tabelle – aber bitte ohne drei Stunden Copy-and-paste.“ Das eigentliche Ärgernis liegt woanders: Die gängigen Listen der „besten Craigslist-Scraper“ sind oft Jahre alt, schweigen sich über die unangenehmen Details wie Anti-Bot-Schutz aus oder reihen einfach Tools aneinander, ohne sie ernsthaft gegeneinander zu stellen.
Genau deshalb dieser Leitfaden: 10 Tools, die 2026 wirklich noch liefern – No-Code-Erweiterungen für Chrome, Proxy-Plattformen für den Enterprise-Einsatz und Open-Source-Bibliotheken in Python. Ob du als Business-Nutzer noch nie programmiert hast oder als Entwickler in Python lebst: Für jeden ist hier etwas dabei.
Warum Craigslist 2026 scrapen? Die wichtigsten Use Cases für Business-Teams
Dass Craigslist so aus der Zeit gefallen wirkt, ist nicht nur kein Makel – es ist Teil des Reizes und der Stärke. Weltweit rangiert die Seite nach wie vor auf Platz 3 unter den Kleinanzeigen-Portalen, und das offizielle Verzeichnis listet 416 Einträge für US-Bundesstaaten und -Gebiete. Übersetzt heißt das: eine gewaltige Menge hyperlokaler Angebote, gebündelt an einem Ort, den es so kein zweites Mal gibt.
Diese Anwendungsfälle tauchen bei Teams immer wieder auf:
- Lead-Generierung: In den Rubriken Services und Gigs stehen häufig eine Firmenbeschreibung, ein Standort und ein Craigslist-Relay-Kontakt – ausreichend, damit der Vertrieb daraus eine lokale Lead-Liste zusammenstellt.
- Immobilien-Monitoring: Wohnungsinserate verraten Miete, Stadtteil, Zimmer/Bäder, Quadratmeter und Zeitstempel – die ideale Grundlage für Mietvergleiche und Verfügbarkeits-Tracking.
- Wettbewerbsfähige Preisanalysen: Im Bereich „Zu verkaufen“ findest du Titel, Preis, Zustand und Standort – ein Schatz für jede Resale- oder Arbitrage-Recherche.
- Recruiting und Arbeitsmarkt-Monitoring: Unter Jobs und Gigs werden Vergütung, Beschäftigungsart und Rollenprofile sichtbar – wie geschaffen für die Analyse lokaler Talentmärkte.
- Marktanalyse über mehrere Regionen hinweg: Da Craigslist nach Subdomain und Stadt aufgeteilt ist, lässt sich Region für Region nach Preisen, Volumen oder Kategorienmix abfragen.
- Workflow-Automatisierung: Viele wollen Craigslist-Daten einfach nach CSV, Google Sheets, Airtable oder ins CRM kippen – komplett ohne manuelles Browsen.
Ein Nutzer erzählte uns, dass sein täglicher Craigslist-Durchlauf früher 60–90 Minuten verschlungen hat und mit Automatisierung auf gut 5 Minuten gesunken ist. Solche Einsparungen läppern sich schnell zusammen.
Craigslist-Daten mit KI scrapen Get Started Free
Wie wir die besten Craigslist-Scraper ausgewählt haben: Unsere Bewertungskriterien
Craigslist-Scraper sind nicht über einen Kamm zu scheren, und welches Tool das „beste“ ist, entscheidet sich an deinem Profil und deinem Bedarf. Sechs Kriterien lagen meiner Bewertung jedes Tools zugrunde:
- Einrichtungsaufwand – Geht es anfängerfreundlich per No-Code, oder muss ein Entwickler ran?
- Umgang mit Craigslist-anti-Bot-Schutz – Sind Proxy-Rotation, CAPTCHA-Handling oder Browser-Fingerprinting mit an Bord?
- Preismodell – Kostenlos, Freemium, kostenpflichtig oder Enterprise?
- Exportoptionen – CSV, Excel, Google Sheets, Airtable, Notion, JSON, Datenbank?
- Multi-Region-Unterstützung – Schafft das Tool alle 416 US-Craigslist-Seiten oder immer nur eine Stadt?
- Wartungsaufwand – Geht das Tool kaputt, sobald Craigslist sein Layout dreht, oder zieht es automatisch nach?
So einen durchgängigen, direkten Vergleich liefert keiner der Konkurrenzartikel, die mir untergekommen sind – wenn dich vage „Top 10“-Listen also bisher genervt haben, bist du hier richtig.
Die 10 besten Craigslist-Scraper im Überblick
Bevor jedes Tool seinen eigenen Abschnitt bekommt, hier die zentrale Vergleichstabelle. Ich habe drei Gruppen gebildet: No-Code-Tools für Business-User, Enterprise-Plattformen zum Skalieren und Open-Source-Bibliotheken für Entwickler.
| Tool | Typ | Kostenlose Stufe? | Proxy-/Anti-Bot-Support | CAPTCHA-Handling | Exportformate | Am besten für |
|---|---|---|---|---|---|---|
| Thunderbit | No-Code-Chrome-Erweiterung | Ja (6 Seiten/Monat) | Browser-Modus (für moderate Läufe kein Proxy nötig) | N/A (Browser-Sitzung) | Excel, Sheets, Airtable, Notion, CSV, JSON | Nicht-technische Business-User |
| Bright Data | Enterprise-Scraper + Proxy + Dataset | Testphase | Verwaltetes Unblocking, Proxies, Retries, Rendering | Ja (automatisch gelöst) | JSON, NDJSON, CSV, Parquet, XLSX, API | Erfassung im Enterprise-Maßstab |
| Oxylabs | API + Proxy-Stack | Testphase | Verwaltetes Unblocking, Residential-/ISP-Proxies | Ja | HTML, Screenshot, API-Ausgaben | Entwickler, die Enterprise-Infrastruktur brauchen |
| Apify | Cloud-Actor-Marktplatz | Ja ($5/Monat Guthaben) | Proxy-Rotation (abhängig vom Actor) | Teilweise / actor-spezifisch | JSON, CSV, XML, Excel, JSONL | Flexible Low-Code-Cloud-Automatisierung |
| ParseHub | Visueller No-Code-Scraper | Ja | Kostenpflichtige Proxy-Rotation, Cloud-Runs | Kein Kernfeature | CSV, JSON, API/S3/Dropbox (kostenpflichtig) | Preisbewusste No-Code-Nutzer |
| Phantombuster | Cloud-Automatisierungsplattform | Ja (eingeschränkt) | Proxy-Support vorhanden | Credits / workflow-basiert | CSV, JSON (kostenpflichtig) | Multi-Plattform-Sales-Automatisierung |
| Scrapy | Open-Source-Python-Crawler | Kostenlos (OSS) | Eigene Proxies/Middleware mitbringen | Nein | JSON, JSONL, CSV, XML, DB | Produktions-Crawler |
| Playwright | Open-Source-Browser-Automatisierung | Kostenlos (OSS) | Eigenen Browser/Proxy mitbringen | Nein | Benutzerdefinierter Export | Kontrolle auf Browser-Ebene |
| Selenium | Open-Source-Browser-Automatisierung | Kostenlos (OSS) | Eigenen Browser/Proxy mitbringen | Nein | Benutzerdefinierter Export | Ältere Multi-Language-Stacks |
| BeautifulSoup | Open-Source-HTML-Parser | Kostenlos (OSS) | Allein keine | Nein | Benutzerdefinierter Export | Leichtgewichtiges Parsen |
Drei Gruppen schälen sich klar heraus:
- No-Code-Tools (Thunderbit, ParseHub, Phantombuster) für Business-User, die Daten ohne Engineering-Overhead wollen.
- Enterprise-Plattformen (Bright Data, Oxylabs, Apify) für Teams, die Skalierung, Anti-Bot-Infrastruktur und verwaltete Auslieferung brauchen.
- Open-Source-Entwicklertools (Scrapy, Playwright, Selenium, BeautifulSoup) für maximale Kontrolle – um den Preis von Einrichtungs-, Wartungs- und Proxy-Management-Aufwand.
Und jetzt der genaue Blick auf jedes einzelne.
1. Thunderbit
Thunderbit ist eine KI-gestützte Chrome-Erweiterung für alle, die strukturierte Daten von jeder Website – Craigslist eingeschlossen – ziehen wollen, ohne eine Zeile Code zu schreiben oder Proxies einzurichten.
Voreingenommen bin ich hier natürlich, schließlich stammt das Tool von uns. Trotzdem steht Thunderbit aus einem handfesten Grund auf Platz 1: Es packt genau die Stolpersteine, die Craigslist-Scraping für nicht-technische Nutzer so zäh machen – Layouts, die sich von Kategorie zu Kategorie unterscheiden, die Anreicherung über Unterseiten und das ständige Brechen, sobald sich ein CSS-Selektor verschiebt.
So funktioniert es auf Craigslist:
- Installiere die Thunderbit Chrome-Erweiterung und öffne eine beliebige Craigslist-Anzeigenseite (zum Beispiel Wohnungen in deiner Stadt).
- Klicke auf „KI-Felder vorschlagen“ – Thunderbits KI liest die Seite und schlägt Spalten vor, die genau zu den vorhandenen Inhalten passen. Bei Wohnungsanzeigen bekommst du Titel, Preis, Quadratmeter, Schlafzimmer, Standort, Datum und Link. Bei Jobs bekommst du Titel, Vergütung, Jobtyp und so weiter. Keine manuelle Selektor-Konfiguration.
- Klicke auf „Scrapen“ und beobachte, wie die Daten in einer strukturierten Tabelle erscheinen.
- Die Paginierung ist kein Problem – Thunderbit funktioniert mit Craigslists klickbasierter Seitennavigation.
- Nutze „Unterseiten scrapen“, um jede einzelne Anzeige aufzurufen und Felder nur von der Detailseite zu extrahieren: vollständige Beschreibung, alle Bilder, eingebettete Kontaktdaten und mehr.
- Exportiere nach Google Sheets, Excel, Airtable, Notion oder CSV – kostenlos.
Wichtige Funktionen:
- KI-gestützte Felderkennung: Passt sich automatisch an unterschiedliche Craigslist-Kategorien an – Wohnungen bekommen Quadratmeter-/Schlafzimmer-Spalten, Jobs bekommen Vergütungs-/Jobtyp-Spalten, Angebote zum Verkauf bekommen Zustand/Preis. Kein manuelles CSS-Arbeiten.
- Scraping von Unterseiten: Nach dem Scrapen einer Ergebnisseite ruft das Tool jede Anzeige auf, um Felder von der Detailseite zu holen (vollständige Beschreibung, Bilder, Kontaktinfos).
- Browserbasierter Scraping-Modus: Läuft in deiner eigenen Chrome-Sitzung, sodass bei moderaten Mengen kein Proxy nötig ist. Das senkt Kosten und Komplexität erheblich.
- Null Wartungsaufwand: Die KI liest die Seite jedes Mal neu. Wenn Craigslist sein Layout ändert (und das passiert), bricht dein Scraper nicht.
- Kostenloser Export: Excel, Google Sheets, Airtable, Notion, CSV, JSON – keine Paywall für Exporte.
Preis: Kostenlose Stufe (6 Seiten/Monat), kostenlose Testphase (10 Seiten), kostenpflichtige Pläne für höhere Volumina.
Am besten für: Vertriebsteams, die Leads aus Craigslist-Services/Gigs scrapen, Immobilien-Teams, die Mietpreise überwachen, Operations-Teams, die strukturierte Craigslist-Daten ohne Entwicklerunterstützung brauchen, und alle, die Daten in einem Schritt scrapen, kennzeichnen und exportieren wollen.
Thunderbit fürs Craigslist-Scraping ausprobieren
2. Bright Data
Bright Data ist das Schwergewicht für den Enterprise-Einsatz. Als einzige Plattform dieser Liste bringt es eine eigene Craigslist-Scraper-Produktseite und einen Craigslist-Dataset-Marktplatz mit.
Sobald du täglich Tausende Craigslist-Anzeigen quer über alle US-Regionen abgreifen willst, spielt Bright Data seine Stärke aus – dafür ist es gebaut. Um IPs, Retries, Rendering und Blockaden kümmert sich der Web Unlocker, und das Lösen von CAPTCHAs läuft standardmäßig automatisch mit. Über die Web Scraper IDE baust du eigene Craigslist-Workflows und iterierst programmgesteuert durch alle 416 Regional-URLs.
Wichtige Funktionen:
- Riesiges Residential-Proxy-Netzwerk (Millionen IPs)
- Integrierte CAPTCHA-Lösung und Anti-Bot-Umgehung
- Craigslist-spezifische Scraper- und Dataset-Produkte
- Export: JSON, NDJSON, CSV, Parquet, XLSX, API-Auslieferung, Webhooks
Preis: Der Craigslist-Scraper kostet im Pay-as-you-go-Modell 0,50 $ pro 1.000 Seitenaufrufe; daneben gibt es Pakete wie 380.000 Seitenaufrufe für 499 $. Residential Proxies beginnen bei 4 $/GB, ebenfalls pay-as-you-go. Die kostenlose Testphase deckt 1.000 Anfragen über eine Woche ab.
Am besten für: Enterprise-Teams, die Craigslist in hohem Volumen und über mehrere Regionen hinweg mit garantierter Verfügbarkeit und dediziertem Support erfassen müssen. Kleine, kostenbewusste Teams sollten sich anderswo umsehen.
3. Oxylabs
Oxylabs ist ein Premium-Anbieter für Proxy- und Scraping-Infrastruktur – inklusive dedizierter Craigslist-Scraper-API und eigener Craigslist-Proxies-Seite.
Wo Bright Data alles in einem Paket schnürt, richtet sich Oxylabs deutlicher an Entwickler. Web Scraper API und Web Unblocker beherrschen JS-Rendering, Retries, Sitzungsverwaltung, Fingerprint-Erzeugung und ein breiteres Anti-Bot-Handling. Die kostenlose Testphase der Craigslist Scraper API reicht bis zu 2.000 Ergebnissen.
Wichtige Funktionen:
- Residential- und ISP-Proxy-Pools (Residential ab 6 $/GB, ISP ab 0,60 $/IP)
- Web Unblocker mit automatischem Fingerprint- und Sitzungsmanagement
- Craigslist-spezifischer API-Endpunkt
- 7-tägige kostenlose Testphase verfügbar
Preis: Die Scraper-API für „andere Websites“ startet bei etwa 0,15 $ pro 1.000 Ergebnisse ohne JS, 0,35 $ pro 1.000 mit JS. Die Micro-Stufe des Web Unblockers beginnt bei etwa 75 $/Monat. Residential Proxies in großem Umfang können bei 1 TB rund 0,50 $/GB kosten.
Am besten für: Entwickler-Teams, die verwaltete Proxy-Infrastruktur und API-basierte Workflows für dauerhaftes Craigslist-Scraping wollen. Teams, die bereits Oxylabs-Proxies für andere Projekte nutzen, können Craigslist leicht ergänzen.
4. Apify
Apify ist eine cloudbasierte Plattform für Web-Scraping und Automatisierung, deren Herzstück ein Marktplatz vorgefertigter „Actors“ bildet – fertige Scraper-Vorlagen, die ohne Code laufen.
Spannend ist die Craigslist-Lage auf Apify: Mehrere von der Community gepflegte Craigslist-Actors stehen bereit, qualitativ aber meilenweit auseinander. Der Actor ivanvs/craigslist-scraper bringt es auf 829 Nutzer und eine 5,0-Bewertung, während automation-lab/craigslist-scraper bei 44 Nutzern und einer 1,0-Bewertung dümpelt. Die Qualität schwankt also stark – teste lieber, bevor du dich festlegst.
Wichtige Funktionen:
- Mehrere Craigslist-Actors verfügbar (einige extrahieren ~120 Anzeigen pro Seite mit eingebauten Verzögerungen)
- Cloud-Ausführung, geplante Läufe, API-Zugriff, Webhook-Integrationen
- Proxy-Rotation verfügbar
- Export: JSON, CSV, XML, Excel, JSONL
Preis: Kostenlose Stufe mit 5 $/Monat Guthaben, kostenpflichtige Pläne ab etwa 49 $/Monat. Die Compute-basierte Preisgestaltung kann bei hoher Nutzung stark ansteigen – behalte deinen CU-Verbrauch im Blick.
Am besten für: Teams, die eine Cloud-Lösung wollen, ohne Infrastruktur zu verwalten, Nutzer mit Komfort im Low-Code-Setup und Teams, die geplante, wiederkehrende Craigslist-Scrapes brauchen.
5. ParseHub
ParseHub ist ein desktopbasiertes visuelles Web-Scraping-Tool: Du klickst auf Seitenelemente und legst damit fest, was extrahiert werden soll.
Den Craigslist-Scrape richtest du ein, indem du Anzeigentitel, Preise und Links anklickst, bis das Tool gelernt hat, worauf es ankommt. Paginierung erledigt es über AJAX-Klickschleifen, und in den kostenpflichtigen Plänen kommen Cloud-Runs hinzu. Die kostenlose Stufe lässt bis zu 5 Projekte zu – für kleinere Craigslist-Aufgaben durchaus solide.
Wichtige Funktionen:
- Visueller Point-and-Click-Workflow-Builder
- Paginierung und dynamische Inhalte
- Cloud-Runs und Planung in kostenpflichtigen Plänen
- Export: CSV, Excel, JSON
Preis: Kostenlose Stufe (5 Projekte), kostenpflichtige Pläne ab etwa 189 $/Monat für mehr Seiten und geplante Läufe.
Einschränkungen: Bei großen Scrapes kann es träge werden, geplante Läufe sind in der kostenlosen Stufe limitiert, und – das wiegt schwer – es baut auf CSS-Selektoren auf, verlangt also manuelle Pflege, sobald Craigslist sein Layout umstellt.
Am besten für: Einzelanwender oder kleine Teams mit mittlerem Scraping-Bedarf, die ein visuelles No-Code-Tool wollen, aber keine KI-gestützte Felderkennung benötigen.
6. Phantombuster
Phantombuster ist eine cloudbasierte Automatisierungsplattform, groß geworden mit LinkedIn- und Social-Media-Scraping. Ein Craigslist-natives Tool ist es nicht, doch der Web Element Extractor scrapt öffentliche Seiten über CSS-Selektoren.
Den Craigslist-Scrape in Phantombuster aufzusetzen, kostet mehr Mühe als bei einem dedizierten Tool – Selektoren angeben, Workflow bauen, Planung einrichten. Wer Phantombuster aber ohnehin für LinkedIn oder Social-Media-Lead-Gen einsetzt, hängt Craigslist im Handumdrehen an die Pipeline an.
Wichtige Funktionen:
- Vorgefertigte Automatisierungsvorlagen und Cloud-Ausführung
- Planung und CRM-Integrationen
- Proxy-Support und Credits für CAPTCHA-Lösung verfügbar
- Export: CSV, JSON in kostenpflichtigen Plänen (kostenlose Stufe auf 10 Zeilen begrenzt)
Preis: Kostenlose Stufe mit 5 Slots, 2 Stunden/Monat und Exportlimit von 10 Zeilen. Kostenpflichtige Jahrespläne starten bei etwa 56 $/Monat bei jährlicher Abrechnung.
Am besten für: Vertriebsteams, die Phantombuster bereits für Multi-Plattform-Lead-Generierung nutzen und Craigslist zu ihrem Workflow hinzufügen wollen.
7. Scrapy
Scrapy ist das bekannteste Open-Source-Framework für Web-Scraping in Python und damit die naheliegende Wahl für Entwicklerteams, die maximale Kontrolle über ihr Craigslist-Crawling wollen.
Stabil ist aktuell die Version 2.15.0 (9. April 2026). Scrapy kann Multi-Region-Crawling (durch sämtliche regionalen URLs iterieren), bringt Anfrageplanung und Drosselung mit, bietet Downloader-Middleware für die Proxy-Rotation und Feed-Exporte nach CSV, JSON, JSONL, XML und in Datenbank-Pipelines. Browser-Rendering steuerst du bei Bedarf über das scrapy-playwright-Plugin bei.
Wichtige Funktionen:
- Hochgradig anpassbarer Crawler in Produktionsqualität
- Middleware für Proxies, Retries, Cookies und Rotation von User-Agents
- Feed-Exporte: JSON, JSONL, CSV, XML, Datenbank-Pipelines
- Kostenlos und Open Source
Die versteckten Kosten: Scrapy an sich kostet nichts, doch der großmaßstäbliche Betrieb auf Craigslist heißt Proxy-Abos (50–500+ $/Monat), Hosting-/Serverkosten und Dauerwartung, sobald Craigslist seine HTML-Struktur anpasst.
Am besten für: Entwicklerteams mit Python-Erfahrung, die maximale Flexibilität, vorhandene Proxy-Infrastruktur und Craigslist-Crawling in hohem Volumen und über mehrere Regionen hinweg brauchen.
8. Playwright
Playwright ist Microsofts moderne Browser-Automatisierungsbibliothek, die Chromium, Firefox und WebKit programmatisch steuert. Der Release-Zyklus läuft auf Hochtouren – v1.59.1 erschien am 1. April 2026.
In Entwickler-Communities verdrängt Playwright Selenium beim Craigslist-Scraping zunehmend. Es arbeitet schneller, zuverlässiger und bietet mit Community-Plugins wie playwright-extra die besseren Stealth-Funktionen gegen Erkennung. Headless- und Headed-Modus, automatisches Warten auf Elemente, Netzwerk-Interception und Screenshot-/PDF-Erfassung sind dabei.
Wichtige Funktionen:
- Unterstützt Python, JavaScript/TypeScript, Java und .NET
- Headless- und Headed-Browser-Modi
- Automatisches Warten auf Elemente, Netzwerk-Interception
- Kostenlos und Open Source
Craigslist-Vorteil: Playwright ahmt echtes Nutzerverhalten überzeugender nach als rohe HTTP-Anfragen und drückt damit das Blockierungsrisiko. Auf Reddit kippt die Community-Stimmung für neue Projekte klar zugunsten von Playwright statt Selenium.
Versteckte Kosten: Dieselben wie bei Scrapy – Proxy-Kosten, Hosting und Wartung, wenn Selektoren brechen.
Am besten für: Entwickler, die feingranulare Browser-Kontrolle brauchen, Teams, die Scraper für JavaScript-gerenderte Inhalte bauen, und alle, die eine moderne Alternative zu Selenium bevorzugen.
9. Selenium
Selenium ist das seit Jahren etablierte, weit verbreitete Browser-Automatisierungs-Framework. Aktuell ist Version 4.43.0 (10. April 2026), und die BiDi- und Netzwerk-Steuerungsfunktionen wachsen weiter.
Selenium spricht mehrere Sprachen (Python, Java, C#, JavaScript) und alle wichtigen Browser. Es simuliert komplette Browsersitzungen, loggt sich bei Bedarf ein und scrollt durch Seiten. Gegenüber Playwright ist es allerdings langsamer, ausführlicher und – ohne Zusatzbibliotheken wie undetected-chromedriver – leichter als Bot zu enttarnen.
Wichtige Funktionen:
- Unterstützung für mehrere Sprachen (Python, Java, C#, JavaScript)
- Simulation vollständiger Browsersitzungen
- Reifes Ökosystem mit umfangreicher Dokumentation
- Kostenlos und Open Source
Einschränkungen: Bei neuen Projekten tendiert die Community 2026 klar zu Playwright. In einem Reddit-Thread hieß es, Cloudflare erkenne Selenium nach wie vor, „auch mit Residential Proxies“ – Stealth gibt es also nicht out of the box.
Am besten für: Entwicklerteams, die bereits in Selenium investiert haben und nicht migrieren wollen, Projekte mit Bedarf an Multi-Language-Support (Java, C#) und ältere Scraping-Setups.
10. BeautifulSoup
BeautifulSoup ist eine leichtgewichtige Python-Bibliothek fürs Parsen von HTML und XML. Auf PyPI liegt aktuell die Version 4.14.3 (30. November 2025).
Wichtige Klarstellung: BeautifulSoup ist ein Parser, kein vollwertiger Scraper. Webseiten ruft es nicht ab, Browser-Automatisierung leistet es nicht. Du kombinierst es mit der Bibliothek requests, die das HTTP-Abrufen übernimmt, und BeautifulSoup parst anschließend das übergebene HTML. Das macht es zum simpelsten Einstiegspunkt für Entwickler – und zugleich zum am stärksten begrenzten.
Wichtige Funktionen:
- Extrem leicht zu lernen – minimaler Code nötig
- Ideal für kleine oder einmalige Craigslist-Scrapes
- Kostenlos und Open Source
Einschränkungen: Keine integrierte Paginierung, kein JavaScript-Rendering, keine Proxy-Rotation – all das musst du selbst ergänzen. Ändert Craigslist seine HTML-Struktur, brechen deine Selektoren, und du reparierst sie von Hand.
Am besten für: Python-Anfänger, die Craigslist-Scraping mit minimalem Aufwand ausprobieren wollen, schnelle Einzelabrufe aus einer einzelnen Kategorie oder Region und Entwickler, die einfach nur einen leichten Parser brauchen.
Das Anti-Ban-Playbook für Craigslist: Proxies, Rate Limits und was dich blockiert
Diesen Abschnitt überspringen die meisten Craigslist-Guides – dabei ist er der wichtigste. Scraperlys Tests vom April 2026 verorten Craigslist bei einer Schwierigkeit von 3/5 und nennen als Gründe benutzerdefinierte CAPTCHA-Abfragen, Rate-Limits und IP-Blocking. Das Bright-Data-Tutorial rät, statt schlichtem HTTP den Web Unlocker oder einen Playwright-basierten Scraping Browser zu nehmen. Und Oxylabs hält auf seiner Proxy-Seite fest, dass Craigslist Proxies erkennen kann und Residential Proxies die beste Wahl sind.
Das bewährt sich in der Praxis:
| Strategie | Wirksamkeit auf Craigslist | Kosten | Komplexität |
|---|---|---|---|
| Residential Proxies | ✅ Hoch | $$ (4–6 $/GB) | Mittel |
| ISP Proxies | ✅ Hoch | $ (0,60–0,80 $/IP) | Mittel |
| Datacenter-Proxies | ⚠️ Niedrig (oft blockiert) | $ (0,20–0,40 $/IP) | Niedrig |
| Browserbasiertes Scraping (eigene Sitzung) | ✅ Mittel bis hoch | Kostenlos | Niedrig |
| Rate-Limiting + zufällige Verzögerungen | ✅ Unverzichtbare Basis | Kostenlos | Niedrig |
Praktische Tipps:
- Anfrageverzögerungen: Mindestens 2–5 Sekunden zwischen den Anfragen. Scraperly empfiehlt, bei etwa 5–10 Anfragen/Minute pro IP zu bleiben und nach 20–30 Anfragen zu rotieren.
- Sitzungsrotation: User-Agents und Browser-Fingerprints rotieren. Vorhersehbare Crawl-Muster werden schnell erkannt.
- Datacenter-Proxies vermeiden: Sie sind günstig, werden auf Craigslist aber schnell blockiert.
- Browserbasiertes Scraping eliminiert das Proxy-Problem bei moderaten Volumina fast vollständig. Thunderbits Browser-Modus läuft in deiner eigenen Chrome-Sitzung – keine Proxy-Einrichtung, keine IP-Rotation, keine Kosten. Für die meisten Business-User, die ein paar hundert Anzeigen scrapen, reicht das mehr als aus.
Und dann ist da noch der Wartungspunkt, den fast alle übersehen: Stellt Craigslist sein CSS um (und das tut es regelmäßig), bricht jeder Scraper, der auf CSS-Selektoren basiert. Dann heißt es: Seite inspizieren, neue Selektoren suchen, Code aktualisieren, erneut testen. KI-gestützte Tools wie Thunderbit ersparen sich das komplett – die KI liest die Seitenstruktur jedes Mal frisch ein, sodass Layoutänderungen deinen Workflow nicht aushebeln.
Code vs. No-Code: Zwei komplette Craigslist-Scraping-Anleitungen
Die Leserschaft dieses Artikels teilt sich erfahrungsgemäß grob 50/50: nicht-technische Business-User, die schlicht die Daten wollen, und Entwickler vom Anfänger- bis Mittelniveau, die funktionierenden Code suchen. Darum hier beide Wege nebeneinander.
No-Code: So scrapest du Craigslist mit Thunderbit (Schritt für Schritt)
- Installiere die Thunderbit Chrome-Erweiterung aus dem Chrome Web Store.
- Öffne eine Craigslist-Anzeigenseite – zum Beispiel Wohnungen in deiner Stadt (
https://yourcity.craigslist.org/search/apa). - Klicke auf „KI-Felder vorschlagen“ – Thunderbits KI liest die Seite und schlägt Spalten vor, die zur Kategorie passen. Bei Wohnungsanzeigen siehst du Titel, Preis, Quadratmeter, Schlafzimmer, Standort, Veröffentlichungsdatum und Link.
- Prüfe und passe die vorgeschlagenen Spalten bei Bedarf an. Felder lassen sich mit einem Klick hinzufügen oder entfernen.
- Klicke auf „Scrapen“ – und beobachte, wie die Daten in einer strukturierten Tabelle erscheinen.
- Handle die Paginierung – klicke dich durch die Seiten oder lass Thunderbit das übernehmen.
- Nutze „Unterseiten scrapen“, um jede einzelne Anzeige aufzurufen und mit Detailseiten-Feldern anzureichern: vollständige Beschreibung, alle Bilder, eingebettete Kontaktdaten.
- Exportiere kostenlos nach Google Sheets, Excel, Airtable, Notion oder CSV.
Für eine Ergebnisseite ist der ganze Vorgang in rund 2 Minuten erledigt. Keine CSS-Selektoren, keine Proxies, kein Code.
Code-Weg: So scrapest du Craigslist mit Python + Playwright
In Entwicklerforen ist Playwright 2026 die meistempfohlene Bibliothek fürs Craigslist-Scraping. Hier ein lauffähiger Python-Snippet, der eine Craigslist-Wohnungs-Ergebnisseite scrapt, Titel/Preis/Link herauszieht, die Paginierung abdeckt und die Ergebnisse ausgibt.
Der Ansatz: erst die JSON-LD-Strukturdaten prüfen (Craigslist bettet auf manchen Seiten ItemList-Schema ein), dann auf DOM-Selektoren zurückfallen. Die Paginierung läuft über s=120.
import asyncio, json
from urllib.parse import urlparse, parse_qs, urlencode, urlunparse
from playwright.async_api import async_playwright
def next_page_url(url, step=120):
p = urlparse(url)
qs = parse_qs(p.query)
offset = int(qs.get("s", ["0"])[0]) + step
qs["s"] = [str(offset)]
return urlunparse((p.scheme, p.netloc, p.path, "", urlencode(qs, doseq=True), ""))
async def scrape_page(page, url):
await page.goto(url, wait_until="domcontentloaded")
await page.wait_for_timeout(1500)
data = []
# Zuerst JSON-LD prüfen
for raw in await page.locator('script[type="application/ld+json"]').all_text_contents():
try:
obj = json.loads(raw)
except Exception:
continue
if isinstance(obj, dict) and obj.get("@type") == "ItemList":
for item in obj.get("itemListElement", []):
thing = item.get("item", {})
data.append({
"title": thing.get("name"),
"price": thing.get("offers", {}).get("price"),
"link": thing.get("url"),
})
if data:
return data
# Fallback: DOM-Selektoren
cards = page.locator("div.cl-search-result, li.cl-static-search-result")
count = await cards.count()
for i in range(count):
card = cards.nth(i)
title = await card.locator("a.posting-title, a.titlestring").first.text_content()
link = await card.locator("a.posting-title, a.titlestring").first.get_attribute("href")
price = (await card.locator(".price, .result-price").first.text_content()
if await card.locator(".price, .result-price").count() else None)
data.append({"title": (title or "").strip(), "price": (price or "").strip(), "link": link})
return data
async def main():
start_url = "https://newyork.craigslist.org/search/apa?query=studio"
async with async_playwright() as p:
browser = await p.chromium.launch(headless=True)
page = await browser.new_page()
url = start_url
all_rows = []
for _ in range(3): # 3 Seiten scrapen
rows = await scrape_page(page, url)
if not rows:
break
all_rows.extend(rows)
url = next_page_url(url)
await browser.close()
for row in all_rows[:10]:
print(row)
asyncio.run(main())
Was du zusätzlich zu diesem Skript brauchst: Installiertes Playwright (pip install playwright && playwright install), Proxy-Konfiguration für hohe Volumina und manuelles CAPTCHA-Handling, falls du Rate-Limits triffst. Das ist der Kompromiss: volle Kontrolle, aber auch volle Verantwortung.
Kostenlos vs. kostenpflichtig: Ehrliche Kostenübersicht für jeden Craigslist-Scraper
Diese Tabelle hätte ich mir bei meiner eigenen Recherche zum Thema gewünscht. „Kostenlos“ ist beim Web Scraping nämlich ein ausgesprochen dehnbarer Begriff.
| Tool | Völlig kostenlos? | Grenzen der kostenlosen Stufe | Preis ab | Versteckte Kosten |
|---|---|---|---|---|
| Thunderbit | Kostenlose Stufe (6 Seiten) | 6 Seiten/Monat; Testphase = 10 Seiten | Kostenpflichtige Pläne für höhere Volumina | Keine – Export ist kostenlos |
| Scrapy | ✅ Open Source | Unbegrenzt | 0 $ | Proxy-Kosten, Hosting, Wartung |
| BeautifulSoup | ✅ Open Source | Unbegrenzt | 0 $ | Proxy-Kosten, Hosting, Wartung |
| Playwright | ✅ Open Source | Unbegrenzt | 0 $ | Proxy-Kosten, Hosting, Wartung |
| Selenium | ✅ Open Source | Unbegrenzt | 0 $ | Proxy-Kosten, Hosting, Wartung |
| ParseHub | Kostenlose Stufe | 5 Projekte | ca. 189 $/Monat | Eingeschränkte geplante Läufe in der kostenlosen Stufe |
| Apify | Kostenlose Stufe | 5 $/Monat Guthaben kostenlos | ca. 49 $/Monat | Compute-basierte Preise können stark ansteigen |
| Phantombuster | Kostenlose Stufe | 5 Slots, 2 Std./Monat, Export auf 10 Zeilen begrenzt | ca. 56 $/Monat (jährlich) | Slot-basierte Preisgestaltung |
| Bright Data | Nur Testphase | 1.000 Anfragen / 1 Woche | ca. 500 $+/Monat | Proxy-Kosten extra |
| Oxylabs | Nur Testphase | 2.000 Ergebnisse / 1 GB | ca. 75 $+/Monat (Unblocker) | Enterprise-Preisniveau |
Der große Haken an den „kostenlosen“ Open-Source-Tools: Scrapy, Playwright, Selenium und BeautifulSoup kosten beim Installieren tatsächlich 0 $, doch der großmaßstäbliche Betrieb auf Craigslist frisst Stunden an Entwicklerzeit fürs Setup, 50–500+ $/Monat für Residential Proxies und Dauerwartung bei jeder HTML-Änderung von Craigslist. Thunderbits KI liest die Seite jedes Mal frisch ein (keine Wartung), Exporte sind kostenlos, und browserbasiertes Scraping macht Proxy-Kosten bei moderaten Volumina überflüssig. Für Nicht-Entwickler ist das ein echter Vorteil.
Was du tatsächlich extrahieren kannst: Craigslist-Datenfelder nach Kategorie
Jede Craigslist-Kategorie folgt einer völlig eigenen Datenstruktur. Eine Wohnungsanzeige hat mit einer Jobanzeige strukturell nichts gemein. Was du aus den wichtigsten Bereichen realistisch herausholst:
| Craigslist-Kategorie | Extrahierbare Felder | Kontaktinfos verfügbar? |
|---|---|---|
| Wohnen / Wohnungen | Titel, Preis, Quadratmeter, Schlafzimmer, Badezimmer, Standort, Datum, Bilder, Beschreibung, Kartenlink, Verfügbarkeit, Haustierregelung, Wasch-/Parkoptionen | ⚠️ Manchmal (anonymisierte E-Mail-Weiterleitung) |
| Zu verkaufen | Titel, Preis, Zustand, Standort, Datum, Bilder, Beschreibung, Marke/Modell/Baujahr (variiert) | ⚠️ Manchmal |
| Jobs | Titel, Unternehmen, Vergütung, Standort, Jobtyp, Erfahrungsniveau, Datum, Beschreibung | Selten (meist nur Bewerbungslink) |
| Services | Titel, Standort, Beschreibung, Bilder | ⚠️ Manchmal |
| Gigs | Titel, Vergütung, Standort, Datum, Beschreibung | ⚠️ Manchmal |
Ein paar wichtige Hinweise:
- Kontaktinfos: Craigslist setzt ganz bewusst auf anonymisierte E-Mail-Weiterleitungen, um direktes E-Mail-Scraping zu unterbinden. Tools, die mit „E-Mail-Extraktion“ werben, ziehen oft nur die Relay-Adresse (
reply+randomstring@craigslist.org) heraus, nicht die echte E-Mail des Inserenten. - Detailseiten-Felder wie vollständige Beschreibung, alle Bilder und eingebettete Kontaktdaten gibt es erst, wenn du jede einzelne Anzeige aufrufst – nicht schon auf der Suchergebnisseite.
- Thunderbits „KI-Felder vorschlagen“ erkennt von selbst, welche Felder auf der aktuellen Seite vorliegen, und schlägt die passende Spaltenstruktur vor. Wer Wohnungen scrapt, bekommt Quadratmeter-/Schlafzimmer-Spalten; wer Jobs scrapt, bekommt Vergütungs-/Jobtyp-Spalten – ganz ohne manuelle Konfiguration. Das Scraping von Unterseiten ruft anschließend jede Anzeige auf, um die nur auf der Detailseite verfügbaren Felder zu holen.
Rechtliche Einordnung: Craigslist-AGB, der 3Taps-Fall und was du wissen solltest
Ich bin kein Anwalt, und das hier ersetzt keine Rechtsberatung. Aber ich weiß, dass das Thema Nutzer umtreibt, und deshalb verdient es eine klare Antwort.
Der wichtigste Präzedenzfall: In Craigslist v. 3Taps (2013) erwirkte Craigslist eine einstweilige Verfügung gegen 3Taps, nachdem das Unternehmen trotz Unterlassungsaufforderung weiter Anzeigen gescrapt und neu veröffentlicht hatte. 3Taps umging die IP-Blocks angeblich über Proxy-Server, und das Gericht wertete den Zugriff nach einer Sperre möglicherweise als „ohne Genehmigung“. Die EFF merkte an, dass der Fall 2015 beigelegt wurde.
Craigslist-Nutzungsbedingungen untersagen ausdrücklich den Einsatz von „robots, spiders, scripts, scrapers, crawlers oder deren automatischem oder manuellem Äquivalent“ zur Interaktion mit der Website. Für Verstöße legen sie sogar pauschale Schadensersatzansprüche von 0,25 $ pro Seite nach den ersten 1.000 Seitenaufrufen in einem 24-Stunden-Zeitraum fest.
Praktische Leitlinien:
- ✅ Öffentliche Anzeigendaten für Marktrecherche oder private Zwecke scrapen
- ✅ Robots.txt und Rate-Limits respektieren
- ⚠️ Gescrapte Anzeigen nicht massenhaft erneut veröffentlichen
- ⚠️ Gescrapte Kontaktdaten nicht für unerwünschtes Marketing nutzen
- ❌ Technische Zugriffsbeschränkungen nicht umgehen, nachdem du blockiert wurdest
Der Unterschied wiegt schwer: Öffentlich sichtbare Daten für die eigene Analyse zu scrapen ist etwas anderes als massenhaftes Republizieren oder das Einsammeln von E-Mail-Adressen für Spam. Sei dir trotzdem im Klaren darüber, dass Craigslist historisch von AGB-Durchsetzung über IP-Blocking bis zu rechtlichen Schritten eskaliert hat.
Welcher Craigslist-Scraper ist der beste für dich?
Nach Test und Bewertung aller 10 lautet meine szenariobasierte Empfehlung:
- Nicht-technischer Business-User, der schnell Craigslist-Daten braucht → Thunderbit. Kein Code, KI-gestützte Felderkennung, keine Wartung, kostenloser Export. Der schnellste Weg von „Ich brauche diese Daten“ zu „Sie stehen in meiner Tabelle“.
- Enterprise-Team, das täglich Tausende Anzeigen in allen Regionen scrapen muss → Bright Data. Craigslist-spezifischer Scraper, massive Proxy-Infrastruktur, automatische CAPTCHA-Lösung, dedizierter Support.
- Entwicklerteam, das verwaltete API-/Proxy-Infrastruktur braucht → Oxylabs für proxy-first Workflows, Apify für Flexibilität im Actor-Marktplatz.
- Entwickler, der volle Kontrolle und Anpassbarkeit will → Scrapy + Playwright. Open Source, maximale Flexibilität, aber Proxies und Wartung musst du selbst mitbringen.
- Preisbewusster Nutzer mit moderatem Bedarf → Apify kostenlose Stufe (5 $/Monat Guthaben) oder ParseHub kostenlose Stufe (5 Projekte).
- Vertriebsteam, das bereits Multi-Plattform-Lead-Gen-Tools nutzt → Phantombuster. Ergänze Craigslist zu deiner bestehenden Pipeline.
- Python-Anfänger, der einen einmaligen Scrape machen will → BeautifulSoup + requests. Minimaler Code, minimale Einrichtung, minimale Möglichkeiten.
Für die meisten nicht-technischen Business-User trifft Thunderbit die beste Balance aus Einfachheit, Genauigkeit und Kosten. Für Entwickler ist Scrapy + Playwright die schlagkräftigste Kombination. Und für die Enterprise-Skalierung ist Bright Data schwer zu schlagen.
Willst du sehen, wie KI-gestütztes Craigslist-Scraping konkret aussieht, probier Thunderbit aus – die kostenlose Stufe genügt, um es an deinem eigenen Use Case zu testen. Und wenn du tiefer in Web-Scraping-Techniken einsteigen willst, wirf einen Blick in unsere Anleitungen zu Web Scraping in Google Sheets, zu den besten automatisierten Web-Scraping-Tools und zu Web Scraping ohne Blockierung. Schritt-für-Schritt-Videoanleitungen findest du außerdem auf unserem YouTube-Kanal.
Damit hast du für jedes Szenario das passende Werkzeug, um Craigslist-Daten sauber und strukturiert in deine Tabelle zu bekommen.
FAQs
Ist es legal, Craigslist-Anzeigen zu scrapen?
Craigslistes Nutzungsbedingungen verbieten automatisiertes Scraping ausdrücklich, und der Fall Craigslist v. 3Taps ist der maßgebliche rechtliche Präzedenzfall. Öffentlich sichtbare Anzeigendaten für persönliche oder analytische Zwecke zu scrapen, wird in der Regel anders behandelt als massenhaftes Republizieren oder Spam – respektiere aber immer Rate-Limits und Seitenregeln. Und auch das hier ist keine Rechtsberatung.
Kann ich Craigslist ohne Programmieren scrapen?
Ja. Tools wie Thunderbit, ParseHub und Apify bieten No-Code- oder Low-Code-Optionen, um Craigslist-Daten zu extrahieren. Thunderbits KI-gestützte Felderkennung macht es besonders bequem – einfach auf „KI-Felder vorschlagen“ und dann auf „Scrapen“ klicken.
Was ist der beste kostenlose Craigslist-Scraper?
Für Entwickler sind Scrapy und BeautifulSoup komplett kostenlos und Open Source (auch wenn Proxy- und Wartungskosten dazukommen). Für Nicht-Programmierer ist Thunderbits kostenlose Stufe (6 Seiten/Monat) der beste Einstieg, mit ParseHubs kostenloser Stufe (5 Projekte) als zweiter Option.
Wie vermeide ich Blockierungen beim Scrapen von Craigslist?
Setze auf Rate-Limiting (mindestens 2–5 Sekunden Verzögerung), rotiere User-Agents, meide Datacenter-Proxies (Residential- oder ISP-Proxies schlagen sich auf Craigslist deutlich besser) und vermeide vorhersehbare Crawl-Muster. Bei moderaten Volumina umgehen browserbasierte Tools wie Thunderbit das Proxy-Problem komplett, indem sie in deiner eigenen Chrome-Sitzung laufen.
Kann ich alle Craigslist-Regionen auf einmal scrapen?
Mit Entwicklertools wie Scrapy oder Playwright iterierst du programmatisch durch alle 416 regionalen URLs der US-/Gebietsseiten. Enterprise-Tools wie Bright Data und Oxylabs bringen Multi-Region-Scraping von Haus aus mit. Und mit Thunderbit öffnest du jede regionale Website und scrapst sie mit demselben Workflow – die KI passt sich automatisch an jede Seite an.
Thunderbit fürs Craigslist-Scraping ausprobieren Get Started Free
Mehr erfahren


