Craigslist ser ud, som om siden ikke har ændret sig siden 2003, men de data, der gemmer sig i de enkle tekstannoncer, er overraskende værdifulde. Med ~127 millioner månedlige besøg og titusindvis af nye opslag hver måned er det stadig en af de største platforme for rubrikannoncer i USA — og der findes ingen offentlig API at hente data fra.
Jeg har brugt år på at bygge automatiseringsværktøjer hos Thunderbit, og én ting hører jeg igen og igen fra salgs-, drifts- og ejendomsteams: "Jeg har brug for Craigslist-data i et regneark, og jeg gider ikke kopiere og indsætte i tre timer." Problemet er, at de fleste guides til "den bedste Craigslist-scraper" enten er forældede, springer de svære dele over (som beskyttelse mod bots) eller bare oplister værktøjer uden faktisk at sammenligne dem.
Så jeg har samlet denne guide med 10 værktøjer, der faktisk stadig virker i 2026 — fra no-code Chrome-udvidelser til enterprise proxy-platforme og open source Python-biblioteker. Uanset om du er en forretningsbruger, der aldrig har skrevet en linje kode, eller en udvikler, der drømmer i Python, er der noget her til dig.
Hvorfor scrape Craigslist i 2026? De vigtigste brugsscenarier for forretnings- og driftsteams
Craigslist kan se gammeldags ud, men det er netop en del af charmen — og værdien. Siden ligger stadig nr. 3 globalt blandt rubrikannoncesider, og den dækker 416 amerikanske og territoriale områder i sit officielle katalog. Det er rigtig meget hyperlokalt indhold, som ganske enkelt ikke findes samlet ét andet sted.
Her er de brugsscenarier, jeg igen og igen ser teams vende tilbage til:
- Leadgenerering: Opslag i kategorierne services og gigs indeholder ofte virksomhedsbeskrivelser, geografi og en kontaktvej via Craigslist — nok til, at salgsteams kan bygge en lokal lead-liste.
- Ejendomsovervågning: Boligsider viser husleje, kvarter, antal senge/bade, kvadratmeter og tidsstempler — perfekt til huslejesammenligninger og overvågning af ledige boliger.
- Konkurrencedygtig prissætning: Salgsannoncer viser titel, pris, stand og placering, hvilket er guld værd til videresalg eller arbitrage-research.
- Rekruttering og overvågning af arbejdsmarkedet: Job- og gigs-kategorierne viser aflønning, ansættelsestype og stillingsbeskrivelser til scanning af det lokale talentmarked.
- Markedanalyse på tværs af regioner: Fordi Craigslist er opdelt efter underdomæne og by, kan du undersøge region for region for priser, volumen eller kategorisammensætning.
- Workflow-automatisering: Mange vil bare have Craigslist-data ind i CSV, Google Sheets, Airtable eller et CRM — uden manuelt at browse.
En bruger fortalte, at et dagligt Craigslist-scrape, som før tog 60–90 minutter, blev reduceret til omkring 5 minutter med automatisering. Den slags tidsbesparelse løber hurtigt op.
Scrape Craigslist-data med AI Get Started Free
SĂĄdan udvalgte vi de bedste Craigslist-scrapere: vores vurderingskriterier
Ikke alle Craigslist-scrapere er ens, og det "bedste" værktøj afhænger meget af, hvem du er, og hvad du har brug for. Jeg vurderede hvert værktøj ud fra seks dimensioner:
- Opsætningsvenlighed — Er det begyndervenligt (no-code), eller kræver det en udvikler?
- Håndtering af Craigslist anti-bot — Har det indbygget proxy-rotation, CAPTCHA-håndtering eller browser-fingerprinting?
- Prisniveau — Gratis, freemium, betalt eller enterprise?
- Eksportmuligheder — CSV, Excel, Google Sheets, Airtable, Notion, JSON, database?
- Support til flere regioner — Kan det scrape på tværs af alle 416 Craigslist-sider i USA, eller er det begrænset til én by ad gangen?
- Vedligeholdelsesarbejde — Går værktøjet i stykker, når Craigslist ændrer sidens layout, eller tilpasser det sig automatisk?
Ingen af de konkurrerende artikler, jeg fandt, gav en side-om-side-sammenligning med ens kriterier som disse — så hvis du er træt af vage "top 10"-lister, er denne her til dig.
De 10 bedste Craigslist-scrapere på et øjeblik
Før vi går i dybden med hvert værktøj, er her den samlede sammenligningstabel. Jeg har grupperet dem i tre spor: no-code-værktøjer til forretningsbrugere, enterprise-platforme til skalering og open source-biblioteker til udviklere.
| Værktøj | Type | Gratis niveau? | Proxy / anti-bot-support | CAPTCHA-håndtering | Eksportformater | Bedst til |
|---|---|---|---|---|---|---|
| Thunderbit | No-code Chrome-udvidelse | Ja (6 sider/måned) | Browser-tilstand (ingen proxy nødvendig ved moderate kørsler) | N/A (browser-session) | Excel, Sheets, Airtable, Notion, CSV, JSON | Ikke-tekniske forretningsbrugere |
| Bright Data | Enterprise-scraper + proxy + dataset | Prøveperiode | Administreret unblockering, proxyer, retries, rendering | Ja (løses automatisk) | JSON, NDJSON, CSV, Parquet, XLSX, API | Indsamling i enterprise-skala |
| Oxylabs | API + proxy-stack | Prøveperiode | Administreret unblockering, residential/ISP-proxyer | Ja | HTML, skærmbillede, API-output | Udviklere, der har brug for enterprise-infrastruktur |
| Apify | Cloud-baseret actor-markedsplads | Ja ($5/md. i credits) | Proxy-rotation (afhænger af actor) | Delvist / afhænger af actor | JSON, CSV, XML, Excel, JSONL | Fleksibel low-code cloud-automatisering |
| ParseHub | No-code visuel scraper | Ja | Betalt proxy-rotation, cloud-kørsler | Ikke en kernefunktion | CSV, JSON, API/S3/Dropbox (betalt) | No-code-brugere med lavt budget |
| Phantombuster | Cloud-automatiseringsplatform | Ja (begrænset) | Proxy-support findes | Credits / workflow-baseret | CSV, JSON (betalt) | Salgsautomatisering på tværs af platforme |
| Scrapy | Open source Python-crawler | Gratis (OSS) | Medbring dine egne proxyer/middleware | Nej | JSON, JSONL, CSV, XML, DB | Produktions-crawlere |
| Playwright | Open source browserautomatisering | Gratis (OSS) | Medbring din egen browser/proxy | Nej | Egen eksport | Browserniveau-kontrol |
| Selenium | Open source browserautomatisering | Gratis (OSS) | Medbring din egen browser/proxy | Nej | Egen eksport | Ældre multi-sprog stacks |
| BeautifulSoup | Open source HTML-parser | Gratis (OSS) | Ingen i sig selv | Nej | Egen eksport | Letvægts-parsing |
Tre spor tegner sig tydeligt her:
- No-code-værktøjer (Thunderbit, ParseHub, Phantombuster) til forretningsbrugere, der vil have data uden teknisk overhead.
- Enterprise-platforme (Bright Data, Oxylabs, Apify) til teams, der har brug for skala, anti-bot-infrastruktur og administreret levering.
- Open source-værktøjer til udviklere (Scrapy, Playwright, Selenium, BeautifulSoup) til maksimal kontrol — til gengæld med opsætning, vedligeholdelse og proxyhåndtering.
Nu til de dybere gennemgange.
1. Thunderbit
Thunderbit er en AI-drevet Chrome-udvidelse bygget til folk, der vil have strukturerede data fra enhver hjemmeside — inklusive Craigslist — uden at skrive kode eller konfigurere proxyer.
Jeg er ikke helt objektiv her (vi byggede det), men grunden til, at jeg placerer Thunderbit først, er, at det løser de konkrete smertepunkter, som Craigslist-scraping skaber for ikke-tekniske brugere: varierende sideopsætninger på tværs af kategorier, berigelse af detaljesider og det konstante nedbrud, der opstår, når CSS-selektorer ændrer sig.
SĂĄdan fungerer det pĂĄ Craigslist:
- Installer Thunderbit Chrome Extension og ĂĄbn en Craigslist-annoncerside (f.eks. lejligheder i din by).
- Klik "AI Suggest Fields" — Thunderbits AI læser siden og foreslår kolonner, der passer til det, der faktisk er der. For boliger får du Title, Price, Sqft, Bedrooms, Location, Date Posted, Link. For jobs får du Title, Compensation, Job Type osv. Ingen manuel opsætning af selektorer.
- Klik "Scrape" og se dataene blive udfyldt i en struktureret tabel.
- HĂĄndter pagination — Thunderbit fungerer sammen med CraigsÂlists klik-baserede sideskift.
- Brug "Scrape Subpages" til at besøge hver enkelt annonce og hente felter, der kun findes på detaljesiden: fuld beskrivelse, alle billeder, indlejret kontaktinfo og mere.
- Eksportér til Google Sheets, Excel, Airtable, Notion eller CSV — gratis.
Nøglefunktioner:
- AI-drevet feltdetektion: Tilpasser sig automatisk forskellige Craigslist-kategorier — boliger får sqft-/bedrooms-kolonner, jobs får compensation/job type, salgsannoncer får condition/pris. Intet manuelt CSS-arbejde.
- Scraping af undersider: Når du har scrappet en resultatside, kan du besøge hver annonce for at hente felter fra detaljesiden (fuld beskrivelse, billeder, kontaktinfo).
- Browserbaseret scraping-tilstand: Kører i din egen Chrome-session, så der ikke er behov for proxy ved moderate mængder. Det alene fjerner et stort lag af omkostninger og kompleksitet.
- Ingen vedligeholdelse: AI'en læser siden frisk hver gang. Når Craigslist ændrer layoutet (og det gør det), går din scraper ikke i stykker.
- Gratis eksport: Excel, Google Sheets, Airtable, Notion, CSV, JSON — ingen betalingsmur for eksport.
Pris: Gratis niveau (6 sider/måned), gratis prøveperiode (10 sider), betalte planer for højere volumen.
Bedst til: Salgsteams, der scraper leads fra Craigslist services/gigs, ejendomsteams, der overvåger lejepriser, driftsteams, der har brug for strukturerede Craigslist-data uden udviklerhjælp, og alle, der vil scrape, mærke og eksportere data i ét trin.
Prøv Thunderbit til Craigslist-scraping
2. Bright Data
Bright Data er den tunge enterprise-løsning. Det er den eneste platform på denne liste med både en dedikeret Craigslist Scraper-produktside og en Craigslist Dataset-markedsplads.
Hvis du skal scrape tusindvis af Craigslist-annoncer dagligt på tværs af alle amerikanske regioner, er Bright Data bygget til den skala. Deres Web Unlocker håndterer IP’er, retries, rendering og blokering — inklusive automatisk CAPTCHA-løsning som standard. Web Scraper IDE gør det muligt at bygge brugerdefinerede Craigslist-workflows, og du kan programmæssigt gå igennem alle 416 regionale URL’er.
Nøglefunktioner:
- Massivt residential proxy-netværk (millioner af IP’er)
- Indbygget CAPTCHA-løsning og anti-bot-bypass
- Craigslist-specifikke scraper- og dataset-produkter
- Eksport: JSON, NDJSON, CSV, Parquet, XLSX, API-levering, webhooks
Pris: Craigslist scraper kører fra $0,5 pr. 1.000 sideindlæsninger som pay-as-you-go, med planer som 380.000 sideindlæsninger for $499. Residential proxies starter ved $4/GB som pay-as-you-go. Der er en gratis prøve på 1.000 forespørgsler i én uge.
Bedst til: Enterprise-teams, der har brug for højvolumen, multi-region Craigslist-indsamling med garanteret oppetid og dedikeret support. Små teams med fokus på budget bør kigge andre steder.
3. Oxylabs
Oxylabs er en premium-udbyder af proxy- og scraping-infrastruktur med en dedikeret Craigslist Scraper API og en Craigslist-proxy-side.
Oxylabs er mere udviklerorienteret end Bright Datas alt-i-en-tilgang. Deres Web Scraper API og Web Unblocker understøtter JS-rendering, retries, sessionshåndtering, fingerprint-generering og bredere anti-bot-håndtering. Den gratis prøve på Craigslist Scraper API går op til 2.000 resultater.
Nøglefunktioner:
- Residential- og ISP-proxy-pools (residential fra $6/GB, ISP fra $0,60/IP)
- Web Unblocker med automatisk fingerprint og sessionsstyring
- Craigslist-specifikt API-endepunkt
- 7 dages gratis prøveperiode
Pris: Scraper API til "andre sider" starter omkring $0,15/1.000 resultater uden JS, $0,35/1.000 med JS. Web Unblocker micro-tier starter fra ca. $75/mĂĄned. Residential proxies i stor skala kan koste $0,50/GB ved 1 TB.
Bedst til: Udviklerteams, der vil have administreret proxy-infrastruktur og API-baserede workflows til vedvarende Craigslist-scraping. Teams, der allerede bruger Oxylabs-proxyer til andre projekter, vil nemt kunne tilføje Craigslist.
4. Apify
Apify er en cloud-baseret platform til webscraping og automatisering med en markedsplads af forudbyggede "Actors" — scraper-skabeloner, du kan køre uden at skrive kode.
Craigslist-landskabet på Apify er interessant: der findes flere community-vedligeholdte Craigslist actors med meget forskellige kvalitetsniveauer. Actoren ivanvs/craigslist-scraper har 829 samlede brugere og en vurdering på 5,0, mens automation-lab/craigslist-scraper har 44 brugere og en vurdering på 1,0. Kvaliteten er ujævn, så du bør teste, før du binder dig.
Nøglefunktioner:
- Flere Craigslist actors tilgængelige (nogle udtrækker ~120 annoncer pr. side med indbyggede forsinkelser)
- Cloud-kørsel, planlagte kørsler, API-adgang, webhook-integrationer
- Proxy-rotation tilgængelig
- Eksport: JSON, CSV, XML, Excel, JSONL
Pris: Gratis niveau med $5/måned i credits, betalte planer fra ca. $49/måned. Pris pr. compute kan stige ved tung brug — hold øje med dit CU-forbrug.
Bedst til: Teams, der vil have en cloud-hostet løsning uden at håndtere infrastruktur, brugere, der er komfortable med low-code-konfiguration, og teams, der har brug for planlagte, tilbagevendende Craigslist-scrapes.
5. ParseHub
ParseHub er et desktop-baseret visuelt webscraping-værktøj, hvor du peger og klikker på sideelementer for at definere, hvad der skal udtrækkes.
For at sætte et Craigslist-scrape op i ParseHub klikker du på annoncetitler, priser og links for at lære værktøjet, hvad det skal hente. Det håndterer pagination via AJAX-kliksløjfer og understøtter cloud-kørsler på betalte planer. Gratisniveauet giver dig op til 5 projekter, hvilket er fint til mindre Craigslist-opgaver.
Nøglefunktioner:
- Visuel point-and-click-workflowbygger
- HĂĄndtering af pagination og dynamisk indhold
- Cloud-kørsler og planlægning på betalte planer
- Eksport: CSV, Excel, JSON
Pris: Gratis niveau (5 projekter), betalte planer fra ca. $189/måned for flere sider og planlagte kørsler.
Begrænsninger: Kan være langsomt ved store scraping-opgaver, begrænsede planlagte kørsler på gratisniveauet og — vigtigst — det er baseret på CSS-selektorer, så det kræver manuel vedligeholdelse, når Craigslist ændrer layout.
Bedst til: Enkeltbrugere eller små teams med moderate scraping-behov, der ønsker et visuelt no-code-værktøj, men ikke har brug for AI-drevet feltdetektion.
6. Phantombuster
Phantombuster er en cloud-baseret automatiseringsplatform, som oprindeligt blev populær til LinkedIn- og social media-scraping. Det er ikke et Craigslist-født værktøj, men dets Web Element Extractor kan scrape offentlige sider ved hjælp af CSS-selektorer.
Det kræver mere arbejde at konfigurere et Craigslist-scrape i Phantombuster end i et dedikeret værktøj — du skal angive selektorer, bygge workflowet og sætte planlægning op. Men hvis du allerede bruger Phantombuster til LinkedIn eller leadgenerering på sociale medier, er det ligetil at tilføje Craigslist til pipelinen.
Nøglefunktioner:
- Forudbyggede automationsskabeloner og cloud-kørsel
- Planlægning og CRM-integrationer
- Proxy-support og credits til CAPTCHA-løsning tilgængelige
- Eksport: CSV, JSON på betalte planer (gratisniveauet er begrænset til 10 rækker)
Pris: Gratis niveau med 5 slots, 2 timer/måned og en eksportgrænse på 10 rækker. Betalte årlige planer starter omkring $56/måned faktureret årligt.
Bedst til: Salgsteams, der allerede bruger Phantombuster til leadgenerering på tværs af platforme og vil føje Craigslist til deres workflow.
7. Scrapy
Scrapy er det mest populære open source Python-framework til webscraping, og det er det oplagte valg for udviklerteams, der vil have maksimal kontrol over deres Craigslist-crawling.
Den seneste stabile version er 2.15.0 (9. april 2026). Scrapy understøtter crawl på tværs af regioner (loop gennem alle regionale URL’er), indbygget planlægning og throttling, downloader middleware til proxy-rotation og feed-eksport til CSV, JSON, JSONL, XML og databasepipelines. Pluginet scrapy-playwright tilføjer browserniveau-rendering, når du har brug for det.
Nøglefunktioner:
- Meget tilpasningsbart crawler-værktøj i produktionsklasse
- Middleware til proxyer, retries, cookies og rotation af user-agents
- Feed-eksport: JSON, JSONL, CSV, XML, databasepipelines
- Gratis og open source
Den skjulte omkostning: Scrapy er gratis, men at køre det i stor skala på Craigslist betyder proxy-abonnementer ($50–500+/måned), hosting/serveromkostninger og løbende vedligeholdelse, når Craigslist ændrer sin HTML-struktur.
Bedst til: Udviklerteams med Python-erfaring, der har brug for maksimal fleksibilitet, eksisterende proxy-infrastruktur og højvolumen Craigslist-crawling på tværs af regioner.
8. Playwright
Playwright er et moderne browserautomatiseringsbibliotek fra Microsoft, som styrer Chromium, Firefox og WebKit programmæssigt. Udgivelsesrytmen er stadig aktiv — v1.59.1 blev udgivet 1. april 2026.
Playwright bliver i stigende grad anbefalet frem for Selenium til Craigslist-scraping i udviklermiljøer. Det er hurtigere, mere pålideligt og har bedre anti-detektion med community-plugins som playwright-extra. Det understøtter både headless- og headed-tilstand, auto-waits for elementer, netværksinterception og optagelse af skærmbilleder/PDF.
Nøglefunktioner:
- Understøtter Python, JavaScript/TypeScript, Java og .NET
- Browsertilstande med og uden synligt vindue
- Automatisk venten på elementer, netværksinterception
- Gratis og open source
Craigslist-fordel: Playwright kan efterligne rigtig brugeradfærd mere overbevisende end rene HTTP-forespørgsler, hvilket reducerer risikoen for blokering. Stemningen i Reddit-fællesskaber peger konsekvent på Playwright frem for Selenium til nye projekter.
Skjulte omkostninger: De samme som Scrapy — proxyomkostninger, hosting og vedligeholdelse, når selektorer går i stykker.
Bedst til: Udviklere, der har brug for detaljeret browserkontrol, teams, der bygger scrapers til JavaScript-renderet indhold, og alle, der foretrækker et moderne alternativ til Selenium.
9. Selenium
Selenium er det langvarige og meget udbredte framework til browserautomatisering. Den seneste version er 4.43.0 (10. april 2026), og det udvider fortsat BiDi- og netværkskontrolfunktioner.
Selenium understøtter flere sprog (Python, Java, C#, JavaScript) og alle større browsere. Det kan simulere komplette browsersessioner, håndtere login, hvis det er nødvendigt, og scrolle gennem sider. Men sammenlignet med Playwright er det langsommere, mere ordrigt og lettere at opdage som bot uden ekstra stealth-biblioteker som undetected-chromedriver.
Nøglefunktioner:
- Understøttelse af flere sprog (Python, Java, C#, JavaScript)
- Simulering af fulde browsersessioner
- Modent økosystem med omfattende dokumentation
- Gratis og open source
Begrænsninger: I 2026 hælder udviklermiljøet mod Playwright til nye projekter. En Reddit-tråd bemærkede, at Cloudflare stadig opdagede Selenium "også med residential proxies" — stealth er sværere fra start.
Bedst til: Udviklerteams, der allerede har investeret i Selenium og ikke vil migrere, projekter der kræver understøttelse af flere sprog (Java, C#) og ældre scraping-opsætninger.
10. BeautifulSoup
BeautifulSoup er et letvægts Python-bibliotek til parsing af HTML og XML. Den aktuelle PyPI-version er 4.14.3 (30. november 2025).
En vigtig afklaring: BeautifulSoup er en parser, ikke en fuld scraper. Den henter ikke websider og håndterer ikke browserautomatisering. Du kombinerer den med biblioteket requests til HTTP-hentning, og den parser det HTML, du giver den. Det gør den til det enkleste udgangspunkt for udviklere, men også det mest begrænsede.
Nøglefunktioner:
- Ekstremt let at lære — minimal kode kræves
- God til smĂĄ eller enkeltstĂĄende Craigslist-scrapes
- Gratis og open source
Begrænsninger: Ingen indbygget håndtering af pagination, ingen JavaScript-rendering, ingen proxy-rotation — alt skal tilføjes manuelt. Hvis Craigslist ændrer HTML-strukturen, går selektorerne i stykker, og du retter dem manuelt.
Bedst til: Python-begyndere, der vil prøve Craigslist-scraping med minimal opsætning, hurtige engangshentninger fra en enkelt kategori eller region og udviklere, der bare har brug for en letvægts-parser.
Anti-ban-guide til Craigslist: proxyer, rate limits og det, der fĂĄr dig blokeret
Det her er den sektion, de fleste Craigslist-scraping-guides springer over — og det er den vigtigste. Scraperlys test fra april 2026 klassificerer Craigslist som en målside med 3/5 sværhedsgrad og peger på egen CAPTCHA, rate limiting og IP-blokering. Bright Datas tutorial anbefaler Web Unlocker eller en Playwright-baseret Scraping Browser i stedet for rene HTTP-kald. Oxylabs' proxy-side siger, at Craigslist kan registrere proxyer, og at residential proxies er det bedste valg.
Her er det, der faktisk virker:
| Strategi | Effektivitet pĂĄ Craigslist | Omkostning | Kompleksitet |
|---|---|---|---|
| Residential-proxyer | ✅ Høj | $$ ($4–6/GB) | Mellem |
| ISP-proxyer | ✅ Høj | $ ($0,60–0,80/IP) | Mellem |
| Datacenter-proxyer | ⚠️ Lav (blokeres ofte) | $ ($0,20–0,40/IP) | Lav |
| Browserbaseret scraping (egen session) | ✅ Mellem-høj | Gratis | Lav |
| Rate limiting + tilfældige forsinkelser | ✅ Nødvendigt minimum | Gratis | Lav |
Konkrete tips:
- Forsinkelser mellem forespørgsler: 2–5 sekunder som minimum mellem forespørgsler. Scraperly anbefaler cirka 5–10 forespørgsler/minut pr. IP og rotation efter 20–30 forespørgsler.
- Sessionsrotation: Rotér user-agents og browser-fingerprints. Forudsigelige crawl-mønstre bliver hurtigt fanget.
- UndgĂĄ datacenter-proxyer: De er billige, men bliver hurtigt blokeret pĂĄ Craigslist.
- Browserbaseret scraping fjerner proxy-problemet helt ved moderate mængder. Thunderbits browser-tilstand kører i din egen Chrome-session — ingen proxyopsætning, ingen IP-rotation, ingen omkostning. For de fleste forretningsbrugere, der scraper et par hundrede annoncer, er det mere end nok.
Og her er vedligeholdelsesvinklen, som de fleste overser: når Craigslist ændrer sin CSS (og det sker med jævne mellemrum), bryder alle scrapers baseret på CSS-selektorer sammen. Du skal inspicere siden, finde de nye selektorer, opdatere din kode og teste igen. AI-drevne værktøjer som Thunderbit undgår dette helt — AI'en læser sidens struktur på ny hver gang, så layoutændringer ikke ødelægger dit workflow.
Kode vs. no-code: to komplette gennemgange af Craigslist-scraping
Jeg ved, at målgruppen for denne artikel er nogenlunde delt 50/50: ikke-tekniske forretningsbrugere, der bare vil have dataene, og begyndere til let øvede udviklere, der vil have fungerende kode. Så her er begge veje side om side.
No-code: SĂĄdan scraper du Craigslist med Thunderbit (trin for trin)
- Installer Thunderbit Chrome Extension fra Chrome Web Store.
- Gå til en Craigslist-annoncerside — for eksempel lejligheder i din by (
https://yourcity.craigslist.org/search/apa). - Klik på "AI Suggest Fields" — Thunderbits AI læser siden og foreslår kolonner, der passer til kategorien. For boliger vil du se Title, Price, Sqft, Bedrooms, Location, Date Posted, Link.
- Gennemgå og justér de foreslåede kolonner, hvis det er nødvendigt. Tilføj eller fjern felter med et klik.
- Klik på "Scrape" — se dataene blive udfyldt i en struktureret tabel.
- Håndter pagination — klik dig gennem siderne, eller lad Thunderbit gøre det.
- Brug "Scrape Subpages" til at besøge hver enkelt annonce og berige med felter fra detaljesiden: fuld beskrivelse, alle billeder, indlejret kontaktinfo.
- Eksportér til Google Sheets, Excel, Airtable, Notion eller CSV — gratis.
Hele processen tager omkring 2 minutter for en resultatside. Ingen CSS-selektorer, ingen proxyer, ingen kode.
Kodevejen: SĂĄdan scraper du Craigslist med Python + Playwright
Playwright er det mest anbefalede bibliotek til Craigslist-scraping i udviklerfora i 2026. Her er et fungerende Python-eksempel, der scraper en Craigslist-side med boligresultater, henter titel/pris/link, hĂĄndterer pagination og outputter resultater.
Tilgangen: prøv først strukturerede JSON-LD-data (Craigslist indlejrer ItemList-schema på nogle sider), og fald derefter tilbage til DOM-selektorer. Paginer ved s=120.
import asyncio, json
from urllib.parse import urlparse, parse_qs, urlencode, urlunparse
from playwright.async_api import async_playwright
def next_page_url(url, step=120):
p = urlparse(url)
qs = parse_qs(p.query)
offset = int(qs.get("s", ["0"])[0]) + step
qs["s"] = [str(offset)]
return urlunparse((p.scheme, p.netloc, p.path, "", urlencode(qs, doseq=True), ""))
async def scrape_page(page, url):
await page.goto(url, wait_until="domcontentloaded")
await page.wait_for_timeout(1500)
data = []
# Prøv JSON-LD først
for raw in await page.locator('script[type="application/ld+json"]').all_text_contents():
try:
obj = json.loads(raw)
except Exception:
continue
if isinstance(obj, dict) and obj.get("@type") == "ItemList":
for item in obj.get("itemListElement", []):
thing = item.get("item", {})
data.append({
"title": thing.get("name"),
"price": thing.get("offers", {}).get("price"),
"link": thing.get("url"),
})
if data:
return data
# Fallback: DOM-selektorer
cards = page.locator("div.cl-search-result, li.cl-static-search-result")
count = await cards.count()
for i in range(count):
card = cards.nth(i)
title = await card.locator("a.posting-title, a.titlestring").first.text_content()
link = await card.locator("a.posting-title, a.titlestring").first.get_attribute("href")
price = (await card.locator(".price, .result-price").first.text_content()
if await card.locator(".price, .result-price").count() else None)
data.append({"title": (title or "").strip(), "price": (price or "").strip(), "link": link})
return data
async def main():
start_url = "https://newyork.craigslist.org/search/apa?query=studio"
async with async_playwright() as p:
browser = await p.chromium.launch(headless=True)
page = await browser.new_page()
url = start_url
all_rows = []
for _ in range(3): # scrape 3 pages
rows = await scrape_page(page, url)
if not rows:
break
all_rows.extend(rows)
url = next_page_url(url)
await browser.close()
for row in all_rows[:10]:
print(row)
asyncio.run(main())
Det, du skal bruge ud over dette script: Playwright installeret (pip install playwright && playwright install), proxykonfiguration til højvolumenkørsler og manuel CAPTCHA-håndtering, hvis du rammer rate limits. Det er kompromiset: fuld kontrol, men også fuldt ansvar.
Gratis vs. betalt: ærlig omkostningsfordeling for hver Craigslist-scraper
Det her er den tabel, jeg ville ønske fandtes, da jeg begyndte at undersøge emnet. "Gratis" er et ladet ord inden for webscraping.
| Værktøj | Helt gratis? | Grænser i gratisniveauet | Startpris for betalt | Skjulte omkostninger |
|---|---|---|---|---|
| Thunderbit | Gratis niveau (6 sider) | 6 sider/md.; gratis prøve = 10 sider | Betalte planer ved højere volumen | Ingen — eksport er gratis |
| Scrapy | ✅ Open source | Ubegrænset | $0 | Proxyomkostninger, hosting, vedligeholdelse |
| BeautifulSoup | ✅ Open source | Ubegrænset | $0 | Proxyomkostninger, hosting, vedligeholdelse |
| Playwright | ✅ Open source | Ubegrænset | $0 | Proxyomkostninger, hosting, vedligeholdelse |
| Selenium | ✅ Open source | Ubegrænset | $0 | Proxyomkostninger, hosting, vedligeholdelse |
| ParseHub | Gratis niveau | 5 projekter | ~ $189/md. | Begrænsede planlagte kørsler på gratis |
| Apify | Gratis niveau | $5/md. i credits gratis | ~ $49/md. | Pris pr. compute kan stige |
| Phantombuster | Gratis niveau | 5 slots, 2 t/md., 10-rækkers eksport | ~ $56/md. (årligt) | Pris pr. slot |
| Bright Data | Kun prøveperiode | 1.000 forespørgsler / 1 uge | ~ $500+/md. | Proxyomkostninger kommer oveni |
| Oxylabs | Kun prøveperiode | 2.000 resultater / 1 GB | ~ $75+/md. (Unblocker) | Enterprise-prissætning |
Den store stjerne ved "gratis" open source-værktøjer: Scrapy, Playwright, Selenium og BeautifulSoup koster $0 at installere, men at køre dem i stor skala på Craigslist betyder timer af udviklertid til opsætning, $50–500+/måned til residential proxies og løbende vedligeholdelse, hver gang Craigslist ændrer sin HTML. Thunderbits AI læser siden frisk hver gang (ingen vedligeholdelse), eksport er gratis, og browserbaseret scraping fjerner proxyomkostninger ved moderate mængder. Det er en reel fordel for ikke-udviklere.
Hvad du faktisk kan udtrække: Craigslist-datafelter efter kategori
Forskellige Craigslist-kategorier har helt forskellige datastrukturer. En boligannonce ligner slet ikke et jobopslag. Her er, hvad du realistisk kan udtrække fra hver hovedsektion:
| Craigslist-kategori | Felter, der kan udtrækkes | Kontaktinfo tilgængelig? |
|---|---|---|
| Boliger / lejligheder | Titel, pris, kvadratmeter, soveværelser, badeværelser, placering, dato, billeder, beskrivelse, kortlink, tilgængelighed, kæledyrspolitik, vaskeri/parkering | ⚠️ Nogle gange (anonymiseret e-mail-relay) |
| Til salg | Titel, pris, stand, placering, dato, billeder, beskrivelse, mærke/model/årgang (varierer) | ⚠️ Nogle gange |
| Jobs | Titel, virksomhed, løn, placering, jobtype, erfaringsniveau, dato, beskrivelse | Sjældent (kun ansøgningslink) |
| Services | Titel, placering, beskrivelse, billeder | ⚠️ Nogle gange |
| Gigs | Titel, kompensation, placering, dato, beskrivelse | ⚠️ Nogle gange |
Et par vigtige noter:
- Kontaktinfo: Craigslist bruger anonymiserede e-mail-relays specifikt for at forhindre direkte e-mailscraping. Værktøjer, der påstår at "udtrække emails", henter ofte relay-adressen (
reply+randomstring@craigslist.org) og ikke opslagets rigtige e-mail. - Felter på detaljesiden som fuld beskrivelse, alle billeder og indlejret kontaktinfo vises kun, når du besøger hver enkelt annonce — ikke på søgeresultatsiden.
- Thunderbits "AI Suggest Fields" registrerer automatisk, hvilke felter der er tilgængelige på den aktuelle side, og foreslår den rigtige kolonnestruktur. En bruger, der scraper boliger, får sqft-/bedrooms-kolonner; en bruger, der scraper jobs, får compensation/job-type-kolonner — uden manuel opsætning. Dets scraping af undersider besøger derefter hver annonce for at hente felter, der kun findes på detaljesiden.
Juridisk virkelighedstjek: Craigslist TOS, 3Taps-sagen og det, du bør vide
Jeg er ikke advokat, og det her er ikke juridisk rĂĄdgivning. Men jeg ved, at brugere bekymrer sig om det, og det fortjener et direkte svar.
Det vigtigste præjudikat: I Craigslist v. 3Taps (2013) fik Craigslist et forbud mod 3Taps for scraping og genudgivelse af annoncer efter et cease-and-desist-brev. 3Taps skal angiveligt have omgået IP-blokeringer via proxyservere, og retten betragtede adgang efter blokering som potentielt "uden tilladelse." EFF bemærkede, at sagen blev forligt i 2015.
CraigsÂlists vilkĂĄr for brug forbyder udtrykkeligt brug af "robots, spiders, scripts, scrapers, crawlers eller enhver tilsvarende automatisk eller manuel metode" til at interagere med siden. De fastsætter endda en aftalt erstatning pĂĄ $0,25 pr. side efter de første 1.000 sidevisninger i en 24-timers periode ved overtrædelser.
Praktisk vejledning:
- âś… Scrape offentlige annonce-data til markedsresearch eller personlig brug
- âś… Respekter robots.txt og rate limits
- ⚠️ Genudgiv ikke scrappede annoncer i stor skala
- ⚠️ Brug ikke scrappede kontaktoplysninger til uopfordret markedsføring
- ❌ Omgå ikke tekniske adgangsbegrænsninger, efter du er blevet blokeret
Forskellen betyder noget: at scrape offentligt synlige data til egen analyse er noget andet end at genudgive i stor skala eller høste e-mails til spam. Men vær opmærksom på, at Craigslist historisk har eskaleret fra håndhævelse af vilkår til IP-blokering til juridiske skridt.
Hvilken Craigslist-scraper er bedst for dig?
Efter at have testet og vurderet alle 10 er her min scenariebaserede anbefaling:
- Ikke-teknisk forretningsbruger, der hurtigt skal bruge Craigslist-data → Thunderbit. Ingen kode, AI-drevet feltdetektion, ingen vedligeholdelse, gratis eksport. Den hurtigste vej fra "jeg har brug for de her data" til "de ligger i mit regneark."
- Enterprise-team, der scraper tusindvis af annoncer dagligt på tværs af alle regioner → Bright Data. Craigslist-specifik scraper, massiv proxy-infrastruktur, automatisk CAPTCHA-løsning, dedikeret support.
- Udviklerteam, der vil have administreret API-/proxy-infrastruktur → Oxylabs til proxy-first workflows, Apify til fleksibilitet via actor-markedspladsen.
- Udvikler, der vil have fuld kontrol og tilpasning → Scrapy + Playwright. Open source, maksimal fleksibilitet, men medbring egne proxyer og vedligeholdelse.
- Budgetbevidst bruger med moderate behov → Apifys gratis niveau ($5/md. i credits) eller ParseHubs gratis niveau (5 projekter).
- Salgsteam, der allerede bruger leadgen-værktøjer på tværs af platforme → Phantombuster. Tilføj Craigslist til din eksisterende pipeline.
- Python-begynder, der skal lave et enkelt scrape → BeautifulSoup + requests. Minimal kode, minimal opsætning, minimal kapacitet.
For de fleste ikke-tekniske forretningsbrugere giver Thunderbit den bedste balance mellem lethed, præcision og pris. For udviklere er Scrapy + Playwright den stærkeste kombination. Til enterprise-skala er Bright Data svær at slå.
Hvis du vil se, hvordan AI-drevet Craigslist-scraping faktisk ser ud, så prøv Thunderbit — gratisniveauet er nok til at teste det på dit eget use case. Og hvis du vil dykke dybere ned i webscraping-teknikker, så tjek vores guides om hvordan man scraper til Google Sheets, de bedste automatiserede webscraping-værktøjer og webscraping uden at blive blokeret. Du kan også udforske vores YouTube-kanal for trin-for-trin video-guides.
God scraping — og må dine data altid være rene, strukturerede og klar til handling.
Ofte stillede spørgsmål
Er det lovligt at scrape Craigslist-annoncer?
CraigsÂlists vilkĂĄr for brug forbyder udtrykkeligt automatiseret scraping, og Craigslist v. 3Taps-sagen er det førende juridiske præjudikat. Scraping af offentlige annonce-data til personlig eller analytisk brug behandles generelt anderledes end massegenudgivelse eller spam, men du bør altid respektere rate limits og sidens regler — og dette er ikke juridisk rĂĄdgivning.
Kan jeg scrape Craigslist uden at kode?
Ja. Værktøjer som Thunderbit, ParseHub og Apify tilbyder no-code- eller low-code-muligheder til at udtrække Craigslist-data. Thunderbits AI-drevne feltdetektion gør det især nemt — klik bare på "AI Suggest Fields" og "Scrape."
Hvad er den bedste gratis Craigslist-scraper?
For udviklere er Scrapy eller BeautifulSoup helt gratis og open source (selvom proxy- og vedligeholdelsesomkostninger løber op). For ikke-kodere er Thunderbits gratis niveau (6 sider/måned) det bedste sted at starte, med ParseHubs gratis niveau (5 projekter) som et andet valg.
Hvordan undgĂĄr jeg at blive blokeret, nĂĄr jeg scraper Craigslist?
Brug rate limiting (minimum 2–5 sekunders forsinkelser), rotér user-agents, undgå datacenter-proxyer (residential- eller ISP-proxyer fungerer meget bedre på Craigslist), og følg ikke forudsigelige crawl-mønstre. Ved moderate mængder omgår browserbaserede værktøjer som Thunderbit proxy-problemet helt ved at køre i din egen Chrome-session.
Kan jeg scrape alle Craigslist-regioner på én gang?
Med udviklerværktøjer som Scrapy eller Playwright kan du programmæssigt løbe gennem alle 416 regionale URL’er for USA/territorier. Enterprise-værktøjer som Bright Data og Oxylabs har multi-region scraping indbygget. Med Thunderbit kan du åbne hver regional side og scrape med den samme arbejdsgang — AI'en tilpasser sig automatisk hver side.
Prøv Thunderbit til Craigslist-scraping Get Started Free
Lær mere


