Craigslist ser ut som om det inte har förändrats sedan 2003, men datan som gömmer sig i de där rena textannonserna är förvånansvärt värdefull. Med ~127 miljoner besök i månaden och tiotals miljoner nya inlägg varje månad är det fortfarande en av de största plattformarna för klassificerade annonser i USA — och det finns inget publikt API att använda.
Jag har ägnat år åt att bygga automationsverktyg på Thunderbit, och en sak jag ständigt hör från sälj-, drift- och fastighetsteam är: "Jag behöver Craigslist-data i ett kalkylblad, och jag vill inte kopiera och klistra in i tre timmar." Problemet är att de flesta guider om "bästa Craigslist-skrapare" antingen är föråldrade, hoppar över de svåra delarna (som skydd mot bottar), eller bara listar verktyg utan att faktiskt jämföra dem.
Så jag satte ihop den här guiden med 10 verktyg som verkligen fortfarande fungerar 2026 — från kodfria Chrome-tillägg till enterprise-plattformar för proxyhantering och Python-bibliotek med öppen källkod. Oavsett om du är en affärsanvändare som aldrig har skrivit en rad kod eller en utvecklare som drömmer i Python, finns det något här för dig.
Varför skrapa Craigslist 2026? Toppanvändningsfall för affärsteam
Craigslist kan se gammaldags ut, men det är en del av dess charm — och av dess värde. Sajten ligger fortfarande på plats 3 globalt bland annonssajter och finns i 416 amerikanska områden och territorier i den officiella katalogen. Det betyder massor av hyperlokalt utbud som helt enkelt inte finns samlat på ett och samma ställe någon annanstans.
Här är användningsfallen jag ser team återkomma till gång på gång:
- Leadgenerering: Inlägg i tjänster och gig innehåller ofta företagsbeskrivning, geografi och en kontaktväg via Craigslist-relä — tillräckligt för att säljteam ska kunna bygga en lokal leadlista.
- Fastighetsbevakning: Bostadssidor visar hyra, område, antal rum, storlek och tidsstämplar — perfekt för att jämföra hyror och följa tillgänglighet.
- Konkurrensprissättning: Försäljningsannonser visar titel, pris, skick och plats, vilket är guld värt för andrahandsförsäljning eller arbitrageanalyser.
- Rekrytering och arbetsmarknadsbevakning: Kategorierna jobb och gig visar ersättning, anställningsform och rollbeskrivningar för lokala marknadsanalyser.
- Marknadsanalys i flera regioner: Eftersom Craigslist är uppdelat per subdomän och stad kan du fråga region för region efter pris, volym eller kategorimix.
- Automatisering av arbetsflöden: Många vill bara få in Craigslist-data i CSV, Google Sheets, Airtable eller ett CRM — utan att behöva surfa manuellt.
En användare rapporterade att en daglig Craigslist-skrapning som tidigare tog 60–90 minuter sjönk till ungefär 5 minuter med automation. Det är den typen av tidsbesparing som snabbt blir stor.
Skrapa Craigslist-data med AI Get Started Free
Så valde vi de bästa Craigslist-skraparna: våra utvärderingskriterier
Alla Craigslist-skrapare är inte likadana, och det "bästa" verktyget beror mycket på vem du är och vad du behöver. Jag utvärderade varje verktyg utifrån sex dimensioner:
- Hur lätt det är att komma igång — Är det nybörjarvänligt (utan kod), eller krävs en utvecklare?
- Hantering av Craigslist skydd mot bottar — Finns inbyggd proxyrotation, CAPTCHA-hantering eller browser fingerprinting?
- Prisnivå — Gratis, freemium, betalt eller enterprise?
- Exportalternativ — CSV, Excel, Google Sheets, Airtable, Notion, JSON, databas?
- Stöd för flera regioner — Kan det skrapa alla 416 Craigslist-sajter i USA, eller är det begränsat till en stad åt gången?
- Underhållsbehov — Går verktyget sönder när Craigslist ändrar sidlayout, eller anpassar det sig automatiskt?
Ingen konkurrerande artikel jag hittade ger en jämförelse sida vid sida med konsekventa kriterier som dessa — så om du har tröttnat på vaga "topp 10"-listor är den här för dig.
De 10 bästa Craigslist-skraparna i korthet
Innan vi går på djupet i varje verktyg, här är den stora jämförelsetabellen. Jag har delat in dem i tre spår: kodfria verktyg för affärsanvändare, enterprise-plattformar för skala, och bibliotek med öppen källkod för utvecklare.
| Verktyg | Typ | Gratis nivå? | Proxy-/bottenskyddsstöd | CAPTCHA-hantering | Exportformat | Bäst för |
|---|---|---|---|---|---|---|
| Thunderbit | Kodfritt Chrome-tillägg | Ja (6 sidor/mån) | Browser-läge (ingen proxy behövs för måttliga körningar) | N/A (webbläsarsession) | Excel, Sheets, Airtable, Notion, CSV, JSON | Icke-tekniska affärsanvändare |
| Bright Data | Enterprise-skrapare + proxy + dataset | Testversion | Hanterad upplåsning, proxies, återförsök, rendering | Ja (löses automatiskt) | JSON, NDJSON, CSV, Parquet, XLSX, API | Insamling i enterprise-skala |
| Oxylabs | API + proxystack | Testversion | Hanterad upplåsning, residential-/ISP-proxies | Ja | HTML, skärmdump, API-utdata | Utvecklare som behöver enterprise-infrastruktur |
| Apify | Molnbaserad actor-marknadsplats | Ja ($5/mån i credits) | Proxyrotation (beroende på actor) | Delvis / actorspecifikt | JSON, CSV, XML, Excel, JSONL | Flexibel molnautomation med låg kodnivå |
| ParseHub | Visuell skrapare utan kod | Ja | Betald proxyrotation, molnkörningar | Inte en kärnfunktion | CSV, JSON, API/S3/Dropbox (betalt) | Budgetmedvetna användare utan kod |
| Phantombuster | Molnbaserad automationsplattform | Ja (begränsad) | Proxy-stöd finns | Credits / arbetsflödesbaserat | CSV, JSON (betalt) | Säljautomation över flera plattformar |
| Scrapy | Python-crawler med öppen källkod | Gratis (OSS) | Du står för proxies/middleware | Nej | JSON, JSONL, CSV, XML, DB | Produktionscrawlers |
| Playwright | Webbläsarautomation med öppen källkod | Gratis (OSS) | Du står för browser/proxy | Nej | Anpassad export | Kontroll på webbläsarnivå |
| Selenium | Webbläsarautomation med öppen källkod | Gratis (OSS) | Du står för browser/proxy | Nej | Anpassad export | Äldre stackar i flera språk |
| BeautifulSoup | HTML-parser med öppen källkod | Gratis (OSS) | Ingen i sig | Nej | Anpassad export | Lättviktig parsning |
Tre tydliga spår framträder här:
- Kodfria verktyg (Thunderbit, ParseHub, Phantombuster) för affärsanvändare som vill ha data utan tekniskt arbete.
- Enterprise-plattformar (Bright Data, Oxylabs, Apify) för team som behöver skala, infrastruktur mot bottar och hanterad leverans.
- Öppna utvecklarverktyg (Scrapy, Playwright, Selenium, BeautifulSoup) för maximal kontroll — men till priset av installation, underhåll och proxyhantering.
Nu till djupdykningarna.
1. Thunderbit
Thunderbit är ett AI-drivet Chrome-tillägg byggt för människor som vill ha strukturerad data från vilken webbplats som helst — inklusive Craigslist — utan att skriva kod eller konfigurera proxies.
Jag är partisk här (vi byggde det), men anledningen till att jag placerar Thunderbit först är att det löser de specifika problem som Craigslist-skrapning skapar för icke-tekniska användare: varierande sidlayouter mellan kategorier, berikning från detaljsidor och den ständiga sönderbrytningen när CSS-selektorer ändras.
Så fungerar det på Craigslist:
- Installera Thunderbit Chrome Extension och öppna valfri Craigslist-annons sida (till exempel lägenheter i din stad).
- Klicka på "AI Suggest Fields" — Thunderbits AI läser sidan och föreslår kolumner anpassade efter det som faktiskt finns där. För bostäder får du titel, pris, kvadratmeter, sovrum, plats, publiceringsdatum och länk. För jobb får du titel, ersättning, jobbt typ och så vidare. Ingen manuell konfiguration av selektorer.
- Klicka på "Scrape" och se hur datan fylls i i en strukturerad tabell.
- Hantera paginering — Thunderbit fungerar med Craigslist klickbaserade sidindelning.
- Använd "Scrape Subpages" för att besöka varje enskild annons och extrahera fält som bara finns på detaljsidan: full beskrivning, alla bilder, inbäddad kontaktinfo med mera.
- Exportera till Google Sheets, Excel, Airtable, Notion eller CSV — gratis.
Viktiga funktioner:
- AI-baserad fältdetektering: Anpassar sig automatiskt till olika Craigslist-kategorier — bostäder får kolumner för kvadratmeter/sovrum, jobb får ersättning/jobbt typ, försäljning får skick/pris. Inget manuellt CSS-arbete.
- Skrapning av undersidor: Efter att du har skrapat en resultatsida kan du besöka varje annons för att hämta fält från detaljsidan (full beskrivning, bilder, kontaktinfo).
- Browser-baserat skrapningsläge: Körs i din egen Chrome-session, så ingen proxy behövs för måttliga volymer. Bara det sänker både kostnad och komplexitet rejält.
- Noll underhåll: AI:n läser sidan på nytt varje gång. När Craigslist ändrar layout (och det gör de), går inte din skrapare sönder.
- Gratis export: Excel, Google Sheets, Airtable, Notion, CSV, JSON — ingen betalvägg för export.
Prissättning: Gratis nivå (6 sidor/månad), gratis testperiod (10 sidor), betalda planer för högre volym.
Bäst för: Säljteam som skrapar leads från Craigslist services/gigs, fastighetsteam som följer hyresnivåer, driftteam som behöver strukturerad Craigslist-data utan utvecklarstöd, och alla som vill skrapa, märka upp och exportera data i ett steg.
Testa Thunderbit för Craigslist-skrapning
2. Bright Data
Bright Data är det tunga enterprise-alternativet. Det är den enda plattformen i den här listan som både har en dedikerad Craigslist Scraper-produktsida och en Craigslist Dataset-marknadsplats.
Om du behöver skrapa tusentals Craigslist-annonser dagligen över alla regioner i USA är Bright Data byggt för den skalan. Deras Web Unlocker hanterar IP-adresser, återförsök, rendering och blockering — inklusive automatiskt lösta CAPTCHA som standard. Web Scraper IDE låter dig bygga anpassade arbetsflöden för Craigslist-insamling, och du kan programmässigt loopa igenom alla 416 regionala URL:er.
Viktiga funktioner:
- Massivt nätverk av residential proxies (miljontals IP-adresser)
- Inbyggd CAPTCHA-lösning och bypass av skydd mot bottar
- Craigslist-specifika skrap- och datasetprodukter
- Export: JSON, NDJSON, CSV, Parquet, XLSX, API-leverans, webhooks
Prissättning: Craigslist-skraparen kostar från $0,5 per 1 000 sidladdningar enligt pay-as-you-go, med paket som 380 000 sidladdningar för $499. Residential proxies börjar på $4/GB enligt pay-as-you-go. Det finns en gratis testperiod med 1 000 förfrågningar i en vecka.
Bäst för: Enterprise-team som behöver högvolymsinsamling från Craigslist i flera regioner, med garanterad upptid och dedikerad support. Mindre team med snäv budget bör leta någon annanstans.
3. Oxylabs
Oxylabs är en premiumleverantör av proxies och scraping-infrastruktur med en dedikerad Craigslist Scraper API och en Craigslist proxies-sida.
Oxylabs är mer utvecklarorienterat än Bright Datas allt-i-ett-upplägg. Deras Web Scraper API och Web Unblocker stödjer JS-rendering, återförsök, sessionhantering, fingerprint-generering och bredare hantering av skydd mot bottar. Den kostnadsfria testperioden för Craigslist Scraper API går upp till 2 000 resultat.
Viktiga funktioner:
- Residential- och ISP-proxypooler (residential från $6/GB, ISP från $0,60/IP)
- Web Unblocker med automatisk fingerprint och sessionshantering
- Craigslist-specifik API-endpoint
- 7 dagars gratis testperiod tillgänglig
Prissättning: Scraper API för "andra sajter" börjar runt $0,15/1 000 resultat utan JS, $0,35/1 000 med JS. Web Unblocker i micro-nivå från ungefär $75/månad. Residential proxies i stor skala kan ligga på $0,50/GB vid 1 TB.
Bäst för: Utvecklingsteam som vill ha hanterad proxyinfrastruktur och API-baserade arbetsflöden för långvarig Craigslist-skrapning. Team som redan använder Oxylabs-proxies i andra projekt kommer enkelt kunna lägga till Craigslist.
4. Apify
Apify är en molnbaserad plattform för webskrapning och automation med en marknadsplats för förbyggda "Actors" — skrapmallar du kan köra utan att skriva kod.
Craigslist-landskapet i Apify är intressant: det finns flera community-underhållna Craigslist-actors med väldigt olika kvalitet. Actorn ivanvs/craigslist-scraper har 829 totala användare och ett betyg på 5,0, medan automation-lab/craigslist-scraper har 44 användare och ett betyg på 1,0. Kvaliteten är ojämn, så du bör testa innan du bestämmer dig.
Viktiga funktioner:
- Flera Craigslist-actors tillgängliga (vissa extraherar ~120 annonser per sida med inbyggda fördröjningar)
- Molnkörning, schemalagda körningar, API-åtkomst, webhook-integrationer
- Proxyrotation tillgänglig
- Export: JSON, CSV, XML, Excel, JSONL
Prissättning: Gratis nivå med $5/månad i credits, betalda planer från cirka $49/månad. Prissättning per beräkning kan sticka iväg vid tung användning — håll koll på din CU-förbrukning.
Bäst för: Team som vill ha en molnbaserad lösning utan att hantera infrastruktur, användare som är bekväma med konfiguration på låg kodnivå, och team som behöver schemalagda, återkommande Craigslist-skrapningar.
5. ParseHub
ParseHub är ett skrivbordsbaserat visuellt webskrapningsverktyg där du pekar och klickar på sidans element för att definiera vad som ska extraheras.
För att sätta upp en Craigslist-skrapning i ParseHub klickar du på annonstitlar, priser och länkar för att lära verktyget vad det ska hämta. Det hanterar paginering via AJAX-klickloopar och stödjer molnkörningar i betalda planer. Gratisnivån ger dig upp till 5 projekt, vilket är helt okej för Craigslist-arbete i mindre skala.
Viktiga funktioner:
- Visuell byggare med klicka-och-peka-flöde
- Hantering av paginering och dynamiskt innehåll
- Molnkörningar och schemaläggning i betalda planer
- Export: CSV, Excel, JSON
Prissättning: Gratis nivå (5 projekt), betalda planer från cirka $189/månad för fler sidor och schemalagda körningar.
Begränsningar: Kan vara långsamt vid storskalig skrapning, begränsat antal schemalagda körningar på gratisnivån och — viktigast av allt — det bygger på CSS-selektorer, så det kräver manuellt underhåll när Craigslist ändrar layouten.
Bäst för: Enskilda användare eller små team med måttliga behov som vill ha ett visuellt verktyg utan kod, men inte behöver AI-baserad fältdetektering.
6. Phantombuster
Phantombuster är en molnbaserad automationsplattform som ursprungligen blev populär för LinkedIn- och sociala medieskrapning. Det är inte ett Craigslist-inbyggt verktyg, men dess Web Element Extractor kan skrapa publika sidor med CSS-selektorer.
Att konfigurera en Craigslist-skrapning i Phantombuster kräver mer arbete än ett specialiserat verktyg — du måste ange selektorer, bygga arbetsflödet och sätta upp schemaläggning. Men om du redan använder Phantombuster för LinkedIn eller leadgenerering från sociala medier är det enkelt att lägga till Craigslist i pipelinen.
Viktiga funktioner:
- Förbyggda automationsmallar och molnkörning
- Schemaläggning och CRM-integrationer
- Proxy-stöd och credits för CAPTCHA-lösning finns tillgängliga
- Export: CSV, JSON i betalda planer (gratisnivån begränsar till 10 rader)
Prissättning: Gratis nivå med 5 platser, 2 h/månad och exportbegränsning på 10 rader. Betalda årsplaner börjar på cirka $56/månad fakturerat årsvis.
Bäst för: Säljteam som redan använder Phantombuster för leadgenerering över flera plattformar och vill lägga till Craigslist i sitt arbetsflöde.
7. Scrapy
Scrapy är det mest populära Python-ramverket med öppen källkod för webskrapning, och det är det självklara valet för utvecklingsteam som vill ha maximal kontroll över sin Craigslist-crawling.
Den senaste stabila versionen är 2.15.0 (9 april 2026). Scrapy stödjer crawling i flera regioner (loopa igenom alla regionala URL:er), inbyggd schemaläggning och throttling av förfrågningar, downloader middleware för proxyrotation och feed exports till CSV, JSON, JSONL, XML och databaspipelines. Tillägget scrapy-playwright lägger till rendering på webbläsarnivå när du behöver det.
Viktiga funktioner:
- Mycket anpassningsbar crawler i produktionsklass
- Middleware för proxies, återförsök, cookies och rotation av user-agent
- Feed exports: JSON, JSONL, CSV, XML, databaspipelines
- Gratis och öppen källkod
Den dolda kostnaden: Scrapy i sig är gratis, men att köra det i stor skala på Craigslist innebär proxyabonnemang ($50–500+/månad), hosting/serverkostnader och löpande underhåll när Craigslist ändrar sin HTML-struktur.
Bäst för: Utvecklingsteam med Python-erfarenhet som behöver maximal flexibilitet, befintlig proxyinfrastruktur och högvolyms-crawling över flera Craigslist-regioner.
8. Playwright
Playwright är ett modernt bibliotek för webbläsarautomation från Microsoft som styr Chromium, Firefox och WebKit programmatiskt. Den nuvarande releasetakten är aktiv — v1.59.1 släpptes den 1 april 2026.
Playwright är i allt högre grad det rekommenderade valet framför Selenium för Craigslist-skrapning i utvecklarcommunityn. Det är snabbare, mer tillförlitligt och har bättre stealth mot detektering med communitytillägg som playwright-extra. Det stödjer headless- och headed-lägen, automatisk väntan på element, nätverksinterception och skärmdumps-/PDF-fångst.
Viktiga funktioner:
- Stöd för Python, JavaScript/TypeScript, Java och .NET
- Headless- och headed-lägen för webbläsare
- Automatisk väntan på element, nätverksinterception
- Gratis och öppen källkod
Fördel för Craigslist: Playwright kan efterlikna verkligt användarbeteende mer övertygande än rena HTTP-förfrågningar, vilket minskar risken för blockering. Reddit-communityns inställning lutar konsekvent åt Playwright framför Selenium för nya projekt.
Dolda kostnader: Samma som för Scrapy — proxykostnader, hosting och underhåll när selektorer går sönder.
Bäst för: Utvecklare som behöver detaljerad kontroll över webbläsaren, team som bygger skrapare för JavaScript-renderat innehåll, och alla som föredrar ett modernt alternativ till Selenium.
9. Selenium
Selenium är det långlivade och mycket använda ramverket för webbläsarautomation. Den senaste releasen är 4.43.0 (10 april 2026), och det fortsätter att bygga ut BiDi- och nätverkskontrollfunktioner.
Selenium stödjer flera språk (Python, Java, C#, JavaScript) och alla större webbläsare. Det kan simulera hela webbläsarsessioner, hantera inloggning vid behov och scrolla genom sidor. Men jämfört med Playwright är det långsammare, mer omständligt och lättare att upptäcka som bot utan extra stealth-bibliotek som undetected-chromedriver.
Viktiga funktioner:
- Stöd för flera språk (Python, Java, C#, JavaScript)
- Simulering av hela webbläsarsessioner
- Moget ekosystem med omfattande dokumentation
- Gratis och öppen källkod
Begränsningar: Communityn 2026 lutar mot Playwright för nya projekt. En Reddit-tråd noterade att Cloudflare fortfarande upptäckte Selenium, "även med residential proxies" — stealth är svårare direkt ur lådan.
Bäst för: Utvecklingsteam som redan är investerade i Selenium och inte vill migrera, projekt som behöver stöd för flera språk (Java, C#), och äldre skrapningsupplägg.
10. BeautifulSoup
BeautifulSoup är ett lättviktigt Python-bibliotek för att tolka HTML och XML. Den aktuella PyPI-versionen är 4.14.3 (30 november 2025).
En viktig precisering: BeautifulSoup är en parser, inte en fullständig skrapare. Den hämtar inte webbsidor och hanterar inte webbläsarautomation. Du parar ihop den med biblioteket requests för HTTP-hämtning, och den tolkar HTML:en du ger den. Det gör den till den enklaste startpunkten för utvecklare, men också den mest begränsade.
Viktiga funktioner:
- Extremt lätt att lära sig — minimal kod krävs
- Bra för småskaliga eller engångs-skrapningar av Craigslist
- Gratis och öppen källkod
Begränsningar: Ingen inbyggd hantering av paginering, ingen JavaScript-rendering, ingen proxyrotation — allt måste läggas till manuellt. Om Craigslist ändrar sin HTML-struktur går selektorerna sönder och du får fixa dem för hand.
Bäst för: Python-nybörjare som vill testa Craigslist-skrapning med minimal setup, snabba engångsuttag från en enskild kategori eller region, och utvecklare som bara behöver en lättviktig parser.
Anti-ban-spelplanen för Craigslist: proxies, rate limits och vad som gör att du blockeras
Det här är avsnittet som de flesta guider om Craigslist-skrapning hoppar över, och det är det som betyder mest. Scraperlys testning från april 2026 klassar Craigslist som ett mål med 3/5 i svårighetsgrad, med hänvisning till anpassad CAPTCHA, begränsning av förfrågningar och IP-blockering. Bright Datas guide styr användare mot Web Unlocker eller en Playwright-baserad Scraping Browser i stället för vanliga HTTP-anrop. Oxylabs proxiesida säger att Craigslist kan upptäcka proxies och att residential proxies är det bästa valet.
Det här fungerar faktiskt:
| Strategi | Effektivitet på Craigslist | Kostnad | Komplexitet |
|---|---|---|---|
| Residential proxies | ✅ Hög | $$ ($4–6/GB) | Medel |
| ISP-proxies | ✅ Hög | $ ($0,60–0,80/IP) | Medel |
| Datacenter-proxies | ⚠️ Låg (blockeras ofta) | $ ($0,20–0,40/IP) | Låg |
| Browser-baserad skrapning (egen session) | ✅ Medel-hög | Gratis | Låg |
| Rate limiting + slumpmässiga fördröjningar | ✅ Nödvändig basnivå | Gratis | Låg |
Praktiska tips:
- Fördröjningar mellan förfrågningar: minst 2–5 sekunder mellan varje request. Scraperly rekommenderar att ligga runt 5–10 requests/minut per IP och rotera efter 20–30 requests.
- Sessionsrotation: rotera user agents och browser fingerprints. Förutsägbara crawlmönster upptäcks snabbt.
- Undvik datacenter-proxies: De är billiga men blockeras snabbt på Craigslist.
- Browser-baserad skrapning tar bort proxyproblemet helt för måttliga volymer. Thunderbits browser-läge körs i din egen Chrome-session — ingen proxyuppsättning, ingen IP-rotation, ingen kostnad. För de flesta affärsanvändare som skrapar några hundra annonser räcker det mer än väl.
Och här är underhållsaspekten som många missar: när Craigslist ändrar sin CSS (och det gör den med jämna mellanrum) går varje CSS-selector-baserad skrapare sönder. Du måste inspektera sidan, hitta de nya selektorerna, uppdatera koden och testa igen. AI-drivna verktyg som Thunderbit undviker detta helt — AI:n läser sidstrukturen på nytt varje gång, så layoutändringar bryter inte arbetsflödet.
Kod eller utan kod: två kompletta genomgångar av Craigslist-skrapning
Jag vet att publiken för den här artikeln är ungefär 50/50 uppdelad: icke-tekniska affärsanvändare som bara vill ha datan, och nybörjare till mellannivå-utvecklare som vill ha fungerande kod. Så här är båda spåren, sida vid sida.
Utan kod: så skrapar du Craigslist med Thunderbit (steg för steg)
- Installera Thunderbit Chrome Extension från Chrome Web Store.
- Gå till en Craigslist-listningssida — till exempel lägenheter i din stad (
https://yourcity.craigslist.org/search/apa). - Klicka på "AI Suggest Fields" — Thunderbits AI läser sidan och föreslår kolumner anpassade efter kategorin. För bostäder ser du titel, pris, kvadratmeter, sovrum, plats, publiceringsdatum och länk.
- Granska och justera de föreslagna kolumnerna vid behov. Lägg till eller ta bort fält med ett klick.
- Klicka på "Scrape" — se hur datan fylls i i en strukturerad tabell.
- Hantera paginering — klicka dig igenom sidorna eller låt Thunderbit göra det.
- Använd "Scrape Subpages" för att besöka varje enskild annons och berika med detaljsidesfält: full beskrivning, alla bilder, inbäddad kontaktinfo.
- Exportera till Google Sheets, Excel, Airtable, Notion eller CSV — gratis.
Hela processen tar ungefär 2 minuter för en resultatsida. Inga CSS-selektorer, inga proxies, ingen kod.
Kodvägen: så skrapar du Craigslist med Python + Playwright
Playwright är det mest rekommenderade biblioteket för Craigslist-skrapning i utvecklarforum 2026. Här är ett fungerande Python-snippet som skrapar en resultatsida för bostäder på Craigslist, extraherar titel/pris/länk, hanterar paginering och skriver ut resultat.
Upplägget: försök först med strukturerad JSON-LD-data (Craigslist bäddar in ItemList-schema på vissa sidor), och fall tillbaka till DOM-selektorer vid behov. Paginera med s=120.
import asyncio, json
from urllib.parse import urlparse, parse_qs, urlencode, urlunparse
from playwright.async_api import async_playwright
def next_page_url(url, step=120):
p = urlparse(url)
qs = parse_qs(p.query)
offset = int(qs.get("s", ["0"])[0]) + step
qs["s"] = [str(offset)]
return urlunparse((p.scheme, p.netloc, p.path, "", urlencode(qs, doseq=True), ""))
async def scrape_page(page, url):
await page.goto(url, wait_until="domcontentloaded")
await page.wait_for_timeout(1500)
data = []
# Försök med JSON-LD först
for raw in await page.locator('script[type="application/ld+json"]').all_text_contents():
try:
obj = json.loads(raw)
except Exception:
continue
if isinstance(obj, dict) and obj.get("@type") == "ItemList":
for item in obj.get("itemListElement", []):
thing = item.get("item", {})
data.append({
"title": thing.get("name"),
"price": thing.get("offers", {}).get("price"),
"link": thing.get("url"),
})
if data:
return data
# Fallback: DOM-selektorer
cards = page.locator("div.cl-search-result, li.cl-static-search-result")
count = await cards.count()
for i in range(count):
card = cards.nth(i)
title = await card.locator("a.posting-title, a.titlestring").first.text_content()
link = await card.locator("a.posting-title, a.titlestring").first.get_attribute("href")
price = (await card.locator(".price, .result-price").first.text_content()
if await card.locator(".price, .result-price").count() else None)
data.append({"title": (title or "").strip(), "price": (price or "").strip(), "link": link})
return data
async def main():
start_url = "https://newyork.craigslist.org/search/apa?query=studio"
async with async_playwright() as p:
browser = await p.chromium.launch(headless=True)
page = await browser.new_page()
url = start_url
all_rows = []
for _ in range(3): # skrapa 3 sidor
rows = await scrape_page(page, url)
if not rows:
break
all_rows.extend(rows)
url = next_page_url(url)
await browser.close()
for row in all_rows[:10]:
print(row)
asyncio.run(main())
Det du behöver utöver skriptet: Playwright installerat (pip install playwright && playwright install), proxykonfiguration för högvolymskörningar och manuell CAPTCHA-hantering om du når rate limits. Det är avvägningen: full kontroll, men fullt ansvar.
Gratis vs betalt: ärlig kostnadsbild för varje Craigslist-skrapare
Det här är tabellen jag önskar att jag hade när jag började undersöka ämnet. "Gratis" är ett laddat ord inom webskrapning.
| Verktyg | Helt gratis? | Begränsningar i gratisnivå | Startpris för betalt | Dolda kostnader |
|---|---|---|---|---|
| Thunderbit | Gratis nivå (6 sidor) | 6 sidor/mån; gratis test = 10 sidor | Betalda planer för högre volym | Inga — export är gratis |
| Scrapy | ✅ Öppen källkod | Obegränsat | $0 | Proxykostnader, hosting, underhåll |
| BeautifulSoup | ✅ Öppen källkod | Obegränsat | $0 | Proxykostnader, hosting, underhåll |
| Playwright | ✅ Öppen källkod | Obegränsat | $0 | Proxykostnader, hosting, underhåll |
| Selenium | ✅ Öppen källkod | Obegränsat | $0 | Proxykostnader, hosting, underhåll |
| ParseHub | Gratis nivå | 5 projekt | ~ $189/mån | Begränsade schemalagda körningar på gratisnivån |
| Apify | Gratis nivå | $5/mån i gratis credits | ~ $49/mån | Prissättning per beräkning kan sticka iväg |
| Phantombuster | Gratis nivå | 5 platser, 2 h/mån, export upp till 10 rader | ~ $56/mån (årsvis) | Prissättning per plats |
| Bright Data | Bara testversion | 1 000 förfrågningar/1 vecka | ~ $500+/mån | Proxykostnader tillkommer |
| Oxylabs | Bara testversion | 2 000 resultat / 1 GB | ~ $75+/mån (Unblocker) | Enterprise-prissättning |
Den stora asterisken för "gratis" i verktyg med öppen källkod: Scrapy, Playwright, Selenium och BeautifulSoup kostar $0 att installera, men att köra dem i stor skala på Craigslist innebär timmar av utvecklartid för installation, $50–500+/månad för residential proxies och löpande underhåll varje gång Craigslist ändrar sin HTML. Thunderbits AI läser sidan på nytt varje gång (inget underhåll), export är gratis och browser-baserad skrapning eliminerar proxykostnader för måttliga volymer. Det är en verklig fördel för icke-utvecklare.
Vad du faktiskt kan extrahera: Craigslist-datafält per kategori
Olika Craigslist-kategorier har helt olika datastrukturer. En bostadsannons ser inte alls ut som ett jobbannonsinlägg. Här är vad du realistiskt kan extrahera från varje större sektion:
| Craigslist-kategori | Fält som kan extraheras | Kontaktinfo tillgänglig? |
|---|---|---|
| Bostäder / lägenheter | Titel, pris, kvadratmeter, sovrum, badrum, plats, datum, bilder, beskrivning, kartlänk, tillgänglighet, husdjurspolicy, tvätt/tvättstuga/parkering | ⚠️ Ibland (anonymiserad e-postrelä) |
| Till försäljning | Titel, pris, skick, plats, datum, bilder, beskrivning, fabrikat/modell/år (varierar) | ⚠️ Ibland |
| Jobb | Titel, företag, ersättning, plats, jobbt typ, erfarenhetsnivå, datum, beskrivning | Sällan (oftast bara ansökningslänk) |
| Tjänster | Titel, plats, beskrivning, bilder | ⚠️ Ibland |
| Gig | Titel, ersättning, plats, datum, beskrivning | ⚠️ Ibland |
Några viktiga saker att tänka på:
- Kontaktinfo: Craigslist använder anonymiserade e-postreläer just för att förhindra direkt e-postskrapning. Verktyg som påstår sig "extrahera e-post" hämtar ofta reläadressen (
reply+randomstring@craigslist.org), inte den riktiga e-postadressen från den som lagt ut annonsen. - Fält från detaljsidor som full beskrivning, alla bilder och inbäddad kontaktinfo finns bara när du besöker varje enskild annons — inte på resultatsidan.
- Thunderbits "AI Suggest Fields" upptäcker automatiskt vilka fält som finns på den aktuella sidan och föreslår rätt kolumnstruktur. En användare som skrapar bostäder får kolumner för kvadratmeter och sovrum; en användare som skrapar jobb får kolumner för ersättning och jobbt typ — utan manuell konfigurering. Dess skrapning av undersidor besöker sedan varje annons för att hämta fält som bara finns på detaljsidan.
Juridisk verklighetscheck: Craigslist TOS, 3Taps-fallet och vad du bör veta
Jag är inte jurist, och detta är inte juridisk rådgivning. Men jag vet att användare oroar sig för det här, och det förtjänar ett rakt svar.
Det centrala prejudikatet: I Craigslist v. 3Taps (2013) fick Craigslist ett föreläggande mot 3Taps för att ha skrapat och publicerat annonser igen efter ett cease-and-desist-brev. 3Taps ska enligt uppgift ha kringgått IP-blockeringar med proxyservrar, och domstolen betraktade åtkomst efter blockering som potentiellt "utan auktorisation". EFF noterade att målet nådde en förlikning 2015.
Craigslist användarvillkor förbjuder uttryckligen användning av "robots, spiders, scripts, scrapers, crawlers, or any automated or manual equivalent" för att interagera med sajten. De anger till och med skadestånd på $0,25 per sida efter de första 1 000 sidvisningarna under en 24-timmarsperiod vid överträdelser.
Praktisk vägledning:
- ✅ Skrapa offentligt tillgänglig annonsdata för marknadsanalys eller personligt bruk
- ✅ Respektera robots.txt och rate limits
- ⚠️ Publicera inte stora mängder skrapade annonser på nytt
- ⚠️ Använd inte skrapad kontaktinfo för oönskad marknadsföring
- ❌ Försök inte kringgå tekniska åtkomstbegränsningar efter att du blivit blockerad
Skillnaden är viktig: att skrapa offentligt synlig data för egen analys är inte samma sak som att återpublicera i stor skala eller samla in e-post för spam. Men var medveten om att Craigslist historiskt har gått från villkorspåföljder till IP-blockering till rättsliga åtgärder.
Vilken Craigslist-skrapare är bäst för dig?
Efter att ha testat och utvärderat alla 10 är här min rekommendation utifrån scenario:
- Icke-teknisk affärsanvändare som behöver Craigslist-data snabbt → Thunderbit. Ingen kod, AI-baserad fältdetektering, inget underhåll, gratis export. Den snabbaste vägen från "jag behöver den här datan" till "den finns i mitt kalkylblad".
- Enterprise-team som skrapar tusentals annonser dagligen i alla regioner → Bright Data. Craigslist-specifik skrapare, massiv proxyinfrastruktur, automatisk CAPTCHA-lösning, dedikerad support.
- Utvecklingsteam som behöver hanterad API-/proxyinfrastruktur → Oxylabs för proxy-first-arbetsflöden, Apify för flexibilitet via actor-marknadsplatsen.
- Utvecklare som vill ha full kontroll och anpassning → Scrapy + Playwright. Öppen källkod, maximal flexibilitet, men du får stå för proxies och underhåll.
- Budgetmedveten användare med måttliga behov → Apifys gratisnivå ($5/mån i credits) eller ParseHubs gratisnivå (5 projekt).
- Säljteam som redan använder verktyg för leadgenerering över flera plattformar → Phantombuster. Lägg till Craigslist i din befintliga pipeline.
- Python-nybörjare som gör en engångsskrapning → BeautifulSoup + requests. Minimal kod, minimal setup, minimal kapacitet.
För de flesta icke-tekniska affärsanvändare erbjuder Thunderbit den bästa balansen mellan enkelhet, träffsäkerhet och kostnad. För utvecklare är Scrapy + Playwright den mest kraftfulla kombinationen. För enterprise-skala är Bright Data svårt att slå.
Om du vill se hur AI-driven Craigslist-skrapning faktiskt ser ut, testa Thunderbit — gratisnivån räcker för att prova på ditt eget användningsfall. Och om du vill gå djupare in på tekniker för webskrapning kan du kolla våra guider om hur man skrapar in i Google Sheets, bästa automatiserade webskrapningsverktyg och webskrapning utan att bli blockerad. Du kan också utforska vår YouTube-kanal för steg-för-steg-videogenomgångar.
Lycka till med skrapandet — och må din data alltid vara ren, strukturerad och redo att användas.
Vanliga frågor
Är det lagligt att skrapa Craigslist-annonser?
Craigslists användarvillkor förbjuder uttryckligen automatiserad skrapning, och Craigslist v. 3Taps-fallet är det ledande juridiska prejudikatet. Att skrapa offentligt annonsmaterial för personligt eller analytiskt bruk behandlas i allmänhet annorlunda än masspublicering eller spam, men du bör alltid respektera rate limits och sajtens regler — och detta är inte juridisk rådgivning.
Kan jag skrapa Craigslist utan att koda?
Ja. Verktyg som Thunderbit, ParseHub och Apify erbjuder kodfria eller lågkodsalternativ för att extrahera Craigslist-data. Thunderbits AI-baserade fältdetektering gör det särskilt enkelt — klicka bara på "AI Suggest Fields" och "Scrape".
Vilken är den bästa gratis Craigslist-skraparen?
För utvecklare är Scrapy eller BeautifulSoup helt gratis och med öppen källkod (även om proxy- och underhållskostnader tillkommer). För icke-kodare är Thunderbits gratisnivå (6 sidor/månad) den bästa startpunkten, med ParseHubs gratisnivå (5 projekt) som ett annat alternativ.
Hur undviker jag att bli blockerad när jag skrapar Craigslist?
Använd rate limiting (minst 2–5 sekunders fördröjning), rotera user agents, undvik datacenter-proxies (residential- eller ISP-proxies fungerar mycket bättre på Craigslist) och följ inte förutsägbara crawlmönster. För måttliga volymer kringgår browser-baserade verktyg som Thunderbit proxyproblemet helt genom att köras i din egen Chrome-session.
Kan jag skrapa alla Craigslist-regioner på en gång?
Med utvecklarverktyg som Scrapy eller Playwright kan du programmässigt loopa igenom alla 416 regionala URL:er för USA/territorier. Enterprise-verktyg som Bright Data och Oxylabs har stöd för skrapning i flera regioner inbyggt. Med Thunderbit kan du öppna varje regional sajt och skrapa med samma arbetsflöde — AI:n anpassar sig automatiskt till varje sida.
Testa Thunderbit för Craigslist-skrapning Get Started Free
Läs mer


