10 nejlepších Craigslist scraperů, které v roce 2026 stále fungují

Poslední aktualizace April 24, 2026
10 nejlepších Craigslist scraperů, které v roce 2026 stále fungují

Craigslist vypadá, jako by se od roku 2003 vůbec nezměnil, ale data ukrytá v těchto jednoduchých textových inzerátech jsou překvapivě cenná. S ~127 miliony měsíčních návštěv a desítkami milionů nových příspěvků měsíčně jde pořád o jednu z největších inzerčních platforem v USA — a veřejné API, které by se dalo použít, neexistuje.

Strávil jsem roky vývojem automatizačních nástrojů v Thunderbit a jednu věc od obchodních, provozních i realitních týmů slyším pořád dokola: „Potřebuju data z Craigslistu do tabulky a nechci u toho tři hodiny kopírovat a vkládat.“ Problém je, že většina průvodců typu „nejlepší Craigslist scraper“ je buď zastaralá, vynechává ty nejtěžší části (třeba ochranu proti botům), nebo jen vyjmenuje nástroje bez skutečného srovnání.

Dal jsem proto dohromady tohoto průvodce s 10 nástroji, které v roce 2026 opravdu pořád fungují — od no-code rozšíření do Chromu přes enterprise proxy platformy až po open-source Python knihovny. Ať už jste byznys uživatel, který nikdy nenapsal ani řádek kódu, nebo vývojář, který přemýšlí v Pythonu, najdete si tu něco pro sebe.

Proč v roce 2026 scrapovat Craigslist? Hlavní případy použití pro byznys týmy

Craigslist může působit staromódně, ale právě v tom je jeho kouzlo — a jeho hodnota. Stále se umisťuje na 3. místě celosvětově mezi weby s inzeráty a provozuje 416 amerických a teritoriálních sekcí ve svém oficiálním adresáři. To je obrovské množství hyperlokální nabídky, která jinde v jednom místě prostě neexistuje.

Tady jsou případy použití, ke kterým se týmy vracejí znovu a znovu:

  • Generování leadů: Příspěvky v sekcích služby a práce na zakázku často obsahují popis firmy, lokalitu a kontaktní cestu přes Craigslist relay — obchodním týmům to stačí k vytvoření seznamu lokálních leadů.
  • Monitoring realit: Stránky s bydlením zobrazují nájem, čtvrť, počet pokojů/koupelen, výměru a časové razítko — ideální pro porovnání nájmů a sledování dostupnosti.
  • Sledování konkurence v cenách: Inzeráty v sekci prodej ukazují název, cenu, stav a lokalitu, což je skvělé pro průzkum dalšího prodeje nebo arbitráže.
  • Nábor a monitoring trhu práce: Kategorie práce a zakázky zobrazují odměnu, typ úvazku a popis role pro lokální analýzu trhu talentů.
  • Analýza trhu napříč regiony: Protože je Craigslist rozdělený podle subdomén a měst, můžete region po regionu zjišťovat ceny, objem nebo skladbu kategorií.
  • Automatizace workflow: Mnoho uživatelů prostě potřebuje dostávat data z Craigslistu do CSV, Google Sheets, Airtable nebo CRM — bez ručního procházení webu.

Jeden uživatel uvedl, že každodenní scrapování Craigslistu, které dřív zabralo 60–90 minut, se s automatizací smrsklo zhruba na 5 minut. To je přesně ten typ úspory času, který se rychle nasčítá.

Scrapujte data z Craigslistu pomocí AI Get Started Free

Jak jsme vybírali nejlepší Craigslist scrapery: naše hodnoticí kritéria

Ne všechny Craigslist scrapery jsou stejné a „nejlepší“ nástroj hodně závisí na tom, kdo jste a co potřebujete. Každý nástroj jsem hodnotil podle šesti hledisek:

  1. Snadnost nastavení — je vhodný pro začátečníky (no-code), nebo vyžaduje vývojáře?
  2. Zvládání anti-bot ochrany Craigslistu — obsahuje vestavěné střídání proxy, řešení CAPTCHA nebo browser fingerprinting?
  3. Cenová úroveň — zdarma, freemium, placené, nebo enterprise?
  4. Možnosti exportu dat — CSV, Excel, Google Sheets, Airtable, Notion, JSON, databáze?
  5. Podpora více regionů — umí scrapovat napříč všemi 416 americkými weby Craigslistu, nebo jen jedno město po druhém?
  6. Náročnost údržby — rozbije se nástroj, když Craigslist změní rozložení stránky, nebo se přizpůsobí automaticky?

Žádný konkurenční článek, který jsem našel, nenabízí srovnání těchto nástrojů vedle sebe podle stejných kritérií — takže pokud vás frustrují vágní seznamy „top 10“, tohle je pro vás.

10 nejlepších Craigslist scraperů na první pohled

Než se pustíme do detailů jednotlivých nástrojů, tady je hlavní srovnávací tabulka. Rozdělil jsem je do tří skupin: no-code nástroje pro byznys uživatele, enterprise platformy pro škálování a open-source knihovny pro vývojáře.

NástrojTypZdarma verze?Podpora proxy / anti-botZpracování CAPTCHAFormáty exportuNejlepší pro
ThunderbitNo-code rozšíření do ChromuAno (6 stránek/měs.)Režim prohlížeče (pro běžné běhy není potřeba proxy)N/A (relace v prohlížeči)Excel, Sheets, Airtable, Notion, CSV, JSONNe-technické firemní uživatele
Bright DataEnterprise scraper + proxy + datasetZkušební verzeSpravované odblokování, proxy, opakování pokusů, renderingAno (automatické řešení)JSON, NDJSON, CSV, Parquet, XLSX, APISběr ve velkém měřítku
OxylabsAPI + proxy stackZkušební verzeSpravované odblokování, rezidenční/ISP proxyAnoHTML, screenshot, výstupy přes APIVývojáře, kteří potřebují enterprise infrastrukturu
ApifyCloud marketplace actorůAno ($5/měs. v kreditech)Střídání proxy (závisí na actorovi)Částečně / podle actoruJSON, CSV, XML, Excel, JSONLFlexibilní low-code cloud automatizaci
ParseHubNo-code vizuální scraperAnoPlacení proxy rotace, cloud běhyNení hlavní funkcíCSV, JSON, API/S3/Dropbox (placené)Uživatelé no-code s menším rozpočtem
PhantombusterCloudová automatizační platformaAno (omezeně)Podpora proxy existujeKredity / podle workflowCSV, JSON (placené)Víceplatformní obchodní automatizaci
ScrapyOpen-source Python crawlerZdarma (OSS)Vlastní proxy/middlewareNeJSON, JSONL, CSV, XML, DBProdukční crawlery
PlaywrightOpen-source automatizace prohlížečeZdarma (OSS)Vlastní prohlížeč/proxyNeVlastní exportKontrolu na úrovni prohlížeče
SeleniumOpen-source automatizace prohlížečeZdarma (OSS)Vlastní prohlížeč/proxyNeVlastní exportStarší multi-language stacky
BeautifulSoupOpen-source HTML parserZdarma (OSS)Sám o sobě žádnouNeVlastní exportLehký parsing

Tady se jasně ukazují tři směry:

  • No-code nástroje (Thunderbit, ParseHub, Phantombuster) pro byznys uživatele, kteří chtějí data bez inženýrské režie.
  • Enterprise platformy (Bright Data, Oxylabs, Apify) pro týmy, které potřebují škálování, anti-bot infrastrukturu a spravované doručování dat.
  • Open-source nástroje pro vývojáře (Scrapy, Playwright, Selenium, BeautifulSoup) pro maximální kontrolu — za cenu nastavení, údržby a správy proxy.

A teď podrobnosti.

1. Thunderbit

thunderbit-ai-web-scraper.webp Thunderbit je AI rozšíření do Chromu určené pro lidi, kteří chtějí strukturovaná data z libovolného webu — včetně Craigslistu — bez psaní kódu nebo konfigurace proxy.

Tady jsem trochu zaujatý, protože jsme ho vytvořili my, ale důvod, proč dávám Thunderbit na první místo, je jednoduchý: řeší konkrétní bolesti, které scrapování Craigslistu přináší netechnickým uživatelům — proměnlivé rozložení stránek napříč kategoriemi, obohacování detailních stránek a neustálé rozbíjení při změně CSS selektorů.

Jak funguje na Craigslistu:

  1. Nainstalujte si rozšíření Thunderbit do Chromu a otevřete libovolnou stránku s inzeráty Craigslistu (třeba byty ve vašem městě).
  2. Klikněte na „AI navrhne pole“ — Thunderbit AI přečte stránku a navrhne sloupce přizpůsobené tomu, co na ní skutečně je. U bydlení dostanete Název, Cena, Metráž, Počet ložnic, Lokalita, Datum zveřejnění, Odkaz. U práce dostanete Název, Odměna, Typ práce a podobně. Žádná ruční konfigurace selektorů.
  3. Klikněte na „Scrape“ a sledujte, jak se data naplní do strukturované tabulky.
  4. Zvládněte stránkování — Thunderbit funguje s klikacím stránkováním Craigslistu.
  5. Použijte „Scrape Subpages“ pro návštěvu každého jednotlivého inzerátu a získání polí jen z detailní stránky: plný popis, všechny obrázky, vložené kontaktní údaje a další.
  6. Exportujte do Google Sheets, Excelu, Airtable, Notion nebo CSV — zdarma.

Klíčové funkce:

  • AI detekce polí: Automaticky se přizpůsobí různým kategoriím Craigslistu — u bydlení získáte sloupce jako metráž/ložnice, u práce kompenzaci/typ práce, u prodeje stav/cenu. Žádné ruční CSS.
  • Scraping podstránek: Po vytažení výsledkové stránky navštíví každý inzerát a vytáhne pole z detailní stránky (plný popis, obrázky, kontaktní údaje).
  • Scraping v režimu prohlížeče: Běží ve vaší vlastní relaci Chromu, takže pro běžné objemy není potřeba proxy. Už jen to samo výrazně snižuje náklady i složitost.
  • Žádná údržba: AI pokaždé znovu přečte stránku. Když Craigslist změní rozložení (a dělá to), váš scraper se nerozbije.
  • Bezplatný export: Excel, Google Sheets, Airtable, Notion, CSV, JSON — exporty nejsou za paywallem.

Cenovka: Zdarma tarif (6 stránek/měsíc), zkušební verze (10 stránek), placené plány pro vyšší objem.

Nejlepší pro: Obchodní týmy, které scrapují leady z Craigslistu ze sekcí služby a zakázky, realitní týmy sledující nájmy, provozní týmy, které potřebují strukturovaná data z Craigslistu bez podpory vývojáře, a kohokoli, kdo chce data scrapovat, označovat a exportovat v jednom kroku.

Vyzkoušejte Thunderbit pro scrapování Craigslistu

2. Bright Data

Screenshot 2026-04-22 at 12.27.50 PM_compressed.webp Bright Data je těžkotonážní enterprise volba. Je to jediná platforma v tomto seznamu, která má jak vyhrazenou produktovou stránku Craigslist Scraper, tak tržiště s Craigslist Dataset.

Pokud potřebujete denně scrapovat tisíce Craigslist inzerátů napříč všemi regiony v USA, Bright Data je na takové měřítko stavěná. Její Web Unlocker řeší IP adresy, opakování pokusů, rendering i blokování — včetně automatického řešení CAPTCHA ve výchozím nastavení. Web Scraper IDE vám umožní vytvářet vlastní workflow pro sběr dat z Craigslistu a programově procházet všech 416 regionálních URL.

Klíčové funkce:

  • Obrovská síť rezidenčních proxy (miliony IP adres)
  • Vestavěné řešení CAPTCHA a obcházení anti-bot ochrany
  • Produkty pro Craigslist scraper i dataset
  • Export: JSON, NDJSON, CSV, Parquet, XLSX, doručení přes API, webhooky

Cena: Craigslist scraper stojí 0,5 USD za 1 000 načtení stránek podle spotřeby, s tarify jako 380 tisíc načtení stránek za 499 USD. Rezidenční proxy začínají na 4 USD/GB podle spotřeby. K dispozici je bezplatná zkušební verze na 1 000 požadavků na jeden týden.

Nejlepší pro: Enterprise týmy, které potřebují vysoký objem, více regionů a zaručenou dostupnost i specializovanou podporu. Menší týmy citlivé na rozpočet by se měly poohlédnout jinde.

3. Oxylabs

oxylabs-data-for-ai-proxies.webp Oxylabs je prémiový poskytovatel proxy a scrapingové infrastruktury s vyhrazeným Craigslist Scraper API a stránkou s Craigslist proxy.

Oxylabs je víc orientovaný na vývojáře než all-in-one přístup Bright Data. Jeho Web Scraper API a Web Unblocker podporují renderování JS, opakování pokusů, správu session, generování fingerprintu a širší anti-bot ochranu. Bezplatná zkušební verze Craigslist Scraper API jde až na 2 000 výsledků.

Klíčové funkce:

  • Rezidenční a ISP proxy pooly (rezidenční od 6 USD/GB, ISP od 0,60 USD/IP)
  • Web Unblocker s automatickým fingerprintem a správou session
  • Vyhrazený endpoint pro Craigslist API
  • 7denní zkušební verze zdarma

Cena: API pro scraper „ostatních webů“ začíná zhruba na 0,15 USD/1 000 výsledků bez JS, 0,35 USD/1 000 s JS. Mikrotarif Web Unblocker začíná přibližně na 75 USD/měsíc. Rezidenční proxy ve velkém měřítku mohou při 1 TB vyjít na 0,50 USD/GB.

Nejlepší pro: Vývojářské týmy, které chtějí spravovanou proxy infrastrukturu a workflow přes API pro dlouhodobé scrapování Craigslistu. Týmy už používající proxy Oxylabs pro jiné projekty přidají Craigslist snadno.

4. Apify

apify-web-data-scrapers.webp Apify je cloudová platforma pro web scraping a automatizaci s tržištěm předpřipravených „actorů“ — tedy scraper šablon, které můžete spustit bez psaní kódu.

Situace kolem Craigslistu na Apify je zajímavá: existuje několik komunitně spravovaných Craigslist actorů s hodně rozdílnou kvalitou. Actor ivanvs/craigslist-scraper má 829 celkových uživatelů a hodnocení 5,0, zatímco automation-lab/craigslist-scraper má 44 uživatelů a hodnocení 1,0. Kvalita je nevyrovnaná, takže před závazkem je potřeba testovat.

Klíčové funkce:

Cena: Zdarma tarif s kredity 5 USD/měsíc, placené plány od cca 49 USD/měsíc. Ceny podle výpočetních jednotek mohou při vyšším využití vyskočit — hlídejte si spotřebu CU.

Nejlepší pro: Týmy, které chtějí cloudové řešení bez správy infrastruktury, uživatele pohodlné s low-code konfigurací a týmy, které potřebují plánované, opakované scrapování Craigslistu.

5. ParseHub

parsehub.com-homepage-1920x1080_compressed.webp ParseHub je desktopový vizuální nástroj pro web scraping, kde na prvky na stránce klikáte a určujete, co se má vytáhnout.

Při nastavování scrapingu Craigslistu v ParseHub klikáte na názvy inzerátů, ceny a odkazy, abyste nástroj naučili, co má sbírat. Stránkování zvládá přes AJAX click loop a na placených tarifech podporuje cloudové běhy. Zdarma tarif nabízí až 5 projektů, což pro menší práci s Craigslistem stačí.

Klíčové funkce:

  • Vizuální workflow builder typu point-and-click
  • Zvládání stránkování a dynamického obsahu
  • Cloudové běhy a plánování na placených tarifech
  • Export: CSV, Excel, JSON

Cena: Zdarma tarif (5 projektů), placené plány od cca 189 USD/měsíc pro více stránek a plánované běhy.

Omezení: Může být pomalý při rozsáhlém scrapování, na bezplatném tarifu má omezený počet plánovaných běhů a — co je zásadní — je založený na CSS selektorech, takže při změně rozložení Craigslistu vyžaduje ruční údržbu.

Nejlepší pro: Jednotlivce nebo malé týmy se středními nároky na scraping, kteří chtějí vizuální no-code nástroj, ale nepotřebují AI detekci polí.

6. Phantombuster

phantombuster-website-screenshot.webp Phantombuster je cloudová automatizační platforma, která původně získala popularitu pro scraping LinkedInu a sociálních sítí. Není to nativní nástroj pro Craigslist, ale jeho Web Element Extractor umí scrapovat veřejné stránky pomocí CSS selektorů.

Nastavení scrapingu Craigslistu v Phantombusteru je pracnější než u specializovaného nástroje — musíte určit selektory, sestavit workflow a nastavit plánování. Pokud ale už Phantombuster používáte pro LinkedIn nebo generování leadů ze sociálních sítí, přidat Craigslist do pipeline je jednoduché.

Klíčové funkce:

  • Předpřipravené automatizační šablony a cloudové spuštění
  • Plánování a integrace s CRM
  • Podpora proxy a kredity na řešení CAPTCHA k dispozici
  • Export: CSV, JSON na placených tarifech (zdarma tarif omezuje export na 10 řádků)

Cena: Zdarma tarif s 5 sloty, 2 hodinami měsíčně a limitem exportu 10 řádků. Roční placené tarify začínají přibližně na 56 USD/měsíc při roční fakturaci.

Nejlepší pro: Obchodní týmy, které už Phantombuster používají pro vícekanálové generování leadů a chtějí do workflow přidat Craigslist.

7. Scrapy

scrapy.org-homepage-1920x1080_compressed.webp Scrapy je nejpopulárnější open-source Python framework pro web scraping a je jasnou volbou pro vývojářské týmy, které chtějí maximální kontrolu nad crawlingem Craigslistu.

Nejnovější stabilní verze je 2.15.0 (9. dubna 2026). Scrapy podporuje crawling napříč regiony (procházení všech regionálních URL), vestavěné plánování a throttling požadavků, downloader middleware pro rotaci proxy a feed exporty do CSV, JSON, JSONL, XML i databázových pipeline. Plugin scrapy-playwright přidává renderování na úrovni prohlížeče, když je potřeba.

Klíčové funkce:

  • Vysoce přizpůsobitelný crawler produkční úrovně
  • Middleware pro proxy, opakování pokusů, cookies a střídání user-agentů
  • Feed exporty: JSON, JSONL, CSV, XML, databázové pipeline
  • Zdarma a open-source

Skryté náklady: Samotné Scrapy je zdarma, ale provoz ve velkém na Craigslistu znamená proxy předplatné (50–500+ USD/měsíc), hosting/serverové náklady a průběžnou údržbu při změně HTML struktury Craigslistu.

Nejlepší pro: Vývojářské týmy se zkušeností v Pythonu, které potřebují maximální flexibilitu, vlastní proxy infrastrukturu a vysoký objem crawlerů napříč regiony.

8. Playwright

playwright.dev-homepage-1920x1080_compressed.webp Playwright je moderní knihovna pro automatizaci prohlížeče od Microsoftu, která programově ovládá Chromium, Firefox a WebKit. Aktuální tempo vydávání je aktivní — v1.59.1 vyšla 1. dubna 2026.

V komunitách vývojářů je Playwright u scrapingu Craigslistu čím dál častěji doporučovanou volbou místo Selenium. Je rychlejší, spolehlivější a díky komunitním pluginům jako playwright-extra má i lepší stealth proti detekci. Podporuje headless i viditelný režim, automatické čekání na prvky, zachytávání síťové komunikace a ukládání screenshotů/PDF.

Klíčové funkce:

Výhoda pro Craigslist: Playwright dokáže napodobit chování skutečného uživatele přesvědčivěji než obyčejné HTTP požadavky, což snižuje riziko blokace. Názory na Redditu dlouhodobě favorizují Playwright před Selenium pro nové projekty.

Skryté náklady: Stejné jako u Scrapy — proxy náklady, hosting a údržba, když se rozbijí selektory.

Nejlepší pro: Vývojáře, kteří potřebují jemně řízené ovládání prohlížeče, týmy stavějící scrapery pro obsah renderovaný JavaScriptem a kohokoli, kdo preferuje moderní alternativu k Selenium.

9. Selenium

selenium.dev-homepage-1920x1080_compressed.webp Selenium je dlouholetý a široce používaný framework pro automatizaci prohlížeče. Nejnovější vydání je 4.43.0 (10. dubna 2026) a nadále rozšiřuje možnosti BiDi a řízení sítě.

Selenium podporuje více jazyků (Python, Java, C#, JavaScript) a všechny hlavní prohlížeče. Umí simulovat plné relace v prohlížeči, zvládnout přihlášení, pokud je potřeba, a procházet stránky scrollováním. Ve srovnání s Playwrightem je ale pomalejší, ukecanější a snadněji se jako bot odhalí bez dalších stealth knihoven typu undetected-chromedriver.

Klíčové funkce:

  • Podpora více jazyků (Python, Java, C#, JavaScript)
  • Simulace plné relace v prohlížeči
  • Zralý ekosystém s rozsáhlou dokumentací
  • Zdarma a open-source

Omezení: Nálada komunity v roce 2026 se u nových projektů přiklání k Playwrightu. Jeden redditový thread poznamenal, že Cloudflare stále detekoval Selenium „i s použitím rezidenčních proxy“ — stealth je tu hůř dosažitelný už od základu.

Nejlepší pro: Vývojářské týmy, které už do Selenium investovaly a nechtějí migrovat, projekty vyžadující podporu více jazyků (Java, C#) a starší scrapingová řešení.

10. BeautifulSoup

crummy.com-homepage-1920x1080_compressed.webp BeautifulSoup je lehká Python knihovna pro parsování HTML a XML. Aktuální verze na PyPI je 4.14.3 (30. listopadu 2025).

Důležité upřesnění: BeautifulSoup je parser, ne plnohodnotný scraper. Nestahuje webové stránky ani neřeší automatizaci prohlížeče. Spojujete ho s knihovnou requests pro HTTP stahování a on jen parsuje HTML, které mu předáte. To z něj dělá nejjednodušší vstupní bod pro vývojáře, ale zároveň i nejomezenější nástroj.

Klíčové funkce:

  • Extrémně snadné naučení — vyžaduje minimum kódu
  • Skvělé pro malé nebo jednorázové scrapování Craigslistu
  • Zdarma a open-source

Omezení: Žádné vestavěné stránkování, žádné renderování JavaScriptu, žádná rotace proxy — vše je nutné doplnit ručně. Když Craigslist změní strukturu HTML, selektory se rozbijí a vy je opravujete ručně.

Nejlepší pro: Začátečníky v Pythonu, kteří si chtějí vyzkoušet scrapování Craigslistu s minimálním nastavením, rychlé jednorázové tahy dat z jedné kategorie nebo regionu a vývojáře, kteří potřebují jen lehký parser.

Plán proti blokaci Craigslistu: proxy, rate limits a co vás nechá zablokovat

Tohle je část, kterou většina průvodců scrapováním Craigslistu přeskočí, a přitom je nejdůležitější. Testování Scraperly z dubna 2026 řadí Craigslist mezi cíle obtížnosti 3/5, s odkazem na vlastní CAPTCHA, rate limiting a blokování IP adres. Tutoriál Bright Data vede uživatele spíš k Web Unlockeru nebo k Scraping Browseru postavenému na Playwrightu než k obyčejnému HTTP. Stránka Oxylabs s proxy uvádí, že Craigslist umí proxy detekovat a že rezidenční proxy jsou nejlepší volba.

Tohle skutečně funguje:

StrategieÚčinnost na CraigslistuCenaSložitost
Rezidenční proxy✅ Vysoká$$ (4–6 USD/GB)Střední
ISP proxy✅ Vysoká$ (0,60–0,80 USD/IP)Střední
Datacentrové proxy⚠️ Nízká (často blokované)$ (0,20–0,40 USD/IP)Nízká
Scraping v prohlížeči (vlastní relace)✅ Středně vysokáZdarmaNízká
Rate limiting + náhodné prodlevy✅ Základ nezbytnýZdarmaNízká

Praktické tipy:

  • Prodlevy mezi požadavky: Minimálně 2–5 sekund mezi jednotlivými requesty. Scraperly doporučuje držet se kolem 5–10 požadavků za minutu na jednu IP a rotovat po 20–30 požadavcích.
  • Rotace session: Střídejte user-agenty a fingerprinty prohlížeče. Předvídatelné crawl vzory se odhalí rychle.
  • Vyhněte se datacentrovým proxy: Jsou levné, ale na Craigslistu se rychle blokují.
  • Scraping v prohlížeči problém s proxy pro běžné objemy úplně obchází. Režim prohlížeče Thunderbit běží ve vaší vlastní Chrome relaci — žádné nastavování proxy, žádná rotace IP, žádné náklady. Pro většinu firemních uživatelů, kteří scrapují jen pár stovek inzerátů, to naprosto stačí.

A tady je údržbový aspekt, který si mnoho lidí neuvědomuje: když Craigslist změní CSS (a dělá to průběžně), každý scraper založený na CSS selektorech se rozbije. Musíte stránku zkontrolovat, najít nové selektory, upravit kód a znovu otestovat. AI nástroje jako Thunderbit tomu zcela předcházejí — AI si pokaždé znovu přečte strukturu stránky, takže změny rozložení váš workflow nerozhodí.

Kód vs. no-code: dva kompletní postupy scrapování Craigslistu

Vím, že publikum pro tento článek je zhruba napůl rozdělené: ne-tech byznys uživatelé, kteří jen chtějí data, a začínající až mírně pokročilí vývojáři, kteří chtějí funkční kód. Tady jsou tedy oba přístupy vedle sebe.

No-code: jak scrapovat Craigslist s Thunderbit (krok za krokem)

  1. Nainstalujte rozšíření Thunderbit do Chromu z Chrome Web Storu.
  2. Otevřete stránku s inzeráty Craigslistu — například byty ve vašem městě (https://yourcity.craigslist.org/search/apa).
  3. Klikněte na „AI navrhne pole“ — Thunderbit AI přečte stránku a navrhne sloupce přizpůsobené kategorii. U bydlení uvidíte Název, Cena, Metráž, Počet ložnic, Lokalita, Datum zveřejnění, Odkaz.
  4. Zkontrolujte a upravte navržené sloupce podle potřeby. Pole můžete přidat nebo odebrat jedním kliknutím.
  5. Klikněte na „Scrape“ — sledujte, jak se data naplní do strukturované tabulky.
  6. Zvládněte stránkování — klikejte mezi stránkami nebo nechte Thunderbit, ať to zvládne za vás.
  7. Použijte „Scrape Subpages“ k návštěvě každého jednotlivého inzerátu a obohacení o pole z detailní stránky: plný popis, všechny obrázky, vložené kontaktní údaje.
  8. Exportujte do Google Sheets, Excelu, Airtable, Notion nebo CSV — zdarma.

Celý proces zabere asi 2 minuty pro jednu stránku výsledků. Žádné CSS selektory, žádné proxy, žádný kód.

Kódová cesta: jak scrapovat Craigslist pomocí Pythonu + Playwright

Playwright je v roce 2026 ve vývojářských fórech nejdoporučovanější knihovna pro scrapování Craigslistu. Tady je funkční Python ukázka, která scrapuje výsledkovou stránku Craigslistu s bydlením, vytahuje název/cenu/odkaz, zvládá stránkování a vypisuje výsledky.

Postup: nejdřív zkuste strukturovaná data JSON-LD (Craigslist na některých stránkách vkládá schéma ItemList), a když to nepomůže, sáhněte po DOM selektorech. Stránkování probíhá přes s=120.

import asyncio, json
from urllib.parse import urlparse, parse_qs, urlencode, urlunparse
from playwright.async_api import async_playwright

def next_page_url(url, step=120):
    p = urlparse(url)
    qs = parse_qs(p.query)
    offset = int(qs.get("s", ["0"])[0]) + step
    qs["s"] = [str(offset)]
    return urlunparse((p.scheme, p.netloc, p.path, "", urlencode(qs, doseq=True), ""))

async def scrape_page(page, url):
    await page.goto(url, wait_until="domcontentloaded")
    await page.wait_for_timeout(1500)
    data = []
    # Try JSON-LD first
    for raw in await page.locator('script[type="application/ld+json"]').all_text_contents():
        try:
            obj = json.loads(raw)
        except Exception:
            continue
        if isinstance(obj, dict) and obj.get("@type") == "ItemList":
            for item in obj.get("itemListElement", []):
                thing = item.get("item", {})
                data.append({
                    "title": thing.get("name"),
                    "price": thing.get("offers", {}).get("price"),
                    "link": thing.get("url"),
                })
            if data:
                return data
    # Fallback: DOM selectors
    cards = page.locator("div.cl-search-result, li.cl-static-search-result")
    count = await cards.count()
    for i in range(count):
        card = cards.nth(i)
        title = await card.locator("a.posting-title, a.titlestring").first.text_content()
        link = await card.locator("a.posting-title, a.titlestring").first.get_attribute("href")
        price = (await card.locator(".price, .result-price").first.text_content()
                 if await card.locator(".price, .result-price").count() else None)
        data.append({"title": (title or "").strip(), "price": (price or "").strip(), "link": link})
    return data

async def main():
    start_url = "https://newyork.craigslist.org/search/apa?query=studio"
    async with async_playwright() as p:
        browser = await p.chromium.launch(headless=True)
        page = await browser.new_page()
        url = start_url
        all_rows = []
        for _ in range(3):  # scrape 3 pages
            rows = await scrape_page(page, url)
            if not rows:
                break
            all_rows.extend(rows)
            url = next_page_url(url)
        await browser.close()
        for row in all_rows[:10]:
            print(row)

asyncio.run(main())

Co budete potřebovat navíc k tomuto skriptu: Nainstalovaný Playwright (pip install playwright && playwright install), konfiguraci proxy pro vysoké objemy a ruční řešení CAPTCHA, pokud narazíte na rate limit. To je ta výměna: plná kontrola, ale i plná zodpovědnost.

Zdarma vs. placené: poctivý rozpad nákladů pro každý Craigslist scraper

Tohle je tabulka, kterou bych si přál mít, když jsem s tímto tématem začínal. „Zdarma“ je ve web scrapingu dost ošemetné slovo.

NástrojÚplně zdarma?Limity free tarifuPočáteční cena placeného tarifuSkryté náklady
ThunderbitFree tier (6 stránek)6 stránek/měs.; zkušební verze = 10 stránekPlacené tarify pro vyšší objemŽádné — export je zdarma
Scrapy✅ Open sourceNeomezeně0 USDNáklady na proxy, hosting, údržbu
BeautifulSoup✅ Open sourceNeomezeně0 USDNáklady na proxy, hosting, údržbu
Playwright✅ Open sourceNeomezeně0 USDNáklady na proxy, hosting, údržbu
Selenium✅ Open sourceNeomezeně0 USDNáklady na proxy, hosting, údržbu
ParseHubFree tier5 projektů~189 USD/měs.Na free tarifu omezené plánované běhy
ApifyFree tierKredity 5 USD/měs. zdarma~49 USD/měs.Ceny podle výpočtu mohou vyskočit
PhantombusterFree tier5 slotů, 2 h/měs., export 10 řádků~56 USD/měs. (ročně)Cena za slot
Bright DataJen zkušební verze1 000 požadavků / 1 týden~500+ USD/měs.Proxy navíc
OxylabsJen zkušební verze2 000 výsledků / 1 GB~75+ USD/měs. (Unblocker)Enterprise ceny

Velká hvězdička u „zdarma“ open-source nástrojů: Scrapy, Playwright, Selenium a BeautifulSoup stojí 0 USD na instalaci, ale provoz ve velkém na Craigslistu znamená hodiny práce vývojáře na nastavení, 50–500+ USD/měsíc za rezidenční proxy a průběžnou údržbu pokaždé, když Craigslist změní HTML. AI Thunderbit přečte stránku pokaždé znovu (žádná údržba), exporty jsou zdarma a scraping v prohlížeči odstraňuje náklady na proxy u běžných objemů. To je pro netechnické uživatele skutečná výhoda.

Co můžete skutečně vytěžit: datová pole Craigslistu podle kategorií

Různé kategorie Craigslistu mají úplně jiné datové struktury. Inzerát na bydlení nevypadá vůbec jako pracovní nabídka. Tady je, co můžete realisticky vytáhnout z jednotlivých hlavních sekcí:

Kategorie CraigslistuVytěžitelná poleJsou dostupné kontaktní údaje?
Bydlení / bytyNázev, Cena, Metráž, Ložnice, Koupelny, Lokalita, Datum, Obrázky, Popis, Odkaz na mapu, Dostupnost, Podmínky pro domácí mazlíčky, Prádelna/parkování⚠️ Někdy (anonymizovaný email relay)
ProdejNázev, Cena, Stav, Lokalita, Datum, Obrázky, Popis, Značka/model/rok (liší se)⚠️ Někdy
PráceNázev, Firma, Odměna, Lokalita, Typ práce, Úroveň zkušeností, Datum, PopisZřídka (jen odkaz pro přihlášení)
SlužbyNázev, Lokalita, Popis, Obrázky⚠️ Někdy
ZakázkyNázev, Odměna, Lokalita, Datum, Popis⚠️ Někdy

Pár důležitých poznámek:

  • Kontaktní údaje: Craigslist používá anonymizované email relay záměrně, aby zabránil přímému scrapování emailů. Nástroje, které tvrdí, že „extrahují emaily“, často vytahují relay adresu (reply+randomstring@craigslist.org), ne skutečný email inzerenta.
  • Pole z detailní stránky jako plný popis, všechny obrázky a vložené kontaktní údaje se objeví až po otevření každého jednotlivého inzerátu — ne na výsledkové stránce.
  • Thunderbit „AI navrhne pole“ automaticky rozpozná, která pole jsou na aktuální stránce k dispozici, a navrhne správnou strukturu sloupců. Uživatel scrapující bydlení dostane sloupce pro metráž/ložnice; uživatel scrapující práci dostane sloupce pro odměnu/typ práce — bez ruční konfigurace. Jeho scraping podstránek pak navštíví každý inzerát a vytáhne pole jen z detailní stránky.

Právní realita: podmínky Craigslistu, případ 3Taps a co byste měli vědět

Nejsem právník a tohle není právní poradenství. Ale vím, že se toho uživatelé obávají, a zaslouží si přímou odpověď.

Klíčový precedens: V případu Craigslist v. 3Taps (2013) získal Craigslist soudní příkaz proti 3Taps za scrapování a znovu publikování inzerátů po zaslání výzvy k ukončení. 3Taps údajně obcházel bloky IP přes proxy servery a soud považoval přístup po zablokování za potenciálně „bez oprávnění“. EFF poznamenal, že se případ v roce 2015 uzavřel smírem.

Podmínky použití Craigslistu výslovně zakazují používat „roboty, spidery, skripty, scrapery, crawlery nebo jakýkoli automatizovaný či manuální ekvivalent“ pro interakci se stránkou. Za porušení dokonce stanovují smluvní pokutu 0,25 USD za stránku po prvních 1 000 zhlédnutích stránky během 24 hodin.

Praktické doporučení:

  • ✅ Scrapujte veřejně viditelná data pro průzkum trhu nebo osobní použití
  • ✅ Respektujte robots.txt a rate limity
  • ⚠️ Nepublikujte hromadně znovu scrapované inzeráty
  • ⚠️ Nepoužívejte scrapované kontaktní údaje pro nevyžádaný marketing
  • ❌ Po zablokování neobcházejte technická omezení přístupu

Rozdíl je důležitý: scrapování veřejně viditelných dat pro vlastní analýzu je něco jiného než hromadné přepublikování nebo sběr emailů pro spam. Ale mějte na paměti, že Craigslist historicky postupoval od vymáhání podmínek přes blokování IP až po právní kroky.

Který Craigslist scraper je pro vás nejlepší?

Po testování a vyhodnocení všech 10 nástrojů je tady moje doporučení podle scénáře:

  • Netechnický byznys uživatel, který potřebuje data z Craigslistu rychleThunderbit. Žádný kód, AI detekce polí, žádná údržba, export zdarma. Nejrychlejší cesta z „potřebuji tato data“ do „už jsou v tabulce“.
  • Enterprise tým scrapující tisíce inzerátů denně napříč všemi regionyBright Data. Craigslist-specific scraper, obrovská proxy infrastruktura, automatické řešení CAPTCHA, dedikovaná podpora.
  • Vývojářský tým, který potřebuje spravovanou API/proxy infrastrukturuOxylabs pro proxy-first workflow, Apify pro flexibilitu actor marketplace.
  • Vývojář, který chce plnou kontrolu a možnost úpravScrapy + Playwright. Open-source, maximální flexibilita, ale vlastní proxy a údržba jsou na vás.
  • Uživatel s omezeným rozpočtem a středními potřebami → free tier Apify (kredity 5 USD/měs.) nebo free tier ParseHubu (5 projektů).
  • Obchodní tým, který už používá nástroje pro vícekanálové generování leadůPhantombuster. Přidejte Craigslist do stávající pipeline.
  • Začátečník v Pythonu, který chce jednorázové scrapováníBeautifulSoup + requests. Minimum kódu, minimum nastavení, minimum možností.

Pro většinu ne-technických firemních uživatelů nabízí Thunderbit nejlepší rovnováhu mezi jednoduchostí, přesností a cenou. Pro vývojáře je nejsilnější kombinací Scrapy + Playwright. Pro enterprise škálu je Bright Data těžké překonat.

Pokud chcete vidět, jak scrapování Craigslistu s AI skutečně vypadá, vyzkoušejte Thunderbit — free tier stačí k otestování na vlastním use casu. A pokud chcete jít víc do hloubky ve web scrapingu, podívejte se na naše návody na jak scrapovat do Google Sheets, nejlepší automatizované web scraping nástroje a web scraping bez blokace. Můžete také prozkoumat náš YouTube kanál s videonávody krok za krokem.

Šťastné scrapování — a ať jsou vaše data vždy čistá, strukturovaná a připravená k akci.

Časté dotazy

Je legální scrapovat inzeráty z Craigslistu?

Podmínky použití Craigslistu výslovně zakazují automatizované scrapování a případ Craigslist v. 3Taps je hlavní právní precedent. Scrapování veřejných dat pro osobní nebo analytické použití se obecně posuzuje jinak než hromadné znovupublikování nebo spam, ale vždy byste měli respektovat rate limity a pravidla webu — a toto není právní rada.

Můžu scrapovat Craigslist bez programování?

Ano. Nástroje jako Thunderbit, ParseHub a Apify nabízejí no-code nebo low-code možnosti pro extrakci dat z Craigslistu. AI detekce polí v Thunderbitu to dělá obzvlášť snadné — stačí kliknout na „AI navrhne pole“ a „Scrape“.

Jaký je nejlepší bezplatný Craigslist scraper?

Pro vývojáře jsou Scrapy nebo BeautifulSoup úplně zdarma a open-source (i když se načítají náklady na proxy a údržbu). Pro netechnické uživatele je nejlepší výchozí volba free tier Thunderbitu (6 stránek/měsíc), alternativně free tier ParseHubu (5 projektů).

Jak se vyhnout zablokování při scrapování Craigslistu?

Používejte rate limiting (minimálně 2–5 sekund mezi požadavky), střídejte user-agenty, vyhněte se datacentrovým proxy (na Craigslistu fungují mnohem lépe rezidenční nebo ISP proxy) a nepoužívejte předvídatelné crawl vzory. U středních objemů obcházejí nástroje pro scraping v prohlížeči, jako je Thunderbit, problém s proxy úplně tím, že běží ve vaší vlastní Chrome relaci.

Můžu scrapovat všechny regiony Craigslistu najednou?

S vývojářskými nástroji jako Scrapy nebo Playwright můžete programově procházet všech 416 regionálních URL pro USA/teritoria. Enterprise nástroje jako Bright Data a Oxylabs mají multi-region scraping vestavěný. S Thunderbit můžete otevřít každý regionální web a scrapovat stejným workflow — AI se každé stránce automaticky přizpůsobí.

Vyzkoušejte Thunderbit pro scrapování Craigslistu Get Started Free

Zjistěte více

Shuai Guan
Shuai Guan
CEO ve společnosti Thunderbit | Expert na automatizaci dat s využitím AI Shuai Guan je CEO společnosti Thunderbit a absolvent inženýrského oboru na University of Michigan. Na základě téměř deseti let zkušeností v oblasti technologií a architektury SaaS se zaměřuje na převádění složitých modelů AI do praktických nástrojů pro extrakci dat bez nutnosti programování. Na tomto blogu sdílí nezkreslené a v praxi ověřené poznatky o web scrapingu a automatizačních strategiích, které vám pomohou vytvářet chytřejší datově řízené pracovní postupy. Když zrovna neoptimalizuje datové workflow, věnuje stejný důraz na detail také své vášni pro fotografii.
Obsah

Získej data z webu jen tím, že si o ně řekneš

Řekni, co potřebuješ, obyčejnou angličtinou. Nebo ještě lépe – neříkej nic.

Vyzkoušet Thunderbit zdarma
Získej data pomocí AI
Snadno přenes data do Google Sheets, Airtable nebo Notion
Chrome Store Rating
PRODUCT HUNT#1 Product of the Week