10 najlepszych scraperów Craigslist, które nadal działają w 2026 roku

Ostatnia aktualizacja: April 24, 2026
10 najlepszych scraperów Craigslist, które nadal działają w 2026 roku

Craigslist wygląda, jakby od 2003 roku nic się na nim nie zmieniło, ale dane ukryte w tych prostych ogłoszeniach tekstowych są zaskakująco cenne. Przy ~127 milionach miesięcznych odwiedzin i dziesiątkach milionów nowych ogłoszeń każdego miesiąca nadal jest to jedna z największych platform ogłoszeń drobnych w USA — i nie ma publicznego API, z którego można by skorzystać.

Od lat tworzę narzędzia automatyzujące pracę w Thunderbit, a od zespołów sprzedaży, operacji i nieruchomości ciągle słyszę jedno: „Potrzebuję danych z Craigslist w arkuszu kalkulacyjnym i nie chcę przez trzy godziny kopiować i wklejać”. Problem w tym, że większość poradników o „najlepszym scraperze Craigslist” jest albo nieaktualna, albo pomija trudne kwestie (jak zabezpieczenia anty-botowe), albo po prostu wymienia narzędzia bez realnego porównania.

Dlatego przygotowałem ten przewodnik z 10 narzędziami, które naprawdę nadal działają w 2026 roku — od rozszerzeń Chrome bez kodu, przez platformy proxy klasy enterprise, aż po biblioteki Python open source. Niezależnie od tego, czy jesteś osobą biznesową, która nigdy nie napisała ani jednej linijki kodu, czy deweloperem myślącym w Pythonie, znajdziesz tu coś dla siebie.

Dlaczego warto scrapować Craigslist w 2026 roku? Najważniejsze zastosowania dla zespołów biznesowych

Craigslist może wyglądać staroświecko, ale właśnie w tym tkwi jego urok — i wartość. Nadal zajmuje 3. miejsce globalnie wśród serwisów z ogłoszeniami, a w oficjalnym katalogu działa w 416 lokalizacjach w USA i terytoriach. To ogromna pula bardzo lokalnych ofert, których po prostu nie da się znaleźć w jednym miejscu nigdzie indziej.

Oto zastosowania, do których zespoły wracają najczęściej:

  • Pozyskiwanie leadów: ogłoszenia o usługach i zleceniach często zawierają opis firmy, lokalizację i anonimową ścieżkę kontaktu przez Craigslist — to wystarczy, by zespół sprzedaży zbudował lokalną listę leadów.
  • Monitorowanie rynku nieruchomości: strony z mieszkaniami pokazują czynsz, dzielnicę, liczbę pokoi i łazienek, metraż oraz datę publikacji — idealne do porównywania stawek i śledzenia dostępności.
  • Analiza konkurencyjnych cen: ogłoszenia sprzedaży pokazują tytuł, cenę, stan i lokalizację, co jest bardzo cenne przy analizie odsprzedaży lub arbitrażu.
  • Rekrutacja i monitoring rynku pracy: kategorie pracy i zleceń ujawniają wynagrodzenie, typ zatrudnienia i opis roli, co pomaga ocenić lokalny rynek talentów.
  • Analiza wielu regionów: ponieważ Craigslist jest podzielony na subdomeny i miasta, można sprawdzać region po regionie pod kątem cen, wolumenu i miksu kategorii.
  • Automatyzacja workflow: wielu użytkowników po prostu chce, aby dane z Craigslist trafiały do CSV, Google Sheets, Airtable lub CRM — bez ręcznego przeglądania.

Jeden z użytkowników zgłosił, że codzienny scraping Craigslist, który wcześniej zajmował 60–90 minut, po automatyzacji skrócił się do około 5 minut. To właśnie taki oszczędzony czas, który bardzo szybko się kumuluje.

Scrapuj dane z Craigslist z pomocą AI Get Started Free

Jak wybraliśmy najlepsze scrapery Craigslist: nasze kryteria oceny

Nie wszystkie scrapery Craigslist są sobie równe, a to, co jest „najlepsze”, zależy w dużej mierze od tego, kim jesteś i czego potrzebujesz. Oceniałem każde narzędzie w sześciu wymiarach:

  1. Łatwość konfiguracji — czy jest przyjazne dla początkujących (no-code), czy wymaga dewelopera?
  2. Obsługa zabezpieczeń anty-botowych Craigslist — czy ma wbudowaną rotację proxy, obsługę CAPTCHA albo fingerprinting przeglądarki?
  3. Poziom cenowy — darmowe, freemium, płatne czy enterprise?
  4. Opcje eksportu danych — CSV, Excel, Google Sheets, Airtable, Notion, JSON, baza danych?
  5. Obsługa wielu regionów — czy potrafi scrapować wszystkie 416 witryn Craigslist w USA, czy ogranicza się do jednego miasta naraz?
  6. Nakład na utrzymanie — czy narzędzie psuje się, gdy Craigslist zmieni układ strony, czy dostosowuje się automatycznie?

Żaden konkurencyjny artykuł, który znalazłem, nie oferuje porównania obok siebie według tak spójnych kryteriów — więc jeśli masz już dość niejasnych list „top 10”, ten materiał jest dla Ciebie.

10 najlepszych scraperów Craigslist w skrócie

Zanim przejdziemy do szczegółów każdego narzędzia, oto główna tabela porównawcza. Podzieliłem je na trzy grupy: narzędzia no-code dla użytkowników biznesowych, platformy enterprise do pracy na dużą skalę oraz biblioteki open source dla deweloperów.

NarzędzieTypDarmowy plan?Obsługa proxy / anty-botObsługa CAPTCHAFormaty eksportuNajlepsze dla
ThunderbitRozszerzenie Chrome bez koduTak (6 stron/mies.)Tryb przeglądarki (bez proxy przy umiarkowanych uruchomieniach)N/D (sesja przeglądarki)Excel, Sheets, Airtable, Notion, CSV, JSONUżytkownicy biznesowi bez technicznego zaplecza
Bright DataEnterprise scraper + proxy + datasetTrialZarządzane odblokowywanie, proxy, ponawianie prób, renderowanieTak (automatycznie rozwiązywana)JSON, NDJSON, CSV, Parquet, XLSX, APIZbieranie danych na skalę enterprise
OxylabsAPI + stos proxyTrialZarządzane odblokowywanie, proxy residential/ISPTakHTML, zrzut ekranu, wyjścia APIDeweloperzy potrzebujący infrastruktury enterprise
ApifyChmurowy marketplace actorówTak (kredyty 5 USD/mies.)Rotacja proxy (zależna od aktora)Częściowo / zależnie od aktoraJSON, CSV, XML, Excel, JSONLElastyczna automatyzacja cloud low-code
ParseHubWizualny scraper bez koduTakPłatna rotacja proxy, uruchomienia w chmurzeNie jest funkcją podstawowąCSV, JSON, API/S3/Dropbox (płatne)Użytkownicy no-code z ograniczonym budżetem
PhantombusterPlatforma automatyzacji w chmurzeTak (ograniczone)Dostępna obsługa proxyKredyty / workflowCSV, JSON (płatne)Automatyzacja sprzedaży na wielu platformach
ScrapyOpen source Python crawlerTak (OSS)Własne proxy/middlewareNieJSON, JSONL, CSV, XML, DBCrawlers produkcyjne
PlaywrightOpen source automatyzacja przeglądarkiTak (OSS)Własna przeglądarka/proxyNieNiestandardowy eksportKontrola na poziomie przeglądarki
SeleniumOpen source automatyzacja przeglądarkiTak (OSS)Własna przeglądarka/proxyNieNiestandardowy eksportStarsze wielojęzyczne stosy
BeautifulSoupOpen source parser HTMLTak (OSS)Brak samodzielnieNieNiestandardowy eksportLekkie parsowanie

Widać tu wyraźnie trzy ścieżki:

  • Narzędzia no-code (Thunderbit, ParseHub, Phantombuster) dla użytkowników biznesowych, którzy chcą danych bez obciążenia inżynieryjnego.
  • Platformy enterprise (Bright Data, Oxylabs, Apify) dla zespołów, które potrzebują skali, infrastruktury anty-botowej i zarządzanego dostarczania danych.
  • Open-source’owe narzędzia deweloperskie (Scrapy, Playwright, Selenium, BeautifulSoup) dla maksymalnej kontroli — kosztem konfiguracji, utrzymania i zarządzania proxy.

Teraz przejdźmy do szczegółów.

1. Thunderbit

thunderbit-ai-web-scraper.webp Thunderbit to oparta na AI wtyczka do Chrome, stworzona dla osób, które chcą uporządkowanych danych z dowolnej strony — także z Craigslist — bez pisania kodu i bez konfiguracji proxy.

Jestem tu stronniczy (to my ją zbudowaliśmy), ale powód, dla którego stawiam Thunderbit na pierwszym miejscu, jest prosty: rozwiązuje konkretne problemy, jakie scraping Craigslist stawia przed użytkownikami nietechnicznymi — zmienne układy stron w różnych kategoriach, wzbogacanie danych ze stron szczegółów oraz ciągłe psucie się scraperów po zmianach selektorów CSS.

Jak działa to na Craigslist:

  1. Zainstaluj rozszerzenie Thunderbit do Chrome i otwórz dowolną stronę z ogłoszeniami Craigslist (na przykład mieszkania w Twoim mieście).
  2. Kliknij „AI Suggest Fields” — AI Thunderbit odczytuje stronę i proponuje kolumny dopasowane do rzeczywistej zawartości. W przypadku nieruchomości dostaniesz tytuł, cenę, metraż, liczbę sypialni, lokalizację, datę publikacji i link. W przypadku ofert pracy — tytuł, wynagrodzenie, typ pracy i tak dalej. Bez ręcznej konfiguracji selektorów.
  3. Kliknij „Scrape” i obserwuj, jak dane pojawiają się w uporządkowanej tabeli.
  4. Obsłuż paginację — Thunderbit współpracuje z klikową paginacją Craigslist.
  5. Użyj „Scrape Subpages”, aby wejść w każde pojedyncze ogłoszenie i pobrać pola dostępne tylko na stronie szczegółów: pełny opis, wszystkie zdjęcia, osadzony kontakt i więcej.
  6. Wyeksportuj dane do Google Sheets, Excel, Airtable, Notion lub CSV — za darmo.

Najważniejsze funkcje:

  • Wykrywanie pól oparte na AI: automatycznie dopasowuje się do różnych kategorii Craigslist — w nieruchomościach dodaje kolumny metrażu i liczby sypialni, w ofertach pracy — wynagrodzenia i typu pracy, a w sprzedaży — stanu i ceny. Bez ręcznej pracy z CSS.
  • Scraping podstron: po pobraniu strony wyników można wejść w każde ogłoszenie i pobrać pola z jego strony szczegółów (pełny opis, obrazy, informacje kontaktowe).
  • Tryb scrapowania w przeglądarce: działa w Twojej własnej sesji Chrome, więc przy umiarkowanych wolumenach nie potrzebujesz proxy. To samo w sobie usuwa ogromną warstwę kosztów i złożoności.
  • Zero konserwacji: AI odczytuje stronę od nowa za każdym razem. Gdy Craigslist zmieni układ (a zmienia), scraper się nie psuje.
  • Darmowy eksport: Excel, Google Sheets, Airtable, Notion, CSV, JSON — bez paywalla na eksport.

Cena: darmowy plan (6 stron/mies.), darmowy trial (10 stron), płatne plany dla większych wolumenów.

Najlepsze dla: zespołów sprzedaży scrapujących leady z Craigslist w kategoriach usług i zleceń, zespołów nieruchomości monitorujących ceny najmu, zespołów operacyjnych potrzebujących uporządkowanych danych z Craigslist bez wsparcia deweloperów oraz każdego, kto chce scrapować, opisywać i eksportować dane w jednym kroku.

Wypróbuj Thunderbit do scrapowania Craigslist

2. Bright Data

Screenshot 2026-04-22 at 12.27.50 PM_compressed.webp Bright Data to ciężka artyleria w segmencie enterprise. To jedyna platforma na tej liście, która ma zarówno dedykowaną stronę produktu Craigslist Scraper, jak i marketplace Craigslist Dataset.

Jeśli musisz scrapować tysiące ogłoszeń Craigslist dziennie we wszystkich regionach USA, Bright Data jest zbudowane właśnie pod taką skalę. Jej Web Unlocker obsługuje IP, ponawianie prób, renderowanie i blokady — w tym automatyczne rozwiązywanie CAPTCHA domyślnie. Web Scraper IDE pozwala budować własne workflow zbierania danych z Craigslist, a także programowo iterować przez wszystkie 416 regionalnych adresów URL.

Najważniejsze funkcje:

  • Ogromna sieć proxy residential (miliony adresów IP)
  • Wbudowane rozwiązywanie CAPTCHA i omijanie zabezpieczeń anty-botowych
  • Dedykowane produkty scraper i dataset dla Craigslist
  • Eksport: JSON, NDJSON, CSV, Parquet, XLSX, dostarczanie przez API, webhooki

Cena: scraper Craigslist kosztuje 0,5 USD za 1 tys. załadowań stron w modelu pay-as-you-go, a plany obejmują np. 380 tys. załadowań za 499 USD. Proxy residential zaczynają się od 4 USD/GB w modelu pay-as-you-go. Dostępny jest tygodniowy trial z 1 tys. żądań.

Najlepsze dla: zespołów enterprise potrzebujących dużych wolumenów, wieloregionalnego zbierania danych z Craigslist z gwarantowanym uptime i dedykowanym wsparciem. Małe zespoły pilnujące budżetu powinny spojrzeć gdzie indziej.

3. Oxylabs

oxylabs-data-for-ai-proxies.webp Oxylabs to premium dostawca infrastruktury proxy i scrapingu z dedykowanym Craigslist Scraper API oraz stroną proxy Craigslist.

Oxylabs jest bardziej nastawione na deweloperów niż podejście „wszystko w jednym” oferowane przez Bright Data. Jego Web Scraper API i Web Unblocker obsługują renderowanie JS, ponawianie prób, zarządzanie sesją, generowanie fingerprintów i szerszą obsługę anty-botową. Darmowy trial Scraper API dla Craigslist obejmuje do 2 000 wyników.

Najważniejsze funkcje:

  • Pule proxy residential i ISP (residential od 6 USD/GB, ISP od 0,60 USD/IP)
  • Web Unblocker z automatycznym fingerprintem i zarządzaniem sesjami
  • Dedykowany endpoint API dla Craigslist
  • Dostępny 7-dniowy darmowy trial

Cena: „inne strony” w Scraper API zaczynają się od około 0,15 USD/1 tys. wyników bez JS, 0,35 USD/1 tys. z JS. Web Unblocker w mikro planie od około 75 USD/mies.. Proxy residential na dużą skalę mogą kosztować 0,50 USD/GB przy 1 TB.

Najlepsze dla: zespołów deweloperskich, które chcą zarządzanej infrastruktury proxy i workflow opartych na API do długotrwałego scrapowania Craigslist. Zespoły już korzystające z proxy Oxylabs w innych projektach łatwo dodadzą Craigslist.

4. Apify

apify-web-data-scrapers.webp Apify to chmurowa platforma do web scrapingu i automatyzacji z marketplace’em gotowych „Actorów” — szablonów scraperów, które można uruchomić bez pisania kodu.

Środowisko Craigslist na Apify jest interesujące: istnieje kilka aktorów utrzymywanych przez społeczność, ale ich jakość bardzo się różni. Aktor ivanvs/craigslist-scraper ma łącznie 829 użytkowników i ocenę 5,0, podczas gdy automation-lab/craigslist-scraper ma 44 użytkowników i ocenę 1,0. Jakość bywa nierówna, więc przed wdrożeniem warto testować.

Najważniejsze funkcje:

Cena: Darmowy plan z kredytami 5 USD/mies., płatne plany od ok. 49 USD/mies. Cennik za zasoby może rosnąć przy intensywnym użyciu — warto pilnować zużycia CU.

Najlepsze dla: zespołów, które chcą rozwiązania hostowanego w chmurze bez zarządzania infrastrukturą, użytkowników komfortowo czujących się z konfiguracją low-code oraz zespołów potrzebujących zaplanowanych, cyklicznych zadań scrapowania Craigslist.

5. ParseHub

parsehub.com-homepage-1920x1080_compressed.webp ParseHub to desktopowe narzędzie do wizualnego web scrapingu, w którym klikasz elementy strony, aby zdefiniować, co ma zostać pobrane.

Aby skonfigurować scraping Craigslist w ParseHub, klikasz tytuły ogłoszeń, ceny i linki, ucząc narzędzie, co ma pobrać. Obsługuje paginację poprzez pętle kliknięć AJAX i umożliwia uruchomienia w chmurze w płatnych planach. Darmowy plan daje do 5 projektów, co jest całkiem przyzwoite przy małej skali pracy z Craigslist.

Najważniejsze funkcje:

  • Wizualny kreator workflow „wskaż i kliknij”
  • Obsługa paginacji i dynamicznej treści
  • Uruchomienia w chmurze i harmonogramy w płatnych planach
  • Eksport: CSV, Excel, JSON

Cena: darmowy plan (5 projektów), płatne plany od około 189 USD/mies. za większą liczbę stron i uruchomienia harmonogramowe.

Ograniczenia: może działać wolno przy dużych scrape’ach, darmowy plan ma ograniczone uruchomienia harmonogramowe, a co najważniejsze — opiera się na selektorach CSS, więc wymaga ręcznej konserwacji, gdy Craigslist zmienia układ strony.

Najlepsze dla: pojedynczych użytkowników lub małych zespołów z umiarkowanymi potrzebami scrapingu, którzy chcą wizualnego narzędzia no-code, ale nie potrzebują wykrywania pól opartego na AI.

6. Phantombuster

phantombuster-website-screenshot.webp Phantombuster to chmurowa platforma automatyzacji, znana pierwotnie ze scrapowania LinkedIn i mediów społecznościowych. Nie jest to narzędzie stworzone natywnie dla Craigslist, ale jego Web Element Extractor potrafi scrapować publiczne strony przy użyciu selektorów CSS.

Konfiguracja scrapingu Craigslist w Phantombuster wymaga więcej pracy niż w narzędziu dedykowanym — trzeba zdefiniować selektory, zbudować workflow i ustawić harmonogram. Ale jeśli i tak używasz Phantombuster do LinkedIn lub generowania leadów z social mediów, dodanie Craigslist do pipeline’u jest proste.

Najważniejsze funkcje:

  • Gotowe szablony automatyzacji i uruchamianie w chmurze
  • Harmonogramy i integracje CRM
  • Dostępna obsługa proxy i kredyty na rozwiązywanie CAPTCHA
  • Eksport: CSV, JSON w płatnych planach (darmowy plan ogranicza do 10 wierszy)

Cena: darmowy plan z 5 slotami, 2 godz./mies. i limitem eksportu do 10 wierszy. Płatne plany roczne zaczynają się od około 56 USD/mies. rozliczanych rocznie.

Najlepsze dla: zespołów sprzedaży już korzystających z Phantombuster do wieloplatformowego pozyskiwania leadów, które chcą dodać Craigslist do swojego workflow.

7. Scrapy

scrapy.org-homepage-1920x1080_compressed.webp Scrapy to najpopularniejszy open-source’owy framework Python do web scrapingu i oczywisty wybór dla zespołów deweloperskich, które chcą maksymalnej kontroli nad crawl’owaniem Craigslist.

Najnowsza stabilna wersja to 2.15.0 (9 kwietnia 2026). Scrapy obsługuje crawl wielu regionów (przechodzenie przez wszystkie regionalne adresy URL), wbudowane planowanie i ograniczanie żądań, downloader middleware do rotacji proxy oraz eksport feedów do CSV, JSON, JSONL, XML i pipeline’ów bazodanowych. Wtyczka scrapy-playwright dodaje renderowanie na poziomie przeglądarki, gdy jest potrzebne.

Najważniejsze funkcje:

  • Wysoce konfigurowalny crawler klasy produkcyjnej
  • Middleware do proxy, ponawiania prób, ciasteczek i rotacji user-agentów
  • Eksport feedów: JSON, JSONL, CSV, XML, pipeline’y bazodanowe
  • Darmowy i open source

Ukryty koszt: samo Scrapy jest darmowe, ale uruchamianie go na dużą skalę na Craigslist oznacza subskrypcje proxy (50–500+ USD/mies.), koszty hostingu/serwera i bieżącą konserwację, gdy Craigslist zmienia strukturę HTML.

Najlepsze dla: zespołów deweloperskich z doświadczeniem w Pythonie, które potrzebują maksymalnej elastyczności, własnej infrastruktury proxy i dużego, wieloregionalnego crawl’owania Craigslist.

8. Playwright

playwright.dev-homepage-1920x1080_compressed.webp Playwright to nowoczesna biblioteka do automatyzacji przeglądarki od Microsoftu, która programowo kontroluje Chromium, Firefox i WebKit. Obecne tempo wydań jest aktywne — v1.59.1 ukazała się 1 kwietnia 2026.

W społecznościach deweloperskich Playwright jest coraz częściej rekomendowany zamiast Selenium do scrapowania Craigslist. Jest szybszy, bardziej niezawodny i ma lepszy stealth anty-detekcyjny dzięki wtyczkom społecznościowym takim jak playwright-extra. Obsługuje tryb headless i z interfejsem, automatyczne oczekiwanie na elementy, przechwytywanie ruchu sieciowego oraz zrzuty ekranu/PDF.

Najważniejsze funkcje:

Zaleta przy Craigslist: Playwright potrafi bardziej przekonująco naśladować zachowanie prawdziwego użytkownika niż surowe żądania HTTP, co zmniejsza ryzyko blokady. W społeczności Reddit opinie konsekwentnie faworyzują Playwright nad Selenium w nowych projektach.

Ukryte koszty: takie same jak w Scrapy — koszty proxy, hostingu i utrzymania, gdy selektory przestają działać.

Najlepsze dla: deweloperów potrzebujących precyzyjnej kontroli nad przeglądarką, zespołów budujących scrapery obsługujące treści renderowane przez JavaScript oraz każdego, kto woli nowoczesną alternatywę dla Selenium.

9. Selenium

selenium.dev-homepage-1920x1080_compressed.webp Selenium to długo istniejący i szeroko używany framework do automatyzacji przeglądarki. Najnowsze wydanie to 4.43.0 (10 kwietnia 2026), a projekt nadal rozwija możliwości BiDi i kontroli sieci.

Selenium obsługuje wiele języków (Python, Java, C#, JavaScript) i wszystkie główne przeglądarki. Potrafi symulować pełne sesje przeglądarki, obsłużyć logowanie, jeśli jest potrzebne, i przewijać strony. Jednak w porównaniu z Playwright jest wolniejszy, bardziej rozwlekły i łatwiejszy do wykrycia jako bot bez dodatkowych bibliotek stealth, takich jak undetected-chromedriver.

Najważniejsze funkcje:

  • Obsługa wielu języków (Python, Java, C#, JavaScript)
  • Symulacja pełnej sesji przeglądarki
  • Dojrzały ekosystem z obszerną dokumentacją
  • Darmowy i open source

Ograniczenia: społeczność w 2026 roku skłania się ku Playwright przy nowych projektach. Jeden z wątków na Reddit wskazywał, że Cloudflare nadal wykrywa Selenium „także przy użyciu proxy residential” — stealth jest trudniejszy od razu po instalacji.

Najlepsze dla: zespołów deweloperskich, które już zainwestowały w Selenium i nie chcą migracji, projektów wymagających obsługi wielu języków (Java, C#) oraz starszych środowisk scrapingu.

10. BeautifulSoup

crummy.com-homepage-1920x1080_compressed.webp BeautifulSoup to lekka biblioteka Python do parsowania HTML i XML. Obecna wersja na PyPI to 4.14.3 (30 listopada 2025).

Ważne doprecyzowanie: BeautifulSoup to parser, a nie pełny scraper. Nie pobiera stron internetowych ani nie obsługuje automatyzacji przeglądarki. Łączy się go z biblioteką requests do pobierania HTTP, a on parsuje przekazany mu HTML. To czyni go najprostszym punktem wejścia dla deweloperów, ale też najbardziej ograniczonym.

Najważniejsze funkcje:

  • Bardzo łatwy do nauczenia — wymaga minimalnej ilości kodu
  • Świetny do małej skali lub jednorazowego scrapingu Craigslist
  • Darmowy i open source

Ograniczenia: brak wbudowanej obsługi paginacji, brak renderowania JavaScript, brak rotacji proxy — wszystko trzeba dodać ręcznie. Jeśli Craigslist zmieni strukturę HTML, selektory przestają działać i trzeba poprawiać je ręcznie.

Najlepsze dla: początkujących w Pythonie, którzy chcą spróbować scrapingu Craigslist przy minimalnej konfiguracji, szybkich jednorazowych pobrań danych z jednej kategorii lub regionu oraz deweloperów potrzebujących po prostu lekkiego parsera.

Playbook antybanowy Craigslist: proxy, limity i to, co prowadzi do blokady

To jest sekcja, którą pomija większość poradników o scrapowaniu Craigslist, a to właśnie ona ma największe znaczenie. Testy Scraperly z kwietnia 2026 klasyfikują Craigslist jako cel o trudności 3/5, wskazując na własną CAPTCHA, limity szybkości i blokady IP. Poradnik Bright Data kieruje użytkowników w stronę Web Unlocker albo przeglądarki Scraping Browser opartej na Playwright zamiast zwykłego HTTP. Strona proxy Oxylabs mówi wprost, że Craigslist potrafi wykrywać proxy i że proxy residential są najlepszym wyborem.

Oto, co faktycznie działa:

StrategiaSkuteczność na CraigslistKosztZłożoność
Proxy residential✅ Wysoka$$ (4–6 USD/GB)Średnia
Proxy ISP✅ Wysoka$ (0,60–0,80 USD/IP)Średnia
Proxy datacenter⚠️ Niska (często blokowane)$ (0,20–0,40 USD/IP)Niska
Scrapowanie w przeglądarce (własna sesja)✅ Średnio-wysokaZa darmoNiska
Ograniczanie tempa + losowe opóźnienia✅ Niezbędna podstawaZa darmoNiska

Praktyczne wskazówki:

  • Opóźnienia między żądaniami: minimum 2–5 sekund między requestami. Scraperly sugeruje trzymanie się około 5–10 żądań/minutę na IP i rotację po 20–30 żądaniach.
  • Rotacja sesji: rotuj user-agent i fingerprint przeglądarki. Przewidywalne wzorce crawlowania są szybko wychwytywane.
  • Unikaj proxy datacenter: są tanie, ale na Craigslist są szybko blokowane.
  • Scraping w przeglądarce całkowicie usuwa problem proxy przy umiarkowanych wolumenach. Tryb przeglądarki Thunderbit działa w Twojej własnej sesji Chrome — bez konfiguracji proxy, bez rotacji IP, bez kosztów. Dla większości użytkowników biznesowych scrapujących kilkaset ogłoszeń to więcej niż wystarczające.

I jest jeszcze aspekt utrzymania, który wiele osób pomija: gdy Craigslist zmienia CSS (a robi to okresowo), każdy scraper oparty na selektorach CSS przestaje działać. Trzeba sprawdzić stronę, znaleźć nowe selektory, zaktualizować kod i przetestować wszystko ponownie. Narzędzia oparte na AI, takie jak Thunderbit, omijają ten problem całkowicie — AI odczytuje strukturę strony od nowa za każdym razem, więc zmiany układu nie psują workflow.

Kod vs. no-code: dwa kompletne przewodniki po scrapowaniu Craigslist

Wiem, że odbiorcy tego artykułu dzielą się mniej więcej po równo: nietechniczni użytkownicy biznesowi, którzy po prostu chcą dane, oraz początkujący i średniozaawansowani deweloperzy, którzy chcą działającego kodu. Dlatego poniżej są oba podejścia, obok siebie.

No-code: jak scrapować Craigslist z Thunderbit (krok po kroku)

  1. Zainstaluj rozszerzenie Thunderbit do Chrome z Chrome Web Store.
  2. Otwórz stronę z ogłoszeniami Craigslist — na przykład mieszkania w Twoim mieście (https://yourcity.craigslist.org/search/apa).
  3. Kliknij „AI Suggest Fields” — AI Thunderbit odczyta stronę i zaproponuje kolumny dopasowane do kategorii. W przypadku nieruchomości zobaczysz tytuł, cenę, metraż, liczbę sypialni, lokalizację, datę publikacji i link.
  4. Sprawdź i dostosuj sugerowane kolumny, jeśli trzeba. Możesz dodać lub usunąć pola jednym kliknięciem.
  5. Kliknij „Scrape” — obserwuj, jak dane pojawiają się w uporządkowanej tabeli.
  6. Obsłuż paginację — przechodź między stronami ręcznie lub pozwól, by zrobił to Thunderbit.
  7. Użyj „Scrape Subpages”, aby wejść w każde ogłoszenie i wzbogacić dane o pola ze strony szczegółów: pełny opis, wszystkie obrazy, osadzony kontakt.
  8. Wyeksportuj do Google Sheets, Excel, Airtable, Notion lub CSV — za darmo.

Cały proces zajmuje około 2 minut na stronę wyników. Bez selektorów CSS, bez proxy, bez kodu.

Ścieżka kodowa: jak scrapować Craigslist w Pythonie + Playwright

Playwright to obecnie najczęściej polecana biblioteka do scrapowania Craigslist w społecznościach deweloperskich w 2026 roku. Poniżej znajduje się działający fragment Pythona, który scrapuje stronę wyników Craigslist z mieszkaniami, wyciąga tytuł/cenę/link, obsługuje paginację i zwraca wyniki.

Podejście: najpierw próbuj danych strukturalnych JSON-LD (Craigslist na niektórych stronach osadza schemat ItemList), a potem przejdź do selektorów DOM. Paginacja odbywa się przez s=120.

import asyncio, json
from urllib.parse import urlparse, parse_qs, urlencode, urlunparse
from playwright.async_api import async_playwright

def next_page_url(url, step=120):
    p = urlparse(url)
    qs = parse_qs(p.query)
    offset = int(qs.get("s", ["0"])[0]) + step
    qs["s"] = [str(offset)]
    return urlunparse((p.scheme, p.netloc, p.path, "", urlencode(qs, doseq=True), ""))

async def scrape_page(page, url):
    await page.goto(url, wait_until="domcontentloaded")
    await page.wait_for_timeout(1500)
    data = []
    # Najpierw spróbuj JSON-LD
    for raw in await page.locator('script[type="application/ld+json"]').all_text_contents():
        try:
            obj = json.loads(raw)
        except Exception:
            continue
        if isinstance(obj, dict) and obj.get("@type") == "ItemList":
            for item in obj.get("itemListElement", []):
                thing = item.get("item", {})
                data.append({
                    "title": thing.get("name"),
                    "price": thing.get("offers", {}).get("price"),
                    "link": thing.get("url"),
                })
            if data:
                return data
    # Fallback: selektory DOM
    cards = page.locator("div.cl-search-result, li.cl-static-search-result")
    count = await cards.count()
    for i in range(count):
        card = cards.nth(i)
        title = await card.locator("a.posting-title, a.titlestring").first.text_content()
        link = await card.locator("a.posting-title, a.titlestring").first.get_attribute("href")
        price = (await card.locator(".price, .result-price").first.text_content()
                 if await card.locator(".price, .result-price").count() else None)
        data.append({"title": (title or "").strip(), "price": (price or "").strip(), "link": link})
    return data

async def main():
    start_url = "https://newyork.craigslist.org/search/apa?query=studio"
    async with async_playwright() as p:
        browser = await p.chromium.launch(headless=True)
        page = await browser.new_page()
        url = start_url
        all_rows = []
        for _ in range(3):  # scrapuj 3 strony
            rows = await scrape_page(page, url)
            if not rows:
                break
            all_rows.extend(rows)
            url = next_page_url(url)
        await browser.close()
        for row in all_rows[:10]:
            print(row)

asyncio.run(main())

Czego potrzebujesz poza tym skryptem: zainstalowanego Playwrighta (pip install playwright && playwright install), konfiguracji proxy przy dużych wolumenach oraz ręcznej obsługi CAPTCHA, jeśli trafisz na limity. To właśnie kompromis: pełna kontrola, ale też pełna odpowiedzialność.

Darmowe vs. płatne: szczere zestawienie kosztów dla każdego scrapera Craigslist

To jest tabela, którą chciałbym mieć, kiedy zaczynałem badać ten temat. „Darmowe” to w web scrapingu słowo pełne haczyków.

NarzędzieCałkowicie darmowe?Limity darmowego planuCena startowa płatnego planuUkryte koszty
ThunderbitDarmowy plan (6 stron)6 stron/mies.; trial = 10 stronPłatne plany dla większego wolumenuBrak — eksport jest darmowy
Scrapy✅ Open sourceBez limitu0 USDKoszty proxy, hostingu, utrzymania
BeautifulSoup✅ Open sourceBez limitu0 USDKoszty proxy, hostingu, utrzymania
Playwright✅ Open sourceBez limitu0 USDKoszty proxy, hostingu, utrzymania
Selenium✅ Open sourceBez limitu0 USDKoszty proxy, hostingu, utrzymania
ParseHubDarmowy plan5 projektów~189 USD/mies.Ograniczone uruchomienia harmonogramowe w darmowym planie
ApifyDarmowy planKredyty 5 USD/mies.~49 USD/mies.Cennik za zasoby może rosnąć
PhantombusterDarmowy plan5 slotów, 2 godz./mies., eksport 10 wierszy~56 USD/mies. (rocznie)Cennik za slot
Bright DataTylko trial1 tys. żądań / 1 tydzień~500+ USD/mies.Proxy dodatkowo
OxylabsTylko trial2 tys. wyników / 1 GB~75+ USD/mies. (Unblocker)Cennik enterprise

Największy znak zapytania przy „darmowych” narzędziach open source: Scrapy, Playwright, Selenium i BeautifulSoup kosztują 0 USD przy instalacji, ale uruchamianie ich na dużą skalę na Craigslist oznacza godziny pracy deweloperskiej przy konfiguracji, 50–500+ USD/mies. za proxy residential oraz ciągłą konserwację za każdym razem, gdy Craigslist zmieni HTML. AI w Thunderbit odczytuje stronę od nowa za każdym razem (zero konserwacji), eksporty są darmowe, a scraping w przeglądarce eliminuje koszty proxy przy umiarkowanych wolumenach. To realna przewaga dla osób bez zaplecza deweloperskiego.

Co naprawdę da się wyciągnąć: pola danych Craigslist według kategorii

Różne kategorie Craigslist mają zupełnie różne struktury danych. Ogłoszenie mieszkaniowe nie wygląda jak oferta pracy. Oto, co realnie można wyciągnąć z każdej głównej sekcji:

Kategoria CraigslistPola do wyciągnięciaDane kontaktowe dostępne?
Nieruchomości / mieszkaniaTytuł, cena, metraż, sypialnie, łazienki, lokalizacja, data, obrazy, opis, link do mapy, dostępność, zasady dotyczące zwierząt, pralnia/parking⚠️ Czasami (zanonimizowany relay e-mail)
SprzedażTytuł, cena, stan, lokalizacja, data, obrazy, opis, marka/model/rok (zależnie od oferty)⚠️ Czasami
PracaTytuł, firma, wynagrodzenie, lokalizacja, typ pracy, poziom doświadczenia, data, opisRzadko (zwykle tylko link do aplikacji)
UsługiTytuł, lokalizacja, opis, obrazy⚠️ Czasami
Zlecenia / gigsTytuł, wynagrodzenie, lokalizacja, data, opis⚠️ Czasami

Kilka ważnych uwag:

  • Dane kontaktowe: Craigslist używa zanonimizowanych relay e-mail właśnie po to, by uniemożliwić bezpośredni scraping adresów e-mail. Narzędzia, które twierdzą, że „wyciągają e-maile”, często pobierają adres relay (reply+randomstring@craigslist.org), a nie prawdziwy adres osoby wystawiającej ogłoszenie.
  • Pola ze strony szczegółów takie jak pełny opis, wszystkie obrazy i osadzony kontakt pojawiają się dopiero po wejściu w każde pojedyncze ogłoszenie — nie ma ich na stronie wyników.
  • „AI Suggest Fields” w Thunderbit automatycznie wykrywa, jakie pola są dostępne na bieżącej stronie, i proponuje odpowiednią strukturę kolumn. Osoba scrapująca nieruchomości dostaje kolumny metrażu i sypialni; osoba scrapująca oferty pracy dostaje kolumny wynagrodzenia i typu pracy — bez ręcznej konfiguracji. Następnie funkcja scrapowania podstron odwiedza każde ogłoszenie, aby pobrać tylko pola ze strony szczegółów.

Legalny reality check: regulamin Craigslist, sprawa 3Taps i to, co warto wiedzieć

Nie jestem prawnikiem i to nie jest porada prawna. Ale wiem, że użytkownicy się tym martwią, więc warto powiedzieć to wprost.

Kluczowy precedens: w sprawie Craigslist v. 3Taps (2013) Craigslist uzyskał zakaz sądowy wobec 3Taps za scrapowanie i ponowne publikowanie ogłoszeń po wysłaniu wezwania do zaprzestania. Według zarzutów 3Taps omijał blokady IP przy użyciu serwerów proxy, a sąd potraktował dostęp po blokadzie jako potencjalnie „bez upoważnienia”. EFF zauważył, że sprawa zakończyła się ugodą w 2015 roku.

Warunki korzystania z Craigslist wprost zakazują używania „robotów, spiderów, skryptów, scraperów, crawlerów lub jakichkolwiek ich automatycznych albo manualnych odpowiedników” do interakcji z serwisem. Określają nawet odszkodowanie umowne na poziomie 0,25 USD za stronę po przekroczeniu pierwszych 1000 odsłon w okresie 24 godzin.

Praktyczne wskazówki:

  • ✅ Scrapuj publicznie widoczne dane ogłoszeń do badań rynku lub użytku osobistego
  • ✅ Szanuj robots.txt i limity tempa
  • ⚠️ Nie publikuj masowo ponownie zeskrobanych ogłoszeń
  • ⚠️ Nie używaj zeskrobanych danych kontaktowych do niezamówionego marketingu
  • ❌ Nie omijaj ograniczeń technicznych po zablokowaniu

Różnica jest istotna: scrapowanie publicznie widocznych danych do własnej analizy to coś innego niż masowe republikuowanie albo zbieranie e-maili do spamu. Mimo to warto pamiętać, że Craigslist historycznie przechodził od egzekwowania regulaminu, przez blokady IP, aż po działania prawne.

Który scraper Craigslist jest najlepszy dla Ciebie?

Po przetestowaniu i ocenie wszystkich 10 narzędzi, moja rekomendacja zależna od scenariusza wygląda tak:

  • Nietechniczny użytkownik biznesowy, który potrzebuje danych z Craigslist szybkoThunderbit. Bez kodu, wykrywanie pól oparte na AI, zero konserwacji, darmowy eksport. Najkrótsza droga od „potrzebuję tych danych” do „mam je w arkuszu”.
  • Zespół enterprise scrapujący tysiące ogłoszeń dziennie we wszystkich regionachBright Data. Dedykowany scraper Craigslist, ogromna infrastruktura proxy, automatyczne rozwiązywanie CAPTCHA, dedykowane wsparcie.
  • Zespół deweloperski potrzebujący zarządzanej infrastruktury API/proxyOxylabs do workflow proxy-first, Apify dla elastyczności marketplace’u actorów.
  • Deweloper chcący pełnej kontroli i personalizacjiScrapy + Playwright. Open source, maksymalna elastyczność, ale własne proxy i utrzymanie po Twojej stronie.
  • Użytkownik dbający o budżet z umiarkowanymi potrzebami → darmowy plan Apify (kredyty 5 USD/mies.) albo darmowy plan ParseHub (5 projektów).
  • Zespół sprzedaży już korzystający z narzędzi do lead gen na wielu platformachPhantombuster. Dodaj Craigslist do istniejącego pipeline’u.
  • Początkujący w Pythonie robiący jednorazowy scrapingBeautifulSoup + requests. Minimalny kod, minimalna konfiguracja, minimalne możliwości.

Dla większości nietechnicznych użytkowników biznesowych Thunderbit oferuje najlepszy balans między łatwością, dokładnością i kosztem. Dla deweloperów Scrapy + Playwright to najmocniejsze połączenie. W skali enterprise trudno przebić Bright Data.

Jeśli chcesz zobaczyć, jak wygląda scraping Craigslist wspierany przez AI, wypróbuj Thunderbit — darmowy plan wystarczy, aby przetestować go na własnym przypadku użycia. A jeśli chcesz wejść głębiej w techniki web scrapingu, sprawdź nasze poradniki o jak scrapować do Google Sheets, najlepszych zautomatyzowanych narzędziach do web scrapingu oraz web scrapingu bez blokowania. Możesz też zajrzeć na nasz kanał YouTube, gdzie znajdziesz instrukcje krok po kroku wideo.

Miłego scrapowania — i oby Twoje dane zawsze były czyste, uporządkowane i gotowe do działania.

FAQ

Czy scrapowanie ogłoszeń Craigslist jest legalne?

Warunki korzystania z Craigslist wprost zakazują automatycznego scrapowania, a sprawa Craigslist v. 3Taps jest najważniejszym precedensem prawnym. Scrapowanie publicznie dostępnych danych do użytku osobistego lub analitycznego jest zwykle traktowane inaczej niż masowe republikuowanie albo spam, ale zawsze należy respektować limity tempa i zasady serwisu — i nie jest to porada prawna.

Czy mogę scrapować Craigslist bez kodowania?

Tak. Narzędzia takie jak Thunderbit, ParseHub i Apify oferują opcje no-code lub low-code do wyciągania danych z Craigslist. Wykrywanie pól oparte na AI w Thunderbit sprawia, że jest to szczególnie proste — wystarczy kliknąć „AI Suggest Fields” i „Scrape”.

Jaki jest najlepszy darmowy scraper Craigslist?

Dla deweloperów Scrapy lub BeautifulSoup są całkowicie darmowe i open source (choć koszty proxy i utrzymania się sumują). Dla osób bez kodowania najlepszym punktem startowym jest darmowy plan Thunderbit (6 stron/mies.), a alternatywnie darmowy plan ParseHub (5 projektów).

Jak uniknąć blokady podczas scrapowania Craigslist?

Stosuj ograniczanie tempa (minimum 2–5 sekund opóźnienia), rotuj user-agent, unikaj proxy datacenter (proxy residential lub ISP działają na Craigslist znacznie lepiej) i nie twórz przewidywalnych wzorców crawl’owania. Przy umiarkowanych wolumenach narzędzia do scrapowania w przeglądarce, takie jak Thunderbit, omijają problem proxy całkowicie, bo działają w Twojej własnej sesji Chrome.

Czy mogę scrapować wszystkie regiony Craigslist naraz?

Za pomocą narzędzi deweloperskich, takich jak Scrapy lub Playwright, możesz programowo przechodzić przez wszystkie 416 regionalnych adresów URL w USA i terytoriach. Narzędzia enterprise, takie jak Bright Data i Oxylabs, mają wieloregionalny scraping wbudowany. W Thunderbit możesz otworzyć każdy regionalny serwis i scrapować tym samym workflow — AI automatycznie dostosuje się do każdej strony.

Wypróbuj Thunderbit do scrapowania Craigslist Get Started Free

Dowiedz się więcej

Shuai Guan
Shuai Guan
CEO w Thunderbit | Ekspert ds. automatyzacji danych AI Shuai Guan jest CEO Thunderbit oraz absolwentem wydziału inżynierii University of Michigan. Czerpiąc z niemal dekady doświadczenia w branży technologicznej i architekturze SaaS, specjalizuje się w przekuwaniu złożonych modeli AI w praktyczne, niewymagające kodowania narzędzia do استخراج danych. Na tym blogu dzieli się szczerymi, sprawdzonymi w boju spostrzeżeniami na temat web scrapingu i strategii automatyzacji, które pomogą Ci tworzyć mądrzejsze, oparte na danych procesy pracy. Gdy nie optymalizuje przepływów danych, z tą samą dbałością o szczegóły oddaje się swojej pasji do fotografii.
Spis treści

Zbierz dane ze strony, po prostu o to prosząc

Powiedz, czego potrzebujesz, prostym angielskim. A najlepiej: nie mów nic.

Wypróbuj Thunderbit darmowe
Wyodrębniaj dane dzięki AI
Łatwo przenoś dane do Google Sheets, Airtable lub Notion
Chrome Store Rating
PRODUCT HUNT#1 Product of the Week