Do Googlu napíšeš „scraper plugin“ a čekáš tlačítko v liště a tabulku za pět minut. Místo toho na tebe vyskočí samé vývojářské API, ukázky kódu a ceníky plné výrazů jako „rotace proxy“ nebo „současní pracovníci“. Někde mezi těmito dvěma extrémy většina běžných uživatelů prostě vzdá práci a data ručně kopíruje.
To zmatení není náhoda — je to problém samotné kategorie. Většina přehledů „nejlepší scraper“ hází do jednoho pytle rozšíření do prohlížeče, desktopové aplikace i cloudová API, jako by instalace rozšíření do Chrome a napojení REST API bylo totéž. Není. Proto tenhle seznam třídím nejdřív podle typu nasazení a teprve potom podle účelu, abys během zhruba třiceti sekund zjistil, jestli potřebuješ plugin, aplikaci, nebo předání vývojáři.
Co se dá považovat za skutečný scraper plugin? (Rozšíření vs. desktopové aplikace vs. cloudová API)

Tady je test, který opravdu funguje: nainstaluje se nástroj přímo do tvého prohlížeče a pracuje s právě otevřenou stránkou, aniž bys nejdřív musel budovat backendovou integraci? Pokud ano, jde v praxi o skutečný browser plugin. Když musíš stáhnout a otevřít samostatný program, je to desktopová aplikace. A pokud píšeš kód a voláš endpoint, je to cloudové API — užitečné, ale podle rozumné definice to plugin není.
| Kategorie | Kde běží | Ovládání | Silná stránka | Omezení |
|---|---|---|---|---|
| Skutečné rozšíření do prohlížeče | Uvnitř Chrome/Edge na právě otevřené stránce / relaci | Lišta, postranní panel, klikání bez kódu | Nejmenší tření, pracuje přesně s tím, co vidíš | Vázané na otevřený tab; slabší plánování a škálování |
| Desktopová aplikace | Samostatný nainstalovaný program s vlastním prohlížečem | Vizuální editor projektu | Větší kontrola nad navigací a lokálními projekty | Nutná instalace a úvodní nastavení |
| Cloudová automatizační platforma | Hostovaná služba, někdy s doplňkovým rozšířením | Šablony, roboti, plánovač | Opakovatelné běhy bez otevřeného notebooku | Složitější účty a kredity |
| Cloudové API / platforma | Infrastruktura dodavatele volaná z kódu | HTTP požadavek, SDK, CLI | Škálování a opakovatelnost | Vyžaduje vývojáře |
Tahle hranice je důležitá, protože hybridní nástroje ji pořád rozmazávají. Octoparse má režim podobný rozšíření v šablonách, ale v jádru je to desktopová aplikace s cloudovou vrstvou. PhantomBuster má rozšíření do prohlížeče, ale jeho hlavní produkt je cloudová automatizace sociálních sítí. Říkat každému scrapingovému nástroji „plugin“, protože má nějakou část v prohlížeči, je přesně ten typ záměny kategorií, kvůli které ses do tohohle zmatku dostal.
Jak jsme vybírali nejlepší scraper plugin nástroje
Každý nástroj jsem hodnotil podle šesti kritérií: náročnost instalace (skutečné rozšíření vs. desktop vs. API), nastavení bez kódu vs. s kódem, práce s JavaScriptem a anti-bot ochranou, možnosti exportu, průhlednost cen a — to je bod, který většina recenzí vynechá — nároky na údržbu, když cílový web změní layout.
U toho posledního je potřeba se zastavit. Každý nástroj založený na selektorech ve svém oficiálním centru nápovědy popisuje, co se stane, když web změní design: špatné sloupce, prázdné řádky, duplicitní záznamy nebo tiché selhání. Octoparse ve svém troubleshooting průvodci uvádí přeskočené stránky a nekonečné smyčky na poslední stránce jako běžné typy problémů. Chybové kódy ParseHub zahrnují i „selected no elements“, když selektor prostě přestane sedět. To není výtka těmto nástrojům — je to jen důsledek práce s pevně danými HTML prvky. Nástroj, který při každém běhu znovu čte strukturu stránky, se chová jinak než nástroj, který si před půl rokem zapamatoval CSS cestu, a ten rozdíl přímo ovlivňuje průběžnou údržbu.
Nejlepší scraper plugin nástroje přehledně
| Nástroj | Kategorie | Ideální pro | Nastavení | Práce s JS / anti-bot | Export | Cenový model |
|---|---|---|---|---|---|---|
| Thunderbit | AI-native rozšíření do prohlížeče | Extrakce jedním klikem bez selektorů | Spustíš kliknutím, na podporovaných stránkách bez návrhu schématu | Agentní analýza stránky na kompatibilních / autorizovaných stránkách | Excel, Google Sheets, Airtable, Notion, stažení | Na kredity (ověř aktuálně) |
| Instant Data Scraper | Starší heuristické rozšíření | Zdarma, rychlé scrapování tabulek a seznamů | Klikání bez kódu, automatická detekce tabulek | Zdokumentovaná práce s dynamickým načítáním a nekonečným scrollováním; bez spravované proxy/CAPTCHA | XLS/XLSX/CSV | Zdarma |
| Web Scraper | Rozšíření založené na recipech | Strukturované, opakovatelné scrapingové recepty | Ruční nastavení sitemap a selektorů | Lokální řízení JS/paginace; cloud přidává proxy a opakované pokusy | CSV, XLSX lokálně; JSON/API přes Cloud | Zdarma lokálně + placený Cloud |
| Octoparse | Desktopová aplikace + cloudová vrstva | Neprogramátoři, kteří potřebují více síly na dynamických stránkách | Šablony + vizuální workflow v desktopu | Slabší až dobré přes Chrome/Phantom režimy a cloudovou extrakci | CSV, Excel, DB, API | Zdarma + předplatné |
| ParseHub | Desktopové klikací rozhraní | Složitá vnořená paginace | Instalace desktopové aplikace | Dobré pro JS díky vestavěnému prohlížeči; server snapshot pro debug | CSV, JSON, Google Sheets (přes skript) | Zdarma + placené tarify |
| Browse AI | Cloudoví roboti + monitoring | Plánované sledování a upozornění | Šablony robotů (rozšíření je nyní zastaralé) | Dobré u nahraných interakcí; platí minimální podmínky pro prémiové weby | CSV, JSON, S3, API, Sheets, Airtable | Kredity / úkoly |
| PhantomBuster | Cloudová automatizace + doplňkové rozšíření | Podporovaná automatizace pro sociální sítě a lead gen | Předpřipravené „Phantoms“ | Běží přes váš vlastní přihlášený účet | HubSpot ověřen; ostatní exporty je potřeba znovu zkontrolovat | Kredity za dobu běhu (přesné ceny nejsou veřejné) |
| Firecrawl | Cloudové kontextové API | Velké objemy a crawling náročný na JS | API/SDK/CLI, nutný vývojář | Hostované renderování, chytré čekání, respektuje robots.txt pro FirecrawlAgent | Markdown, HTML, screenshoty, JSON | Na kredity (1 kredit / stránka pro Scrape/Crawl/Map/Monitor) |
| ScraperAPI | Cloudové proxy / scraping API | Vyhýbání se blokaci IP ve velkém měřítku | Nutné API / kód | Rotace proxy, CAPTCHA/browser handling, geotargeting | JSON (strukturované endpointy); u core API raw response | Podle využití (přesné sazby nejsou veřejné) |
Jestli už přesně víš, že potřebuješ „dostat tuhle jednu tabulku dnes do Excelu“, přeskoč rovnou na Thunderbit nebo Instant Data Scraper. Jestli je váš úkol „náš vývojář potřebuje spolehlivě trefit 10 000 URL bez blokace“, skoč rovnou na Firecrawl nebo ScraperAPI. Ostatní čti dál — právě střed tohohle seznamu je místo, kam v praxi spadá většina firemních případů.
Nejlepší volba pro extrakci jedním klikem bez selektorů: Thunderbit

Thunderbit je AI-native rozšíření pro Chrome a Edge, navržené tak, aby netechnický uživatel nikdy nemusel kreslit CSS selektor. Otevřeš cílovou stránku, klikneš na One Click Extract a Thunderbit stránku přečte a zanalyzuje, aby zjistil, co má vytáhnout — a pak nabídne tlačítko Run Now, kterým úlohu hned spustíš.
To je opravdu jiný pracovní postup než starší model „AI Suggest Fields → kontrola → Scrape“, který popisovaly dřívější recenze Thunderbit. Současné výchozí chování je mnohem blíž „jedním klikem hotovo“, což je důležité, pokud jsi ten typ uživatele, který hledal „scraper plugin“ právě proto, že nic nechceš nastavovat.
Klíčové funkce:
- Sloupce navržené AI bez ruční tvorby CSS selektorů, plus úprava polí v přirozeném jazyce
- Podstránky / deep enrichment — projde odkaz na detail a automaticky vytáhne další pole
- Podpora paginace, hromadného zadání URL a nekonečného scrollování na podporovaných stránkách
- Spuštění v browser módu pro stránky, kde jsi přihlášený; cloudové spuštění pro veřejné stránky
- Export do Excelu, CSV, Google Sheets, Airtable, Notion nebo JSON
Ceny (aktuální čísla ověř na oficiální stránce): Free plán spouští 6 stránek měsíčně; Starter je 15 USD/měsíc za 500 kreditů; Pro je 38 USD/měsíc za 3 000 kreditů. V podmínkách Thunderbit se uvádí, že kredity se spotřebovávají na každý výstupní řádek, což vychází přibližně na 30 USD za 1 000 řádků u Starteru a asi 12,67 USD za 1 000 řádků u Pro — to jsou výpočty z kvót, ne faktury, takže ceny si před plánováním rozpočtu raději zkontroluj znovu.
Ideální pro: obchodní, ops nebo marketingové uživatele, kteří chtějí dnes dostat z webu tabulku do Excelu, aniž by se museli učit, co je selektor.
Jedno upřímné omezení: stejně jako každý plugin v tomhle seznamu funguje Thunderbit jen na kompatibilních a autorizovaných stránkách. Neslibuje obejití každé CAPTCHA ani anti-bot ochrany a jeho podmínky výslovně zakazují obejití přístupových kontrol. Žádný nástroj to spolehlivě nedělá — kdo tvrdí opak, něco ti prodává.
Nejlepší bezplatná volba pro rychlé jednorázové scrapování tabulek: Instant Data Scraper

Instant Data Scraper je bezplatné heuristické rozšíření pro Chrome, které automaticky detekuje nejpravděpodobnější tabulku nebo seznam na stránce a umožní ti ho prohlédnout, upravit a exportovat. Důležitá poznámka: aktuálním vydavatelem v Chrome Web Store je Flavr Technology, ne Web Robots — Web Robots ho vytvořil, ale uvádí, že už ho nevlastní ani nepodporuje, takže starší návody z té domény ber spíš jako historický workflow než jako současný závazek k ochraně soukromí.
K čemu je dobrý:
- Téměř okamžitý export do CSV/Excelu u čistých, statických katalogových stránek
- Detekce dynamického načítání a nekonečného scrollování s nastavitelným zpožděním crawl
- Žádné náklady na nastavení — je opravdu zdarma, bez nutnosti účtu
Na co se nehodí: nemá zdokumentovaný plánovač, API, export do JSON ani spravované CAPTCHA řešení. A hlavně — na to bys měl skutečně myslet — aktuální vydavatel ve svých zásadách ochrany soukromí (aktualizováno v červenci 2026) přiznává sběr širší historie prohlížení, vyhledávání a e-commerce aktivit, než by naznačovalo tvrzení „vaše data zůstávají lokálně“. To neznamená, že tvoje scrapované řádky opouštějí prohlížeč, ale znamená to, že to není nástroj, který bych bez rozmýšlení pustil na citlivou přihlášenou relaci.
Ideální pro: jednorázové stažení z čisté, veřejné listing stránky, kde chceš nulové tření a nulové náklady.
Nejlepší pro opakovatelné scrapingové recepty: Web Scraper

Web Scraper se jasně dělí na dva produkty: bezplatné, neomezené lokální rozšíření s klikacím „sitemap“ seznamem selektorů a placenou Web Scraper Cloud vrstvu, která přidává plánování, API, webhooky a spravované obcházení blokací.
Model sitemap vyžaduje víc přípravy než Thunderbit nebo Instant Data Scraper — ručně definuješ navigaci i datové selektory — ale tahle úvodní práce ti dává něco, co heuristické nástroje neumí: zdokumentovaný, znovupoužitelný recept, který se při každém spuštění chová stejně (pokud se web nezmění). Vlastní dokumentace Web Scraperu je k tomu až osvěžující upřímná a upozorňuje, že automatický point-and-click výběr „není vždy dostačující“ a že samostatně označené více-násobné selektory potřebují explicitní wrapper prvek, jinak se řádky rozhodí.
- Lokálně: zdarma, neomezeně, export CSV/XLSX, bez nutnosti účtu
- Cloud: plánování (denně / interval / CRON), API, export JSON, proxy a funkce pro CAPTCHA
- Cloudové ceny začínají na 50 USD/měsíc (při roční fakturaci) za 5 000 URL kreditů — pozor, jde o kredit na načtenou stránku, ne na řádek, takže cena za řádek se výrazně mění podle počtu záznamů na stránce
Ideální pro: týmy, které potřebují, aby stejný vícestránkový scraping běžel týden co týden úplně stejně, a nevadí jim investovat čas do nastavení předem.
Nejlepší no-code krok nahoru pro dynamické stránky: Octoparse

Octoparse je nejlepší popsat jako desktopovou aplikaci s cloudovou vrstvou pro běh — neexistuje webová verze a neběží na Linuxu ani Chromeboocích. Co ti dává navíc oproti browser rozšíření, je Chrome Mode, který přímo ovládá tvůj nainstalovaný Chrome pro weby plné CAPTCHA a Cloudflare ochrany, Phantom Mode pro lokální headless běhy a skutečnou cloudovou extrakci pro úlohy, které musí pokračovat i po zavření notebooku.
- Detekce AJAXu s nastavitelnými timeouty pro dynamický obsah
- Explicitní práce s paginací pro tlačítka Next, Load More i nekonečný scroll
- Export do Excelu, CSV, JSON, XML, Google Sheets, SQL databází nebo cloudového úložiště u placených tarifů
Ceník je místo, kde je potřeba před závazkem znovu zkontrolovat detaily: živá cenová stránka (v době psaní) ukazuje Standard „od 69 USD/měsíc“ a Professional kolem 199 USD, ale vlastní srovnávací stránka nápovědy Octoparse uvádí jiné částky než cenová karta. Ověř si přepínač fakturace i aktuální promo předtím, než si uděláš rozpočet.
Ideální pro: uživatele, kteří přerostli jednoduché rozšíření a potřebují vizuální kontrolu workflow nad opravdu dynamickými stránkami, ale nechtějí psát kód.
Nejlepší pro složitou, vnořenou paginaci: ParseHub

ParseHub je desktopová aplikace — ne browser plugin — s point-and-click rozhraním postaveným na vestavěném prohlížeči. Výjimečný je svou hierarchií příkazů: Select, Relative Select, Click a opravdu chytrý příkaz Jump, který rekurzivně skáče zpět k nadřazenému výběru; vlastní dokumentace ParseHubu ho doporučuje právě pro hluboce zanořené diskuse v komentářích.
To je skutečná odpověď na „složitou vnořenou paginaci“ — většina nástrojů v tomhle seznamu nemá ekvivalent příkazu Jump. Cena za to je vyšší složitost nastavení: vlastní průvodce hierarchií ParseHubu upozorňuje, že když kliknutí na další stránku umístíš pod špatného rodiče, scraper může stránku dvě znovu a znovu scrapovat ve smyčce.
Jedna zajímavost, kterou je dobré zmínit: testovací běhy používají tvoji lokální IP, ale „běžné“ produkční běhy nahrávají projekt a spouští ho na serverech ParseHubu s jinými IP — což znamená, že projekt, který funguje perfektně v testu, může při ostrém běhu skončit jiným výsledkem nebo blokací. ParseHub proto zavedl funkci „Server Snapshot“, aby se tenhle rozdíl dal ladit.
Ideální pro: vícestupňovou, hluboce vnořenou paginaci (např. komentářové vlákno, strom kategorií), kde jednodušší point-and-click nástroje selhávají.
Nejlepší pro plánované sledování a upozornění: Browse AI

Browse AI se tiše proměnil spíš v cloudovou monitorovací platformu než v rozšíření do prohlížeče — vlastní centrum nápovědy s datem březen 2026 výslovně ukončuje podporu Chrome rozšíření ve prospěch „Robot Studio“. (Jeho vlastní ceníková FAQ stránka ale novým uživatelům pořád říká, aby si rozšíření nainstalovali, což je přesně ten druh vnitřní nekonzistence, který vzniká, když se produkt přerodí rychleji než marketingové texty.)
Co dělá dobře: každý nahraný „robot“ lze naplánovat hodinově, denně, týdně nebo v jiných intervalech, s historií změn, e-mailovými upozorněními a webhook integracemi. Jeho kreditní systém je detailní — 10 řádků v seznamu je 1 kredit, minimálně 1 kredit na úkol a „prémiové weby“ (víc zabezpečení, víc dynamiky) stojí minimálně 2–10 kreditů za úkol.
Ideální pro: opakované sledování cen, monitorování konkurence nebo workflow typu „ozvi se mi, když se to změní“, kde cílem není jednorázový export, ale průběžný dohled.
Nejlepší pro automatizaci sociálních sítí a lead gen: PhantomBuster

PhantomBuster je cloudová automatizační platforma s doprovodným rozšířením do prohlížeče, postavená na předpřipravených „Phantoms“ pro úkoly jako vyhledávání leadů na LinkedIn, enrichment a outreach. FAQ dodavatele uvádí jednu důležitou věc doslova: automatizace běží přes váš vlastní účet a nepřistupuje k datům, která byste už sami neviděli.
To je rozumný princip návrhu, ale neřeší těžší otázku — neporušuje četnost nebo typ akce podmínky cílové platformy? Pouhé čtení dat a akce na účtu (odesílání pozvánek, zpráv, lajků) nesou úplně jiné riziko a PhantomBuster je na homepage výslovně nabízí obě. Ber „běží přes váš účet“ jako výchozí bod pro due diligence, ne jako záruku bezpečnosti.
Ideální pro: sales týmy, které používají podporované workflow na LinkedIn nebo sociálních sítích — ne jako náhradu univerzálního scraperu na libovolnou stránku.
Nejlepší cloudová záloha pro rozsáhlé crawlingové úlohy s těžkým JS: Firecrawl

Firecrawl se popisuje jako „context API pro vyhledávání, scraping a práci s webem ve velkém měřítku“ a to je přesný popis — není to plugin, ale vývojářská infrastruktura se SDK pro Python, Node.js, Go, Rust, Java a Elixir, plus oficiálním MCP serverem pro AI agenty.
Po tomhle nástroji sáhneš ve chvíli, kdy browser rozšíření už fyzicky nezvládne práci: notebook nemůže zůstat otevřený kvůli crawl 10 000 stránek, nebo potřebuješ místo CSV čistý výstup v Markdown / JSON pro LLM pipeline. Endpoint Crawl ve Firecrawl respektuje pravidla robots.txt napsaná pro direktivu FirecrawlAgent — malý, ale konkrétní signál správy a governance, který stojí za zmínku, protože většina konkurentů tohle veřejně neuvádí.
Účtování je na kredity: Scrape, Crawl, Map a Monitor stojí 1 kredit na stránku; Search stojí 2 kredity za 10 výsledků; Interact (vícekrokové akce v prohlížeči) stojí 2 kredity za minutu v browseru. Free plán obsahuje 1 000 kreditů měsíčně. Přesné dolarové ceny placených tarifů nebyly v době rešerše potvrzené — zkontroluj aktuální ceník.
Ideální pro: vývojáře, kteří staví opakovaný crawl nebo posílají strukturovaný webový obsah do AI / RAG pipeline.
Nejlepší cloudová záloha proti blokaci IP ve velkém: ScraperAPI

ScraperAPI je výslovně „web scraping API pro sběr dat z veřejných webů“ — žádný prohlížeč, žádná desktopová aplikace, jen endpoint, který za tvým existujícím scraperem řeší rotaci proxy, CAPTCHA a renderování stránky. Firma uvádí pool více než 40 milionů proxy ve více než 50 zemích a také strukturované endpointy pro konkrétní cíle jako Amazon a Google Search, které vracejí už naparsované JSON místo surového HTML.
Tohle je správný nástroj ve chvíli, kdy tvůj problém není „nevím, jak tu stránku naparsovat“, ale „vím přesně jak, ale pořád dostávám blokaci IP nebo CAPTCHA“. To je užší a poctivější vymezení než „jakýkoliv web“, a já bych se držel právě toho: homepage ScraperAPI sama sebe omezuje na veřejné weby, ne na obsah chráněný přihlášením.
Přesné aktuální cenové tarify nebyly v době rešerše veřejně potvrzeny — dodavatel na hlavních marketingových stránkách neuvádí detailní sazby za požadavek, takže si před závazkem vyžádej nabídku nebo zkontroluj živý ceník.
Ideální pro: tým, který už scraper má a jeho skutečným úzkým hrdlem jsou blokace IP, ne logika extrakce.
Proč scrapers pluginy selhávají nebo jsou blokované

Prázdný výstup a „blocked“ výstup vypadají pro uživatele stejně, ale jde o dva různé problémy, které vyžadují jinou opravu.
| Typ selhání | Co se děje | První kontrola |
|---|---|---|
| Posun DOM / selektoru | Redesign webu přesunul pole | Spusť detekci znovu, aktualizuj recept |
| Načasování JS | Obsah se načítá až po API volání nebo interakci | Přidej čekání, ověř renderovaný stav |
| Nekonečný scroll / virtualizované seznamy | V DOM je vždy jen viditelná část řádků | Otestuj scrollování, zkontroluj duplicitní záznamy |
| Paginace / stav navigace | Logika další stránky se nespouští správně | Ověř rozsah smyčky a podmínku ukončení |
| Přihlášení / ochrana relace | Obsah závisí na cookies nebo tokenu | Potvrď oprávnění a rozsah relace |
| Rate limit / IP enforcement | Vzor požadavků spustil zpomalení nebo CAPTCHA | Zpomal, zkontroluj pravidla cíle |
Nástroje založené na selektorech (heuristická detekce Instant Data Scraperu, pevná sitemap ve Web Scraperu) jsou nejzranitelnější vůči prvnímu typu selhání, protože si pamatují strukturu místo toho, aby ji znovu četly. Agentní nástroje jako Thunderbit analyzují stránku při každém běhu znovu, což může snížit — ne odstranit — právě tento typ problému. Nepomůže ti to s limity, CAPTCHA ani přihlášenou zdí a žádný nástroj v tomhle seznamu, včetně Thunderbitu, to věrohodně netvrdí. Jakmile je skutečným úzkým hrdlem opakovaně rate/IP enforcement nebo těžké renderování JS, místo občasné nepříjemnosti, je to signál přejít na cloudovou zálohu jako Firecrawl nebo ScraperAPI, případně na cloudovou extrakci typu Octoparse v placené verzi.
Kolik tyto scraper plugin nástroje opravdu stojí na 1 000 řádků?
Problém s porovnáváním těchto nástrojů jen podle ceny je v tom, že neúčtují stejnou jednotku. Thunderbit účtuje za výstupní řádek. Web Scraper Cloud účtuje za načtenou URL (která může vrátit nula nebo tisíc řádků). Firecrawl účtuje za stránku napříč Scrape/Crawl/Map/Monitor. Browse AI účtuje za 10 řádků s minimem 1 kreditu na úkol, což může u malých jobů dominovat. PhantomBuster a ScraperAPI nezveřejňují dost detailů, aby šel sazebník vůbec přesně spočítat.
| Nástroj | Ověřená jednotka | Přibližná normalizovaná cena | Háček |
|---|---|---|---|
| Thunderbit | Kredit za výstupní řádek | ~30 USD / 1K řádků (Starter), ~12,67 USD / 1K (Pro) | Agentní akce mohou spotřebovávat proměnlivý počet kreditů |
| Instant Data Scraper | Zdarma | 0 USD / 1K řádků | Nezahrnuje čas na úklid dat, nemá plánovač |
| Web Scraper (Cloud) | Kredit za načtenou URL | 10 USD / 1K URL (Project), 5 USD / 1K URL (Professional) | Počet řádků na URL se dramaticky liší |
| Browse AI | 10 řádků = 1 kredit, minimum 1 kredit na úkol | ~1,90–20,90 USD / 1K podle detail page použití | Detailní stránky a prémiové weby výrazně mění reálnou cenu |
| Firecrawl | 1 kredit na stránku | Free plán pokrývá 1 000 stránek měsíčně | Stránky ≠ řádky; přesné placené ceny nebyly v době rešerše veřejné |
| Octoparse, ParseHub, PhantomBuster, ScraperAPI | Liší se / není plně veřejné | Nelze spolehlivě spočítat | Před rozpočtem ověř aktuální billing dokumentaci |
Nespoléhej na tvrzení typu „X USD za 1 000 řádků“ — včetně těch mých výše — dokud si nezkontroluješ živý ceník a nepřepočítáš to na vlastní očekávanou hustotu řádků. Nástroj účtovaný za stránku vypadá levně, dokud ti z jedné stránky nevypadne deset řádků místo sta.
Který scraper plugin se hodí na váš případ?
| Potřeba | Začněte zde | Proč |
|---|---|---|
| Jedna stránka, minimum nastavení, žádný kód | Thunderbit | Jedno kliknutí, pole navržená AI |
| Zdarma, jednorázově, čistá statická tabulka | Instant Data Scraper | Žádné náklady, žádné nastavování |
| Opakovatelný recept, který budeš spouštět týdně | Web Scraper | Explicitní, verzovatelná kontrola selektorů |
| Dynamické stránky, potřebuješ desktopové ovládání | Octoparse | Chrome/Phantom režimy + cloudová vrstva |
| Hluboce vnořená paginace | ParseHub | Příkaz Jump přímo na to cílený |
| Plánované monitorování + alerty | Browse AI | Robot + cloud plánování, historie změn |
| Podporované workflow pro sociální sítě / lead gen | PhantomBuster | Hotová automatizace přes účet |
| Velký opakovaný JS-heavy crawl pro AI / RAG | Firecrawl | Markdown/JSON výstup, SDK, MCP |
| Existující scraper naráží na blokace IP | ScraperAPI | Spravovaná vrstva proxy a CAPTCHA |
Vyber nástroj podle toho nejmenšího provozního modelu, který tvůj problém opravdu vyřeší. Nepřebírej vývojářské API jen proto, že zní silněji — a nenechávej kvůli jednorázové práci otevřený prohlížeč donekonečna, když by ji měl někde jinde spouštět plánovač.
Je používání scraper pluginu legální? Krátká poznámka k podmínkám a soukromí

Nejsem právník a nejde o právní radu — ale praktická verze zní takhle: drž se veřejných nebo výslovně autorizovaných dat. Než web budeš opakovaně scrapovat, zkontroluj jeho podmínky používání a robots.txt. A u nástrojů, které pracují v přihlášené relaci, buď extra opatrný — sem patří browser režim Thunderbitu, login-state nastavení Web Scraperu i účetová automatizace PhantomBusteru.
Schopnost obejít technickou překážku (CAPTCHA, přihlašovací zed’) není totéž co mít k tomu povolení. FAQ PhantomBusteru říká, že přistupuje jen k datům, která už vidíte přes vlastní účet — to je rozumný princip návrhu, ale nedává ti povolení data znovu publikovat, přeprodávat nebo ve velkém kontaktovat lidi jen proto, že jejich profil technicky vidíš. Sbírej co nejméně osobních údajů, měj jasně daný účel a neuchovávej data déle, než potřebuješ.
Žádný z nástrojů v tomhle seznamu — ani ty, které na cenových stránkách používají formulaci o souladu s pravidly — ti automaticky nezajistí, že konkrétní použití bude legální. To záleží na cílovém webu, na tom, jaká data sbíráš, a co s nimi pak uděláš.
Závěr: Který scraper plugin nástroj byste měli použít?
Pokud potřebuješ dnes jednu čistou tabulku a nechceš řešit selektory, nainstaluj skutečné rozšíření do prohlížeče — Thunderbit, pokud chceš pole navržená AI a export do firemních nástrojů; Instant Data Scraper, pokud je stránka čistá a chceš nulové náklady. Pokud stejný scraping spouštíš každý týden, model receptů ve Web Scraperu nebo desktopový workflow Octoparse ti dají opakovatelnost za cenu úvodního nastavení. Pokud je problém opravdu v hluboce vnořené paginaci, je ParseHub s příkazovým stromem přímo na to stavěný. Pokud jde o to „sledovat a hlásit změny“, zvol Browse AI. A když přerosteš všechno výše — tisíce URL, JS-heavy weby nebo opakované blokace IP — předej to vývojáři a nasměruj ho na Firecrawl nebo ScraperAPI.
Plugin je správný nástroj pro jednorázovou, zkontrolovanou práci, kterou si chceš udělat sám. API je správný nástroj pro automatizovaný, ve velkém měřítku běžící pipeline, kterou má pod kontrolou vývojář. Nezaměňuj je jen proto, že oba mají v názvu slovo „scraper“.
Často kladené otázky
Jsou scraper pluginy / rozšíření bezpečné pro použití na přihlášených webech? Jen tehdy, když máš oprávnění k datům a víš, co nástroj dělá s tvou relací. Široká oprávnění v prohlížeči jsou běžná, protože scraper musí umět číst libovolné stránky — neznamená to automaticky, že tvoje data opouštějí prohlížeč, ale znamená to, že bys měl kontrolovat zásady ochrany soukromí u každého nástroje zvlášť. Akce měnící účet (např. messaging ve PhantomBusteru) odděl ve svém uvažování od jednoduché read-only extrakce.
Jaký je rozdíl mezi scraper pluginem a scraper API? Plugin běží uvnitř tvého prohlížeče nad otevřenou stránkou — bez kódu, s minimálním nastavením, vázaný na tvou relaci. API běží na infrastruktuře (tvé nebo dodavatele) a vrací data programově pro pipeline. Desktopové aplikace jako ParseHub a Octoparse jsou někde mezi: víc nastavení než plugin, víc vizuální kontroly než čisté API.
Proč mi scraper plugin najednou vrací prázdná nebo rozbitá data? Obvykle jde o jednu z několika příčin: web změnil layout a tvůj selektor už nesedí, obsah se načítá přes JavaScript až poté, co to nástroj zkontroloval, logika paginace nezvládla nový typ stránky, nebo vypršela login cookie. Nástroje, které při každém běhu znovu analyzují strukturu stránky (jako agentní přístup Thunderbitu), umí snížit — ne odstranit — právě tento typ problému, ale nic z tohohle seznamu neeliminuje rate limiting ani CAPTCHA stěny.
Můžu používat bezplatný scraper plugin pro opakované plánované scrapování? Spolehlivě ne. Bezplatné nástroje jako Instant Data Scraper a lokální rozšíření Web Scraper nemají zdokumentovaný plánovač — běží, když máš otevřený prohlížeč a klikneš na tlačítko. Pokud potřebuješ opravdu bezobslužné, opakované běhy, budeš potřebovat placenou vrstvu: plánované scrapery Thunderbitu, Web Scraper Cloud, cloudovou extrakci Octoparse nebo monitorovací produkt Browse AI.
Zjistit více


