Po více než tisícovce scrapingů se Simplescraperem jsem přestal počítat úspěchy a začal si zapisovat selhání. Ten posun — z „fungovalo to?“ na „proč se to tentokrát rozbilo?“ — mě naučil víc než jakákoli dokumentace.
Simplescraper je solidní rozšíření pro Chrome, které umí stahovat data z webů bez psaní kódu. Díky 60 000 uživatelům v Chrome Web Storu a opravdu přívětivému point-and-click rozhraní si vydobyl své místo v sadě nástrojů pro scraping bez kódu. Jenže na landing page vám nikdo neřekne to podstatné: abyste při větším měřítku dostávali konzistentní a spolehlivé výsledky, musíte chápat, kde se vizuální scrapery lámou. Průzkum z roku 2025 zjistil, že pracovníci tráví více než devět hodin týdně opakovaným ručním zadáváním dat — a právě tenhle typ bolesti žene lidi k nástrojům jako Simplescraper. Jenže když neznáte jeho zvláštnosti, strávíte těch devět hodin laděním chyb místo užitečné práce. Tento článek shrnuje pět osvědčených postupů, které jsem vypreparoval z reálné provozní zkušenosti: řešení problémů s výběrem prvků, volbu správného režimu scrapingu, maximum z free tarifu, vyhýbání se blokacím a poznání, kdy je čas jít dál.

Co je Simplescraper (a proč na osvědčených postupech záleží)
Simplescraper je rozšíření pro Chrome, které vám umožní vizuálně vybrat prvky na webové stránce — názvy produktů, ceny, obrázky, kontaktní údaje — a převést je do strukturovaných dat bez psaní jediného řádku kódu. Ukážete, kliknete a nástroj vytvoří „recept“, který můžete znovu použít na podobných stránkách.
Základní model funguje takto:
- Vizuální výběr prvků: Kliknete na to, co chcete. Simplescraper automaticky rozpozná opakující se vzory (seznamy produktů, výsledky vyhledávání, pracovní nabídky).
- Recepty: Uložíte si nastavení extrakce a později ho použijete znovu nebo spustíte na dávce URL.
- Dva režimy scrapingu: Browser (lokální, běží ve vašem Chromu) a Cloud (běží na serverech Simplescraperu bez vaší účasti).
- Integrace: Export do Google Sheets, Airtable, webhooků, Zapieru, Make, CSV a JSON.
- AI extrakce: Novější funkce Smart Extract, která z promptu se schématem generuje CSS selektory.
Cílová skupina je široká — marketéři, obchodní týmy, provoz v e-commerce, výzkumníci — zkrátka kdokoli, kdo potřebuje tahat strukturovaná data z webů bez najímání vývojáře. A na jednoduchých stránkách Simplescraper funguje rychle.

Proč tedy na osvědčených postupech záleží? Protože ve chvíli, kdy přejdete od jednoduchého seznamu produktů nebo čistého adresáře k něčemu složitějšímu, začne tření. Dynamický obsah, anti-bot ochrany, obrázky načítané až při scrollování, zanořené HTML struktury — to jsou reálné podmínky, které oddělují frustrující zkušenost od produktivní. Když víte, jak postupovat hned na začátku, ušetříte si hodiny pokusů a omylů.
Osvědčený postup 1: Co dělat, když Simplescraper nedokáže vybrat prvky
Tohle je zdaleka nejčastější frustrace, kterou jsem viděl. Kliknete na prvek, Simplescraper ho zvýrazní, máte dobrý pocit — a pak zjistíte, že ve výstupu chybí polovina dat. Fotky jsou prázdné. Bio je prázdné. Místa zmizela.
Sám zakladatel už dřív přiznal, že „výběr prvku / CSS selektor pořád není na 100 %“. Ta upřímnost je osvěžující, ale ve středu ve 23:00 vám rozbitý scraping neopraví.

Běžná selhání výběru prvků (a proč k nim dochází)
Simplescraper nejčastěji zradí čtyři vzory:
- Obrázky načítané až po scrollování: Prvek obrázku doslova na stránce neexistuje, dokud k němu nescrollujete. Když spustíte scraping před scrollováním, skončíte s prázdnými poli pro obrázky.
- Vnořené nebo seskupené kontejnery: Automatická detekce Simplescraperu se snaží být přesná, což někdy znamená, že vezme jen jednu část stránky místo celé opakující se sady. Uživatelé popisují tabulky, které „nejdou vybrat všechny řádky na jeden zátah“.
- Dynamický JavaScriptový obsah: Prvky, které se vykreslí až po prvním načtení stránky přes React, Vue nebo AJAX, prostě v okamžiku, kdy scraper zasáhne moc brzy, ještě nejsou k dispozici.
- Stránkování pomocí nekonečného scrollu: Data, která chcete, ještě nejsou v HTML načtená, protože je třeba scrollovat nebo kliknout na „načíst další“.
Praktické kroky při ladění
Než sáhnete po ručních selektorech, zkuste toto:
- Nejdřív celou stránku nescrollujte. Tím dostanete lazy-loaded obrázky i obsah do DOM.
- Použijte „Include Similar“, když vám počet položek připadá podezřele nízký. Vlastní dokumentace Simplescraperu to u seskupeného obsahu doporučuje.
- Počkejte na úplné vykreslení stránky u webů náročných na JS. Dejte jim pár sekund navíc před spuštěním scrapingu.
- Začněte s malým vzorkem. Ověřte počty řádků na 2–3 stránkách, než spustíte dávku 500 stránek.
Přechod na ruční CSS selektory
Když vizuální výběr pořád selhává, je čas přejít na ruční nastavení. To je ten tah, který odděluje příležitostné uživatele od efektivních.
Postup je jednoduchý:
- Klikněte pravým tlačítkem na požadovaný prvek v Chrome → Inspect.
- V DevTools najděte název třídy nebo datový atribut prvku (např.
.product-card .pricenebo[data-test="location"]). - V Simplescraperu přepněte na kartu Edit Properties a vložte selektor.
- Otestujte selektor spuštěním malého scrapingu.
Tipy pro odolné selektory:
- Upřednostněte názvy tříd (
.listing-title) před pozičními selektory (div:nth-child(3)) - Používejte datové atributy, když jsou k dispozici — obvykle bývají stabilnější při změnách webu
- Vyhněte se hluboce zanořeným cestám, které se rozbijí, jakmile se změní HTML struktura webu
AI alternativa: Nechte Thunderbit automaticky rozpoznat pole
Na rovinu — náš tým vyvinul Thunderbit právě proto, že nás tenhle problém přestal bavit. Funkce Thunderbitu „AI Suggest Fields“ čte strukturu stránky a automaticky doporučí sloupce i logiku extrakce. Žádné CSS znalosti nejsou potřeba. AI se přizpůsobí rozvržení každého webu, včetně vnořeného obsahu a obrázků načítaných až při scrollování.
Pokud strávíte laděním selektorů víc než pár minut na jeden scraping, stojí za to vyzkoušet úplně jiný přístup.
Osvědčený postup 2: Jak vybírat mezi cloud scrapingem a browser scrapingem
Většina uživatelů Simplescraperu si režim volí automaticky — obvykle ten, který zkusili jako první — aniž přemýšlí, který režim se hodí pro jejich skutečný use case. To vede ke zbytečným selháním.
Kdy použít browser scraping (lokálně)
- Stránky vyžadující přihlášení: LinkedIn, CRM dashboardy, interní nástroje — cokoli za autentizací potřebuje aktivní relaci ve vašem prohlížeči.
- Rychlé jednorázové extrakce: Už jste na stránce a chcete data hned.
- Šetření free kreditů: Browser scraping nespotřebovává cloud kredity.
Nevýhoda: počítač musí zůstat zapnutý a velké úlohy běží mnohem pomaleji než v cloudu.
Kdy použít cloud scraping
- Veřejné stránky (e-commerce seznamy, adresáře, realitní weby), kde není potřeba přihlášení.
- Plánované monitorování: Běží bez dozoru opakovaně v čase.
- Dávkové úlohy: Až 5 000 URL v jedné cloud dávce.
- Předávání do integrací: Automatické posílání do Google Sheets, Airtable nebo webhooků.
Nevýhoda: cloud scraping stojí kredity — 2 za stránku s JavaScriptem, 1 za stránku bez JS — a free tarif 100 kreditů vyčerpáte rychle.
Rozhodovací rámec
| Situace | Doporučený režim | Proč | Riziko, když zvolíte špatně |
|---|---|---|---|
| Stránky vyžadující přihlášení (LinkedIn, dashboardy) | Browser | Potřebuje vaši přihlášenou relaci | Cloud mód narazí na přihlašovací zeď |
| Veřejné e-commerce seznamy produktů | Cloud | Rychlejší, běží bez dozoru | Browser mód zaměstná váš počítač |
| Pravidelné plánované monitorování | Cloud | Běží bez vaší účasti | Browser vyžaduje, abyste byli u toho |
| Weby s tvrdou anti-bot ochranou (Amazon, Yelp) | Browser (záloha) nebo Cloud s proxy | Je potřeba rotace IP nebo opakované použití relace | Cloud bez proxy bude rychle blokován |
| Rychlá jednorázová extrakce | Browser | Okamžitě, bez nákladů na kredity | Nastavovat cloud kvůli jedné stránce je zbytečné |

Jak to zjednodušuje Thunderbit
V Thunderbitu je volba jen jednoduchý přepínač ve stejném rozhraní. Cloud režim zpracuje až 50 stránek současně — bez samostatného placeného tarifu pro přístup ke cloudu. Browser režim zvládne weby vyžadující přihlášení bez další konfigurace. Mentální zátěž typu „který režim vlastně potřebuji?“ výrazně klesne, když oba režimy žijí v jednom workflow.
Osvědčený postup 3: Jak vytěžit maximum z free tarifu Simplescraperu
Zmatek kolem cen je reálný. Viděl jsem příspěvky na fórech, kde si lidé mysleli, že „free Chrome extension“ znamená „všechno zdarma“. Neznamená. A naopak jsem viděl lidi, kteří si mysleli, že Simplescraper je drahý, protože placené tarify nejsou moc vidět. Ani jedno z toho nepomáhá.
Co free plán Simplescraperu skutečně zahrnuje
Podle aktuálních plánů Simplescraperu:
- Browser scraping: Neomezeně (běží lokálně ve vašem Chromu)
- Cloud kredity: 100 měsíčně
- Uložené recepty: 3
- Formáty exportu: CSV a JSON
- Co NENÍ zahrnuto: Prioritní podpora, pokročilé proxy možnosti, vyšší příděl cloud kreditů
Realistický scénář s free tarifem
Řekněme, že potřebujete vypsat 50 produktových stránek z veřejného e-commerce webu.
- Browser režim (zdarma): Můžete to udělat úplně bez placení. Otevřete každou stránku (nebo použijete seznam), spustíte recept a exportujete do CSV. Časová náročnost: záleží na vaší trpělivosti a rychlosti internetu, ale u 50 stránek s ruční navigací počítejte s 15–30 minutami aktivní práce.
- Cloud režim (free tarif): Se zapnutým vykreslováním JavaScriptu stojí každá stránka 2 kredity. 50 stránek = 100 kreditů. To je celý měsíční cloud limit v jedné úloze. Žádné plánování, žádné opakování při chybě.
Free tarif je opravdu užitečný pro menší, občasné scrapingy. Jakmile ale potřebujete cloud automatizaci nebo větší měřítko, rychle dojde.
Porovnání free tarifu: Simplescraper vs. Thunderbit
| Funkce | Simplescraper Free | Thunderbit Free |
|---|---|---|
| Stránky / kredity | Neomezený browser + 100 cloud kreditů | 6 stránek s plnými AI funkcemi |
| AI extrakce | Omezená (Smart Extract spotřebovává kredity) | Plné AI Suggest Fields v ceně |
| Cíle exportu | CSV, JSON | Excel, Google Sheets, Airtable, Notion — vše zdarma |
| Uložené konfigurace | 3 recepty | K dispozici šablony |
| Scraping podstránek | Ruční nastavení receptu | Započteno v počtu stránek |
Tyto modely jsou opravdu odlišné. Simplescraper vám dává neomezený lokální scraping s omezeným cloudem. Thunderbit vám dá méně stránek, ale do každé z nich vloží plné AI schopnosti a navíc bezplatné exporty do nástrojů, které týmy skutečně používají. Free tarif Simplescraperu funguje, pokud potřebujete základní lokální scraping a nevadí vám manuální práce. Pokud ale chcete AI extrakci s flexibilními exporty, free tarif Thunderbitu nabízí na jednu stránku víc.
Osvědčený postup 4: Jak se při scrapingu vyhnout blokaci
Nikdo neřeší anti-bot opatření, dokud nestojí před CAPTCHou nebo prázdným datasetem. V tu chvíli už jste ale ztratili čas a možná i kredity.
Prevence je vždy levnější než dodatečné ladění.
Nastavte rate limit a dávkujte požadavky
Nejčastější důvod blokace: bombardování webu rychlými požadavky. Pro webový server vypadá 50 požadavků za 10 sekund z jedné IP jako útok, ne jako zvědavý výzkum.
Obecné pravidlo:
- U většiny komerčních webů přidejte mezi požadavky 2–5 sekund.
- U citlivějších cílů (marketplace, recenzní weby) zpomalte na 5–10 sekund.
- Pokud používáte API Simplescraperu, parametr
waitForSelectormůže pomoci zajistit, že se stránky před extrakcí plně načtou, což přirozeně zpomalí i tempo.
Kdy zapnout rotaci proxy
Rotace proxy mění mezi požadavky vaši IP adresu, takže vypadáte jako více různých uživatelů. Budete ji potřebovat pro:
- Amazon, Yelp, TripAdvisor, LinkedIn (agresivní anti-bot systémy)
- Jakýkoli web s rate limitingem podle IP
- Velké dávky (stovky stránek z jedné domény)
Platforma Simplescraperu podporuje proxy režimy včetně standardních, prémiových a residential možností. Přesná dostupnost podle plánu ale z veřejné dokumentace nemusí být vždy úplně jasná — ověřte si ji dřív, než budete spoléhat na to, že free tarif pokryje tvrdé cíle. Residential proxy bývají obvykle dražší, ale méně často skončí jako označené.
Jak zacházet s weby náročnými na JavaScript
Moderní weby postavené na Reactu, Vue nebo Angularu vykreslují obsah až po prvním načtení stránky. Pokud scraper zasáhne dřív, než JavaScript doběhne, dostanete prázdná pole.
Strategie:
- Použijte cloud scraping pro lepší vykreslování (cloud Simplescraperu umí JavaScript spouštět).
- Před browser scrapingem stránku ručně nescrollujte, aby se načetl obsah s lazy loadingem.
- V API workflow použijte
waitForSelector, abyste počkali, až se cílové prvky objeví. - Přijměte, že některé silně dynamické single-page aplikace mohou být prostě za hranicí toho, co vizuální scraper spolehlivě zvládne.
Bezstarostná alternativa
Cloud scraping v Thunderbitu automaticky zvládá anti-bot ochranu, CAPTCHA i vykreslování JavaScriptu — bez konfigurace proxy, bez ladění prodlev, bez ručního scrollování. Pro uživatele, kteří se nechtějí stát amatérskými DevOps inženýry jen kvůli scrapingu produktového katalogu, je to zásadní. Problémy nezmizí — jen je řeší někdo jiný.
Osvědčený postup 5: Vědět, kdy Simplescraper narazil na strop
Kéž by mi někdo tuhle část napsal před dvěma lety.
Existuje bod, kdy nástroj přestane šetřit čas a začne ho jen spolykávat. Když ten práh rozpoznáte včas, ušetříte si past utopených nákladů: „Už jsem přece vytvořil 15 receptů, teď nemůžu přestat.“
Praktické limity Simplescraperu
- Dynamické single-page aplikace, které načítají obsah přes AJAX bez klasické navigace mezi stránkami
- Nekonečný scroll, který vyžaduje neustálé scrollování pro načtení všech položek (ne standardní stránkování klikáním)
- Obohacování podstránek: Scraping seznamové stránky a následné návštěvy každé detailní stránky kvůli dalším datům. Simplescraper to zvládne s dávkovými workflow, ale nastavení se rychle komplikuje.
- Změny rozvržení, které rozbijí existující recepty. Jakmile web upraví HTML strukturu, vaše pečlivě vyladěné CSS selektory přestanou fungovat.
Znaky, že jste nástroj přerostli
Pravděpodobně jste narazili na strop, když:
- Ručně upravujete CSS selektory při každém scrapingu, protože automatická detekce pořád selhává
- Recepty se po aktualizaci webu rozbíjejí a musíte je znovu stavět
- Potřebujete současně scrapovat desítky nebo stovky stránek, ale pořád narážíte na limity kreditů nebo rychlosti
- Data z podstránek vyžadují složité vícekrokové řetězce receptů
- Strávíte víc času údržbou scrapingů než využíváním získaných dat
Právě poslední bod je nejsilnější signál. Jakmile se údržba stane vaší hlavní náplní, výhoda no-code pohodlí je pryč.
Přechod na workflow s AI
Tady budu mluvit o tom, co náš tým postavil v Thunderbitu, protože byl navržen přesně pro ty selhávající scénáře popsané výše:

- AI čte každou stránku pokaždé znovu — žádné křehké recepty ani CSS selektory, které byste museli udržovat. Když web změní rozvržení, AI se přizpůsobí při dalším spuštění.
- Scraping podstránek obohatí vaši datovou tabulku na jedno kliknutí. Vyberete seznam a pak automaticky navštívíte každou detailní stránku kvůli dalším polím.
- Plánovaný scraping pomocí přirozeného jazyka („každé pondělí v 9:00“) místo nastavování předvoleb času.
- Cloud scraping až na 50 stran současně pro rychlost na veřejných webech.
- Nativní bezplatný export do Google Sheets, Airtable, Notion a Excelu bez nastavování webhooků.
Simplescraper vs. Thunderbit: srovnání vedle sebe
Tady je všechno na jednom místě:

| Schopnost | Simplescraper | Thunderbit |
|---|---|---|
| Nastavení polí | Ruční CSS selektory / vizuální výběr | AI Suggest Fields (běžná angličtina) |
| Obohacení podstránek | Možné přes dávkové workflow (složitější nastavení) | Automatické obohacení na 1 klik |
| Automatické přizpůsobení změnám rozvržení | Rozbije se (nutná ruční oprava) | AI při každém spuštění znovu přečte strukturu stránky |
| Současné zpracování stránek v cloudu | Dávky až 5 000 URL (liší se podle tarifu) | 50 stránek současně |
| Export do Notion/Airtable | Přes webhook (placené tarify) | Nativně, zdarma |
| Plánování | Předvolby + vlastní časování | Popis v přirozeném jazyce |
| Anti-bot / CAPTCHA | K dispozici proxy režimy (závisí na tarifu) | Automaticky, bez konfigurace |
| Free tarif | 100 cloud kreditů + neomezený browser + 3 recepty | 6 stránek s plnými AI funkcemi + bezplatné exporty |
Stručně řečeno: Simplescraper vyniká u jednoduché, vizuální extrakce s nízkými nároky na nastavení, kde občasné ruční doladění nevadí. Thunderbit navazuje tam, kde tenhle model začíná selhávat — řeší interpretaci stránky, adaptaci na rozvržení i složitost workflow, abyste to nemuseli dělat vy.
Ani jeden nástroj není univerzálně lepší. Jen stojí v jiné části křivky složitosti — a to je v pořádku.
Rychlý checklist osvědčených postupů pro Simplescraper
Uložte si to pro příští scraping:
- Vždy nejdřív testujte na malém vzorku. Ověřte počty řádků a úplnost polí na 2–3 stránkách, než to škálujete.
- Před scrapováním stránku nescrollujte kvůli aktivaci lazy-loaded obsahu.
- Použijte „Include Similar“, když detekce seznamu vypadá příliš úzce.
- Volte režim scrapingu záměrně. Browser pro weby s přihlášením; cloud pro veřejné stránky a plánované úlohy.
- Nastavte prodlevy mezi požadavky — minimum 2–5 sekund u komerčních webů, déle u webů s tvrdou anti-bot ochranou.
- Znáte matematiku free tarifu. 100 cloud kreditů = 50 stránek s JavaScriptem. Plánujte podle toho.
- Recepty ukládejte jen pro stabilní stránky. Když se web často mění, recepty se budou rozbíjet.
- Naučte se základy CSS selektorů jako zálohu. Názvy tříd a datové atributy jsou lepší než poziční selektory.
- Sledujte blokace proaktivně. Pokud dostáváte prázdné výsledky nebo CAPTCHy, zpomalte nebo přepněte režim.
- Poznejte, kdy jste narazili na strop. Když čas na údržbu převýší čas na využití dat, zvažte alternativy.
Závěr: Udělejte z každého scrapingu maximum
Hlavní poučení z více než tisícovky scrapingů není o žádném jednom nástroji. Je to o tom, že přístup je důležitější než software. Chápat, proč scraping selže — lazy loading, špatný režim, agresivní anti-bot, křehké selektory — je cennější než jakýkoli seznam funkcí.
Simplescraper opravdu dobře funguje pro jednoduché extrakční úlohy. Pokud máte čisté stránky, skromné potřeby a nevadí vám občasné ruční ladění, dodá vám výsledky.
Jestli ale máte pocit, že s nástrojem spíš bojujete, než že ho používáte — ladíte selektory, přestavujete rozbité recepty, nastavujete proxy, ručně scrollujete stránky — není to vaše selhání. Je to signál, že jste přerostli to, co samotný vizuální scraping zvládne.
Pokud vám to zní povědomě, zkuste free tarif Thunderbitu — šest stránek s plnými AI funkcemi, bezplatné exporty do Sheets, Airtable a Notion. Porovnejte ho se svým současným workflow a uvidíte, co vám sedne. Někdy je tím nejlepším postupem vědět, kdy sáhnout po úplně jiném nástroji.
Časté dotazy
Je Simplescraper zdarma?
Ano, Simplescraper má free plán, který zahrnuje neomezený lokální browser scraping, 100 cloud kreditů měsíčně, 3 uložené recepty a export do CSV/JSON. Cloud stránky s JavaScriptem stojí 2 kredity za kus, takže těch 100 kreditů pokryje zhruba 50 stránek v cloud režimu. Placené tarify začínají na 39 USD měsíčně (Plus) za 6 000 kreditů a 70 USD měsíčně (Pro) za 15 000 kreditů.
Umí Simplescraper pracovat s weby náročnými na JavaScript?
Někdy ano. Cloud režim Simplescraperu umí vykreslovat JavaScript a nástroj uvádí podporu pro single-page aplikace. Složitější SPA s těžkým dynamickým renderováním, nekonečným scrollem nebo agresivní anti-bot ochranou ale mohou stále vracet neúplné výsledky. Použití cloud režimu s vhodnými prodlevami spolehlivost zlepšuje, ale vysoce dynamické weby zůstávají výzvou pro každý vizuální scraper.
Jaký je rozdíl mezi cloud scrapingem a browser scrapingem v Simplescraperu?
Browser scraping běží lokálně ve vašem prohlížeči Chrome — používá vaši aktivní relaci (skvělé pro weby s přihlášením), nespotřebovává kredity, ale vyžaduje, aby byl váš počítač zapnutý. Cloud scraping běží na serverech Simplescraperu — je rychlejší, běží bez dozoru, podporuje plánování i integrace, ale stojí kredity za každou stránku a nedostane se na stránky za vaším osobním přihlášením.
Kdy bych měl přejít ze Simplescraperu na alternativu jako Thunderbit?
Nejjasnější signál je, když čas na údržbu převýší čas na využití dat. Pokud pravidelně opravujete rozbité selektory po změnách webu, ručně nastavujete proxy, znovu stavíte recepty nebo trávíte víc času laděním než analýzou získaných dat, přerostli jste to, co vám ruční vizuální scraping umí efektivně poskytnout. Nástroje jako Thunderbit, které při každém spuštění používají AI k interpretaci struktury stránky, většinu této údržby eliminují.
Jak se vyhnout blokaci při scrapingu se Simplescraperem?
Tři klíčové postupy: Zaprvé, dávkujte požadavky s prodlevami 2–5 sekund mezi stránkami (déle u webů s tvrdou anti-bot ochranou, jako je Amazon nebo Yelp). Zadruhé, jako zálohu použijte browser režim u webů, které agresivně blokují cloud IP — vaše prohlížečová relace vypadá víc jako běžný provoz. Zatřetí, zapněte rotaci proxy pro velké dávky na citlivých cílech, ale předtím si ověřte, jaké proxy možnosti váš plán skutečně obsahuje.
Zjistit více


