Každý, kdo se mě zeptá „je scrapování Instagramu legální?“, většinou dostane jednu ze tří odpovědí: „úplně v pohodě“, „rozhodně nelegální“ a „záleží“. Jen ta třetí je opravdu užitečná.
Ta nejasnost je reálná, protože odpověď závisí na tom, jaká data sbíráte, kde se nacházíte vy i lidé, jejichž data zpracováváte, jak k nim přistupujete a proč je vůbec chcete. Tenhle článek to rozsekne. Projdeme si hlavní soudní rozhodnutí, rozdíl mezi porušením pravidel platformy a porušením zákona, porovnání podle jurisdikcí i praktický rozhodovací strom, abyste si mohli posoudit vlastní situaci. Nejde o právní radu — jsem technologický autor, ne právník — ale měl by vám dát mnohem jasnější mapu terénu.
Co vlastně znamená „scraping Instagramu“?
Nejdřív definice.
Scraping Instagramu znamená používat software k automatickému sběru veřejně viditelných informací z webu nebo aplikace Instagramu — například bio v profilu, popisky příspěvků, komentáře, používání hashtagů, počty sledujících nebo metriky zapojení.
Není to totéž jako používat oficiální Graph API Instagramu, které má vlastní omezení, schvalovací pravidla a restrikce použití. Scraping nepoužívá oficiální API cestu; data bere přímo z webových stránek nebo z rozhraní aplikace.
Typické scénáře použití:
- Generování leadů: hledání potenciálních zákazníků nebo influencerů podle veřejných profilů a vzorců zapojení.
- Sledování konkurence: kontrola frekvence příspěvků, míry engagementu a obsahové strategie konkurentů.
- Průzkum trhu: analýza trendů hashtagů, sentimentu nebo geografických vzorců ve veřejných příspěvcích.
- Akademický výzkum: studium veřejné debaty, vizuální kultury nebo dynamiky sociálních sítí pro diplomku či odborný článek.
Tenhle článek řeší hlavně otázku legality — ne technický návod. Pokud se snažíte zjistit, jestli vám konkrétní použití může přinést žalobu, zákaz účtu nebo pokutu, čtěte dál.
Je scrapování Instagramu legální? Krátká odpověď
Scraping veřejně dostupných dat z Instagramu obecně není podle současné americké judikatury federálním trestným činem — ale „není to trestný čin“ a „je to úplně v pořádku“ jsou dvě dost odlišné věci.
Platí tři samostatné právní vrstvy a většina zmatku vzniká tím, že si je lidé pletou:
- Zákony o přístupu k počítačovým systémům (např. americký Computer Fraud and Abuse Act, tedy CFAA): přistupujete k datům „neoprávněně“?
- Pravidla ochrany soukromí (např. GDPR, CCPA): obsahují ta data osobní údaje a máte k jejich zpracování právní základ?
- Smlouva / podmínky používání: zakazují vaše jednání podmínky Instagramu a co se stane, když je porušíte?
Každá z těchto vrstev má jiné důsledky, jiné mechanismy vymáhání a jiné riziko. Scraping může být v jedné rovině bez problémů a v jiné vážný průšvih.
„Je můj scraping legální?“ — rozhodovací strom, který můžete opravdu použít
Na tohle téma jsem četl desítky článků. Všechny vyjmenovávají stejné právní faktory v dlouhých odstavcích — a žádný vám nedá způsob, jak si vlastní situaci skutečně posoudit za méně než minutu. Tady je rozhodovací strom:
| Krok | Otázka | Pokud ANO → | Pokud NE → |
|---|---|---|---|
| 1 | Je data vidět veřejně i bez přihlášení? | Přejděte na krok 2 | ⚠️ Vysoké riziko — pravděpodobně se dotýká CFAA / ochrany přístupových kontrol |
| 2 | Obsahují data osobní údaje (jména, fotky, bio, e-mailové adresy)? | Přejděte na krok 3 (platí GDPR/CCPA) | Nižší riziko — přejděte na krok 4 |
| 3 | Máte podle GDPR/CCPA právní základ (oprávněný zájem, souhlas apod.)? | Přejděte na krok 4 | ⛔ Bez právníka nepokračujte |
| 4 | Jde o komerční využití (prodej dat, generování leadů, SaaS produkt)? | Vyšší riziko vymáhání — prověřte TOS a precedenty s výzvami k ukončení | Nižší riziko — zvlášť pro osobní nebo akademické použití |
| 5 | Vyhýbáte se technickým obcházením a nadměrnému automatizovanému přístupu? | Nižší praktické riziko | Zvyšuje se právní, platformní i účetní riziko |
Tohle není volná vstupenka — je to rámec pro vyhodnocení rizika. Pokud jste na krocích 1, 3 a 5 odpověděli „ano“ a na krok 4 „ne“, jste v nižším rizikovém pásmu. Pokud jste přihlášení, sbíráte osobní data bez právního základu, prodáváte je komerčně a ignorujete kontrolní mechanismy platformy, vrstvíte riziko na riziko.
V byznysových workflow je nižší riziko často jednoduše v tom Instagram vůbec nepoužívat a sáhnout po povolených veřejných zdrojích, jako jsou weby firem, landing pages tvůrců, e‑commerce stránky, adresáře nebo licencované datasety. Tenhle strom platí bez ohledu na to, jaký nástroj používáte.

Krok 1: Jsou data veřejně viditelná?
Test v anonymním okně: otevřete privátní okno prohlížeče (bez přihlášení do Instagramu), přejděte na stránku a podívejte se. Pokud data vidíte, jsou v praktickém smyslu přístupná veřejně. Americké případy jako hiQ v. LinkedIn zacházejí s veřejně dostupnými daty bez přihlášení jinak než s daty za přístupovou kontrolou, pokud jde o CFAA — ale to není univerzální licence ke sběru.
Instagram navíc průběžně mění, co je možné vidět bez přihlášení. Než začnete, ověřte si, co je skutečně veřejné dnes.
Krok 2: Obsahuje to osobní údaje?
Osobní údaje jsou podle GDPR a CCPA definovány široce: uživatelská jména, profilové fotky, bio, e-mailové adresy, lokalizační štítky a dokonce i odvozené vlastnosti z obrázků nebo popisků. Pokud scrapujete profily na Instagramu, téměř jistě sbíráte osobní údaje.
Veřejná viditelnost vás nevyjímá z práva na ochranu soukromí — to je jeden z nejrozšířenějších mýtů v téhle oblasti.
Krok 3: Máte právní základ?
Podle článku 6 GDPR musíte mít před zpracováním osobních údajů zdokumentovaný právní základ. Nejčastěji se u scrappingu uvádí „oprávněný zájem“, ale ten vyžaduje formální test vyvážení — váš zájem vs. práva subjektu údajů. Další možností je souhlas, ale ten je při scrapování ve velkém nepraktický.
Podle CCPA mají obyvatelé Kalifornie práva vztahující se k jejich osobním údajům, včetně práva vědět, smazat a odmítnout prodej nebo sdílení. Pokud jste povinná firma a sbíráte data o obyvatelích Kalifornie, tyto povinnosti se na vás vztahují.
Bez právního základu + osobní údaje = zastavit a vyhledat právní radu.
Krok 4: Jde o komerční využití?
Komerční využití — prodej datasetů, budování lead-gen produktů, napájení SaaS nástroje — přitahuje nejvíc pozornosti ze strany Meta. Osobní projekty a akademický výzkum bývají v praxi méně rizikové, i když ne bezrizikové.
Krok 5: Respektujete rate limity a mantinely platformy?
Nepřekonávejte CAPTCHA, přihlašovací zdi, anti-bot ochrany ani omezení účtů. I když data vypadají veřejně, agresivní automatizovaný přístup zvyšuje riziko zásahu platformy, smluvní riziko, soukromoprávní riziko i provozní riziko.
Veřejná vs. soukromá data: hranice, na které záleží nejvíc
Všechno stojí na jednom rozdílu: veřejná versus soukromá data.
| Obecně nižší riziko scrapeovat | Nescrapujte |
|---|---|
| Veřejné bio profilu, zobrazované jméno | Příspěvky a stories soukromých účtů |
| Veřejné popisky příspěvků a komentáře | Přímé zprávy (DM) |
| Veřejné používání hashtagů | Obsah za přihlašovací zdí |
| Veřejné počty zapojení (lajky, počty komentářů) | Data z falešných / koupených účtů |
| Veřejné profilové fotky (s výhradami podle práva na soukromí) | Seznamy sledujících ve velkém (šedá zóna) |
Šedých zón je spousta. Seznamy sledujících a sledovaných, geolokační data v označeních a účty dětí se právně pohybují v nejasném prostoru. I když jsou technicky vidět, scraping ve velkém může vyvolat obavy o soukromí nebo zásah platformy. Když si nejste jistí, je bezpečnější to nesbírat.
U amerického práva v oblasti přístupu k počítačům je relevantní logika z případů jako hiQ v. LinkedIn, ale je potřeba držet rozsah úzký: jde o oprávnění k přístupu podle CFAA, ne o závěr, že každý veřejný profil na sociální síti lze volně sbírat a znovu používat. Na GDPR a podobná pravidla se navíc vztahuje úplně jiný rámec.
Porušení TOS vs. trestní odpovědnost: největší omyl kolem scrapování Instagramu
Řeknu to napřímo:
Porušení podmínek používání Instagramu není trestný čin.
Podmínky používání Instagramu Terms of Use uvádějí, že uživatelé nesmí zakládat účty ani přistupovat ke sběru informací neoprávněným způsobem, včetně automatizovaného sběru bez výslovného svolení Instagramu. Stejně tak podmínky Meta pro Automated Data Collection Terms vyžadují výslovný písemný souhlas.
Jde o smluvní pravidla — dohodu mezi vámi a Instagramem. Jejich porušení může vést k blokaci účtu a v krajním případě i k občanskoprávní žalobě. Nejde ale o trestní zákon.
Zjednodušená právní hierarchie vypadá takto:
| Právní vrstva | Co to je | Důsledek porušení |
|---|---|---|
| Smluvní právo (TOS) | Dohoda mezi vámi a Instagramem | Zablokování účtu, občanskoprávní žaloba za porušení smlouvy |
| Zákonná úprava (CFAA) | Federální zákon o přístupu k počítačům | Možná trestní odpovědnost — ale výrazně omezená po Van Buren v. US (2021) |
| Regulace (GDPR/CCPA) | Pravidla ochrany soukromí | Pokuty až do výše 4 % globálních tržeb (GDPR); různé sankce podle CCPA |
To je ten klíčový rozdíl: pravidlo platformy může znamenat riziko blokace účtu a smluvní občanskoprávní odpovědnost, aniž by se automaticky jednalo o trestný čin podle zákona o počítačové kriminalitě.
Nuance je důležitá, protože Meta v. Bright Data (leden 2024) dopadlo ve prospěch Bright Data v argumentaci o porušení smlouvy při scrapování veřejných dat z Facebooku a Instagramu po odhlášení. Rozhodnutí ale bylo úzké: přístup bez přihlášení, veřejná data, konkrétní skutkový stav a jeden americký okresní soud. Neznamená to, že je povolen scraping za přihlašovací zdí, sběr přes falešné účty, zpracování soukromých dat, porušování pravidel ochrany soukromí nebo jakékoli komerční znovupoužití dat z Instagramu.
Co se skutečně může stát, když scrapujete Instagram: matice rizik
Lidé se pořád ptají: „Může mě Instagram žalovat?“ a „Dostanu ban na účet?“ Tady je upřímný rozklad:
| Následek | Co se stane | Závažnost | Pravděpodobnost |
|---|---|---|---|
| Zákaz / pozastavení účtu | Okamžitě, obvykle bez odvolání | Nízký až střední dopad | VYSOKÁ u agresivního scrapingu |
| Dopis s výzvou k ukončení | Právní upozornění od právníků Meta | Střední dopad (náklady na odpověď) | STŘEDNÍ u komerčního využití |
| Občanskoprávní žaloba (porušení TOS) | Nárok na náhradu škody, soudní zákaz | Vysoký dopad | NÍZKÁ (typicky pro velký objem / komerční provoz) |
| Trestní stíhání podle CFAA | Trestní obvinění | Velmi vysoký dopad | VELMI NÍZKÁ (po Van Buren výrazně omezeno) |
| Pokuta podle GDPR | Až 4 % globálních tržeb | Velmi vysoký dopad | NÍZKÁ až STŘEDNÍ u scrappingu osobních dat z EU |
Nejpravděpodobnější jsou dvě věci: omezení účtu a výzva k ukončení činnosti. Nejlepší kontrola není technický workaround; je to disciplína v rozsahu: nesbírat data po přihlášení ani přes brány, minimalizovat osobní údaje, zdokumentovat účel a právní základ a pokud možno použít oficiální nebo souhlasem podložené cesty.
Meta na své stránce o pokroku v oblasti soukromí uvádí, že blokuje miliardy podezřelých neoprávněných scrapingových akcí denně napříč Facebookem, Instagramem a WhatsAppem. Jde o vlastní tvrzení Meta, které nemohu nezávisle ověřit, ale ukazuje, jak vážně vymáhání bere.
Země po zemi: kde je scrapování Instagramu legální?
Legálnost závisí na jurisdikci a žádné dvě země k tomu nepřistupují úplně stejně. Tady je srovnávací tabulka, která podle mého zjištění nikde jinde není v takhle přehledné podobě:
| Jurisdikce | Klíčový zákon / zákony | Scraping veřejných dat | Scraping osobních údajů | Riziko jen kvůli TOS | Významný případ / rozhodnutí |
|---|---|---|---|---|---|
| USA | CFAA, státní varianty CFAA | Nižší riziko podle CFAA u veřejných dat bez přihlášení v některých případech, ale záleží na faktech | Na kvalifikované firmy a obyvatele Kalifornie se může vztahovat CCPA/CPRA | I tak může zůstat smluvní / účetní / občanskoprávní riziko | hiQ v. LinkedIn (2022), Van Buren v. US (2021), Meta v. Bright Data (2024) |
| EU | GDPR, směrnice o databázích | Nižší riziko z pohledu soukromí, pokud nejde o osobní údaje; mohou ale hrát roli i jiná práva | Vyžaduje právní základ podle čl. 6 | I nadále může hrát roli smluvní a platformní vymáhání | Vymáhání GDPR; riziko zvláštních kategorií údajů v obrázcích/bio |
| Velká Británie | UK GDPR, DPA 2018 | Podobné jako v EU | Vyžaduje právní základ; pokyny ICO aktualizované v dubnu 2026 | I nadále může hrát roli smluvní a platformní vymáhání | Pokyny ICO |
| Kanada | PIPEDA, provinční zákony | Nižší riziko, pokud nejde o osobní údaje | Může se uplatnit souhlas a další povinnosti v oblasti soukromí | I nadále může hrát roli smluvní a platformní vymáhání | Omezený precedens přímo k scrapingu |
| Brazílie | LGPD | Nižší riziko, pokud nejde o osobní údaje | Vyžaduje právní základ | I nadále může hrát roli smluvní a platformní vymáhání | Vznikající vymáhání; zatím žádný zásadní případ k scrapingu |
| Austrálie | Privacy Act 1988 | Nižší riziko, pokud nejde o osobní údaje | Mohou se uplatnit Australian Privacy Principles (APPs) | I nadále může hrát roli smluvní a platformní vymáhání | Omezený precedens přímo k scrapingu |
Napříč všemi šesti jurisdikcemi je vidět stejný vzorec. Ve všech platí, že scraping nepersonálních veřejných dat je nejméně rizikový scénář. Jakmile se objeví osobní údaje, vstupuje do hry právo na ochranu soukromí — a tvrzení „data byla veřejně viditelná“ není podle GDPR, UK GDPR ani LGPD obranou. Je to faktor, ale samo o sobě ne právní základ.
Pro čtenáře, kteří řeší datovou rezidenci a přeshraniční sběr: záleží i na tom, kde jsou data sbírána, zpracovávána a ukládána. Pokud používáte třetí stranu nebo dodavatele pro povolené veřejné zdroje, před sběrem osobních údajů si prověřte region, retenční politiku a bezpečnostní / privacy kontrolní mechanismy.
Klíčové právní milníky pro riziko scrapingu Instagramu
Pár právních a platformních milníků vysvětluje, proč je odpověď pořád tak nuanceovaná:
- 2017: hiQ v. LinkedIn — okresní soud vydává předběžné opatření, které LinkedIn brání blokovat hiQ ve scrapingu veřejných profilů. První velké americké rozhodnutí ve prospěch scrapingu veřejných dat.
- 2018: V EU vstupuje v platnost GDPR, nejkomplexnější rámec ochrany osobních údajů na světě.
- 2020: V Kalifornii vstupuje v platnost CCPA. Meta podává žalobu Meta v. BrandTotal, zaměřenou na scraping dat z Facebooku.
- 2021: Van Buren v. United States — Nejvyšší soud USA zužuje výklad ustanovení CFAA o „překročení oprávněného přístupu“. Pro právo scrapingu jde o zásadní zlom.
- 2022: hiQ v. LinkedIn — odvolací soud 9. obvodu vydává konečné rozhodnutí potvrzující, že scraping veřejných dat neporušuje CFAA.
- 2024: Meta v. Bright Data — federální soud v Severním okrese Kalifornie rozhoduje, že podmínky Facebooku/Instagramu nebránily Bright Data ve scrapingu veřejných dat po odhlášení. Úzké, ale významné rozhodnutí.
- 2024 a dále: Meta pokračuje ve veřejném prosazování anti-scraping pravidel. Na své stránce o pokroku v oblasti soukromí uvádí, že blokuje miliardy podezřelých neoprávněných scrapingových akcí denně napříč Facebookem, Instagramem a WhatsAppem. Berte to jako tvrzení samotné Meta, ne jako nezávisle ověřený benchmark.
Jak Van Buren v. US změnil pohled na scraping veřejných dat
Před případem Van Buren existoval reálný argument, že scraping jakéhokoli webu proti jeho vůli může být podle CFAA federálním trestným činem. Znění o „překročení oprávněného přístupu“ bylo dost široké na to, aby se někteří žalobci i státní zástupci pokoušeli vztáhnout ho na porušení TOS.
Nejvyšší soud tomu udělal přítrž. V případu Van Buren soud přijal rámec „brány nahoře vs. brány dole“: CFAA dopadá na situace, kdy někdo obejde technologickou přístupovou bariéru (např. přihlašovací zeď nebo heslo), ne na situace, kdy přistupuje k informacím, které jsou volně dostupné, i když si majitel webu nepřeje, aby je někdo sbíral.
Pro scraping je praktický dopad zásadní. Pokud jsou data za přihlašovací zdí nebo jinou přístupovou kontrolou, CFAA riziko rychle roste. Pokud jsou data na veřejné stránce, kterou si může v anonymním okně otevřít kdokoli, argument podle CFAA je obecně slabší — i když rizika podle soukromí, smlouvy, IP a vymáhání platformy mohou zůstat.
Většina konkurenčních článků cituje hiQ, ale nedostatečně vysvětluje Van Buren. Tyto rozsudky se doplňují a Van Buren je možná důležitější, protože jde o rozhodnutí Nejvyššího soudu s celostátní závazností, ne o rozhodnutí odvolacího soudu v jednom obvodu.
Jak Meta vymáhá svá pravidla
Meta nezůstává stát. Podle vlastních veřejných vyjádření její nástroje vymáhání zahrnují:
- Rate limity a datové limity pro omezení automatizovaného sběru.
- Detekci vzorců pro odhalování neobvyklého chování při sběru.
- Omezení nebo deaktivaci účtů, pokud Meta usoudí, že automatizace porušuje její podmínky.
- Výzvy k ukončení činnosti, žaloby a požadavky na odstranění u vysoce objemových nebo komerčních scrapingových operací.
I když vás zajímá jen právní riziko, zásah platformy je důležitý. Veřejná pozice Meta je jasná: automatizovaný sběr z jejích platforem bez svolení porušuje její pravidla a firma do jeho potírání výrazně investuje.
Scraping Instagramu pro akademický výzkum: co by měli vědět studenti a výzkumníci
Doktorandi a akademičtí výzkumníci spadají do jiné rizikové kategorie — často nižší než komerční přeprodej dat, ale rozhodně ne nulové.
Nižší riziko než komerční scraping? Ano. Automatická výjimka? Ne.
Analýza fair use u dat z Instagramu
V USA doktrína fair use (17 U.S.C. § 107) posuzuje čtyři faktory:
- Účel a povaha užití: nekomerční, vzdělávací a transformační užití nahrává fair use. Akademický výzkum si obvykle vede dobře.
- Povaha chráněného díla: faktická data (počty sledujících, datum příspěvku) jsou méně chráněná než kreativní obsah (fotky, popisky). Scraping kreativního obsahu je rizikovější.
- Množství použití: scrapovat celý veřejný profil je něco jiného než pár datových bodů. Sbírejte jen to minimum.
- Dopad na trh: pokud váš výzkum nekonkuruje komerčním službám Instagramu, tento faktor vám hraje do karet.
Akademický výzkum obvykle vychází z této analýzy příznivě, ale není to záruka — zvlášť pokud scrapujete velké objemy kreativního obsahu (obrázky, videa, celé popisky).
Zvažování IRB
Pokud váš výzkum zahrnuje identifikovatelná data o lidech — a profily na Instagramu jsou ze své podstaty identifikovatelné — může váš univerzitní Institutional Review Board (IRB) potřebovat váš plán sběru dat posoudit a schválit. Platí to i tehdy, když jsou data veřejně viditelná. Než začnete scrapovat, ověřte si to u IRB.
Výzkumné programy přímo od platformy
Meta nabízí Content Library and API pro schválené výzkumníky, které poskytují přístup k veřejně dostupnému obsahu z Facebooku, Instagramu a Threads. Žádosti procházejí nezávislým posouzením. Pokud máte nárok, jde o nižší rizikovou oficiální cestu pro akademický výzkum Instagramu.
(Poznámka: Nástroj Meta CrowdTangle, který byl mezi výzkumníky populární, je už z velké části ukončen. Content Library/API je jeho nástupce.)
Minimalizace dat pro výzkumníky
Praktické doporučení:
- Sbírejte jen ty datové body, které skutečně potřebujete k výzkumné otázce. Nescrapujte celé profily „pro jistotu“.
- Anonymizujte datasety co nejdříve — odstraňte uživatelská jména, rozmažte profilové fotky, agregujte data místo reportování na úrovni jednotlivců.
- Nastavte politiku uchovávání dat: jak dlouho je budete držet a kdy je smažete?
- Zdokumentujte metodiku a právní základ (pokud je relevantní pro GDPR compliance).
Pro výzkum mimo Instagram-specific sběr mohou pomoci nástroje pro minimalizaci dat. Funkci Thunderbit „Field AI Prompt“ lze nastavit tak, aby při extrakci z povolených veřejných zdrojů data kategorizovala, formátovala nebo anonymizovala — například místo ukládání většího množství surového textu vytáhla kategorii nebo štítek sentimentu.
Kontrolní seznam s nižším rizikem před sběrem dat z Instagramu
Když už je právní mapa jasná, tady je praktický checklist pro snížení rizika:
- Scrapujte jen veřejně viditelná data. Použijte test v anonymním okně. Pokud je bez přihlášení nevidíte, nescrapujte je.
- Nikdy neobcházejte přihlašovací zdi ani nepoužívejte falešné účty. Tady prudce roste riziko podle CFAA, smluvního práva i zásahu platformy.
- Technické a účtové kontroly berte jako stopku. CAPTCHA, přihlašovací zdi, omezení účtu a anti-bot systémy jsou jasné červené varovné signály.
- Minimalizujte sběr osobních údajů. Sbírejte jen to, co skutečně potřebujete. Když nepotřebujete uživatelská jména, nesbírejte je.
- Mějte politiku uchovávání a mazání dat. Vězte, jak dlouho data uchováte a kdy je smažete.
- Zdokumentujte právní základ, pokud sbíráte osobní údaje (zejména kvůli GDPR). „Oprávněný zájem“ vyžaduje písemný test vyvážení, ne jen vágní záměr.
- Používejte oficiální, licencované, souhlasem podložené nebo ne-Instagram zdroje tam, kde dávají smysl. Nejnižší riziko bývá u sběru, který na Instagramu vůbec nemusíte dělat.
Poznámka k nástrojům a alternativám
Pokud je vaším skutečným cílem výzkum tvůrců, monitoring značek nebo generování leadů, často vůbec nepotřebujete scrapovat Instagram přímo. Veřejné firemní weby, landing pages tvůrců, e‑commerce weby, firemní adresáře a eventové stránky obsahují spoustu stejných informací — a scraping těchto zdrojů s sebou nese mnohem menší riziko specifické pro platformu.
Thunderbit je postavený přesně pro tenhle typ sběru veřejných webových dat. Jde o AI Web Scraper Chrome extension, která dokáže strukturovaně extrahovat data z webů, PDF a obrázků pomocí instrukcí v přirozeném jazyce. Pro tuto diskusi jsou důležité hlavně tyto body:
- Workflow z veřejných zdrojů: Thunderbit může sbírat strukturovaná data z povolených veřejných webů bez použití vašeho osobního Instagram účtu.
- AI Suggest Fields: AI přečte stránku a navrhne, jaké sloupce dat extrahovat, takže nesbíráte zbytečně moc.
- Field AI Prompt: můžete nastavit pravidla extrakce tak, aby data během scrapingu štítkovala, formátovala nebo anonymizovala — užitečné pro GDPR compliance i minimalizaci dat ve výzkumu.
- Bezplatný export dat: export do Excelu, Google Sheets, Airtable nebo Notion bez paywallu.
- Instant Data Scraper Templates: předpřipravené šablony pro populární typy webů, které automaticky řeší stránkování i podstránky.
Aby bylo jasno: Thunderbit není nástroj na scraping Instagramu ani na obcházení kontrol Meta. Pro řadu use casů — generování leadů, monitoring e-commerce, výzkum konkurence — existují veřejné webové zdroje mimo Instagram, kde jsou podmínky i povinnosti v oblasti soukromí jasnější, a Thunderbit sběr těchto dat výrazně zjednodušuje.

Můžete se podívat na ceny Thunderbit nebo si projít návody na Thunderbit YouTube Channel, abyste viděli, jak funguje v praxi.
Hlavní závěry
- Scraping veřejně dostupných dat z Instagramu není podle současné americké judikatury automaticky nelegální, ale „není to nelegální“ a „je to bez rizika“ jsou dvě úplně jiné věci.
- Důležité jsou tři právní vrstvy: zákony o přístupu k počítačům (CFAA), pravidla ochrany soukromí (GDPR/CCPA) a smluvní podmínky/TOS. Nezaměňujte je.
- Porušení TOS není trestný čin. Může vést k blokaci účtu a občanskoprávním žalobám, ale ne ke kriminálnímu stíhání (po Van Buren).
- Právo na ochranu soukromí platí i pro veřejná data. Pokud sbíráte osobní údaje, potřebujete právní základ — zvlášť podle GDPR a CCPA.
- Jurisdikce rozhoduje. Právní situace se výrazně liší mezi USA, EU, Velkou Británií, Kanadou, Brazílií a Austrálií.
- Rozhodovací strom je váš nejlepší kamarád. Projděte si ho u každého projektu sběru dat: veřejný přístup → osobní údaje → právní základ → use case → kontroly platformy.
- Akademičtí výzkumníci mají nižší, ale ne nulové riziko. Pokud můžete, využijte Meta Content Library/API, sbírejte jen nezbytná data, anonymizujte co nejdřív a konzultujte IRB.
- Zvažte alternativní zdroje dat. Pro mnoho byznys use casů poskytují potřebná data veřejné weby, adresáře a stránky tvůrců bez platformního rizika spojeného s Instagramem. Nástroje jako Thunderbit tento sběr výrazně usnadní.
- U vysoce rizikového komerčního využití se poraďte s právníkem. Tenhle článek je mapa, ne právní stanovisko.
Často kladené otázky o legálnosti scrapování Instagramu
Může mě Instagram žalovat za scraping veřejných dat?
Meta může poslat výzvu k ukončení činnosti nebo podat občanskoprávní žalobu za porušení svých podmínek používání. Americké soudy — včetně Meta v. Bright Data (2024) — ale rozhodly, že podmínky Instagramu v určitých situacích nebránily scrapingu veřejných dat po odhlášení, a Van Buren v. US (2021) výrazně zúžil odpovědnost podle CFAA za přístup k veřejným informacím. Pravděpodobnost žaloby je u malého, nekomerčního použití nízká, ale není nulová — zejména u komerčních operací.
Je scraping Instagramu v Evropě legální?
Scraping veřejně dostupných, neosobních dat je obvykle z hlediska soukromí méně rizikový scénář, ale data z Instagramu často osobní údaje obsahují. Pokud jsou osobní údaje ve hře, potřebujete právní základ podle článku 6 GDPR — například oprávněný zájem s doloženým testem vyvážení. Pokuty za nesoulad mohou dosáhnout až 4 % ročního globálního obratu. Pokyny ICO (aktualizované v dubnu 2026) vyžadují, aby organizace před zpracováním určila a zdokumentovala svůj právní základ.
Dostanu ban na Instagramu za scraping?
Omezení účtu patří mezi nejpravděpodobnější důsledky agresivního scrapingu. Zásady Instagramu pro omezení účtu popisují neoprávněný scraping jako automatizaci používanou ke sběru informací v rozporu s podmínkami. Vyhýbání se scrapingu z osobního účtu snižuje riziko zablokování, ale nezbavuje sběr z Instagramu právního ani smluvního rizika.
Je scraping Instagramu legální pro akademický výzkum?
Obecně jde o nižší riziko než u komerčního přeprodeje, zejména u nekomerčního výzkumu veřejných dat, ale nejde o automatickou výjimku. Může být relevantní fair use nebo fair dealing, přesto by si výzkumníci měli u identifikovatelných dat o lidech ověřit požadavky IRB, praktikovat minimalizaci dat a zvážit použití Meta Content Library and API pokud mají nárok.
Jaký je rozdíl mezi scrapováním Instagramu a použitím Instagram API?
Oficiální Instagram Graph API poskytuje strukturovaný přístup pro schválené business a creator use casy, ale má omezení, požadavky na review a pravidla použití. Scraping sbírá data viditelná na webu mimo tuto oficiální API cestu. Obě varianty mají právní souvislosti: používání API se řídí vývojářskými podmínkami Meta, zatímco veřejný scraping bez přihlášení byl v některých úzkých amerických případech posouzen příznivě, ale stále může narážet na podmínky, soukromí, IP a zásahy platformy. Pro většinu byznys use casů jsou nižším rizikem oficiální API, data se souhlasem, licencovaná data nebo veřejné zdroje mimo Instagram.
Další informace


