Nejlepší Temu scrapery v roce 2026 — co funguje a co ne

Poslední aktualizace August 13, 2026
Nejlepší Temu scrapery v roce 2026 — co funguje a co ne

Temu dnes oslovuje více než 416 milionů měsíčně aktivních uživatelů ve více než 50 trzích. V jeho katalogu najdeš úplně všechno od kuchyňských vychytávek přes doplňky pro domácí mazlíčky až po LED pásky. Pokud pracuješ v ecommerce, dropshippingu nebo competitive intelligence, nejspíš už ses snažil dostat data z Temu do tabulky — a pak ses přesvědčil, že Temu o to opravdu, opravdu nestojí.

Strávil jsem hodně času průzkumem a testováním scrapingových nástrojů pro chráněné ecommerce weby. Temu patří mezi nejtěžší cíle. Většina online návodů ti buď předhodí Python tutoriál, který za týden přestane fungovat, nebo tě pošle k enterprise API, které stojí víc než tvůj měsíční rozpočet na reklamu.

Realita je taková, že většina business uživatelů — dropshippeři, samostatní podnikatelé, marketingové týmy — chce jednoduše čistou tabulku s názvy produktů, cenami, obrázky, hodnocením a informacemi o prodejci. Nechtějí ve dvě ráno ladit Playwright skripty.

Tenhle průvodce je postavený přesně na tenhle problém: praktický, podle úrovně dovedností členěný přehled nejlepších Temu scraperů, které v roce 2026 skutečně fungují, plus osvědčené postupy, které z obyčejného scrapingu udělají průběžnou competitive intelligence. Ať už jsi úplný začátečník, nebo vývojář, který staví datovou pipeline, najdeš si tu svou část.

Vyzkoušet Thunderbit pro scraping Temu

Proč scrapovat Temu? Hlavní use cases pro business týmy

Data z Temu nejsou jen zajímavá — jsou strategicky užitečná.

Platforma se stala výrazným cenotvorným faktorem u levnějších i středně drahých produktových kategorií. I když na Temu nic neprodáváš, tvoji zákazníci porovnávají ceny s tím, co vidí tam. Takhle různě týmy data z Temu využívají:

Use CasePotřebná dataProč je to důležité
Průzkum produktů pro dropshippingNázev, cena, obrázek, hodnocení, počet recenzí, počet prodaných kusů, variantyPomáhá najít levné produkty s jasnými signály poptávky pro porovnání s Amazonem, Shopify, AliExpressem a TikTok Shopem
Konkurenční cenotvorbaAktuální cena, původní cena, sleva %, měna, doprava, časová značkaSlouží jako základ pro cenovou strategii a plánování promo akcí
Sourcing produktůParametry, obrázky, varianty, prodejce/obchod, ID položky, kategoriePomáhá identifikovat typy produktů a nabídky ve stylu dodavatelů, které stojí za hlubší ověření
Analýza tržních trendůVyhledávací klíčové slovo, kategorie, počet prodaných kusů, počet recenzí, hodnoceníUkazuje, které produkty napříč kategoriemi nabírají na síle
Marketingový a kreativní průzkumNázev, obrázek, počet recenzí, hodnocení, popisky, štítky kategoriíOdhaluje messaging, vizuální háčky, balíčky a tvrzení používaná u listingů s vysokým objemem
Monitoring zásob a dostupnostiURL produktu, dostupnost, odhad dopravy, cena, časová značkaZachycuje výpadky skladu, změny v lokálním skladu a cenové pohyby v čase

Lidé, kteří hledají „best Temu scrapers“, obvykle spadají do tří skupin. Net technical uživatelé chtějí rozšíření do Chromu, které vyplivne tabulku. Mírně techničtí operátoři chtějí vizuální nástroj se šablonami a plánováním. Vývojáři chtějí API, Playwright skript a proxy strategii.

Tenhle článek pokrývá všechny tři — ale začíná u největší skupiny: lidí, kteří potřebují data, ne kód.

Čím nejlepší Temu scrapery v roce 2026 vynikají

Scraper, který zvládne Amazon nebo Shopify, nemusí Temu přežít. Hodnoticí kritéria pro tenhle článek jsou:

  1. Spolehlivost na Temu — Vrací skutečně čistá data, nebo se nechá zablokovat, vrací prázdné řádky, případně se rozbije po změně layoutu?
  2. Jednoduchost použití — Může nezačínající business uživatel začít bez programování?
  3. Úplnost dat — Podporuje obohacení přes podstránky (návštěvu detailu každého produktu kvůli parametrům, variantám a informacím o prodejci)?
  4. Nároky na údržbu — Přizpůsobí se, když Temu změní strukturu stránky?
  5. Plánování a monitoring — Umí opakovaný scraping a export do živého datového cíle?
  6. Cílová exportní místa — CSV, Excel, Google Sheets, Airtable, Notion, JSON?
  7. Jasnost ceny — Kolik ve skutečnosti stojí realistický workflow pro scraping Temu za měsíc?

Komunitní hlášení na Redditu v r/webscraping Temu konzistentně popisují jako jeden z nejtěžších ecommerce webů na scraping. Jeden uživatel napsal, že „ani jako kupující nedostane cenu“, zatímco jiný poznamenal, že Temu a Shopee mají týmy, které průběžně posilují anti-bot mechanismy. Veřejně dostupná data o míře selhání specificky pro Temu neexistují, ale 2025 Imperva Bad Bot Report ukázal, že automatizovaný provoz předběhl lidský, přičemž boti tvořili 51 % veškerého internetového provozu. To je prostředí, proti kterému se Temu brání.

Anti-bot obrana Temu: proč většina scraperů selže

Většina článků o scrapingu Temu věnuje anti-bot opatřením jednu větu: „Temu používá anti-bot.“ To je k ničemu.

Když vybíráš nástroj, potřebuješ vědět, kterou obranu Temu používá a jaká funkce nástroje ji dokáže obejít. Tady je praktická mapa:

Obrana TemuCo děláJaká schopnost nástroje je potřebaPříklad nástrojů
Cloudflare WAF / browser checksBlokuje automatizované user-agenty, rozpoznává botí fingerprinty, vrací challenge stránkyCloudová infrastruktura s rotujícími residential IP a skutečnými browser fingerprintyThunderbit (cloud scraping), Bright Data, Oxylabs, ScraperAPI
Silné JavaScript renderováníData o produktech se načítají přes JS; surové HTML je prázdnéHeadless browser nebo plné browser renderováníThunderbit (browser scraping mode), Playwright, Selenium, ParseHub, Apify browser actors
Dynamické CSS selektoryClass names se mění mezi nasazením a rozbíjejí CSS-based scraperyAI-based detekce polí (nezávislá na pevných selectorech)Thunderbit (AI čte stránku při každém běhu znovu), Bright Data AI scraper builder
Rate limitingOmezování příliš rychlých sekvenčních požadavkůParalelní cloud requests s inteligentním throttlingemThunderbit (až 50 stránek najednou přes cloud), ScraperAPI, Bright Data
CAPTCHA challengePřerušuje relace po podezřelém chováníVestavěné řešení CAPTCHA nebo strategie s nižším triggeremBright Data, Oxylabs, ScraperAPI premium/ultra-premium
Nekonečný scroll / lazy loadingBez interakce se zobrazí jen první produktyChytré scrollování, detekce stránkování, automatizace interakcíThunderbit pagination, Apify smart scrolling, Octoparse workflow builder

temu-anti-scraping-defenses.webp

Cloudflare WAF a blokování IP adres

Vstupní bránu Temu hlídají browser integrity checks ve stylu Cloudflare. Základní HTTP requesty — tedy typ požadavku, který dělá jednoduchý Python requests.get() — jsou buď vyzvány k potvrzení, vrací 403, nebo dostanou neúplná data.

Nástroje, které tady fungují, potřebují rotující residential nebo mobilní IP a skutečné browser fingerprinty. Cloudflare ve své 2025 Radar review uvedl, že ne-AI boti zahájili rok 2025 zhruba na polovině všech HTML page requestů. To je rozsah automatizace, proti kterému platformy jako Temu brání své služby.

Renderování JavaScriptu a dynamické selektory

Tady většina začátečnických scraperů tiše selže.

Když si zobrazíš zdroj stránky Temu, často uvidíš jen prázdnou skořápku — skutečné product cards, ceny a obrázky se doplňují přes JavaScript až po načtení stránky. Scraper, který čte jen surové HTML, nevrátí nic užitečného. Navíc se CSS class names a DOM struktura Temu mezi nasazeními mění. Scraper, který spoléhá na pevný CSS selector jako .product-card__price, bude dnes fungovat a zítra vrátí prázdné sloupce.

AI scrapery (například Thunderbit) čtou stránku sémanticky při každém běhu, takže nejsou závislé na tom, že se konkrétní class names nezmění.

Rate limiting a CAPTCHA výzvy

Když Temu zatížíš příliš rychlými nebo četnými požadavky z jedné IP, spustíš rate limits nebo CAPTCHA challenge. Některé nástroje to řeší inteligentním throttlingem a vestavěným CAPTCHA solvingem. Jiné to nechají na tobě — což je pro netechnického uživatele v podstatě slepá ulička.

U cloud scrapingu je klíčové posílat paralelní requesty přes čisté IP s automatickým retry logic.

Nejlepší Temu scrapery podle úrovně dovedností: kompletní rozpad

Najdi svůj řádek a skoč na příslušnou část:

9610cf17-db90-45fd-a9b1-ceabcc435348_compressed.webp

PřístupÚroveň dovednostíČas nastaveníZvládání anti-bot ochranyNejvhodnější pro
AI rozšíření do Chromu (např. Thunderbit)Začátečník< 2 minVyřešeno (cloud nebo browser)Dropshippery, marketéry, ecommerce operátory
No-code desktop nástroj (např. Octoparse, ParseHub)Začátečník–středně pokročilý10–60 minČástečně (je potřeba proxy konfigurace)Pravidelný scraping se šablonami
Scraping API / služba (např. ScraperAPI, Apify)Středně pokročilý15–45 minVestavěnéVývojáře integrující do pipeline
Managed proxy / enterprise (např. Bright Data, Oxylabs)Pokročilý / enterpriseHodiny až dnyKompletní infrastrukturaVysoký objem, doručení do warehouse
Vlastní Python skript (Playwright/Selenium)Pokročilý1–4+ hodinyRučně (proxy + CAPTCHA setup)Plná kontrola, úpravy pro speciální případy

Thunderbit: nejlepší Temu scraper pro netechnické uživatele

Thunderbit official website screenshot

Thunderbit je AI Chrome extension navržené pro business uživatele — obchodní týmy, ecommerce operátory, dropshippery a marketéry — kteří potřebují strukturovaná data z webu bez programování. Pracuji v týmu Thunderbit, takže produkt dobře znám. Budu úplně upřímný, co umí a kam se hodí.

Základní workflow má jeden krok: otevřeš stránku na Temu a klikneš na One-Click ExtractAI Suggest Fields navrhne sloupce (název produktu, cena, obrázek, hodnocení atd.) a proces běží sám, pokud do něj nezasáhneš.

AI v Thunderbitu čte strukturu stránky a automaticky navrhuje názvy sloupců i datové typy. Nespoléhá se na pevné CSS selectory, takže když Temu změní názvy class nebo rozložení karet, scraper se přizpůsobí.

Klíčové funkce pro Temu:

  • Cloud scraping mode: Rychlejší pro veřejné stránky, zpracuje až 50 stránek najednou. Nejlepší pro kategorie, výsledky hledání a produktové listingy, které nevyžadují přihlášení.
  • Browser scraping mode: Používá tvou aktuální Chrome relaci včetně cookies, lokality a stavu přihlášení. Nejlepší tam, kde zobrazení stránky ovlivňuje region, pop-upy nebo obsah dostupný po přihlášení.
  • Scrape Subpages: Po scrape stránky s výpisem klikneš na „Scrape Subpages“ a nástroj navštíví detail každého produktu a přidá sloupce jako plný popis, varianty, informace o prodejci, odhad dopravy a specifikace — bez další konfigurace.
  • Field AI Prompts: Během scrapingu můžeš data kategorizovat, překládat nebo přeformátovat. Například: „Zařaď tento produkt do Kitchen Utensils, Small Appliances, Storage nebo Other.“
  • Scheduled scraping: Nastavíš plán v přirozeném jazyce („každé pondělí v 9:00“), vložíš URL a Thunderbit provede scraping v cloudu a exportuje data do Google Sheets, Airtable nebo jiného cíle.
  • Free exports: Excel, CSV, Google Sheets, Airtable, Notion, JSON — export není za paywallem. Obrázky se do Airtable a Notion exportují jako skutečné přílohy.

Cena: bezplatný tarif až pro 6 stránek měsíčně; placené plány začínají zhruba na $15/měsíc (měsíčně) nebo $9/měsíc (ročně) za 500 kreditů, přičemž 1 kredit = 1 výstupní řádek.

Scrape data z Temu pomocí AI Get Started Free

Vedle sebe: Thunderbit vs. Python skript na stejné stránce Temu

Rozdíl je markantní:

2e03202f-b794-42c6-b8ad-115439986def_compressed.webp

ÚkolThunderbitPython (Playwright)
Otevřít kategorii na TemuOtevřít stránku v ChromuNastavit Python prostředí, nainstalovat Playwright, nainstalovat prohlížeče
Identifikovat poleKliknout na "AI Suggest Fields"Projít DOM, network calls, JSON payloady
Zvládnout dynamické načítáníBrowser/cloud mode + stránkováníNapsat logiku scroll/wait, intercept requests
Zvládnout blokaceZkusit cloud mode nebo browser modePřidat proxy, hlavičky, fingerprinting, retry, CAPTCHA
Extrahovat pole z listinguKliknout na "Scrape"Napsat selectory nebo logiku parsování API
Obohatit data z detailů produktuKliknout na "Scrape Subpages"Postavit samostatný PDP crawler
ExportKliknout na Sheets/Airtable/Notion/ExcelNapsat integraci CSV/JSON/Sheets
Typické nastavení pro business uživateleDo 2 minutMinimálně 1–4 hodiny; následná údržba

Minimalistický Playwright prototyp pro Temu může vypadat takto (pseudokód — není připravený pro produkci):

from playwright.sync_api import sync_playwright

with sync_playwright() as p:
    browser = p.chromium.launch(headless=False)
    page = browser.new_page()
    page.goto("https://www.temu.com/search_result.html?search_key=kitchen+organizer")
    page.wait_for_load_state("networkidle")
    for _ in range(8):
        page.mouse.wheel(0, 2000)
        page.wait_for_timeout(1200)
    cards = page.locator("[data-product-id], a[href*='goods.html']")
    # Produkční kód pořád potřebuje selectory, proxy, retry,
    # CAPTCHA handling, PDP crawling a export logiku.
    print(cards.count())

To je přes 10 řádků ještě předtím, než jsi vytáhl jediné pole, a pořád neřešíš proxy, CAPTCHA, obohacení přes PDP ani export. Pro netechnického uživatele Thunderbit celý ten workflow zkrátí na pár kliknutí. Pro vývojáře dává Python větší kontrolu — ale za výrazně vyšší cenu na údržbu.

Octoparse a ParseHub: no-code desktop scrapery pro Temu

Pokud chceš větší kontrolu než u Chrome extension, ale nechceš psát kód, hlavní volby jsou Octoparse a ParseHub.

Octoparse má veřejnou šablonu Temu Details Scraper. Ukázkový výstup zahrnuje product ID, názvy, ceny, data o prodejci/obchodu, URL obrázků, slevy, URL obchodu a detailní specifikace. To je velká výhoda — můžeš začít se šablonou místo stavby workflow od nuly. Octoparse také podporuje cloud extraction, plánování a vizuální tvorbu workflow.

U Temu ale platí několik háčků:

  • Doplňky proti anti-botu (residential proxy za $3/GB, CAPTCHA solving za $1–$1.50 za tisíc) mohou náklady rychle navýšit.
  • Šablony se mohou rozbít, když Temu změní layout. Možná budeš muset upravit selectory nebo počkat, až Octoparse šablonu aktualizuje.
  • Nastavení zabere 10–60 minut podle složitosti stránky.

Cenotvorba Octoparse: bezplatný plán s 10 tasky a 50K měsíčním exportem dat; Standard od $69/měsíc a Professional od $249/měsíc, obě varianty účtované ročně (měsíční fakturace je dražší). Doplňky pro proxy, CAPTCHA a managed services jsou extra.

ParseHub je vizuální desktop/web scraper, který si dobře poradí s dynamickými stránkami (běží na plném Chromium prohlížeči). Placené plány ale začínají na $189/měsíc, což je pro jednotlivce dost vysoké. Při mém průzkumu jsem nenašel žádnou silnou veřejnou Temu-specific šablonu. ParseHub je lepší volba pro týmy, které už jsou zvyklé stavět vizuální scraping projekty.

NástrojSilné stránky pro TemuSlabiny na TemuCena
OctoparseVeřejná Temu šablona, vizuální workflow, cloud extraction, plánováníÚdržba šablon, anti-bot doplňky zvyšují cenuZdarma; od $69/měs. Standard a $249/měs. Pro (účtováno ročně); doplňky navíc
ParseHubZvládání dynamických stránek, builder workflow projektů, rotace IP u placených plánůVyšší vstupní cena, žádná veřejná Temu šablona nenalezenaPlacené plány od $189/měs.

Scraping API: ScraperAPI, Apify a Bright Data pro Temu

API-based scraping služby řeší proxy, renderování i anti-bot logiku, takže se vývojáři mohou soustředit na parsování a ukládání dat. Hodí se, když stavíš pipeline, ne když děláš jednorázový export do tabulky.

ScraperAPI je developerské API pro rotaci proxy a renderování. Jeho cenová stránka uvádí 7denní trial s 5 000 kredity, Hobby za $49/měsíc pro 100 000 kreditů a vyšší tarify nad tím. Háček u Temu: renderování JavaScriptu a prémiové proxy pooly stojí 10–75 kreditů na request podle tarifu. To znamená, že skutečná cena za řádek může být výrazně vyšší než nápadná headline cena.

Apify je platforma s marketplace předpřipravených „actorů“ (scraperů). Existuje několik Temu actorů. Jeden komunitně spravovaný Temu Scraper uvádí pay-per-event cenu kolem $5 za 1 000 produktů na free tieru. Jiný Temu Products Scraper uvádí $4 za 1 000 výsledků. Riziko: kvalita actorů se liší, údržba závisí na komunitě a některé actory mohou být zastaralé nebo se rozbít po aktualizaci Temu. Vždy si před použitím zkontroluj datum poslední úpravy a hodnocení uživatelů.

Bright Data je enterprise varianta. Jeho Temu scraper stránka uvádí, že úlohy běží na infrastruktuře Bright Data s rotací proxy, geo-targetingem, logikou proti CAPTCHA / unblockingu a autoscalingem. Výstupní formáty zahrnují JSON, CSV, Parquet a přímé doručení do S3, GCS, Azure Blob, BigQuery a Snowflake. Oborové recenze uvádějí Web Scraper API pay-as-you-go kolem $1.5 za 1 000 záznamů, s commitovanými plány od zhruba $499/měsíc. Silné, ale naceněné pro týmy s reálným rozpočtem.

Oxylabs má také dedikovanou stránku Temu Scraper API. Plány začínají na $49/měsíc a je k dispozici bezplatný trial až na 2 000 výsledků. Je to silná alternativa k Bright Data pro developerské týmy, které chtějí strukturovaná data z Temu přes API.

API / platformaDůkaz zaměřený na TemuSilná stránkaSlabinaNejvhodnější pro
ScraperAPINebyla nalezena stránka specifická pro Temu, ale ecommerce anti-bot funkce jsou doloženéJednoduchý endpoint, JS renderování, prémiové proxyKreditové násobky u prémiových funkcí; data musí parsovat vývojářDeveloperské pipeline
ApifyV marketplace je více Temu actorůNejrychlejší developerská cesta, pokud actor sedí a je udržovanýKvalita actorů se liší; část je zastaraláVývojáři, kteří chtějí marketplace actorů a plánování
Bright DataDedikovaná stránka Temu scraperuEnterprise infrastruktura, unblocking, doručení do warehouseDrahé; pořád je potřeba rozumět web scrapinguEnterprise datové týmy
OxylabsDedikovaná stránka Temu Scraper APIJasná cena za výsledek, práce s JS, tvrzení o IP/CAPTCHAWorkflow přes developerské APIVývojářské týmy potřebující přístup k Temu API

Vlastní Python skripty (Playwright/Selenium): plná kontrola, vysoká náročnost

Vlastní Python scrapery nabízejí maximální flexibilitu — to je jejich plus. Playwright je pro Temu obvykle lepší výchozí volba než Selenium díky auto-waiting modelu a lepšímu zvládání stránek s hodně JavaScriptem.

Ale ta protihodnota je tvrdá.

Prototyp zabere 1–4 hodiny. Produkční scraper potřebuje rotaci proxy, realistické browser fingerprinty, strategii pro CAPTCHA, retry, validaci schématu, ukládání výstupů, monitoring, alerting a právní kontrolu.

A rozbíjí se. Scrapingové komunity na Redditu opakovaně popisují moderní ecommerce scraping jako nestabilní, když weby používají Cloudflare, renderování přes JavaScript a anti-bot fingerprinting.

Režim selháníTypická příčinaMožná náprava
Prázdné HTML / chybějící produktyJS načítá product cards až po úvodním HTMLPoužít Playwright, čekat na network i DOM
Jen první produktyNekonečný scroll / lazy loadingScroll smyčka, čekání na network idle, prahy počtu karet
Chybějící nebo nekonzistentní cenyStav regionu/session/měny nebo anti-bot odpověďNastavit locale, cookies, geo-targeted proxy
403 / challenge / CAPTCHAReputace IP, headless fingerprint, rychlost requestůResidential proxy, stealth browser, nižší rychlost
Rozbití selektorůZměny DOM/class, A/B testySémantická extrakce nebo parsování API, pokud je dostupné

Vlastní skripty nejsou „zdarma“ varianta. Jen přesouvají náklady z předplatného na čas vývojářů, účty za proxy, náklady na CAPTCHA a riziko údržby. Pokud máš na staffu scraping inženýra a potřebuješ neobvyklou logiku, je to správná cesta. Pro všechny ostatní je to v praxi nejdražší možnost.

Osvědčený postup: scraping podstránek pro kompletní data o produktech Temu

Tohle je zdaleka nejdůležitější best practice v celém článku — a téměř žádný jiný průvodce ji neřeší.

Kategorie nebo vyhledávací stránka na Temu ti ukáže základ: název, náhled, cenu, hrubé hodnocení. Ale pole, která dělají řádek opravdu použitelným — detailní popisy, seznamy variant, plný počet recenzí, odhady dopravy, jména prodejců, tabulky specifikací — jsou na stránce detailu produktu (PDP).

Když scrapuješ jen listing page, pracuješ s neúplným datasetem.

Dvoukrokový workflow:

  1. Krok 1 — scrape listing page (PLP): Z Temu vyhledávání nebo kategorie vytáhni název produktu, cenu, náhled a hodnocení.
  2. Krok 2 — obohacení přes subpage scraping: Navštiv PDP každého produktu a doplň sloupce jako plný popis, počet recenzí, varianty, doba dopravy a informace o prodejci.

Takhle data vypadají před a po:

PoleZ PLP (krok 1)Doplněno z PDP (krok 2)
Název produktu
Cena✅ (ověřená / sleva %)
Náhledový obrázek
Hvězdičkové hodnocení✅ (s počtem recenzí)
Plný popis
Varianty (velikosti, barvy)
Jméno prodejce
Odhad dopravy
Detailní specifikace

V Thunderbit je to jedna akce: po prvním scrapu klikneš na „Scrape Subpages“. AI navštíví každou URL produktu a přidá další sloupce — žádná další konfigurace, žádný samostatný spider, žádná údržba selektorů. Šablona Octoparse Temu Details i Temu actor v Apify také podporují pole na úrovni PDP, ale vyžadují víc nastavení a údržby. V Pythonu bys musel postavit samostatný PDP crawler, udržovat jeho selectory a řešit stránkování uvnitř detailů — což je výrazně další investice.

Osvědčený postup: plánovaný scraping Temu pro průběžný monitoring cen a skladovosti

Jednorázové scrapování je užitečné pro objevování produktů. Competitive intelligence ale vyžaduje opakované sledování.

Ceny se mění, produkty mizí ze skladu, každý den přibývají nové položky a hloubka slev se mění s akcemi. Týdenní nebo denní scraping vytvoří historii, se kterou váš tým skutečně může pracovat.

Tři use cases, které stojí za automatizaci:

  • Monitoring cen: Sleduj každých 50 nejlepších Temu SKU konkurence jednou týdně. Aktualizované ceny se automaticky exportují do Google Sheets pro rychlé porovnání s vlastní cenotvorbou.
  • Monitoring zásob a dostupnosti: Zjisti, kdy se trendový produkt vyprodá, objeví se nová varianta nebo se změní odhad dopravy.
  • Detekce nových produktů a trendů: Naplánuj denní scraping sekce „New Arrivals“ nebo prioritní kategorie na Temu. Seřaď podle počtu prodaných kusů nebo recenzí a včas zachyť rostoucí produkty.

V Thunderbit to nastavíš tak, že popíšeš interval v přirozeném jazyce („každé pondělí v 9:00“), vložíš cílové URL a klikneš na „Schedule“. Scraping běží v cloudu a exportuje data do zvoleného cíle. Protože AI čte stránku při každém běhu znovu, plánované scrapování se automaticky přizpůsobí změnám layoutu Temu — nemusíš upravovat selectory pokaždé, když Temu přepracuje kartu produktu.

Alternativa: nastavit cron job, udržovat Python skript, nakonfigurovat rotaci proxy, vybudovat exportní pipeline a opravovat selectory pokaždé, když Temu změní layout. Pro netechnický tým je to nepoužitelné. Pro vývojáře je to průběžná režie. Apify a Bright Data také podporují plánované běhy, ale s techničtějším nastavením a vyšší vstupní cenou.

Osvědčený postup: end-to-end workflow pro data z Temu (scrape → čištění → export → akce)

Většina scrapingových průvodců končí u „stáhněte CSV“.

Business uživatelé ale potřebují data v nástrojích, ve kterých opravdu pracují — Google Sheets pro spolupráci, Airtable pro produktové databáze, Notion pro týmové dashboardy. Skutečný best practice je end-to-end workflow:

c94913a9-f8ba-4e7e-9869-74047c1f9a87_compressed.webp

Krok workflowCo se dějeSchopnost Thunderbit
ScrapeExtrakce dat ze stránek TemuAI Suggest Fields → Scrape (2 kliknutí)
EnrichNávštěva detailní stránky každého produktuScrape Subpages (1 kliknutí)
Clean & LabelKategorizace produktů, normalizace cen, překlad názvůField AI Prompt — značení, formátování, překlad během scrapingu
ExportOdeslání dat do business nástrojůBezplatný export do Excelu, Google Sheets, Airtable, Notion; stažení CSV/JSON
MonitorSledování změn v časeScheduled Scraper s intervaly v přirozeném jazyce

Konkrétní příklad: nascrapuješ 200 kuchyňských produktů z Temu. Během scrapingu Field AI Prompt automaticky zařadí každý produkt do kategorií „Utensils / Small Appliances / Storage / Cleaning / Decor“. Ceny se normalizují na číselné hodnoty v USD. Čínské názvy produktů se přeloží do angličtiny. Data se exportují přímo do Airtable base s obrázky produktů zachovanými v plné podobě (ne jen URL — skutečné obrazové přílohy, jak popisuje Thunderbit image scraping guide). Naplánovaný scraping data každý týden obnovuje.

Užitečné instrukce Field AI Prompt pro data z Temu:

  • „Zařaď tento produkt do jedné z kategorií: Kitchen Utensils, Small Appliances, Storage, Cleaning, Decor, Other. Vrať pouze kategorii.“
  • „Přelož název produktu do stručné angličtiny a zachovej značky, množství, velikosti a modelová čísla.“
  • „Normalizuj cenu jako číslo bez symbolů měny.“
  • „Označ poptávku jako High, Medium nebo Low na základě hodnocení, počtu recenzí a počtu prodaných kusů. Pokud údaje chybí, vrať Unknown.“

Tento workflow promění syrový scraping v živou databázi produktové intelligence — bez toho, aby vývojář stavěl samostatnou ETL pipeline.

Nejlepší Temu scrapery v porovnání: přehledná tabulka

NástrojÚroveň dovednostíČas nastaveníZvládání anti-bot ochranyScraping podstránekPlánováníMožnosti exportuCenová úroveňNejvhodnější pro
ThunderbitZačátečníkMinutyBrowser mode, cloud mode, AI detekce políAno (Scrape Subpages)Ano (plány v přirozeném jazyce)Excel, CSV, Google Sheets, Airtable, Notion, JSONZdarma 6 stránek; placené od cca $9–15/měs. za 500 kreditůNetechnické ecommerce týmy, dropshippeři
OctoparseZačátečník–středně pokročilý10–60 minCloud extraction, proxy/CAPTCHA doplňkyAno (template workflows)Ano (placené/cloud plány)Excel, CSV, JSON, HTML, XML, databáze, Google SheetsZdarma; od $69/měs. Standard (účtováno ročně); doplňky extraOperátoři, kteří chtějí vizuální workflow + Temu šablonu
ParseHubZačátečník–středně pokročilý30–60 minDynamické renderování, placená rotace IPAno (project flows)Placené plányCSV/JSON, Dropbox/S3 na placenýchPlacené od $189/měs.Týmy stavící vizuální projekty pro dynamické weby
ScraperAPIVývojářHodinyRotace proxy, JS renderování, prémiové poolyVlastní kódDataPipeline / schedulerHTML/JSON/CSVTrial 5K kreditů; Hobby $49/měs.; vyšší tarify dostupnéVývojáři budující vlastní Temu pipeline
ApifyStředně pokročilý10–30 min, pokud actor sedíLogika prohlížeče/proxy podle actoraZávisí na actoruAnoJSON, CSV, Excel, API/datasetsBezplatná platforma; Temu actory cca $4–5/1K produktůVývojáři/operátoři, kteří umí prověřit kvalitu actorů
Bright DataPokročilý / enterpriseHodiny až dnyPlná proxy, CAPTCHA, unblocking, autoscalingVlastní přes scraper/APIAnoJSON, CSV, Parquet, S3, GCS, Azure, BigQuery, Snowflakecca $1.5/1K záznamů PAYG; Scale od $499/měs.Enterprise datové týmy, vysoký objem extrakce
OxylabsPokročilýHodinyPodpora JS, tvrzení o IP/CAPTCHAVlastní přes APIAnoJSON/API výstupOd $49/měs.; trial až 2K výsledkůVývojářské týmy potřebující přístup k Temu API
Vlastní Python (Playwright)Pokročilý1–4 hod.+; průběžná údržbaRuční proxy, CAPTCHA, fingerprintyPlně vlastníCron/queue/manualVlastníČas vývojářů + proxy/CAPTCHA/hostingHraniční případy, týmy se scraping inženýry

Který Temu scraper byste si měli vybrat? Rychlá doporučení

  • Dropshipper, který potřebuje rychlý průzkum produktů? Začni s bezplatným tarifem Thunderbit. Je to nejrychlejší cesta od „chci data z Temu“ k „mám tabulku“. Pokud to funguje na tvých cílových stránkách (a mělo by to fungovat na většině veřejných kategorií a produktových stránek), máš hotovo.
  • Operátor, který chce vizuální kontrolu a znovupoužitelné šablony? Octoparse má veřejnou Temu Details šablonu a vizuální builder workflow. Počítej s nastavením 10–30 minut a určitou konfigurací proxy/CAPTCHA.
  • Vývojář stavící datovou pipeline nebo interní nástroj? ScraperAPI nebo Apify nabízejí API/actor workflow, které se integrují s kódem a plánovanými joby. Apify actory pečlivě prověřuj — sleduj stav údržby a hodnocení uživatelů.
  • Enterprise tým potřebující vysoký objem dat z Temu a doručení do warehouse? Bright Data je infrastrukturní řešení. Drahé, ale zvládá škálu, unblocking a doručení do S3/BigQuery/Snowflake.
  • Scraping inženýr, který potřebuje nestandardní logiku? Custom Playwright/Selenium ti dá plnou kontrolu. Jen si vyhraď rozpočet na průběžnou údržbu, proxy a CAPTCHA.

Pro většinu netechnických business uživatelů bych doporučil nejdřív otestovat bezplatný tarif Thunderbit. Okamžitá otázka vždy zní: „Dostanu z téhle konkrétní Temu stránky řádky, které potřebuju?“ — a na to si můžeš odpovědět do dvou minut, aniž bys něco platil. Pro vývojáře doporučuji před rozhodnutím o rozpočtu porovnat cost-per-successful-row napříč Apify, ScraperAPI a malým Playwright prototypem.

Vyzkoušet Thunderbit zdarma pro scraping Temu

FAQ o scrapingu Temu

Je scraping Temu legální?

Záleží na jurisdikci, datech, která sbíráš, způsobu přístupu i na tom, jak data používáš. Temu ve svých Terms of Use výslovně omezuje automatizovaný přístup, včetně crawlování, scrapingu nebo spideringu stránek či dat. Americké soudy nabídly určitý příznivý precedens pro přístup k veřejně dostupným datům (rozhodnutí 9. obvodu hiQ v. LinkedIn), ale pozdější rozhodnutí zároveň potvrdila nároky z porušení smlouvy i trespassu. Stručně: scraping veřejně dostupných produktových dat pro výzkum může být v některých kontextech obhajitelný, ale záleží na podmínkách služby, ochraně soukromí, autorském právu i způsobu využití dat. Nejde o právní radu — pro komerční použití se poraď se s právníkem.

Jak často Temu mění layout webu?

Veřejně doložený rytmus neexistuje. Komunitní hlášení i ekosystém nástrojů berou Temu jako dynamický, často aktualizovaný cíl. Počítej s tím, že CSS selectory se mohou kdykoli rozbít, a upřednostňuj AI/sémantickou extrakci nebo aktivně udržované šablony před natvrdo napsanými selectory.

Můžu scrapovat Temu, aniž bych byl zablokován?

U omezeného množství veřejných stránek a při rozumném tempu ano — zejména s nástroji, které mají skutečné renderování prohlížeče, podporu relace a throttling. Žádný nástroj ale nelze považovat za univerzální záruku. Cloud scraping s rotujícími IP funguje dobře u veřejných katalogových stránek; browser scraping s tvou aktuální relací je lepší, když data ovlivňuje region, přihlášení nebo pop-upy.

Jaká data lze z produktových stránek Temu získat?

Mezi běžná veřejná pole patří název produktu, URL, aktuální cena, původní cena, procento slevy, URL obrázků, hvězdičkové hodnocení, počet recenzí, počet prodaných kusů, název prodejce/obchodu, informace o dopravě, kategorie, specifikace produktu, varianty (barvy, velikosti) a čas scrapingu. Přesná dostupnost polí závisí na typu stránky (listing vs. detail) a regionu.

Potřebuji pro scraping Temu proxy?

Pro menší ruční extrakci v browser mode (pár stránek najednou) možná ne. Pro cloudové, plánované nebo objemné sběry jsou ale proxy nebo managed anti-blocking infrastruktura obvykle nutné. Nástroje jako Thunderbit, Bright Data a ScraperAPI mají správu proxy zabudovanou přímo v platformě, takže ji nemusíš nastavovat zvlášť.

Pokud chceš jít do hloubky i na související témata, podívej se na naše průvodce o web scrapingu pro porovnání cen, nejlepších ecommerce web scraperech, scrapingu dat z webu do Excelu a jak scrapovat do Google Sheets. Můžeš se také podívat na návody na YouTube kanálu Thunderbit.

Vyzkoušet Thunderbit pro scraping Temu Get Started Free

Zjistit více

Ke
Ke
CTO ve Thunderbit | Senior Data Scientist a expert na ML S téměř desetiletou zkušeností v oblasti strojového učení a datové vědy je Ke Shen absolventem Kolumbijské univerzity a bývalým Senior Data Scientist ve Walmart Labs. Díky hlubokým odborným znalostem v Pythonu, R, Javě a statistice, uznávaným i mezi kolegy, sdílí ověřené poznatky o tom, jak převést složité AI algoritmy od teorie až k produkční architektuře.
Topics
Web Scraping ToolsAI Web Scraper
Obsah
Thunderbit · AI agent pro webová data

Extrahuj data z jakékoli stránky v 1 kliknutí

Důvěřuje mu více než 250 000 uživatelů
k dispozici bezplatný plán
Z webové stránky do tabulky
Popiš, co potřebuješ — AI agent Thunderbit to vyextrahuje a exportuje do Excelu, Google Sheets, Airtable nebo Notion. Začni zdarma.
Chrome Store Rating
PRODUCT HUNT#1 Product of the Week