En sökning på GitHub efter "tiktok scraper" ger 339 repositories. Ungefär 48% av dem har inte fått en push på över ett år, och minst 4 är uttryckligen arkiverade.
Om du någon gång klonat ett populärt TikTok-scraperrepo, slitit i en timme med beroenden och sedan fått noll output — då är du långt ifrån ensam. Den mest stjärnmärkta TikTok-scrapern på GitHub, drawrowfly/tiktok-scraper, har fortfarande över 5 000 stjärnor. Men i dess issue-tracker ligger trådarna på rad, som #812: "is this amazing tool still working?" och #824: "Is this still working?" — båda med rapporter om noll output. På Thunderbit har jag följt läget för TikTok-scraperrepon i flera månader, och mönstret är tydligt: de här verktygen går sönder snabbt, och de flesta lagas aldrig. Den här artikeln är den praktiska överlevnadsguide jag önskar att jag haft när jag började utvärdera de här reporna. Vi går igenom vad som lever, vad som är dött, vad du kan göra i stället och hur du slutar slösa bort timmar på kod som slutade fungera redan innan du hittade den.
Varför de flesta TikTok-scrapers på GitHub går sönder (och fortsätter gå sönder)
TikTok är inte ett vanligt scrapingmål. Dess webbgränssnitt förändras hela tiden. Till skillnad från en statisk produktsida i e-handel eller en katalogsida roterar TikTok endpoints, uppdaterar sitt anti-bot-fingeravtryck, ändrar hur sidor renderas och inför nya krav på sessioner och tokens — ibland redan inom veckor efter senaste ändringen.
Open source-maintainers är volontärer. När TikTok skickar ut en uppdatering som bryter scraperns requestflöde kan repot bli trasigt i dagar, veckor eller för alltid. Det är inte en kritik mot underhållarna — det är en strukturell obalans mellan en snabb, välfinansierad plattform och obetalda utvecklare som har vanliga jobb vid sidan av.
Även de bästa TikTok-scraperreporna lever på ett evigt laga-och-bryta-löpband. Om du ska använda ett sådant behöver du en strategi för att utvärdera, felsöka och ha en plan B.
TikToks anti-bot-försvar: det du står emot
- Hastighetsbegränsning. TikToks officiella utvecklardokumentation beskriver tydligt requestkvoter, även för godkända integrationer. Oofficiella scrapers träffar dessa gränser mycket snabbare.
- Cookie- och sessionskrav. Moderna repos som davidteather/TikTok-Api kräver ett
ms_token; äldre repos som drawrowfly/tiktok-scraper visartt_webid_v2i sina exempel; Evil0ctal/Douyin_TikTok_Download_API dokumenterarmsToken,ttwid,X-BogusochA_Bogus. TikTok kontrollerar om din request ser ut att komma från en verklig webbsession. - Browser fingerprinting. ScrapFlys guide om anti-bot-skydd förklarar varför sajter jämför headers, cookies, TLS-signaturer och JavaScript-exponerade webbläsarsignaler med riktig användartrafik. Deras genomgång av browser fingerprinting täcker Canvas, WebGL, WebRTC, typsnitt och runtime-signaler. Fingerprinting är som att TikTok kollar ditt webbläsar-ID-kort — om webbläsaren, cookies, tajmingen och nätverkssignaturen inte stämmer ihop ser requesten fejkat ut innan något innehåll ens skickas tillbaka.
- Beteendedetektion. Reddit-trådar om TikTok-scraping nämner ofta att nya Playwright-sessioner triggar CAPTCHA-frågor. Communityinlägg från 2025–2026 beskriver i allt högre grad upptäckt som tittar på tajming och interaktionskvalitet, inte bara IP-återanvändning.
- Krypterade/signade requestparametrar. Evil0ctal dokumenterar
X-BogusochA_Bogus; äldre community-gists kretsar kring URL-signering och token-generering. TikTok förväntar sig i allt högre grad att requests kommer med samma "stämplar" som den egna webbläsar- eller apptrafiken. - CAPTCHA och verifieringsflöden. Att det finns TikTok-specifika CAPTCHA-solver-repos och Reddit-trådar om pusselutmaningar bekräftar att CAPTCHA fortfarande är en del av anti-bot-lagret.
Varför open source-maintainers inte hinner med
Livscykeln är alltid densamma. En utvecklare bygger en TikTok-scraper. Den blir viral på GitHub. TikTok patchar bort den. Underhållaren fixar den — eller går vidare.
Två repos visar mönstret extra tydligt:
- drawrowfly/tiktok-scraper har fortfarande 5 052 stjärnor och 889 forks, men dess senaste push var 19 maj 2023. Det är den mest stjärnmärkta exakta TikTok-scrapern på GitHub, men den känns mer som ett historiskt dokument: hög synlighet, högt förtroende, inget aktivt underhåll.
- davidteather/TikTok-Api visar 6 301 stjärnor, 1 177 forks och senaste push den 1 april 2026. Dess release-feed visar meningsfullt underhåll i april 2025, juli 2025, oktober 2025 och april 2026 — inklusive fixar för videocrawling och nya proxy-/sessionskontroller. Men även detta friskare projekt varnar öppet för att TikTok blockerar requests och att användare kan behöva proxies, Playwright och egen sessionslogik.
Mönstret är enkelt:
- Ett gammalt TikTok-scraperrepo är sannolikt dött.
- Ett aktivt TikTok-scraperrepo är sannolikt fortfarande ömtåligt.
- Den enda verkliga skillnaden är om någon fortfarande finns kvar och lagar det som går sönder den här månaden.
60-sekunderschecklistan för repo-hälsa: så utvärderar du vilken TikTok-scraper som helst på GitHub
Innan du klonar något alls, kör den här checklistan. Det tar mindre än en minut och sparar timmar av frustration.
| Signal | 🟢 Friskt | 🟡 Riskfyllt | 🔴 Dött |
|---|---|---|---|
| Senaste meningsfulla push | för mindre än 3 månader sedan | 3–12 månader sedan | 12+ månader sedan |
| Antal öppna issues | Lågt, nya frågor får svar | Växande hög med viss aktivitet från maintainer | Många obesvarade rapporter om "trasigt/blockerat/fungerar inte" |
| Nya klagomål från användare | Mest installationsfrågor | Blandning av setup- och felrapporter | Upprepade rapporter om "noll output", "403", "fungerar det fortfarande?" |
| Nuvarande auth-/sessionsmodell | Sessions-/cookieflöde dokumenterat | Token-tungt men dokumenterat | Förlitar sig på gamla web endpoints utan aktuell auth-vägledning |
| Installationsyta | Reproducerbar, testad setup | Några manuella steg | Gamla beroenden, inga moderna installationsnoteringar |
| CI/tester | Tester finns och är aktuella | Tester finns men täckningen är oklar | Inga tester eller gamla Actions-workflows |
| Passar databehovet | Matchar ditt faktiska användningsfall | Stödjer bara en del av användningsfallet | Löser egentligen ett annat problem |
Så kontrollerar du varje signal på under 60 sekunder
- Datum för senaste push: Titta i repo-headern på GitHub. Står det "last pushed 2 years ago" är det bara att gå vidare.
- Öppna issues: Klicka på fliken Issues. Skumma de senaste titlarna. Sök efter
not working,403,blocked,captchaellerzero output. - Användarklagomål: Om de fem översta öppna issues alla är varianter av "det här fungerar inte längre" har du svaret.
- Auth-/sessionsmodell: Öppna README. Leta efter aktuell vägledning som
ms_token, Playwright-setup eller proxy-noteringar. Om README:n fortfarande refererar till endpoints från 2023, gå vidare. - Installationsyta: Kolla efter requirements-fil, Docker-stöd eller tydliga installationsinstruktioner. Om README:n säger "npm install" och senaste testade Node-versionen är 14, räkna med problem.
- CI/tester: Titta i Actions-fliken. Om tester saknas eller faller isär får du gissa dig fram.
- Databehov: Beskriver repot faktiskt de datatyper du behöver (profiler, videometadata, kommentarer, hashtags)? Många repos gör bara videonedladdning, inte strukturerad dataextraktion.
Röda flaggor som betyder "gå därifrån"
- Repot är arkiverat.
- README:n säger "no longer maintained".
- Senaste commit refererar till en TikTok API-version från för mer än 2 år sedan.
- Issues svämmar över av "doesn't work"-rapporter och maintainern har inte svarat på månader.
- Repot har många stjärnor men få nya forks eller pull requests.
Tips: Sök i Issues-fliken efter is:issue is:open "not working" eller is:issue is:open "403". Om resultaten är många och färska är repot sannolikt trasigt.
Populära TikTok-scraperrepon på GitHub: en ärlig statuskoll (2026)

Här är Repo Vitals Checklist applicerad på de repos du faktiskt hittar när du söker efter "tiktok scraper" på GitHub:
| Repo | Senaste push | Stjärnor | Öppna issues | Bedömning | Notering |
|---|---|---|---|---|---|
| drawrowfly/tiktok-scraper | 2023-05-19 | 5 052 | 58 | 🔴 Död / endast som referens | Fortfarande välkänt, men för gammalt för produktion 2026 |
| davidteather/TikTok-Api | 2026-04-01 | 6 301 | 134 | 🟡 Lever, men kräver mycket underhåll | Starkaste OSS-valet; förutsätter Playwright, tokens och ofta proxies |
| scrapfly/scrapfly-scrapers/tiktok-scraper | 2026-04-21 | 938 (parent) | ~0 (monorepo) | 🟡 Lever, men inte ren open source | Aktuell och användbar, men kräver ScrapFly API-nyckel |
| Evil0ctal/Douyin_TikTok_Download_API | 2025-10-12 | 17 397 | 135 | 🟡 Lever, bred, komplex | Funktionsrikt projekt för flera plattformar; mer som en power-user-plattform |
| naseif/tiktok-scraper | 2024-07-26 | 107 | 13 | 🟡 Riskfyllt | Mindre repo med öppna klagomål kring user info- och hashtag-flöden |
| loewehancara1rmyv/Tiktok-scraper | 2026-01-12 | 4 | 0 | 🔴 För nytt för att lita på | Visningsrepo, inte community-beprövat |
drawrowfly/tiktok-scraper
I flera år var den här TypeScript-baserade scraper/downloadern standardsvaret på "tiktok scraper github" — för användare, trender, hashtags och musikflöden. År 2026 bör den främst ses som historisk dokumentation. Senaste pushen var i maj 2023, och issue-kön innehåller fortfarande olösta rapporter om "still working?" och "zero output" från 2023–2025. Om du läser den här artikeln för att du klonade just det här repot och fick ingenting tillbaka, är du i gott sällskap.
davidteather/TikTok-Api
Det mest trovärdiga open source-verktyget för TikTok-data som fortfarande lever 2026. Det är aktivt, har nya releases och dokumenterar tydligt Playwright-setup, async-användning, tokenhantering, proxy-stöd och funktioner för sessionsåterställning. Men det är inte ett "klona och kör"-verktyg. I dess egen README står att EmptyResponseException oftast betyder att TikTok blockerar requesten, och diskussionshistoriken visar återkommande problem med ms_token, trasig kommentarsextraktion, KeyError: 'ItemModule' och endpoint-specifika fel. Bedömning: lever, användbart, för utvecklare, och kräver mycket underhåll.
Andra repos värda att nämna
- scrapfly/scrapfly-scrapers/tiktok-scraper: Aktuellt och tekniskt relevant, men README:n kräver en
SCRAPFLY_KEY. Detta är ett kodexempel för en hanterad scrapingplattform, inte ett gratis fristående verktyg. - Evil0ctal/Douyin_TikTok_Download_API: Täcker TikTok och Douyin, dokumenterar signeringslogik (
X-Bogus,A_Bogus,msToken) och stöder kommentarer, följare, spellistor med mera. Det är tekniskt krävande och allt mer sammanflätat med betalda API-referenser. Issue-tracker visar löpande buggrapporter under 2026 kring videolänkar och user-info-endpoints. Lever och är funktionsrikt, men komplext. - naseif/tiktok-scraper: Mindre, med öppna klagomål. Riskfyllt för produktion.
- loewehancara1rmyv/Tiktok-scraper: 4 stjärnor, 0 issues, för nytt för att lita på. Medium-artikeln som lyfte fram det gjorde det okritiskt.
TikTok officiella API vs GitHub-scrapers vs no-code-verktyg: ett beslutsramverk

De flesta konkurrentartiklar ignorerar antingen TikToks officiella åtkomstvägar eller hoppar direkt från "använd GitHub" till "köp vår tjänst". Här är en neutral jämförelse av alla tre vägar:
| Faktor | TikTok Research API | GitHub-scrapers | No-code-verktyg (t.ex. Thunderbit) |
|---|---|---|---|
| Tillgångströskel | Ansökan för akademi/affärsanvändning krävs; cirka 4 veckor för godkännande | Git-klon + installation | Installation av webbläsartillägg |
| Datatäckning | Endast godkända endpoints (konton, videor, kommentarer, shops) | Bred (profiler, videor, kommentarer, hashtags, shops) | Synlig siddata (profiler, videor, engagemang, hashtags) |
| Underhållsbörda | Låg (officiellt, stabilt) | Hög (repon går sönder när TikTok uppdateras) | Ingen (AI anpassar sig till layoutändringar) |
| Risk för blockering | Ingen (auktoriserad) | Hög | Låg (webbläsarbaserat, efterliknar riktig användare) |
| Kostnad | Gratis (om du godkänns) | Gratis (men tidskrävande) | Gratisplan finns; kreditbaserade planer från $15/mån |
| Kod krävs | Ja (Python/R) | Ja (Python/Node.js) | Nej |
| Bäst för | Forskare, akademiker, godkända organisationer | Utvecklare som är okej med underhåll | Marknadsförare, säljteam, ops, icke-utvecklare |
När TikTok Research API är rätt val
TikToks Research API är den renaste officiella vägen om du kvalificerar dig. Kvalificerade forskare i USA, Europa och Brasilien kan ansöka om att studera offentligt innehåll och kontodata. Tillgängliga datakategorier inkluderar konton, följare/följda, gillade videor, pinnade videor, återpublicerade videor, innehåll, kommentarer och shops. Codebooken exponerar fält som video_description, view_count, like_count, comment_count, share_count samt kommentarsfält som text, reply_count och create_time.
Nackdelen: behörigheten är begränsad till akademiska institutioner och kvalificerade ideella/oberoende forskare i vissa regioner, plus granskade forskare under EU:s DSA-process. Om du är ett growth-team eller en byrå som behöver snabb operativ data är detta inte rätt väg.
TikTok erbjuder också ett Commercial Content API för annonser och innehållsdata från annonsörer, vilket är användbart för transparensforskning men inte för generell scraping.
När en GitHub-scraper fortfarande är vettig
GitHub-scrapers är fortfarande relevanta för utvecklare som behöver oofficiell åtkomst till offentlig data utanför den officiella API-godkännanderamen och som är beredda att underhålla stacken. Det inkluderar use case som att skrapa synliga profilrutnät, hashtags, kommentarer, spellistor eller videometadata i en egen pipeline där det är okej att forka repot och patcha det.
Den ärliga brasklappen: det här är inte en engångsinstallation. Även det mest pålitliga 2026-repot, davidteather/TikTok-Api, säger fortfarande att användare kan behöva Playwright, cookies/tokens, proxies och egen sessionshantering.
När ett no-code-verktyg som Thunderbit är rätt val
Skrapa TikTok-data med AI Get Started Free
Inte utvecklare? Eller utvecklare som är trött på bryta-och-fixa-cykeln? Ett webbläsarbaserat AI-verktyg är det snabbaste sättet att få strukturerad TikTok-data.
Vi byggde Thunderbit som en AI-webbscraper som fungerar som ett Chrome-tillägg. På TikTok läser den vilken synlig sida som helst (profil, video, hashtag, sökresultat), föreslår kolumner via "AI Suggest Fields" och låter dig klicka på "Scrape" för att extrahera strukturerad data. TikTok-scraper-sidan beskriver fält som publiceringsdatum, videolängd, likes, delningar, sparningar, kommentarer, visningar och hashtags. Bildscraper-mallen visar hur du samlar in miniatyrbilder, URL:er, captions, creator-handle och engagemangssignaler från profilsidor. Hashtag-scraper-mallen täcker video-URL, creator-användarnamn, beskrivning, publiceringstid, visningar, likes, kommentarer, delningar, ljud och omslagsbilds-URL.
Med subpage scraping kan du öppna varje videosida från en profil-listning och berika tabellen med engagemangsdata, captions och hashtags — perfekt för marknadsförare som bygger influencer-databaser eller gör konkurrentanalyser.
Inget underhåll, ingen installationstriage, ingen anti-ban-konfiguration. AI anpassar sig automatiskt till layoutändringar. Export till Google Sheets, Excel, Airtable, Notion, CSV eller JSON är gratis.
Om du redan har förlorat timmar på trasiga GitHub-repos är det här ett seriöst alternativ — inte en påtvingad produktpitch.
Testa Thunderbit för TikTok-scraping
Installations-triage: fixa de 5 vanligaste setup-felen för TikTok-scrapers på GitHub
Installationsfel är det tredje vanligaste smärtområdet i TikTok-scrapingforum, och ingen större guide hjälper faktiskt till att lösa dem. Här är vad som brukar gå fel.
Node.js-versionkonflikter
Problem: Många äldre TikTok-scraperrepor, särskilt drawrowfly/tiktok-scraper, byggdes för Node.js 14–16. Om du kör Node 20+ kan npm install misslyckas tyst eller ge inkompatibla binärer.
Lösning: Använd nvm (Node Version Manager) för att installera och växla till rätt version:
nvm install 16
nvm use 16
npm install
Om repot inte anger Node-version, kolla engines-fältet i package.json eller titta på CI-konfigurationen.
Python-beroenden och Playwright-setup
Problem: davidteather/TikTok-Api kräver Python 3.9+ och Playwright med särskilda browserbinärer. Användare stöter på fel som "browser not found" eller beroendekonflikter.
Lösning: Använd alltid en virtuell miljö, och installera sedan Playwright-browsers explicit:
python -m venv .venv
source .venv/bin/activate # På Windows: .venv\Scripts\activate
pip install TikTokApi
python -m playwright install
Om playwright install misslyckas, kontrollera att systemet saknar nödvändiga paket, till exempel libnss3 på Ubuntu.
Behörighetsfel i Linux/Ubuntu
Problem: Att köra sudo pip install förstör den systemövergripande Python-miljön och leder till följdfel i beroenden.
Lösning: Använd aldrig sudo pip install. Skapa alltid en virtuell miljö först:
python3 -m venv .venv
source .venv/bin/activate
pip install -r requirements.txt
Det isolerar scraperns beroenden från systemets Python.
Problem med sökvägar och teckenkodning i Windows
Problem: Windows CMD har problem med teckenkodning och begränsningar för sökvägslängd som kan sabotera installationer, särskilt när Playwright laddar ner browserbinärer till djupt nästlade kataloger.
Lösning: Använd WSL (Windows Subsystem for Linux) eller Git Bash i stället för CMD. WSL ger dig en full Linux-miljö inne i Windows:
wsl --install
# Öppna sedan en WSL-terminal och följ Linux-stegen ovan
Docker-genvägen: hoppa över beroendeproblemen helt
Problem: Allt ovan.
Lösning: Om du kan Docker, kapsla in scraper-miljön. En enkel Dockerfile för en Python-baserad TikTok-scraper kan se ut så här:
FROM python:3.11-slim
RUN apt-get update && apt-get install -y libnss3 libatk-bridge2.0-0 libdrm2 libxcomposite1 libxdamage1 libxrandr2 libgbm1 libasound2
RUN pip install TikTokApi playwright && python -m playwright install --with-deps chromium
WORKDIR /app
COPY . .
CMD ["python", "scrape.py"]
Detta ger en reproducerbar miljö oavsett värddatorns operativsystem. Om scrapern fungerar i Docker men inte utanför är det ett miljöproblem, inte ett kodproblem.
Felsökningsflöde:
- Kan repot köra sitt eget exempel utan problem? → Om nej, kontrollera runtime-versionen.
- Är runtime-versionen rätt? → Kontrollera installation av browser/Playwright.
- Är browsern installerad? → Kontrollera tokens/cookies.
- Är tokens/cookies giltiga? → Kontrollera om TikTok blockerar sessionen.
- Om allt ovan faller? → Utgå från att det är repots fel, inte användarfel. Byt verktyg.
Bästa praxis för anti-ban vid TikTok-scraping (utan att betala för proxies)
Forumanvändare klagar ofta på bans och upptäckt: "de får kontona bannade, vilket blir en extra kostnad" och "utan Apify eller dyra betalda API:er." Här är gratis, praktiska workarounds som inte kräver en betald proxyprenumeration.

| Praxis | Svårighetsgrad | Kostnad | Effektivitet |
|---|---|---|---|
| Slumpmässiga fördröjningar mellan requests (2–8 s jitter) | Enkel | Gratis | Medel |
| Rotation av session/cookies | Medel | Gratis | Medel |
| Skrapa endast offentliga sidor utan inloggning | Enkel | Gratis | Medel |
Respektera robots.txt + rate-limit headers | Enkel | Gratis | Basnivå |
| Slumpning av browser fingerprint i headless browser (Playwright) | Medel | Gratis | Hög |
| Använda TikToks mobila API-endpoints (lägre upptäcktsrisk) | Svår | Gratis | Hög |
| Rotation av residential proxies | Medel | 20–100 USD/mån | Hög |
Gratis tekniker som faktiskt hjälper
Slumpmässiga fördröjningar mellan requests. Kör inte requests i en tajt loop. Lägg in 2–8 sekunders slumpmässig fördröjning mellan varje request. Det här är det enklaste du kan göra:
import time, random
time.sleep(random.uniform(2, 8))
Återanvänd sessioner och cookies. Skapa inte en helt ny session för varje request. Återanvänd cookies och sessionsstatus över en batch av requests och rotera sedan. Det är precis därför moderna repos ber om ms_token i stället för att lova stateless scraping.
Skrapa offentliga sidor utan inloggning. TikTok-Api säger uttryckligen att det inte stödjer användarautentiserade routes och bara fungerar på data som syns när du är utloggad. Utloggad scraping har lägre upptäcktsprofil än autentiserade sessioner.
Respektera robots.txt. TikToks nuvarande robots.txt blockerar många user agents helt och tillåter bara ett begränsat antal publika paths för generell crawling. Det är inte ett frikort för aggressiv scraping, men att respektera det minskar risken för omedelbar IP-blockering.
Mellannivå-tekniker för högre träffsäkerhet
Slumpning av browser fingerprint i headless browser. Om du använder Playwright, slumpa viewport-storlek, user-agent, tidszon och locale för varje session. Då ser scrapern ut som en annan verklig användare varje gång, i stället för samma bot med ny IP.
Använd TikToks mobila API-endpoints. Vissa i communityn rapporterar lägre upptäcktsgrad när de riktar in sig på mobila endpoints i stället för webbgränssnittet. Det är svårare att implementera och sämre dokumenterat, men det är en verklig teknik för avancerade användare.
När du faktiskt behöver en proxy (och prisvärda alternativ)
I stor skala räcker inte gratismetoder. Rotation av residential proxies är standard för TikTok-scraping i hög volym. Jag rekommenderar inte någon specifik betald proxy-tjänst här, men den generella rådet är: undvik datacenterproxies (TikTok flaggar dem aggressivt) och leta efter residential- eller mobilproxy-pooler med rotation per request.
Alternativt kringgår webbläsarbaserade verktyg som Thunderbit proxyfrågan helt eftersom de körs i din egen webbläsarsession och efterliknar en riktig användare. Det gör dem inte immuna mot upptäckt i stor skala, men för vanliga marknadsförings- eller forskningsbehov (tiotals till hundratals sidor, inte miljontals) är det en mycket enklare väg.
Vilken data får du egentligen? Verkliga output-exempel från TikTok-scrapers
Användare vill veta vilken data de faktiskt får innan de väljer verktyg — och de flesta guider hoppar över detta helt. Här är representativa fältstrukturer baserade på källdokumentation.
Profildata
| Användarnamn | Visningsnamn | Följare | Följer | Totala likes | Bio | Verifierad | Profil-URL |
|---|---|---|---|---|---|---|---|
| @examplecreator | Jane Doe | 1,240,000 | 312 | 48,700,000 | "Cooking + comedy 🍳" | ✅ | tiktok.com/@examplecreator |
| @travelwithmark | Mark S. | 890,000 | 150 | 22,100,000 | "Travel vlogger 🌍" | ❌ | tiktok.com/@travelwithmark |
| @fitnessmaya | Maya L. | 2,100,000 | 88 | 91,300,000 | "Workouts & wellness" | ✅ | tiktok.com/@fitnessmaya |
Finns via: GitHub-scrapers (TikTok-Api, Evil0ctal), Research API, Thunderbit (från synliga profilsidor).
Videometadata
| Video-URL | Caption | Visningar | Likes | Kommentarer | Delningar | Musik | Hashtags | Publiceringsdatum | Längd |
|---|---|---|---|---|---|---|---|---|---|
| tiktok.com/@ex/video/123 | "Best pasta trick ever 🍝" | 4,200,000 | 312,000 | 8,400 | 21,000 | "Italian Vibes – DJ Marco" | #pasta #cooking #hack | 2026-03-15 | 0:42 |
| tiktok.com/@ex/video/456 | "POV: your cat judges you" | 9,100,000 | 1,100,000 | 23,000 | 55,000 | "Original Sound" | #cat #pov #funny | 2026-04-01 | 0:18 |
| tiktok.com/@ex/video/789 | "Morning routine nobody asked for" | 1,800,000 | 98,000 | 3,200 | 7,500 | "Chill Morning – LoFi" | #routine #morning | 2026-04-10 | 1:02 |
Finns via: GitHub-scrapers (TikTok-Api, Evil0ctal), Research API (fält inkluderar video_description, view_count, like_count, comment_count, share_count, music_id, hashtag_names, video_duration), Thunderbit (fält på videonivå).
Kommentarer
| Kommentator | Kommentarstext | Likes | Tidsstämpel | Svar |
|---|---|---|---|---|
| @user_abc | "I tried this and it actually works 😂" | 1,200 | 2026-03-16T08:12:00Z | 14 |
| @chef_dan | "Add garlic next time, trust me" | 890 | 2026-03-16T09:45:00Z | 7 |
| @randomfan99 | "This is the content I'm here for" | 340 | 2026-03-16T11:30:00Z | 2 |
Finns via: GitHub-scrapers (TikTok-Api, Evil0ctal), Research API (fält inkluderar text, like_count, reply_count, create_time), Thunderbit (från synliga kommentarsfält).
Hashtag- och sökdata
| Hashtag | Toppvideo-URL | Totala visningar | Trendande |
|---|---|---|---|
| #pasta | tiktok.com/@ex/video/123 | 4,200,000 | Ja |
| #cooking | tiktok.com/@chef/video/321 | 11,000,000 | Ja |
| #hack | tiktok.com/@tips/video/654 | 2,900,000 | Nej |
Finns via: GitHub-scrapers (varierar beroende på repo), Thunderbit (hashtag-scraper-mall).
Obs: Inget enskilt repo garanterar alla fält hela tiden. TikToks svarstruktur förändras, och även underhållare varnar för det. Se detta som representativa exempel, inte som något garanterat.
Så skrapar du TikTok-data på 2 klick med Thunderbit (steg för steg)
Trött på bryta-och-fixa-cykeln? Här är no-code-vägen — nödutgången för den som har försökt och misslyckats med GitHub-repos.
- Installera Thunderbit Chrome Extension.
- Gå till TikTok-sidan du vill skrapa — en profil, sökresultatsida, hashtagsida eller en enskild video.
- Klicka på "AI Suggest Fields." Thunderbits AI läser sidan och föreslår kolumner: användarnamn, följare, videobeskrivning, likes, hashtags och mer.
- Justera fälten vid behov och klicka sedan på "Scrape." Data fylls i som en strukturerad tabell.
- Använd Subpage Scraping för att berika datan. Klicka in på varje video från en profil-listning och hämta extra fält: full caption, musikdetaljer, antal kommentarer, antal delningar.
- Exportera till Google Sheets, Excel, Airtable eller Notion — helt gratis.
Inget underhåll, ingen installationstriage, ingen anti-ban-konfiguration. AI anpassar sig automatiskt till förändringar i TikToks layout.
Berika TikTok-data med Subpage Scraping
Efter att du skrapat en lista med videor från en profil- eller hashtagsida klickar du på "Scrape Subpages" så att AI:n besöker varje videosida och hämtar fler fält. Det är särskilt användbart för marknadsförare som bygger influencer-databaser eller gör konkurrentanalyser — du får en komplett tabell med engagemangsdata på videonivå utan att manuellt klicka dig igenom dussintals sidor.
Exportera och använd din TikTok-data
Thunderbit exporterar till Google Sheets, Excel, Airtable, Notion, CSV eller JSON — helt gratis. Vanliga användningsområden:
- Lägg datan i ett kalkylblad för engagemangsanalys.
- Skicka till Airtable som en CRM-liknande influencer-tracker.
- För över till Notion för teamsamarbete kring innehållsresearch.
För en djupare titt på hur Thunderbit hanterar webbdatastraktion, se vår nybörjarguide till web scraping eller titta på tutorials på Thunderbits YouTube-kanal.
Håll det lagligt: TikToks användarvillkor och compliance vid scraping
TikToks juridiska hållning är tydlig. Plattformens privacy blog om scraping säger att användarvillkoren förbjuder automatiserade script som samlar in information eller interagerar med tjänsten på otillåtna sätt, och nämner uttryckligen försök att kringgå åtkomstbegränsningar. TikToks Community Guidelines förbjuder också vilseledande försök att få fram information via automatiserade script eller web crawling.
Praktisk vägledning:
- Håll dig till offentligt tillgänglig data. Skrapa inte privat eller inloggningsskyddat innehåll.
- Respektera rate limits. Överbelasta inte TikToks servrar.
- Följ lagar om dataskydd. GDPR och CCPA gäller fortfarande om du samlar in, lagrar eller analyserar personuppgifter.
- Använd Research API när du är berättigad. Det är den säkraste vägen ur ett compliance-perspektiv.
- Detta är inte juridisk rådgivning. Rådgör med en jurist för din specifika situation.
För mer om det juridiska landskapet, se vår guide om juridiska konsekvenser av web scraping.
Vad du ska göra när ditt TikTok-scraperrepo på GitHub dör
Kortversionen:
- Kör alltid 60-sekunderschecklistan för repo-hälsa innan du klonar någon TikTok-scraper från GitHub. De flesta repos är redan döda.
- Förstå alternativen. Officiellt API, GitHub-scrapers och no-code-verktyg passar olika användare och olika use case.
- Om du väljer GitHub-spåret, räkna med tid för installationsfelsökning och anti-ban-konfiguration. Förvänta dig löpande underhåll.
- Veta vilken data du faktiskt får innan du binder upp dig på ett verktyg. Titta på output-fälten, inte bara på stjärnantalet.
- Om du inte är utvecklare (eller är trött på trasiga repos), prova ett no-code-verktyg som Thunderbit — två klick, strukturerad data, fri export.
Den TikTok-data du behöver går att komma åt. Frågan är om du vill lägga tiden på att underhålla en scraper eller faktiskt använda datan. Välj den metod som passar din kompetensnivå och ditt use case, och låt inte ett dött GitHub-repo stjäla ännu en eftermiddag.
Testa Thunderbit för TikTok-data
Vanliga frågor
Finns det några TikTok-scrapers på GitHub som fortfarande fungerar 2026?
Ja, men listan är kort. davidteather/TikTok-Api är det mest trovärdiga open source-alternativet med aktivt underhåll per april 2026. Evil0ctal/Douyin_TikTok_Download_API lever också, men är mer komplext. Det mest stjärnmärkta repot, drawrowfly/tiktok-scraper, har inte uppdaterats sedan maj 2023 och är i praktiken dött. Kör alltid Repo Vitals Checklist innan du lägger tid på ett repo.
Är det lagligt att skrapa TikTok?
TikToks användarvillkor förbjuder uttryckligen automatiserad scraping. Offentligt synlig data befinner sig i en juridisk gråzon som varierar mellan jurisdiktioner. Den säkraste vägen är det officiella Research API för kvalificerade forskare. Om du skrapar offentlig data: håll dig till offentligt tillgängligt innehåll, respektera rate limits och följ GDPR/CCPA. Detta är inte juridisk rådgivning — rådgör med en expert för din situation.
Kan jag skrapa TikTok utan att koda?
Ja. Webbläsarbaserade AI-verktyg som Thunderbit låter dig extrahera strukturerad TikTok-data (profiler, videometadata, hashtags, engagemangsstatistik) utan att skriva kod. TikToks Research API kräver också minimal kodning för godkända sökande. För icke-utvecklare är no-code-verktyg snabbast och mest pålitliga.
Vilken data kan jag få från en TikTok-scraper?
Vanliga datatyper inkluderar profildata (användarnamn, följare, bio, verifieringsstatus), videometadata (caption, visningar, likes, kommentarer, delningar, musik, hashtags, längd, publiceringsdatum), kommentarer (text, likes, tidsstämpel, svar) samt hashtag- och sökdata (toppvideor, totala visningar, trendstatus). De exakta fälten beror på verktyget och metoden — se exempelavsnittet ovan för detaljer.
Varför blir min TikTok-scraper hela tiden blockerad?
TikTok använder flera lager av anti-bot-skydd: hastighetsbegränsning, cookie-/sessionskrav, browser fingerprinting, beteendedetektion, krypterade requestparametrar och CAPTCHA-flöden. Vanliga orsaker till blockering är att skicka requests för snabbt, använda en ny ren session för varje request, köra en headless browser med standardfingerprint eller använda datacenterproxies. Se avsnittet om bästa praxis för anti-ban ovan för gratis och betalda workarounds.


