Een GitHub-zoekopdracht op "tiktok scraper" levert 339 repositories op. Ongeveer 48% daarvan is al meer dan een jaar niet meer geüpdatet, en minstens 4 zijn expliciet gearchiveerd.
Als je ooit een populaire TikTok-scraperrepo hebt gekloond, een uur hebt lopen worstelen met dependencies en vervolgens helemaal geen output kreeg — je bent niet de enige. De meest gestarte TikTok scraper op GitHub, drawrowfly/tiktok-scraper, heeft nog altijd ruim 5.000 sterren. Maar in de issue-tracker staan threads als #812: "werkt deze geweldige tool nog steeds?" en #824: "Werkt dit nog?" — beide met nul output. Bij Thunderbit volg ik al maanden de staat van TikTok-scraperrepos, en het patroon is glashelder: deze tools breken snel en worden zelden gerepareerd. Dit artikel is de praktische survival guide die ik zelf graag had gehad toen ik deze repos voor het eerst ging beoordelen. We kijken naar wat nog leeft, wat dood is, wat je in plaats daarvan kunt doen en hoe je voorkomt dat je uren verspilt aan code die al stuk was voordat je hem überhaupt vond.
Waarom de meeste TikTok scrapers op GitHub stukgaan (en stuk blijven gaan)
TikTok is geen standaard scrapingdoel. De webomgeving verandert constant. In tegenstelling tot een statische productpagina van een webshop of een bedrijvengids wisselt TikTok endpoints af, past het anti-bot fingerprinting aan, verandert het de manier waarop pagina’s worden gerenderd en introduceert het nieuwe sessie- en tokenvereisten — soms al binnen enkele weken na de vorige wijziging.
Open-source maintainers doen dit vrijwillig. Wanneer TikTok een update uitrolt die het request-pad van de scraper breekt, kan de repo dagen, weken of voorgoed stuk blijven liggen. Dat is geen kritiek op de maintainers, maar een structurele mismatch tussen een snel bewegend, zwaar gefinancierd platform en onbetaalde ontwikkelaars met een gewone baan.
Zelfs de beste TikTok-scraperrepos zitten in een eindeloze reparatiecyclus. Als je er een wilt gebruiken, heb je een strategie nodig om te beoordelen, te troubleshooten en een back-upplan te hebben.
TikTok’s anti-botmaatregelen: waar je tegenaan loopt
- Rate limiting. TikTok’s officiële developer-documentatie beschrijft expliciet requestquota’s, zelfs voor goedgekeurde integraties. Onofficiële scrapers lopen daar veel sneller tegenaan.
- Cookie- en sessiecontrole. Moderne repos zoals davidteather/TikTok-Api vereisen een
ms_token; oudere repos zoals drawrowfly/tiktok-scraper gebruikentt_webid_v2in voorbeelden; Evil0ctal/Douyin_TikTok_Download_API documenteertmsToken,ttwid,X-BogusenA_Bogus. TikTok controleert of je request lijkt op verkeer uit een echte browsersessie. - Browser fingerprinting. ScrapFly’s anti-botgids legt uit waarom websites headers, cookies, TLS-signatures en browserkenmerken die via JavaScript zichtbaar zijn, vergelijken met echt gebruikersverkeer. Hun uitleg over browser fingerprinting behandelt Canvas, WebGL, WebRTC, fonts en runtime-signalen. Fingerprinting is alsof TikTok je browser-ID controleert — als browser, cookies, timing en netwerksignatuur niet kloppen, ziet het request er nep uit nog voordat er content terugkomt.
- Gedragsdetectie. Reddit-threads over TikTok scraping melden vaak dat verse Playwright-sessies CAPTCHA’s triggeren. Communityposts uit 2025–2026 beschrijven steeds vaker detectie op basis van timing en interactiekwaliteit, niet alleen IP-hergebruik.
- Versleutelde/ondertekende requestparameters. Evil0ctal documenteert
X-BogusenA_Bogus; oudere community-gists draaien om URL-signing en token-generatie. TikTok verwacht steeds vaker dat requests dezelfde “stempels” dragen als verkeer uit zijn eigen browser of app. - CAPTCHA- en verificatiestromen. Het bestaan van TikTok-specifieke CAPTCHA-solver repos en Reddit-threads over puzzeluitdagingen bevestigt dat CAPTCHA nog steeds deel uitmaakt van het anti-botlandschap.
Waarom open-source maintainers niet kunnen bijbenen
De levenscyclus is telkens hetzelfde. Een developer bouwt een TikTok scraper. De repo gaat viraal op GitHub. TikTok dicht het lek. De maintainer fixt het — of haakt af.
Twee repos laten dat patroon perfect zien:
- drawrowfly/tiktok-scraper heeft nog steeds 5.052 sterren en 889 forks, maar de laatste push was op 19 mei 2023. Het is de meest gestarte exacte TikTok-scraperterm op GitHub, maar voelt inmiddels als een historisch document: veel zichtbaarheid, veel vertrouwen, geen actueel onderhoud.
- davidteather/TikTok-Api laat 6.301 sterren, 1.177 forks en een laatste push op 1 april 2026 zien. De releasefeed toont zinvol onderhoud in april 2025, juli 2025, oktober 2025 en april 2026 — inclusief fixes voor het crawlen van gebruikersvideo’s en nieuwe proxy-/sessie-instellingen. Maar zelfs dit gezondere project waarschuwt openlijk dat TikTok requests blokkeert en dat gebruikers mogelijk proxies, Playwright en eigen sessielogica nodig hebben.
Het patroon is simpel:
- Een verouderde TikTok-scraperrepo is waarschijnlijk dood.
- Een actieve TikTok-scraperrepo is waarschijnlijk nog steeds kwetsbaar.
- Het enige echte verschil is of er deze maand nog iemand is om de schade te repareren.
De 60-seconden repo-checklist: hoe je elke TikTok scraper op GitHub beoordeelt
Voordat je iets kloont, loop je deze checklist door. Het kost minder dan een minuut en bespaart je uren frustratie.
| Signaal | 🟢 Gezond | 🟡 Risicovol | 🔴 Dood |
|---|---|---|---|
| Laatste relevante push | < 3 maanden geleden | 3–12 maanden geleden | 12+ maanden geleden |
| Aantal open issues | Laag, recente issues krijgen antwoord | Groeiende stapel met enige maintainer-activiteit | Veel onbeantwoorde meldingen over “stuk/geblokkeerd/werkt niet” |
| Recente gebruikersklachten | Vooral setupvragen | Mix van setup- en breukmeldingen | Herhaalde meldingen van “zero output”, “403”, “werkt dit nog?” |
| Huidig auth-/sessiemodel | Sessies/cookies goed gedocumenteerd | Token-heavy maar gedocumenteerd | Leunt op oude webendpoints zonder actuele auth-instructies |
| Installatiecomplexiteit | Reproduceerbare, geteste setup | Enkele handmatige stappen | Oude dependencies, geen moderne setupnotities |
| CI/tests | Tests aanwezig en actueel | Tests aanwezig, dekking onduidelijk | Geen tests of verouderde actions |
| Past de datascope? | Sluit aan op jouw use case | Ondersteunt slechts een deel | Lost eigenlijk een ander probleem op |
Hoe je elk signaal binnen 60 seconden controleert
- Laatste pushdatum: Kijk in de repo-header op GitHub. Staat daar “last pushed 2 years ago”, dan ben je al klaar.
- Open issues: Klik op het Issues-tabblad. Scan de nieuwste titels. Zoek op
not working,403,blocked,captchaofzero output. - Gebruikersklachten: Als de top 5 open issues allemaal varianten zijn van “dit werkt niet meer”, dan heb je je antwoord.
- Auth-/sessiemodel: Open de README. Zoek naar actuele aanwijzingen zoals
ms_token, Playwright-setup of proxy-notities. Verwijst de README nog naar endpoints uit 2023, loop dan door. - Installatiecomplexiteit: Kijk of er een requirements-bestand, Docker-support of duidelijke setup-instructies zijn. Als de README alleen “npm install” zegt en de laatste geteste Node-versie 14 was, verwacht problemen.
- CI/tests: Check het Actions-tabblad. Als tests falen of ontbreken, dan is breakage giswerk.
- Datascope: Beschrijft de repo echt de datatypes die jij nodig hebt (profielen, videometadata, comments, hashtags)? Veel repos doen alleen video-downloads, geen gestructureerde data-extractie.
Rode vlaggen die betekenen: wegwezen
- De repo is gearchiveerd.
- De README zegt “no longer maintained”.
- De laatste commit verwijst naar een TikTok API-versie van 2+ jaar geleden.
- Issues staan vol met “werkt niet”-meldingen en de maintainer reageert al maanden niet.
- De repo heeft veel sterren, maar nauwelijks recente forks of pull requests.
Pro-tip: zoek in het Issues-tabblad op is:issue is:open "not working" of is:issue is:open "403". Zijn de resultaten talrijk en recent, dan is de repo waarschijnlijk kapot.
Populaire TikTok-scraper GitHub-repos: een eerlijke statuscheck (2026)

Hier zie je de Repo Vitals Checklist toegepast op de repos die je daadwerkelijk tegenkomt wanneer je op GitHub zoekt naar “tiktok scraper”:
| Repo | Laatste push | Sterren | Open issues | Oordeel | Opmerking |
|---|---|---|---|---|---|
| drawrowfly/tiktok-scraper | 2023-05-19 | 5,052 | 58 | 🔴 Dood / alleen als referentie | Nog steeds beroemd, maar veel te verouderd voor productiegebruik in 2026 |
| davidteather/TikTok-Api | 2026-04-01 | 6,301 | 134 | 🟡 Levend maar onderhoudsintensief | Sterkste OSS-optie; verwacht Playwright, tokens en vaak proxies |
| scrapfly/scrapfly-scrapers/tiktok-scraper | 2026-04-21 | 938 (ouder project) | ~0 (monorepo) | 🟡 Levend, maar niet puur OSS | Actueel en bruikbaar, maar vereist een ScrapFly API-key |
| Evil0ctal/Douyin_TikTok_Download_API | 2025-10-12 | 17,397 | 135 | 🟡 Levend, breed, complex | Functierijk multi-platform project; meer iets voor power users |
| naseif/tiktok-scraper | 2024-07-26 | 107 | 13 | 🟡 Risicovol | Kleinere repo met open klachten over user info- en hashtagflows |
| loewehancara1rmyv/Tiktok-scraper | 2026-01-12 | 4 | 0 | 🔴 Te nieuw om te vertrouwen | Showcaserepo, niet door de community bewezen |
drawrowfly/tiktok-scraper
Jarenlang was deze TypeScript scraper/downloader het standaardantwoord op “tiktok scraper github” — met ondersteuning voor user-, trend-, hashtag- en muziekfeeds. In 2026 kun je hem het best zien als historische documentatie. De laatste push was in mei 2023, en de issue-queue bevat nog steeds onbeantwoorde meldingen zoals “still working?” en “zero output” uit 2023–2025. Als je dit artikel leest omdat je deze repo hebt gekloond en niets terugkrijgt, dan ben je in goed gezelschap.
davidteather/TikTok-Api
De meest geloofwaardige open-source TikTok-datawrapper die in 2026 nog leeft. Actief, met recente releases, en met duidelijke documentatie voor Playwright-setup, async usage, tokenafhandeling, proxyondersteuning en herstel van sessies. Maar het is geen “clone and go”-tool. In de eigen README staat dat EmptyResponseException meestal betekent dat TikTok het request blokkeert, en de discussiehistorie laat terugkerende problemen zien rond ms_token, kapotte commentextractie, KeyError: 'ItemModule' en endpointspecifieke fouten. Oordeel: levend, nuttig, alleen voor developers en onderhoudsintensief.
Andere noemenswaardige repos
- scrapfly/scrapfly-scrapers/tiktok-scraper: Actueel en technisch relevant, maar de README vereist een
SCRAPFLY_KEY. Dit is een codevoorbeeld voor een beheerd scrapingplatform, geen gratis losstaande tool. - Evil0ctal/Douyin_TikTok_Download_API: Dekt TikTok en Douyin af, documenteert signinglogica (
X-Bogus,A_Bogus,msToken) en ondersteunt comments, volgers, playlists en meer. Het is technisch veeleisend en raakt steeds meer verweven met betaalde API-referenties. De issue-tracker laat in 2026 nog steeds bugmeldingen zien rond videolinks en user-info-endpoints. Levend en rijk aan functies, maar complex. - naseif/tiktok-scraper: Kleiner, met open klachten. Risicovol voor productiegebruik.
- loewehancara1rmyv/Tiktok-scraper: 4 sterren, 0 issues, te nieuw om te vertrouwen. Het Medium-artikel dat hem promootte was daar bovendien niet kritisch over.
TikTok officiële API vs. GitHub scrapers vs. no-code tools: een besliskader

De meeste vergelijkingsartikelen negeren TikTok’s officiële toegangspaden of springen meteen van “gebruik GitHub” naar “koop onze dienst”. Hier is een neutrale vergelijking van alle drie de routes:
| Factor | TikTok Research API | GitHub scrapers | No-code tools (bijv. Thunderbit) |
|---|---|---|---|
| Toegangsdrempel | Academische/zakelijke aanvraag vereist; ~4 weken voor goedkeuring | Git clone + setup | Browserextensie installeren |
| Datascope | Alleen goedgekeurde endpoints (accounts, video’s, comments, shops) | Breed (profielen, video’s, comments, hashtags, shops) | Zichtbare paginadata (profielen, video’s, engagement, hashtags) |
| Onderhoudslast | Laag (officieel, stabiel) | Hoog (repos breken wanneer TikTok update) | Geen (AI past zich aan layoutwijzigingen aan) |
| Risico op blokkering | Geen (geautoriseerd) | Hoog | Laag (browsergebaseerd, lijkt op een echte gebruiker) |
| Kosten | Gratis (na goedkeuring) | Gratis (maar tijdsintensief) | Gratis tier beschikbaar; credit-based plannen vanaf $15/mnd |
| Coderen nodig | Ja (Python/R) | Ja (Python/Node.js) | Nee |
| Beste voor | Onderzoekers, academici, goedgekeurde organisaties | Developers die onderhoud aankunnen | Marketeers, sales teams, operations, niet-developers |
Wanneer de TikTok Research API zinvol is
TikTok’s Research API is de schoonste officiële route als je ervoor in aanmerking komt. Geschikte onderzoekers in de VS, Europa en Brazilië kunnen zich aanmelden om openbare content en accountdata te bestuderen. Beschikbare datacategorieën zijn onder andere accounts, volgers/volgend, gelikete video’s, vastgepinde video’s, opnieuw geplaatste video’s, content, comments en shops. Het codebook bevat velden zoals video_description, view_count, like_count, comment_count, share_count en comment-velden zoals text, reply_count en create_time.
Nadeel: de toegang is beperkt tot academische instellingen en geschikte non-profit-/individuele onderzoekers in specifieke regio’s, plus gecontroleerde onderzoekers binnen het EU-DSA-traject. Ben je een growthteam of bureau dat snel operationele data nodig heeft, dan is dit niet jouw route.
TikTok biedt ook een Commercial Content API voor advertenties en data over adverteerderscontent, handig voor transparantieonderzoek maar niet voor algemene scraping.
Wanneer een GitHub scraper nog steeds zinvol is
GitHub scrapers blijven relevant voor developers die onofficiële toegang nodig hebben tot openbare data buiten de goedkeuringspoort van de officiële API en bereid zijn de stack te onderhouden. Denk aan use cases zoals het scrapen van zichtbare profielrasterweergaven, hashtags, comments, playlists of videometadata in een custom pipeline waar je de repo kunt forken en patchen.
De eerlijke kanttekening: dit is geen eenmalige setup. Zelfs de meest betrouwbare repo van 2026, davidteather/TikTok-Api, zegt nog steeds dat gebruikers mogelijk Playwright, cookies/tokens, proxies en eigen page-/session factories nodig hebben.
Wanneer een no-code tool zoals Thunderbit zinvol is
TikTok-data scrapen met AI Get Started Free
Geen developer? Of ben je een developer die klaar is met de reparatiecyclus? Dan is een browsergebaseerde AI-tool de snelste weg naar gestructureerde TikTok-data.
We hebben Thunderbit gebouwd als AI-webscraper in de vorm van een Chrome-extensie. Op TikTok leest het elke zichtbare pagina (profiel, video, hashtag, zoekresultaten), stelt het kolommen voor via “AI Suggest Fields” en kun je op “Scrape” klikken om gestructureerde data te extraheren. De TikTok scraper-toolpagina documenteert velden zoals plaatsingsdatum, videoduur, likes, shares, opgeslagen items, comments, views en hashtags. De image scraper-template laat zien hoe je post-thumbnails, URL’s, captions, creator handles en engagement-signalen van profielpagina’s verzamelt. De hashtag scraper-template dekt video-URL, creatorgebruikersnaam, beschrijving, tijdstip van plaatsen, views, likes, comments, shares, sound/audio en cover-image-URL.
Met subpage scraping kun je vanaf een profieloverzicht iedere video afzonderlijk openen en de tabel verrijken met engagementmetrics, captions en hashtags — handig voor marketeers die influencer-databases opbouwen of concurrentiecontent analyseren.
Geen onderhoud, geen installatiegedoe, geen anti-banconfiguratie. AI past zich automatisch aan layoutwijzigingen aan. Export is gratis naar Google Sheets, Excel, Airtable, Notion, CSV of JSON.
Als je al uren hebt verspild aan kapotte GitHub-repos, is dit een serieus alternatief — geen opgedrongen verkooppraatje.
Probeer Thunderbit voor TikTok-scraping
Installatieproblemen oplossen: de 5 meest voorkomende setupfouten bij TikTok scrapers op GitHub
Installatiefouten zijn de derde meest genoemde pijnpunt in TikTok-scrapingforums, en geen enkele grote gids helpt je echt om ze op te lossen. Dit gaat er meestal mis.
Conflicten met Node.js-versies
Probleem: Veel oudere TikTok-scraperrepos (vooral drawrowfly/tiktok-scraper) zijn gebouwd voor Node.js 14–16. Als je Node 20+ gebruikt, kan npm install stil falen of incompatibele binaries produceren.
Oplossing: Gebruik nvm (Node Version Manager) om de juiste versie te installeren en te activeren:
nvm install 16
nvm use 16
npm install
Als de repo geen Node-versie vermeldt, kijk dan in het engines-veld in package.json of in de CI-configuratie.
Python-dependencyproblemen en Playwright-setup
Probleem: davidteather/TikTok-Api vereist Python 3.9+ en Playwright met specifieke browserbinaries. Gebruikers krijgen fouten zoals “browser not found” of dependencyconflicten.
Oplossing: Gebruik altijd een virtual environment en installeer daarna expliciet de Playwright-browsers:
python -m venv .venv
source .venv/bin/activate # Op Windows: .venv\Scripts\activate
pip install TikTokApi
python -m playwright install
Als playwright install faalt, controleer dan of er systeemdependencies ontbreken via je package manager (bijv. libnss3 op Ubuntu).
Permissiefouten op Linux/Ubuntu
Probleem: sudo pip install beschadigt de systeem-Pythonomgeving en leidt tot een kettingreactie van dependencyproblemen.
Oplossing: Gebruik nooit sudo pip install. Maak altijd eerst een virtual environment:
python3 -m venv .venv
source .venv/bin/activate
pip install -r requirements.txt
Zo blijven de scraperdependencies gescheiden van je systeem-Python.
Windows-problemen met paden en encoding
Probleem: Windows CMD heeft encodingproblemen en beperkingen in padlengte die scraperinstallaties breken, vooral wanneer Playwright browserbinaries downloadt naar diep geneste mappen.
Oplossing: Gebruik WSL (Windows Subsystem for Linux) of Git Bash in plaats van CMD. WSL geeft je een volledige Linux-omgeving binnen Windows:
wsl --install
# Open daarna een WSL-terminal en volg de Linux-stappen
De Docker-shortcut: sla dependencyproblemen volledig over
Probleem: Al het bovenstaande.
Oplossing: Als je met Docker overweg kunt, zet de scraperomgeving dan in een container. Een basale Dockerfile voor een Python-gebaseerde TikTok scraper ziet er zo uit:
FROM python:3.11-slim
RUN apt-get update && apt-get install -y libnss3 libatk-bridge2.0-0 libdrm2 libxcomposite1 libxdamage1 libxrandr2 libgbm1 libasound2
RUN pip install TikTokApi playwright && python -m playwright install --with-deps chromium
WORKDIR /app
COPY . .
CMD ["python", "scrape.py"]
Zo krijg je een reproduceerbare omgeving, ongeacht je host-OS. Werkt de scraper in Docker, dan ligt een fout buiten Docker aan de omgeving en niet aan de code.
Troubleshooting-flowchart:
- Kan de repo zijn eigen voorbeeld succesvol draaien? → Zo nee, check de runtimeversie.
- Runtimeversie correct? → Check browser-/Playwright-installatie.
- Browser geïnstalleerd? → Check tokens/cookies.
- Tokens/cookies geldig? → Check of TikTok de sessie blokkeert.
- Falen al het bovenstaande? → Ga uit van repo-breuk, niet van gebruikersfout. Wissel van tool.
Best practices tegen blokkades bij TikTok scraping (zonder te betalen voor proxies)
Forumgebruikers klagen regelmatig over bans en detectie: “ze laten je accounts bannen, en dat kost extra geld” en “zonder Apify of dure betaalde API’s.” Hier zijn gratis, praktische workarounds waarvoor je geen betaald proxyabonnement nodig hebt.

Gratis technieken die echt helpen
Willekeurige vertraging tussen requests. Vuur requests niet in een strakke loop af. Voeg 2–8 seconden willekeurige jitter toe tussen requests. Dit is het makkelijkste wat je kunt doen:
import time, random
time.sleep(random.uniform(2, 8))
Sessies en cookies hergebruiken. Maak niet voor elk request een compleet nieuwe sessie aan. Hergebruik cookies en sessiestatus over een batch requests heen en roteer daarna. Daarom vragen moderne repos om ms_token in plaats van stateless scraping te beloven.
Scrape openbare pagina’s zonder in te loggen. TikTok-Api zegt expliciet dat het geen user-authenticated routes ondersteunt en alleen werkt op data die zichtbaar is wanneer je bent uitgelogd. Scraping zonder login heeft een lager detectieprofiel dan geauthenticeerde sessies.
Respecteer robots.txt. TikTok’s actuele robots.txt blokkeert veel agents volledig en staat voor algemeen crawlen slechts een beperkte set publieke paden toe. Het is geen vrijbrief voor agressief scrapen, maar het respecteren ervan verkleint de kans op directe IP-blacklisting.
Gevorderde technieken voor hogere succeskansen
Fingerprint-randomisatie in een headless browser. Als je Playwright gebruikt, randomiseer dan per sessie viewportgrootte, user-agent, timezone en locale. Zo lijkt je scraper elke keer op een andere echte gebruiker in plaats van op dezelfde bot met een nieuw IP.
TikTok’s mobiele API-endpoints gebruiken. Sommige communityleden melden lagere detectie wanneer ze mobiele endpoints gebruiken in plaats van de webfrontend. Dit is lastiger te implementeren en minder gedocumenteerd, maar wel een echte techniek voor gevorderde gebruikers.
Wanneer je wel een proxy nodig hebt (en betaalbare opties)
Op grote schaal zijn gratis technieken niet genoeg. Residential proxy-rotatie is de standaardaanpak voor TikTok scraping met hoge volumes. Ik beveel hier geen specifieke betaalde proxydienst aan, maar het algemene advies is: vermijd datacenterproxies (TikTok signaleert die agressief) en zoek naar residential of mobile proxy-pools met rotatie per request.
Browsergebaseerde tools zoals Thunderbit omzeilen de proxyvraag grotendeels omdat ze in je eigen browsersessie draaien en lijken op een echte gebruiker. Dat maakt ze niet immuun voor detectie op schaal, maar voor typische marketing- of onderzoeksuse cases (tientallen tot honderden pagina’s, niet miljoenen) is het een veel simpelere route.
Welke data krijg je eigenlijk? Echte outputvoorbeelden van TikTok scrapers
Gebruikers willen weten welke data ze concreet krijgen vóór ze ergens tijd in steken — en de meeste gidsen slaan dit volledig over. Hieronder staan representatieve veldstructuren, gebaseerd op brondocumentatie.
Profieldata
| Gebruikersnaam | Weergavenaam | Volgers | Volgend | Totaal aantal likes | Bio | Geverifieerd | Profiel-URL |
|---|---|---|---|---|---|---|---|
| @examplecreator | Jane Doe | 1.240.000 | 312 | 48.700.000 | "Koken + comedy 🍳" | ✅ | tiktok.com/@examplecreator |
| @travelwithmark | Mark S. | 890.000 | 150 | 22.100.000 | "Travel vlogger 🌍" | ❌ | tiktok.com/@travelwithmark |
| @fitnessmaya | Maya L. | 2.100.000 | 88 | 91.300.000 | "Workouts & wellness" | ✅ | tiktok.com/@fitnessmaya |
Beschikbaar via: GitHub scrapers (TikTok-Api, Evil0ctal), Research API, Thunderbit (van zichtbare profielpagina’s).
Videometadata
| Video-URL | Caption | Weergaven | Likes | Comments | Shares | Muziek | Hashtags | Publicatiedatum | Duur |
|---|---|---|---|---|---|---|---|---|---|
| tiktok.com/@ex/video/123 | "Best pasta trick ever 🍝" | 4.200.000 | 312.000 | 8.400 | 21.000 | "Italian Vibes – DJ Marco" | #pasta #cooking #hack | 2026-03-15 | 0:42 |
| tiktok.com/@ex/video/456 | "POV: your cat judges you" | 9.100.000 | 1.100.000 | 23.000 | 55.000 | "Original Sound" | #cat #pov #funny | 2026-04-01 | 0:18 |
| tiktok.com/@ex/video/789 | "Morning routine nobody asked for" | 1.800.000 | 98.000 | 3.200 | 7.500 | "Chill Morning – LoFi" | #routine #morning | 2026-04-10 | 1:02 |
Beschikbaar via: GitHub scrapers (TikTok-Api, Evil0ctal), Research API (velden zoals video_description, view_count, like_count, comment_count, share_count, music_id, hashtag_names, video_duration), Thunderbit (videoniveauvelden).
Commentdata
| Reageerder | Commenttekst | Likes | Tijdstip | Reacties |
|---|---|---|---|---|
| @user_abc | "I tried this and it actually works 😂" | 1.200 | 2026-03-16T08:12:00Z | 14 |
| @chef_dan | "Add garlic next time, trust me" | 890 | 2026-03-16T09:45:00Z | 7 |
| @randomfan99 | "This is the content I'm here for" | 340 | 2026-03-16T11:30:00Z | 2 |
Beschikbaar via: GitHub scrapers (TikTok-Api, Evil0ctal), Research API (velden zoals text, like_count, reply_count, create_time), Thunderbit (van zichtbare commentsecties).
Hashtag- en zoekdata
| Hashtag | Topvideo-URL | Totaal aantal weergaven | Trending |
|---|---|---|---|
| #pasta | tiktok.com/@ex/video/123 | 4.200.000 | Ja |
| #cooking | tiktok.com/@chef/video/321 | 11.000.000 | Ja |
| #hack | tiktok.com/@tips/video/654 | 2.900.000 | Nee |
Beschikbaar via: GitHub scrapers (verschilt per repo), Thunderbit (hashtag scraper-template).
Let op: geen enkele repo garandeert alle velden altijd. De response-structuren van TikTok veranderen, en zelfs maintainers waarschuwen daarvoor. Zie deze voorbeelden als representatief, niet als garantie.
TikTok-data scrapen in 2 klikken met Thunderbit (stap voor stap)
Ben je klaar met de eindeloze reparatiecyclus? Hier is de no-code route — de nooduitgang voor iedereen die GitHub-repos heeft geprobeerd en gefaald heeft.
- Installeer de Thunderbit Chrome-extensie.
- Ga naar de TikTok-pagina die je wilt scrapen — een profiel, zoekresultatenpagina, hashtagpagina of individuele video.
- Klik op "AI Suggest Fields." Thunderbit’s AI leest de pagina en stelt kolommen voor: gebruikersnaam, volgers, videocaption, likes, hashtags, enzovoort.
- Pas velden aan indien nodig en klik op "Scrape." De data wordt ingevuld in een gestructureerde tabel.
- Gebruik Subpage Scraping om data te verrijken. Klik vanuit een profieloverzicht door naar elke video en haal extra velden op: volledige caption, muziekinformatie, commentaantallen, share-aantallen.
- Exporteer naar Google Sheets, Excel, Airtable of Notion — helemaal gratis.
Geen onderhoud, geen installatie-gedoe, geen anti-banconfiguratie. De AI past zich automatisch aan TikTok-layoutwijzigingen aan.
TikTok-data verrijken met Subpage Scraping
Nadat je een lijst video’s van een profiel- of hashtagpagina hebt gescrapet, klik je op “Scrape Subpages” zodat de AI elke videopagina bezoekt en extra velden ophaalt. Dit is vooral handig voor marketeers die influencer-databases bouwen of concurrentiecontent analyseren — je krijgt een complete tabel met engagementdata op videoniveau zonder handmatig door tientallen pagina’s te klikken.
TikTok-data exporteren en gebruiken
Thunderbit exporteert gratis naar Google Sheets, Excel, Airtable, Notion, CSV of JSON. Veelgebruikte toepassingen:
- Data in een spreadsheet zetten voor engagementanalyse.
- Naar Airtable sturen voor een CRM-achtige influencertracker.
- Naar Notion pushen voor teamsamenwerking rond contentonderzoek.
Wil je dieper begrijpen hoe Thunderbit webdata-extractie aanpakt, bekijk dan onze beginnersgids voor webscraping of tutorials op het Thunderbit YouTube-kanaal.
Binnen de lijnen blijven: TikTok’s gebruiksvoorwaarden en scraping-compliance
TikTok’s juridische positie is duidelijk. De privacyblog over scraping stelt dat de Terms of Service geautomatiseerde scripts verbieden die informatie verzamelen of op niet-geautoriseerde manieren met de dienst interacteren, en noemt expliciet het omzeilen van toegangsbeperkingen. TikTok’s Community Guidelines verbieden ook misleidende pogingen om informatie te verkrijgen via geautomatiseerde scripts of webcrawling.
Praktische richtlijnen:
- Blijf bij publiek beschikbare data. Scrape geen privé- of login-gebonden content.
- Respecteer rate limits. Beuk TikTok’s servers niet plat.
- Houd je aan privacywetgeving. GDPR en CCPA blijven gelden als je persoonsgegevens verzamelt, opslaat of analyseert.
- Gebruik de Research API wanneer je daarvoor in aanmerking komt. Dat is juridisch en qua compliance de veiligste route.
- Dit is geen juridisch advies. Raadpleeg een professional voor jouw situatie.
Voor meer over de juridische kant, zie onze gids over juridische implicaties van webscraping.
Wat te doen als je TikTok scraper GitHub-repo sterft
Kort samengevat:
- Voer altijd eerst de 60-seconden Repo Vitals Checklist uit voordat je een TikTok scraper van GitHub kloont. De meeste repos zijn al dood.
- Begrijp je opties. De officiële API, GitHub scrapers en no-code tools bedienen elk andere gebruikers en use cases.
- Kies je voor GitHub, reken dan op tijd voor installatieproblemen en anti-banconfiguratie. Verwacht doorlopend onderhoud.
- Weet welke data je echt krijgt voordat je je ergens aan vastlegt. Kijk naar de outputvelden, niet alleen naar het aantal sterren.
- Ben je geen developer (of ben je klaar met kapotte repos)? Probeer dan een no-code tool zoals Thunderbit — twee klikken, gestructureerde data, gratis export.
De TikTok-data die je nodig hebt is bereikbaar. De echte vraag is of je je tijd wilt steken in het onderhouden van een scraper of in het daadwerkelijk gebruiken van de data. Kies de aanpak die past bij je niveau en use case, en laat een dode GitHub-repo je middag niet opnieuw verspillen.
Probeer Thunderbit voor TikTok-data
FAQ
Zijn er in 2026 nog TikTok scrapers op GitHub die werken?
Ja, maar de lijst is kort. davidteather/TikTok-Api is de meest geloofwaardige open-sourceoptie met actieve onderhoudsactiviteiten per april 2026. Evil0ctal/Douyin_TikTok_Download_API leeft ook nog, maar is complexer. De meest gestarte repo, drawrowfly/tiktok-scraper, is sinds mei 2023 niet meer bijgewerkt en is in feite dood. Gebruik altijd de Repo Vitals Checklist voordat je tijd in een repo steekt.
Is het legaal om TikTok te scrapen?
TikTok’s Terms of Service verbieden expliciet geautomatiseerd scrapen. Openbaar zichtbare data bevindt zich in een juridisch grijs gebied dat per jurisdictie verschilt. De veiligste route is de officiële Research API voor daarvoor in aanmerking komende onderzoekers. Als je openbare data scraped, blijf dan bij publiek toegankelijke content, respecteer rate limits en houd je aan GDPR/CCPA. Dit is geen juridisch advies — raadpleeg een professional voor jouw situatie.
Kan ik TikTok scrapen zonder te coderen?
Ja. Browsergebaseerde AI-tools zoals Thunderbit laten je gestructureerde TikTok-data extraheren (profielen, videometadata, hashtags, engagementmetrics) zonder code te schrijven. De TikTok Research API vereist voor goedgekeurde aanvragers ook maar weinig code. Voor niet-developers zijn no-code tools de snelste en betrouwbaarste route.
Welke data kan ik uit een TikTok scraper halen?
Veelvoorkomende datatypes zijn profielinformatie (gebruikersnaam, volgers, bio, verificatiestatus), videometadata (caption, views, likes, comments, shares, muziek, hashtags, duur, publicatiedatum), comments (tekst, likes, tijdstip, reacties) en hashtag-/zoekdata (topvideo’s, totaal aantal weergaven, trending-status). De precieze velden hangen af van de tool en methode — zie hierboven de outputvoorbeelden voor details.
Waarom wordt mijn TikTok scraper steeds geblokkeerd?
TikTok gebruikt meerdere lagen anti-botbescherming: rate limiting, cookie-/sessiecontrole, browser fingerprinting, gedragsdetectie, versleutelde requestparameters en CAPTCHA-flows. Veelvoorkomende oorzaken zijn te snel requests sturen, voor elk request een nieuwe schone sessie gebruiken, een headless browser met standaardfingerprints draaien of datacenterproxies gebruiken. Zie hierboven de sectie over anti-ban best practices voor gratis en betaalde workarounds.


