Die meisten TikTok-Scraper auf GitHub sind tot — das kannst du tun

Zuletzt aktualisiert am July 13, 2026
Die meisten TikTok-Scraper auf GitHub sind tot — das kannst du tun

Wer auf GitHub nach „tiktok scraper“ sucht, bekommt 339 Repositories angezeigt. Davon liegen rund 48 % seit über einem Jahr brach, und mindestens 4 tragen offiziell den Stempel „archiviert“.

Du hast schon mal ein vielversprechendes TikTok-Scraper-Repo geklont, eine Stunde lang mit Abhängigkeiten gerungen und am Ende genau null Datensätze bekommen? Damit bist du in bester Gesellschaft. Das Repo mit den meisten Sternen, drawrowfly/tiktok-scraper, steht nach wie vor bei über 5.000 Sternen. Im Issue-Tracker stapeln sich allerdings Threads wie #812: „is this amazing tool still working?“ und #824: „Is this still working?“, beide mit der immer gleichen Klage: keinerlei Ausgabe. Bei Thunderbit beobachten wir seit Monaten, in welchem Zustand TikTok-Scraping-Repos sind, und das Bild ist eindeutig: Diese Tools gehen schnell kaputt, und die meisten werden nie wieder geflickt. Dieser Artikel ist der Praxisleitfaden, den ich mir gewünscht hätte, als ich diese Repos zum ersten Mal unter die Lupe nahm. Es geht darum, was noch funktioniert, was tot ist, welche Alternativen es gibt, und wie du aufhörst, Stunden in Code zu versenken, der schon nicht mehr läuft, bevor du ihn überhaupt entdeckt hast.

Warum die meisten TikTok-Scraper auf GitHub kaputtgehen (und es immer wieder tun)

TikTok ist ein denkbar undankbares Scraping-Ziel. Die Weboberfläche ist permanent in Bewegung. Anders als eine statische Produktseite im Shop oder ein simples Verzeichnis tauscht TikTok Endpunkte aus, schraubt am Anti-Bot-Fingerprinting, verändert die Art, wie die Seite gerendert wird, und führt neue Session- und Token-Anforderungen ein, mitunter nur wenige Wochen nach der letzten Umstellung.

Open-Source-Maintainer machen das in ihrer Freizeit. Bringt ein TikTok-Update den Request-Pfad eines Scrapers durcheinander, kann das Repo Tage, Wochen oder für immer defekt bleiben. Das ist kein Vorwurf an die Entwickler. Es ist schlicht ein strukturelles Ungleichgewicht: hier eine schnelllebige, finanzstarke Plattform, dort unbezahlte Programmierer mit Brotjob.

Selbst die besten TikTok-Scraper-Repos leben in einem Dauerzustand aus Reparieren und Nachbessern. Wer eines davon einsetzen will, braucht eine Methode, um es zu bewerten, Fehler zu beheben, und einen Plan B in der Hinterhand.

TikToks Anti-Bot-Abwehr: Wogegen du antrittst

  • Rate Limiting. Die offiziellen Entwicklerdokumente von TikTok führen ausdrücklich Anfragekontingente auf, sogar für freigegebene Integrationen. Inoffizielle Scraper rennen viel früher gegen diese Grenzen.
  • Cookie- und Session-Gating. Aktuelle Repos wie davidteather/TikTok-Api verlangen ein ms_token; ältere wie drawrowfly/tiktok-scraper arbeiten in ihren Beispielen mit tt_webid_v2; Evil0ctal/Douyin_TikTok_Download_API dokumentiert msToken, ttwid, X-Bogus und A_Bogus. TikTok kontrolliert, ob eine Anfrage so aussieht, als stamme sie aus einer echten Browsing-Session.
  • Browser-Fingerprinting. ScrapFlys Anti-Bot-Leitfaden erläutert, warum Websites Header, Cookies, TLS-Signaturen und im Browser sichtbare Merkmale mit echtem Nutzerverkehr abgleichen. Ihre Analyse zum Browser-Fingerprinting behandelt Canvas, WebGL, WebRTC, Schriften und Laufzeitsignale. Fingerprinting funktioniert wie eine Ausweiskontrolle: Passen Browser, Cookies, Timing und Netzwerksignatur nicht zusammen, wirkt die Anfrage gefälscht, noch bevor überhaupt Inhalte zurückkommen.
  • Verhaltensbasierte Erkennung. Reddit-Threads zum TikTok-Scraping berichten immer wieder, dass frisch gestartete Playwright-Sitzungen CAPTCHAs auslösen. Community-Beiträge aus 2025–2026 beschreiben zunehmend eine Erkennung, die auf das Timing einzelner Aktionen und die Qualität der Interaktion achtet, nicht bloß auf wiederverwendete IPs.
  • Verschlüsselte/signierte Request-Parameter. Evil0ctal dokumentiert X-Bogus und A_Bogus; ältere Community-Gists kreisen um URL-Signierung und Token-Generierung. TikTok erwartet immer öfter, dass Anfragen mit denselben „Stempeln“ ankommen wie der eigene Browser- oder App-Verkehr.
  • CAPTCHA- und Verifizierungsabläufe. Dass es eigens CAPTCHA-Solver-Repos für TikTok und Reddit-Threads zu Puzzle-Challenges gibt, belegt: CAPTCHA bleibt fester Bestandteil der Anti-Bot-Schicht.

Warum Open-Source-Maintainer nicht mithalten können

Der Ablauf wiederholt sich immer gleich. Ein Entwickler baut einen TikTok-Scraper. Er geht auf GitHub viral. TikTok patcht irgendetwas. Der Maintainer flickt es entweder, oder er zieht weiter.

Zwei Repos zeigen dieses Muster wie unter dem Brennglas:

  • drawrowfly/tiktok-scraper kommt nach wie vor auf 5.052 Sterne und 889 Forks, doch der letzte Push datiert vom 19. Mai 2023. Mit genau dieser Suchphrase ist es das sternreichste TikTok-Scraper-Repo auf GitHub und wirkt heute wie ein historisches Fundstück: enorme Sichtbarkeit, viel Vertrauensvorschuss, aber keinerlei aktuelle Pflege.
  • davidteather/TikTok-Api weist 6.301 Sterne, 1.177 Forks und einen letzten Push vom 1. April 2026 aus. Der Release-Feed belegt ernsthafte Pflege im April 2025, Juli 2025, Oktober 2025 und April 2026, inklusive Fixes fürs Video-Crawling und neuer Proxy- und Session-Steuerung. Doch selbst dieses gesündere Projekt warnt unverblümt: TikTok blockiert Anfragen, und Nutzer brauchen womöglich Proxys, Playwright und eigene Session-Logik.

Die Faustregel ist simpel:

  • Ein veraltetes TikTok-Scraper-Repo ist mit hoher Wahrscheinlichkeit tot.
  • Ein aktives TikTok-Scraper-Repo ist mit hoher Wahrscheinlichkeit trotzdem fragil.
  • Der einzige echte Unterschied: ob diesen Monat noch jemand da ist, der die neuen Brüche kittet.

Die 60-Sekunden-Repo-Vitals-Checkliste: So bewertest du jeden TikTok-Scraper auf GitHub

Bevor du irgendetwas klonst, arbeite diese Checkliste ab. Sie kostet dich keine Minute und erspart dir stundenlangen Frust.

Signal🟢 Gesund🟡 Riskant🔴 Tot
Letzter relevanter Pushvor < 3 Monatenvor 3–12 Monatenvor 12+ Monaten
Anzahl offener IssuesNiedrig, aktuelle Issues werden beantwortetWachsende Liste mit etwas Aktivität der MaintainerViele unbeantwortete Berichte über „broken/blocked/not working“
Aktuelle NutzerbeschwerdenMeist Setup-FragenMischung aus Setup- und FehlerberichtenWiederholte Meldungen wie „zero output“, „403“, „still working?“
Aktuelles Auth-/Session-ModellSession-/Cookie-Pfad dokumentiertToken-lastig, aber dokumentiertVerwendet alte Web-Endpunkte ohne aktuelle Auth-Hinweise
InstallationsaufwandReproduzierbares, getestetes SetupEinige manuelle SchritteAlte Abhängigkeiten, keine modernen Setup-Hinweise
CI/TestsTests existieren und sind aktuellTests existieren, aber Abdeckung unklarKeine Tests oder veraltete Actions
Passung des DatenumfangsPasst zu deinem echten AnwendungsfallDeckt nur einen Teil des Anwendungsfalls abLöst ein ganz anderes Problem

So prüfst du jedes Signal in unter 60 Sekunden

  1. Datum des letzten Pushs: Ein Blick in den Repo-Header auf GitHub genügt. Steht dort „last pushed 2 years ago“, kannst du dir den Rest sparen.
  2. Offene Issues: Öffne den Issues-Tab und überfliege die neuesten Titel. Achte auf not working, 403, blocked, captcha oder zero output.
  3. Nutzerbeschwerden: Sind die fünf obersten offenen Issues allesamt Spielarten von „this doesn't work anymore“, hast du deine Antwort.
  4. Auth-/Session-Modell: Wirf einen Blick in die README. Aktuelle Hinweise wie ms_token, Playwright-Setup oder Proxy-Anmerkungen sind ein gutes Zeichen. Tauchen dort 2023er-Endpunkte auf, geh weiter.
  5. Installationsoberfläche: Prüfe, ob es eine Requirements-Datei, Docker-Unterstützung oder klare Setup-Anweisungen gibt. Steht in der README „npm install“ und die letzte getestete Node-Version war 14, wird es zäh.
  6. CI/Tests: Schau in den Actions-Tab. Schlagen Tests fehl oder fehlen sie ganz, ist alles Weitere Glückssache.
  7. Datenumfang: Beschreibt das Repo wirklich die Datentypen, die du brauchst (Profile, Videometadaten, Kommentare, Hashtags)? Viele Repos können nur Videos herunterladen, aber keine strukturierten Daten extrahieren.

Warnsignale, bei denen du sofort gehen solltest

  • Das Repo ist archiviert.
  • In der README steht „no longer maintained“.
  • Der letzte Commit bezieht sich auf eine TikTok-API-Version, die über 2 Jahre alt ist.
  • Die Issues quellen über vor „doesn't work“-Meldungen, und der Maintainer hat seit Monaten nichts mehr beantwortet.
  • Das Repo hat viele Sterne, aber keine aktuellen Forks oder Pull Requests.

Praxistipp: Filtere im Issues-Tab mit is:issue is:open "not working" oder is:issue is:open "403". Häufen sich frische Treffer, ist das Repo mit ziemlicher Sicherheit kaputt.

Beliebte TikTok-Scraper-GitHub-Repos: Ein ehrlicher Status-Check (2026)

tiktok_scraper_repo_status_v1_a5c4a7a45c.png

Hier die Repo-Vitals-Checkliste, angewendet auf genau die Repos, über die du bei einer GitHub-Suche nach „tiktok scraper“ stolperst:

RepoLetzter PushSterneOffene IssuesUrteilHinweis
drawrowfly/tiktok-scraper2023-05-195.05258🔴 Tot / nur als ReferenzImmer noch bekannt, aber für den produktiven Einsatz 2026 zu veraltet
davidteather/TikTok-Api2026-04-016.301134🟡 Lebt, aber wartungsintensivStärkste OSS-Option; erwartet Playwright, Tokens und oft Proxys
scrapfly/scrapfly-scrapers/tiktok-scraper2026-04-21938 (Parent)~0 (Monorepo)🟡 Lebt, aber kein reines OSSAktuell und nützlich, benötigt aber einen ScrapFly-API-Schlüssel
Evil0ctal/Douyin_TikTok_Download_API2025-10-1217.397135🟡 Lebt, breit, komplexFunktionsreiches Multi-Platform-Projekt; eher eine Power-User-Plattform
naseif/tiktok-scraper2024-07-2610713🟡 RiskantKleineres Repo mit offenen Beschwerden zu User-Info- und Hashtag-Flows
loewehancara1rmyv/Tiktok-scraper2026-01-1240🔴 Zu neu, um vertrauenswürdig zu seinShowcase-Repo, nicht von der Community bewährt

drawrowfly/tiktok-scraper

Jahrelang war dieser TypeScript-Scraper und -Downloader die Standardantwort auf „tiktok scraper github“, und zwar für User-, Trend-, Hashtag- und Musik-Feeds. 2026 betrachtest du ihn am besten als historische Dokumentation. Der letzte Push stammt vom Mai 2023, und in der Issue-Warteschlange schlummern ungelöste Berichte wie „still working?“ und „zero output“ aus den Jahren 2023 bis 2025. Wer diesen Artikel liest, weil er das Repo geklont hat und nichts herausbekommt, ist nicht allein.

davidteather/TikTok-Api

Die glaubwürdigste noch aktive Open-Source-Lösung für TikTok-Daten im Jahr 2026. Das Projekt ist lebendig, hat aktuelle Releases und dokumentiert Playwright-Setup, asynchrone Nutzung, Token-Handling, Proxy-Support und Funktionen zur Session-Wiederherstellung im Detail. Trotzdem: „klonen und loslegen“ ist das nicht. Die README selbst erklärt, dass EmptyResponseException meist bedeutet, dass TikTok die Anfrage blockiert, und die Diskussionshistorie zeigt wiederkehrende Probleme mit ms_token, kaputter Kommentar-Extraktion, KeyError: 'ItemModule' und endpunktspezifischen Fehlern. Fazit: lebendig, brauchbar, aber nur etwas für Entwickler, und wartungsintensiv.

Weitere bemerkenswerte Repos

  • scrapfly/scrapfly-scrapers/tiktok-scraper: Aktuell und technisch relevant, doch die README verlangt einen SCRAPFLY_KEY. Es ist ein Codebeispiel für eine verwaltete Scraping-Plattform, kein kostenloses Standalone-Tool.
  • Evil0ctal/Douyin_TikTok_Download_API: Deckt TikTok und Douyin ab, dokumentiert die Signierlogik (X-Bogus, A_Bogus, msToken) und unterstützt Kommentare, Follower, Playlists und mehr. Technisch anspruchsvoll und zunehmend mit bezahlten API-Referenzen verzahnt. Der Issue-Tracker verzeichnet 2026 laufende Bugmeldungen zu Videolinks und User-Info-Endpunkten. Lebendig und funktionsreich, dafür komplex.
  • naseif/tiktok-scraper: Klein, mit offenen Beschwerden. Für den Produktionseinsatz riskant.
  • loewehancara1rmyv/Tiktok-scraper: 4 Sterne, 0 Issues, schlicht zu neu, um Vertrauen zu verdienen. Der Medium-Artikel, der es bewarb, tat dies ohne jede kritische Einordnung.

TikTok Official API vs. GitHub-Scraper vs. No-Code-Tools: Ein Entscheidungsrahmen

tiktok_scraper_decision_framework_v1_590e6b1852.png

Die meisten Konkurrenzartikel übergehen entweder TikToks offizielle Zugänge oder springen direkt von „nimm GitHub“ zu „kauf unseren Dienst“. Hier ein neutraler Vergleich aller drei Wege:

FaktorTikTok Research APIGitHub-ScraperNo-Code-Tools (z. B. Thunderbit)
ZugangshürdeAkademischer/geschäftlicher Antrag erforderlich; ca. 4 Wochen bis zur FreigabeGit-Klon + SetupBrowser-Erweiterung installieren
DatenumfangNur freigegebene Endpunkte (Konten, Videos, Kommentare, Shops)Breit (Profile, Videos, Kommentare, Hashtags, Shops)Sichtbare Seitendaten (Profile, Videos, Engagement, Hashtags)
WartungsaufwandNiedrig (offiziell, stabil)Hoch (Repos brechen bei TikTok-Updates)Keiner (KI passt sich Layout-Änderungen an)
Anti-Ban-RisikoKeines (autorisiert)HochNiedrig (browserbasiert, imitiert echten Nutzer)
KostenKostenlos (bei Freigabe)Kostenlos (aber zeitintensiv)Kostenlose Stufe verfügbar; Pläne ab 15 $/Monat
Programmierung erforderlichJa (Python/R)Ja (Python/Node.js)Nein
Am besten geeignet fürForschende, Hochschulen, freigegebene OrganisationenEntwickler, die mit Wartung leben könnenMarketing, Vertrieb, Operations, Nicht-Entwickler

Wann die TikTok Research API sinnvoll ist

Die Research API von TikTok ist der sauberste offizielle Weg – sofern du zugelassen wirst. Berechtigte Forschende in den USA, Europa und Brasilien können sich bewerben, um öffentliche Inhalte und Kontodaten zu untersuchen. Zu den verfügbaren Datenkategorien zählen Konten, Follower und Following, gelikte Videos, angeheftete Videos, erneut gepostete Videos, Inhalte, Kommentare und Shops. Das Codebook gibt Felder wie video_description, view_count, like_count, comment_count, share_count sowie kommentarbezogene Felder wie text, reply_count und create_time frei.

Der Haken: Die Berechtigung ist auf akademische Einrichtungen sowie auf qualifizierte gemeinnützige und individuelle Forschende in bestimmten Regionen beschränkt, dazu kommen im EU-DSA-Verfahren geprüfte Forschende. Wer als Growth-Team oder Agentur schnell operative Daten braucht, ist hier falsch.

Daneben bietet TikTok eine Commercial Content API für Anzeigen- und Advertiser-Inhalte, hilfreich für Transparenzforschung, nicht aber fürs allgemeine Scraping.

Wann ein GitHub-Scraper noch sinnvoll ist

Für Entwickler bleiben GitHub-Scraper eine Option, wenn sie inoffiziellen Zugriff auf öffentliche Daten jenseits der Freigabeschranke der offiziellen API brauchen und bereit sind, den Stack selbst zu pflegen. Typische Fälle: das Abgreifen sichtbarer Profilraster, Hashtags, Kommentare, Playlists oder Videometadaten in einer eigenen Pipeline, in der Forken und Patchen kein Problem ist.

Die ehrliche Einschränkung: Das ist keine einmalige Einrichtung. Selbst das verlässlichste Repo des Jahrgangs 2026, davidteather/TikTok-Api, weist seine Nutzer darauf hin, dass Playwright, Cookies und Tokens, Proxys sowie eigene Page- und Session-Factories nötig sein können.

Wann ein No-Code-Tool wie Thunderbit sinnvoll ist

TikTok-Daten mit KI scrapen Get Started Free

Kein Entwickler? Oder Entwickler, aber das ewige Reparieren leid? Dann ist ein browserbasiertes KI-Tool der schnellste Weg zu strukturierten TikTok-Daten.

Thunderbit haben wir als KI-Web-Scraper gebaut, der als Chrome-Erweiterung läuft. Auf TikTok liest es jede sichtbare Seite (Profil, Video, Hashtag, Suchergebnisse), schlägt über „KI-Felder vorschlagen“ passende Spalten vor und extrahiert die strukturierten Daten per Klick auf „Scrapen“. Die TikTok-Scraper-Toolseite führt Felder wie Veröffentlichungsdatum, Videodauer, Likes, Shares, Speicherungen, Kommentare, Aufrufe und Hashtags auf. Die Vorlage für den Bild-Extraktor zeigt, wie du Vorschaubilder, URLs, Bildunterschriften, Creator-Handles und Engagement-Signale von Profilseiten einsammelst. Die Vorlage für den Hashtag-Scraper deckt Video-URL, Creator-Nutzername, Beschreibung, Veröffentlichungszeit, Aufrufe, Likes, Kommentare, Shares, Sound/Audio und Coverbild-URL ab.

Mit dem Scraping von Unterseiten rufst du jede Videoseite aus einer Profilauflistung auf und reicherst die Tabelle um Engagement-Metriken, Bildunterschriften und Hashtags an. Praktisch für Marketingteams, die Influencer-Datenbanken aufbauen, oder für die Wettbewerbsanalyse von Inhalten.

Keine Wartung, kein Installations-Chaos, keine Anti-Ban-Konfiguration. Die KI stellt sich auf Layout-Änderungen automatisch ein. Der Export nach Google Sheets, Excel, Airtable, Notion, CSV oder JSON ist kostenlos.

Wer bereits Stunden an kaputten GitHub-Repos verheizt hat, findet hier eine legitime Alternative, ganz ohne aufgesetzten Produkt-Pitch.

Thunderbit fürs TikTok-Scraping testen

Installations-Triage: Die 5 häufigsten Setup-Fehler bei TikTok-Scrapern auf GitHub beheben

Installationsfehler sind das dritthäufigste Thema in TikTok-Scraping-Foren, und kein großer Leitfaden hilft wirklich beim Beheben. Hier kommt, was schiefläuft und wie du es löst.

Node.js-Versionskonflikte

Problem: Viele ältere TikTok-Scraper-Repos, allen voran drawrowfly/tiktok-scraper, wurden für Node.js 14 bis 16 gebaut. Unter Node 20+ kann npm install stillschweigend scheitern oder inkompatible Binärdateien erzeugen.

Lösung: Nutze nvm (Node Version Manager), um die passende Version zu installieren und dorthin zu wechseln:

nvm install 16
nvm use 16
npm install

Nennt das Repo keine Node-Version, hilft ein Blick ins engines-Feld der package.json oder in die CI-Konfiguration.

Python-Abhängigkeitsprobleme und Playwright-Setup

Problem: davidteather/TikTok-Api setzt Python 3.9+ und Playwright mit bestimmten Browser-Binaries voraus. Häufige Fehler: „browser not found“ oder kollidierende Abhängigkeiten.

Lösung: Arbeite grundsätzlich mit einer virtuellen Umgebung und installiere die Playwright-Browser ausdrücklich:

python -m venv .venv
source .venv/bin/activate   # Unter Windows: .venv\Scripts\activate
pip install TikTokApi
python -m playwright install

Scheitert playwright install, prüfe über den Paketmanager deines Systems, ob Systemabhängigkeiten fehlen (etwa libnss3 unter Ubuntu).

Linux-/Ubuntu-Berechtigungsfehler

Problem: sudo pip install zerschießt die systemweite Python-Umgebung und löst eine Kettenreaktion bei den Abhängigkeiten aus.

Lösung: Finger weg von sudo pip install. Lege immer zuerst eine virtuelle Umgebung an:

python3 -m venv .venv
source .venv/bin/activate
pip install -r requirements.txt

So bleiben die Abhängigkeiten des Scrapers sauber von deinem System-Python getrennt.

Windows-Pfad- und Kodierungsprobleme

Problem: Die Windows-Eingabeaufforderung hat ihre Tücken bei Kodierung und Pfadlänge, die Scraper-Installationen scheitern lassen, besonders, wenn Playwright Browser-Binaries in tief verschachtelte Verzeichnisse legt.

Lösung: Greif zu WSL (Windows Subsystem for Linux) oder Git Bash statt CMD. WSL liefert dir eine vollwertige Linux-Umgebung mitten in Windows:

wsl --install
# Dann ein WSL-Terminal öffnen und den Linux-Setup-Schritten folgen

Der Docker-Kurzweg: Abhängigkeitsprobleme komplett überspringen

Problem: Alles oben Genannte auf einmal.

Lösung: Wer mit Docker umgehen kann, packt die Scraper-Umgebung in einen Container. Ein einfaches Dockerfile für einen Python-basierten TikTok-Scraper sieht so aus:

FROM python:3.11-slim
RUN apt-get update && apt-get install -y libnss3 libatk-bridge2.0-0 libdrm2 libxcomposite1 libxdamage1 libxrandr2 libgbm1 libasound2
RUN pip install TikTokApi playwright && python -m playwright install --with-deps chromium
WORKDIR /app
COPY . .
CMD ["python", "scrape.py"]

Das garantiert eine reproduzierbare Umgebung, unabhängig vom Host-OS. Läuft der Scraper in Docker, dann liegt jeder Fehler außerhalb von Docker an der Umgebung, nicht am Code.

Flowchart zur Fehlerbehebung:

  1. Läuft das mitgelieferte Beispiel des Repos durch? → Falls nein, Runtime-Version prüfen.
  2. Runtime-Version korrekt? → Browser- bzw. Playwright-Installation prüfen.
  3. Browser installiert? → Tokens und Cookies prüfen.
  4. Tokens und Cookies gültig? → Prüfen, ob TikTok die Session blockiert.
  5. Alles davon schlägt fehl? → Von einem Repo-Fehler ausgehen, nicht von einem eigenen. Tool wechseln.

Anti-Ban-Best Practices für TikTok-Scraping (ohne für Proxys zu zahlen)

In Foren ist die Klage über Bans und Erkennung Dauerthema: „they get your accounts banned, which is an added expense“ und „without using Apify or expensive paid APIs.“ Hier kommen kostenlose, praxistaugliche Kniffe, die kein kostenpflichtiges Proxy-Abo verlangen.

tiktok_scraper_antiban_playbook_v1_3f3a302f6b.png

PraxisSchwierigkeitKostenWirksamkeit
Zufällige Anfrageverzögerungen (2–8 s Jitter)EinfachKostenlosMittel
Session-/Cookie-RotationMittelKostenlosMittel
Nur öffentliche Seiten ohne Login scrapenEinfachKostenlosMittel
robots.txt + Rate-Limit-Header respektierenEinfachKostenlosBasis
Fingerprinting im Headless-Browser zufällig variieren (Playwright)MittelKostenlosHoch
TikToks mobile API-Endpunkte nutzen (geringere Erkennung)SchwerKostenlosHoch
Rotation von Residential ProxiesMittel20–100 $/MonatHoch

Kostenlose Techniken, die wirklich helfen

Zufällige Anfrageverzögerungen. Feuere deine Anfragen nicht in einer engen Schleife ab. Streu zwischen den Requests 2 bis 8 Sekunden zufälligen Jitter ein, die einfachste Maßnahme überhaupt:

import time, random
time.sleep(random.uniform(2, 8))

Session und Cookies wiederverwenden. Bau nicht für jede Anfrage eine brandneue Session auf. Nutze Cookies und Session-Status über einen Schwung von Anfragen hinweg weiter und rotiere erst danach. Genau deshalb fragen moderne Repos nach ms_token, statt zustandsloses Scraping zu versprechen.

Nur ausgeloggte öffentliche Seiten scrapen. TikTok-Api stellt klar, dass es keine nutzerauthentifizierten Routen unterstützt und nur mit Daten arbeitet, die ohne Login sichtbar sind. Scraping ohne Anmeldung fällt weniger auf als authentifizierte Sessions.

robots.txt respektieren. TikToks aktuelle robots.txt sperrt viele Agenten komplett aus und gibt fürs allgemeine Crawling nur eine begrenzte Auswahl öffentlicher Pfade frei. Ein Freifahrtschein für aggressives Scraping ist das nicht, aber wer sich daran hält, verringert das Risiko einer sofortigen IP-Sperre.

Fortgeschrittene Techniken für höhere Erfolgsraten

Browser-Fingerprint im Headless-Browser zufällig variieren. Mit Playwright änderst du pro Session Viewport-Größe, User-Agent-String, Zeitzone und Locale. So wirkt dein Scraper jedes Mal wie ein anderer echter Nutzer und nicht wie derselbe Bot mit frischer IP.

TikToks mobile API-Endpunkte ansteuern. Einige aus der Community berichten von geringerer Erkennung, wenn sie mobile Endpunkte statt des Web-Frontends nutzen. Das ist schwerer umzusetzen und dürftiger dokumentiert, für fortgeschrittene Nutzer aber ein gangbarer Weg.

Wann du doch einen Proxy brauchst (und günstige Optionen)

In großem Maßstab reichen kostenlose Techniken nicht mehr. Für TikTok-Scraping mit hohem Volumen ist die Rotation von Residential Proxies der Standard. Ich empfehle hier bewusst keinen konkreten Anbieter, aber die Grundregel lautet: Meide Datacenter-Proxys (TikTok markiert sie aggressiv) und setze auf Residential- oder Mobile-Proxy-Pools, die pro Anfrage rotieren.

Browserbasierte Tools wie Thunderbit umgehen die Proxy-Frage dagegen weitgehend, weil sie in deiner eigenen Browsersitzung laufen und einen echten Nutzer nachbilden. Unverwundbar macht sie das bei großem Volumen nicht, doch für typische Marketing- oder Research-Fälle (Dutzende bis Hunderte Seiten, keine Millionen) ist es der deutlich einfachere Weg.

Welche Daten bekommst du eigentlich? Echte Ausgabebeispiele von TikTok-Scrapern

Nutzer wollen vorab wissen, welche Daten am Ende wirklich herauskommen, und genau das lassen die meisten Leitfäden weg. Hier sind repräsentative Feldstrukturen, abgeleitet aus der jeweiligen Quellen-Dokumentation.

Profildaten

NutzernameAnzeigenameFollowerFolgtGesamt-LikesBioVerifiziertProfil-URL
@examplecreatorJane Doe1.240.00031248.700.000"Kochen + Comedy 🍳"tiktok.com/@examplecreator
@travelwithmarkMark S.890.00015022.100.000"Reise-Vlogger 🌍"tiktok.com/@travelwithmark
@fitnessmayaMaya L.2.100.0008891.300.000"Workouts & Wellness"tiktok.com/@fitnessmaya

Verfügbar über: GitHub-Scraper (TikTok-Api, Evil0ctal), Research API, Thunderbit (aus sichtbaren Profilseiten).

Videometadaten

Video-URLCaptionAufrufeLikesKommentareSharesMusikHashtagsVeröffentlichungsdatumDauer
tiktok.com/@ex/video/123"Bester Pasta-Trick überhaupt 🍝"4.200.000312.0008.40021.000"Italian Vibes – DJ Marco"#pasta #cooking #hack2026-03-150:42
tiktok.com/@ex/video/456"POV: Deine Katze bewertet dich"9.100.0001.100.00023.00055.000"Original Sound"#cat #pov #funny2026-04-010:18
tiktok.com/@ex/video/789"Morgenroutine, nach der niemand gefragt hat"1.800.00098.0003.2007.500"Chill Morning – LoFi"#routine #morning2026-04-101:02

Verfügbar über: GitHub-Scraper (TikTok-Api, Evil0ctal), Research API (Felder wie video_description, view_count, like_count, comment_count, share_count, music_id, hashtag_names, video_duration), Thunderbit (Videofelder).

Kommentardaten

Kommentierende PersonKommentartextLikesZeitstempelAntworten
@user_abc"Ich habe das ausprobiert, und es funktioniert wirklich 😂"1.2002026-03-16T08:12:00Z14
@chef_dan"Beim nächsten Mal Knoblauch dazu, vertrau mir"8902026-03-16T09:45:00Z7
@randomfan99"Genau für solche Inhalte bin ich hier"3402026-03-16T11:30:00Z2

Verfügbar über: GitHub-Scraper (TikTok-Api, Evil0ctal), Research API (Felder wie text, like_count, reply_count, create_time), Thunderbit (aus sichtbaren Kommentarbereichen).

Hashtag- und Suchdaten

HashtagTop-Video-URLGesamtaufrufeTrendend
#pastatiktok.com/@ex/video/1234.200.000Ja
#cookingtiktok.com/@chef/video/32111.000.000Ja
#hacktiktok.com/@tips/video/6542.900.000Nein

Verfügbar über: GitHub-Scraper (je nach Repo unterschiedlich), Thunderbit (Vorlage für den Hashtag-Scraper).

Eine Einschränkung: Kein einzelnes Repo garantiert dir alle Felder zu jeder Zeit. TikToks Response-Strukturen ändern sich, und selbst die Maintainer weisen darauf hin. Versteh diese Beispiele als repräsentativ, nicht als garantiert.

TikTok-Daten in 2 Klicks mit Thunderbit scrapen (Schritt für Schritt)

Genug repariert und geflickt? Hier kommt der No-Code-Weg, der Notausgang für alle, die sich an GitHub-Repos die Zähne ausgebissen haben.

  1. Installiere die Thunderbit Chrome-Erweiterung.
  2. Öffne die TikTok-Seite, die du scrapen willst – ein Profil, eine Suchergebnisseite, eine Hashtag-Seite oder ein einzelnes Video.
  3. Klicke auf „KI-Felder vorschlagen“. Thunderbits KI liest die Seite und schlägt Spalten vor: Nutzername, Follower, Videocaption, Likes, Hashtags und so weiter.
  4. Passe die Felder bei Bedarf an und klicke dann auf „Scrapen“. Die Daten landen in einer strukturierten Tabelle.
  5. Reichere die Daten per Scraping von Unterseiten an. Öffne jedes Video aus einer Profilauflistung und zieh zusätzliche Felder: vollständige Caption, Musikdetails, Kommentar- und Share-Anzahl.
  6. Exportiere nach Google Sheets, Excel, Airtable oder Notion – komplett kostenlos.

Keine Wartung, keine Installations-Triage, keine Anti-Ban-Konfiguration. Die KI stellt sich auf TikToks Layout-Änderungen von selbst ein.

TikTok-Daten mit Subpage-Scraping anreichern

Hast du eine Videoliste von einer Profil- oder Hashtag-Seite gescrapt, klickst du auf „Unterseiten scrapen“, damit die KI jede Videoseite besucht und weitere Felder holt. Besonders wertvoll ist das für Marketingteams, die Influencer-Datenbanken aufbauen oder Content-Audits der Konkurrenz fahren. Du erhältst eine vollständige Tabelle mit Engagement-Daten auf Videoebene, ohne dich manuell durch Dutzende Seiten klicken zu müssen.

Exportieren und mit deinen TikTok-Daten arbeiten

Thunderbit exportiert kostenlos nach Google Sheets, Excel, Airtable, Notion, CSV oder JSON. Typische Anwendungsfälle:

  • Daten in ein Tabellenblatt laden, um das Engagement auszuwerten.
  • An Airtable schicken für ein CRM-artiges Influencer-Tracking.
  • In Notion einbinden, damit das Team gemeinsam an der Content-Recherche arbeitet.

Wer genauer wissen will, wie Thunderbit Webdaten extrahiert, wirft einen Blick in unseren Einsteigerleitfaden zum Web-Scraping oder schaut sich die Tutorials auf dem Thunderbit YouTube-Kanal an.

Legal bleiben: TikTok-Nutzungsbedingungen und Scraping-Compliance

TikToks Rechtsposition ist unmissverständlich. Der Privacy-Blog von TikTok zum Thema Scraping hält fest, dass die Nutzungsbedingungen automatisierte Skripte verbieten, die Informationen sammeln oder auf unzulässige Weise mit dem Dienst interagieren, und nennt ausdrücklich das Umgehen von Zugriffsbeschränkungen. Auch die Community-Richtlinien untersagen täuschende Versuche, über automatisierte Skripte oder Web-Crawling an Informationen zu gelangen.

Konkret heißt das:

  • Beschränke dich auf öffentlich verfügbare Daten. Lass private oder login-geschützte Inhalte außen vor.
  • Halte Rate Limits ein. Überlaste TikToks Server nicht.
  • Beachte die Datenschutzgesetze. DSGVO und CCPA greifen weiterhin, sobald du personenbezogene Daten sammelst, speicherst oder auswertest.
  • Nutze die Research API, wenn du berechtigt bist. Aus Compliance-Sicht ist das der sicherste Weg.
  • Das ist keine Rechtsberatung. Für deinen konkreten Fall ziehst du am besten eine Fachperson hinzu.

Mehr zur rechtlichen Einordnung findest du in unserem Leitfaden zu den rechtlichen Auswirkungen von Web-Scraping.

Was tun, wenn dein TikTok-Scraper-GitHub-Repo stirbt

Die Kurzfassung:

  1. Arbeite immer die 60-Sekunden-Repo-Vitals-Checkliste ab, bevor du irgendeinen TikTok-Scraper von GitHub klonst. Die meisten Repos sind ohnehin schon tot.
  2. Kenne deine Optionen. Offizielle API, GitHub-Scraper und No-Code-Tools bedienen jeweils unterschiedliche Nutzer und Anwendungsfälle.
  3. Entscheidest du dich für GitHub, dann plane Zeit für Installationsprobleme und Anti-Ban-Konfiguration ein und rechne mit laufender Wartung.
  4. Wisse vorher, welche Daten wirklich herauskommen. Prüfe die Ausgabefelder, nicht bloß die Sternezahl.
  5. Bist du kein Entwickler (oder hast du genug von kaputten Repos), probier ein No-Code-Tool wie Thunderbit – zwei Klicks, strukturierte Daten, kostenloser Export.

Die TikTok-Daten, die du brauchst, sind erreichbar. Die einzige Frage ist, ob du deine Zeit lieber in die Wartung eines Scrapers steckst oder die Daten endlich nutzt. Wähle den Ansatz, der zu deinem Kenntnisstand und deinem Anwendungsfall passt – und lass dir von einem toten GitHub-Repo nicht noch einen Nachmittag rauben.

Thunderbit für TikTok-Daten testen

FAQs

Gibt es 2026 noch TikTok-Scraper auf GitHub, die funktionieren?

Ja, aber die Liste ist kurz. davidteather/TikTok-Api ist die glaubwürdigste Open-Source-Option, aktiv gepflegt bis April 2026. Evil0ctal/Douyin_TikTok_Download_API lebt ebenfalls noch, ist aber komplexer. Das sternreichste Repo, drawrowfly/tiktok-scraper, hat seit Mai 2023 kein Update mehr gesehen und ist praktisch tot. Geh immer zuerst die Repo-Vitals-Checkliste durch, bevor du Zeit in ein Repo investierst.

Ist das Scrapen von TikTok legal?

Die Nutzungsbedingungen von TikTok verbieten automatisiertes Scraping ausdrücklich. Öffentlich sichtbare Daten bewegen sich in einer rechtlichen Grauzone, die je nach Jurisdiktion variiert. Der sicherste Weg ist die offizielle Research API für berechtigte Forschende. Wer öffentliche Daten scrapen will, bleibt bei öffentlich zugänglichen Inhalten, hält Rate Limits ein und richtet sich nach DSGVO und CCPA. Das ist keine Rechtsberatung. Für deinen Fall wendest du dich an eine Fachperson.

Kann ich TikTok ohne Programmieren scrapen?

Ja. Browserbasierte KI-Tools wie Thunderbit extrahieren strukturierte TikTok-Daten (Profile, Videometadaten, Hashtags, Engagement-Metriken), ohne dass du eine Zeile Code schreibst. Auch die TikTok Research API verlangt von zugelassenen Antragstellern nur minimale Programmierung. Für Nicht-Entwickler sind No-Code-Tools der schnellste und zuverlässigste Weg.

Welche Daten kann ich aus einem TikTok-Scraper bekommen?

Üblich sind Profilinformationen (Nutzername, Follower, Bio, Verifizierungsstatus), Videometadaten (Caption, Aufrufe, Likes, Kommentare, Shares, Musik, Hashtags, Dauer, Veröffentlichungsdatum), Kommentare (Text, Likes, Zeitstempel, Antworten) sowie Hashtag- und Suchdaten (Top-Videos, Gesamtaufrufe, Trendstatus). Welche Felder genau dabei sind, hängt von Tool und Methode ab – siehe dazu den Abschnitt mit den Ausgabebeispielen oben.

Warum wird mein TikTok-Scraper ständig blockiert?

TikTok arbeitet mit mehreren Ebenen der Anti-Bot-Abwehr: Rate Limiting, Cookie- und Session-Gating, Browser-Fingerprinting, verhaltensbasierte Erkennung, verschlüsselte Request-Parameter und CAPTCHA-Abläufe. Häufige Auslöser für eine Sperre sind zu schnelle Anfragen, eine frische Session für jede einzelne Anfrage, ein Headless-Browser mit Standard-Fingerprints oder Datacenter-Proxys. Kostenlose und kostenpflichtige Gegenmaßnahmen findest du im Abschnitt mit den Anti-Ban-Best-Practices weiter oben.

Ke
Ke
CTO bei Thunderbit | Senior Data Scientist & ML-Experte Mit fast zehn Jahren Erfahrung in Machine Learning und Data Science ist Ke Shen Absolvent der Columbia University und ehemaliger Senior Data Scientist bei Walmart Labs. Mit tiefgreifender, von Fachkollegen anerkannter Expertise in Python, R, Java und Statistik teilt er praxiserprobte Einblicke dazu, wie sich komplexe KI-Algorithmen von der Theorie in eine produktionsreife Architektur überführen lassen.
Inhaltsverzeichnis

Eine Webseite einfach per Anfrage scrapen

Sag einfach in normalem Deutsch, was du brauchst. Oder noch besser: sag gar nichts.

Thunderbit ausprobieren kostenlos
Daten mit KI extrahieren
Daten einfach zu Google Sheets, Airtable oder Notion übertragen
Chrome Store Rating
PRODUCT HUNT#1 Product of the Week