Поиск по GitHub по запросу «tiktok scraper» выдает 339 репозиториев. Примерно 48% из них не обновлялись больше года, а как минимум 4 прямо помечены как архивные.
Если ты хоть раз клонировал популярный TikTok scraper-репозиторий, час бился с зависимостями, а в итоге не получил ни одного результата — ты не одинок. Самый популярный TikTok scraper на GitHub, drawrowfly/tiktok-scraper, до сих пор собрал больше 5 000 звезд. Но в его issue-трекере полно тем вроде #812: «is this amazing tool still working?» и #824: «Is this still working?» — и в обеих жалуются на нулевой результат. В Thunderbit я уже несколько месяцев отслеживаю состояние TikTok scraping-репозиториев, и картина предельно ясна: такие инструменты очень быстро ломаются, а чинят их далеко не все. Эта статья — практическое руководство по выживанию, которого мне самому не хватало, когда я только начинал оценивать такие репозитории. Разберем, что еще живо, что уже мертво, чем это заменить и как перестать тратить часы на код, который перестал работать еще до того, как ты его нашел.
Почему большинство TikTok scraper-репозиториев на GitHub ломаются (и продолжают ломаться)
TikTok — не самый простой объект для парсинга. Его веб-интерфейс постоянно меняется. В отличие от статичной страницы товара в интернет-магазине или каталога, TikTok регулярно переключает эндпоинты, обновляет антибот-защиту, меняет способ отрисовки страниц и вводит новые требования к сессии и токенам — иногда уже через несколько недель после очередного изменения.
Поддерживающие open-source-проекты — это добровольцы. Когда TikTok выпускает обновление, которое ломает путь запроса у scraper-а, репозиторий может оставаться сломанным днями, неделями или вообще навсегда. Это не упрек мейнтейнерам — просто структурный конфликт между быстро меняющейся, хорошо финансируемой платформой и разработчиками без оплаты, у которых есть основная работа.
Даже лучшие TikTok scraper-репозитории живут в режиме бесконечного «починили — снова сломалось». Если ты все же хочешь ими пользоваться, тебе нужна стратегия оценки, отладки и запасной вариант на случай неудачи.
Антибот-защита TikTok: с чем вы столкнетесь
- Ограничение частоты запросов. В официальной документации TikTok для разработчиков прямо указаны квоты запросов даже для одобренных интеграций. Неофициальные scraper-ы упираются в эти лимиты куда быстрее.
- Привязка к cookies и сессии. Современные репозитории вроде davidteather/TikTok-Api требуют
ms_token; старые проекты вроде drawrowfly/tiktok-scraper используют в примерахtt_webid_v2; Evil0ctal/Douyin_TikTok_Download_API описываетmsToken,ttwid,X-BogusиA_Bogus. TikTok проверяет, похоже ли твое обращение на настоящую пользовательскую сессию. - Браузерный fingerprinting. Рекомендации ScrapFly по антибот-защите объясняют, почему сайты сравнивают заголовки, cookies, TLS-отпечатки и JavaScript-доступные признаки браузера с реальным трафиком пользователей. Их разбор browser fingerprinting охватывает Canvas, WebGL, WebRTC, шрифты и runtime-сигналы. Fingerprinting — это как проверка паспорта твоего браузера: если браузер, cookies, тайминг и сетевой отпечаток не совпадают, запрос выглядит фальшивым еще до того, как вернется контент.
- Поведенческое обнаружение. В темах Reddit про TikTok scraping часто пишут, что свежие Playwright-сессии вызывают CAPTCHA. Сообщения сообщества из 2025–2026 все чаще описывают детект, который смотрит не только на повторное использование IP, но и на тайминг действий и качество взаимодействия.
- Зашифрованные/подписанные параметры запросов. Evil0ctal документирует
X-BogusиA_Bogus; старые гисты сообщества крутятся вокруг подписи URL и генерации токенов. TikTok все чаще ожидает, что запрос придет с теми же «метками», что и трафик из его собственного браузера или приложения. - CAPTCHA и проверки. Само существование репозиториев-решателей TikTok CAPTCHA и тем Reddit о puzzle challenge подтверждает, что CAPTCHA по-прежнему остается частью антибот-механики.
Почему open-source-мейнтейнеры не успевают
Сценарий всегда один и тот же. Разработчик делает TikTok scraper. Он становится популярным на GitHub. TikTok закрывает лазейку. Мейнтейнер либо чинит проект, либо уходит.
Два репозитория очень хорошо иллюстрируют этот сценарий:
- drawrowfly/tiktok-scraper до сих пор имеет 5 052 звезды и 889 форков, но последний push был 19 мая 2023 года. Это самый популярный репозиторий на GitHub, если искать точную фразу TikTok scraper, но сейчас он больше похож на исторический артефакт: когда-то очень заметный, когда-то очень надежный, но без текущей поддержки.
- davidteather/TikTok-Api показывает 6 301 звезду, 1 177 форков и последний push 1 апреля 2026 года. В его релизах видно активную поддержку в апреле 2025, июле 2025, октябре 2025 и апреле 2026 — включая исправления для парсинга видео пользователей и новые настройки proxy/session. Но даже этот более живой проект прямо предупреждает, что TikTok блокирует запросы и что пользователям могут понадобиться proxies, Playwright и собственная логика сессий.
Суть проста:
- устаревший TikTok scraper-репозиторий, скорее всего, мертв;
- активный TikTok scraper-репозиторий, скорее всего, все еще хрупкий;
- реальная разница только в том, есть ли кто-то, кто может починить сломавшийся код в этом месяце.
Чек-лист жизнеспособности репозитория за 60 секунд: как оценить любой TikTok scraper на GitHub
Прежде чем что-либо клонировать, пройдись по этому чек-листу. Он занимает меньше минуты и экономит часы нервов.
| Сигнал | 🟢 Здорово | 🟡 Рискованно | 🔴 Мертвое |
|---|---|---|---|
| Последний заметный push | Менее 3 месяцев назад | 3–12 месяцев назад | 12+ месяцев назад |
| Количество открытых issue | Низкое, свежие вопросы получают ответы | Растущая куча, но мейнтейнер иногда отвечает | Много необработанных жалоб на «сломано/заблокировано/не работает» |
| Недавние жалобы пользователей | В основном вопросы по настройке | Смешанные вопросы: настройка + поломки | Повторяющиеся «zero output», «403», «still working?» |
| Текущая модель auth/session | Описан путь через session/cookie | Токены нужны, но все документировано | Завязка на старые web-endpoints без актуальной auth-инструкции |
| Сложность установки | Воспроизводимая, протестированная установка | Есть ручные шаги | Старые зависимости, нет современных заметок по установке |
| CI/тесты | Тесты есть и актуальны | Тесты есть, но покрытие неясно | Нет тестов или устаревшие Actions |
| Соответствие задаче | Подходит именно под ваш сценарий | Закрывает только часть сценария | Решает вообще другую проблему |
Как проверить каждый сигнал меньше чем за 60 секунд
- Дата последнего push: посмотри на шапку репозитория на GitHub. Если там написано «last pushed 2 years ago», дальше можно не тратить время.
- Открытые issue: открой вкладку Issues. Быстро просмотри последние заголовки. Ищи
not working,403,blocked,captchaилиzero output. - Жалобы пользователей: если топ-5 открытых issue — это вариации на тему «это больше не работает», ответ уже найден.
- Модель auth/session: открой README. Ищи актуальные подсказки вроде
ms_token, настройки Playwright или комментарии про proxy. Если в README упомянуты эндпоинты 2023 года — иди дальше. - Сложность установки: проверь наличие requirements-файла, поддержки Docker или понятных инструкций. Если в README написано только
npm install, а последняя протестированная версия Node — 14, жди проблем. - CI/тесты: открой вкладку Actions. Если тесты падают или их нет, любая поломка — это гадание.
- Соответствие данных: действительно ли в репозитории описаны нужные тебе типы данных (профили, метаданные видео, комментарии, хэштеги)? Многие проекты умеют только скачивать видео, но не извлекать структурированные данные.
Красные флаги, после которых нужно сразу уходить
- Репозиторий архивирован.
- В README написано «no longer maintained».
- Последний commit ссылается на версию TikTok API двухлетней давности или старше.
- Issues завалены сообщениями «doesn't work», а мейнтейнер не отвечает месяцами.
- У репозитория много звезд, но почти нет свежих форков или pull request-ов.
Совет: ищи во вкладке Issues запросы is:issue is:open "not working" или is:issue is:open "403". Если результатов много и они свежие, репозиторий, скорее всего, сломан.
Популярные TikTok scraper-репозитории GitHub: честная проверка статуса (2026)

Ниже — тот же чек-лист жизнеспособности, примененный к репозиториям, которые ты реально найдешь по запросу «tiktok scraper» на GitHub:
| Репозиторий | Последний push | Звезды | Открытые issue | Вердикт | Примечание |
|---|---|---|---|---|---|
| drawrowfly/tiktok-scraper | 2023-05-19 | 5,052 | 58 | 🔴 Мертв / только как справка | До сих пор известный, но для продакшена в 2026 уже слишком устарел |
| davidteather/TikTok-Api | 2026-04-01 | 6,301 | 134 | 🟡 Жив, но требует много поддержки | Самый сильный OSS-вариант; ожидает Playwright, токены и часто proxies |
| scrapfly/scrapfly-scrapers/tiktok-scraper | 2026-04-21 | 938 (parent) | ~0 (monorepo) | 🟡 Жив, но это не чистый OSS | Актуален и полезен, но требует ключ ScrapFly API |
| Evil0ctal/Douyin_TikTok_Download_API | 2025-10-12 | 17,397 | 135 | 🟡 Жив, широкий, сложный | Проект с большим количеством функций; ближе к платформе для продвинутых пользователей |
| naseif/tiktok-scraper | 2024-07-26 | 107 | 13 | 🟡 Рискованно | Небольшой репозиторий с открытыми жалобами на user info и hashtag flows |
| loewehancara1rmyv/Tiktok-scraper | 2026-01-12 | 4 | 0 | 🔴 Слишком новый, чтобы доверять | Showcase-репозиторий, а не проверенный сообществом проект |
drawrowfly/tiktok-scraper
Много лет этот TypeScript scraper/downloader был ответом по умолчанию на запрос «tiktok scraper github» — он работал с user, trend, hashtag и music feeds. В 2026 году его лучше воспринимать как архивную документацию. Последний push был в мае 2023, а в очереди issues до сих пор лежат нерешенные сообщения «still working?» и «zero output» за 2023–2025 годы. Если ты читаешь эту статью потому, что клонировал этот репозиторий и ничего не получил, ты не один такой.
davidteather/TikTok-Api
Самый убедительный open-source TikTok data wrapper, который все еще жив в 2026 году. Он активен, имеет свежие релизы и прямо документирует настройку Playwright, асинхронное использование, работу с токенами, поддержку proxy и восстановление сессий. Но это не инструмент уровня «склонировал и поехал». В README прямо сказано, что EmptyResponseException обычно означает, что TikTok блокирует запрос, а история обсуждений показывает постоянные проблемы с ms_token, поломанным извлечением комментариев, KeyError: 'ItemModule' и сбоями на уровне отдельных эндпоинтов. Вердикт: живой, полезный, но только для разработчиков и с высокой нагрузкой на поддержку.
Другие заметные репозитории
- scrapfly/scrapfly-scrapers/tiktok-scraper: актуален и технически релевантен, но в README требуется
SCRAPFLY_KEY. Это пример кода для управляемой scraping-платформы, а не бесплатный самостоятельный инструмент. - Evil0ctal/Douyin_TikTok_Download_API: охватывает TikTok и Douyin, документирует логику подписи (
X-Bogus,A_Bogus,msToken) и поддерживает комментарии, followers, playlists и многое другое. Технически сложный и все сильнее завязан на платные API-референсы. В issue-трекере в 2026 году продолжают появляться баг-репорты по ссылкам на видео и эндпоинтам информации о пользователях. Живой и богатый функциями, но сложный. - naseif/tiktok-scraper: небольшой, с открытыми жалобами. Рискован для продакшена.
- loewehancara1rmyv/Tiktok-scraper: 4 звезды, 0 issues, слишком новый, чтобы доверять. Medium-статья, которая его продвигала, делала это без критической оценки.
TikTok Official API vs. GitHub scraper-ы vs. no-code инструменты: схема выбора

Большинство обзорных статей либо игнорируют официальный путь доступа TikTok, либо сразу прыгают от «используйте GitHub» к «купите наш сервис». Ниже — нейтральное сравнение всех трех вариантов:
| Фактор | TikTok Research API | GitHub scraper-ы | No-code инструменты (например, Thunderbit) |
|---|---|---|---|
| Порог доступа | Нужна академическая или бизнес-заявка; ~4 недели на одобрение | git clone + настройка | Установка расширения для браузера |
| Объем данных | Только одобренные эндпоинты (аккаунты, видео, комментарии, магазины) | Широкий (профили, видео, комментарии, хэштеги, магазины) | Видимые данные страницы (профили, видео, engagement, хэштеги) |
| Нагрузка на поддержку | Низкая (официально и стабильно) | Высокая (репозитории ломаются после обновлений TikTok) | Нет (AI адаптируется к изменениям верстки) |
| Риск бана | Нет (авторизованный доступ) | Высокий | Низкий (работа через браузер, имитация реального пользователя) |
| Стоимость | Бесплатно, если одобрят | Бесплатно, но отнимает много времени | Есть бесплатный тариф; тарифы по кредитам от $15/мес |
| Нужен код | Да (Python/R) | Да (Python/Node.js) | Нет |
| Лучше всего подходит для | Исследователей, академических команд, одобренных организаций | Разработчиков, готовых поддерживать код | Маркетологов, sales-команд, ops и не-разработчиков |
Когда TikTok Research API — лучший выбор
Research API от TikTok — самый чистый официальный путь, если ты соответствуешь условиям. Допущенные исследователи в США, Европе и Бразилии могут подать заявку на доступ к публичному контенту и данным аккаунтов. Доступные категории данных включают аккаунты, followers/following, понравившиеся видео, закрепленные видео, репосты, контент, комментарии и магазины.
В codebook доступны поля вроде video_description, view_count, like_count, comment_count, share_count, а на уровне комментариев — text, reply_count и create_time.
Минус в том, что доступ ограничен академическими учреждениями, подходящими nonprofit/independent-исследователями в определенных регионах, а также проверенными исследователями в рамках EU DSA. Если ты growth-команда или агентство и тебе нужны быстрые операционные данные, это не твой путь.
У TikTok есть и Commercial Content API для рекламных и advertiser-данных — это полезно для исследований прозрачности, но не для общего scraping-а.
Когда GitHub scraper все еще имеет смысл
GitHub scraper-ы по-прежнему полезны разработчикам, которым нужен неофициальный доступ к публичным данным за пределами одобряемого окна официального API, и которые готовы поддерживать стек сами. Это подходит для задач вроде парсинга видимых сеток профилей, хэштегов, комментариев, плейлистов или метаданных видео в собственном pipeline, где нормально форкать репозиторий и дорабатывать его под себя.
Честная оговорка: это не разовая настройка. Даже самый надежный репозиторий 2026 года, davidteather/TikTok-Api, все равно предупреждает, что тебе могут понадобиться Playwright, cookies/tokens, proxies и собственные фабрики страниц/сессий.
Когда имеет смысл no-code инструмент вроде Thunderbit
Собирайте данные TikTok с помощью AI Get Started Free
Ты не разработчик? Или разработчик, которому надоел бесконечный цикл «починить — снова сломалось»? Браузерный AI-инструмент — самый быстрый путь к структурированным данным TikTok.
Мы создали Thunderbit как AI web scraper в формате расширения для Chrome. В TikTok он читает любую видимую страницу — профиль, видео, хэштег или результаты поиска — предлагает поля через «AI Suggest Fields», а затем позволяет нажать «Scrape» и получить структурированные данные. На странице TikTok scraper-инструмента описаны такие поля, как дата публикации, длительность видео, лайки, репосты, сохранения, комментарии, просмотры и хэштеги. Шаблон image scraper показывает, как собирать превью постов, URL, подписи, аккаунты авторов и сигналы вовлеченности со страниц профилей. Шаблон hashtag scraper охватывает URL видео, имя пользователя автора, описание, время публикации, просмотры, лайки, комментарии, репосты, звук/аудио и URL обложки.
Scraping подстраниц позволяет открывать каждую страницу видео из списка профиля и дополнять таблицу метриками вовлеченности, подписями и хэштегами — это особенно полезно маркетологам, которые строят базы инфлюенсеров или проводят аудит контента конкурентов.
Никакой поддержки, никакой возни с установкой, никакой настройки anti-ban. AI автоматически адаптируется к изменениям верстки. Экспорт бесплатный в Google Sheets, Excel, Airtable, Notion, CSV или JSON.
Если ты уже потерял часы на сломанных GitHub-репозиториях, это вполне рабочая альтернатива — а не навязанный рекламный питч.
Попробовать Thunderbit для TikTok Scraping
Разбор установки: как исправить 5 самых частых ошибок при настройке TikTok scraper-репозитория на GitHub
Проблемы с установкой — третья по частоте боль в TikTok scraping-форумах, и ни один крупный гайд по-настоящему не помогает их решить. Вот что обычно идет не так.
Конфликты версий Node.js
Проблема: многие старые TikTok scraper-репозитории, особенно drawrowfly/tiktok-scraper, писались под Node.js 14–16. Если у тебя Node 20+, npm install может молча падать или собирать несовместимые бинарники.
Решение: используй nvm (Node Version Manager), чтобы поставить и активировать нужную версию:
nvm install 16
nvm use 16
npm install
Если в репозитории не указана версия Node, проверь поле engines в package.json или конфигурацию CI.
Проблемы с Python-зависимостями и настройкой Playwright
Проблема: davidteather/TikTok-Api требует Python 3.9+ и Playwright с определенными browser binaries. Пользователи получают ошибки вроде «browser not found» или конфликты зависимостей.
Решение: всегда используй виртуальное окружение, а затем отдельно установи браузеры Playwright:
python -m venv .venv
source .venv/bin/activate # На Windows: .venv\Scripts\activate
pip install TikTokApi
python -m playwright install
Если playwright install не проходит, проверь системный пакетный менеджер на недостающие зависимости, например libnss3 в Ubuntu.
Ошибки прав доступа в Linux/Ubuntu
Проблема: запуск sudo pip install ломает системное окружение Python и запускает цепочку конфликтов зависимостей.
Решение: никогда не используй sudo pip install. Сначала всегда создавай виртуальное окружение:
python3 -m venv .venv
source .venv/bin/activate
pip install -r requirements.txt
Так зависимости scraper-а изолируются от системного Python.
Проблемы с путями и кодировкой в Windows
Проблема: Windows CMD часто дает сбои из-за кодировки и ограничений длины пути, что ломает установку scraper-ов, особенно когда Playwright скачивает browser binaries в глубоко вложенные каталоги.
Решение: используй WSL (Windows Subsystem for Linux) или Git Bash вместо CMD. WSL дает полноценную Linux-среду внутри Windows:
wsl --install
# Затем открой терминал WSL и продолжай по Linux-инструкции
Короткий путь через Docker: полностью обойти проблемы зависимостей
Проблема: все перечисленное выше.
Решение: если тебе комфортно работать с Docker, упакуй среду scraper-а в контейнер. Базовый Dockerfile для Python-ориентированного TikTok scraper выглядит так:
FROM python:3.11-slim
RUN apt-get update && apt-get install -y libnss3 libatk-bridge2.0-0 libdrm2 libxcomposite1 libxdamage1 libxrandr2 libgbm1 libasound2
RUN pip install TikTokApi playwright && python -m playwright install --with-deps chromium
WORKDIR /app
COPY . .
CMD ["python", "scrape.py"]
Такой подход гарантирует воспроизводимую среду независимо от ОС на хосте. Если scraper работает в Docker, а вне Docker — нет, проблема в окружении, а не в коде.
Схема отладки:
- Репозиторий сам по себе запускает пример? → Если нет, проверь версию runtime.
- Версия runtime правильная? → Проверь установку браузера/Playwright.
- Браузер установлен? → Проверь токены/cookies.
- Токены/cookies валидны? → Проверь, не блокирует ли TikTok сессию.
- Все равно не работает? → Считай, что сломался репозиторий, а не ты. Меняй инструмент.
Лучшие практики anti-ban для TikTok scraping (без оплаты proxy)
Пользователи на форумах постоянно жалуются на баны и детект: «они банят ваши аккаунты, а это дополнительные расходы» и «без Apify или дорогих платных API». Ниже — бесплатные и практичные обходы, не требующие платной подписки на proxies.

| Практика | Сложность | Стоимость | Эффективность |
|---|---|---|---|
| Случайные задержки между запросами (jitter 2–8 сек.) | Легко | Бесплатно | Средняя |
| Ротация сессий/cookies | Средне | Бесплатно | Средняя |
| Сбор только публичных страниц без входа в аккаунт | Легко | Бесплатно | Средняя |
Соблюдение robots.txt + заголовков rate-limit | Легко | Бесплатно | Базовая |
| Рандомизация browser fingerprint в headless-браузере (Playwright) | Средне | Бесплатно | Высокая |
| Использование mobile API endpoints TikTok (ниже детект) | Сложно | Бесплатно | Высокая |
| Ротация residential proxies | Средне | $20–100/мес. | Высокая |
Бесплатные методы, которые действительно помогают
Случайные задержки между запросами. Не отправляй запросы в плотном цикле. Добавляй случайный jitter 2–8 секунд между обращениями. Это самое простое, что можно сделать:
import time, random
time.sleep(random.uniform(2, 8))
Повторное использование сессии и cookies. Не создавай новую сессию для каждого запроса. Используй одни и те же cookies и состояние сессии для пачки запросов, а потом меняй их. Именно поэтому современные репозитории просят ms_token, а не обещают stateless scraping.
Сбор только публичных страниц без входа. TikTok-Api прямо пишет, что не поддерживает user-authenticated routes и работает только с данными, видимыми без входа. Скрейпинг без авторизации обычно заметнее меньше триггерит детект, чем работа через авторизованную сессию.
Соблюдай robots.txt. В текущем robots.txt TikTok многие агенты блокируются полностью, а для общего краулинга разрешен лишь ограниченный набор публичных путей. Это не разрешение на агрессивный scraping, но соблюдение файла снижает шанс моментальной блокировки IP.
Более продвинутые методы для лучшего результата
Рандомизация browser fingerprint в headless-браузере. Если ты используешь Playwright, меняй размер viewport, user-agent, часовой пояс и locale для каждой сессии. Так scraper будет выглядеть как новый реальный пользователь, а не один и тот же бот с новым IP.
Использование mobile API endpoints TikTok. Некоторые участники сообщества отмечают более низкий уровень детекта при работе с mobile-подобными endpoint-ами вместо веб-фронтенда. Это сложнее реализовать и хуже документировано, но для продвинутых пользователей это реальный прием.
Когда proxy все-таки нужен, и какие варианты доступны
На больших объемах бесплатных методов уже недостаточно. Ротация residential proxies — стандартный подход для массового TikTok scraping. Я не буду рекомендовать конкретный платный proxy-сервис, но общий совет такой: избегай datacenter proxies (TikTok их агрессивно помечает) и ищи residential или mobile proxy-пулы с ротацией на каждый запрос.
В качестве альтернативы браузерные инструменты вроде Thunderbit обходят вопрос proxy, потому что работают в твоей собственной браузерной сессии и имитируют настоящего пользователя. Это не делает их неуязвимыми при больших объемах, но для типичных маркетинговых или исследовательских задач — десятки или сотни страниц, а не миллионы — это гораздо более простой путь.
Какие данные вы реально получите? Примеры вывода из TikTok scraper-ов
Пользователям важно заранее понимать, какие данные они получат, прежде чем выбирать инструмент, — но большинство гайдов этот вопрос просто пропускает. Ниже — типовые структуры полей, основанные на исходной документации.
Данные профиля
| Username | Display Name | Followers | Following | Total Likes | Bio | Verified | Profile URL |
|---|---|---|---|---|---|---|---|
| @examplecreator | Jane Doe | 1,240,000 | 312 | 48,700,000 | "Cooking + comedy 🍳" | ✅ | tiktok.com/@examplecreator |
| @travelwithmark | Mark S. | 890,000 | 150 | 22,100,000 | "Travel vlogger 🌍" | ❌ | tiktok.com/@travelwithmark |
| @fitnessmaya | Maya L. | 2,100,000 | 88 | 91,300,000 | "Workouts & wellness" | ✅ | tiktok.com/@fitnessmaya |
Доступно в: GitHub scraper-ах (TikTok-Api, Evil0ctal), Research API, Thunderbit (из видимых страниц профиля).
Метаданные видео
| Video URL | Caption | Views | Likes | Comments | Shares | Music | Hashtags | Post Date | Duration |
|---|---|---|---|---|---|---|---|---|---|
| tiktok.com/@ex/video/123 | "Best pasta trick ever 🍝" | 4,200,000 | 312,000 | 8,400 | 21,000 | "Italian Vibes – DJ Marco" | #pasta #cooking #hack | 2026-03-15 | 0:42 |
| tiktok.com/@ex/video/456 | "POV: your cat judges you" | 9,100,000 | 1,100,000 | 23,000 | 55,000 | "Original Sound" | #cat #pov #funny | 2026-04-01 | 0:18 |
| tiktok.com/@ex/video/789 | "Morning routine nobody asked for" | 1,800,000 | 98,000 | 3,200 | 7,500 | "Chill Morning – LoFi" | #routine #morning | 2026-04-10 | 1:02 |
Доступно в: GitHub scraper-ах (TikTok-Api, Evil0ctal), Research API (поля включают video_description, view_count, like_count, comment_count, share_count, music_id, hashtag_names, video_duration), Thunderbit (поля уровня видео).
Данные комментариев
| Commenter | Comment Text | Likes | Timestamp | Replies |
|---|---|---|---|---|
| @user_abc | "I tried this and it actually works 😂" | 1,200 | 2026-03-16T08:12:00Z | 14 |
| @chef_dan | "Add garlic next time, trust me" | 890 | 2026-03-16T09:45:00Z | 7 |
| @randomfan99 | "This is the content I'm here for" | 340 | 2026-03-16T11:30:00Z | 2 |
Доступно в: GitHub scraper-ах (TikTok-Api, Evil0ctal), Research API (поля включают text, like_count, reply_count, create_time), Thunderbit (из видимых блоков комментариев).
Данные по хэштегам и поиску
| Hashtag | Top Video URL | Aggregate Views | Trending |
|---|---|---|---|
| #pasta | tiktok.com/@ex/video/123 | 4,200,000 | Yes |
| #cooking | tiktok.com/@chef/video/321 | 11,000,000 | Yes |
| #hack | tiktok.com/@tips/video/654 | 2,900,000 | No |
Доступно в: GitHub scraper-ах (зависит от репозитория), Thunderbit (шаблон hashtag scraper).
Важно: ни один репозиторий не гарантирует все поля всегда. Структуры ответов TikTok меняются, и даже мейнтейнеры об этом предупреждают. Считай эти примеры ориентиром, а не гарантией.
Как собрать данные TikTok в 2 клика с Thunderbit (пошагово)
Устал от цикла «сломалось — починил — снова сломалось»? Вот no-code путь — запасной выход для всех, кто уже пытался и не смог с GitHub-репозиториями.
- Установи Thunderbit Chrome Extension.
- Открой страницу TikTok, которую хочешь собрать — профиль, результаты поиска, страницу хэштега или отдельное видео.
- Нажми «AI Suggest Fields». AI Thunderbit прочитает страницу и предложит поля: username, followers, caption видео, likes, hashtags и т. д.
- При необходимости скорректируй поля, затем нажми «Scrape». Данные появятся в структурированной таблице.
- Используй Scrape Subpages для обогащения данных. Открой каждое видео из списка профиля и подтяни дополнительные поля: полную подпись, детали музыки, число комментариев, число репостов.
- Экспортируй в Google Sheets, Excel, Airtable или Notion — совершенно бесплатно.
Никакой поддержки, никакой возни с установкой, никакой настройки anti-ban. AI автоматически адаптируется к изменениям интерфейса TikTok.
Обогащение данных TikTok через Scrape Subpages
После того как ты собрал список видео со страницы профиля или хэштега, нажми «Scrape Subpages», чтобы AI посетил каждую страницу видео и забрал дополнительные поля. Это особенно полезно маркетологам, которые строят базы инфлюенсеров или проводят аудит контента конкурентов: ты получаешь полную таблицу метрик уровня видео без ручного кликанья по десяткам страниц.
Экспорт и использование данных TikTok
Thunderbit экспортирует данные в Google Sheets, Excel, Airtable, Notion, CSV или JSON — и все это бесплатно. Типичные сценарии использования:
- загрузить данные в таблицу для анализа вовлеченности;
- отправить в Airtable для CRM-подобного трекера инфлюенсеров;
- перенести в Notion для командной работы над исследованием контента.
Чтобы глубже понять, как Thunderbit работает с извлечением веб-данных, посмотри наше руководство для начинающих по web scraping или видео на Thunderbit YouTube Channel.
Соблюдаем закон: TikTok Terms of Service и соответствие требованиям при scraping-е
Правовая позиция TikTok ясна. В блоге о приватности и scraping-е платформа пишет, что ее Terms of Service запрещают автоматизированные скрипты, которые собирают информацию или взаимодействуют с сервисом неавторизованным способом, и отдельно упоминает обход ограничений доступа. Community Guidelines TikTok тоже запрещают обманные попытки получить информацию с помощью автоматизированных скриптов или web crawling.
Практические рекомендации:
- Оставайся в рамках публично доступных данных. Не парси приватный контент и материалы за логином.
- Соблюдай лимиты запросов. Не перегружай серверы TikTok.
- Следуй законам о защите данных. GDPR и CCPA по-прежнему применимы, если ты собираешь, хранишь или анализируешь персональные данные.
- Используй Research API, если ты подходишь под критерии. С точки зрения комплаенса это самый безопасный путь.
- Это не юридическая консультация. По твоей конкретной ситуации лучше обратиться к специалисту.
Подробнее о правовых аспектах см. в нашем гайде о юридических последствиях web scraping.
Что делать, если ваш TikTok scraper-репозиторий на GitHub умер
Коротко:
- Всегда проходи 60-секундный чек-лист жизнеспособности репозитория перед тем, как клонировать любой TikTok scraper с GitHub. Большинство репозиториев уже мертвы.
- Пойми свои варианты. Официальный API, GitHub scraper-ы и no-code инструменты решают разные задачи и подходят разным пользователям.
- Если идешь через GitHub, закладывай время на отладку установки и настройку anti-ban. Поддержка потребуется постоянно.
- Заранее выясни, какие данные ты реально получишь, прежде чем выбирать инструмент. Смотри на поля вывода, а не только на число звезд.
- Если ты не разработчик (или тебе надоели сломанные репозитории), попробуй no-code-инструмент вроде Thunderbit — два клика, структурированные данные, бесплатный экспорт.
Данные TikTok доступны. Вопрос только в том, хочешь ли ты тратить время на поддержание scraper-а или сразу использовать данные. Выбирай подход под свой уровень и задачу и не позволяй мертвому GitHub-репозиторию украсть еще один день.
Попробовать Thunderbit для данных TikTok
FAQ
Есть ли в GitHub TikTok scraper-ы, которые все еще работают в 2026 году?
Да, но список короткий. davidteather/TikTok-Api — самый надежный open-source-вариант с активной поддержкой по состоянию на апрель 2026 года. Evil0ctal/Douyin_TikTok_Download_API тоже жив, но намного сложнее. Самый популярный репозиторий, drawrowfly/tiktok-scraper, не обновлялся с мая 2023 года и фактически мертв. Всегда проходи чек-лист жизнеспособности репозитория, прежде чем вкладывать в него время.
Законно ли парсить TikTok?
Terms of Service TikTok прямо запрещают автоматизированный scraping. Публично доступные данные находятся в юридической серой зоне, и она зависит от юрисдикции. Самый безопасный путь — официальный Research API для подходящих исследователей. Если ты парсишь публичные данные, ограничивайся общедоступным контентом, соблюдай лимиты запросов и требования GDPR/CCPA. Это не юридическая консультация — в твоей ситуации лучше поговорить со специалистом.
Можно ли парсить TikTok без кода?
Да. Браузерные AI-инструменты вроде Thunderbit позволяют извлекать структурированные данные TikTok — профили, метаданные видео, хэштеги, метрики вовлеченности — без написания кода. TikTok Research API также требует минимум кода для одобренных заявителей. Для не-разработчиков no-code инструменты — самый быстрый и надежный вариант.
Какие данные можно получить из TikTok scraper-а?
Обычно доступны данные профиля (username, followers, bio, verified status), метаданные видео (caption, views, likes, comments, shares, music, hashtags, duration, date публикации), комментарии (text, likes, timestamp, replies) и данные по хэштегам/поиску (top videos, aggregate views, trending status). Точный набор зависит от инструмента и метода — подробности смотри в разделе с примерами вывода выше.
Почему мой TikTok scraper постоянно блокируется?
TikTok использует несколько уровней антибот-защиты: лимиты запросов, привязку к cookies/session, browser fingerprinting, поведенческое обнаружение, зашифрованные параметры запросов и CAPTCHA. Типичные причины блокировки — слишком частые запросы, новая чистая сессия для каждого запроса, headless-браузер со стандартным fingerprint или использование datacenter proxies. См. раздел с best practices по anti-ban выше — там есть бесплатные и платные обходные варианты.


