A maioria dos TikTok Scrapers no GitHub está morta — veja o que fazer

Última atualização em July 2, 2026
A maioria dos TikTok Scrapers no GitHub está morta — veja o que fazer

Uma busca no GitHub por "tiktok scraper" retorna 339 repositórios. Cerca de 48% deles não recebem atualizações há mais de um ano, e pelo menos 4 estão explicitamente arquivados.

Se você já clonou um repositório popular de TikTok scraper, passou uma hora brigando com dependências e, no fim, recebeu zero resultado — você não está sozinho. O TikTok scraper mais estrelado no GitHub, drawrowfly/tiktok-scraper, ainda soma mais de 5.000 estrelas. Mas o rastreador de issues dele está cheio de tópicos como #812: "is this amazing tool still working?" e #824: "Is this still working?" — ambos relatando saída vazia. Na Thunderbit, venho acompanhando há meses o estado dos repositórios de scraping do TikTok, e o padrão é claro: essas ferramentas quebram rápido, e a maioria nunca é corrigida. Este artigo é o guia prático de sobrevivência que eu gostaria de ter encontrado quando comecei a avaliar esses repositórios. Vamos ver o que ainda funciona, o que já morreu, o que fazer no lugar e como parar de perder horas com código que deixou de funcionar antes mesmo de você encontrá-lo.

Por que a maioria dos TikTok Scrapers no GitHub quebra — e continua quebrando

O TikTok não é um alvo de scraping comum. A superfície web muda o tempo todo. Diferente de uma página estática de produto em e-commerce ou de uma listagem de diretório, o TikTok altera endpoints, atualiza a proteção anti-bot, muda o modo de renderização da página e introduz novos requisitos de sessão/token — às vezes em poucas semanas após a última mudança.

Os mantenedores de projetos open source são voluntários. Quando o TikTok lança uma atualização que quebra o caminho da requisição do scraper, o repositório pode ficar fora do ar por dias, semanas ou para sempre. Isso não é uma crítica aos mantenedores — é um descompasso estrutural entre uma plataforma que muda rápido e tem muito dinheiro, e desenvolvedores sem remuneração que ainda têm seus empregos.

Até mesmo os melhores repositórios de TikTok scraper vivem num ciclo de remendo e correção. Se você for usar um, precisa de uma estratégia para avaliar, depurar e ter um plano B.

Defesas anti-bot do TikTok: com o que você está lidando

  • Limitação de taxa. A documentação oficial para desenvolvedores do TikTok descreve explicitamente cotas de requisição até mesmo para integrações aprovadas. Scrapers não oficiais atingem esses limites muito mais rápido.
  • Bloqueio por cookie e sessão. Repositórios modernos como davidteather/TikTok-Api exigem um ms_token; repositórios mais antigos como drawrowfly/tiktok-scraper mostram tt_webid_v2 nos exemplos; Evil0ctal/Douyin_TikTok_Download_API documenta msToken, ttwid, X-Bogus e A_Bogus. O TikTok verifica se a sua requisição parece vir de uma sessão real de navegação.
  • Fingerprint do navegador. As diretrizes anti-bot da ScrapFly explicam por que sites comparam cabeçalhos, cookies, assinaturas TLS e características do navegador expostas por JavaScript com tráfego de usuários reais. A análise de browser fingerprinting deles cobre sinais de Canvas, WebGL, WebRTC, fontes e runtime. Fingerprinting é como o TikTok conferir a identidade do seu navegador — se navegador, cookies, timing e assinatura de rede não batem, a requisição parece falsa antes mesmo de qualquer conteúdo ser devolvido.
  • Detecção comportamental. Threads do Reddit sobre scraping do TikTok mencionam com frequência que sessões novas do Playwright acionam desafios de CAPTCHA. Publicações da comunidade de 2025–2026 descrevem cada vez mais uma detecção baseada no timing das ações e na qualidade da interação, e não só no reuso de IP.
  • Parâmetros de requisição criptografados/assinados. O Evil0ctal documenta X-Bogus e A_Bogus; gists antigos da comunidade giram em torno de assinatura de URL e geração de tokens. O TikTok espera cada vez mais que as requisições cheguem com os mesmos "carimbos" presentes no tráfego do navegador/app oficial.
  • CAPTCHA e fluxos de verificação. A existência de repositórios de resolução de CAPTCHA específicos para TikTok e threads no Reddit sobre desafios de quebra-cabeça confirma que o CAPTCHA continua fazendo parte da superfície anti-bot.

Por que os mantenedores open source não conseguem acompanhar

O ciclo é sempre o mesmo. Um desenvolvedor cria um TikTok scraper. O projeto viraliza no GitHub. O TikTok corrige a brecha. O mantenedor conserta ou segue em frente.

Dois repositórios ilustram esse padrão perfeitamente:

  • drawrowfly/tiktok-scraper ainda tem 5.052 estrelas e 889 forks, mas o último push foi em 19 de maio de 2023. É o TikTok scraper exato mais estrelado do GitHub, e hoje parece uma peça histórica: muita visibilidade, muita confiança, nenhuma manutenção atual.
  • davidteather/TikTok-Api mostra 6.301 estrelas, 1.177 forks e um último push em 1º de abril de 2026. O feed de releases mostra manutenção real em abril de 2025, julho de 2025, outubro de 2025 e abril de 2026 — incluindo correções para crawling de vídeos de usuários e novos controles de proxy/sessão. Mas até esse projeto mais saudável avisa abertamente que o TikTok bloqueia requisições e que os usuários podem precisar de proxies, Playwright e lógica customizada de sessão.

O padrão é simples:

  • Um repositório antigo de TikTok scraper provavelmente está morto.
  • Um repositório ativo de TikTok scraper provavelmente ainda é frágil.
  • A única diferença real é se ainda existe alguém por perto para corrigir o problema neste mês.

Checklist de 60 segundos para avaliar qualquer TikTok Scraper no GitHub

Antes de clonar qualquer coisa, rode este checklist. Leva menos de um minuto e poupa horas de frustração.

Sinal🟢 Saudável🟡 Arriscado🔴 Morto
Último push relevanteHá menos de 3 mesesEntre 3 e 12 meses12+ meses atrás
Quantidade de issues abertasBaixa, issues recentes recebem respostasCrescendo, com alguma atividade do mantenedorMuitos relatos sem resposta de "quebrado/bloqueado/não funciona"
Reclamações recentes de usuáriosPrincipalmente dúvidas de configuraçãoMistura de setup e falhas"zero output", "403", "ainda funciona?" repetidos
Modelo atual de auth/sessãoCaminho com sessão/cookie documentadoMuito token, mas documentadoDepende de endpoints antigos, sem orientação atual de auth
Superfície de instalaçãoSetup reproduzível e testadoAlguns passos manuaisDependências antigas, sem notas modernas de setup
CI/testesExistem testes e estão atuaisHá testes, mas cobertura incertaSem testes ou ações desatualizadas
Adequação do escopo de dadosBate com seu caso real de usoSó cobre parte do casoResolve outro problema totalmente

Como checar cada sinal em menos de 60 segundos

  1. Data do último push: olhe o cabeçalho do repositório no GitHub. Se aparecer "last pushed 2 years ago", já pode sair.
  2. Issues abertas: clique na aba Issues. Leia rapidamente os títulos mais recentes. Pesquise not working, 403, blocked, captcha ou zero output.
  3. Reclamações de usuários: se as 5 principais issues abertas forem variações de "isso não funciona mais", essa é a resposta.
  4. Modelo de auth/sessão: abra o README. Procure orientações atuais como ms_token, configuração do Playwright ou notas sobre proxy. Se o README citar endpoints de 2023, siga em frente.
  5. Superfície de instalação: verifique se há arquivo de requirements, suporte a Docker ou instruções claras de setup. Se o README disser "npm install" e a última versão do Node testada for 14, espere problemas.
  6. CI/testes: confira a aba Actions. Se os testes estiverem falhando ou nem existirem, o diagnóstico vira chute.
  7. Escopo dos dados: o repositório realmente descreve os tipos de dados que você precisa (perfis, metadados de vídeos, comentários, hashtags)? Muitos repos só fazem download de vídeo, não extração estruturada.

Sinais vermelhos que significam "desista"

  • O repositório está arquivado.
  • O README diz "no longer maintained".
  • O último commit menciona uma versão da API do TikTok de mais de 2 anos atrás.
  • As issues estão lotadas de relatos de "doesn't work" e o mantenedor não responde há meses.
  • O repo tem muitas estrelas, mas nenhum fork ou pull request recente.

Dica rápida: pesquise na aba Issues por is:issue is:open "not working" ou is:issue is:open "403". Se os resultados forem densos e recentes, o repositório provavelmente está quebrado.

Repositórios populares de TikTok Scraper no GitHub: uma checagem honesta de status (2026)

tiktok_scraper_repo_status_v1_a5c4a7a45c.png

Aqui está o Checklist de Sinais Vitais aplicado aos repositórios que você realmente vai encontrar ao buscar "tiktok scraper" no GitHub:

RepoÚltimo pushEstrelasIssues abertasVereditoObservação
drawrowfly/tiktok-scraper2023-05-195.05258🔴 Morto / só como referênciaAinda famoso, mas velho demais para uso em produção em 2026
davidteather/TikTok-Api2026-04-016.301134🟡 Vivo, mas exige muita manutençãoMelhor opção OSS; espera Playwright, tokens e muitas vezes proxies
scrapfly/scrapfly-scrapers/tiktok-scraper2026-04-21938 (pai)~0 (monorepo)🟡 Vivo, mas não é OSS puroAtual e útil, porém exige chave da API do ScrapFly
Evil0ctal/Douyin_TikTok_Download_API2025-10-1217.397135🟡 Vivo, amplo e complexoProjeto multi-plataforma rico em recursos; mais parecido com uma plataforma para power users
naseif/tiktok-scraper2024-07-2610713🟡 ArriscadoRepositório menor, com reclamações abertas sobre fluxo de info do usuário e hashtags
loewehancara1rmyv/Tiktok-scraper2026-01-1240🔴 Novo demais para confiarRepositório demonstrativo, não validado pela comunidade

drawrowfly/tiktok-scraper

Por anos, esse scraper/downloader em TypeScript foi a resposta padrão para "tiktok scraper github" — lidando com feeds de usuário, tendências, hashtags e músicas. Em 2026, o melhor é tratá-lo como documentação histórica. O último push foi em maio de 2023, e a fila de issues ainda traz relatos sem solução de "still working?" e "zero output" de 2023–2025. Se você está lendo este artigo porque clonou esse repo e não obteve nada, está em boa companhia.

davidteather/TikTok-Api

A wrapper de dados do TikTok open source mais confiável que ainda sobrevive em 2026. Está ativa, tem releases recentes e documenta explicitamente setup do Playwright, uso assíncrono, tratamento de tokens, suporte a proxy e recursos de recuperação de sessão. Mas não é uma ferramenta de "clonar e sair usando". O próprio README diz que EmptyResponseException normalmente significa que o TikTok está bloqueando a requisição, e o histórico de discussões mostra dores recorrentes com ms_token, extração de comentários quebrada, KeyError: 'ItemModule' e falhas específicas de endpoint. Veredito: vivo, útil, só para desenvolvedores e com muita manutenção.

Outros repositórios relevantes

  • scrapfly/scrapfly-scrapers/tiktok-scraper: Atual e tecnicamente relevante, mas o README exige SCRAPFLY_KEY. É um exemplo de código para uma plataforma gerenciada de scraping, não uma ferramenta gratuita independente.
  • Evil0ctal/Douyin_TikTok_Download_API: Abrange TikTok e Douyin, documenta lógica de assinatura (X-Bogus, A_Bogus, msToken) e suporta comentários, seguidores, playlists e mais. É tecnicamente exigente e cada vez mais ligado a referências de API paga. O tracker de issues mostra bugs ativos em 2026 relacionados a links de vídeo e endpoints de informações de usuário. Vivo e rico em recursos, mas complexo.
  • naseif/tiktok-scraper: Menor, com reclamações abertas. Arriscado para uso em produção.
  • loewehancara1rmyv/Tiktok-scraper: 4 estrelas, 0 issues, novo demais para confiar. O artigo do Medium que o promoveu fez isso sem muita crítica.

API oficial do TikTok vs. scrapers do GitHub vs. ferramentas no-code: um framework de decisão

tiktok_scraper_decision_framework_v1_590e6b1852.png

A maioria dos artigos concorrentes ou ignora os caminhos oficiais de acesso do TikTok, ou pula direto de "use GitHub" para "compre nosso serviço". Aqui vai uma comparação neutra dos três caminhos:

FatorTikTok Research APIScrapers do GitHubFerramentas no-code (ex.: Thunderbit)
Barreira de acessoÉ preciso aplicação acadêmica/empresarial; ~4 semanas para aprovaçãoGit clone + setupInstalação de extensão no navegador
Escopo de dadosSomente endpoints aprovados (contas, vídeos, comentários, lojas)Amplo (perfis, vídeos, comentários, hashtags, lojas)Dados visíveis da página (perfis, vídeos, engajamento, hashtags)
Carga de manutençãoBaixa (oficial, estável)Alta (os repos quebram quando o TikTok atualiza)Nenhuma (a IA se adapta a mudanças de layout)
Risco de bloqueioNenhum (autorizado)AltoBaixo (baseado no navegador, imita um usuário real)
CustoGratuito (se aprovado)Gratuito (mas consome tempo)Plano gratuito disponível; planos por créditos a partir de US$15/mês
É preciso programar?Sim (Python/R)Sim (Python/Node.js)Não
Melhor paraPesquisadores, acadêmicos, organizações aprovadasDesenvolvedores confortáveis com manutençãoMarketing, vendas, operações, não desenvolvedores

Quando a TikTok Research API faz sentido

A Research API do TikTok é o caminho oficial mais limpo, se você for elegível. Pesquisadores elegíveis nos EUA, Europa e Brasil podem se candidatar para estudar conteúdo público e dados de contas. As categorias de dados disponíveis incluem contas, seguidores/seguidos, vídeos curtidos, vídeos fixados, vídeos repostados, conteúdo, comentários e lojas. O codebook expõe campos como video_description, view_count, like_count, comment_count, share_count e, em nível de comentário, campos como text, reply_count e create_time.

A desvantagem: a elegibilidade é restrita a instituições acadêmicas e pesquisadores independentes/sem fins lucrativos elegíveis em regiões específicas, além de pesquisadores validados pelo processo DSA da UE. Se você é um time de growth ou uma agência e precisa de dados operacionais rápidos, esse não é o caminho.

O TikTok também oferece uma Commercial Content API para anúncios e dados de conteúdo de anunciantes, útil para pesquisas de transparência, mas não para scraping geral.

Quando ainda faz sentido usar um scraper do GitHub

Os scrapers do GitHub ainda fazem sentido para desenvolvedores que precisam de acesso não oficial a dados públicos além da barreira de aprovação da API oficial e estão dispostos a manter a stack. Isso inclui casos como raspar grades de perfis visíveis, hashtags, comentários, playlists ou metadados de vídeos em um pipeline customizado, onde fazer fork do repositório e corrigir coisas é aceitável.

A ressalva honesta: isso não é uma configuração única. Até mesmo o repositório mais confiável de 2026, davidteather/TikTok-Api, ainda diz que os usuários podem precisar de Playwright, cookies/tokens, proxies e fábricas customizadas de página/sessão.

Quando uma ferramenta no-code como a Thunderbit faz sentido

Extraia dados do TikTok com IA Get Started Free

Não é desenvolvedor? Ou é um desenvolvedor cansado do ciclo de quebra e reparo? Uma ferramenta de IA baseada em navegador é o caminho mais rápido para dados estruturados do TikTok.

Criamos a Thunderbit como um AI web scraper que funciona como extensão do Chrome. No TikTok, ela lê qualquer página visível (perfil, vídeo, hashtag, resultados de busca), sugere colunas com "AI Suggest Fields" e permite clicar em "Scrape" para extrair dados estruturados. A página da ferramenta de TikTok scraper documenta campos como data da publicação, duração do vídeo, curtidas, compartilhamentos, salvamentos, comentários, visualizações e hashtags. O template de image scraper mostra como coletar miniaturas de posts, URLs, legendas, @do criador e sinais de engajamento a partir de páginas de perfil. O template de hashtag scraper cobre URL do vídeo, nome de usuário do criador, descrição, horário da publicação, visualizações, curtidas, comentários, compartilhamentos, som/áudio e URL da imagem de capa.

O scraping de subpáginas permite visitar cada página de vídeo a partir de uma listagem de perfil e enriquecer a tabela com métricas de engajamento, legendas e hashtags — útil para profissionais de marketing que montam bases de influenciadores ou fazem auditoria de conteúdo da concorrência.

Sem manutenção, sem triagem de instalação, sem configuração anti-bloqueio. A IA se adapta automaticamente às mudanças de layout. A exportação é gratuita para Google Sheets, Excel, Airtable, Notion, CSV ou JSON.

Se você já perdeu horas com repositórios quebrados no GitHub, esta é uma alternativa legítima — não um pitch forçado.

Experimente a Thunderbit para scraping do TikTok

Triagem de instalação: corrigindo os 5 erros mais comuns de setup de TikTok Scraper no GitHub

Falhas de instalação são o terceiro ponto de dor mais citado em fóruns sobre scraping do TikTok, e nenhum guia grande realmente ajuda a resolvê-las. Veja o que costuma dar errado.

Conflitos de versão do Node.js

Problema: muitos repositórios antigos de TikTok scraper (especialmente drawrowfly/tiktok-scraper) foram feitos para Node.js 14–16. Se você estiver usando Node 20+, o npm install pode falhar silenciosamente ou gerar binários incompatíveis.

Correção: use o nvm (Node Version Manager) para instalar e alternar para a versão correta:

nvm install 16
nvm use 16
npm install

Se o repositório não especificar a versão do Node, verifique o campo engines no package.json ou olhe a configuração de CI.

Problemas de dependências Python e setup do Playwright

Problema: davidteather/TikTok-Api exige Python 3.9+ e Playwright com binários específicos do navegador. Usuários acabam vendo erros como "browser not found" ou conflitos de dependência.

Correção: sempre use um ambiente virtual e depois instale explicitamente os navegadores do Playwright:

python -m venv .venv
source .venv/bin/activate   # No Windows: .venv\Scripts\activate
pip install TikTokApi
python -m playwright install

Se o playwright install falhar, verifique no gerenciador de pacotes do sistema se faltam dependências nativas (por exemplo, libnss3 no Ubuntu).

Erros de permissão no Linux/Ubuntu

Problema: rodar sudo pip install corrompe o ambiente Python do sistema e gera uma cadeia de problemas de dependência.

Correção: nunca use sudo pip install. Sempre crie um ambiente virtual primeiro:

python3 -m venv .venv
source .venv/bin/activate
pip install -r requirements.txt

Isso isola as dependências do scraper do Python do sistema.

Problemas de caminho e codificação no Windows

Problema: o CMD do Windows tem problemas de codificação e limitações de comprimento de caminho que quebram instalações de scrapers, especialmente quando o Playwright baixa binários de navegador em diretórios muito profundos.

Correção: use WSL (Windows Subsystem for Linux) ou Git Bash em vez do CMD. O WSL oferece um ambiente Linux completo dentro do Windows:

wsl --install
# Depois, abra um terminal WSL e siga os passos de configuração do Linux

O atalho com Docker: pule totalmente os problemas de dependência

Problema: tudo o que foi dito acima.

Correção: se você se sente à vontade com Docker, coloque o ambiente do scraper em contêiner. Um Dockerfile básico para um TikTok scraper em Python fica assim:

FROM python:3.11-slim
RUN apt-get update && apt-get install -y libnss3 libatk-bridge2.0-0 libdrm2 libxcomposite1 libxdamage1 libxrandr2 libgbm1 libasound2
RUN pip install TikTokApi playwright && python -m playwright install --with-deps chromium
WORKDIR /app
COPY . .
CMD ["python", "scrape.py"]

Isso garante um ambiente reproduzível, independentemente do sistema operacional da máquina hospedeira. Se o scraper funciona no Docker, qualquer falha fora dele é problema de ambiente, não de código.

Fluxograma de troubleshooting:

  1. O repositório consegue executar o próprio exemplo com sucesso? → Se não, verifique a versão de runtime.
  2. A versão do runtime está correta? → Verifique a instalação do browser/Playwright.
  3. O browser está instalado? → Verifique tokens/cookies.
  4. Tokens/cookies válidos? → Veja se o TikTok está bloqueando a sessão.
  5. Tudo isso falhou? → Considere que o repositório quebrou, não que o usuário errou. Troque de ferramenta.

Boas práticas anti-bloqueio para scraping do TikTok (sem pagar proxies)

Usuários de fóruns reclamam repetidamente de banimento e detecção: "they get your accounts banned, which is an added expense" e "without using Apify or expensive paid APIs." Aqui estão alternativas práticas e gratuitas que não exigem assinatura paga de proxy.

tiktok_scraper_antiban_playbook_v1_3f3a302f6b.png

PráticaDificuldadeCustoEfetividade
Atrasos aleatórios entre requisições (jitter de 2–8s)FácilGrátisModerada
Rotação de sessão/cookieMédiaGrátisModerada
Raspar apenas páginas públicas deslogadasFácilGrátisModerada
Respeitar robots.txt + cabeçalhos de rate limitFácilGrátisBase
Randomização de fingerprint em navegador headless (Playwright)MédiaGrátisAlta
Usar endpoints de API mobile do TikTok (menor detecção)DifícilGrátisAlta
Rotação de proxy residencialMédiaUS$20–100/mêsAlta

Técnicas gratuitas que realmente ajudam

Atrasos aleatórios entre requisições. Não faça requisições em loop apertado. Adicione um jitter aleatório de 2–8 segundos entre uma e outra. É a coisa mais fácil que você pode fazer:

import time, random
time.sleep(random.uniform(2, 8))

Reuso de sessão e cookies. Não crie uma sessão nova para cada requisição. Reaproveite cookies e estado de sessão ao longo de um lote de requisições e só depois faça rotação. É exatamente por isso que os repositórios modernos pedem ms_token em vez de prometer scraping sem estado.

Raspe páginas públicas deslogadas. O TikTok-Api diz explicitamente que não suporta rotas autenticadas por usuário e só funciona em dados visíveis quando deslogado. Scraping deslogado tem um perfil de detecção menor do que sessões autenticadas.

Respeite o robots.txt. O robots.txt atual do TikTok bloqueia muitos agentes por completo e só permite um conjunto limitado de caminhos públicos para crawling geral. Isso não é sinal verde para scraping agressivo, mas respeitá-lo reduz a chance de blacklist imediata do IP.

Técnicas intermediárias para taxas maiores de sucesso

Randomização de fingerprint em navegador headless. Se estiver usando Playwright, randomize o tamanho da viewport, o user-agent, o fuso horário e o locale de cada sessão. Isso faz seu scraper parecer um usuário real diferente a cada vez, em vez do mesmo bot com IP novo.

Usar endpoints móveis do TikTok. Alguns membros da comunidade relatam menor detecção ao usar endpoints com cara de mobile, em vez da interface web. Isso é mais difícil de implementar e menos documentado, mas é uma técnica real para usuários avançados.

Quando você realmente precisa de proxy — e opções acessíveis

Em escala, técnicas gratuitas não bastam. A rotação de proxy residencial é a abordagem padrão para scraping do TikTok em grande volume. Não vou indicar um serviço pago específico aqui, mas a recomendação geral é: evite proxies de datacenter (o TikTok os sinaliza agressivamente) e procure pools de proxies residenciais ou mobile com rotação por requisição.

Como alternativa, ferramentas baseadas em navegador como a Thunderbit evitam a questão do proxy porque rodam na sua própria sessão de navegador, imitando um usuário real. Isso não as torna imunes à detecção em larga escala, mas para casos típicos de marketing ou pesquisa (dezenas a centenas de páginas, não milhões), é um caminho muito mais simples.

Que dados você realmente obtém? Exemplos reais de saída de TikTok scrapers

Os usuários querem saber quais dados de fato vão receber antes de escolher uma ferramenta — e a maioria dos guias ignora isso completamente. Aqui estão estruturas de campos representativas, baseadas na documentação das fontes.

Dados de perfil

Nome de usuárioNome exibidoSeguidoresSeguindoCurtidas totaisBioVerificadoURL do perfil
@examplecreatorJane Doe1,240,00031248,700,000"Cooking + comedy 🍳"tiktok.com/@examplecreator
@travelwithmarkMark S.890,00015022,100,000"Travel vlogger 🌍"tiktok.com/@travelwithmark
@fitnessmayaMaya L.2,100,0008891,300,000"Workouts & wellness"tiktok.com/@fitnessmaya

Disponível em: scrapers do GitHub (TikTok-Api, Evil0ctal), Research API, Thunderbit (a partir de páginas de perfil visíveis).

Metadados de vídeo

URL do vídeoLegendaVisualizaçõesCurtidasComentáriosCompartilhamentosMúsicaHashtagsData do postDuração
tiktok.com/@ex/video/123"Best pasta trick ever 🍝"4,200,000312,0008,40021,000"Italian Vibes – DJ Marco"#pasta #cooking #hack2026-03-150:42
tiktok.com/@ex/video/456"POV: your cat judges you"9,100,0001,100,00023,00055,000"Original Sound"#cat #pov #funny2026-04-010:18
tiktok.com/@ex/video/789"Morning routine nobody asked for"1,800,00098,0003,2007,500"Chill Morning – LoFi"#routine #morning2026-04-101:02

Disponível em: scrapers do GitHub (TikTok-Api, Evil0ctal), Research API (campos como video_description, view_count, like_count, comment_count, share_count, music_id, hashtag_names, video_duration), Thunderbit (campos em nível de vídeo).

Dados de comentários

Autor do comentárioTexto do comentárioCurtidasHorárioRespostas
@user_abc"I tried this and it actually works 😂"1,2002026-03-16T08:12:00Z14
@chef_dan"Add garlic next time, trust me"8902026-03-16T09:45:00Z7
@randomfan99"This is the content I'm here for"3402026-03-16T11:30:00Z2

Disponível em: scrapers do GitHub (TikTok-Api, Evil0ctal), Research API (campos como text, like_count, reply_count, create_time), Thunderbit (a partir de seções visíveis de comentários).

Dados de hashtags e busca

HashtagURL do vídeo principalVisualizações agregadasEm alta
#pastatiktok.com/@ex/video/1234,200,000Yes
#cookingtiktok.com/@chef/video/32111,000,000Yes
#hacktiktok.com/@tips/video/6542,900,000No

Disponível em: scrapers do GitHub (varia por repositório), Thunderbit (template de hashtag scraper).

Observação: nenhum repositório único garante todos os campos o tempo todo. As estruturas de resposta do TikTok mudam, e até os mantenedores avisam sobre isso. Trate os exemplos como representativos, não garantidos.

Como raspar dados do TikTok em 2 cliques com a Thunderbit (passo a passo)

Cansado do ciclo de quebrar e consertar? Aqui vai o caminho no-code — a saída para quem tentou e falhou com repositórios do GitHub.

  1. Instale a extensão Chrome da Thunderbit.
  2. Acesse a página do TikTok que você quer raspar — perfil, resultados de busca, página de hashtag ou vídeo individual.
  3. Clique em "AI Suggest Fields". A IA da Thunderbit lê a página e sugere colunas: nome de usuário, seguidores, legenda do vídeo, curtidas, hashtags etc.
  4. Ajuste os campos se necessário e clique em "Scrape". Os dados são preenchidos em uma tabela estruturada.
  5. Use o Scraping de Subpáginas para enriquecer os dados. Abra cada vídeo a partir de uma listagem de perfil e puxe campos extras: legenda completa, detalhes da música, número de comentários, compartilhamentos.
  6. Exporte para Google Sheets, Excel, Airtable ou Notion — totalmente grátis.

Sem manutenção, sem triagem de instalação, sem configuração anti-bloqueio. A IA se adapta automaticamente às mudanças de layout do TikTok.

Enriquecendo dados do TikTok com Scraping de Subpáginas

Depois de raspar uma lista de vídeos de um perfil ou de uma página de hashtag, clique em "Scrape Subpages" para que a IA visite cada página de vídeo e puxe campos adicionais. Isso é especialmente útil para profissionais de marketing que montam bases de influenciadores ou fazem auditorias de conteúdo da concorrência — você obtém uma tabela completa com dados de engajamento em nível de vídeo sem precisar clicar manualmente em dezenas de páginas.

Exportando e usando seus dados do TikTok

A Thunderbit exporta para Google Sheets, Excel, Airtable, Notion, CSV ou JSON — tudo grátis. Casos de uso comuns:

  • Colocar os dados em uma planilha para análise de engajamento.
  • Enviar para Airtable para um rastreador de influenciadores no estilo CRM.
  • Levar para o Notion para colaboração da equipe em pesquisa de conteúdo.

Para um panorama mais profundo de como a Thunderbit lida com extração de dados da web, confira nosso guia para iniciantes em web scraping ou assista aos tutoriais no canal da Thunderbit no YouTube.

Permanecendo legal: Termos de Serviço do TikTok e conformidade no scraping

A posição legal do TikTok é clara. O blog de privacidade sobre scraping da plataforma diz que os Termos de Serviço proíbem scripts automatizados que coletem informações ou interajam com o serviço de forma não autorizada, e menciona explicitamente a tentativa de contornar restrições de acesso. As Diretrizes da Comunidade do TikTok também proíbem tentativas enganosas de obter informações por meio de scripts automatizados ou web crawling.

Orientação prática:

  • Fique em dados publicamente disponíveis. Não raspe conteúdo privado ou protegido por login.
  • Respeite os limites de taxa. Não bombardeie os servidores do TikTok.
  • Cumpra as leis de privacidade de dados. GDPR e CCPA ainda se aplicam se você estiver coletando, armazenando ou analisando dados pessoais.
  • Use a Research API quando for elegível. É o caminho mais seguro do ponto de vista de conformidade.
  • Isto não é aconselhamento jurídico. Consulte um profissional para o seu caso específico.

Para mais informações sobre o cenário legal, veja nosso guia sobre implicações jurídicas do web scraping.

O que fazer quando seu repositório de TikTok Scraper no GitHub morre

Resumo curto:

  1. Sempre rode o Checklist de Sinais Vitais de 60 segundos antes de clonar qualquer TikTok scraper no GitHub. A maioria dos repositórios já está morta.
  2. Entenda suas opções. API oficial, scrapers do GitHub e ferramentas no-code atendem perfis e casos de uso diferentes.
  3. Se seguir pelo GitHub, reserve tempo para depurar instalação e configurar anti-bloqueio. Espere manutenção contínua.
  4. Saiba quais dados você realmente vai obter antes de escolher a ferramenta. Verifique os campos de saída, não só a quantidade de estrelas.
  5. Se você não é desenvolvedor (ou está cansado de repositórios quebrados), teste uma ferramenta no-code como a Thunderbit — dois cliques, dados estruturados, exportação grátis.

Os dados do TikTok que você precisa estão acessíveis. A questão é se você quer gastar seu tempo mantendo um scraper ou usando os dados de verdade. Escolha a abordagem que combina com seu nível técnico e seu caso de uso, e não deixe um repositório morto no GitHub desperdiçar outra tarde.

Experimente a Thunderbit para dados do TikTok

FAQs

Existem TikTok scrapers no GitHub que ainda funcionam em 2026?

Sim, mas a lista é curta. davidteather/TikTok-Api é a opção open source mais confiável, com manutenção ativa até abril de 2026. Evil0ctal/Douyin_TikTok_Download_API também está vivo, mas é mais complexo. O repositório com mais estrelas, drawrowfly/tiktok-scraper, não é atualizado desde maio de 2023 e está efetivamente morto. Sempre rode o Checklist de Sinais Vitais antes de investir tempo em qualquer repositório.

É legal raspar o TikTok?

Os Termos de Serviço do TikTok proíbem explicitamente o scraping automatizado. Dados visíveis publicamente ocupam uma zona jurídica cinzenta que varia conforme a jurisdição. O caminho mais seguro é a Research API oficial, para pesquisadores elegíveis. Se você raspar dados públicos, fique em conteúdo publicamente acessível, respeite os limites de taxa e cumpra GDPR/CCPA. Isto não é aconselhamento jurídico — consulte um profissional para o seu caso.

Posso raspar o TikTok sem programar?

Sim. Ferramentas de IA baseadas em navegador como a Thunderbit permitem extrair dados estruturados do TikTok (perfis, metadados de vídeo, hashtags, métricas de engajamento) sem escrever código. A TikTok Research API também exige pouca programação para candidatos aprovados. Para não desenvolvedores, ferramentas no-code são o caminho mais rápido e confiável.

Que dados posso obter de um TikTok scraper?

Os tipos de dados mais comuns incluem informações de perfil (nome de usuário, seguidores, bio, status de verificação), metadados de vídeo (legenda, visualizações, curtidas, comentários, compartilhamentos, música, hashtags, duração, data do post), comentários (texto, curtidas, horário, respostas) e dados de hashtags/busca (vídeos principais, visualizações agregadas, status de tendência). Os campos exatos dependem da ferramenta e do método — veja a seção de exemplos de saída acima para detalhes.

Por que meu TikTok scraper continua sendo bloqueado?

O TikTok usa várias camadas de defesa anti-bot: limitação de taxa, bloqueio por cookie/sessão, fingerprint do navegador, detecção comportamental, parâmetros de requisição criptografados e fluxos de CAPTCHA. Causas comuns de bloqueio incluem enviar requisições rápido demais, usar uma sessão nova e limpa a cada requisição, executar um navegador headless com fingerprints padrão ou usar proxies de datacenter. Veja a seção de melhores práticas anti-bloqueio acima para alternativas gratuitas e pagas.

Ke
Ke
CTO na Thunderbit | Cientista de Dados Sênior e Especialista em ML Com quase uma década de experiência em machine learning e data science, Ke Shen é ex-aluno da Columbia University e foi Cientista de Dados Sênior na Walmart Labs. Com profunda experiência, reconhecida pelos pares, em Python, R, Java e Estatística, ele compartilha insights testados em batalha sobre como levar algoritmos complexos de IA da teoria à arquitetura pronta para produção.
Índice

Extraia uma página só perguntando

Diga o que você precisa em inglês simples. Ou melhor: nem precisa dizer nada.

Experimente Thunderbit grátis
Extraia dados usando IA
Transfira dados facilmente para Google Sheets, Airtable ou Notion
Chrome Store Rating
PRODUCT HUNT#1 Product of the Week