معظم أدوات استخراج TikTok على GitHub أصبحت ميتة — إليك ما ينبغي فعله

آخر تحديث في July 2, 2026
معظم أدوات استخراج TikTok على GitHub أصبحت ميتة — إليك ما ينبغي فعله

يُظهر بحث GitHub عن عبارة "tiktok scraper" 339 مستودعًا. وحوالي 48% منها لم تُحدَّث منذ أكثر من عام، وعلى الأقل 4 منها مؤرشفة بشكل صريح.

إذا سبق لك أن استنسخت مستودعًا مشهورًا لجلب بيانات TikTok، ثم قضيت ساعة كاملة في حل مشاكل الاعتمادات، وفي النهاية لم تحصل على أي نتيجة — فأنت لست وحدك. أكثر أداة TikTok scraper حصولًا على النجوم في GitHub، وهي drawrowfly/tiktok-scraper، ما تزال تمتلك أكثر من 5,000 نجمة. لكن قسم المشكلات فيها مليء بمواضيع مثل #812: "is this amazing tool still working?" و #824: "Is this still working?" — وكلاهما يشتكي من عدم خروج أي بيانات. لقد كنت أتابع حالة مستودعات TikTok scraping في Thunderbit منذ أشهر، والنمط واضح جدًا: هذه الأدوات تتعطل بسرعة، ومعظمها لا يُصلَح أبدًا. هذا المقال هو دليل النجاة العملي الذي تمنيت لو كان متاحًا لي عندما بدأت تقييم هذه المستودعات. سنغطي ما الذي ما يزال حيًا، وما الذي مات، وما البديل، وكيف تتوقف عن إضاعة الساعات على كود توقف عن العمل قبل أن تعثر عليه أصلًا.

لماذا تتعطل معظم أدوات TikTok Scraper على GitHub — وتستمر في التعطل

TikTok ليس هدفًا عاديًا لعمليات scraping. واجهته على الويب تتغير باستمرار. وعلى عكس صفحة منتج ثابتة في متجر إلكتروني أو قائمة دليل أعمال، يقوم TikTok بتبديل نقاط النهاية، وتحديث بصمة مقاومة البوتات، وتغيير طريقة عرض الصفحات، وإضافة متطلبات جديدة للجلسة/الرموز — وأحيانًا خلال أسابيع فقط من آخر تغيير.

المحافظون على المشاريع مفتوحة المصدر يعملون تطوعًا. وعندما يدفع TikTok تحديثًا يكسر مسار الطلبات في الأداة، قد يبقى المستودع معطّلًا أيامًا أو أسابيع أو إلى الأبد. وهذا ليس انتقاصًا من جهود المطورين، بل هو عدم توافق بنيوي بين منصة سريعة التغير وممولة جيدًا، وبين مطورين غير مدفوعي الأجر لديهم وظائف أخرى.

حتى أفضل مستودعات TikTok scraper تعيش في حلقة إصلاح متكرر. وإذا كنت ستستخدم واحدًا منها، فأنت بحاجة إلى خطة لتقييمه، وتشخيص مشاكله، وامتلاك بديل جاهز.

دفاعات TikTok ضد البوتات: ما الذي تواجهه

  • تحديد معدلات الطلبات. توثّق وثائق المطور الرسمية في TikTok بوضوح حدود الطلبات حتى للتكاملات المعتمدة. أما الأدوات غير الرسمية فتصل إلى هذه الحدود أسرع بكثير.
  • التحكم عبر الكوكيز والجلسات. المستودعات الحديثة مثل davidteather/TikTok-Api تتطلب ms_token؛ بينما تظهر المستودعات الأقدم مثل drawrowfly/tiktok-scraper قيمة tt_webid_v2 في أمثلتها؛ أما Evil0ctal/Douyin_TikTok_Download_API فيوثّق msToken وttwid وX-Bogus وA_Bogus. TikTok يتحقق مما إذا كان طلبك يبدو صادرًا عن جلسة تصفح حقيقية.
  • بصمة المتصفح. تشرح إرشادات ScrapFly لمكافحة البوتات لماذا تقارن المواقع بين الرؤوس، والكوكيز، وبصمات TLS، وخصائص JavaScript الخاصة بالمتصفح، وحركة المستخدم الحقيقية. كما يغطي شرحهم لبصمة المتصفح إشارات Canvas وWebGL وWebRTC والخطوط وإشارات التشغيل. البصمة هنا تشبه فحص TikTok لبطاقة هوية المتصفح — فإذا لم تتطابق المتصفح والكوكيز والتوقيت وبصمة الشبكة، سيبدو الطلب مزيفًا قبل حتى أن تصل أي محتويات.
  • الكشف السلوكي. كثيرًا ما تشير مناقشات Reddit حول scraping لـ TikTok إلى أن جلسات Playwright الجديدة تستدعي مطالبات CAPTCHA. كما أن منشورات المجتمع من 2025–2026 تصف بشكل متزايد أنظمة كشف تراقب توقيت الأفعال وجودة التفاعل، وليس مجرد إعادة استخدام الـ IP.
  • معلمات الطلبات المشفرة/الموقعة. يوثق Evil0ctal X-Bogus وA_Bogus؛ بينما تدور مقتطفات المجتمع الأقدم حول توقيع الروابط وتوليد الرموز. TikTok يتوقع بشكل متزايد أن تصل الطلبات مع نفس "الأختام" التي تحملها حركة المتصفح/التطبيق الخاص به.
  • CAPTCHA ومسارات التحقق. وجود مستودعات لحل CAPTCHA الخاصة بـ TikTok ومناقشات Reddit حول تحديات الألغاز يؤكد أن CAPTCHA ما تزال جزءًا من سطح الحماية ضد البوتات.

لماذا لا يستطيع المحافظون على المشاريع مفتوحة المصدر مواكبة التغيير

الدورة دائمًا نفسها: مطوّر يبني scraper لـ TikTok، ثم ينتشر بقوة على GitHub، ثم يكسر TikTok الأداة، فيقوم المحافظ بإصلاحها أو يبتعد.

مستودعان يوضحان هذا النمط بوضوح:

  • drawrowfly/tiktok-scraper ما يزال لديه 5,052 نجمة و889 fork، لكن آخر تحديث له كان في 19 مايو 2023. وهو أكثر مستودع TikTok scraper مطابق للعبارة المطلوبة حصولًا على النجوم في GitHub، لكنه يبدو كأثر تاريخي: ظاهر بقوة، موثوق قديمًا، بلا صيانة فعلية حاليًا.
  • davidteather/TikTok-Api يظهر 6,301 نجمة، و1,177 fork، وآخر تحديث في 1 أبريل 2026. وتوضح صفحة الإصدارات أن هناك صيانة فعلية في أبريل 2025، ويوليو 2025، وأكتوبر 2025، وأبريل 2026 — بما في ذلك إصلاحات تتعلق بجلب فيديوهات المستخدم، وضوابط جديدة للـ proxy والجلسات. لكن حتى هذا المشروع الأفضل نسبيًا يحذّر صراحة من أن TikTok يَحجب الطلبات وأن المستخدمين قد يحتاجون إلى proxies وPlaywright ومنطق جلسات مخصص.

النمط بسيط:

  • المستودع القديم غالبًا ميت.
  • المستودع النشط غالبًا ما يزال هشًا.
  • الفرق الحقيقي الوحيد هو ما إذا كان هناك شخص متاح هذا الشهر لإصلاح ما انكسر.

قائمة فحص حيوية المستودع خلال 60 ثانية: كيف تقيّم أي TikTok Scraper على GitHub

قبل أن تستنسخ أي شيء، مرّ على هذه القائمة. تستغرق أقل من دقيقة وتوفر عليك ساعات من الإحباط.

الإشارة🟢 سليم🟡 به مخاطرة🔴 ميت
آخر دفع مهممنذ أقل من 3 أشهرمن 3 إلى 12 شهرًامنذ 12 شهرًا فأكثر
عدد المشكلات المفتوحةمنخفض، والحديث منها يُجاب عليهتراكم متزايد مع بعض نشاط الصيانةالكثير من تقارير "معطل/محجوب/لا يعمل" بلا رد
شكاوى المستخدمين الحديثةأغلبها أسئلة إعدادمزيج من مشاكل الإعداد والانقطاعتكرار "لا يوجد مخرجات" و"403" و"ما زال يعمل؟"
نموذج المصادقة/الجلسة الحاليموثّق بوضوحيعتمد على رموز كثيرة لكن موثّقيعتمد على نقاط نهاية قديمة بلا إرشادات حديثة
سطح التثبيتإعداد قابل للتكرار ومختبربعض الخطوات اليدويةاعتمادات قديمة وملاحظات إعداد غير حديثة
CI/الاختباراتتوجد اختبارات وحديثةتوجد اختبارات لكن التغطية غير واضحةلا توجد اختبارات أو إجراءات CI قديمة
ملاءمة نطاق البياناتيطابق حالة الاستخدام الفعليةيدعم جزءًا فقط من الحالةيحل مشكلة مختلفة تمامًا

كيف تفحص كل إشارة خلال أقل من 60 ثانية

  1. تاريخ آخر دفع: انظر إلى رأس المستودع في GitHub. إذا ظهر "last pushed 2 years ago" فالواضح أنك تنسحب.
  2. المشكلات المفتوحة: افتح تبويب Issues. ألقِ نظرة سريعة على أحدث العناوين. وابحث عن not working أو 403 أو blocked أو captcha أو zero output.
  3. شكاوى المستخدمين: إذا كانت أول 5 مشكلات مفتوحة كلها نسخًا مختلفة من "هذا لم يعد يعمل"، فهذه هي الإجابة.
  4. نموذج المصادقة/الجلسة: افتح ملف README. ابحث عن إرشادات حديثة مثل ms_token أو إعداد Playwright أو ملاحظات البروكسي. إذا كانت التعليمات تشير إلى نقاط نهاية من 2023، فتابع الطريق.
  5. سطح التثبيت: تحقّق من وجود ملف requirements أو دعم Docker أو خطوات إعداد واضحة. إذا قال README فقط "npm install" وكان آخر إصدار Node مختبر هو 14، فتوقع المتاعب.
  6. CI/الاختبارات: افتح تبويب Actions. إذا كانت الاختبارات فاشلة أو غائبة، فالتعطل يصبح مجرد تخمين.
  7. نطاق البيانات: هل يصف المستودع فعلًا أنواع البيانات التي تحتاجها (profiles، video metadata، comments، hashtags)؟ كثير من المستودعات لا تفعل سوى تنزيل الفيديو، لا استخراج بيانات منظمة.

إشارات حمراء تعني "ابتعد"

  • المستودع مؤرشف.
  • README يقول "no longer maintained".
  • آخر commit يشير إلى إصدار TikTok API عمره أكثر من عامين.
  • قسم المشكلات غارق في تقارير "doesn't work" ولم يردّ المشرف منذ أشهر.
  • للمستودع نجوم كثيرة لكن لا توجد forks أو pull requests حديثة.

نصيحة مهمة: ابحث في Issues عن is:issue is:open "not working" أو is:issue is:open "403". إذا كانت النتائج كثيرة وحديثة، فالمستودع على الأغلب معطّل.

أشهر مستودعات TikTok Scraper على GitHub: فحص صريح للحالة (2026)

tiktok_scraper_repo_status_v1_a5c4a7a45c.png

إليك تطبيق قائمة فحص حيوية المستودع على المستودعات التي ستجدها فعلًا عند البحث عن "tiktok scraper" في GitHub:

المستودعآخر تحديثالنجومالمشكلات المفتوحةالحكمملاحظة
drawrowfly/tiktok-scraper2023-05-195,05258🔴 ميت / للرجوع فقطما يزال مشهورًا، لكنه قديم جدًا للاستخدام الإنتاجي في 2026
davidteather/TikTok-Api2026-04-016,301134🟡 حي لكنه عالي الصيانةأقوى خيار مفتوح المصدر؛ يتوقع Playwright ورموزًا وغالبًا proxies
scrapfly/scrapfly-scrapers/tiktok-scraper2026-04-21938 (المستودع الأم)~0 (ضمن monorepo)🟡 حي، لكنه ليس OSS خالصًاحديث ومفيد، لكنه يتطلب ScrapFly API key
Evil0ctal/Douyin_TikTok_Download_API2025-10-1217,397135🟡 حي، واسع، معقدمشروع غني بالميزات ومتعدد المنصات؛ أقرب إلى منصة للمستخدمين المتقدمين
naseif/tiktok-scraper2024-07-2610713🟡 محفوف بالمخاطرمستودع أصغر مع شكاوى مفتوحة حول معلومات المستخدم ومسارات الهاشتاغ
loewehancara1rmyv/Tiktok-scraper2026-01-1240🔴 جديد جدًا بحيث لا يمكن الوثوق بهمستودع استعراضي، وليس مُثبتًا من المجتمع

drawrowfly/tiktok-scraper

لسنوات طويلة، كان هذا الـ scraper/downloader المكتوب بـ TypeScript هو الجواب الافتراضي لسؤال "tiktok scraper github" — حيث يتعامل مع تغذيات المستخدمين، والترند، والهاشتاغ، والموسيقى. لكن في 2026، الأفضل اعتباره وثيقة تاريخية. آخر تحديث كان في مايو 2023، وما يزال طابور المشكلات يحتوي تقارير غير محلولة من نوع "still working?" و"zero output" من 2023 إلى 2025. إذا كنت تقرأ هذا لأنك استنسخت هذا المستودع ولم تحصل على شيء، فأنت في صحبة كثيرة.

davidteather/TikTok-Api

أكثر غلاف بيانات TikTok مفتوح المصدر موثوقية وما يزال حيًا في 2026. إنه نشط، لديه إصدارات حديثة، ويوثّق بوضوح إعداد Playwright، والاستخدام غير المتزامن، والتعامل مع الرموز، ودعم الـ proxy، وميزات استعادة الجلسة. لكنه ليس أداة "انسخ وشغّل". ملف README نفسه يذكر أن EmptyResponseException تعني عادةً أن TikTok يحجب الطلب، كما تُظهر سجل النقاشات ألمًا متكررًا حول ms_token، واستخراج التعليقات المعطّل، وKeyError: 'ItemModule'، وفشل نقاط نهاية محددة. الحكم: حي، مفيد، للمطورين فقط، ويحتاج صيانة كبيرة.

مستودعات أخرى جديرة بالذكر

  • scrapfly/scrapfly-scrapers/tiktok-scraper: حديث ومرتبط تقنيًا بالموضوع، لكن README يتطلب SCRAPFLY_KEY. هذا مثال كود لمنصة scraping مُدارة، وليس أداة مستقلة مجانية.
  • Evil0ctal/Douyin_TikTok_Download_API: يغطي TikTok وDouyin، ويوثق منطق التوقيع (X-Bogus وA_Bogus وmsToken)، ويدعم التعليقات والمتابعين وقوائم التشغيل وأكثر. لكنه يتطلب مهارة تقنية عالية، وارتباطه يتزايد بمراجع API مدفوعة. ويُظهر قسم المشكلات تقارير مستمرة في 2026 حول روابط الفيديو ونقاط نهاية معلومات المستخدم. حي وغني بالميزات، لكنه معقد.
  • naseif/tiktok-scraper: أصغر حجمًا، مع شكاوى مفتوحة. محفوف بالمخاطر للاستخدام الإنتاجي.
  • loewehancara1rmyv/Tiktok-scraper: 4 نجوم، 0 مشكلات، لكنه جديد جدًا بحيث لا يمكن الوثوق به. المقال على Medium الذي روّج له كان غير نقدي.

TikTok API الرسمية مقابل Scrapers GitHub مقابل الأدوات بدون كود: إطار لاتخاذ القرار

tiktok_scraper_decision_framework_v1_590e6b1852.png

معظم المقالات المنافسة إما تتجاهل مسارات الوصول الرسمية في TikTok، أو تقفز مباشرة من "استخدم GitHub" إلى "اشترِ خدمتنا". إليك مقارنة محايدة بين المسارات الثلاثة:

العاملTikTok Research APIGitHub Scrapersأدوات بدون كود (مثل Thunderbit)
عائق الوصوليتطلب تقديمًا أكاديميًا/تجاريًا؛ حوالي 4 أسابيع للموافقةاستنساخ المستودع + الإعدادتثبيت إضافة المتصفح
نطاق البياناتنقاط نهاية معتمدة فقط (حسابات، فيديوهات، تعليقات، متاجر)واسع (profiles، videos، comments، hashtags، shops)بيانات الصفحة المرئية (profiles، videos، engagement، hashtags)
عبء الصيانةمنخفض (رسمي ومستقر)مرتفع (تتعطل المستودعات عند تحديث TikTok)لا شيء (الذكاء الاصطناعي يتكيف مع تغييرات الواجهة)
خطر الحظرلا يوجد (مصرّح به)مرتفعمنخفض (يعمل داخل المتصفح ويشبه المستخدم الحقيقي)
التكلفةمجاني (إذا تمت الموافقة)مجاني (لكن يستهلك الوقت)خطة مجانية متاحة؛ وخطط بنظام الاعتماد من 15 دولارًا/شهر
الحاجة إلى البرمجةنعم (Python/R)نعم (Python/Node.js)لا
الأفضل لـالباحثين، الأكاديميين، الجهات المعتمدةالمطورين القادرين على إدارة الصيانةالمسوقين، فرق المبيعات، العمليات، وغير المطورين

متى يكون TikTok Research API هو الخيار الأنسب

تُعد Research API الخاصة بـ TikTok أنظف مسار رسمي إذا كنت مؤهلًا لها. يمكن للباحثين المؤهلين في الولايات المتحدة وأوروبا والبرازيل التقديم لدراسة المحتوى العام وبيانات الحسابات. تشمل فئات البيانات المتاحة الحسابات، والمتابعين/الذين تتم متابعتهم، والفيديوهات المعجبة، والفيديوهات المثبتة، والفيديوهات المعاد نشرها، والمحتوى، والتعليقات، والمتاجر. كما أن الـ codebook يتيح حقولًا مثل video_description وview_count وlike_count وcomment_count وshare_count، وحقولًا على مستوى التعليق مثل text وreply_count وcreate_time.

الجانب السلبي: الأهلية محدودة بالمؤسسات الأكاديمية وبعض الباحثين المستقلين/غير الربحيين المؤهلين في مناطق محددة، بالإضافة إلى الباحثين المعتمدين ضمن عملية DSA في الاتحاد الأوروبي. إذا كنت فريق نمو أو وكالة تحتاج بيانات تشغيلية سريعة، فليس هذا مسارك.

كما تقدم TikTok أيضًا Commercial Content API لبيانات الإعلانات والمحتوى الإعلاني، وهي مفيدة لأبحاث الشفافية لكنها ليست scraping عامًا.

متى لا يزال GitHub Scraper منطقيًا

لا تزال أدوات GitHub scraping مناسبة للمطورين الذين يحتاجون إلى وصول غير رسمي إلى بيانات عامة تتجاوز بوابة الموافقة في الـ API الرسمي، ومستعدين لصيانة المنظومة. يشمل ذلك حالات مثل scraping شبكات الحسابات المرئية، والهاشتاغات، والتعليقات، وقوائم التشغيل، أو بيانات الفيديو داخل pipeline مخصص حيث يكون نسخ المستودع وتعديله مقبولًا.

التحذير الصريح: هذا ليس إعدادًا مرة واحدة. حتى أكثر المستودعات موثوقية في 2026، davidteather/TikTok-Api، ما تزال تخبر المستخدمين بأنهم قد يحتاجون إلى Playwright، والكوكيز/الرموز، وproxies، ومصانع صفحات/جلسات مخصصة.

متى تكون أداة بدون كود مثل Thunderbit منطقية

استخرج بيانات TikTok بالذكاء الاصطناعي Get Started Free

لست مطورًا؟ أو مطورًا سئم من دورة الإصلاح المستمر؟ أداة AI عبر المتصفح هي أسرع طريق إلى بيانات TikTok منظمة.

لقد بنينا Thunderbit كأداة AI web scraper تعمل كإضافة Chrome. على TikTok، تقرأ أي صفحة مرئية (profile، video، hashtag، search results)، وتقترح أعمدة عبر "AI Suggest Fields"، ثم تتيح لك النقر على "Scrape" لاستخراج بيانات منظمة. توضح صفحة أداة TikTok scraper حقولًا مثل تاريخ النشر، مدة الفيديو، الإعجابات، المشاركات، الحفظ، التعليقات، المشاهدات، والهاشتاغات. وتوضح قالب image scraper كيفية جمع صور المنشورات المصغرة، والروابط، والتعليقات التوضيحية، ومعرّفات المبدعين، وإشارات التفاعل من صفحات الملفات الشخصية. أما قالب hashtag scraper فيغطي رابط الفيديو، واسم المستخدم، والوصف، ووقت النشر، والمشاهدات، والإعجابات، والتعليقات، والمشاركات، والصوت، ورابط صورة الغلاف.

يتيح لك scraping الصفحات الفرعية زيارة كل صفحة فيديو من قائمة الملف الشخصي وإثراء الجدول بمقاييس التفاعل والتعليقات التوضيحية والهاشتاغات — وهو أمر مفيد للمسوقين الذين يبنون قواعد بيانات المؤثرين أو يجرون تدقيقًا لمحتوى المنافسين.

لا صيانة، لا تشخيص تثبيت، لا إعدادات مضادة للحظر. يتكيف الذكاء الاصطناعي تلقائيًا مع تغييرات تصميم TikTok. والتصدير مجاني إلى Google Sheets وExcel وAirtable وNotion وCSV أو JSON.

إذا كنت قد أهدرت ساعات على مستودعات GitHub المعطلة، فهذا بديل حقيقي — وليس مجرد ترويج قسري لمنتج.

جرّب Thunderbit لاستخراج بيانات TikTok

تشخيص التثبيت: إصلاح أكثر 5 حالات فشل شائعة في إعداد TikTok Scraper على GitHub

فشل التثبيت هو ثالث أكثر نقاط الألم ذكرًا في منتديات scraping الخاصة بـ TikTok، ولا يوجد دليل كبير يساعدك فعلًا على إصلاحه. إليك ما الذي يذهب خطأ.

تعارضات إصدار Node.js

المشكلة: كثير من مستودعات TikTok scraper القديمة (خصوصًا drawrowfly/tiktok-scraper) بُنيت لـ Node.js 14–16. إذا كنت تستخدم Node 20+، فقد يفشل npm install بصمت أو ينتج ملفات ثنائية غير متوافقة.

الحل: استخدم nvm (Node Version Manager) لتثبيت الإصدار الصحيح والانتقال إليه:

nvm install 16
nvm use 16
npm install

إذا لم يحدد المستودع إصدار Node، فتحقق من حقل engines في package.json أو من إعدادات CI.

مشاكل اعتمادات Python وإعداد Playwright

المشكلة: davidteather/TikTok-Api يتطلب Python 3.9+ وPlaywright مع حِزم متصفح محددة. ويظهر للمستخدمين أخطاء مثل "browser not found" أو تعارضات الاعتمادات.

الحل: استخدم دائمًا بيئة افتراضية، ثم ثبّت متصفحات Playwright صراحةً:

python -m venv .venv
source .venv/bin/activate   # على Windows: .venv\Scripts\activate
pip install TikTokApi
python -m playwright install

إذا فشل playwright install، فتحقق من مدير الحزم في نظامك لاحتمال نقص بعض الاعتمادات النظامية (مثل libnss3 على Ubuntu).

أخطاء الصلاحيات في Linux/Ubuntu

المشكلة: تشغيل sudo pip install يفسد بيئة Python على النظام ويؤدي إلى مشاكل متسلسلة في الاعتمادات.

الحل: لا تستخدم أبدًا sudo pip install. أنشئ بيئة افتراضية أولًا دائمًا:

python3 -m venv .venv
source .venv/bin/activate
pip install -r requirements.txt

هذا يعزل اعتمادات الـ scraper عن Python الخاص بالنظام.

مشاكل المسارات والترميز في Windows

المشكلة: يعاني Windows CMD من مشاكل ترميز وحدود لطول المسار، ما يكسر تثبيت أدوات scraping، خصوصًا عندما ينزل Playwright ملفات المتصفح الثنائية داخل مجلدات متداخلة بعمق.

الحل: استخدم WSL (Windows Subsystem for Linux) أو Git Bash بدلًا من CMD. يمنحك WSL بيئة Linux كاملة داخل Windows:

wsl --install
# ثم افتح طرفية WSL واتبع خطوات إعداد Linux

اختصار Docker: تجاوز مشاكل الاعتمادات بالكامل

المشكلة: كل ما سبق.

الحل: إذا كنت مرتاحًا مع Docker، فحوّل بيئة scraper إلى حاوية. يبدو Dockerfile أساسي لأداة TikTok scraper مبنية بـ Python كالتالي:

FROM python:3.11-slim
RUN apt-get update && apt-get install -y libnss3 libatk-bridge2.0-0 libdrm2 libxcomposite1 libxdamage1 libxrandr2 libgbm1 libasound2
RUN pip install TikTokApi playwright && python -m playwright install --with-deps chromium
WORKDIR /app
COPY . .
CMD ["python", "scrape.py"]

هذا يضمن بيئة قابلة لإعادة الإنتاج بغض النظر عن نظام التشغيل المضيف. إذا عمل scraper داخل Docker، فأي فشل خارجه فهو مشكلة بيئة، لا مشكلة كود.

مخطط استكشاف الأخطاء:

  1. هل يستطيع المستودع تشغيل المثال الخاص به بنجاح؟ → إذا لا، فتحقق من إصدار التشغيل.
  2. هل إصدار التشغيل صحيح؟ → افحص تثبيت المتصفح/Playwright.
  3. هل المتصفح مثبت؟ → افحص الرموز/الكوكيز.
  4. هل الرموز/الكوكيز صالحة؟ → افحص ما إذا كان TikTok يحجب الجلسة.
  5. هل فشل كل ما سبق؟ → اعتبر أن المستودع معطّل، لا أن المستخدم أخطأ. بدّل الأداة.

أفضل ممارسات تجنب الحظر في TikTok Scraping (من دون الدفع مقابل proxies)

يشتكي المستخدمون في المنتديات مرارًا من الحظر والكشف: "they get your accounts banned, which is an added expense" و"without using Apify or expensive paid APIs." إليك بدائل مجانية وعملية لا تتطلب الاشتراك في proxy مدفوع.

tiktok_scraper_antiban_playbook_v1_3f3a302f6b.png

الممارسةالصعوبةالتكلفةالفعالية
فواصل عشوائية بين الطلبات (تذبذب 2–8 ثوانٍ)سهلةمجانيةمتوسطة
تدوير الجلسات/الكوكيزمتوسطةمجانيةمتوسطة
scraping للصفحات العامة بعد تسجيل الخروج فقطسهلةمجانيةمتوسطة
احترام robots.txt + رؤوس تحديد المعدّلسهلةمجانيةأساسية
عشوائية بصمة المتصفح headless (Playwright)متوسطةمجانيةعالية
استخدام نقاط نهاية TikTok الخاصة بالهاتف المحمول (كشف أقل)صعبةمجانيةعالية
تدوير Residential Proxyمتوسطة20–100 دولار/شهرعالية

تقنيات مجانية تساعد فعلًا

فواصل عشوائية بين الطلبات. لا ترسل الطلبات داخل حلقة ضيقة. أضف تذبذبًا عشوائيًا بين 2 و8 ثوانٍ بين الطلبات. هذه أسهل خطوة يمكنك فعلها:

import time, random
time.sleep(random.uniform(2, 8))

إعادة استخدام الجلسة والكوكيز. لا تنشئ جلسة جديدة تمامًا لكل طلب. أعد استخدام الكوكيز وحالة الجلسة عبر مجموعة من الطلبات، ثم دوّرها. لهذا السبب تحديدًا تطلب المستودعات الحديثة ms_token بدل أن تعدك scraping بلا حالة.

اعمل على الصفحات العامة بعد تسجيل الخروج. يذكر TikTok-Api صراحةً أنه لا يدعم المسارات المعتمدة على تسجيل الدخول، ويعمل فقط على البيانات المرئية عند تسجيل الخروج. scraping بدون تسجيل دخول أقل عرضة للكشف من الجلسات الموثقة.

احترم robots.txt. ملف robots.txt الحالي في TikTok يحظر العديد من الوكلاء بالكامل، ولا يسمح إلا بعدد محدود من المسارات العامة للزحف العام. هذا لا يعني أن الأداة صارت خضراء لممارسات scraping العدوانية، لكن احترامه يقلل احتمال حظر الـ IP فورًا.

تقنيات متوسطة لرفع نسب النجاح

عشوائية بصمة المتصفح headless. إذا كنت تستخدم Playwright، فاعمل على عشوائية حجم النافذة، وUser-Agent، والمنطقة الزمنية، واللغة في كل جلسة. هذا يجعل scraper يبدو كمستخدم حقيقي مختلف كل مرة، بدلًا من بوت واحد مع IP جديد.

استخدام نقاط نهاية TikTok الخاصة بالهاتف المحمول. يذكر بعض أفراد المجتمع أن معدلات الكشف أقل عند استهداف نقاط نهاية شبيهة بالهاتف بدل الواجهة الويب. هذا أصعب في التنفيذ وأقل توثيقًا، لكنه تقنية حقيقية للمستخدمين المتقدمين.

متى تحتاج فعلًا إلى proxy — وما البدائل المعقولة

عند التوسع، لا تكفي التقنيات المجانية. تدوير الـ Residential Proxy هو النهج المعتاد لاستخراج كميات كبيرة من بيانات TikTok. لن أوصي هنا بخدمة proxy مدفوعة بعينها، لكن النصيحة العامة هي: تجنّب datacenter proxies (TikTok يرصدها بقوة) وابحث عن مجموعات residential أو mobile proxy مع تدوير لكل طلب.

وبدلًا من ذلك، تتجاوز الأدوات المعتمدة على المتصفح مثل Thunderbit سؤال الـ proxy بالكامل لأنها تعمل داخل جلسة المتصفح الخاصة بك، وتحاكي مستخدمًا حقيقيًا. هذا لا يجعلها محصنة ضد الكشف على نطاق ضخم، لكن لحالات الاستخدام المعتادة في التسويق أو البحث (عشرات إلى مئات الصفحات، لا الملايين)، فهو مسار أبسط بكثير.

ما البيانات التي تحصل عليها فعليًا؟ أمثلة حقيقية لمخرجات TikTok Scrapers

يريد المستخدمون معرفة ما الذي سيحصلون عليه فعلًا قبل الالتزام بأداة ما — ومع ذلك تتجاهل معظم الأدلة هذا تمامًا. إليك هياكل حقول تمثيلية مستندة إلى وثائق المصدر.

بيانات الملف الشخصي

اسم المستخدماسم العرضالمتابعونالذين تتم متابعتهمإجمالي الإعجاباتالنبذةموثّقرابط الملف الشخصي
@examplecreatorJane Doe1,240,00031248,700,000"Cooking + comedy 🍳"tiktok.com/@examplecreator
@travelwithmarkMark S.890,00015022,100,000"Travel vlogger 🌍"tiktok.com/@travelwithmark
@fitnessmayaMaya L.2,100,0008891,300,000"Workouts & wellness"tiktok.com/@fitnessmaya

متاح من: GitHub scrapers (TikTok-Api, Evil0ctal)، وResearch API، وThunderbit (من صفحات الملف الشخصي المرئية).

بيانات الفيديو

رابط الفيديوالتعليق النصيالمشاهداتالإعجاباتالتعليقاتالمشاركاتالموسيقىالهاشتاغاتتاريخ النشرالمدة
tiktok.com/@ex/video/123"Best pasta trick ever 🍝"4,200,000312,0008,40021,000"Italian Vibes – DJ Marco"#pasta #cooking #hack2026-03-150:42
tiktok.com/@ex/video/456"POV: your cat judges you"9,100,0001,100,00023,00055,000"Original Sound"#cat #pov #funny2026-04-010:18
tiktok.com/@ex/video/789"Morning routine nobody asked for"1,800,00098,0003,2007,500"Chill Morning – LoFi"#routine #morning2026-04-101:02

متاح من: GitHub scrapers (TikTok-Api, Evil0ctal)، وResearch API (وتتضمن الحقول video_description وview_count وlike_count وcomment_count وshare_count وmusic_id وhashtag_names وvideo_duration)، وThunderbit (حقول على مستوى الفيديو).

بيانات التعليقات

المعلّقنص التعليقالإعجاباتالطابع الزمنيالردود
@user_abc"I tried this and it actually works 😂"1,2002026-03-16T08:12:00Z14
@chef_dan"Add garlic next time, trust me"8902026-03-16T09:45:00Z7
@randomfan99"This is the content I'm here for"3402026-03-16T11:30:00Z2

متاح من: GitHub scrapers (TikTok-Api, Evil0ctal)، وResearch API (وتتضمن الحقول text وlike_count وreply_count وcreate_time)، وThunderbit (من أقسام التعليقات المرئية).

بيانات الهاشتاغ والبحث

الهاشتاغرابط الفيديو الأعلىإجمالي المشاهداتترند
#pastatiktok.com/@ex/video/1234,200,000نعم
#cookingtiktok.com/@chef/video/32111,000,000نعم
#hacktiktok.com/@tips/video/6542,900,000لا

متاح من: GitHub scrapers (يختلف حسب المستودع)، وThunderbit (قالب hashtag scraper).

ملاحظة: لا يوجد مستودع واحد يضمن كل الحقول طوال الوقت. هياكل استجابة TikTok تتغير، وحتى المشرفون يحذرون من ذلك. تعامل مع هذه الأمثلة على أنها تمثيلية، لا مضمونة.

كيف تستخرج بيانات TikTok في خطوتين مع Thunderbit (خطوة بخطوة)

هل سئمت من دورة الإصلاح المستمر؟ إليك المسار بدون كود — مخرج النجاة لأي شخص جرّب مستودعات GitHub وفشل معها.

  1. ثبّت Thunderbit Chrome Extension.
  2. انتقل إلى صفحة TikTok التي تريد استخراجها — profile أو search results أو صفحة hashtag أو فيديو فردي.
  3. انقر على "AI Suggest Fields". يقرأ الذكاء الاصطناعي في Thunderbit الصفحة ويقترح أعمدة مثل اسم المستخدم، عدد المتابعين، نص الفيديو، الإعجابات، الهاشتاغات، إلخ.
  4. عدّل الحقول إن لزم، ثم انقر "Scrape". ستُملأ البيانات في جدول منظم.
  5. استخدم Subpage Scraping لإثراء البيانات. ادخل إلى كل فيديو من قائمة الملف الشخصي واسحب حقولًا إضافية: النص الكامل، تفاصيل الموسيقى، عدد التعليقات، عدد المشاركات.
  6. صدّر إلى Google Sheets أو Excel أو Airtable أو Notion — مجانًا بالكامل.

لا صيانة، لا تشخيص تثبيت، لا إعدادات مضادة للحظر. يتكيف الذكاء الاصطناعي تلقائيًا مع تغييرات تصميم TikTok.

إثراء بيانات TikTok عبر Subpage Scraping

بعد استخراج قائمة فيديوهات من صفحة ملف شخصي أو صفحة هاشتاغ، انقر على "Scrape Subpages" ليزور الذكاء الاصطناعي كل صفحة فيديو ويسحب حقولًا إضافية. هذا مفيد جدًا للمسوقين الذين يبنون قواعد بيانات للمؤثرين أو يجرون تدقيقًا لمحتوى المنافسين — ستحصل على جدول كامل ببيانات التفاعل على مستوى الفيديو من دون النقر اليدوي عبر عشرات الصفحات.

تصدير واستخدام بيانات TikTok الخاصة بك

يُصدّر Thunderbit إلى Google Sheets وExcel وAirtable وNotion وCSV أو JSON — وكل ذلك مجانًا. حالات الاستخدام الشائعة:

  • وضع البيانات في جدول بيانات لتحليل التفاعل.
  • إرسالها إلى Airtable لبناء متتبع مؤثرين بأسلوب CRM.
  • دفعها إلى Notion لتعاون الفريق في أبحاث المحتوى.

ولنظرة أعمق إلى طريقة Thunderbit في استخراج البيانات من الويب، راجع دليل المبتدئين في web scraping أو شاهد الشروحات على قناة Thunderbit على YouTube.

البقاء ضمن القانون: شروط استخدام TikTok والامتثال عند scraping

موقف TikTok القانوني واضح. إذ تقول مدونة الخصوصية الخاصة بمكافحة scraping إن شروط الخدمة تمنع البرامج الآلية التي تجمع المعلومات أو تتفاعل مع الخدمة بطرق غير مصرّح بها، وتذكر صراحةً تجاوز قيود الوصول. كما أن إرشادات المجتمع تحظر أيضًا المحاولات الخادعة للحصول على المعلومات عبر البرامج الآلية أو الزحف على الويب.

إرشادات عملية:

  • التزم بالبيانات المتاحة للجمهور. لا تجرِ scraping للمحتوى الخاص أو المحجوب بتسجيل الدخول.
  • احترم حدود الطلبات. لا ترهق خوادم TikTok.
  • التزم بقوانين الخصوصية. لا تزال GDPR وCCPA تنطبقان إذا كنت تجمع أو تخزّن أو تحلل بيانات شخصية.
  • استخدم Research API عندما تكون مؤهلًا. إنه المسار الأكثر أمانًا من منظور الامتثال.
  • هذا ليس استشارة قانونية. استشر مختصًا وفق حالتك.

لمزيد من التفاصيل حول الجانب القانوني، راجع دليلنا حول الآثار القانونية للـ web scraping.

ماذا تفعل عندما يموت مستودع TikTok Scraper الخاص بك على GitHub

النسخة المختصرة:

  1. شغّل دائمًا قائمة فحص حيوية المستودع خلال 60 ثانية قبل استنساخ أي TikTok scraper من GitHub. معظم المستودعات ميتة أصلًا.
  2. افهم خياراتك. الـ API الرسمي، وGitHub scrapers، والأدوات بدون كود — كل منها يخدم مستخدمين وحالات استخدام مختلفة.
  3. إذا اتجهت إلى GitHub، خصص وقتًا لتشخيص التثبيت وإعدادات مكافحة الحظر. توقّع صيانة مستمرة.
  4. اعرف ما البيانات التي ستحصل عليها فعلًا قبل الالتزام بأداة. افحص حقول الخرج، لا عدد النجوم فقط.
  5. إذا لم تكن مطورًا (أو سئمت المستودعات المعطلة)، فجرب أداة بدون كود مثل Thunderbit — خطوتان، بيانات منظمة، وتصدير مجاني.

البيانات التي تحتاجها من TikTok متاحة. السؤال هو: هل تريد أن تقضي وقتك في صيانة scraper، أم في استخدام البيانات فعلًا؟ اختر النهج الذي يناسب مهارتك وحالة استخدامك، ولا تسمح لمستودع GitHub ميت بأن يضيع عليك بعد ظهر آخر.

جرّب Thunderbit لبيانات TikTok

الأسئلة الشائعة

هل توجد أدوات TikTok scraper على GitHub ما تزال تعمل في 2026؟

نعم، لكن القائمة قصيرة. davidteather/TikTok-Api هو الخيار مفتوح المصدر الأكثر مصداقية مع صيانة نشطة حتى أبريل 2026. كما أن Evil0ctal/Douyin_TikTok_Download_API ما يزال حيًا لكنه أكثر تعقيدًا. المستودع الأكثر نجومًا، drawrowfly/tiktok-scraper، لم يُحدَّث منذ مايو 2023 وهو ميت عمليًا. استخدم دائمًا قائمة فحص حيوية المستودع قبل استثمار وقتك في أي مشروع.

هل scraping TikTok قانوني؟

تمنع شروط خدمة TikTok صراحةً scraping الآلي. أما البيانات المرئية للجمهور فتقع في منطقة قانونية رمادية تختلف حسب الولاية القضائية. المسار الأكثر أمانًا هو Research API الرسمي للباحثين المؤهلين. وإذا قمت بجمع بيانات عامة، فالتزم بالمحتوى المتاح للجمهور، واحترم حدود الطلبات، وامتثل لـ GDPR/CCPA. هذه ليست استشارة قانونية — استشر مختصًا حسب حالتك.

هل يمكنني scraping TikTok بدون برمجة؟

نعم. أدوات الذكاء الاصطناعي المعتمدة على المتصفح مثل Thunderbit تتيح لك استخراج بيانات TikTok المنظمة (الملفات الشخصية، بيانات الفيديو، الهاشتاغات، مؤشرات التفاعل) من دون كتابة أي كود. كما أن TikTok Research API يتطلب فقط قدرًا محدودًا من البرمجة للمتقدمين المعتمدين. وبالنسبة لغير المطورين، تظل الأدوات بدون كود هي الأسرع والأكثر موثوقية.

ما البيانات التي يمكنني الحصول عليها من TikTok scraper؟

تشمل أنواع البيانات الشائعة معلومات الملف الشخصي (اسم المستخدم، المتابعون، النبذة، حالة التوثيق)، وبيانات الفيديو (التعليق النصي، المشاهدات، الإعجابات، التعليقات، المشاركات، الموسيقى، الهاشتاغات، المدة، تاريخ النشر)، والتعليقات (النص، الإعجابات، الطابع الزمني، الردود)، وبيانات الهاشتاغ/البحث (أفضل الفيديوهات، إجمالي المشاهدات، حالة الترند). تعتمد الحقول الدقيقة على الأداة والطريقة — راجع قسم أمثلة المخرجات أعلاه للتفاصيل.

لماذا يستمر TikTok scraper الخاص بي في التعرض للحظر؟

يستخدم TikTok عدة طبقات من الدفاع ضد البوتات: تحديد المعدّل، والتحكم بالكوكيز/الجلسة، وبصمة المتصفح، والكشف السلوكي، ومعلمات الطلبات المشفرة، ومسارات CAPTCHA. من الأسباب الشائعة للحظر: إرسال الطلبات بسرعة كبيرة، أو استخدام جلسة جديدة ونظيفة لكل طلب، أو تشغيل متصفح headless ببصمة افتراضية، أو استخدام datacenter proxies. راجع قسم أفضل ممارسات تجنب الحظر أعلاه للاطلاع على بدائل مجانية ومدفوعة.

Ke
Ke
المدير التقني في Thunderbit | عالم بيانات أول وخبير في تعلّم الآلة بخبرة تقارب عقدًا من الزمن في تعلّم الآلة وعلم البيانات، كيه شين خريج جامعة كولومبيا وكان سابقًا عالم بيانات أول في Walmart Labs. وبفضل خبرته العميقة المعترف بها من قبل الأقران في Python وR وJava والإحصاء، يشارك رؤى مجرّبة حول نقل خوارزميات الذكاء الاصطناعي المعقدة من النظرية إلى بنية جاهزة للإنتاج.

جرّب Thunderbit

استخرج العملاء المحتملين وبيانات أخرى في خطوتين فقط. مدعوم بالذكاء الاصطناعي.

احصل على Thunderbit مجاني
استخرج البيانات باستخدام الذكاء الاصطناعي
انقل البيانات بسهولة إلى Google Sheets أو Airtable أو Notion
Chrome Store Rating
PRODUCT HUNT#1 Product of the Week