تشير Reddit الآن إلى وجود 471.6 مليون مستخدم فريد نشط أسبوعيًا عبر أكثر من 100,000 مجتمع نشط — ومع ذلك، أصبح استخراج هذه البيانات من Reddit بصيغة منظمة وقابلة للاستخدام أصعب من أي وقت مضى. بين إعادة هيكلة أسعار واجهة برمجة التطبيقات في 2023، وانتهاء Pushshift كأرشيف عام، والدعاوى القضائية الأخيرة التي رفعتها Reddit ضد شركات الذكاء الاصطناعي، تبدو مشهدية الاستخراج اليوم مختلفة تمامًا عمّا كانت عليه قبل عامين فقط.
لقد أمضيت سنوات في بناء أدوات استخراج البيانات واختبارها في Thunderbit، وكنت أتابع كيف تغيّر النقاش حول استخراج بيانات Reddit من "استخدم PRAW فقط" إلى "انتظر، ما الذي لا يزال يعمل أصلًا؟" لذلك اختبرت بنفسي 12 أداة لاستخراج Reddit — بدون برمجة، وبرمجة خفيفة، وبرمجة كاملة — لأعرف أيها يقدّم نتائج فعلية في 2026 لفرق المبيعات والتسويق والبحث والعمليات التي تحتاج بيانات Reddit دون صداع. هذا ما توصلت إليه.
جرّب Thunderbit لاستخراج بيانات Reddit
لماذا تهم بيانات Reddit فرق المبيعات والتسويق والبحث
Reddit ليست مجرد منصة اجتماعية أخرى. إنها المكان الذي يقول فيه الناس ما يفكرون به فعلًا — بشكل شبه مجهول، ومن دون فلترة، ومع نظام تصويت إيجابي يبرز أكثر الإجابات فائدة. وهذا يجعلها منجمًا ذهبيًا لفرق الأعمال، لكنه من الصعب جدًا مراقبته يدويًا على نطاق واسع. في النصف الثاني من 2024 وحده، أنشأ مستخدمو Reddit 237 مليون منشور و1.79 مليار تعليق. وهذا يعادل تقريبًا 1.3 مليون منشور و9.7 مليون تعليق يوميًا.
وتدعم مواد Reddit التجارية نفسها هذا الكلام: يقول 74% من مستخدمي Reddit إنهم سيبدؤون بحثًا معمقًا عن منتج على Reddit، وفي كل ثانية يطلب متوسط شخصين توصيات من مجتمعات Reddit ويتلقون في المتوسط 14 ردًا شخصيًا. وقد استخدمت علامات تجارية مثل Škoda Auto ملاحظات Reddit في تصميم المنتجات بشكل مشترك، ما أدى إلى زيادة الطلبات بنسبة 255% و84% من المشاعر الإيجابية. كما حققت Nespresso ارتفاعًا بنسبة +30% في الوعي الإعلاني عبر حملات مدفوعة بالاعتماد على Reddit.
إليك كيف تستخدم فرق الأعمال بيانات Reddit فعليًا:
| حالة الاستخدام | لماذا Reddit قوية هنا | ما الذي تستخرجه الفرق |
|---|---|---|
| توليد العملاء المحتملين | سلاسل من نوع "أي أداة يجب أن أشتري؟" تكشف نية شراء عالية | المنشورات، سلاسل التعليقات، حسابات المؤلفين |
| مراقبة العلامة التجارية | الشكاوى والمديح غير المفلترين يظهران مبكرًا | الإشارات إلى العلامة، المشاعر، تجمعات الشكاوى |
| استخبارات تنافسية | المشترون يناقشون المنافسين بلغة حقيقية | مقارنات المنتجات، أسباب التحول، فجوات الميزات |
| التحقق من المنتج | ملاحظات الـ subreddit تكشف نقاط الألم قبل الاستبيانات | طلبات الميزات، الاعتراضات، لغة الطلب |
| تحليل المشاعر | التعليقات تحمل قدرًا أكبر من الدقة من تقييمات النجوم | أشجار التعليقات، البنية الأب-الابن، الأصوات |
| ابتكار المحتوى | الأسئلة تكشف الطلب التحريري مباشرة | عناوين المنشورات، الأسئلة المتكررة، صياغة الـ subreddit |
التحدي واضح: لا يمكنك تتبع آلاف السلاسل يدويًا كل يوم. وهنا تأتي أدوات الاستخراج — لكن القواعد تغيّرت.
حملة Reddit على واجهة API (2023–2026): ما الذي لا يزال يعمل وما الذي تعطّل
إذا لم تكن تتابع سياسات الوصول الخاصة بـ Reddit، فهذه هي الخلاصة: انتهى عالم الوصول المجاني وغير المحدود إلى API، وانتهت Pushshift كأرشيف بيانات عام. إن فهم ما تغيّر ضروري قبل اختيار أي أداة استخراج، لأنه يحدد مباشرةً الأدوات القادرة على تقديم النتائج الآن.
خط زمني لإعادة الضبط
| التاريخ | التغيير | لماذا يهم |
|---|---|---|
| أبريل 2023 | Reddit أعلنت تغييرات كبيرة على API | نهاية عصر الوصول المفتوح للجميع |
| مايو 2023 | تقييد الوصول إلى Pushshift | بدأ إغلاق الأرشيف التاريخي |
| يوليو 2023 | دخول الطبقة المجانية والقواعد التجارية المدفوعة حيّز التنفيذ | أصبح الـ API المجاني محدودًا، وأصبح الوصول التجاري مدفوعًا |
| منتصف 2024 | إطلاق Reddit for Researchers (نسخة تجريبية محدودة) | انتقل الوصول الأكاديمي إلى مسار مُراقَب |
| يناير 2025 | تأكيد أن Pushshift أصبح مقتصرًا على المشرفين الموثقين وللاستخدام في الإشراف فقط | لم يعد بوابة خلفية للبحث |
| يونيو 2025 | Reddit رفعت دعوى على Anthropic | تصعيد قانوني ضد الاستخدام غير المصرح به لبيانات الذكاء الاصطناعي |
| أكتوبر 2025 | Reddit رفعت دعوى على Perplexity | توسع موقف الإنفاذ أكثر |
| مارس 2026 | Reddit حدّثت Data API Wiki، وResponsible Builder Policy، وDeveloper Terms | لا تزال الطبقة المجانية وقواعد الموافقة والموقف المناهض للتجارية صارمة |
ما الذي لا يزال يعمل
- الطبقة المجانية الرسمية لواجهة Data API: ما زالت متاحة بمعدل 100 طلب في الدقيقة لكل OAuth client ID، محسوبة على متوسط نافذة 10 دقائق.
- نقاط نهاية ".json": إضافة ".json" إلى أي رابط Reddit لا تزال تُرجع بيانات، لكنها محدودة بمعدل استخدام وليست مخصصة للاستخدام واسع النطاق.
- الاستخراج عبر المتصفح: الأدوات التي تقرأ الصفحة المعروضة (مثل Thunderbit أو Octoparse) لا تخضع لقيود الـ API بالطريقة نفسها.
- خدمات الاستخراج السحابي: منصات مثل Apify وOxylabs تتولى العرض والبروكسيات وإعادة المحاولة من جانبها.
ما الذي تعطّل
- Pushshift كمصدر تاريخي عام: انتهى عمليًا. في 2026 أصبح محدودًا للمشرفين الموثقين لاستخدام الإشراف فقط.
- PRAW للجمع على نطاق تجاري واسع: مقيد بحدود الطبقة المجانية وبشروط Reddit الأوسع.
- أي سير عمل يفترض أن الوصول إلى الـ API متاح افتراضيًا وأن الاستخدام التجاري مسموح بسهولة: هذا افتراض قديم.
كيف يؤثر ذلك في اختيار الأداة
| النهج | هل يتأثر بقيود API؟ | الوصول إلى البيانات التاريخية | تعقيد الإعداد |
|---|---|---|---|
| Reddit API (PRAW) | نعم — حد 1K منشور، ومعدلات استخدام | محدود إلى الحديث نسبيًا | متوسط |
| نقطة نهاية ".json" | نعم — محدود بالمعدل | محدود جدًا | منخفض |
| الاستخراج عبر المتصفح (Thunderbit, Octoparse) | لا — يقرأ الصفحة المعروضة | فقط ما هو مرئي/قابل للتحميل | منخفض جدًا |
| خدمات الاستخراج السحابي (Apify, Oxylabs) | لا (تتولى البروكسيات) | يختلف حسب المزود | منخفض–متوسط |
الخلاصة: الأدوات المعتمدة على الـ API أولًا هي الآن الأفضل للمطورين والأحمال المحدودة. أما الأدوات المعتمدة على المتصفح أولًا وأدوات الاستخراج السحابي فهي الخيار الأكثر أمانًا لغير التقنيين أو لحالات الاستخدام ذات الحجم الأكبر.
بدون برمجة vs برمجة خفيفة vs برمجة كاملة: اختيار نهج استخراج Reddit المناسب
جمهور أدوات استخراج Reddit منقسم فعلًا. بعض القراء يحتاجون بيانات Reddit ولا يملكون أي دعم هندسي. وآخرون لديهم مشغل تقني لكن ليس لديهم فريق زحف مخصص. وبعضهم يريد تحكمًا كاملًا على مستوى الكود. النهج الصحيح يعتمد على موقعك من هذه المعادلة.
نشر أحد المستخدمين في r/nocode مؤخرًا: "أنا أعمل على scraper لـ reddit لكنني لا أستطيع الحصول على مفاتيح Reddit API." وشرح مستخدم آخر في r/NoCodeSaaS كيف بنى لوحة بيانات حية لـ Reddit باستخدام Zapier + Airtable + Softr — من دون كتابة أي كود خلفي. هذه ليست حالات نادرة. وفقًا لاستطلاع Smarty Marketing لـ 150 فريق تسويق داخلي، قال 47.8% إن عائقهم الرئيسي مع Reddit هو عدم فهم المنصة جيدًا، بينما قال 39% إنهم قلقون من الحظر.
إليك مصفوفة المفاضلة:
| العامل | بدون برمجة | برمجة خفيفة / API | برمجة كاملة |
|---|---|---|---|
| وقت الإعداد | دقائق | ساعات | ساعات–أيام |
| الصيانة | لا شيء (الذكاء الاصطناعي يتكيّف) | منخفضة (تحديثات API) | مرتفعة (تغييرات التصميم/الـ API) |
| سقف التوسع | متوسط | مرتفع | متوسط (قيود المعدل) |
| التخصيص | محدود | متوسط | غير محدود |
| التكلفة | طبقة مجانية → مدفوعة | الدفع حسب الاستخدام | مجاني (لكن وقت المطور) |
بدون برمجة (Thunderbit، Browse AI، Octoparse، ScrapeStorm، ParseHub): الأفضل لفرق التسويق والمبيعات والبحث. تدفق Thunderbit بالذكاء الاصطناعي من خطوتين هو أسرع طريق هنا.
خدمات برمجة خفيفة / API (Apify، ScrapingBee، Oxylabs، Firecrawl، ScrapeGraphAI): الأفضل للفرق التي لديها بعض الموارد التقنية وتحتاج إلى التوسع وإدارة البروكسي.
برمجة كاملة (PRAW، Scrapy): الأفضل للمطورين الذين يريدون أقصى تحكم — لكن عليهم تحمّل قيود الـ API والصيانة المستمرة.
كيف اختبرنا وقمنا بترتيب هذه الأدوات الـ 12 لاستخراج Reddit
قيّمت كل أداة وفق المعايير التالية:
- سهولة الاستخدام: بدون برمجة، أم برمجة خفيفة، أم برمجة كاملة؟
- الميزات الخاصة بـ Reddit: تفرع التعليقات، الاستهداف بحسب الـ subreddit، البيانات التاريخية
- كيفية التعامل مع قيود API الحالية في Reddit وكشف الحظر الآلي
- نموذج التسعير وحدود الطبقة المجانية
- خيارات تصدير البيانات: CSV، JSON، Sheets، إلخ
- دعم الاستخراج المجدول/المتكرر
- أفضل حالة استخدام
وهنا جدول المقارنة الرئيسي لتتصفحه قبل قراءة المراجعات الفردية:
| الأداة | النهج | هل يتطلب كودًا؟ | هل يتعامل مع قيود API؟ | التعليقات المتداخلة | الطبقة المجانية | الأفضل لـ |
|---|---|---|---|---|---|---|
| Thunderbit | أداة استخراج عبر المتصفح/السحابة بالذكاء الاصطناعي | لا | نعم (عبر المتصفح) | نعم (قالب الصفحات الفرعية + التعليقات) | نعم — 6 صفحات مجانية | المستخدمون غير التقنيين، توليد العملاء المحتملين |
| Apify | منصة Actors سحابية | برمجة خفيفة | نعم | جزئي إلى قوي (بحسب الـ actor) | نعم — أرصدة محدودة | استخراج Reddit بكميات كبيرة |
| PRAW | غلاف API لبايثون | برمجة كاملة | جزئي (حدود معدل الـ API) | نعم (بالكود) | نعم (الطبقة المجانية للـ API) | المطورون، المشاريع الصغيرة |
| Octoparse | أداة استخراج مرئية | لا | نعم (عبر المتصفح) | أفضل من المعتاد، لكن غير مثالي | نعم | فرق استخراج مواقع متعددة |
| Browse AI | روبوتات جاهزة | لا | نعم | جزئي | نعم | المراقبة وتتبع التغييرات |
| ScrapingBee | خدمة API | برمجة خفيفة | نعم (تبديل البروكسي) | لا يوجد تفرع أصيل | نعم — 1K رصيد | المطورون الذين يتجنبون الحظر |
| Scrapy | إطار عمل بايثون | برمجة كاملة | لا (افعلها بنفسك) | نعم (إذا بنيتها) | نعم (مفتوح المصدر) | خطوط معالجة مخصصة واسعة النطاق |
| ScrapeStorm | تطبيق مكتبي بالذكاء الاصطناعي | لا | نعم (عبر المتصفح) | جزئي | نعم | المبتدئون، الكشف التلقائي |
| ParseHub | أداة استخراج مرئية لسطح المكتب | لا | نعم (عبر المتصفح) | إمكانات تكرارية قوية | نعم — 5 مشاريع | هياكل الصفحات المعقدة |
| Firecrawl | API بيانات ويب | برمجة خفيفة | نعم | جزئي | نعم — 500 رصيد | خطوط بيانات الذكاء الاصطناعي/LLM |
| Oxylabs | بروكسي + API استخراج | برمجة خفيفة | نعم (بروكسيات مؤسسية) | جزئي | تجربة — 2K نتيجة | الاستخراج على مستوى المؤسسات |
| ScrapeGraphAI | معتمد على أوامر الذكاء الاصطناعي | برمجة خفيفة | نعم | جزئي | نعم — 50 رصيد | استخراج قائم على الأوامر بتركيز على الذكاء الاصطناعي |
والآن إلى المراجعات الفردية.
1. Thunderbit: أسرع أداة بدون برمجة لاستخراج Reddit لفرق الأعمال
Thunderbit هو أداة استخراج الويب بالذكاء الاصطناعي التي بنيناها في شركتنا، لذلك أعرف قدراته على Reddit من الداخل والخارج. إنه إضافة Chrome تستخرج Reddit (وأي موقع) في خطوتين — من دون برمجة، ومن دون مفاتيح API، ومن دون إعداد. الفكرة الأساسية هي أن يحدد الذكاء الاصطناعي البيانات الموجودة على الصفحة بدلًا منك.
وبالنسبة إلى Reddit تحديدًا، يوفّر Thunderbit:
- اقتراح الحقول بالذكاء الاصطناعي: انقر الزر في أي صفحة subreddit وسيكتشف Thunderbit تلقائيًا أعمدة مثل عنوان المنشور، المؤلف، الأصوات الإيجابية، عدد التعليقات، الرابط، والتاريخ.
- استخراج الصفحات الفرعية: ادخل إلى رابط كل منشور لاستخراج النص الكامل، والتعليقات الأعلى، والوسوم، والردود المتداخلة. بهذه الطريقة تحصل على بيانات تعليقات عميقة من دون لمس الـ API.
- أداة مخصصة لاستخراج تعليقات منشورات Reddit: لدى Thunderbit قالب لتعليقات Reddit يستخرج كل التعليقات، وروابط السلاسل، وأعداد الردود، والتعليقات المتداخلة من رابط المنشور.
- الترقيم والتمرير اللانهائي: يتعامل مع سلوك "تحميل المزيد" في Reddit تلقائيًا عبر وثائق الترقيم.
- الاستخراج السحابي: في الصفحات العامة على Reddit، يعالج Cloud Scraping ما يصل إلى 50 صفحة في المرة الواحدة من أجل السرعة.
- تصدير مجاني: أرسل البيانات إلى Excel أو Google Sheets أو Airtable أو Notion أو CSV أو JSON — من دون جدار دفع على التصدير.
- الاستخراج المجدول: اكتب جدولًا بلغة طبيعية (مثلًا: "كل يوم اثنين الساعة 9 صباحًا")، وأدخل روابط الـ subreddit، وسيتم تصدير البيانات تلقائيًا إلى وجهتك.
التسعير: طبقة مجانية (6 صفحات)، ثم خطط مدفوعة بنظام الأرصدة تبدأ من حوالي 9 دولارات/شهر. راجع أسعار Thunderbit.
الأفضل لـ: فرق المبيعات والتسويق والعمليات غير التقنية التي تحتاج بيانات Reddit بسرعة. كما أنه قوي جدًا في تحليل السلاسل عالية القيمة عندما تريد بيانات التعليقات المعروضة كاملة من صفحات المنشور الفردية.
كيفية استخراج subreddit باستخدام Thunderbit في 5 خطوات
- ثبّت إضافة Thunderbit لـ Chrome وانتقل إلى أي subreddit (مثل r/SaaS).
- انقر "اقتراح الحقول بالذكاء الاصطناعي" — سيكتشف Thunderbit الأعمدة تلقائيًا: عنوان المنشور، المؤلف، الأصوات الإيجابية، عدد التعليقات، الرابط، التاريخ.
- انقر "استخراج" — ستُملأ البيانات خلال ثوانٍ. استخدم الاستخراج السحابي للسرعة في الصفحات العامة.
- انقر "استخراج الصفحات الفرعية" لإثراء البيانات — يزور الذكاء الاصطناعي رابط كل منشور ويسحب النص الكامل، والتعليقات الأعلى، والوسوم، والردود المتداخلة.
- صدّر إلى Google Sheets أو Excel أو Airtable أو Notion — مجانًا بالكامل.
ولرؤية ذلك عمليًا، اطلع على قناة Thunderbit على YouTube.
تفضّل الكود؟ إليك مكافئ PRAW في نحو 15 سطرًا من Python:
import praw
reddit = praw.Reddit(
client_id="YOUR_ID",
client_secret="YOUR_SECRET",
user_agent="reddit-scraper-demo/0.1"
)
subreddit = reddit.subreddit("SaaS")
for post in subreddit.hot(limit=10):
print(post.title, post.score, post.num_comments, post.permalink)
Thunderbit يستغرق نحو 30 ثانية وصفر أسطر كود. أما PRAW فيعني إعداد بيانات اعتماد API، وكتابة سكربت، والتعامل مع قيود معدل الاستخدام. لكل منهما مكانه — لكن بالنسبة إلى معظم مستخدمي الأعمال، فإن مسار الخطوتين هو الرابح.
2. Apify Reddit Scraper: استخراج جماعي من السحابة مدعوم بالبنية السحابية
Apify هي منصة استخراج سحابية، وليست أداة Reddit واحدة. فهي تستضيف "Actors" مبنية من المجتمع — أدوات استخراج جاهزة يمكنك تشغيلها على بنية Apify مع تدوير البروكسي والحماية من الحظر مدمجين.
- Actors خاصة بـ Reddit: عدة خيارات، منها prodiger's Reddit Scraper (ابتداءً من نحو 0.60 دولار لكل 1K منشور) وtrudax's Reddit Scraper. كل منها يدعم قوائم الـ subreddit (hot، new، top، rising)، والبحث بالكلمات المفتاحية، والملفات الشخصية للمستخدمين، وفلاتر الوقت.
- التعليقات المتداخلة: لدى Apify Actor مخصص هو Reddit Comments Deep Scraper مع عمق قابل للضبط وحقول أب-ابن — وهو من أقوى الخيارات لاستخراج السلاسل العميقة.
- الجدولة: مجدول مدمج بنمط cron في الخطط المدفوعة.
- التصدير: JSON وCSV وXML وExcel وHTML Table وRSS وJSONL بالإضافة إلى التكامل عبر API وwebhooks.
- التسعير: طبقة مجانية (حوالي 5 دولارات/شهر أرصدة، نحو 1K نتيجة)؛ الخطط المدفوعة تبدأ من 49 دولارًا/شهر.
الأفضل لـ: الفرق التي تحتاج جمع بيانات Reddit على نطاق قابل للتوسع وبشكل متكرر مع بعض الموارد التقنية. إذا كنت تحتاج أشجار تعليقات عميقة على نطاق واسع، فـ actor الاستخراج العميق المخصص يمثل فارقًا حقيقيًا.
ملاحظة: تختلف الجودة والتسعير حسب الـ actor، لذا اختبر قبل الالتزام بسير عمل.
3. PRAW (Python Reddit API Wrapper): الخيار المفضل للمطورين — مع قيود
PRAW لا يزال الغلاف القياسي لواجهة Reddit API للمطورين أولًا. إذا كنت مطور Python، فمن المحتمل أنه أول أداة ستلجأ إليها — وللمشاريع الصغيرة والمحدودة، فهو لا يزال يعمل جيدًا. لكن في 2026، ينتمي إلى فئة "أداة للمطورين مع أحمال محدودة"، لا إلى كونه جوابًا شاملًا.
- أحدث إصدار: v7.8.1 (أكتوبر 2024)
- الميزات الأساسية: الوصول إلى جميع نقاط النهاية في API (المنشورات، التعليقات، معلومات المستخدم)؛ بث المنشورات في الوقت الحقيقي؛ اجتياز أشجار التعليقات كاملة باستخدام
replace_more() - القيود الحرجة: يخضع لحدود معدل Reddit (100 طلب/دقيقة في الطبقة المجانية)، وحد 1K منشور لكل قائمة، وتطبيق أشد لشروط الاستخدام منذ 2023. ويحذر PRAW نفسه من أن أكثر من "نحو عشرة" حالات تشغيل متزامنة قد تصطدم بحدود المعدل.
- التصدير: أي شيء تبرمجه (CSV، JSON، قاعدة بيانات، إلخ)
- الجدولة: افعلها بنفسك عبر مهام cron (يتطلب خادمًا وصيانة)
- التسعير: مجاني ومفتوح المصدر، لكن الاستخدام التجاري قد يتطلب الطبقة المدفوعة للـ API من Reddit.
الأفضل لـ: مطوري Python وعلماء البيانات الذين يحتاجون تكاملات مخصصة مع Reddit لمشاريع صغيرة إلى متوسطة ويمكنهم التعايش مع سقف الـ API.
4. Octoparse: استخراج Reddit بصريًا بالنقر والاختيار
Octoparse هو أداة استخراج ويب بدون برمجة وبواجهة بصرية تعتمد على النقر والاختيار. وعلى عكس كثير من الأدوات البصرية العامة، لديه فعلًا قالب Reddit Scraper عام — وهذا مهم لأن بنية صفحات Reddit تربك كثيرًا من الأدوات.
- قالب Reddit: يتطلب
old.reddit.com، ويدعم حتى 1,000 رابط منشور من Reddit في كل تشغيل، ويمكنه استخراج سلاسل التعليقات/الردود. ويحذّر القالب من التعليقات المطوية أو التي تحتاج "تحميل المزيد". ولمقارنة أعمق، راجع مراجعتنا لـ Octoparse والبديل عنه. - الترقيم والتمرير اللانهائي: مدعومان، رغم أن التحميل الديناميكي في Reddit قد يظل معقدًا.
- التصدير: CSV، Excel، JSON، HTML، XML، قواعد بيانات، Google Sheets.
- الجدولة: متاحة في الخطط المدفوعة، مع المراقبة والمهام الأب-الابن.
- التسعير: الخطة المجانية تشمل 10 مهام، و2 تشغيل متزامن، وما يصل إلى 10,000 صف لكل تصدير. تبدأ الخطط المدفوعة من نحو 69–75 دولارًا شهريًا.
الأفضل لـ: الفرق التي تحتاج أداة استخراج متعددة الاستخدامات لـ Reddit ومواقع أخرى من دون برمجة. قالب Reddit ميزة حقيقية مقارنة بالأدوات البصرية العامة.
5. Browse AI: روبوتات Reddit جاهزة مع مراقبة التغييرات
Browse AI يتخذ زاوية مختلفة: بدلًا من بناء أدوات استخراج من الصفر، تستخدم "robots" جاهزة مصممة لمواقع محددة. بالنسبة إلى Reddit، يدرج Browse AI صراحةً روبوتًا للصفحة الرئيسية ولبعض الـ subreddit، وروبوتًا لنتائج بحث Reddit، وأتمتات لمراقبة Reddit.
- المراقبة: أنشئ تنبيهات للمنشورات الجديدة، أو إشارات الكلمات المفتاحية، أو التغييرات في subreddits محددة. وتدعم الجدولة بشكل ساعي أو يومي أو أسبوعي أو شهري أو أنماط مخصصة.
- التكاملات: CSV، JSON، Google Sheets، Airtable، Zapier، Make، API، وwebhooks.
- التسعير: تشمل الطبقة المجانية 50 رصيدًا شهريًا، وموقعين، و3 مستخدمين. تبدأ الخطط المدفوعة من نحو 49 دولارًا/شهر.
الأفضل لـ: المستخدمون غير التقنيين الذين يريدون مراقبة Reddit تلقائيًا من دون أي عمل يدوي. قوي لتتبع العلامات التجارية والتنبيهات التنافسية. لمزيد من المعلومات، راجع مراجعتنا لـ Browse AI والبديل عنه.
ملاحظة: لم أجد دليلًا عامًا حديثًا على إعادة بناء عميقة لأشجار الردود المتداخلة، لذا الأفضل وصفه بأنه قوي في المراقبة واستخراج مستوى المنشور، لكن جزئي فقط في التعليقات العميقة.
6. ScrapingBee: استخراج Reddit عبر API مع إدارة البروكسي
ScrapingBee ليس منتجًا خاصًا بـ Reddit. إنه API عام للاستخراج يتولى المتصفحات دون واجهة، وتدوير البروكسي، وحل CAPTCHA. ترسل رابطًا، وتستلم HTML نظيفًا، أو Markdown، أو JSON مستخرجًا.
- عرض JavaScript: يتعامل مع صفحات Reddit الديناميكية.
- تدوير البروكسي: تلقائي لتجنب الحظر.
- صيغ الإخراج: HTML، Markdown، نص عادي، JSON مستخرج.
- لا يوجد مجدول مدمج: اربطه بأدوات cron أو الأتمتة.
- التسعير: تجربة مجانية مع 1,000 رصيد API، من دون بطاقة. تبدأ الخطط من 49 دولارًا/شهر.
الأفضل لـ: المطورون الذين يريدون وصولًا موثوقًا إلى صفحات Reddit من دون إدارة البروكسي بأنفسهم. ليس أداة متخصصة في Reddit — فلا يوجد محلل Reddit مدمج ولا تفرع للتعليقات. ولمراجعة كاملة، راجع مراجعتنا لـ ScrapingBee والبديل عنه.
7. Scrapy: إطار Python مفتوح المصدر لخطوط Reddit المخصصة
Scrapy هو الخيار الأكثر مرونة إذا كان فريقك يريد امتلاك منظومة الزحف بالكامل. إنه إطار Python مفتوح المصدر قوي مع 61.4 ألف نجمة على GitHub، وأحدث إصدار له هو v2.15.0 (أبريل 2026).
- معالجة غير متزامنة: زحف سريع مع محددات XPath/CSS لاستهداف دقيق.
- قابل للتوسعة: middlewares وpipelines للترقيم، وتتبّع التعليقات، وتنظيف البيانات، وتدوير البروكسي، وإدارة user-agent، وAutoThrottle.
- التصدير: JSON وJSON Lines وCSV وXML وPickle وMarshal.
- اعتبار حاسم: Scrapy لا يتعامل مع إجراءات مكافحة الحظر في Reddit بشكل جاهز. ستحتاج إلى إضافة تدوير البروكسي وإدارة user-agent وتحديد المعدل بنفسك.
- التسعير: مجاني ومفتوح المصدر.
الأفضل لـ: مطوري Python ذوي الخبرة الذين يبنون أنظمة استخراج Reddit كبيرة ومخصصة. إذا كنت تريد أقصى تحكم ويمكنك تحمّل الصيانة، فمن الصعب التفوق على Scrapy. ولمقارنة أدوات استخراج Python، اطلع على دليلنا لأفضل أدوات استخراج الويب ببايثون.
8. ScrapeStorm: أداة سطح مكتب مدعومة بالذكاء الاصطناعي للمبتدئين
ScrapeStorm هو تطبيق سطح مكتب مدعوم بالذكاء الاصطناعي يكتشف أنماط البيانات تلقائيًا على أي صفحة ويب. الإصدار الحالي هو v4.0.6 (ديسمبر 2025).
- الكشف التلقائي: يحدد الذكاء الاصطناعي بيانات المنشور (العناوين، الدرجات، المؤلفون) من دون إعداد يدوي.
- واجهة بصرية: صقل الاختيارات، وإعداد استخراج مجدول (ساعيًا/يوميًا/أسبوعيًا)، والتصدير إلى Excel وTXT وCSV وHTML وقواعد البيانات وGoogle Sheets.
- التسعير: طبقة مجانية دائمة؛ والخطط المدفوعة تبدأ من 49.99 دولارًا شهريًا.
الأفضل لـ: المبتدئون الذين يريدون استخراج Reddit بمساعدة الذكاء الاصطناعي من دون كود أو إعداد معقد. ولمعرفة أعمق، راجع مراجعتنا لـ ScrapeStorm والبديل عنه.
ملاحظة: لم أجد توثيقًا خاصًا بـ Reddit يثبت استخراج التعليقات المتداخلة بعمق. جيد للاستخراج السطحي، لكن عمق السلاسل غالبًا محدود ما لم تبنِ سير عمل مخططًا بعناية.
9. ParseHub: أداة سطح مكتب بصرية لصفحات Reddit المعقدة
ParseHub هو تطبيق سطح مكتب بواجهة بصرية تعتمد على النقر والاختيار، ويتعامل مع الصفحات الثقيلة بجافاسكربت والصفحات التي تُحمّل ديناميكيًا. ويتميّز عن كثير من أدوات بدون برمجة بسبب دعمه الصريح لأنماط الاستخراج التكراري/المتداخل.
- البيانات المتداخلة: توثق ParseHub ميزات Jump وRelative Select وCSV Wide للتعامل مع استخراج سلاسل التعليقات — وهي أقوى من معظم أدوات DOM بدون برمجة إذا استثمرت وقتًا في الباني.
- الجدولة: يمكن تشغيله كل دقيقة في الخطط المدفوعة.
- التصدير: CSV، JSON، Excel، والوصول إلى API.
- التسعير: مجاني حتى 5 مشاريع؛ والخطط المدفوعة تبدأ من نحو 89 دولارًا/شهر.
الأفضل لـ: المستخدمون الذين يحتاجون إلى استخراج هياكل صفحات Reddit المعقدة والمحمّلة بجافاسكربت من دون كود — خاصة إذا كنت مستعدًا لتعلّم ميزات الباني البصري الأكثر تقدمًا. راجع مراجعتنا لـ ParseHub والبديل عنه للمزيد.
10. Firecrawl: API لبيانات الويب مصمم لخطوط الذكاء الاصطناعي وLLM
Firecrawl هو API مصمم لزحف أي صفحة ويب وتحويلها إلى Markdown نظيف أو بيانات منظمة، ومحسّن لتغذية البيانات في تطبيقات الذكاء الاصطناعي وLLM. ليس أداة أصلية لـ Reddit، لكن إذا كان هدفك إدخال محتوى Reddit إلى خط RAG أو قاعدة معرفة، فهو مناسب جدًا.
- صيغ الإخراج: Markdown، HTML، لقطة شاشة، روابط، JSON، صور، branding، صوت. استخراج JSON يستهلك أرصدة أكثر.
- توجيه البروكسي وعرض JavaScript: موثّقان ومتعامل معهما.
- لا يوجد مجدول مدمج: اربطه بأدوات الأتمتة.
- التسعير: طبقة مجانية مع 500 رصيد لمرة واحدة؛ والخطط المدفوعة تبدأ من نحو 16 دولارًا/شهر.
الأفضل لـ: الفرق التقنية التي تغذي نماذج الذكاء الاصطناعي أو خطوط RAG أو قواعد المعرفة ببيانات Reddit. ولمقارنة أعمق، راجع مراجعتنا لـ Firecrawl والبدائل عنه.
ملاحظة: لا يوجد تفرع أصلي لتعليقات Reddit — إذ يسلّم محتوى الصفحة بصيغة Markdown أو JSON منظم. قوي في التقاط المحتوى، لكنه ليس متخصصًا في تحليل أشجار السلاسل.
11. Oxylabs: استخراج Reddit بمستوى مؤسسي مع بنية بروكسي
Oxylabs هي خدمة ويب موجهة للمؤسسات للاستخراج والبروكسيات. توفر بروكسيات خامًا وWeb Scraper API منظمًا مع الجدولة، والتسليم السحابي، ومجموعات بروكسي ضخمة.
- النطاق: تسوّق أكثر من 177 مليون IP في 195 دولة و15,000+ شريك.
- المجدول: موثّق؛ ويمكن للمهام المتكررة التسليم إلى AWS S3 أو GCS.
- تقييم G2: 4.5/5 من 425 مراجعة.
- التسعير: تجربة مجانية حتى 2,000 نتيجة؛ وWeb Scraper API يبدأ من 49 دولارًا/شهر. وتسعير المؤسسات يتدرج بعد ذلك.
الأفضل لـ: الشركات الكبيرة أو الوكالات التي تحتاج استخراج بيانات Reddit موثوقًا وعالي الحجم وعلى نطاق واسع. ولمراجعة كاملة، راجع مراجعتنا لـ Oxylabs والبديل عنه.
ملاحظة: لم أجد قالبًا أو محللًا خاصًا بـ Reddit من Oxylabs. هذا خيار بنية تحتية — قوي، لكن عليك بناء منطق Reddit الخاص بنفسك.
12. ScrapeGraphAI: استخراج Reddit قائم على الأوامر ومدعوم بالذكاء الاصطناعي
ScrapeGraphAI هو أحد أحدث الأدوات التي تتصدرها الذكاء الاصطناعي. تصف ما تريد استخراجه بالإنجليزية البسيطة، ويتولى الذكاء الاصطناعي الباقي — من دون محددات ومن دون مخططات.
- GitHub: 21.9 ألف نجمة.
- الإخراج: JSON، CSV، Markdown.
- التسعير: طبقة مجانية مع 50 رصيد API و10 طلبات/دقيقة؛ والخطط المدفوعة تبدأ من نحو 17 دولارًا/شهر.
الأفضل لـ: المستخدمون الذين يريدون استخراج Reddit بأسلوب الذكاء الاصطناعي أولًا وبالاعتماد على الأوامر، من دون تعريف المحددات أو المخططات يدويًا. ولمزيد من المعلومات، راجع مراجعتنا لـ ScrapeGraphAI والبديل عنه.
ملاحظة: لم أجد توثيقًا عامًا خاصًا بـ Reddit يقيس دقة التعامل مع سلاسل التعليقات المتفرعة. هو أداة قوية عامة قائمة على الأوامر، لكنه ليس متخصصًا ومحسّنًا لـ Reddit.
مشكلة التعليقات المتداخلة: أي أدوات Reddit تتعامل مع السلاسل العميقة
هذا هو القسم الذي تتجاهله معظم قوائم "أفضل أداة لاستخراج Reddit"، وهو في الواقع الأهم للبحث الجاد. محادثات Reddit مبنية على أشجار، وهذه البنية مهمة تحليليًا. وجدت ورقة 2024 في Applied Network Science أن نمذجة بنية السلاسل الهرمية في Reddit مهمة لفهم الظواهر الاجتماعية. وأفاد preprint من 2022 بأن الوسيط لعمق التعليق كان 3، والحد الأقصى 828.
إذا كنت تقوم بتحليل المشاعر أو جمع بيانات تدريب للذكاء الاصطناعي أو بحث نوعي، فأنت تحتاج شجرة التعليقات كاملة — لا مجرد الردود الأعلى مستوى. كثير من الأدوات تسطّح التعليقات لأنها تقرأ فقط DOM المرئي أو معامل limit الافتراضي في الـ API.
وهكذا تتوزع الأدوات:
| الأداة | عمق التعليقات | الطريقة |
|---|---|---|
| PRAW | شجرة كاملة (بالكود) | استدعاءات API replace_more() — تستهلك من حد المعدل |
| Apify Deep Scraper | شجرة كاملة | Actor مخصص |
| Thunderbit | السلسلة الكاملة المرئية | قالب تعليقات Reddit + استخراج الصفحات الفرعية من روابط المنشورات الفردية |
| ParseHub | إمكانات تكرارية قوية | Relative Select + Jump + CSV Wide |
| Octoparse | أفضل من المعتاد، لكن غير مثالي | قالب Reddit مع استخراج التعليقات/الردود؛ يفوّت الحالات المطوية/تحميل المزيد |
| Browse AI | جزئي | جيد للمراقبة، وأضعف في إثبات العمق التكراري |
| ScrapeStorm | جزئي | استخراج DOM/المتصفح العام |
| Firecrawl | جزئي | جيد لالتقاط المحتوى، وليس متخصصًا في أشجار السلاسل |
| Oxylabs | جزئي | يمكن بناؤه عبر تعليمات المتصفح، بلا توثيق خاص بـ Reddit |
| ScrapeGraphAI | جزئي | استخراج عبر الأوامر/المخطط من المحتوى المعروض |
نصيحة عملية: لاستخراج subreddit على نطاق واسع، تكون البيانات المسطحة غالبًا كافية. أما للسلاسل ذات القيمة العالية تحديدًا (ملاحظات المنتج، أبحاث السوق، الاستخبارات التنافسية)، فاستخدم أداة تزور صفحات المنشورات الفردية وتستخرج سلسلة التعليقات المعروضة كاملة.
مراقبة Reddit دون تدخل: الاستخراج المجدول لذكاء العلامة والسوق
بالنسبة إلى كثير من فرق الأعمال، السؤال الحقيقي ليس "هل أستطيع استخراج Reddit مرة واحدة؟" بل "هل أستطيع الاستمرار في سحب إشارات العلامة والمنافسين كل يوم من دون أن أتابعه بنفسي؟" وصف مستخدم في r/NoCodeSaaS كيف بنى لوحة بيانات حية لـ Reddit باستخدام Zapier + Airtable + Softr لإحصاءات الـ subreddit واتجاهات النمو، وكل ذلك من دون كتابة أي كود خلفي. هذا هو نوع سير العمل الذي يتيحه الاستخراج المجدول.
حالات الاستخدام
- تتبع الإشارات إلى علامتك التجارية أو إلى المنافسين في r/SaaS وr/ecommerce وr/startups
- مراقبة نقاشات الأسعار ومقارنات المنتجات
- إبراز عملاء محتملين جدد يطلبون توصيات في subreddits متخصصة
- تغذية ملخصات أسبوعية من Reddit إلى Slack أو البريد الإلكتروني لفريقك
كيف تتقارن الأدوات
| الأداة | الجدولة المدمجة | صعوبة الإعداد | التصدير التلقائي |
|---|---|---|---|
| Thunderbit | نعم — جدولة بلغة طبيعية | سهلة جدًا | Sheets، Airtable، Notion، CSV، JSON |
| Apify | نعم — مجدول بنمط cron | متوسطة | Datasets، API، webhooks |
| Browse AI | نعم — روبوتات مراقبة | سهلة | CSV، JSON، Sheets، Airtable، تكاملات |
| PRAW + cron | افعلها بنفسك فقط | صعبة (خادم، صيانة) | أي شيء تبرمجه |
| Octoparse | نعم (في الخطط المدفوعة) | متوسطة | CSV، Excel، JSON، قواعد بيانات، Sheets |
| ParseHub | نعم (في الخطط المدفوعة) | متوسطة | CSV، JSON، API |
يتيح لك Thunderbit المجدول أن تكتب شيئًا مثل "كل يوم اثنين الساعة 9 صباحًا"، ثم تدخل روابط الـ subreddit وتضغط جدولة. تُصدَّر البيانات تلقائيًا إلى Sheets أو Airtable أو Notion، بحيث يستطيع فريقك إعداد التنبيهات أو لوحات المعلومات من دون لمس الأداة مرة أخرى. ولمزيد من المعلومات عن أتمتة جمع بيانات الويب، كتبنا دليلًا منفصلًا.
مقارنة جنبًا إلى جنب: جميع أدوات Reddit الـ 12 في لمحة
| الأداة | النهج | هل يتطلب كودًا | هل يتعامل مع قيود API؟ | التعليقات المتداخلة | الطبقة المجانية | بداية التسعير | الأفضل لـ |
|---|---|---|---|---|---|---|---|
| Thunderbit | أداة استخراج عبر المتصفح/السحابة بالذكاء الاصطناعي | لا | نعم | قوي (قالب التعليقات + الصفحات الفرعية) | نعم | مجاني / حوالي 9 دولارات شهريًا | فرق الأعمال غير التقنية |
| Apify | منصة Actors | منخفض | نعم | جزئي إلى قوي | نعم (أرصدة محدودة) | حسب الـ actor / 49 دولارًا شهريًا | استخراج Reddit بكميات كبيرة |
| PRAW | غلاف API | نعم | جزئي | نعم | نعم | مجاني | المطورون، علماء البيانات |
| Octoparse | أداة استخراج مرئية | لا | نعم | أفضل من المعتاد، لكنه غير مثالي | نعم | حوالي 69–75 دولارًا شهريًا | استخراج بدون برمجة عبر مواقع متعددة |
| Browse AI | روبوتات مراقبة | لا | نعم | جزئي | نعم | حوالي 49 دولارًا شهريًا | المراقبة والتنبيهات |
| ScrapingBee | خدمة API | منخفض | نعم | لا يوجد تفرع أصيل | نعم (1K رصيد) | 49 دولارًا شهريًا | المطورون الذين يتجنبون إدارة البروكسي |
| Scrapy | إطار عمل بايثون | نعم | لا (افعلها بنفسك) | نعم (إذا بنيتها) | نعم | مجاني | خطوط مخصصة كاملة التحكم |
| ScrapeStorm | تطبيق سطح مكتب بالذكاء الاصطناعي | لا | نعم | جزئي | نعم | 49.99 دولارًا شهريًا | المبتدئون |
| ParseHub | أداة استخراج مرئية لسطح المكتب | لا | نعم | إمكانات تكرارية قوية | نعم (5 مشاريع) | حوالي 89 دولارًا شهريًا | الصفحات الديناميكية المعقدة |
| Firecrawl | API بيانات ويب | منخفض | نعم | جزئي | نعم (500 رصيد) | حوالي 16 دولارًا شهريًا | خطوط AI/LLM |
| Oxylabs | API استخراج ويب + بروكسيات | منخفض–متوسط | نعم | جزئي | تجربة (2K نتيجة) | 49 دولارًا شهريًا | النطاق المؤسسي |
| ScrapeGraphAI | معتمد على أوامر الذكاء الاصطناعي | منخفض–متوسط | نعم | جزئي | نعم (50 رصيد) | حوالي 17 دولارًا شهريًا | سير عمل ذكاء اصطناعي يبدأ بالأوامر |
تظهر بعض الأنماط بوضوح. أدوات بدون برمجة تكسب في السرعة وسهولة الوصول. الأدوات المعتمدة على الكود تكسب في التخصيص. وأدوات API السحابية تكسب في التوسع.
بالنسبة إلى العمق الخاص بـ Reddit — خاصة التعليقات المتداخلة — فإن عددًا قليلًا فقط من الأدوات يقدم النتائج فعلًا: PRAW، وdeep scraper في Apify، وقالب التعليقات في Thunderbit، واستخراج ParseHub التكراري.
كيف تختار أفضل أداة استخراج Reddit لفريقك
بعد اختبار الأدوات الـ 12 كلها، هذا هو ترتيبي لها:
- فريق مبيعات أو تسويق بلا مطورين؟ ابدأ بـ Thunderbit أو Browse AI. Thunderbit هو الأسرع للاستخراج لمرة واحدة وللاستخراج المجدول؛ وBrowse AI هو الأقوى للتنبيهات والمراقبة.
- تحتاج بيانات subreddit بكميات كبيرة مع بعض الموارد التقنية؟ Apify أو Oxylabs. منظومة Actors في Apify تمنحك خيارات خاصة بـ Reddit؛ بينما توفر Oxylabs بنية تحتية بمستوى مؤسسي.
- مطور يبني خطوطًا مخصصة؟ PRAW أو Scrapy. PRAW لسير العمل المعتمد على API أولًا؛ وScrapy للزحف الكامل التحكم. فقط ضع في الحسبان الصيانة وإدارة حدود المعدل.
- بيانات Reddit لتطبيقات الذكاء الاصطناعي/LLM؟ Firecrawl أو ScrapeGraphAI أو واجهة Thunderbit. يتفوق Firecrawl في إخراج Markdown لـ RAG؛ وScrapeGraphAI ممتاز للاستخراج القائم على الأوامر.
- مراقبة وتنبيهات مستمرة؟ Thunderbit Scheduled Scraper أو Browse AI أو جداول Apify.
ملاحظة سريعة حول الاعتبارات القانونية والأخلاقية
شروط Reddit الآن أكثر صرامة. الاستخدام التجاري للـ API يتطلب موافقة، وPushshift لم يعد أرشيفًا عامًا، وReddit رفعت فعلًا دعاوى على شركات بسبب الاستخراج غير المصرح به. استخراج الصفحات العامة ممكن تقنيًا، لكن مخاطر السياسات حقيقية. إذا كان فريقك يجمع بيانات شخصية، أو يخزن محتوى محذوفًا، أو يبني مراقبة تجارية على نطاق واسع، فالمراجعة القانونية أمر مستحسن. احترم دائمًا اتفاقية مستخدم Reddit وشروط المطورين.
الخلاصة
بيانات Reddit أكثر قيمة من أي وقت مضى — وأصعب وصولًا من أي وقت مضى. الأدوات التي كانت تعمل في 2022 لا تعمل كلها في 2026.
النهج المعتمد على API أولًا أصبح الآن مقيدًا بحدود المعدل والقيود التجارية. وأصبحت أدوات الاستخراج عبر المتصفح والسحابة الخيار العملي الافتراضي لمعظم فرق الأعمال.
إذا أردت أن ترى شكل استخراج Reddit الحديث من دون كتابة سطر كود واحد، فجرّب النسخة المجانية من Thunderbit. وإذا لم يكن Thunderbit مناسبًا تمامًا، فاختبر بضع أدوات أخرى من هذه القائمة. أفضل أداة استخراج هي التي تمنحك البيانات التي تحتاجها فعلًا، في الوقت المحدد، من دون أن تلتهم عطلة نهاية الأسبوع.
استخراج موفق — ونتمنى أن تظل أشجار التعليقات لديك دائمًا مفتوحة بالكامل.
جرّب Thunderbit لاستخراج بيانات Reddit Get Started Free
الأسئلة الشائعة
1. هل من القانوني استخراج بيانات Reddit في 2026؟
تقيّد اتفاقية مستخدم Reddit وشروط المطورين الاستخراج بوضوح من دون موافقة خطية، كما أن الاستخدام التجاري للـ API يتطلب موافقة. وقد رفعت Reddit دعاوى على شركات مثل Anthropic وPerplexity بسبب الاستخدام غير المصرح به للبيانات. الوصول إلى الصفحات العامة ممكن تقنيًا، لكن مخاطر السياسة والتقاضي حقيقية. إذا كنت تستخرج على نطاق واسع أو لأغراض تجارية، فالمراجعة القانونية فكرة جيدة.
2. هل يمكن استخراج Reddit من دون برمجة؟
نعم. أقوى الخيارات بدون برمجة في 2026 هي Thunderbit وBrowse AI وOctoparse وScrapeStorm وParseHub. تدفق Thunderbit بالذكاء الاصطناعي من خطوتين هو أسرع طريق للمستخدمين غير التقنيين — من دون مفاتيح API، ومن دون إعداد، ومن دون سكربتات.
3. ما أفضل أداة مجانية لاستخراج Reddit؟
للمطورين، لا يزال PRAW أفضل خيار مجاني يعتمد على الكود (مع مراعاة قيود الـ API). وللمستخدمين غير التقنيين، توفر Thunderbit وBrowse AI وOctoparse طبقات مجانية مفيدة. تمنحك Thunderbit 6 صفحات مجانية مع تصدير كامل إلى Sheets وExcel وAirtable وNotion.
4. كيف أتجاوز حد Reddit البالغ 1,000 منشور؟
عمومًا لا يمكنك تجاوزه بشكل نظيف عبر الـ API الرسمي — فذلك السقف لا يزال قيدًا عمليًا لسير عمل الـ API من نوع القوائم. الاستخراج عبر المتصفح (Thunderbit، Octoparse)، أو طرق الـ actor السحابية (Apify)، أو الاستعلامات الأضيق والأكثر استهدافًا هي البدائل الأكثر واقعية. أما بالنسبة إلى البيانات التاريخية العميقة، فحل Pushshift القديم لم يعد متاحًا.
5. هل يمكنني استخراج تعليقات Reddit مع المنشورات أيضًا؟
نعم، لكن الجودة تختلف كثيرًا بين الأدوات. يمكن لـ PRAW اجتياز أشجار التعليقات كاملة (على حساب حدود معدل الـ API). أداة Reddit Comments Deep Scraper في Apify مصممة خصيصًا لهذا الغرض. كما أن قالب تعليقات Reddit في Thunderbit واستخراج الصفحات الفرعية يخرجان سلسلة التعليقات المعروضة كاملة من صفحات المنشور الفردية. ويمكن لاستخراج ParseHub التكراري أيضًا التعامل مع التعليقات المتداخلة إذا ضُبط بعناية.
تعرّف أكثر


