Facebook Scraper على GitHub: ما الذي لا يزال يعمل وما الذي لم يعد يعمل

آخر تحديث في August 5, 2026
Facebook Scraper على GitHub: ما الذي لا يزال يعمل وما الذي لم يعد يعمل

يؤدي البحث في GitHub عن "facebook scraper" إلى ظهور 475 مستودعًا. لكن 62 فقط منها تم تحديثها خلال الأشهر الستة الأخيرة.

هذه الفجوة بين "موجود" و"يعمل فعلًا" تلخّص واقع scraping فيسبوك على GitHub في 2026.

قضيت وقتًا طويلًا أراجع تبويبات المشكلات في المستودعات، وشكاوى Reddit، والنتائج الفعلية التي تخرجها هذه الأدوات. النمط واضح: أغلب المشاريع ذات التقييمات العالية تعطلت بهدوء، والمشرفون عليها ابتعدوا، وFacebook يواصل تشديد دفاعاته ضد scraping. المطورون والمستخدمون التجاريون يرجعون دائمًا إلى نتائج البحث نفسها، يثبتون المستودعات نفسها، ثم يصطدمون بالمخرجات الفارغة نفسها. هذه المقالة هي مراجعة واقعية لعام 2026 — فحص صريح للمستودعات التي ما زالت تستحق وقتك، وما الذي يفعله Facebook لكسرها، ومتى عليك أن تتجاوز GitHub بالكامل.

لماذا يبحث الناس عن Facebook Scraper على GitHub؟

حالات الاستخدام وراء هذا البحث هي نفسها منذ سنوات — حتى لو كانت الأدوات نفسها تتعطل باستمرار:

  • توليد العملاء المحتملين: استخراج معلومات التواصل من صفحات الأعمال مثل البريد الإلكتروني وأرقام الهاتف والعنوان
  • مراقبة Marketplace: تتبع المنتجات والأسعار ومعلومات البائعين لأغراض التجارة الإلكترونية أو المراجحة
  • البحث داخل المجموعات: أرشفة المنشورات والتعليقات لأبحاث السوق أو OSINT أو إدارة المجتمعات
  • أرشفة المحتوى والمنشورات: حفظ منشورات الصفحات العامة والتفاعلات والصور والطوابع الزمنية
  • تجميع الفعاليات: سحب عناوين الفعاليات والتواريخ والمواقع والمنظمين

جاذبية GitHub واضحة: كود ظاهر، تكلفة صفرية، صيانة من المجتمع نظريًا، وتحكم كامل في الحقول وخطوط المعالجة.

لكن المشكلة أن عدد النجوم والـ forks لا يعني أن المشروع ما زال يعمل. من بين أفضل 10 مستودعات تطابق العبارة حرفيًا بحسب عدد النجوم، كانت جميعها متقادمة بأكثر من 12 شهرًا حتى أبريل 2026. هذا ليس استثناءً — بل هو القاعدة.

أحد مستخدمي Reddit كتب بصراحة في نقاش نوفمبر 2025 بعد ستة أشهر من المحاولة: كان الأمر "مستحيلًا دون دفع المال لتطبيق خارجي لاستخراج البيانات" أو استخدام Python مع JavaScript rendering وقدرة حوسبة كبيرة. ومستخدم آخر لخّص الأمر في نقاش أبريل 2026 بقوله: "Facebook من أصعب المنصات في scraping لأنه يحظر الأتمتة بشكل عدواني"، وأن أتمتة المتصفح "هشّة لأن Facebook يغيّر DOM باستمرار".

حالات الاستخدام حقيقية. والطلب حقيقي. والإحباط حقيقي جدًا. وباقي المقالة يدور حول كيفية التعامل مع هذه الفجوة.

ما المقصود بمستودع Facebook Scraper على GitHub؟

الـ "Facebook scraper" على GitHub هو سكربت مفتوح المصدر — غالبًا بلغة Python — يستخرج برمجيًا البيانات العامة من صفحات Facebook أو المنشورات أو المجموعات أو Marketplace أو الملفات الشخصية. لكن ليست كلها تعمل بالطريقة نفسها. هناك ثلاث بنى هي الأكثر شيوعًا:

Scrapers تعتمد على أتمتة المتصفح مقابل تغليفات API مقابل Scrapers تعتمد على HTTP مباشر

الأسلوبالهيكل التقني الشائعنقطة القوةنقطة الضعف
أتمتة المتصفحSelenium, Playwright, Puppeteerتتعامل مع صفحات تسجيل الدخول وتُحاكي سلوك المستخدم الحقيقيبطيئة، تستهلك موارد كبيرة، ويسهل رصدها إذا لم تُضبط بعناية
تغليف API الرسميMeta Graph API / Pages APIمستقر وموثّق ومتوافق عند الحصول على الموافقاتمقيّد بشدة — معظم بيانات المنشورات/المجموعات العامة لم تعد متاحة
Scraper عبر HTTP مباشرrequests، تحليل HTML، نقاط نهاية غير موثقةسريع وخفيف عندما يعمليتعطل كلما غيّر Facebook بنية الصفحة أو إجراءات مكافحة البوت

kevinzg/facebook-scraper هو المثال الكلاسيكي على scraping عبر HTTP المباشر: فهو يقرأ الصفحات العامة "من دون مفتاح API" باستخدام الطلبات المباشرة وتحليل المحتوى. أما apurvmishra99/facebook-scraper-selenium فهو مثال على أتمتة المتصفح. بينما minimaxir/facebook-page-post-scraper يمثّل عصر Graph API القديم، حين كانت السكربتات قادرة على سحب منشورات الصفحات والمجموعات عبر واجهات رسمية لم تعد متاحة على نطاق واسع.

البيانات المستهدفة الشائعة عبر هذه المستودعات تشمل نص المنشور، والطوابع الزمنية، وأعداد التفاعلات/التعليقات، وروابط الصور، وبيانات الصفحة (الفئة، الهاتف، البريد الإلكتروني، عدد المتابعين)، وحقول Marketplace، وبيانات المجموعات أو الفعاليات.

في 2026، المفاضلة الحقيقية ليست بين لغات البرمجة، بل بين أنواع الفشل التي يمكنك التعايش معها.

مراجعة حداثة Facebook Scraper على GitHub في 2026: ما المستودعات التي ما زالت تعمل فعلًا؟

قمت بمراجعة أشهر وأبرز مستودعات Facebook scraper على GitHub مقابل بيانات 2026 الفعلية — ليس وعود README، بل تواريخ آخر commit، وصفوف المشكلات، وتقارير المجتمع. وهذه هي الفقرة الأهم.

جدول المراجعة الكامل للحداثة

المستودعالنجومآخر تحديثالمشكلات المفتوحةاللغة / بيئة التشغيلما يزال يستخرجالحالة
kevinzg/facebook-scraper3,1572024-06-22438Python ^3.6عدد محدود من منشورات الصفحات العامة، وبعض التعليقات/الصور، وبيانات الصفحة⚠️ متعطل جزئيًا / متقادم
moda20/facebook-scraper1102024-06-1429Python ^3.6نفس kevinzg + دوال مساعدة لـ Marketplace⚠️ متعطل جزئيًا / نسخة متفرعة متقادمة
minimaxir/facebook-page-post-scraper2,1282019-05-2353حقبة Python 2/3، يعتمد على Graph APIمرجع تاريخي فقط❌ مهجور
apurvmishra99/facebook-scraper-selenium2322020-06-287Python + Seleniumأتمتة متصفح لعمل scraping للصفحات❌ مهجور
passivebot/facebook-marketplace-scraper3752024-04-293Python 3.x + Playwright 1.40قوائم Marketplace عبر أتمتة المتصفح⚠️ هش / متخصص
Mhmd-Hisham/selenium_facebook_scraper372022-11-291Python + Seleniumscraping عام باستخدام Selenium❌ مهجور
anabastos/faceteer202023-07-115JavaScriptموجّه للأتمتة❌ مخاطرة / أدلة ضعيفة

هناك عدة نقاط واضحة:

  • حتى "النسخة المتفرعة النشطة" (moda20) لم تُحدّث منذ يونيو 2024.
  • صفوف المشكلات تكشف الواقع أسرع من ملفات README.
  • كل من kevinzg وmoda20 ما زالا يصرّحان بـ Python ^3.6 في ملفات pyproject.toml الخاصة بهما — وهي إشارة إلى أن الأساس البرمجي لم يُحدَّث.

kevinzg/facebook-scraper

أشهر Facebook scraper بلغة Python على GitHub. يصف README كيفية استخراج صفحات وصفحات المجموعات، وتسجيل الدخول عبر البيانات أو cookies، وحقول على مستوى المنشور مثل comments وimage وimages وlikes وpost_id وpost_text وtext وtime.

لكن الإشارة التشغيلية ضعيفة:

  • آخر تحديث: 22 يونيو 2024
  • المشكلات المفتوحة: 438 — ومنها عناوين مثل "Example Scrape does not return any posts"
  • المشرف لم يعد يرد على المشكلات الحديثة

الخلاصة: متعطل جزئيًا. ما يزال مفيدًا لتجارب صغيرة على الصفحات العامة وللرجوع إلى أسماء الحقول، لكنه غير موثوق للاستخدام الإنتاجي.

moda20/facebook-scraper (نسخة مجتمعية متفرعة)

أشهر fork من kevinzg، مع خيارات إضافية ودوال مساعدة موجهة إلى Marketplace مثل extract_listing، كما هو موضح في README.

لكن صفحة المشكلات تشرح التعطل بوضوح:

عندما تتغير الواجهة المبسطة mbasic أو تختفي، يتعطل معها عدد كبير من scrapers دفعة واحدة.

الخلاصة: أبرز fork، لكنه أيضًا متقادم وهش في 2026. يستحق التجربة أولًا إذا كنت مصرًا على حل من GitHub، لكن لا تتوقع الاستقرار.

minimaxir/facebook-page-post-scraper

كان في وقت ما أداة عملية جدًا تعتمد على Graph API لجلب المنشورات والتفاعلات والتعليقات والبيانات الوصفية من الصفحات العامة والمجموعات المفتوحة إلى CSV. وما زال README يشرح كيفية استخدام App ID وApp Secret لتطبيق Facebook.

لكن في 2026 أصبح أثرًا تاريخيًا:

  • آخر تحديث: 23 مايو 2019
  • المشكلات المفتوحة: 53 — ومنها "HTTP 400 Error Bad Request" و"No data retrieved!!"

الخلاصة: مهجور. مرتبط بشدة بنموذج صلاحيات API الذي ضيّقته Meta لاحقًا بشكل كبير.

مستودعات أخرى جديرة بالذكر

  • passivebot/facebook-marketplace-scraper: مفيد لحالات Marketplace، لكن صفحة المشكلات تتضمن "login to view the content" و"CSS selectors outdated" و"Getting blocked." هذا يختصر ما الذي ينهار في scraping Marketplace.
  • apurvmishra99/facebook-scraper-selenium: لديه مشكلة واحدة تسأل حرفيًا "Does it work with new Facebook layout?" منذ سبتمبر 2020. وهذا يكفي لفهم الوضع.
  • Mhmd-Hisham/selenium_facebook_scraper و anabastos/faceteer: لا يوجد نشاط حديث كافٍ يمنح الثقة.

facebook_scraper_repo_audit_v1.png

دفاعات Facebook ضد scraping: ما الذي يواجهه كل scraper على GitHub؟

معظم المقالات في هذا الموضوع تكتفي بتحذير عام من شروط الاستخدام. وهذا غير مفيد.

Facebook لديه واحد من أكثر أنظمة مكافحة scraping صرامة بين المنصات الكبرى. وفهم طبقات الدفاع المحددة هو ما يصنع الفارق بين scraper يعمل وبين فترة بعد الظهر مليئة بالمخرجات الفارغة.

تشرح Meta في مقالة هندسية من فبراير 2025 وجود "فريق مكافحة scraping" يستخدم التحليل الساكن عبر قاعدة الكود لتحديد مسارات scraping، ويرسل خطابات وقف وكف، ويعطّل الحسابات، ويعتمد على أنظمة تحديد المعدل. هذا ليس افتراضًا — بل التزام تنظيمي فعلي.

facebook_scraper_defense_layers_v1.png

تغيّر عشوائي في DOM وأسماء CSS

يتعمد Facebook تغيير معرفات عناصر HTML وأسماء الفئات وبنية الصفحة. وكما قال أحد المعلّقين في r/webscraping: "لا يمكن لأي scraper عادي أن يعمل على Facebook. HTML يتغير بين عملية تحديث وأخرى."

ما الذي يتعطل: محددات XPath وCSS التي كانت تعمل الأسبوع الماضي تعود اليوم بلا شيء.

طريقة المواجهة: استخدم محددات تعتمد على النص أو السمات عندما يكون ذلك ممكنًا. والتحليل المعتمد على الذكاء الاصطناعي الذي يقرأ محتوى الصفحة بدلًا من الاعتماد على محددات جامدة يتعامل مع هذه المشكلة بشكل أفضل. وتوقّع أن صيانة المحددات ستكون تكلفة متكررة.

جدران تسجيل الدخول وإدارة الجلسات

كثير من أجزاء Facebook — الملفات الشخصية، المجموعات، وبعض قوائم Marketplace — تتطلب تسجيل الدخول لعرض المحتوى. المتصفحات headless قد تُعاد توجيهها أو تحصل على HTML مبسّط. وصف مستخدمو passivebot Marketplace scraper في صفحة المشكلات مشكلة "login to view the content" بأنها من أبرز الشكاوى.

ما الذي يتعطل: الطلبات المجهولة تفقد المحتوى أو تُعاد توجيهها بالكامل.

طريقة المواجهة: استخدم ملفات تعريف الارتباط للجلسة من جلسة متصفح حقيقية، أو أدوات scraping تعتمد على المتصفح وتعمل ضمن جلسة تسجيل دخولك. تدوير الحسابات ممكن لكنه محفوف بالمخاطر.

البصمة الرقمية

تقول مقالة Meta الهندسية إن scrapers غير المصرح بها "غالبًا ما تُخفي نفسها عبر محاكاة الطرق التي يستخدم بها الأشخاص المنتج عادةً" — وهذا عمليًا يعني أن جودة المتصفح وجودة السلوك عاملان أساسيان في الرصد. وتستمر نقاشات المجتمع في مارس وأبريل 2026 في التوصية بمتصفحات anti-detect وبصمات متسقة.

ما الذي يتعطل: إعدادات Selenium أو Puppeteer القياسية تُرصد بسهولة.

طريقة المواجهة: استخدم أدوات مثل undetected-chromedriver أو ملفات تعريف متصفح anti-detect. الجلسات الواقعية والبصمات المتسقة أهم من مجرد تغيير user-agent.

تحديد المعدل والحظر عبر IP

تشير مقالة Meta الهندسية صراحةً إلى تحديد المعدل كجزء من استراتيجية الدفاع، بما في ذلك وضع حدود على قوائم المتابعين لفرض مزيد من الطلبات التي تؤدي بدورها إلى تفعيل قيود المعدل. عمليًا، يذكر المستخدمون أنهم يتعرضون لتحديد المعدل بعد النشر في 10 مجموعات بفاصل 10 ثوانٍ.

ما الذي يتعطل: الطلبات الكبيرة من نفس عنوان IP تُبطأ أو تُحظر خلال دقائق. وغالبًا ما تكون عناوين IP الخاصة بسيرفرات البيانات المحجوبة مسبقًا.

طريقة المواجهة: تدوير proxies سكنية، وليس proxies مراكز البيانات، مع وتيرة طلبات معقولة.

تغييرات مخطط GraphQL

بعض scrapers تعتمد على نقاط GraphQL الداخلية في Facebook لأنها تعطي بيانات منظمة أنظف من HTML الخام. لكن Meta لا تقدّم ضمانًا للاستقرار في GraphQL الداخلي، لذا تتعطل هذه الاستعلامات بصمت — وتعود ببيانات فارغة بدلًا من رسائل خطأ.

ما الذي يتعطل: الاستخراج المنظم يعود بلا شيء دون تحذير.

طريقة المواجهة: أضف فحوصات تحقق، وراقب نقاط المخطط، وثبّت على الاستعلامات المعروفة بأنها تعمل. وتوقّع الصيانة.

ملخص دفاعات مكافحة scraping

طبقة الدفاعكيف تكسر scraper الخاص بكالإجراء العملي المقابل
تغيّر الواجهة / عدم استقرار المحدداتXPath وCSS يعودان بلا نتائج أو بحقول جزئيةفضّل نقاط ارتكاز مرنة، وحقق من المخرجات المرئية، وتوقّع الصيانة
جدران تسجيل الدخولالطلبات غير المسجلة تفقد المحتوى أو تُعاد توجيههااستخدم cookies جلسة صالحة أو أدوات تعمل ضمن جلسة متصفح
البصمة الرقميةالأتمتة القياسية تبدو مصطنعةاستخدم متصفحات حقيقية، وجودة جلسة متسقة، وإجراءات anti-detect
تحديد المعدلمخرجات فارغة، وحظر، وتباطؤأبطئ الوتيرة، قلّل حجم الدُفعات، ودوّر proxies سكنية
تغييرات الاستعلامات الداخليةالاستخراج المنظم يعود ببيانات فارغة بصمتأضف فحوصات تحقق، وتوقع صيانة للاستعلامات

عندما تفشل مستودعات GitHub: اختر بديلًا مسموحًا

المستودع المعطّل ليس سببًا للبحث عن التفاف آخر حول ضوابط المنصة. ابدأ أولًا بتوضيح السؤال التجاري: هل تحتاج تحليلات على مستوى الصفحة، أو شفافية إعلانية، أو دليل تواصل عام، أو كتالوج منتجات؟ كثير من هذه الاحتياجات يمكن تلبيتها عبر منتج رسمي من Meta، أو API مصرح به، أو مصدر عام غير تابع لـ Meta.

على سبيل المثال، استخدم Graph API فقط عندما يملك التطبيق وحالة الاستخدام الصلاحيات المطلوبة، واستخدم برامج Meta البحثية فقط عندما تكون مؤهلًا لها، واستفد من Meta Ad Library فقط للمعلومات الإعلانية التي تتيحها. أما لأبحاث العملاء المحتملين والأسعار واكتشاف الأعمال المحلية، فغالبًا ما يكون الأفضل الاعتماد على مواقع عامة مستقلة يمكن تقييم شروطها والتزاماتها المتعلقة بالخصوصية مباشرة.

أمثلة فعلية للمخرجات: ماذا ستحصل عليه فعلًا؟

كل مقالة منافسة تعرض snippets من الكود لكنها لا تعرض المخرجات الفعلية. فيما يلي ما يمكن توقعه واقعيًا من كل أسلوب.

مثال مخرجات: kevinzg/facebook-scraper (أو fork نشط)

من مثال README، قد يعيد المنشور العام scraped JSON مثل:

{
  "comments": 459,
  "comments_full": null,
  "image": "https://...",
  "images": ["https://..."],
  "likes": 3509,
  "post_id": "2257188721032235",
  "post_text": "Don't let this diminutive version...",
  "text": "Don't let this diminutive version...",
  "time": "2019-04-30T05:00:01"
}

لاحظ الحقول القابلة لأن تكون null مثل comments_full. في 2026، توقّع أن تعود حقول أكثر فارغة أو مفقودة — وهذا غالبًا إشارة إلى الحظر، لا مجرد خلل عابر. المخرجات خام JSON وتحتاج إلى معالجة لاحقة.

مثال مخرجات: Facebook Graph API

توثّق Pages API الحالية من Meta طلبات معلومات الصفحة مثل GET /<PAGE_ID>?fields=id,name,about,fan_count. وتشمل مرجعية Page حقولًا مثل followers_count وfan_count وcategory وemails وphone وبيانات عامة أخرى — ولكن فقط مع الصلاحيات المناسبة مثل Page Public Content Access أو Page Public Metadata Access.

وهذا نطاق بيانات أضيق بكثير مما يتوقعه معظم مستخدمي scrapers على GitHub. فهو يركز على الصفحة، ومقيّد بالصلاحيات، وليس بديلًا عن scraping عشوائي للمنشورات العامة أو المجموعات.

مصفوفة أنواع بيانات Facebook × مسار الوصول

نوع بيانات Facebookنقطة البداية الأفضلالقيد الأساسي
الأصول التي تديرها مؤسستكأدوات الإدارة الرسمية من Meta وواجهات API المعتمدةتختلف الصلاحيات والحقول المتاحة
الملاحظات الإعلانيةMeta Ad Libraryاستخدم فقط الحقول والفلاتر التي توفرها
تفاصيل الأعمال العامة اللازمة لأبحاث العملاء المحتمليندليل عام غير تابع لـ Meta أو موقع ناشر مسموح بهتحقّق من شروط المصدر والتزاماته المتعلقة بالخصوصية
المحتوى الخاص أو المحتوى المغلق على مجموعات أو المحتوى المحجوب بتسجيل الدخول أو المخصص للحسابات فقطلا تُؤتمت جمعهابحث عن مسار مصرح به بدلًا من ذلك

خطوة بخطوة: كيف تُعد Facebook Scraper من GitHub عندما يكون ذلك منطقيًا

إذا قرأت مراجعة الحداثة وما زلت تريد المسار عبر GitHub، فهذا مفهوم. إليك الطريق العملي — مع ملاحظات صريحة حول أماكن التعطل.

facebook_scraper_setup_flow_v1.png

الخطوة 1: اختر المستودع المناسب (اعتمد على مراجعة الحداثة)

ارجع إلى جدول المراجعة. اختر أقل مستودع تقادمًا يتوافق مع السطح الذي تستهدفه. قبل تثبيت أي شيء، افتح تبويب Issues — عناوين المشكلات الحديثة تخبرك عن الوظيفة الحالية أكثر من README.

الخطوة 2: جهّز بيئة Python

python3 -m venv fb-scraper-env
source fb-scraper-env/bin/activate
pip install -r requirements.txt

مشكلة شائعة: تعارض الإصدارات مع التبعيات، خصوصًا Selenium وPlaywright. كل من kevinzg وmoda20 يصرّحان بـ Python ^3.6 في ملف pyproject.toml — وهو أساس قديم قد يتعارض مع المكتبات الحديثة. أما scraper الخاص بـ Marketplace في passivebot فيثبت playwright==1.40.0، وهذا مناسب للتجارب لكنه ليس دليلًا على المتانة.

الخطوة 3: اضبط proxies ومقاومة الرصد

إذا كنت ستتجاوز الاختبار السريع:

  • أعدد تدوير proxies سكنية (وابحث عن مزوّدين لديهم مجموعات عناوين IP خاصة بـ Facebook)
  • إذا كنت تستخدم أتمتة المتصفح، ثبّت undetected-chromedriver أو اضبط anti-fingerprinting
  • لا تتجاوز هذه الخطوة — Selenium أو Puppeteer العاديان يُرصدان بسرعة

الخطوة 4: نفّذ اختبار scraping صغيرًا وراجِع المخرجات

ابدأ بصفحة عامة واحدة، لا بدفعة كبيرة. افحص المخرجات بعناية:

  • الحقول الفارغة أو البيانات المفقودة تعني غالبًا أن دفاعات Facebook تحجبك
  • قارِن المخرجات بما تراه فعلًا في المتصفح
  • نجاح اختبار صفحة واحدة أهم من README جميل

الخطوة 5: تعامل مع الأخطاء، وتحديد المعدل، والصيانة

  • أضف منطق إعادة المحاولة ومعالجة الأخطاء
  • توقّع تحديث المحددات أو الإعدادات بانتظام — هذه صيانة مستمرة، وليست إعدادًا يُنسى
  • إذا وجدت نفسك تقضي وقتًا في صيانة scraper أكثر من استخدام البيانات، فهذه إشارة لإعادة التفكير في المسار no-code

الاعتبارات القانونية والأخلاقية في scraping Facebook

قد تنطبق شروط المنصة وقواعد الخصوصية والالتزامات التعاقدية وقوانين حماية البيانات. ظهور المحتوى للعامة لا يعني بالضرورة الإذن بجمعه آليًا. اجعل البيانات في حدها الأدنى، ووثّق الغرض والأساس القانوني، واستشر محاميًا في حال المشاريع التجارية أو واسعة النطاق.

لا تعتبر إضافة متصفح، أو جلسة مسجّلة الدخول، أو وسم "public" تصريحًا لأتمتة جمع البيانات من منتجات Meta.

أهم النقاط: ما الذي يعمل فعلًا مع Facebook scraping في 2026؟

نشاط المستودع، وصفوف المشكلات، وقواعد المنصة الحالية أهم من عدد النجوم أو README قديم. عندما يرتبط السؤال التجاري بأصل تديره أنت، فابدأ بأدوات Meta الرسمية وواجهات API المعتمدة. أما لأبحاث السوق والعملاء المحتملين والأسعار، فغالبًا ما يكون المصدر العام غير التابع لـ Meta أسهل في التوثيق والإدارة.

الأسئلة الشائعة

هل يوجد Facebook scraper يعمل على GitHub في 2026؟

نعم، لكن الخيارات محدودة. أبرزها هو fork moda20/facebook-scraper من المستودع الأصلي لـ kevinzg — راجع جدول المراجعة أعلاه لمعرفة الحالة الحالية. يمكنه استخراج جزء من منشورات الصفحات العامة وبعض البيانات الوصفية، لكن صف المشكلات يوضح أعطالًا أساسية مرتبطة بـ mbasic والمخرجات الفارغة. معظم المستودعات الأخرى مهجورة أو معطلة بالكامل.

هل يمكنني scraping Facebook بدون كتابة كود؟

استخدم أدوات Facebook الخاصة بالبحث والإدارة للأبحاث اليدوية. أما للأعمال المتكررة أو البرمجية، فقيّم الـ API الرسمي وصلاحياته، أو أعد تصميم سير العمل حول مصدر عام مسموح غير تابع لـ Meta. الراحة بدون كود لا تلغي التزامات المنصة أو الخصوصية أو التعاقد.

هل scraping Facebook قانوني؟

تمنع شروط خدمة Facebook جمع البيانات آليًا بدون إذن. وتطبّق Meta ذلك فعليًا عبر حظر الحسابات، وخطابات وقف وكف، ودعاوى قضائية. تختلف القانونية حسب الولاية القضائية وحالة الاستخدام. التزم ببيانات الأعمال المتاحة للعامة، وتجنب الملفات الشخصية، واستشر مستشارًا قانونيًا إذا كان الاستخدام على نطاق واسع.

ما البيانات التي ما زلت أستطيع الحصول عليها من Facebook Graph API؟

في 2026، أصبح Graph API مقيّدًا بشدة. يمكنك الوصول إلى بيانات محدودة على مستوى الصفحة — مثل id وname وabout وfan_count وemails وphone — مع الصلاحيات المناسبة مثل Page Public Metadata Access. أما معظم بيانات المنشورات العامة، وبيانات المجموعات (وقد تم إيقاف Groups API)، وبيانات المستخدمين، فلم تعد متاحة عبر API.

كم مرة تتعطل مستودعات Facebook scraper على GitHub؟

بشكل متكرر. Facebook يغيّر بنية DOM، وإجراءات مكافحة البوت، وواجهات API الداخلية باستمرار — لا توجد وتيرة معلنة، لكن تقارير المجتمع تُظهر أعطالًا كل بضعة أسابيع في scrapers النشطة. وصفقة moda20 حول اختفاء mbasic مثال حديث. إذا كنت تعتمد على مستودع GitHub، فخصص ميزانية لصيانة منتظمة وللتحقق من المخرجات.

اعرف المزيد

Ke
Ke
المدير التقني في Thunderbit | عالم بيانات أول وخبير في تعلّم الآلة بخبرة تقارب عقدًا من الزمن في تعلّم الآلة وعلم البيانات، كيه شين خريج جامعة كولومبيا وكان سابقًا عالم بيانات أول في Walmart Labs. وبفضل خبرته العميقة المعترف بها من قبل الأقران في Python وR وJava والإحصاء، يشارك رؤى مجرّبة حول نقل خوارزميات الذكاء الاصطناعي المعقدة من النظرية إلى بنية جاهزة للإنتاج.
فهرس المحتويات
Thunderbit · وكيل بيانات الويب بالذكاء الاصطناعي

استخرج البيانات من أي صفحة في بنقرة واحدة

موثوق لدى أكثر من 250,000 مستخدم
تتوفر خطة مجانية
من صفحة ويب إلى جدول بيانات
صف ما تحتاجه — ويقوم وكيل Thunderbit بالذكاء الاصطناعي باستخراجه وتصديره إلى Excel أو Google Sheets أو Airtable أو Notion. ابدأ مجانًا.
Chrome Store Rating
PRODUCT HUNT#1 Product of the Week