يؤدي البحث في GitHub عن "facebook scraper" إلى ظهور 475 مستودعًا. لكن 62 فقط منها تم تحديثها خلال الأشهر الستة الأخيرة.
هذه الفجوة بين "موجود" و"يعمل فعلًا" تلخّص واقع scraping فيسبوك على GitHub في 2026.
قضيت وقتًا طويلًا أراجع تبويبات المشكلات في المستودعات، وشكاوى Reddit، والنتائج الفعلية التي تخرجها هذه الأدوات. النمط واضح: أغلب المشاريع ذات التقييمات العالية تعطلت بهدوء، والمشرفون عليها ابتعدوا، وFacebook يواصل تشديد دفاعاته ضد scraping. المطورون والمستخدمون التجاريون يرجعون دائمًا إلى نتائج البحث نفسها، يثبتون المستودعات نفسها، ثم يصطدمون بالمخرجات الفارغة نفسها. هذه المقالة هي مراجعة واقعية لعام 2026 — فحص صريح للمستودعات التي ما زالت تستحق وقتك، وما الذي يفعله Facebook لكسرها، ومتى عليك أن تتجاوز GitHub بالكامل.
لماذا يبحث الناس عن Facebook Scraper على GitHub؟
حالات الاستخدام وراء هذا البحث هي نفسها منذ سنوات — حتى لو كانت الأدوات نفسها تتعطل باستمرار:
- توليد العملاء المحتملين: استخراج معلومات التواصل من صفحات الأعمال مثل البريد الإلكتروني وأرقام الهاتف والعنوان
- مراقبة Marketplace: تتبع المنتجات والأسعار ومعلومات البائعين لأغراض التجارة الإلكترونية أو المراجحة
- البحث داخل المجموعات: أرشفة المنشورات والتعليقات لأبحاث السوق أو OSINT أو إدارة المجتمعات
- أرشفة المحتوى والمنشورات: حفظ منشورات الصفحات العامة والتفاعلات والصور والطوابع الزمنية
- تجميع الفعاليات: سحب عناوين الفعاليات والتواريخ والمواقع والمنظمين
جاذبية GitHub واضحة: كود ظاهر، تكلفة صفرية، صيانة من المجتمع نظريًا، وتحكم كامل في الحقول وخطوط المعالجة.
لكن المشكلة أن عدد النجوم والـ forks لا يعني أن المشروع ما زال يعمل. من بين أفضل 10 مستودعات تطابق العبارة حرفيًا بحسب عدد النجوم، كانت جميعها متقادمة بأكثر من 12 شهرًا حتى أبريل 2026. هذا ليس استثناءً — بل هو القاعدة.
أحد مستخدمي Reddit كتب بصراحة في نقاش نوفمبر 2025 بعد ستة أشهر من المحاولة: كان الأمر "مستحيلًا دون دفع المال لتطبيق خارجي لاستخراج البيانات" أو استخدام Python مع JavaScript rendering وقدرة حوسبة كبيرة. ومستخدم آخر لخّص الأمر في نقاش أبريل 2026 بقوله: "Facebook من أصعب المنصات في scraping لأنه يحظر الأتمتة بشكل عدواني"، وأن أتمتة المتصفح "هشّة لأن Facebook يغيّر DOM باستمرار".
حالات الاستخدام حقيقية. والطلب حقيقي. والإحباط حقيقي جدًا. وباقي المقالة يدور حول كيفية التعامل مع هذه الفجوة.
ما المقصود بمستودع Facebook Scraper على GitHub؟
الـ "Facebook scraper" على GitHub هو سكربت مفتوح المصدر — غالبًا بلغة Python — يستخرج برمجيًا البيانات العامة من صفحات Facebook أو المنشورات أو المجموعات أو Marketplace أو الملفات الشخصية. لكن ليست كلها تعمل بالطريقة نفسها. هناك ثلاث بنى هي الأكثر شيوعًا:
Scrapers تعتمد على أتمتة المتصفح مقابل تغليفات API مقابل Scrapers تعتمد على HTTP مباشر
| الأسلوب | الهيكل التقني الشائع | نقطة القوة | نقطة الضعف |
|---|---|---|---|
| أتمتة المتصفح | Selenium, Playwright, Puppeteer | تتعامل مع صفحات تسجيل الدخول وتُحاكي سلوك المستخدم الحقيقي | بطيئة، تستهلك موارد كبيرة، ويسهل رصدها إذا لم تُضبط بعناية |
| تغليف API الرسمي | Meta Graph API / Pages API | مستقر وموثّق ومتوافق عند الحصول على الموافقات | مقيّد بشدة — معظم بيانات المنشورات/المجموعات العامة لم تعد متاحة |
| Scraper عبر HTTP مباشر | requests، تحليل HTML، نقاط نهاية غير موثقة | سريع وخفيف عندما يعمل | يتعطل كلما غيّر Facebook بنية الصفحة أو إجراءات مكافحة البوت |
kevinzg/facebook-scraper هو المثال الكلاسيكي على scraping عبر HTTP المباشر: فهو يقرأ الصفحات العامة "من دون مفتاح API" باستخدام الطلبات المباشرة وتحليل المحتوى. أما apurvmishra99/facebook-scraper-selenium فهو مثال على أتمتة المتصفح. بينما minimaxir/facebook-page-post-scraper يمثّل عصر Graph API القديم، حين كانت السكربتات قادرة على سحب منشورات الصفحات والمجموعات عبر واجهات رسمية لم تعد متاحة على نطاق واسع.
البيانات المستهدفة الشائعة عبر هذه المستودعات تشمل نص المنشور، والطوابع الزمنية، وأعداد التفاعلات/التعليقات، وروابط الصور، وبيانات الصفحة (الفئة، الهاتف، البريد الإلكتروني، عدد المتابعين)، وحقول Marketplace، وبيانات المجموعات أو الفعاليات.
في 2026، المفاضلة الحقيقية ليست بين لغات البرمجة، بل بين أنواع الفشل التي يمكنك التعايش معها.
مراجعة حداثة Facebook Scraper على GitHub في 2026: ما المستودعات التي ما زالت تعمل فعلًا؟
قمت بمراجعة أشهر وأبرز مستودعات Facebook scraper على GitHub مقابل بيانات 2026 الفعلية — ليس وعود README، بل تواريخ آخر commit، وصفوف المشكلات، وتقارير المجتمع. وهذه هي الفقرة الأهم.
جدول المراجعة الكامل للحداثة
| المستودع | النجوم | آخر تحديث | المشكلات المفتوحة | اللغة / بيئة التشغيل | ما يزال يستخرج | الحالة |
|---|---|---|---|---|---|---|
| kevinzg/facebook-scraper | 3,157 | 2024-06-22 | 438 | Python ^3.6 | عدد محدود من منشورات الصفحات العامة، وبعض التعليقات/الصور، وبيانات الصفحة | ⚠️ متعطل جزئيًا / متقادم |
| moda20/facebook-scraper | 110 | 2024-06-14 | 29 | Python ^3.6 | نفس kevinzg + دوال مساعدة لـ Marketplace | ⚠️ متعطل جزئيًا / نسخة متفرعة متقادمة |
| minimaxir/facebook-page-post-scraper | 2,128 | 2019-05-23 | 53 | حقبة Python 2/3، يعتمد على Graph API | مرجع تاريخي فقط | ❌ مهجور |
| apurvmishra99/facebook-scraper-selenium | 232 | 2020-06-28 | 7 | Python + Selenium | أتمتة متصفح لعمل scraping للصفحات | ❌ مهجور |
| passivebot/facebook-marketplace-scraper | 375 | 2024-04-29 | 3 | Python 3.x + Playwright 1.40 | قوائم Marketplace عبر أتمتة المتصفح | ⚠️ هش / متخصص |
| Mhmd-Hisham/selenium_facebook_scraper | 37 | 2022-11-29 | 1 | Python + Selenium | scraping عام باستخدام Selenium | ❌ مهجور |
| anabastos/faceteer | 20 | 2023-07-11 | 5 | JavaScript | موجّه للأتمتة | ❌ مخاطرة / أدلة ضعيفة |
هناك عدة نقاط واضحة:
- حتى "النسخة المتفرعة النشطة" (moda20) لم تُحدّث منذ يونيو 2024.
- صفوف المشكلات تكشف الواقع أسرع من ملفات README.
- كل من kevinzg وmoda20 ما زالا يصرّحان بـ Python ^3.6 في ملفات pyproject.toml الخاصة بهما — وهي إشارة إلى أن الأساس البرمجي لم يُحدَّث.
kevinzg/facebook-scraper
أشهر Facebook scraper بلغة Python على GitHub. يصف README كيفية استخراج صفحات وصفحات المجموعات، وتسجيل الدخول عبر البيانات أو cookies، وحقول على مستوى المنشور مثل comments وimage وimages وlikes وpost_id وpost_text وtext وtime.
لكن الإشارة التشغيلية ضعيفة:
- آخر تحديث: 22 يونيو 2024
- المشكلات المفتوحة: 438 — ومنها عناوين مثل "Example Scrape does not return any posts"
- المشرف لم يعد يرد على المشكلات الحديثة
الخلاصة: متعطل جزئيًا. ما يزال مفيدًا لتجارب صغيرة على الصفحات العامة وللرجوع إلى أسماء الحقول، لكنه غير موثوق للاستخدام الإنتاجي.
moda20/facebook-scraper (نسخة مجتمعية متفرعة)
أشهر fork من kevinzg، مع خيارات إضافية ودوال مساعدة موجهة إلى Marketplace مثل extract_listing، كما هو موضح في README.
لكن صفحة المشكلات تشرح التعطل بوضوح:
- "mbasic is gone"
- "CLI 'Couldn't get any posts.'"
- "https://mbasic.facebook.com is no longer working"
عندما تتغير الواجهة المبسطة mbasic أو تختفي، يتعطل معها عدد كبير من scrapers دفعة واحدة.
الخلاصة: أبرز fork، لكنه أيضًا متقادم وهش في 2026. يستحق التجربة أولًا إذا كنت مصرًا على حل من GitHub، لكن لا تتوقع الاستقرار.
minimaxir/facebook-page-post-scraper
كان في وقت ما أداة عملية جدًا تعتمد على Graph API لجلب المنشورات والتفاعلات والتعليقات والبيانات الوصفية من الصفحات العامة والمجموعات المفتوحة إلى CSV. وما زال README يشرح كيفية استخدام App ID وApp Secret لتطبيق Facebook.
لكن في 2026 أصبح أثرًا تاريخيًا:
- آخر تحديث: 23 مايو 2019
- المشكلات المفتوحة: 53 — ومنها "HTTP 400 Error Bad Request" و"No data retrieved!!"
الخلاصة: مهجور. مرتبط بشدة بنموذج صلاحيات API الذي ضيّقته Meta لاحقًا بشكل كبير.
مستودعات أخرى جديرة بالذكر
- passivebot/facebook-marketplace-scraper: مفيد لحالات Marketplace، لكن صفحة المشكلات تتضمن "login to view the content" و"CSS selectors outdated" و"Getting blocked." هذا يختصر ما الذي ينهار في scraping Marketplace.
- apurvmishra99/facebook-scraper-selenium: لديه مشكلة واحدة تسأل حرفيًا "Does it work with new Facebook layout?" منذ سبتمبر 2020. وهذا يكفي لفهم الوضع.
- Mhmd-Hisham/selenium_facebook_scraper و anabastos/faceteer: لا يوجد نشاط حديث كافٍ يمنح الثقة.

دفاعات Facebook ضد scraping: ما الذي يواجهه كل scraper على GitHub؟
معظم المقالات في هذا الموضوع تكتفي بتحذير عام من شروط الاستخدام. وهذا غير مفيد.
Facebook لديه واحد من أكثر أنظمة مكافحة scraping صرامة بين المنصات الكبرى. وفهم طبقات الدفاع المحددة هو ما يصنع الفارق بين scraper يعمل وبين فترة بعد الظهر مليئة بالمخرجات الفارغة.
تشرح Meta في مقالة هندسية من فبراير 2025 وجود "فريق مكافحة scraping" يستخدم التحليل الساكن عبر قاعدة الكود لتحديد مسارات scraping، ويرسل خطابات وقف وكف، ويعطّل الحسابات، ويعتمد على أنظمة تحديد المعدل. هذا ليس افتراضًا — بل التزام تنظيمي فعلي.

تغيّر عشوائي في DOM وأسماء CSS
يتعمد Facebook تغيير معرفات عناصر HTML وأسماء الفئات وبنية الصفحة. وكما قال أحد المعلّقين في r/webscraping: "لا يمكن لأي scraper عادي أن يعمل على Facebook. HTML يتغير بين عملية تحديث وأخرى."
ما الذي يتعطل: محددات XPath وCSS التي كانت تعمل الأسبوع الماضي تعود اليوم بلا شيء.
طريقة المواجهة: استخدم محددات تعتمد على النص أو السمات عندما يكون ذلك ممكنًا. والتحليل المعتمد على الذكاء الاصطناعي الذي يقرأ محتوى الصفحة بدلًا من الاعتماد على محددات جامدة يتعامل مع هذه المشكلة بشكل أفضل. وتوقّع أن صيانة المحددات ستكون تكلفة متكررة.
جدران تسجيل الدخول وإدارة الجلسات
كثير من أجزاء Facebook — الملفات الشخصية، المجموعات، وبعض قوائم Marketplace — تتطلب تسجيل الدخول لعرض المحتوى. المتصفحات headless قد تُعاد توجيهها أو تحصل على HTML مبسّط. وصف مستخدمو passivebot Marketplace scraper في صفحة المشكلات مشكلة "login to view the content" بأنها من أبرز الشكاوى.
ما الذي يتعطل: الطلبات المجهولة تفقد المحتوى أو تُعاد توجيهها بالكامل.
طريقة المواجهة: استخدم ملفات تعريف الارتباط للجلسة من جلسة متصفح حقيقية، أو أدوات scraping تعتمد على المتصفح وتعمل ضمن جلسة تسجيل دخولك. تدوير الحسابات ممكن لكنه محفوف بالمخاطر.
البصمة الرقمية
تقول مقالة Meta الهندسية إن scrapers غير المصرح بها "غالبًا ما تُخفي نفسها عبر محاكاة الطرق التي يستخدم بها الأشخاص المنتج عادةً" — وهذا عمليًا يعني أن جودة المتصفح وجودة السلوك عاملان أساسيان في الرصد. وتستمر نقاشات المجتمع في مارس وأبريل 2026 في التوصية بمتصفحات anti-detect وبصمات متسقة.
ما الذي يتعطل: إعدادات Selenium أو Puppeteer القياسية تُرصد بسهولة.
طريقة المواجهة: استخدم أدوات مثل undetected-chromedriver أو ملفات تعريف متصفح anti-detect. الجلسات الواقعية والبصمات المتسقة أهم من مجرد تغيير user-agent.
تحديد المعدل والحظر عبر IP
تشير مقالة Meta الهندسية صراحةً إلى تحديد المعدل كجزء من استراتيجية الدفاع، بما في ذلك وضع حدود على قوائم المتابعين لفرض مزيد من الطلبات التي تؤدي بدورها إلى تفعيل قيود المعدل. عمليًا، يذكر المستخدمون أنهم يتعرضون لتحديد المعدل بعد النشر في 10 مجموعات بفاصل 10 ثوانٍ.
ما الذي يتعطل: الطلبات الكبيرة من نفس عنوان IP تُبطأ أو تُحظر خلال دقائق. وغالبًا ما تكون عناوين IP الخاصة بسيرفرات البيانات المحجوبة مسبقًا.
طريقة المواجهة: تدوير proxies سكنية، وليس proxies مراكز البيانات، مع وتيرة طلبات معقولة.
تغييرات مخطط GraphQL
بعض scrapers تعتمد على نقاط GraphQL الداخلية في Facebook لأنها تعطي بيانات منظمة أنظف من HTML الخام. لكن Meta لا تقدّم ضمانًا للاستقرار في GraphQL الداخلي، لذا تتعطل هذه الاستعلامات بصمت — وتعود ببيانات فارغة بدلًا من رسائل خطأ.
ما الذي يتعطل: الاستخراج المنظم يعود بلا شيء دون تحذير.
طريقة المواجهة: أضف فحوصات تحقق، وراقب نقاط المخطط، وثبّت على الاستعلامات المعروفة بأنها تعمل. وتوقّع الصيانة.
ملخص دفاعات مكافحة scraping
| طبقة الدفاع | كيف تكسر scraper الخاص بك | الإجراء العملي المقابل |
|---|---|---|
| تغيّر الواجهة / عدم استقرار المحددات | XPath وCSS يعودان بلا نتائج أو بحقول جزئية | فضّل نقاط ارتكاز مرنة، وحقق من المخرجات المرئية، وتوقّع الصيانة |
| جدران تسجيل الدخول | الطلبات غير المسجلة تفقد المحتوى أو تُعاد توجيهها | استخدم cookies جلسة صالحة أو أدوات تعمل ضمن جلسة متصفح |
| البصمة الرقمية | الأتمتة القياسية تبدو مصطنعة | استخدم متصفحات حقيقية، وجودة جلسة متسقة، وإجراءات anti-detect |
| تحديد المعدل | مخرجات فارغة، وحظر، وتباطؤ | أبطئ الوتيرة، قلّل حجم الدُفعات، ودوّر proxies سكنية |
| تغييرات الاستعلامات الداخلية | الاستخراج المنظم يعود ببيانات فارغة بصمت | أضف فحوصات تحقق، وتوقع صيانة للاستعلامات |
عندما تفشل مستودعات GitHub: اختر بديلًا مسموحًا
المستودع المعطّل ليس سببًا للبحث عن التفاف آخر حول ضوابط المنصة. ابدأ أولًا بتوضيح السؤال التجاري: هل تحتاج تحليلات على مستوى الصفحة، أو شفافية إعلانية، أو دليل تواصل عام، أو كتالوج منتجات؟ كثير من هذه الاحتياجات يمكن تلبيتها عبر منتج رسمي من Meta، أو API مصرح به، أو مصدر عام غير تابع لـ Meta.
على سبيل المثال، استخدم Graph API فقط عندما يملك التطبيق وحالة الاستخدام الصلاحيات المطلوبة، واستخدم برامج Meta البحثية فقط عندما تكون مؤهلًا لها، واستفد من Meta Ad Library فقط للمعلومات الإعلانية التي تتيحها. أما لأبحاث العملاء المحتملين والأسعار واكتشاف الأعمال المحلية، فغالبًا ما يكون الأفضل الاعتماد على مواقع عامة مستقلة يمكن تقييم شروطها والتزاماتها المتعلقة بالخصوصية مباشرة.
أمثلة فعلية للمخرجات: ماذا ستحصل عليه فعلًا؟
كل مقالة منافسة تعرض snippets من الكود لكنها لا تعرض المخرجات الفعلية. فيما يلي ما يمكن توقعه واقعيًا من كل أسلوب.
مثال مخرجات: kevinzg/facebook-scraper (أو fork نشط)
من مثال README، قد يعيد المنشور العام scraped JSON مثل:
{
"comments": 459,
"comments_full": null,
"image": "https://...",
"images": ["https://..."],
"likes": 3509,
"post_id": "2257188721032235",
"post_text": "Don't let this diminutive version...",
"text": "Don't let this diminutive version...",
"time": "2019-04-30T05:00:01"
}
لاحظ الحقول القابلة لأن تكون null مثل comments_full. في 2026، توقّع أن تعود حقول أكثر فارغة أو مفقودة — وهذا غالبًا إشارة إلى الحظر، لا مجرد خلل عابر. المخرجات خام JSON وتحتاج إلى معالجة لاحقة.
مثال مخرجات: Facebook Graph API
توثّق Pages API الحالية من Meta طلبات معلومات الصفحة مثل GET /<PAGE_ID>?fields=id,name,about,fan_count. وتشمل مرجعية Page حقولًا مثل followers_count وfan_count وcategory وemails وphone وبيانات عامة أخرى — ولكن فقط مع الصلاحيات المناسبة مثل Page Public Content Access أو Page Public Metadata Access.
وهذا نطاق بيانات أضيق بكثير مما يتوقعه معظم مستخدمي scrapers على GitHub. فهو يركز على الصفحة، ومقيّد بالصلاحيات، وليس بديلًا عن scraping عشوائي للمنشورات العامة أو المجموعات.
مصفوفة أنواع بيانات Facebook × مسار الوصول
| نوع بيانات Facebook | نقطة البداية الأفضل | القيد الأساسي |
|---|---|---|
| الأصول التي تديرها مؤسستك | أدوات الإدارة الرسمية من Meta وواجهات API المعتمدة | تختلف الصلاحيات والحقول المتاحة |
| الملاحظات الإعلانية | Meta Ad Library | استخدم فقط الحقول والفلاتر التي توفرها |
| تفاصيل الأعمال العامة اللازمة لأبحاث العملاء المحتملين | دليل عام غير تابع لـ Meta أو موقع ناشر مسموح به | تحقّق من شروط المصدر والتزاماته المتعلقة بالخصوصية |
| المحتوى الخاص أو المحتوى المغلق على مجموعات أو المحتوى المحجوب بتسجيل الدخول أو المخصص للحسابات فقط | لا تُؤتمت جمعه | ابحث عن مسار مصرح به بدلًا من ذلك |
خطوة بخطوة: كيف تُعد Facebook Scraper من GitHub عندما يكون ذلك منطقيًا
إذا قرأت مراجعة الحداثة وما زلت تريد المسار عبر GitHub، فهذا مفهوم. إليك الطريق العملي — مع ملاحظات صريحة حول أماكن التعطل.

الخطوة 1: اختر المستودع المناسب (اعتمد على مراجعة الحداثة)
ارجع إلى جدول المراجعة. اختر أقل مستودع تقادمًا يتوافق مع السطح الذي تستهدفه. قبل تثبيت أي شيء، افتح تبويب Issues — عناوين المشكلات الحديثة تخبرك عن الوظيفة الحالية أكثر من README.
الخطوة 2: جهّز بيئة Python
python3 -m venv fb-scraper-env
source fb-scraper-env/bin/activate
pip install -r requirements.txt
مشكلة شائعة: تعارض الإصدارات مع التبعيات، خصوصًا Selenium وPlaywright. كل من kevinzg وmoda20 يصرّحان بـ Python ^3.6 في ملف pyproject.toml — وهو أساس قديم قد يتعارض مع المكتبات الحديثة. أما scraper الخاص بـ Marketplace في passivebot فيثبت playwright==1.40.0، وهذا مناسب للتجارب لكنه ليس دليلًا على المتانة.
الخطوة 3: اضبط proxies ومقاومة الرصد
إذا كنت ستتجاوز الاختبار السريع:
- أعدد تدوير proxies سكنية (وابحث عن مزوّدين لديهم مجموعات عناوين IP خاصة بـ Facebook)
- إذا كنت تستخدم أتمتة المتصفح، ثبّت undetected-chromedriver أو اضبط anti-fingerprinting
- لا تتجاوز هذه الخطوة — Selenium أو Puppeteer العاديان يُرصدان بسرعة
الخطوة 4: نفّذ اختبار scraping صغيرًا وراجِع المخرجات
ابدأ بصفحة عامة واحدة، لا بدفعة كبيرة. افحص المخرجات بعناية:
- الحقول الفارغة أو البيانات المفقودة تعني غالبًا أن دفاعات Facebook تحجبك
- قارِن المخرجات بما تراه فعلًا في المتصفح
- نجاح اختبار صفحة واحدة أهم من README جميل
الخطوة 5: تعامل مع الأخطاء، وتحديد المعدل، والصيانة
- أضف منطق إعادة المحاولة ومعالجة الأخطاء
- توقّع تحديث المحددات أو الإعدادات بانتظام — هذه صيانة مستمرة، وليست إعدادًا يُنسى
- إذا وجدت نفسك تقضي وقتًا في صيانة scraper أكثر من استخدام البيانات، فهذه إشارة لإعادة التفكير في المسار no-code
الاعتبارات القانونية والأخلاقية في scraping Facebook
قد تنطبق شروط المنصة وقواعد الخصوصية والالتزامات التعاقدية وقوانين حماية البيانات. ظهور المحتوى للعامة لا يعني بالضرورة الإذن بجمعه آليًا. اجعل البيانات في حدها الأدنى، ووثّق الغرض والأساس القانوني، واستشر محاميًا في حال المشاريع التجارية أو واسعة النطاق.
لا تعتبر إضافة متصفح، أو جلسة مسجّلة الدخول، أو وسم "public" تصريحًا لأتمتة جمع البيانات من منتجات Meta.
أهم النقاط: ما الذي يعمل فعلًا مع Facebook scraping في 2026؟
نشاط المستودع، وصفوف المشكلات، وقواعد المنصة الحالية أهم من عدد النجوم أو README قديم. عندما يرتبط السؤال التجاري بأصل تديره أنت، فابدأ بأدوات Meta الرسمية وواجهات API المعتمدة. أما لأبحاث السوق والعملاء المحتملين والأسعار، فغالبًا ما يكون المصدر العام غير التابع لـ Meta أسهل في التوثيق والإدارة.
الأسئلة الشائعة
هل يوجد Facebook scraper يعمل على GitHub في 2026؟
نعم، لكن الخيارات محدودة. أبرزها هو fork moda20/facebook-scraper من المستودع الأصلي لـ kevinzg — راجع جدول المراجعة أعلاه لمعرفة الحالة الحالية. يمكنه استخراج جزء من منشورات الصفحات العامة وبعض البيانات الوصفية، لكن صف المشكلات يوضح أعطالًا أساسية مرتبطة بـ mbasic والمخرجات الفارغة. معظم المستودعات الأخرى مهجورة أو معطلة بالكامل.
هل يمكنني scraping Facebook بدون كتابة كود؟
استخدم أدوات Facebook الخاصة بالبحث والإدارة للأبحاث اليدوية. أما للأعمال المتكررة أو البرمجية، فقيّم الـ API الرسمي وصلاحياته، أو أعد تصميم سير العمل حول مصدر عام مسموح غير تابع لـ Meta. الراحة بدون كود لا تلغي التزامات المنصة أو الخصوصية أو التعاقد.
هل scraping Facebook قانوني؟
تمنع شروط خدمة Facebook جمع البيانات آليًا بدون إذن. وتطبّق Meta ذلك فعليًا عبر حظر الحسابات، وخطابات وقف وكف، ودعاوى قضائية. تختلف القانونية حسب الولاية القضائية وحالة الاستخدام. التزم ببيانات الأعمال المتاحة للعامة، وتجنب الملفات الشخصية، واستشر مستشارًا قانونيًا إذا كان الاستخدام على نطاق واسع.
ما البيانات التي ما زلت أستطيع الحصول عليها من Facebook Graph API؟
في 2026، أصبح Graph API مقيّدًا بشدة. يمكنك الوصول إلى بيانات محدودة على مستوى الصفحة — مثل id وname وabout وfan_count وemails وphone — مع الصلاحيات المناسبة مثل Page Public Metadata Access. أما معظم بيانات المنشورات العامة، وبيانات المجموعات (وقد تم إيقاف Groups API)، وبيانات المستخدمين، فلم تعد متاحة عبر API.
كم مرة تتعطل مستودعات Facebook scraper على GitHub؟
بشكل متكرر. Facebook يغيّر بنية DOM، وإجراءات مكافحة البوت، وواجهات API الداخلية باستمرار — لا توجد وتيرة معلنة، لكن تقارير المجتمع تُظهر أعطالًا كل بضعة أسابيع في scrapers النشطة. وصفقة moda20 حول اختفاء mbasic مثال حديث. إذا كنت تعتمد على مستودع GitHub، فخصص ميزانية لصيانة منتظمة وللتحقق من المخرجات.
اعرف المزيد


