בשבוע שעבר, אחד המשתמשים שלנו סיפר לי שהוא בילה אחר צהריים שלם בהעתקה ידנית של רישומי אינסטלטורים מ-SuperPages לגיליון נתונים — 47 שורות בשלוש שעות. הידיים שלו כאבו, הנתונים הכילו טעויות הקלדה, ועדיין לא היו לו כתובות אימייל. הסיפור הזה דיבר אליי מיד, כי גם אני הייתי שם, וזה בדיוק מסוג הבעיה שבנינו את Thunderbit כדי לפתור.
SuperPages הוא אחד ממדריכי העסקים המקומיים הוותיקים בארה״ב, שמופעל על ידי Thryv, עם כיסוי רחב בערים ובקטגוריות מרכזיות — אינסטלטורים, רופאי שיניים, עורכי דין, טכנאי מיזוג ועוד. תיעוד טכני ישן תיאר אותו כמסד נתונים ארצי בסגנון דפי זהב עם יותר מ-11 מיליון רישומים, והאתר של היום עדיין מציג קטגוריות מקומיות צפופות. האתגר הוא לא למצוא רישומים. האתגר הוא להפוך אותם לרשימת לידים נקייה ומועשרת, בלי לאבד את השפיות (או את כל אחר הצהריים).
לפי דוח Sales Trends 2024 של HubSpot, אנשי מכירות משקיעים רק כשעתיים ביום בפעילות מכירה בפועל — שאר הזמן נבלע במשימות כמו הזנת נתונים ומחקר. ו-81% מאנשי המכירות אומרים שבינה מלאכותית יכולה לעזור להם להפחית עבודה ידנית. המדריך הזה מסביר שלוש דרכים לחלץ לידים מ-SuperPages — מ-AI בלי קוד ועד Python — כדי שתוכל לבחור את השיטה שמתאימה לרמתך ולחזור לעבודה שבאמת מזיזה את המחט.
חילוץ לידים מ-SuperPages עם AI Get Started Free
מה זה SuperPages ולמה צוותי מכירות אוהבים אותו ללידים?
SuperPages הוא מדריך עסקים מקוון שממוקד בארה״ב, שבו עסקים מקומיים מופיעים עם פרטי קשר, קטגוריות, דירוגים ועוד. אפשר לחשוב עליו כהתפתחות הדיגיטלית של ספר הטלפונים הישן בסגנון דפי זהב — רק שעכשיו אפשר לחפש לפי קטגוריה ומיקום, ולקבל יותר מידע לכל רישום.

כך עשוי להיראות רישום טיפוסי ב-SuperPages:
- שם העסק
- מספר טלפון
- כתובת רחוב
- כתובת אתר (אם זמינה)
- קטגוריה (למשל אינסטלציה, דיני משפחה, מיזוג אוויר)
- דירוגים וביקורות
- שעות פעילות (בדרך כלל בדף הפרטי)
- תיאור (בדף הפרטי)
דף הבית של SuperPages מדגיש קטגוריות פופולריות כמו שירותי בית, אינסטלטורים, חשמלאים, רופאי שיניים, שירותים משפטיים, תיקון רכב, מסעדות ושירותי חיות מחמד — בדיוק התחומים שצוותי מכירות, סוכנויות וספקי שירות מקומיים מכוונים אליהם בפעילות outbound.
בקיצור, SuperPages הוא מכרה זהב לכל מי שמחפש עסקים מקומיים בארה״ב. הנתונים מובנים, הכיסוי רחב, והקטגוריות מתאימות היטב לקמפיינים אמיתיים של פנייה יזומה.
נסו את Thunderbit ללידים מ-SuperPages
למה לחלץ לידים מ-SuperPages? שימושים נפוצים
גלישה ידנית ב-SuperPages והעתקת נתונים לגיליון היא בור שחור של פרודוקטיביות. חילוץ אוטומטי הופך את התהליך לרשימה ממוקדת ומובנית בתוך דקות במקום שעות. ובגלל שאתם שולטים בחיפוש (קטגוריה + עיר + מילת מפתח), התוצאה לרוב רלוונטית יותר מרשימת לידים קנויה כללית.
אלו השימושים הנפוצים ביותר שאני רואה מהמשתמשים שלנו:
| שימוש | מי מרוויח | דוגמה |
|---|---|---|
| יצירת לידים מקומית | צוותי מכירות, סוכנויות | בניית רשימת אינסטלטורים בדאלאס לפנייה קרה |
| מחקר מתחרים | תפעול, שיווק | השוואת דירוגים ושירותים בין מתחרים בשוק |
| מיפוי שוק | פיתוח עסקי | זיהוי כל רופאי השיניים במיקוד מסוים להשקת מוצר חדש |
| איתור ספקים | רכש, תפעול | מציאת ספקים באזור עם טלפון + אתר |
| חיפוש לידים ל-SEO מקומי | סוכנויות | איתור עסקים בלי אתר או עם פרטי רישום חלשים |
| תכנון טריטוריה | מכירות שטח | קיבוץ קבלנים לפי עיר, מיקוד או אזור שירות |
שוק יצירת הלידים ל-B2B בארה״ב הוערך ב-8.5 מיליארד דולר ב-2024 וצפוי להגיע ל-18.2 מיליארד דולר עד 2034 — כך שהביקוש לסוג כזה של נתונים ממש לא נחלש. רשימה חדשה ומוחצלת לפי קטגוריה ומיקום יכולה להיות ממוקדת יותר מרשימה קנויה גנרית, אבל עדיין צריך לאמת ולנַקּוֹת כפילויות לפני הפנייה (עוד על כך בהמשך).
איך נראה הפלט הסופי: דוגמה לנתונים מחולצים מ-SuperPages
לפני שנצלול לאופן הביצוע, אני רוצה להראות לכם מה תקבלו בפועל. זה החלק שרוב המדריכים מדלגים עליו — אבל אם אתם משקיעים זמן, כדאי שתדעו מהי התמורה.
הנה טבלת פלט לדוגמה (נתונים פיקטיביים, מבנה מציאותי):
| שם העסק | טלפון | כתובת | אתר | קטגוריה | דירוג | שעות פעילות | אימייל (מועשר) |
|---|---|---|---|---|---|---|---|
| Sunset Pipe & Drain Co. | +1 213-555-0148 | 1842 W 7th St, Los Angeles, CA 90057 | sunsetpipe.example | אינסטלציה | 4.6 | Mon-Fri 7a-6p | service@sunsetpipe.example |
| Arroyo HVAC Pros | +1 626-555-0182 | 72 N Fair Oaks Ave, Pasadena, CA 91103 | arroyohvac.example | מיזוג אוויר | 4.8 | Mon-Sat 8a-7p | hello@arroyohvac.example |
| Wilshire Family Dental | +1 323-555-0119 | 4100 Wilshire Blvd, Los Angeles, CA 90010 | wilshiredental.example | רופאי שיניים | 4.4 | Mon-Thu 9a-5p | appointments@wilshiredental.example |
| Pacific Legal Aid Group | +1 310-555-0173 | 11845 W Olympic Blvd, Los Angeles, CA 90064 | שירותים משפטיים | 4.2 | Mon-Fri 8:30a-5:30p | intake@pacificlegal.example | |
| Valley Auto Repair Center | +1 818-555-0198 | 14422 Ventura Blvd, Sherman Oaks, CA 91423 | valleyautorepair.example | תיקון רכב | 4.7 | Mon-Sat 8a-6p | info@valleyautorepair.example |
| Echo Park Pet Grooming | +1 213-555-0166 | 1511 Sunset Blvd, Los Angeles, CA 90026 | echoparkpets.example | טיפוח חיות מחמד | 4.9 | Tue-Sun 9a-5p | booking@echoparkpets.example |
כמה דברים שכדאי לשים לב אליהם:
- מדף תוצאות החיפוש: שם העסק, טלפון, כתובת חלקית, קטגוריה, דירוג, כתובת ה-URL של הרישום.
- מדף הפרופיל של העסק (תת-דף): כתובת מלאה, שעות פעילות, תיאור, ביקורות, ולפעמים אתר.
- מהעשרה: אימייל (לעיתים נמצא רק באתר של העסק עצמו או באמצעות כלי העשרה).
- מניקוי נתונים: טלפון בפורמט E.164, נירמול מדינה/מיקוד, מפתחות לכפילות, כתובת מקור ותאריך החילוץ.
זה סוג הפלט שאפשר להכניס ישירות ל-CRM, ל-Google Sheet או ל-Airtable ולהתחיל לעבוד איתו מיד.
3 דרכים לחלץ לידים מ-SuperPages: השוואה מהירה

לא לכולם יש אותה רמת נוחות טכנית — או אותו סבלנות. לכן הנה שלוש שיטות זו לצד זו, כדי שתוכלו לבחור מה שמתאים לכם:
| קריטריון | Thunderbit (AI בלי קוד) | כלי חילוץ חזותי (למשל Octoparse) | Python (Requests + BS4) |
|---|---|---|---|
| זמן הקמה | כ-2 דק׳ (התקנת הרחבה) | כ-15 דק׳ (בניית תהליך) | כ-30 דק׳ (התקנת ספריות, כתיבת קוד) |
| נדרש קוד | לא | לא | כן (Python) |
| טיפול בעימוד | מובנה (קליק או גלילה) | נדרשת הגדרה | קוד ידני |
| העשרת תתי-דפים | חילוץ תתי-דפים בלחיצה אחת | נדרש תהליך/לולאה נפרדת | סקריפט נפרד |
| מניעת חסימות | Cloud Scraping מטפל בזה | תלוי בתוכנית/תוסף פרוקסי | DIY (פרוקסים, כותרות, מגבלות קצב) |
| אפשרויות ייצוא | Excel, Google Sheets, Airtable, Notion, CSV, JSON | CSV, Excel, מסד נתונים | מה שתכתבו |
| מתאים במיוחד ל | צוותי מכירות, סוכנויות, לא-מפתחים | משתמשים טכניים-למחצה | מפתחים שרוצים שליטה מלאה |
ההמלצה שלי: אם אתם רוצים להתחיל לחלץ כבר בעוד 2 דקות, לכו לשיטה 1. אם אתם מעדיפים תהליכי עבודה חזותיים ולא אכפת לכם קצת הגדרה, נסו את שיטה 2. אם אתם רוצים שליטה מלאה ומכירים Python, קפצו לשיטה 3.
שיטה 1: חילוץ לידים מ-SuperPages עם Thunderbit (AI, בלי קוד)
זו הדרך המהירה ביותר מ"יש לי חיפוש ב-SuperPages" ל"יש לי רשימת לידים". בלי קוד, בלי בוני תהליכים, בלי הגדרות פרוקסי. אני משוחד — הרי בנינו את Thunderbit — אבל אני אראה לכם בדיוק מה קורה, כדי שתוכלו לשפוט בעצמכם.
קושי: מתחילים
זמן נדרש: כ-5 דקות לחילוץ מלא של קטגוריה/עיר
מה צריך: דפדפן Chrome, תוסף Chrome של Thunderbit (תוכנית חינמית עובדת)
שלב 1: התקינו את Thunderbit ופתחו את SuperPages
עברו אל דף ההורדה של תוסף Thunderbit ל-Chrome והתקינו את התוסף. זה לוקח בערך דקה. לאחר ההתקנה, היכנסו לדף תוצאות חיפוש ב-SuperPages — למשל, חפשו "Plumbers in Los Angeles, CA" ב-superpages.com.
כדאי שתראו את סמל Thunderbit בסרגל הכלים של הדפדפן ופאנל צד מוכן לפעולה.
שלב 2: לחצו על "AI Suggest Fields" כדי לזהות אוטומטית עמודות נתונים
פתחו את סרגל הצד של Thunderbit ולחצו על "AI Suggest Fields". ה-AI של Thunderbit קורא את הדף ומציע אוטומטית עמודות לפי מה שהוא מזהה — בדרך כלל שם העסק, טלפון, כתובת, אתר, קטגוריה, דירוג וכתובת הרישום.
אפשר להתאים, להוסיף או להסיר עמודות לפני החילוץ. רוצים להוסיף עמודה מותאמת כמו "יש אתר?" או "אזור שירות?" פשוט כתבו תיאור באנגלית פשוטה באמצעות Field AI Prompt. למשל, אפשר להנחות עמודה ל"format phone as +1XXXXXXXXXX" או ל"classify as residential vs. commercial."
כעת אתם אמורים לראות תצוגה מקדימה של טבלה עם העמודות שהגדרתם בלוח של Thunderbit.
שלב 3: לחצו על "Scrape" וראו איך הנתונים מתמלאים
לחצו על כפתור ה-"Scrape" הכחול. Thunderbit מחלץ את כל הרישומים בדף הנוכחי וממלא את הטבלה שורה אחר שורה. בדף תוצאות טיפוסי של SuperPages, זה לוקח בערך 30–45 שניות.
Thunderbit מטפל אוטומטית בעימוד — הוא מזהה כפתורי "Next" או גלילה אינסופית וממשיך עד שנגמרים הדפים או עד שמגיעים למגבלה שלכם. אם אתם מחלצים סט תוצאות גדול (נניח, כל האינסטלטורים באזור מטרופוליני), עברו למצב Cloud Scraping, שיכול לעבד עד 50 דפים בבת אחת בלי לתפוס לכם את הדפדפן.
שלב 4: השתמשו ב-Subpage Scraping כדי להעשיר כל רישום

דף תוצאות החיפוש נותן את הבסיס, אבל הזהב האמיתי — שעות פעילות, תיאור מלא, ביקורות, ולפעמים אימייל — נמצא בדף הפרטי של כל עסק. לחצו על "Scrape Subpages" ו-Thunderbit יבקר בכל דף פרט של רישום, וימשוך עמודות מועשרות כמו שעות פעילות, תיאור, כתובת אתר וכל פרטי קשר שנראים שם.
זה תהליך בלחיצה אחת. בלי workflow נפרד, בלי הגדרות. הנתונים המועשרים מתווספים ישירות לטבלה הקיימת שלכם.
שלב 5: ייצאו את הלידים ל-Excel, Google Sheets, Airtable או Notion
כשהנתונים נראים טוב, לחצו על Export. Thunderbit מאפשר לשלוח את הלידים ישירות אל:
- Google Sheets (מצוין להכנה ל-CRM ולשיתוף)
- Airtable (טבלאות תפעול קלות)
- Notion (מאגרי מחקר)
- Excel / CSV (יבוא ל-CRM)
- JSON (למסירה למפתחים)

כל אפשרויות הייצוא חינמיות. אם אתם מזינים לידים ל-HubSpot או Salesforce, ייצוא ל-CSV או ל-Google Sheets הוא בדרך כלל הנתיב המהיר ביותר.
טיפ מקצועי: חַלְּצו לפי קטגוריה + עיר במקום חיפושים רחבים ברמת מדינה. "Emergency plumbers Dallas TX" ייתן לכם רשימה חדה ויישומית יותר מאשר "plumbers Texas." הוסיפו עמודות "Source URL" ו-"Scraped At" לצורכי עקיבות.
שיטה 2: חילוץ מ-SuperPages עם כלי חזותי (דוגמה: Octoparse)
כלי חילוץ חזותיים כמו Octoparse נמצאים באמצע: בלי קוד, אבל עם יותר הגדרה וקונפיגורציה מאשר Thunderbit. ל-Octoparse אפילו יש תבנית SuperPages מוכנה לשימוש במקרים פשוטים.
קושי: בינוני
זמן נדרש: כ-20–30 דקות להקמה + חילוץ
מה צריך: חשבון Octoparse (יש תוכנית חינמית, עם מגבלות)
שלב 1: צרו משימה חדשה וטענו את כתובת ה-URL של SuperPages
פתחו את Octoparse, לחצו על "New Task", והדביקו את כתובת החיפוש שלכם ב-SuperPages (למשל, "https://www.superpages.com/los-angeles-ca/plumbers"). הדפדפן המובנה יטען את הדף.
שלב 2: זיהוי אוטומטי או בחירה ידנית של שדות הנתונים
לחצו על "Auto-detect" — Octoparse סורק את הדף ומסמן שדות נתונים שהוא חושב שרלוונטיים. עברו על חלונית ה-Data Preview. מניסיוני, הזיהוי האוטומטי תופס לרוב את רוב השדות, אבל לפעמים יקלוט גם פריטים מיותרים (כמו תוויות פרסומת או טקסט ניווט) או יחמיץ שדות מסוימים. סביר שתצטרכו להוסיף או להסיר כמה שדות ידנית.
לפי מסמכי העזרה של Octoparse, הזיהוי האוטומטי יוצר workflow בסיסי עם שלבי עימוד וחילוץ, אבל ייתכן שתצטרכו להוסיף נתונים חסרים באופן ידני.
שלב 3: בנו את ה-Workflow והגדירו עימוד
לחצו על "Create workflow." Octoparse ייצור רצף פעולות שלב-אחר-שלב. בדקו את שלב העימוד — ודאו שהוא לוחץ על "Next" או טוען תוצאות נוספות כראוי. אם אתם רוצים נתונים מכל דף פרטי של עסק (שעות, אימייל, תיאור), תצטרכו להוסיף לולאה לדף פרט או פעולה של subpage בתוך ה-workflow. זה מוסיף מורכבות לעומת הגישה של Thunderbit בלחיצה אחת.
שלב 4: הריצו את המשימה וייצאו את הנתונים
הריצו את המשימה מקומית (לעבודות קטנות) או בענן של Octoparse (לעבודות מתוזמנות או גדולות יותר — ענן הוא פיצ'ר בתשלום). כשהמשימה מסתיימת, ייצאו כ-CSV, Excel או JSON.
מגבלות שחשוב להכיר: התוכנית החינמית של Octoparse כוללת 10 משימות, עד 50,000 שורות בחודש, וחילוץ מקומי בלבד. ריצות בענן, רוטציית IP, פתרון CAPTCHA וחלק מהאינטגרציות לייצוא דורשים תוכנית בתשלום (החל בערך מ-69 דולר לחודש בתשלום שנתי).
שיטה 3: חילוץ מ-SuperPages עם Python (Requests + BeautifulSoup)
זו הדרך של המפתחים. שליטה מלאה, אחריות מלאה. אם אתם מרגישים בנוח לכתוב ולתחזק סקריפטים ב-Python, תקבלו את הגמישות הרבה ביותר — אבל גם את כאב הראש הגדול ביותר.
קושי: מתקדם
זמן נדרש: כ-30–60 דקות (הקמה + קוד + דיבוג)
מה צריך: Python 3.x, pip, requests, beautifulsoup4, lxml, עורך קוד
שלב 1: הגדירו את סביבת ה-Python שלכם
python -m venv .venv
source .venv/bin/activate
pip install requests beautifulsoup4 lxml pandas
שלב 2: בדקו את מבנה ה-HTML של SuperPages
פתחו כלי מפתחים (F12) בדף תוצאות של SuperPages. זהו CSS selectors לשם העסק, הכתובת, הטלפון, האתר וקישור לדף הפרט. קחו בחשבון: מבנה ה-HTML יכול להשתנות בלי אזהרה, ולכן הסלקטורים שלכם עלולים להישבר בכל רגע.
שלב 3: כתבו את מחלץ הרישומים וטפלו בעימוד
הנה דוגמה מפושטת. הסתייגות חשובה: בבדיקות שלי, בקשה ישירה ל-SuperPages החזירה דף חסימה של Cloudflare מסוג "Attention Required". סקריפט Requests נאיבי עלול להיכשל בקנה מידה — ייתכן שתצטרכו הקשר של סשן דפדפן, הגבלת קצב, ניסיונות חוזרים, או חלופות מורשות.
import csv, time
from urllib.parse import urljoin
import requests
from bs4 import BeautifulSoup
BASE_URL = "https://www.superpages.com"
HEADERS = {
"User-Agent": (
"Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_7) "
"AppleWebKit/537.36 (KHTML, like Gecko) "
"Chrome/125.0 Safari/537.36"
)
}
def fetch(url):
resp = requests.get(url, headers=HEADERS, timeout=20)
resp.raise_for_status()
if "Attention Required" in resp.text or "Cloudflare" in resp.text:
raise RuntimeError("Blocked. Slow down or switch to browser/cloud scraping.")
return BeautifulSoup(resp.text, "lxml")
def parse_listing(card):
name_el = card.select_one(".business-name, a.business-name, h2 a, h3 a")
phone_el = card.select_one(".phones, .phone, [class*=phone]")
address_el = card.select_one(".street-address, .adr, [class*=address]")
website_el = card.select_one("a.track-visit-website, a[href*='http']")
rating_el = card.select_one(".rating, [class*=rating]")
detail_url = urljoin(BASE_URL, name_el.get("href")) if name_el and name_el.get("href") else ""
return {
"business_name": name_el.get_text(" ", strip=True) if name_el else "",
"phone": phone_el.get_text(" ", strip=True) if phone_el else "",
"address": address_el.get_text(" ", strip=True) if address_el else "",
"website": website_el.get("href", "") if website_el else "",
"rating": rating_el.get_text(" ", strip=True) if rating_el else "",
"detail_url": detail_url,
}
def scrape_search(search_url, pages=3):
all_rows = []
for page in range(1, pages + 1):
page_url = f"{search_url}?page={page}"
soup = fetch(page_url)
cards = soup.select(".result, .organic, [class*=result]")
if not cards:
break
for card in cards:
all_rows.append(parse_listing(card))
time.sleep(5)
return all_rows
if __name__ == "__main__":
rows = scrape_search("https://www.superpages.com/los-angeles-ca/plumbers", pages=2)
with open("superpages_leads.csv", "w", newline="", encoding="utf-8") as f:
writer = csv.DictWriter(f, fieldnames=sorted({k for row in rows for k in row}))
writer.writeheader()
writer.writerows(rows)
שלב 4: גרדו דפי פרט להעשרה
כתבו פונקציה נפרדת שתבקר בכל כתובת URL של דף פרטי ותוציא שעות פעילות, אימייל, תיאור וביקורות. המשמעות היא ניהול מגבלות קצב, טיפול בשגיאות, ואולי גם פרוקסים — הכול עליכם.
שלב 5: שמרו את הנתונים ל-CSV או JSON
השתמשו במודולים csv או json של Python. תצטרכו גם לכתוב בעצמכם לוגיקת ניקוי, הסרת כפילויות וייצוא.
מלכודות נפוצות:
- SuperPages עשוי לחסום בקשות באמצעות Cloudflare או מערכות אנטי-בוט דומות (אומת בבדיקות שלי).
- הסלקטורים כאן רחבים במכוון, כי המארקאפ של SuperPages עשוי להשתנות.
- אל תניחו שדפי תוצאות החיפוש כוללים אימיילים. כמעט אף פעם לא.
- מחלץ ברמת ייצור צריך בדיקת robots/TOS, הגבלת קצב, retry/backoff, לוגים מובנים ולכידת שגיאות.
אם אתם רוצים להעמיק בחילוץ ב-Python, בדקו את המדריך שלנו לחילוץ נתונים מהאינטרנט עם Python או את המדריך ל-BeautifulSoup.
מנתונים גולמיים ללידים אמיתיים: הצינור המלא (חילוץ → ניקוי → אימות → CRM)
כאן רוב מדריכי החילוץ נעצרים — וכאן הערך האמיתי מתחיל. חילוץ נותן לכם חומר גלם. להפוך אותו לרשימת לידים שמישה דורש עוד כמה שלבים.

הצינור נראה כך:
חיפוש ב-SuperPages → חילוץ רישומים → חילוץ דפי פרט/אתרים → ייצוא ל-Google Sheets או CSV → ניקוי טלפונים, כתובות, קטגוריות → הסרת כפילויות → אימות אימיילים/טלפונים → העשרת אנשי קשר חסרים → ייבוא ל-CRM → פנייה תואמת כללים
הסרת כפילויות: מחיקת רישומים כפולים
SuperPages מציג לעיתים את אותו עסק בכמה קטגוריות. אם חילצתם "plumbers" וגם "drain cleaning" באותה עיר, יהיו לכם חפיפות.
- מפתח כפילות ראשי: מספר טלפון מנורמל + כתובת רחוב מנורמלת.
- משני: דומיין + עיר.
- חלופה: שם העסק + מיקוד (לבדוק ידנית במקרה של רשתות).
ב-Google Sheets, השתמשו ב-=UNIQUE(A:H) להתאמות מדויקות של שורה שלמה, או צרו עמודת עזר כמו =LOWER(REGEXREPLACE(B2&C2,"[^a-zA-Z0-9]","")) כדי לתפוס כמעט-כפילויות. ב-Excel, השתמשו ב-Data > Remove Duplicates.
ניקוי נתונים: סטנדרטיזציה של טלפונים, כתובות ועיצוב
- עצבו מספרי טלפון בפורמט E.164 (עבור ארה״ב: +1 ואחריו 10 ספרות). זה הפורמט שרוב ה-CRM-ים ומערכות החיוג מצפים לו. אפשר להשתמש ב-Field AI Prompt ב-Thunderbit כדי לעצב אוטומטית בזמן החילוץ.
- נרמלו כתובות: הרחיבו קיצורים, השלימו מיקודים חסרים, ופצלו לשדות רחוב/עיר/מדינה/מיקוד אם צריך.
- הסירו שאריות HTML, רווחים מיותרים ופרמטרים של מעקב מכתובות URL.
- הוסיפו עמודות
source_directory,source_urlו-scraped_atלצורכי עקיבות.
אימות אימייל וטלפון לפני פנייה
אל תשלחו אימייל קר לכתובת כלשהי שחילצתם. אימות שומר על מוניטין השולח ומקטין את שיעור ה-bounce.
- אימות אימייל: ZeroBounce (החל מכ-39 דולר ל-2,000 קרדיטים, ועוד 100 קרדיטים חודשיים בחינם) או Bouncer (8 דולר ל-1,000 קרדיטים, הקרדיטים לא פוקעים) הן אפשרויות טובות.
- אימות טלפון: Twilio Lookup מציע עיצוב ואימות בחינם; Caller ID עולה 0.01 דולר לבקשה.
- ה-Email Extractor ו-Phone Number Extractor החינמיים של Thunderbit יכולים למשוך פרטי קשר שהוחמצו בדפי הרישום.
העשרה: מציאת אנשי קשר כש-SuperPages לא מציג אימיילים
רבים מהרישומים ב-SuperPages לא מציגים אימייל בכלל — במיוחד בדף תוצאות החיפוש. מה עושים?
- גרדו את דפי Contact, About או ה-footer באתר של העסק. Subpage Scraping או Email Extractor של Thunderbit יכולים לעשות זאת בכמות גדולה.
- השתמשו בכלי העשרה כמו Apollo, BetterContact, Icypeas או Prospeo. אזהרה: לעסקים מקומיים קטנים (חנות אינסטלציה של שני אנשים, רופא שיניים עצמאי), מסדי נתונים B2B גדולים לרוב מחזירים הרבה ריקים. חילוץ ישירות מהאתר נוטה לעבוד טוב יותר במקרה הזה.
- שלבו כמה מדריכים. גרדו את SuperPages, Yellow Pages ו-Google Maps לאותה קטגוריה/עיר, ואז מיזגו והסירו כפילויות. החפיפה נותנת רשומות שלמות יותר.
אם אי פעם ניסיתם להעביר רשימת עסקים קטנים דרך Apollo וקיבלתם בעיקר שורות ריקות, אתם לא לבד. לכן הגישה שמתחילה באתר העסק חשובה כל כך לקהל הזה.
ייבוא ל-CRM: הכנסת לידים ל-HubSpot, Salesforce או Google Sheets
- HubSpot: עברו אל Data Management > Data Integration > Import data > Quick import (contacts only). העלו את קובץ ה-
.csvאו.xlsx. מדריך הייבוא של HubSpot מסביר את מיפוי השדות. - Salesforce: השתמשו ב-Data Import Wizard. הכינו CSV, מַפּוּ שדות מקור לשדות Salesforce, והריצו את הייבוא.
- Google Sheets / Airtable / Notion: Thunderbit מייצא ישירות לשלושתם — בלי צורך ב-CSV ביניים.
טיפ: מַפּוּ את העמודות שחילצתם לשדות ה-CRM לפני הייבוא. כמה דקות של מיפוי חוסכות שעות של ניקוי ידני אחר כך.
SuperPages מול מדריכי עסקים מקומיים אחרים: איפה למצוא את הלידים הטובים ביותר
SuperPages הוא נקודת התחלה מצוינת, אבל הוא לא המדריך היחיד ששווה לחלץ ממנו. כך הוא עומד מול אחרים:
| מדריך | נפח לידים | שדות נתונים זמינים | עדכניות הנתונים | קושי מול חילוץ אוטומטי | מתאים במיוחד ל |
|---|---|---|---|---|---|
| SuperPages | גדול (ממוקד ארה״ב) | שם, טלפון, כתובת, אתר, קטגוריות, דירוגים | בינונית | בינוני | שירותי בית, קבלנים, עסקים קטנים |
| Yellow Pages | גדול (ממוקד ארה״ב) | דומה ל-SuperPages | בינונית | בינוני | פנייה כללית לעסקים מקומיים |
| Google Maps | עצום (גלובלי) | שם, טלפון, כתובת, אתר, ביקורות, שעות, תמונות | גבוהה (מעודכן ע״י בעלים) | גבוה | נתונים מקומיים הכי עדכניים |
| Yelp | גדול (ממוקד ארה״ב) | שם, טלפון, כתובת, ביקורות, טווח מחירים | גבוהה | גבוה | מסעדות, קמעונאות, עסקים נותני שירות |
| Manta | בינוני | שם, טלפון, כתובת, הערכות הכנסה, מספר עובדים | בינונית | נמוך | חיפוש B2B (נתוני הכנסה/עובדים) |
| BBB | בינוני | שם, טלפון, כתובת, הסמכה, תלונות | בינונית | נמוך | עסקים אמינים/מאומתים |
מקורות: דף הבית של SuperPages, מאמר ה-VLDB על SuperPages, תיעוד Google Places API, תיעוד Yelp Places API, דף הבית של Manta, מדריך BBB.
Thunderbit עובד על כל אלה — כולל תבניות מיידיות לאתרים פופולריים כמו Google Maps ו-SuperPages — כך שתוכלו ליישם את אותו workflow על כמה מקורות ולמזג את רשימות הלידים שלכם. מניסיוני, הגישה הטובה ביותר היא לעיתים קרובות לחלץ משניים או שלושה מדריכים לאותה קטגוריה/עיר ולהסיר כפילויות. החפיפה ממלאת פערים ונותנת תמונה שלמה יותר.
לקריאה נוספת על חילוץ ממדריכים אחרים, ראו את המדריכים שלנו על מחלצי Yellow Pages, מחלצי Google Maps, ו-מחלצי Yelp.
טיפים משפטיים ואתיים לחילוץ לידים מ-SuperPages

אני לא עורך דין, וזה לא ייעוץ משפטי — אבל ביליתי מספיק זמן בתחום הזה כדי לדעת שהתעלמות מעמידה בכללים היא דרך מהירה להסתבך. הנה הסיכום המעשי.
נתונים עסקיים ציבוריים מול נתונים אישיים
רישומי עסקים — שם חברה, טלפון עסקי, כתובת עסקית, אתר עסקי — נחשבים בדרך כלל לנתונים מסחריים ציבוריים. זה שונה מנתונים אישיים של צרכנים לפי GDPR או CCPA. אבל "ציבורי" לא אומר ש"אין חוקים". תמיד בדקו את תנאי השימוש של האתר.
תנאי השימוש של SuperPages (עודכנו ביולי 2019) כוללים סעיף "Data Mining Prohibited": אסור למשתמשים להשתמש בבוטים, crawlers, spiders או כלים דומים כדי לאסוף או לחלץ נתונים ללא הסכמה מוקדמת של Thryv. המאמר דן בשיטות ובתהליכים, אבל עליכם לבדוק את התנאים האלה ולקבל אישור היכן שצריך לפני חילוץ בהיקף גדול.
ציות בפנייה: יסודות CAN-SPAM ו-TCPA
אם אתם משתמשים באימיילים שחילצתם לפנייה קרה, מדריך ה-CAN-SPAM של ה-FTC קובע שעליכם:
- לא להשתמש בכותרות שקריות או מטעות
- לא להשתמש בשורות נושא מטעות
- לזהות את ההודעה כפרסומת כשנדרש
- לכלול כתובת דואר פיזית תקפה
- לספק מנגנון ביטול הרשמה ברור ולכבד אותו במהירות
אם אתם משתמשים במספרי טלפון שחילצתם לשיחות קרות, בדקו את National Do Not Call Registry ועמדו בכללי TCPA — במיוחד סביב שיחות אוטומטיות, הודעות מוקלטות ו-SMS. ה-FTC הודיעה ב-2024 על שינויים לחיזוק ההגנות נגד טלמרקטינג B2B מטעה ושיחות הונאה המונעות ב-AI.
צ’קליסט מהיר לעמידה בכללים
- ✅ לחלץ רק נתונים עסקיים ציבוריים
- ✅ לבדוק את תנאי השימוש של SuperPages ולקבל אישור היכן שנדרש
- ✅ לאמת אנשי קשר לפני פנייה
- ✅ לכלול אפשרות ביטול באימיילים
- ✅ לכבד robots.txt ומגבלות קצב
- ✅ לנהל רשימות DNC ורשימות suppression לאימייל
- ⚠️ להימנע מחילוץ נתונים אישיים/צרכניים
- ⚠️ לא למכור מחדש נתונים גולמיים שחולצו בלי בדיקה משפטית
בחרו את השיטה שלכם והתחילו לבנות את רשימת הלידים
חילוץ לידים מ-SuperPages הוא לא רק שליפת שורות מדף אינטרנט. הערך האמיתי מגיע מהצינור המלא: חילוץ, ניקוי, הסרת כפילויות, אימות, העשרה, ייבוא ופנייה בהתאם לכללים.
הנה הסיכום המהיר:
- Thunderbit הוא הנתיב המהיר ביותר לצוותי מכירות, סוכנויות ולא-מפתחים. שתי לחיצות לחילוץ, לחיצה אחת להעשרה מתתי-דפים, ייצוא חינמי ל-Google Sheets, Airtable, Notion או Excel. נסו בחינם.
- Octoparse הוא כלי workflow חזותי טוב למשתמשים טכניים-למחצה שרוצים יותר שליטה על ההגדרות.
- Python נותן למפתחים גמישות מלאה — אבל גם תחזוקה, כאבי ראש מול חסימות, וללא העשרה מובנית.
- וחשוב לזכור: אותו workflow עובד גם על Yellow Pages, Google Maps, Yelp, Manta ו-BBB. חילוץ ממספר מקורות, מיזוג והסרת כפילויות יתנו לכם את רשימת הלידים המקומית השלמה ביותר שאפשר.
אם אתם רוצים לראות את Thunderbit בפעולה, בדקו את ערוץ YouTube שלנו להדרכות, או חקרו את מחירי Thunderbit כדי לראות מה מתאים לצוות שלכם.
עכשיו צאו והפכו את דפי המדריכים האלה לצינור מכירות — ושהטלפונים שלכם יהיו תמיד בפורמט נכון והאימיילים תמיד מאומתים.
שאלות נפוצות
האם זה חוקי לחלץ לידים מ-SuperPages?
חילוץ נתוני מדריך עסקים ציבוריים למחקר B2B הוא פרקטיקה נפוצה, אבל תנאי השימוש של SuperPages אוסרים Data Mining ללא הסכמה מוקדמת של Thryv. תמיד בדקו את תנאי האתר, קבלו אישור היכן שצריך, ופעלו לפי תקנות פנייה כמו CAN-SPAM ו-TCPA. המאמר הזה מסביר שיטות ותהליכי עבודה למטרות לימודיות בלבד — האחריות לשימוש תואם כללים היא שלכם.
אילו נתונים אפשר לקבל מ-SuperPages?
חילוץ טיפוסי יניב שם העסק, טלפון, כתובת, אתר, קטגוריה, דירוגים, שעות פעילות ותיאורים. אימיילים כמעט אף פעם לא מופיעים בדף תוצאות החיפוש — בדרך כלל צריך לבקר בדף הפרטי של העסק או באתר שלו עצמו (באמצעות subpage scraping או email extractor) כדי למצוא אותם.
אפשר לחלץ מ-SuperPages בלי קוד?
כן. כלים כמו Thunderbit (הרחבת Chrome מבוססת AI) ו-Octoparse (מחלץ חזותי) מאפשרים לחלץ מ-SuperPages בלי לכתוב שורת קוד אחת. Thunderbit הוא האפשרות המהירה ביותר — מתקינים את ההרחבה, פותחים חיפוש ב-SuperPages, לוחצים "AI Suggest Fields", ואז "Scrape."
איך מטפלים בעימוד כשמחַלצים מ-SuperPages?
Thunderbit מטפל בעימוד אוטומטית — הוא מזהה כפתורי "Next" או גלילה אינסופית וממשיך. Octoparse דורש להגדיר שלב pagination בתוך ה-workflow. ב-Python צריך לכתוב לוגיקת לולאה ידנית על דפים (הגדלת מספרי דף, זיהוי הדף האחרון).
איך מקבלים אימיילים מרישומי SuperPages?
רוב רישומי SuperPages לא מציגים אימיילים בדף תוצאות החיפוש. השתמשו ב-Subpage Scraping של Thunderbit כדי לבקר בכל דף פרטי, או ב-Email Extractor החינמי באתר העסק. עבור פערים שנותרו, נסו כלי העשרה כמו Apollo, BetterContact או Prospeo — למרות שבעסקים מקומיים קטנים, חילוץ ישירות מהאתר לרוב עובד טוב יותר ממסדי נתונים B2B גדולים.
נסו AI Web Scraper ללידים מ-SuperPages Get Started Free
למידע נוסף


