Jak pozyskuję leady z SuperPages (3 metody krok po kroku)

Ostatnia aktualizacja: May 26, 2026
Jak pozyskuję leady z SuperPages (3 metody krok po kroku)
Podsumowanie AI
Automate your lead generation from SuperPages by comparing three methods: AI no-code tools, visual scrapers, and Python scripts. Get tips for 2026.

W zeszłym tygodniu jeden z naszych użytkowników powiedział mi, że spędził całe popołudnie na przepisywaniu ofert hydraulików z SuperPages do arkusza kalkulacyjnego — 47 wierszy w trzy godziny. Bolały go nadgarstki, dane miały literówki, a i tak nie miał adresów e-mail. Ta historia była mi aż za dobrze znana, bo sam przez to przechodziłem — i właśnie po to stworzyliśmy Thunderbit, żeby rozwiązywać takie problemy.

SuperPages to jeden z najdłużej działających amerykańskich katalogów lokalnych firm, prowadzony przez Thryv, z szerokim pokryciem dużych miast i wielu branż — hydraulicy, dentyści, prawnicy, specjaliści HVAC i wiele innych. Starsza dokumentacja techniczna opisywała go jako ogólnokrajową bazę yellow pages z ponad 11 milionami wpisów, a sama strona nadal pokazuje gęste, rozbudowane kategorie lokalne. Problemem nie jest znalezienie firm. Problemem jest zamiana ich w czystą, wzbogaconą listę leadów bez utraty cierpliwości (ani połowy dnia).

Według raportu HubSpot 2024 Sales Trends sprzedawcy poświęcają na realną sprzedaż tylko około 2 godzin dziennie — resztę zjadają zadania typu wprowadzanie danych i research. A 81% specjalistów sprzedaży uważa, że AI mogłoby pomóc im spędzać mniej czasu na pracy ręcznej. Ten przewodnik pokazuje trzy sposoby na zeskrobanie leadów z SuperPages — od AI bez kodu po Python — abyś mógł wybrać metodę dopasowaną do swoich umiejętności i wrócić do działań, które naprawdę robią różnicę.

Zeskrob SuperPages do leadów z pomocą AI Get Started Free

Czym jest SuperPages i dlaczego zespoły sprzedaży tak chętnie korzystają z niego do pozyskiwania leadów

SuperPages to katalog firm online nastawiony na rynek USA, w którym lokalne biznesy są opisane danymi kontaktowymi, kategoriami, ocenami i innymi informacjami. Można go traktować jako cyfrową ewolucję klasycznej książki telefonicznej Yellow Pages — tylko że teraz da się go przeszukiwać po kategorii i lokalizacji, a każdy wpis zawiera bogatszy zestaw danych.

superpages-directory-services.webp

Typowy wpis w SuperPages może zawierać:

  • nazwę firmy
  • numer telefonu
  • adres ulicy
  • adres URL strony internetowej (jeśli jest dostępny)
  • kategorię (np. hydraulika, prawo rodzinne, HVAC)
  • oceny i recenzje
  • godziny otwarcia (zwykle na stronie szczegółów)
  • opis (strona szczegółów)

Na stronie głównej SuperPages widoczne są popularne kategorie, takie jak Home Services, Plumbers, Electricians, Dentists, Legal Services, Auto Repair, Restaurants i Pet Services — czyli dokładnie te branże, które zespoły sprzedaży, agencje i lokalni usługodawcy najczęściej targetują w outreachu.

Krótko mówiąc, SuperPages to prawdziwa kopalnia danych dla osób pozyskujących lokalne firmy w USA. Dane są uporządkowane, zasięg szeroki, a kategorie świetnie pasują do realnych kampanii sprzedażowych.

Wypróbuj Thunderbit do leadów z SuperPages

Dlaczego warto zeskrobywać SuperPages pod leady (najczęstsze zastosowania)

Ręczne przeglądanie SuperPages i kopiowanie danych do arkusza to czarna dziura produktywności. Scrapowanie automatyzuje ten proces, dostarczając ukierunkowaną, uporządkowaną listę w kilka minut zamiast kilku godzin. A ponieważ sam kontrolujesz wyszukiwanie (kategoria + miasto + słowo kluczowe), wynik jest zwykle bardziej trafny niż ogólna kupiona lista leadów.

Oto najczęstsze zastosowania, które widzę u naszych użytkowników:

ZastosowanieKto zyskujePrzykład
Lokalna generacja leadówZespoły sprzedaży, agencjeZbuduj listę hydraulików w Dallas do cold outreachu
Analiza konkurencjiOperacje, marketingPorównaj oceny i zakres usług konkurentów na danym rynku
Mapowanie rynkuBusiness developmentZidentyfikuj wszystkich dentystów w danym kodzie pocztowym przed premierą produktu
Pozyskiwanie dostawcówZakupy, operacjeZnajdź dostawców w regionie z numerem telefonu i stroną www
Prospecting SEO lokalnegoAgencjeZnajdź firmy bez strony internetowej lub z ubogimi danymi w profilu
Planowanie terytoriumSprzedaż terenowaGrupuj wykonawców według miasta, kodu pocztowego lub obszaru obsługi

Rynek generowania leadów B2B w USA był w 2024 roku szacowany na 8,5 mld USD i ma wzrosnąć do 18,2 mld USD do 2034 roku — więc zapotrzebowanie na takie dane nie słabnie. Świeżo zeskrobana lista, dopasowana do kategorii i lokalizacji, bywa trafniejsza niż generyczna kupiona baza, ale i tak wymaga weryfikacji oraz deduplikacji przed kontaktem (wrócimy do tego później).

Jak wygląda finalny rezultat: przykładowe dane z SuperPages

Zanim przejdziemy do instrukcji, chcę pokazać Ci, co faktycznie otrzymasz. To ten fragment, którego większość poradników nie pokazuje — a skoro inwestujesz czas, warto wiedzieć, jaki będzie efekt.

Oto przykładowa tabela wynikowa (fikcyjne dane, realistyczna struktura):

Nazwa firmyTelefonAdresStrona internetowaKategoriaOcenaGodzinyE-mail (wzbogacony)
Sunset Pipe & Drain Co.+1 213-555-01481842 W 7th St, Los Angeles, CA 90057sunsetpipe.examplePlumbing4.6Mon-Fri 7a-6pservice@sunsetpipe.example
Arroyo HVAC Pros+1 626-555-018272 N Fair Oaks Ave, Pasadena, CA 91103arroyohvac.exampleHVAC4.8Mon-Sat 8a-7phello@arroyohvac.example
Wilshire Family Dental+1 323-555-01194100 Wilshire Blvd, Los Angeles, CA 90010wilshiredental.exampleDentists4.4Mon-Thu 9a-5pappointments@wilshiredental.example
Pacific Legal Aid Group+1 310-555-017311845 W Olympic Blvd, Los Angeles, CA 90064Legal Services4.2Mon-Fri 8:30a-5:30pintake@pacificlegal.example
Valley Auto Repair Center+1 818-555-019814422 Ventura Blvd, Sherman Oaks, CA 91423valleyautorepair.exampleAuto Repair4.7Mon-Sat 8a-6pinfo@valleyautorepair.example
Echo Park Pet Grooming+1 213-555-01661511 Sunset Blvd, Los Angeles, CA 90026echoparkpets.examplePet Grooming4.9Tue-Sun 9a-5pbooking@echoparkpets.example

Kilka ważnych rzeczy:

  • Ze strony wyników wyszukiwania: nazwa firmy, telefon, częściowy adres, kategoria, ocena, URL wpisu.
  • Ze strony szczegółów firmy (podstrona): pełny adres, godziny, opis, recenzje, czasem strona www.
  • Ze wzbogacenia danych: e-mail (często dostępny tylko na stronie firmy lub przez narzędzia do enrichmentu).
  • Z czyszczenia danych: telefon w formacie E.164, ujednolicony stan/kod ZIP, klucze do deduplikacji, adres źródłowy i data zeskrobania.

Taki wynik możesz od razu wrzucić do CRM, Google Sheets albo bazy Airtable i zacząć pracę bez dodatkowej obróbki.

3 sposoby na zeskrobanie leadów z SuperPages: szybkie porównanie

ai-no-code-visual-python-comparison.webp

Nie każdy ma taki sam komfort techniczny — ani tyle samo cierpliwości. Dlatego poniżej znajdziesz trzy metody obok siebie, żeby łatwo wybrać tę właściwą:

KryteriumThunderbit (AI bez kodu)Narzędzie wizualne do scrapowania (np. Octoparse)Python (Requests + BS4)
Czas konfiguracji~2 min (instalacja rozszerzenia)~15 min (utworzenie workflow)~30 min (instalacja bibliotek, napisanie kodu)
Wymagany kodBrakBrakTak (Python)
Obsługa paginacjiWbudowana (kliknięcie lub scroll)Wymaga konfiguracjiRęcznie w kodzie
Wzbogacanie podstronScrapowanie podstron 1 kliknięciemOsobny workflow/pętlaOsobny skrypt
Ochrona przed blokadamiCloud Scraping ogarnia to automatycznieZależy od planu/dodatku proxyDIY (proxy, nagłówki, limity)
Opcje eksportuExcel, Google Sheets, Airtable, Notion, CSV, JSONCSV, Excel, baza danychCokolwiek napiszesz
Najlepsze dlaZespoły sprzedaży, agencje, osoby nietechniczneUżytkownicy półtechniczniDeweloperzy chcący pełnej kontroli

Moja rekomendacja: jeśli chcesz zacząć scrapować w ciągu najbliższych 2 minut, wybierz Metodę 1. Jeśli wolisz wizualne workflow i nie przeszkadza Ci konfiguracja, wybierz Metodę 2. Jeśli chcesz pełnej kontroli i znasz Pythona, przejdź do Metody 3.

Metoda 1: Zeskrob SuperPages do leadów z Thunderbit (AI, bez kodu)

To najszybsza droga od „mam wyszukiwanie w SuperPages” do „mam listę leadów”. Bez kodowania, bez builderów workflow, bez konfiguracji proxy. Jestem stronniczy — to my stworzyliśmy Thunderbit — ale przeprowadzę Cię przez cały proces dokładnie, żebyś sam mógł ocenić.

Poziom trudności: początkujący
Czas: około 5 minut na pełne scrapowanie kategorii/miasta
Czego potrzebujesz: przeglądarka Chrome, rozszerzenie Thunderbit Chrome Extension (darmowy plan wystarczy)

Krok 1: Zainstaluj Thunderbit i otwórz SuperPages

Wejdź na stronę pobierania rozszerzenia Thunderbit Chrome i zainstaluj rozszerzenie Thunderbit. Zajmuje to około minuty. Po instalacji przejdź do strony wyników wyszukiwania w SuperPages — na przykład wyszukaj „Plumbers in Los Angeles, CA” na superpages.com.

Powinieneś zobaczyć ikonę Thunderbit na pasku narzędzi przeglądarki oraz gotowy panel boczny.

Krok 2: Kliknij „AI Suggest Fields”, aby automatycznie wykryć kolumny danych

Otwórz panel Thunderbit i kliknij „AI Suggest Fields”. AI Thunderbit odczyta stronę i automatycznie zaproponuje kolumny na podstawie tego, co znajdzie — zwykle nazwę firmy, telefon, adres, stronę www, kategorię, ocenę i URL wpisu.

Przed scrapowaniem możesz zmienić, dodać lub usunąć kolumny. Chcesz dodać własną kolumnę, np. „Has Website?” albo „Service Area?”? Po prostu wpisz opis po angielsku w Field AI Prompt. Możesz też polecić kolumnie np. „format phone as +1XXXXXXXXXX” albo „classify as residential vs. commercial”.

Powinieneś teraz widzieć podgląd tabeli z wybranymi kolumnami w panelu Thunderbit.

Krok 3: Kliknij „Scrape” i obserwuj, jak dane się zapełniają

Naciśnij niebieski przycisk „Scrape”. Thunderbit pobierze wszystkie wpisy z bieżącej strony i wypełni tabelę wiersz po wierszu. Dla typowej strony wyników SuperPages trwa to około 30–45 sekund.

Thunderbit automatycznie obsługuje paginację — wykrywa przycisk „Next” lub nieskończone przewijanie i kontynuuje, aż skończą się strony albo osiągniesz limit. Jeśli scrapujesz duży zestaw wyników (np. wszystkich hydraulików w dużym obszarze miejskim), przełącz się na tryb Cloud Scraping, który może przetwarzać nawet 50 stron jednocześnie bez blokowania przeglądarki.

Krok 4: Użyj Scrapowania Podstron, aby wzbogacić każdy wpis

business-profile-verification-process.webp

Strona wyników daje podstawy, ale prawdziwe złoto — godziny otwarcia, pełne opisy, recenzje, czasem e-mail — znajduje się na stronie szczegółów każdej firmy. Kliknij „Scrape Subpages”, a Thunderbit odwiedzi każdą podstronę wpisu, pobierając wzbogacone kolumny, takie jak godziny, opis, URL strony internetowej i wszelkie widoczne dane kontaktowe.

To proces jednym kliknięciem. Bez osobnego workflow, bez konfiguracji. Wzbogacone dane zostaną dopisane bezpośrednio do Twojej istniejącej tabeli.

Krok 5: Wyeksportuj leady do Excel, Google Sheets, Airtable lub Notion

Gdy dane Ci odpowiadają, kliknij Export. Thunderbit pozwala wysłać leady bezpośrednio do:

  • Google Sheets (świetne do przygotowania CRM i współdzielenia)
  • Airtable (lekkie tabele pipeline)
  • Notion (bazy badawcze)
  • Excel / CSV (import do CRM)
  • JSON (przekazanie deweloperowi)

cloud50-data-workflow.webp

Wszystkie opcje eksportu są darmowe. Jeśli zasilasz HubSpot lub Salesforce leadami, CSV albo Google Sheets zwykle będzie najszybszą drogą.

Wskazówka: scrapuj po kategorii + mieście, zamiast po szerokich wyszukiwaniach obejmujących cały stan. „Emergency plumbers Dallas TX” da Ci znacznie bardziej precyzyjną i użyteczną listę niż „plumbers Texas”. Dodaj też kolumny „Source URL” i „Scraped At”, żeby zachować pełną ścieżkę pochodzenia danych.

Metoda 2: Zeskrob SuperPages za pomocą wizualnego narzędzia do scrapowania (przykład Octoparse)

Narzędzia wizualne, takie jak Octoparse, są rozwiązaniem pośrednim: bez kodowania, ale z większą ilością ustawień niż w Thunderbit. Octoparse ma nawet gotowy szablon SuperPages dla prostszych przypadków użycia.

Poziom trudności: średni
Czas: około 20–30 minut na konfigurację i scrapowanie
Czego potrzebujesz: konto Octoparse (dostępny darmowy plan, ale z ograniczeniami)

Krok 1: Utwórz nowe zadanie i wczytaj URL SuperPages

Otwórz Octoparse, kliknij „New Task” i wklej adres wyszukiwania z SuperPages (np. „https://www.superpages.com/los-angeles-ca/plumbers”). Wbudowana przeglądarka załaduje stronę.

Krok 2: Automatycznie wykryj lub ręcznie wybierz pola danych

Kliknij „Auto-detect” — Octoparse przeskanuje stronę i podświetli pola danych, które uważa za istotne. Sprawdź panel Data Preview. Z mojego doświadczenia auto-detekcja często wykrywa większość pól, ale może dodać też zbędne elementy (np. etykiety reklam lub tekst nawigacyjny) albo coś pominąć. Prawdopodobnie będziesz musiał ręcznie dodać lub usunąć kilka pól.

Zgodnie z dokumentacją pomocy Octoparse, auto-detekcja tworzy podstawowy workflow z paginacją i krokiem ekstrakcji danych, ale użytkownik może potrzebować ręcznie uzupełnić brakujące pola.

Krok 3: Zbuduj workflow i skonfiguruj paginację

Kliknij „Create workflow”. Octoparse wygeneruje sekwencję działań krok po kroku. Sprawdź krok paginacji — upewnij się, że klika „Next” albo poprawnie ładuje kolejne wyniki. Jeśli chcesz pobierać dane z każdej strony szczegółów firmy (godziny, e-mail, opis), musisz dodać pętlę po stronach szczegółów albo akcję subpage w workflow. To zwiększa złożoność w porównaniu z jednorazowym scrapowaniem podstron w Thunderbit.

Krok 4: Uruchom zadanie i wyeksportuj dane

Uruchom zadanie lokalnie (dla mniejszych projektów) albo w chmurze Octoparse (dla zadań cyklicznych lub większych — cloud jest funkcją płatną). Po zakończeniu wyeksportuj dane jako CSV, Excel lub JSON.

Warto znać ograniczenia: darmowy plan Octoparse obejmuje 10 zadań, do 50 000 wierszy miesięcznie i tylko ekstrakcję lokalną. Uruchomienia w chmurze, rotacja IP, rozwiązywanie CAPTCHA i niektóre integracje eksportu wymagają płatnego planu (od około 69 USD/mies. przy rozliczeniu rocznym).

Metoda 3: Zeskrob SuperPages z użyciem Pythona (Requests + BeautifulSoup)

To ścieżka dla deweloperów. Pełna kontrola, pełna odpowiedzialność. Jeśli umiesz pisać i utrzymywać skrypty w Pythonie, masz tu największą elastyczność — ale też najwięcej problemów.

Poziom trudności: zaawansowany
Czas: około 30–60 minut (konfiguracja + kodowanie + debugowanie)
Czego potrzebujesz: Python 3.x, pip, requests, beautifulsoup4, lxml, edytor kodu

Krok 1: Skonfiguruj środowisko Pythona

python -m venv .venv
source .venv/bin/activate
pip install requests beautifulsoup4 lxml pandas

Krok 2: Sprawdź strukturę HTML SuperPages

Otwórz Narzędzia deweloperskie (F12) na stronie wyników SuperPages. Zidentyfikuj selektory CSS dla nazwy firmy, adresu, telefonu, strony internetowej i linku do strony szczegółów. Pamiętaj: struktura HTML może zmienić się bez ostrzeżenia, więc selektory mogą przestać działać w dowolnym momencie.

Krok 3: Napisz scraper listingu i obsłuż paginację

Oto uproszczony przykład. Ważne zastrzeżenie: w moich testach bezpośrednie żądanie do SuperPages zwracało stronę blokady Cloudflare „Attention Required”. Naiwny skrypt oparty na Requests może nie działać na większą skalę — możesz potrzebować kontekstu sesji przeglądarki, limitowania tempa, retry lub legalnych alternatyw.

import csv, time
from urllib.parse import urljoin
import requests
from bs4 import BeautifulSoup

BASE_URL = "https://www.superpages.com"
HEADERS = {
    "User-Agent": (
        "Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_7) "
        "AppleWebKit/537.36 (KHTML, like Gecko) "
        "Chrome/125.0 Safari/537.36"
    )
}

def fetch(url):
    resp = requests.get(url, headers=HEADERS, timeout=20)
    resp.raise_for_status()
    if "Attention Required" in resp.text or "Cloudflare" in resp.text:
        raise RuntimeError("Zablokowano. Zwolnij tempo albo przejdź na scrapowanie w przeglądarce/chmurze.")
    return BeautifulSoup(resp.text, "lxml")

def parse_listing(card):
    name_el = card.select_one(".business-name, a.business-name, h2 a, h3 a")
    phone_el = card.select_one(".phones, .phone, [class*=phone]")
    address_el = card.select_one(".street-address, .adr, [class*=address]")
    website_el = card.select_one("a.track-visit-website, a[href*='http']")
    rating_el = card.select_one(".rating, [class*=rating]")
    detail_url = urljoin(BASE_URL, name_el.get("href")) if name_el and name_el.get("href") else ""
    return {
        "business_name": name_el.get_text(" ", strip=True) if name_el else "",
        "phone": phone_el.get_text(" ", strip=True) if phone_el else "",
        "address": address_el.get_text(" ", strip=True) if address_el else "",
        "website": website_el.get("href", "") if website_el else "",
        "rating": rating_el.get_text(" ", strip=True) if rating_el else "",
        "detail_url": detail_url,
    }

def scrape_search(search_url, pages=3):
    all_rows = []
    for page in range(1, pages + 1):
        page_url = f"{search_url}?page={page}"
        soup = fetch(page_url)
        cards = soup.select(".result, .organic, [class*=result]")
        if not cards:
            break
        for card in cards:
            all_rows.append(parse_listing(card))
        time.sleep(5)
    return all_rows

if __name__ == "__main__":
    rows = scrape_search("https://www.superpages.com/los-angeles-ca/plumbers", pages=2)
    with open("superpages_leads.csv", "w", newline="", encoding="utf-8") as f:
        writer = csv.DictWriter(f, fieldnames=sorted({k for row in rows for k in row}))
        writer.writeheader()
        writer.writerows(rows)

Krok 4: Zeskrob strony szczegółów, aby wzbogacić dane

Napisz osobną funkcję, która odwiedzi każdy URL strony szczegółów i wyciągnie godziny, e-mail, opis oraz recenzje. Oznacza to, że sam musisz zarządzać limitami, błędami i potencjalnie proxy — wszystko po Twojej stronie.

Krok 5: Zapisz dane do CSV lub JSON

Użyj modułów csv lub json w Pythonie. Będziesz też musiał sam napisać logikę deduplikacji, czyszczenia i eksportu.

Najczęstsze pułapki:

  • SuperPages może blokować żądania za pomocą Cloudflare lub podobnych systemów anty-bot (potwierdziłem to w testach).
  • Selektory są tu celowo szerokie, bo markup SuperPages może się zmieniać.
  • Nie zakładaj, że strony wyników wyszukiwania zawierają e-maile. Prawie nigdy ich tam nie ma.
  • Produkcyjny scraper wymaga sprawdzenia robots/TOS, limitowania tempa, retry/backoff, logowania strukturalnego i obsługi błędów.

Jeśli chcesz zgłębić scrapowanie w Pythonie, sprawdź nasz poradnik o web scrapingu w Pythonie albo tutorial BeautifulSoup.

Od surowych danych do realnych leadów: pełny pipeline (scrape → clean → verify → CRM)

W tym miejscu większość poradników się kończy — a właśnie tutaj zaczyna się prawdziwa wartość. Scrapowanie daje Ci surowiec. Zamiana go w użyteczną listę leadów wymaga jeszcze kilku kroków.

data-pipeline-workflow.webp

Pipeline wygląda tak:

SuperPages search → scrape listings → scrape detail pages/websites → export to Google Sheets or CSV → clean phones, addresses, categories → deduplicate → verify emails/phones → enrich missing contacts → import to CRM → compliant outreach

Deduplikacja: usuwanie powtarzających się wpisów

SuperPages często pokazuje tę samą firmę w kilku kategoriach. Jeśli zeskrobiesz jednocześnie „plumbers” i „drain cleaning” w tym samym mieście, pojawią się duplikaty.

  • Główny klucz deduplikacji: znormalizowany numer telefonu + znormalizowany adres ulicy.
  • Drugi poziom: domena + miasto.
  • Zapasowo: nazwa firmy + kod ZIP (dla franczyz sprawdź ręcznie).

W Google Sheets użyj =UNIQUE(A:H) dla dokładnych dopasowań całych wierszy albo utwórz kolumnę pomocniczą, np. =LOWER(REGEXREPLACE(B2&C2,"[^a-zA-Z0-9]","")), aby wyłapywać prawie duplikaty. W Excelu użyj Data > Remove Duplicates.

Czyszczenie danych: standaryzacja telefonów, adresów i formatowania

  • Formatuj numery telefonu do E.164 (dla USA: +1, a potem 10 cyfr). To format, którego oczekuje większość CRM-ów i dialerów. Możesz użyć Field AI Prompt w Thunderbit, aby automatycznie sformatować dane już podczas scrapowania.
  • Ujednolicaj adresy: rozwijaj skróty, uzupełniaj brakujące kody ZIP, dziel na kolumny ulica/miasto/stan/ZIP, jeśli trzeba.
  • Usuwaj śmieci HTML, nadmiarowe spacje i parametry śledzące z URL-i.
  • Dodaj kolumny source_directory, source_url i scraped_at, aby zachować możliwość śledzenia źródła.

Weryfikacja e-maili i telefonów przed outreachiem

Nie wysyłaj masowo cold maila na każdy zeskrobany adres. Weryfikacja chroni reputację nadawcy i utrzymuje niski współczynnik odbić.

  • Weryfikacja e-maili: ZeroBounce (od ok. 39 USD za 2 000 kredytów, plus 100 darmowych kredytów miesięcznie) lub Bouncer (8 USD za 1 000 kredytów, kredyty nigdy nie wygasają) to solidne opcje.
  • Walidacja telefonu: Twilio Lookup oferuje formatowanie i weryfikację za darmo; caller ID kosztuje 0,01 USD za żądanie.
  • Darmowe narzędzia Thunderbit Email Extractor i Phone Number Extractor mogą wyciągać dane kontaktowe, których nie ma na stronach wpisów.

Wzbogacanie danych: jak znaleźć kontakty, gdy SuperPages nie pokazuje e-maili

Wiele wpisów SuperPages w ogóle nie pokazuje e-maila — szczególnie na stronie wyników wyszukiwania. Co wtedy zrobić?

  • Zeskrob strony Contact, About albo stopki na stronie firmowej. Thunderbit Subpage Scraping lub Email Extractor potrafią zrobić to hurtowo.
  • Użyj narzędzi do wzbogacania danych, takich jak Apollo, BetterContact, Icypeas czy Prospeo. Uwaga: w przypadku małych lokalnych firm (dwuosobowy warsztat hydrauliczny, jednoosobowy gabinet dentystyczny) duże bazy B2B często zwracają pustki. Dla takiej grupy lepiej działa podejście oparte najpierw na stronie internetowej.
  • Połącz kilka katalogów. Zeskrob SuperPages, Yellow Pages i Google Maps dla tej samej kategorii/miasta, a potem scal i usuń duplikaty. Nakładanie się rekordów daje pełniejszy zestaw danych.

Jeśli kiedykolwiek wrzuciłeś listę lokalnych SMB do Apollo i dostałeś głównie puste pola, nie jesteś sam. Dlatego podejście „website-first” jest tak ważne dla tej grupy odbiorców.

Import do CRM: jak przenieść leady do HubSpot, Salesforce lub Google Sheets

  • HubSpot: przejdź do Data Management > Data Integration > Import data > Quick import (contacts only). Wgraj plik .csv lub .xlsx. Przewodnik importu HubSpot prowadzi przez mapowanie pól.
  • Salesforce: użyj Data Import Wizard. Przygotuj CSV, dopasuj pola źródłowe do pól Salesforce i uruchom import.
  • Google Sheets / Airtable / Notion: Thunderbit eksportuje bezpośrednio do wszystkich trzech — bez pośredniego CSV.

Wskazówka: dopasuj zeskrobane kolumny do pól CRM jeszcze przed importem. Kilka minut mapowania oszczędza później godziny ręcznego czyszczenia.

SuperPages vs. inne katalogi lokalnych firm: gdzie znaleźć najlepsze leady

SuperPages to bardzo mocny punkt startowy, ale nie jedyny katalog wart scrapowania. Oto porównanie:

KatalogWolumen leadówDostępne polaŚwieżość danychTrudność scrapowaniaNajlepsze do
SuperPagesDuży (USA)Nazwa, telefon, adres, strona, kategorie, ocenyŚredniaŚredniaUsługi domowe, wykonawcy, SMB
Yellow PagesDuży (USA)Podobnie jak SuperPagesŚredniaŚredniaOgólny lokalny outreach
Google MapsBardzo duży (globalnie)Nazwa, telefon, adres, strona, recenzje, godziny, zdjęciaWysoka (aktualizowana przez właścicieli)Wysoka (agresywna ochrona anty-bot)Najświeższe dane lokalne
YelpDuży (USA)Nazwa, telefon, adres, recenzje, przedział cenowyWysokaWysokaRestauracje, handel, usługi
MantaŚredniNazwa, telefon, adres, szacowane przychody, liczba pracownikówŚredniaNiskaProspecting B2B (dane o przychodach/liczbie pracowników)
BBBŚredniNazwa, telefon, adres, akredytacja, skargiŚredniaNiskaWiarygodne, sprawdzone firmy

Źródła: strona główna SuperPages, artykuł VLDB o SuperPages, dokumentacja Google Places API, dokumentacja Yelp Places API, strona główna Manta, przewodnik BBB.

Thunderbit działa na wszystkich tych źródłach — w tym oferuje Instant Templates dla popularnych serwisów, takich jak Google Maps i SuperPages — więc możesz zastosować ten sam workflow do wielu źródeł i połączyć listy leadów. Z mojego doświadczenia najlepsze efekty daje często zeskrobanie dwóch lub trzech katalogów dla tej samej kategorii/miasta i ich deduplikacja. Nakładające się rekordy uzupełniają braki i dają pełniejszy obraz.

Więcej informacji o scrapowaniu innych katalogów znajdziesz w naszych poradnikach o Yellow Pages scrapers, Google Maps scrapers i Yelp scrapers.

Wskazówki prawne i etyczne dotyczące scrapowania leadów z SuperPages

data-privacy-compliance-infographic.webp

Nie jestem prawnikiem i nie jest to porada prawna — ale spędziłem w tej branży wystarczająco dużo czasu, żeby wiedzieć, że ignorowanie zgodności z przepisami szybko się mści. Oto praktyczne podsumowanie.

Publiczne dane firmowe vs. dane osobowe

Wpisy firmowe — nazwa firmy, numer telefonu firmy, adres firmy, strona internetowa firmy — są zwykle uznawane za publiczne dane komercyjne. To coś innego niż dane osobowe konsumentów w rozumieniu GDPR lub CCPA. Ale „publiczne” nie oznacza „bez zasad”. Zawsze sprawdzaj regulamin serwisu.

Warunki korzystania z SuperPages (zaktualizowane w lipcu 2019) zawierają klauzulę „Data Mining Prohibited”: użytkownicy nie mogą używać botów, crawlerów, spiderów ani podobnych narzędzi do zbierania lub ekstrakcji danych bez wcześniejszej zgody Thryv. Artykuł omawia metody i workflow, ale przed scrapowaniem na większą skalę powinieneś sprawdzić te warunki i w razie potrzeby uzyskać zgodę.

Zgodność outreachu: podstawy CAN-SPAM i TCPA

Jeśli używasz zeskrobanych e-maili do cold outreachu, przewodnik FTC dotyczący CAN-SPAM mówi, że musisz:

  • nie używać fałszywych lub wprowadzających w błąd nagłówków
  • nie stosować podstępnych tematów wiadomości
  • identyfikować wiadomość jako reklamę, gdy jest to wymagane
  • podać ważny adres fizyczny do korespondencji
  • zapewnić jasny mechanizm opt-out i respektować go niezwłocznie

Jeśli używasz zeskrobanych numerów telefonów do cold callingu, sprawdź National Do Not Call Registry i stosuj się do zasad TCPA — szczególnie dotyczących połączeń automatycznych, nagrań i SMS-ów. FTC ogłosiła w 2024 roku zmiany wzmacniające ochronę przed oszukańczym telemarketingiem B2B i scamami wykorzystującymi AI.

Krótka checklista zgodności

  • ✅ Zeskrobuj wyłącznie publicznie dostępne dane firmowe
  • ✅ Sprawdź Warunki korzystania z SuperPages i uzyskaj zgodę tam, gdzie jest wymagana
  • ✅ Zweryfikuj kontakty przed outreachiem
  • ✅ Dodawaj opt-out w e-mailach
  • ✅ Respektuj robots.txt i limity szybkości
  • ✅ Prowadź listy DNC i suppression dla e-maili
  • ⚠️ Unikaj scrapowania danych osobowych/konsumenckich
  • ⚠️ Nie odsprzedawaj surowych zeskrobanych danych bez analizy prawnej

Wybierz metodę i zacznij budować swoją listę leadów

Scrapowanie SuperPages pod leady to nie tylko wyciąganie wierszy ze strony. Prawdziwa wartość leży w pełnym pipeline: scrape, clean, deduplicate, verify, enrich, import i zgodny z przepisami outreach.

Krótko podsumowując:

  • Thunderbit to najszybsza ścieżka dla zespołów sprzedaży, agencji i osób bez zaplecza technicznego. Dwa kliknięcia do scrapowania, jedno kliknięcie do wzbogacenia przez podstrony, darmowy eksport do Google Sheets, Airtable, Notion lub Excel. Wypróbuj za darmo.
  • Octoparse to solidne narzędzie wizualne dla użytkowników półtechnicznych, którzy chcą większej kontroli nad konfiguracją.
  • Python daje deweloperom pełną elastyczność — ale wiąże się z utrzymaniem, problemami z blokadami i brakiem wbudowanego wzbogacania.
  • I pamiętaj: ten sam workflow działa też dla Yellow Pages, Google Maps, Yelp, Manta i BBB. Zeskrobuj wiele źródeł, scalaj, usuwaj duplikaty, a otrzymasz możliwie najpełniejszą lokalną listę leadów.

Jeśli chcesz zobaczyć Thunderbit w akcji, zajrzyj na nasz kanał YouTube, gdzie znajdziesz instrukcje krok po kroku, albo sprawdź cennik Thunderbit, żeby dobrać opcję dla swojego zespołu.

Teraz zamień te katalogi w pipeline — i niech Twoje numery telefonów zawsze będą poprawnie sformatowane, a e-maile zawsze zweryfikowane.

FAQ

Czy scrapowanie SuperPages pod leady jest legalne?

Scrapowanie publicznie dostępnych danych z katalogów firm do badań B2B jest powszechną praktyką, ale Warunki korzystania z SuperPages zabraniają data mining bez wcześniejszej zgody Thryv. Zawsze sprawdzaj regulamin serwisu, uzyskuj zgodę tam, gdzie jest potrzebna, i przestrzegaj zasad outreachu, takich jak CAN-SPAM i TCPA. Ten artykuł opisuje metody i workflow w celach edukacyjnych — to Ty odpowiadasz za ich zgodne z prawem użycie.

Jakie dane mogę uzyskać z SuperPages?

Typowe scrapowanie daje nazwę firmy, telefon, adres, stronę internetową, kategorię, oceny, godziny i opisy. E-maile rzadko są widoczne na stronie wyników wyszukiwania — zwykle trzeba wejść na stronę szczegółów firmy albo na jej własną stronę internetową (korzystając ze scrapowania podstron lub email extractora), żeby je znaleźć.

Czy mogę scrapować SuperPages bez kodowania?

Tak. Narzędzia takie jak Thunderbit (rozszerzenie AI do Chrome) i Octoparse (wizualny scraper) pozwalają scrapować SuperPages bez napisania ani jednej linijki kodu. Thunderbit jest najszybszą opcją — zainstaluj rozszerzenie, otwórz wyszukiwanie w SuperPages, kliknij „AI Suggest Fields”, a potem „Scrape”.

Jak obsłużyć paginację przy scrapowaniu SuperPages?

Thunderbit obsługuje paginację automatycznie — wykrywa przycisk „Next” lub nieskończone przewijanie i idzie dalej. Octoparse wymaga skonfigurowania kroku paginacji w workflow. W Pythonie trzeba napisać ręczną pętlę po stronach (zwiększanie numeru strony, wykrywanie ostatniej strony).

Jak zdobyć e-maile z wpisów SuperPages?

Większość wpisów SuperPages nie pokazuje e-maili na stronie wyników wyszukiwania. Użyj Scrapowania Podstron w Thunderbit, aby odwiedzić każdą stronę szczegółów, albo skorzystaj z darmowego Email Extractora na stronie internetowej firmy. Jeśli nadal brakuje danych, spróbuj narzędzi do wzbogacania danych, takich jak Apollo, BetterContact lub Prospeo — choć w przypadku małych lokalnych firm podejście oparte najpierw na stronie internetowej często działa lepiej niż duże bazy B2B.

Wypróbuj AI Web Scraper do leadów z SuperPages Get Started Free

Dowiedz się więcej

Shuai Guan
Shuai Guan
CEO w Thunderbit | Ekspert ds. automatyzacji danych AI Shuai Guan jest CEO Thunderbit oraz absolwentem wydziału inżynierii University of Michigan. Czerpiąc z niemal dekady doświadczenia w branży technologicznej i architekturze SaaS, specjalizuje się w przekuwaniu złożonych modeli AI w praktyczne, niewymagające kodowania narzędzia do استخراج danych. Na tym blogu dzieli się szczerymi, sprawdzonymi w boju spostrzeżeniami na temat web scrapingu i strategii automatyzacji, które pomogą Ci tworzyć mądrzejsze, oparte na danych procesy pracy. Gdy nie optymalizuje przepływów danych, z tą samą dbałością o szczegóły oddaje się swojej pasji do fotografii.
Spis treści

Zbierz dane ze strony, po prostu o to prosząc

Powiedz, czego potrzebujesz, prostym angielskim. A najlepiej: nie mów nic.

Wypróbuj Thunderbit darmowe
Wyodrębniaj dane dzięki AI
Łatwo przenoś dane do Google Sheets, Airtable lub Notion
Chrome Store Rating
PRODUCT HUNT#1 Product of the Week