Minggu lalu, salah satu pengguna kami cerita bahwa ia menghabiskan satu sore penuh buat menyalin daftar tukang pipa dari SuperPages ke spreadsheet — 47 baris dalam tiga jam. Pergelangan tangannya pegal, datanya penuh typo, dan emailnya pun masih belum ketemu. Cerita itu terasa sangat dekat, karena saya juga pernah mengalaminya. Dan memang itulah masalah yang ingin kami pecahkan saat membangun Thunderbit.
SuperPages adalah salah satu direktori bisnis lokal di AS yang sudah lama berdiri, dikelola oleh Thryv, dengan jangkauan luas di kota-kota besar dan berbagai kategori — tukang pipa, dokter gigi, pengacara, teknisi HVAC, dan lain-lain. Dokumentasi teknis lama menyebutnya sebagai basis data yellow pages nasional dengan lebih dari 11 juta listing, dan situsnya sampai sekarang masih menampilkan kategori lokal yang padat. Tantangannya bukan cari listing. Tantangannya adalah mengubahnya jadi daftar lead yang rapi dan kaya data tanpa bikin stres (atau menghabiskan sore Anda).
Menurut laporan Sales Trends 2024 dari HubSpot, tim sales cuma menghabiskan sekitar 2 jam per hari untuk benar-benar jualan — sisanya habis untuk input data dan riset. Dan 81% profesional sales bilang AI bisa bantu mereka mengurangi pekerjaan manual. Panduan ini membahas tiga cara untuk scrape SuperPages untuk lead — mulai dari AI tanpa coding sampai Python — supaya Anda bisa pilih metode yang paling cocok dengan kemampuan Anda dan kembali fokus ke hal yang benar-benar berdampak.
Scrape lead SuperPages dengan AI Get Started Free
Apa Itu SuperPages (dan Kenapa Tim Sales Suka Pakai untuk Lead)
SuperPages adalah direktori bisnis online yang fokus ke pasar AS, tempat bisnis lokal ditampilkan bersama detail kontak, kategori, rating, dan lainnya. Anggap saja ini versi digital dari buku telepon yellow pages lama — bedanya, sekarang bisa dicari berdasarkan kategori dan lokasi, dengan data yang jauh lebih kaya di tiap listing.

Berikut isi yang biasanya ada di listing SuperPages:
- Nama bisnis
- Nomor telepon
- Alamat jalan
- URL website (kalau tersedia)
- Kategori (misalnya Plumbing, Family Law, HVAC)
- Rating dan ulasan
- Jam operasional (biasanya di halaman detail)
- Deskripsi (halaman detail)
Beranda SuperPages menonjolkan kategori populer seperti Home Services, Plumbers, Electricians, Dentists, Legal Services, Auto Repair, Restaurants, dan Pet Services — yang kebetulan juga merupakan vertikal yang sering jadi target outreach oleh tim sales, agensi, dan vendor layanan lokal.
Singkatnya, SuperPages adalah tambang data emas buat siapa pun yang cari prospek bisnis lokal di AS. Datanya terstruktur, cakupannya luas, dan kategorinya sangat cocok untuk kampanye outbound yang nyata.
Coba Thunderbit untuk lead SuperPages
Kenapa Scrape SuperPages untuk Lead? (Use Case Utama)
Menelusuri SuperPages secara manual lalu menyalin datanya ke spreadsheet itu seperti lubang hitam produktivitas. Scraping mengotomatiskan proses itu, memberi Anda daftar yang terarah dan terstruktur dalam hitungan menit, bukan jam. Dan karena Anda yang mengontrol pencariannya (kategori + kota + kata kunci), hasilnya sering lebih relevan dibanding daftar lead beli yang generik.
Berikut use case yang paling sering saya lihat dari pengguna kami:
| Use Case | Yang Diuntungkan | Contoh |
|---|---|---|
| Generasi lead lokal | Tim sales, agensi | Membuat daftar tukang pipa di Dallas untuk cold outreach |
| Riset kompetitor | Operasional, marketing | Membandingkan rating dan layanan antar kompetitor di suatu pasar |
| Pemetaan pasar | Business development | Mengidentifikasi semua dokter gigi dalam satu kode pos untuk peluncuran produk baru |
| Sourcing vendor | Procurement, operasional | Mencari pemasok di suatu wilayah dengan info telepon + website |
| Prospek local SEO | Agensi | Menemukan bisnis yang belum punya website atau datanya lemah |
| Perencanaan territory | Field sales | Mengelompokkan kontraktor berdasarkan kota, kode pos, atau area layanan |
Pasar lead generation B2B di AS diperkirakan bernilai USD 8,5 miliar pada 2024 dan diproyeksikan mencapai USD 18,2 miliar pada 2034 — jadi permintaan terhadap data seperti ini jelas belum akan surut. Daftar yang baru di-scrape dan spesifik kategori-lokasi bisa jauh lebih tertarget daripada daftar beli generik, tetapi tetap perlu diverifikasi dan didedup sebelum outreach (lebih lanjut nanti).
Seperti Apa Hasil Akhirnya: Contoh Data SuperPages yang Sudah Di-Scrape
Sebelum masuk ke cara kerjanya, saya ingin menunjukkan hasil akhir yang benar-benar akan Anda dapatkan. Ini bagian yang sering dilewati banyak panduan — padahal kalau Anda menginvestasikan waktu, Anda perlu tahu seperti apa hasilnya.
Berikut contoh tabel output (data fiktif, format realistis):
| Nama Bisnis | Telepon | Alamat | Website | Kategori | Rating | Jam Operasional | Email (hasil enrichment) |
|---|---|---|---|---|---|---|---|
| Sunset Pipe & Drain Co. | +1 213-555-0148 | 1842 W 7th St, Los Angeles, CA 90057 | sunsetpipe.example | Plumbing | 4.6 | Senin-Jumat 7pagi-6sore | service@sunsetpipe.example |
| Arroyo HVAC Pros | +1 626-555-0182 | 72 N Fair Oaks Ave, Pasadena, CA 91103 | arroyohvac.example | HVAC | 4.8 | Senin-Sabtu 8pagi-7sore | hello@arroyohvac.example |
| Wilshire Family Dental | +1 323-555-0119 | 4100 Wilshire Blvd, Los Angeles, CA 90010 | wilshiredental.example | Dentists | 4.4 | Senin-Kamis 9pagi-5sore | appointments@wilshiredental.example |
| Pacific Legal Aid Group | +1 310-555-0173 | 11845 W Olympic Blvd, Los Angeles, CA 90064 | Legal Services | 4.2 | Senin-Jumat 8:30pagi-5:30sore | intake@pacificlegal.example | |
| Valley Auto Repair Center | +1 818-555-0198 | 14422 Ventura Blvd, Sherman Oaks, CA 91423 | valleyautorepair.example | Auto Repair | 4.7 | Senin-Sabtu 8pagi-6sore | info@valleyautorepair.example |
| Echo Park Pet Grooming | +1 213-555-0166 | 1511 Sunset Blvd, Los Angeles, CA 90026 | echoparkpets.example | Pet Grooming | 4.9 | Selasa-Minggu 9pagi-5sore | booking@echoparkpets.example |
Beberapa hal yang perlu diperhatikan:
- Dari halaman hasil pencarian: nama bisnis, telepon, alamat parsial, kategori, rating, URL listing.
- Dari halaman detail bisnis (subpage): alamat lengkap, jam operasional, deskripsi, ulasan, dan kadang website.
- Dari enrichment: email (sering kali cuma ditemukan di website bisnis itu sendiri atau lewat alat enrichment).
- Dari pembersihan data: format telepon E.164, normalisasi state/ZIP, kunci dedupe, source URL, dan tanggal scraping.
Inilah jenis output yang bisa langsung Anda masukkan ke CRM, Google Sheet, atau Airtable dan mulai dipakai saat itu juga.
3 Cara Scrape SuperPages untuk Lead: Perbandingan Singkat

Tidak semua orang punya kenyamanan teknis yang sama — atau kesabaran yang sama. Jadi berikut tiga metode berdampingan, supaya Anda bisa pilih yang paling pas:
| Kriteria | Thunderbit (AI Tanpa Kode) | Visual Scraper (mis. Octoparse) | Python (Requests + BS4) |
|---|---|---|---|
| Waktu setup | ~2 menit (install extension) | ~15 menit (buat workflow) | ~30 menit (install library, tulis kode) |
| Perlu coding | Tidak | Tidak | Ya (Python) |
| Penanganan pagination | Bawaan (klik atau scroll) | Perlu konfigurasi | Kode manual |
| Enrichment subpage | Scrape Subpage 1 klik | Perlu workflow/loop terpisah | Perlu script terpisah |
| Anti-blocking | Cloud Scraping menangani | Tergantung paket/add-on proxy | DIY (proxy, header, rate limit) |
| Opsi ekspor | Excel, Google Sheets, Airtable, Notion, CSV, JSON | CSV, Excel, database | Terserah yang Anda kode |
| Paling cocok untuk | Tim sales, agensi, non-developer | Pengguna semi-teknis | Developer yang ingin kontrol penuh |
Rekomendasi saya: kalau Anda ingin mulai scraping dalam 2 menit, langsung ke Metode 1. Kalau Anda suka workflow visual dan tidak keberatan konfigurasi, coba Metode 2. Kalau Anda ingin kontrol penuh dan paham Python, lompat ke Metode 3.
Metode 1: Scrape SuperPages untuk Lead dengan Thunderbit (AI, Tanpa Kode)
Ini adalah jalur tercepat dari “Saya punya pencarian SuperPages” menjadi “Saya punya daftar lead.” Tanpa coding, tanpa builder workflow, tanpa konfigurasi proxy. Saya memang bias — kami membangun Thunderbit — tetapi saya akan jelaskan langkahnya secara transparan supaya Anda bisa menilai sendiri.
Tingkat Kesulitan: Pemula
Waktu yang Dibutuhkan: ~5 menit untuk scrape kategori/kota lengkap
Yang Dibutuhkan: Browser Chrome, Thunderbit Chrome Extension (paket gratis cukup)
Langkah 1: Instal Thunderbit dan Buka SuperPages
Buka Halaman Download Thunderbit Chrome Extension lalu instal ekstensi Thunderbit. Cuma butuh sekitar satu menit. Setelah terpasang, buka halaman hasil pencarian SuperPages — misalnya cari “Plumbers in Los Angeles, CA” di superpages.com.
Anda akan melihat ikon Thunderbit di toolbar browser dan panel sidebar yang siap dipakai.
Langkah 2: Klik "AI Suggest Fields" untuk Mendeteksi Kolom Data Otomatis
Buka sidebar Thunderbit lalu klik "AI Suggest Fields." AI Thunderbit membaca halaman dan otomatis merekomendasikan kolom berdasarkan isi yang ditemukan — biasanya nama bisnis, telepon, alamat, website, kategori, rating, dan URL listing.
Anda bisa menyesuaikan, menambah, atau menghapus kolom sebelum scraping. Ingin menambahkan kolom khusus seperti “Punya Website?” atau “Service Area?” Cukup tulis deskripsi dalam bahasa biasa menggunakan Field AI Prompt. Misalnya, Anda bisa memberi instruksi supaya kolom memformat telepon menjadi +1XXXXXXXXXX atau mengklasifikasikan bisnis sebagai residential vs. commercial.
Sekarang Anda akan melihat pratinjau tabel dengan kolom yang sudah dikonfigurasi di panel Thunderbit.
Langkah 3: Klik "Scrape" dan Lihat Datanya Terisi Otomatis
Klik tombol biru "Scrape." Thunderbit mengekstrak semua listing di halaman saat ini dan mengisi tabel Anda baris demi baris. Untuk halaman hasil SuperPages yang umum, proses ini biasanya memakan waktu sekitar 30–45 detik.
Thunderbit otomatis menangani pagination — ia mendeteksi tombol "Next" atau infinite scroll dan terus jalan sampai halaman habis atau batas yang Anda tentukan tercapai. Kalau Anda scraping hasil yang besar (misalnya semua tukang pipa di satu wilayah metro), aktifkan Cloud Scraping, yang bisa memproses hingga 50 halaman sekaligus tanpa membebani browser Anda.
Langkah 4: Gunakan Scrape Subpages untuk Memperkaya Setiap Listing

Halaman hasil pencarian memberi Anda dasar-dasarnya, tetapi data yang benar-benar berharga — jam operasional, deskripsi lengkap, ulasan, kadang email — ada di halaman detail tiap bisnis. Klik "Scrape Subpages" dan Thunderbit akan membuka tiap halaman detail listing, lalu menarik kolom yang lebih kaya seperti jam operasional, deskripsi, URL website, dan info kontak yang tampil di sana.
Ini semua proses satu klik. Tidak perlu workflow terpisah, tidak perlu konfigurasi. Data enrichment akan langsung ditambahkan ke tabel yang sudah ada.
Langkah 5: Ekspor Lead Anda ke Excel, Google Sheets, Airtable, atau Notion
Kalau datanya sudah sesuai, klik Export. Thunderbit memungkinkan Anda mengirim lead langsung ke:
- Google Sheets (bagus untuk persiapan CRM dan berbagi data)
- Airtable (tabel pipeline yang ringan)
- Notion (database riset)
- Excel / CSV (untuk impor CRM)
- JSON (untuk developer handoff)

Semua opsi ekspor gratis. Kalau Anda ingin memasukkan lead ke HubSpot atau Salesforce, ekspor ke CSV atau Google Sheets biasanya jadi jalur tercepat.
Tips pro: scrape berdasarkan kategori + kota, bukan pencarian seluruh negara bagian. “Emergency plumbers Dallas TX” akan memberi daftar yang jauh lebih tajam dan bisa ditindaklanjuti dibanding “plumbers Texas.” Tambahkan kolom “Source URL” dan “Scraped At” untuk pelacakan.
Metode 2: Scrape SuperPages dengan Visual Scraping Tool (Contoh Octoparse)
Visual scraping tools seperti Octoparse ada di tengah-tengah: tidak perlu coding, tetapi butuh setup dan konfigurasi lebih banyak dibanding Thunderbit. Octoparse bahkan punya template SuperPages bawaan untuk kebutuhan yang lebih sederhana.
Tingkat Kesulitan: Menengah
Waktu yang Dibutuhkan: ~20–30 menit untuk setup + scraping
Yang Dibutuhkan: Akun Octoparse (paket gratis tersedia, dengan keterbatasan)
Langkah 1: Buat Task Baru dan Muat URL SuperPages
Buka Octoparse, klik "New Task," lalu tempel URL pencarian SuperPages Anda (misalnya "https://www.superpages.com/los-angeles-ca/plumbers"). Browser bawaan akan memuat halaman tersebut.
Langkah 2: Auto-Detect atau Pilih Field Data Secara Manual
Klik "Auto-detect" — Octoparse akan memindai halaman dan menyorot field data yang dianggap relevan. Tinjau panel Data Preview. Dari pengalaman saya, auto-detection sering menangkap sebagian besar field, tapi bisa juga ikut menangkap elemen tambahan (seperti label iklan atau teks navigasi) atau malah melewatkan beberapa field. Jadi kemungkinan Anda tetap perlu menambah atau menghapus beberapa field secara manual.
Menurut dokumentasi bantuan Octoparse, auto-detection membuat workflow dasar dengan langkah pagination dan extract-data, tetapi pengguna mungkin perlu menambahkan data yang hilang secara manual.
Langkah 3: Bangun Workflow dan Atur Pagination
Klik "Create workflow." Octoparse akan menghasilkan urutan aksi langkah demi langkah. Periksa langkah pagination — pastikan ia mengklik "Next" atau memuat hasil tambahan dengan benar. Kalau Anda ingin data dari halaman detail setiap bisnis (jam operasional, email, deskripsi), Anda perlu menambahkan loop halaman detail atau aksi subpage di dalam workflow. Ini menambah kompleksitas dibanding pendekatan subpage satu klik milik Thunderbit.
Langkah 4: Jalankan Task dan Ekspor Data
Jalankan task secara lokal (untuk pekerjaan kecil) atau di cloud Octoparse (untuk jadwal atau pekerjaan yang lebih besar — cloud adalah fitur berbayar). Setelah selesai, ekspor sebagai CSV, Excel, atau JSON.
Keterbatasan yang perlu diketahui: paket gratis Octoparse mencakup 10 task, hingga 50.000 baris/bulan, dan hanya ekstraksi lokal. Cloud run, rotasi IP, penyelesaian CAPTCHA, dan beberapa integrasi ekspor memerlukan paket berbayar (mulai sekitar $69/bulan jika dibayar tahunan).
Metode 3: Scrape SuperPages dengan Python (Requests + BeautifulSoup)
Ini jalur developer. Kontrol penuh, tanggung jawab penuh. Kalau Anda nyaman menulis dan merawat script Python, ini memberi fleksibilitas paling tinggi — tapi juga paling banyak menyita tenaga.
Tingkat Kesulitan: Lanjutan
Waktu yang Dibutuhkan: ~30–60 menit (setup + coding + debugging)
Yang Dibutuhkan: Python 3.x, pip, requests, beautifulsoup4, lxml, code editor
Langkah 1: Siapkan Environment Python
python -m venv .venv
source .venv/bin/activate
pip install requests beautifulsoup4 lxml pandas
Langkah 2: Periksa Struktur HTML SuperPages
Buka Developer Tools (F12) di halaman hasil SuperPages. Identifikasi selector CSS untuk nama bisnis, alamat, telepon, website, dan link halaman detail. Ingat: struktur HTML bisa berubah tanpa pemberitahuan, yang berarti selector Anda bisa rusak kapan saja.
Langkah 3: Tulis Scraper Listing dan Tangani Pagination
Berikut contoh sederhana. Catatan penting: dalam pengujian saya, request langsung ke SuperPages menghasilkan halaman blokir Cloudflare bertuliskan "Attention Required". Script Requests yang terlalu sederhana mungkin gagal pada skala besar — Anda mungkin perlu konteks sesi browser, rate limiting, retry, atau alternatif yang berwenang.
import csv, time
from urllib.parse import urljoin
import requests
from bs4 import BeautifulSoup
BASE_URL = "https://www.superpages.com"
HEADERS = {
"User-Agent": (
"Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_7) "
"AppleWebKit/537.36 (KHTML, like Gecko) "
"Chrome/125.0 Safari/537.36"
)
}
def fetch(url):
resp = requests.get(url, headers=HEADERS, timeout=20)
resp.raise_for_status()
if "Attention Required" in resp.text or "Cloudflare" in resp.text:
raise RuntimeError("Diblokir. Perlambat atau beralih ke browser/cloud scraping.")
return BeautifulSoup(resp.text, "lxml")
def parse_listing(card):
name_el = card.select_one(".business-name, a.business-name, h2 a, h3 a")
phone_el = card.select_one(".phones, .phone, [class*=phone]")
address_el = card.select_one(".street-address, .adr, [class*=address]")
website_el = card.select_one("a.track-visit-website, a[href*='http']")
rating_el = card.select_one(".rating, [class*=rating]")
detail_url = urljoin(BASE_URL, name_el.get("href")) if name_el and name_el.get("href") else ""
return {
"business_name": name_el.get_text(" ", strip=True) if name_el else "",
"phone": phone_el.get_text(" ", strip=True) if phone_el else "",
"address": address_el.get_text(" ", strip=True) if address_el else "",
"website": website_el.get("href", "") if website_el else "",
"rating": rating_el.get_text(" ", strip=True) if rating_el else "",
"detail_url": detail_url,
}
def scrape_search(search_url, pages=3):
all_rows = []
for page in range(1, pages + 1):
page_url = f"{search_url}?page={page}"
soup = fetch(page_url)
cards = soup.select(".result, .organic, [class*=result]")
if not cards:
break
for card in cards:
all_rows.append(parse_listing(card))
time.sleep(5)
return all_rows
if __name__ == "__main__":
rows = scrape_search("https://www.superpages.com/los-angeles-ca/plumbers", pages=2)
with open("superpages_leads.csv", "w", newline="", encoding="utf-8") as f:
writer = csv.DictWriter(f, fieldnames=sorted({k for row in rows for k in row}))
writer.writeheader()
writer.writerows(rows)
Langkah 4: Scrape Halaman Detail untuk Enrichment
Tulis fungsi terpisah untuk membuka URL halaman detail dan mengekstrak jam operasional, email, deskripsi, dan ulasan. Ini berarti Anda harus mengelola rate limit, error handling, dan mungkin proxy — semuanya jadi tanggung jawab Anda.
Langkah 5: Simpan Data ke CSV atau JSON
Gunakan modul csv atau json milik Python. Anda juga perlu membuat logika deduplikasi, pembersihan, dan ekspor sendiri.
Kendala umum:
- SuperPages bisa memblokir request dengan Cloudflare atau sistem anti-bot serupa (terkonfirmasi dalam pengujian saya).
- Selector di contoh ini dibuat sengaja cukup luas karena markup SuperPages bisa berubah.
- Jangan berasumsi halaman hasil pencarian berisi email. Hampir tidak pernah ada.
- Scraper produksi membutuhkan review robots/TOS, rate limiting, retry/backoff, structured logging, dan pencatatan error.
Kalau Anda ingin mendalami scraping dengan Python, lihat panduan kami tentang web scraping dengan Python atau tutorial BeautifulSoup.
Dari Data Mentah ke Lead Nyata: Pipeline Lengkap (Scrape → Clean → Verify → CRM)
Di sinilah kebanyakan panduan scraping berhenti — padahal di sinilah nilai sesungguhnya mulai terasa. Scraping memberi Anda bahan mentah. Mengubahnya menjadi daftar lead yang bisa dipakai butuh beberapa langkah tambahan.

Pipeline-nya seperti ini:
Pencarian SuperPages → Scrape listing → Scrape halaman detail/website → Ekspor ke Google Sheets atau CSV → Bersihkan telepon, alamat, kategori → Dedup → Verifikasi email/telepon → Enrich kontak yang hilang → Impor ke CRM → Outreach yang patuh aturan
Deduplikasi: Menghapus Listing Ganda
SuperPages sering menampilkan bisnis yang sama di beberapa kategori. Kalau Anda scrape “plumbers” dan “drain cleaning” di kota yang sama, pasti ada data yang saling tumpang tindih.
- Kunci dedupe utama: Nomor telepon yang dinormalisasi + alamat jalan yang dinormalisasi.
- Sekunder: Domain + kota.
- Cadangan: Nama bisnis + kode pos (cek manual untuk franchise).
Di Google Sheets, gunakan =UNIQUE(A:H) untuk kecocokan baris persis, atau buat helper column seperti =LOWER(REGEXREPLACE(B2&C2,"[^a-zA-Z0-9]","")) untuk menangkap duplikat yang mirip. Di Excel, gunakan Data > Remove Duplicates.
Pembersihan Data: Menstandarkan Telepon, Alamat, dan Format
- Format nomor telepon sebagai E.164 (untuk AS: +1 diikuti 10 digit). Ini format yang paling sering diharapkan CRM dan dialer. Anda bisa memakai Field AI Prompt di Thunderbit untuk memformat otomatis saat scraping.
- Normalisasi alamat: perluas singkatan, isi kode pos yang hilang, pecah ke kolom street/city/state/ZIP kalau perlu.
- Hapus artefak HTML, spasi berlebih, dan parameter tracking dari URL.
- Tambahkan kolom
source_directory,source_url, danscraped_atuntuk pelacakan.
Verifikasi Email dan Telepon Sebelum Outreach
Jangan langsung mengirim email dingin ke semua alamat yang Anda scrape. Verifikasi menjaga reputasi pengirim Anda dan memastikan bounce rate tetap rendah.
- Verifikasi email: ZeroBounce (mulai sekitar $39 untuk 2.000 kredit, plus 100 kredit gratis per bulan) atau Bouncer ($8 untuk 1.000 kredit, kredit tidak pernah kedaluwarsa) adalah pilihan yang bagus.
- Validasi telepon: Twilio Lookup menyediakan formatting dan validasi gratis; caller ID dikenakan $0,01/request.
- Free Email Extractor dan Phone Number Extractor dari Thunderbit bisa menarik detail kontak yang terlewat di halaman listing.
Enrichment: Mencari Kontak Saat SuperPages Tidak Menampilkan Email
Banyak listing SuperPages sama sekali tidak menampilkan email — terutama di halaman hasil pencarian. Jadi apa yang sebaiknya dilakukan?
- Scrape halaman Contact, About, atau footer di website bisnis. Subpage Scraping atau Email Extractor dari Thunderbit bisa melakukannya secara massal.
- Gunakan alat enrichment seperti Apollo, BetterContact, Icypeas, atau Prospeo. Catatan: untuk bisnis lokal kecil (toko pipa dua orang, dokter gigi solo), database B2B besar sering kali kosong. Ekstraksi dari website biasanya lebih efektif untuk kasus seperti ini.
- Gabungkan beberapa direktori. Scrape SuperPages, Yellow Pages, dan Google Maps untuk kategori/kota yang sama, lalu gabungkan dan dedup. Overlap-nya membantu melengkapi data.
Kalau Anda pernah coba memasukkan daftar SMB lokal ke Apollo dan hasilnya kebanyakan kosong, Anda tidak sendirian. Itulah kenapa pendekatan website-first penting untuk audiens ini.
Impor CRM: Memasukkan Lead ke HubSpot, Salesforce, atau Google Sheets
- HubSpot: Buka Data Management > Data Integration > Import data > Quick import (contacts only). Upload file
.csvatau.xlsx. Panduan impor HubSpot akan membantu pemetaan field. - Salesforce: Gunakan Data Import Wizard. Siapkan CSV, petakan field sumber ke field Salesforce, lalu jalankan impor.
- Google Sheets / Airtable / Notion: Thunderbit mengekspor langsung ke ketiganya — tanpa perlu CSV perantara.
Tips: Petakan kolom hasil scraping ke field CRM sebelum impor. Beberapa menit untuk mapping bisa menghemat berjam-jam pekerjaan manual nanti.
SuperPages vs Direktori Bisnis Lokal Lain: Di Mana Mencari Lead Terbaik
SuperPages adalah titik awal yang kuat, tetapi bukan satu-satunya direktori yang layak di-scrape. Berikut perbandingannya:
| Direktori | Volume Lead | Field Data Tersedia | Kebaruan Data | Tingkat Kesulitan Anti-Scraping | Paling Cocok Untuk |
|---|---|---|---|---|---|
| SuperPages | Besar (fokus AS) | Nama, telepon, alamat, website, kategori, rating | Sedang | Sedang | Home services, kontraktor, SMB |
| Yellow Pages | Besar (fokus AS) | Mirip SuperPages | Sedang | Sedang | Outreach bisnis lokal umum |
| Google Maps | Sangat besar (global) | Nama, telepon, alamat, website, ulasan, jam, foto | Tinggi (diperbarui pemilik) | Tinggi (anti-bot agresif) | Data lokal paling terbaru |
| Yelp | Besar (fokus AS) | Nama, telepon, alamat, ulasan, kisaran harga | Tinggi | Tinggi | Restoran, retail, bisnis layanan |
| Manta | Menengah | Nama, telepon, alamat, estimasi pendapatan, jumlah karyawan | Sedang | Rendah | Prospek B2B (data revenue/karyawan) |
| BBB | Menengah | Nama, telepon, alamat, akreditasi, komplain | Sedang | Rendah | Bisnis yang tepercaya dan terverifikasi |
Sumber: beranda SuperPages, paper VLDB SuperPages, dokumentasi Google Places API, dokumentasi Yelp Places API, beranda Manta, panduan BBB.
Thunderbit bekerja di semua ini — termasuk Instant Templates untuk situs populer seperti Google Maps dan SuperPages — sehingga Anda bisa menerapkan workflow yang sama ke berbagai sumber dan menggabungkan daftar lead Anda. Dari pengalaman saya, pendekatan terbaik sering kali adalah scrape dua atau tiga direktori untuk kategori/kota yang sama lalu dedup. Overlap membantu menutup celah dan memberi gambaran yang lebih lengkap.
Untuk detail tentang scraping direktori lain, lihat panduan kami tentang scraper Yellow Pages, scraper Google Maps, dan scraper Yelp.
Tips Legal dan Etis untuk Scrape Lead SuperPages

Saya bukan pengacara, dan ini bukan nasihat hukum — tetapi saya sudah cukup lama berkecimpung di area ini untuk tahu bahwa mengabaikan compliance adalah cara cepat buat kena masalah. Berikut ringkasan praktisnya.
Data Bisnis Publik vs Data Pribadi
Listing bisnis — nama perusahaan, telepon bisnis, alamat bisnis, website bisnis — umumnya dianggap data komersial publik. Itu berbeda dari data konsumen pribadi menurut GDPR atau CCPA. Tapi “publik” bukan berarti “bebas aturan.” Selalu cek Terms of Service situsnya.
Ketentuan penggunaan SuperPages (diperbarui Juli 2019) mencantumkan klausul “Data Mining Prohibited”: pengguna tidak boleh memakai bot, crawler, spider, atau alat serupa untuk mengumpulkan atau mengekstrak data tanpa persetujuan sebelumnya dari Thryv. Artikel ini membahas metode dan workflow, tetapi Anda tetap perlu meninjau ketentuan tersebut dan mendapat izin bila diperlukan sebelum scraping dalam skala besar.
Kepatuhan Outreach: Dasar CAN-SPAM dan TCPA
Kalau Anda memakai email hasil scrape untuk cold outreach, panduan FTC tentang CAN-SPAM mewajibkan Anda untuk:
- Tidak memakai header palsu atau menyesatkan
- Tidak memakai subject line yang menipu
- Mengidentifikasi pesan sebagai iklan bila diwajibkan
- Mencantumkan alamat pos fisik yang valid
- Menyediakan mekanisme opt-out yang jelas dan menanggapinya dengan cepat
Kalau Anda memakai nomor telepon hasil scrape untuk cold call, periksa National Do Not Call Registry dan patuhi aturan TCPA — terutama soal panggilan otomatis, pesan rekaman, dan SMS. FTC juga mengumumkan perubahan pada 2024 untuk memperkuat perlindungan terhadap telemarketing B2B yang menipu dan panggilan penipuan berbasis AI.
Checklist Kepatuhan Singkat
- ✅ Scrape hanya data bisnis yang dipublikasikan secara terbuka
- ✅ Tinjau Terms of Use SuperPages dan dapatkan izin bila diwajibkan
- ✅ Verifikasi kontak sebelum outreach
- ✅ Sertakan opt-out di email
- ✅ Hormati robots.txt dan rate limit
- ✅ Simpan daftar DNC dan suppression email
- ⚠️ Hindari scraping data pribadi/konsumen
- ⚠️ Jangan menjual ulang data mentah hasil scrape tanpa tinjauan legal
Pilih Metode Anda dan Mulai Bangun Daftar Lead
Scraping SuperPages untuk lead bukan sekadar mengekstrak baris dari halaman web. Nilai sesungguhnya datang dari pipeline lengkap: scrape, bersihkan, dedup, verifikasi, enrich, impor, lalu outreach dengan patuh aturan.
Ringkasan cepatnya:
- Thunderbit adalah jalur tercepat untuk tim sales, agensi, dan non-developer. Dua klik untuk scrape, satu klik untuk enrich lewat subpage, ekspor gratis ke Google Sheets, Airtable, Notion, atau Excel. Coba gratis.
- Octoparse adalah tool workflow visual yang solid untuk pengguna semi-teknis yang ingin kontrol konfigurasi lebih besar.
- Python memberi fleksibilitas penuh untuk developer — tapi datang dengan maintenance, tantangan anti-blocking, dan tanpa enrichment bawaan.
- Dan ingat: workflow yang sama berlaku untuk Yellow Pages, Google Maps, Yelp, Manta, dan BBB. Scrape beberapa sumber, gabungkan, dedup, dan Anda akan dapat daftar lead lokal yang paling lengkap.
Kalau Anda ingin melihat Thunderbit beraksi, kunjungi channel YouTube kami untuk walkthrough, atau lihat harga Thunderbit untuk pilih yang paling cocok buat tim Anda.
Sekarang ubah halaman direktori itu jadi pipeline — dan semoga nomor telepon Anda selalu rapi formatnya dan email Anda selalu terverifikasi.
FAQ
Apakah legal untuk scrape SuperPages untuk lead?
Scraping data direktori bisnis yang tersedia publik untuk riset B2B adalah praktik yang umum, tetapi Terms of Use SuperPages melarang data mining tanpa persetujuan sebelumnya dari Thryv. Selalu tinjau ketentuan situs, dapatkan izin bila diperlukan, dan patuhi aturan outreach seperti CAN-SPAM dan TCPA. Artikel ini membahas metode dan workflow untuk tujuan edukasi — tanggung jawab Anda untuk menggunakannya secara patuh.
Data apa saja yang bisa saya dapatkan dari SuperPages?
Scrape biasa biasanya menghasilkan nama bisnis, telepon, alamat, website, kategori, rating, jam operasional, dan deskripsi. Email jarang tampil di halaman hasil pencarian — biasanya Anda perlu membuka halaman detail bisnis atau website perusahaan itu sendiri (menggunakan subpage scraping atau email extractor) untuk menemukannya.
Apakah saya bisa scrape SuperPages tanpa coding?
Bisa. Tool seperti Thunderbit (ekstensi Chrome berbasis AI) dan Octoparse (visual scraper) memungkinkan Anda scrape SuperPages tanpa menulis satu baris kode pun. Thunderbit adalah opsi tercepat — instal ekstensi, buka pencarian SuperPages, klik "AI Suggest Fields," lalu "Scrape."
Bagaimana cara menangani pagination saat scraping SuperPages?
Thunderbit menangani pagination secara otomatis — ia mendeteksi tombol "Next" atau infinite scroll dan terus jalan. Octoparse mengharuskan Anda mengonfigurasi langkah pagination di workflow. Di Python, Anda perlu menulis logika loop halaman secara manual (menaikkan nomor halaman, mendeteksi halaman terakhir).
Bagaimana cara mendapatkan email dari listing SuperPages?
Sebagian besar listing SuperPages tidak menampilkan email di halaman hasil pencarian. Gunakan Thunderbit's Subpage Scraping untuk membuka tiap halaman detail, atau pakai Email Extractor gratis di website bisnis tersebut. Untuk celah yang tersisa, coba tool enrichment seperti Apollo, BetterContact, atau Prospeo — meski untuk bisnis lokal kecil, ekstraksi dari website sering kali lebih efektif dibanding database B2B besar.
Coba AI Web Scraper untuk lead SuperPages Get Started Free
Pelajari Lebih Lanjut


