Så här skrapar jag SuperPages för leads (3 metoder, steg för steg)

Senast uppdaterad May 26, 2026
Så här skrapar jag SuperPages för leads (3 metoder, steg för steg)
AI-sammanfattning
Automate your lead generation from SuperPages by comparing three methods: AI no-code tools, visual scrapers, and Python scripts. Get tips for 2026.

Förra veckan berättade en av våra användare att han hade tillbringat hela eftermiddagen med att kopiera rörmokarannonser från SuperPages till ett kalkylblad — 47 rader på tre timmar. Handlederna värkte, datan innehöll stavfel och han hade fortfarande inga e-postadresser. Jag kände verkligen igen mig i den historien, för jag har själv varit där, och det är precis den typen av problem vi byggde Thunderbit för att lösa.

SuperPages är en av USA:s mest etablerade lokala företagskataloger, driven av Thryv, med bred täckning över stora städer och kategorier — rörmokare, tandläkare, jurister, HVAC-tekniker, you name it. Äldre teknisk dokumentation beskrev den som en nationell gula-sidorna-databas med över 11 miljoner listningar, och sajten visar fortfarande täta lokala kategorier. Utmaningen är inte att hitta listningar. Det är att förvandla dem till en ren, berikad leadlista utan att tappa tålamodet (eller hela eftermiddagen).

Enligt HubSpot's 2024 Sales Trends-rapport lägger säljare bara omkring 2 timmar per dag på faktiskt säljarbete — resten äts upp av uppgifter som datainmatning och research. Och 81% av säljproffs säger att AI skulle kunna hjälpa dem att lägga mindre tid på manuellt arbete. Den här guiden går igenom tre sätt att skrapa SuperPages för leads — från no-code AI till Python — så att du kan välja metoden som passar din nivå och sedan lägga tiden på sådant som faktiskt driver affären framåt.

Skrapa SuperPages för leads med AI Get Started Free

Vad är SuperPages (och varför säljteamen gillar det för leads)

SuperPages är en amerikansk onlinekatalog för lokala företag där verksamheter listas med kontaktuppgifter, kategorier, omdömen och mer. Tänk det som den digitala versionen av den gamla gula-sidorna-telefonkatalogen — fast nu går det att söka på kategori och plats, med betydligt mer data per listning.

superpages-directory-services.webp

En typisk SuperPages-listning kan innehålla:

  • Företagsnamn
  • Telefonnummer
  • Gatuadress
  • Webbplats-URL (när den finns)
  • Kategori (t.ex. VVS, familjerätt, HVAC)
  • Betyg och omdömen
  • Öppettider (vanligtvis på detaljsidan)
  • Beskrivning (detaljsidan)

SuperPages startsida lyfter fram populära kategorier som hemservice, rörmokare, elektriker, tandläkare, juridiska tjänster, bilverkstäder, restauranger och djurtjänster — alltså exakt de vertikaler som säljteam, byråer och lokala tjänsteleverantörer riktar sin prospektering mot.

Kort sagt: SuperPages är en riktig guldgruva för alla som prospekterar lokala företag i USA. Datan är strukturerad, täckningen är bred och kategorierna passar perfekt för riktade outbound-kampanjer.

Testa Thunderbit för SuperPages-leads

Varför skrapa SuperPages för leads (vanligaste användningsområden)

Att manuellt gå igenom SuperPages och kopiera data till ett kalkylblad är ett svart hål för produktiviteten. Skrapning automatiserar processen och ger dig en riktad, strukturerad lista på några minuter i stället för timmar. Och eftersom du själv styr sökningen (kategori + stad + nyckelord) blir resultatet ofta mer relevant än en generell inköpt leadlista.

Här är de vanligaste användningsområden jag ser bland våra användare:

AnvändningsområdeVem har nytta av detExempel
Lokal leadgenereringSäljteam, byråerBygg en lista över rörmokare i Dallas för kall outreach
KonkurrentanalysDrift, marknadsföringJämför betyg och tjänster mellan konkurrenter i en marknad
MarknadskartläggningAffärsutvecklingIdentifiera alla tandläkare i ett postnummerområde inför en ny produktlansering
LeverantörsourcingInköp, driftHitta leverantörer i en region med telefon- och webbplatsinfo
Lokal SEO-prospekteringByråerHitta företag utan webbplats eller med svag listningsdata
OmrådesplaneringFältsäljGruppera entreprenörer per stad, postnummer eller serviceområde

Den amerikanska B2B-marknaden för leadgenerering uppskattades till 8,5 miljarder USD år 2024 och väntas nå 18,2 miljarder USD till 2034 — så efterfrågan på den här typen av data lär inte minska. En nyskapad lista, filtrerad efter kategori och plats, kan vara mer träffsäker än en generisk köpt lista, men den behöver ändå verifieras och rensas från dubbletter innan du börjar kontakta den (mer om det senare).

Så ser slutresultatet ut: exempel på skrapad data från SuperPages

Innan vi går in på hur man gör vill jag visa vad du faktiskt får ut. Det här är delen många guider hoppar över — men om du lägger tid på något bör du veta vad resultatet blir.

Här är ett exempel på slutoutputen (fiktiva data, realistiskt format):

FöretagsnamnTelefonAdressWebbplatsKategoriBetygÖppettiderE-post (berikad)
Sunset Pipe & Drain Co.+1 213-555-01481842 W 7th St, Los Angeles, CA 90057sunsetpipe.exampleVVS4.6Mån–Fre 7–18service@sunsetpipe.example
Arroyo HVAC Pros+1 626-555-018272 N Fair Oaks Ave, Pasadena, CA 91103arroyohvac.exampleHVAC4.8Mån–Lör 8–19hello@arroyohvac.example
Wilshire Family Dental+1 323-555-01194100 Wilshire Blvd, Los Angeles, CA 90010wilshiredental.exampleTandläkare4.4Mån–Tor 9–17appointments@wilshiredental.example
Pacific Legal Aid Group+1 310-555-017311845 W Olympic Blvd, Los Angeles, CA 90064Juridiska tjänster4.2Mån–Fre 8:30–17:30intake@pacificlegal.example
Valley Auto Repair Center+1 818-555-019814422 Ventura Blvd, Sherman Oaks, CA 91423valleyautorepair.exampleBilverkstad4.7Mån–Lör 8–18info@valleyautorepair.example
Echo Park Pet Grooming+1 213-555-01661511 Sunset Blvd, Los Angeles, CA 90026echoparkpets.exampleDjurtrim4.9Tis–Sön 9–17booking@echoparkpets.example

Några saker att notera:

  • Från sökresultatsidan: företagsnamn, telefon, delvis adress, kategori, betyg, listnings-URL.
  • Från företagets detaljsida: fullständig adress, öppettider, beskrivning, omdömen, ibland webbplats.
  • Från berikning: e-postadress (ofta bara hittbar på företagets egen webbplats eller via berikningsverktyg).
  • Från rensning: telefon formaterad som E.164, normaliserat stat/postnummer, dubblettnycklar, käll-URL och datum för när datan skrapades.

Det här är den typen av output du kan lägga direkt i ett CRM, ett Google Sheet eller en Airtable-bas och börja jobba med direkt.

3 sätt att skrapa SuperPages för leads: snabb jämförelse

ai-no-code-visual-python-comparison.webp

Alla har inte samma tekniska nivå — eller samma tålamod. Därför får du här tre metoder sida vid sida, så att du kan välja den som passar bäst:

KriteriumThunderbit (AI, no-code)Visuellt skrapverktyg (t.ex. Octoparse)Python (Requests + BS4)
Starttid~2 min (installera tillägg)~15 min (skapa arbetsflöde)~30 min (installera bibliotek, skriv kod)
Kräver kodNejNejJa (Python)
Hantering av pagineringInbyggd (klick eller scroll)Kräver inställningManuell kod
Berikning av undersidor1-klicks Subpage ScrapingSeparat arbetsflöde/loop behövsSeparat skript
Skydd mot blockeringCloud Scraping hanterar detBeror på plan/proxy-tilläggEget ansvar (proxys, headers, rate limits)
ExportalternativExcel, Google Sheets, Airtable, Notion, CSV, JSONCSV, Excel, databasVad du själv kodar
Bäst förSäljteam, byråer, icke-utvecklareSemi-tekniska användareUtvecklare som vill ha full kontroll

Min rekommendation: om du vill börja skrapa inom de närmaste 2 minuterna, gå till metod 1. Om du gillar visuella arbetsflöden och inte har något emot viss konfiguration, testa metod 2. Om du vill ha full kontroll och kan Python, hoppa till metod 3.

Metod 1: Skrapa SuperPages för leads med Thunderbit (AI, no-code)

Det här är snabbaste vägen från “jag har en SuperPages-sökning” till “jag har en leadlista.” Ingen kod, inga workflow-byggare, ingen proxy-konfiguration. Jag är förstås partisk — vi byggde Thunderbit — men jag går igenom exakt vad som händer så att du kan bedöma själv.

Svårighetsgrad: Nybörjare
Tidsåtgång: ~5 minuter för en full kategori-/stadsskrapning
Du behöver: Chrome-webbläsare, Thunderbit Chrome Extension (gratisnivån fungerar)

Steg 1: Installera Thunderbit och öppna SuperPages

Gå till Thunderbit Chrome Extension Download Page och installera Thunderbit-tillägget. Det tar ungefär en minut. När det är installerat, gå till en SuperPages-söksida — till exempel sök på “Plumbers in Los Angeles, CA” på superpages.com.

Du bör se Thunderbit-ikonen i webbläsarens verktygsfält och en sidopanel redo att användas.

Steg 2: Klicka på “AI Suggest Fields” för att autoidentifiera datakolumner

Öppna Thunderbit-sidopanelen och klicka på “AI Suggest Fields.” Thunderbits AI läser sidan och föreslår automatiskt kolumner baserat på vad den hittar — vanligtvis företagsnamn, telefon, adress, webbplats, kategori, betyg och listnings-URL.

Du kan justera, lägga till eller ta bort kolumner innan du skrapar. Vill du lägga till en anpassad kolumn som “Har webbplats?” eller “Serviceområde?” Skriv bara en beskrivning på vanligt språk i Field AI Prompt. Du kan till exempel instruera en kolumn att “formatera telefon som +1XXXXXXXXXX” eller “klassificera som privat vs. kommersiell”.

Nu bör du se en tabellförhandsvisning med dina valda kolumner i Thunderbit-panelen.

Steg 3: Klicka på “Scrape” och se datan fyllas i

Tryck på den blå knappen “Scrape”. Thunderbit extraherar alla listningar på den aktuella sidan och fyller i tabellen rad för rad. För en typisk SuperPages-resultatsida tar det cirka 30–45 sekunder.

Thunderbit hanterar paginering automatiskt — den upptäcker “Next”-knappar eller oändlig scroll och fortsätter tills det inte finns fler sidor eller din gräns nås. Om du skrapar ett större resultatset (t.ex. alla rörmokare i ett storstadsområde) kan du växla till Cloud Scraping-läge, som kan hantera upp till 50 sidor samtidigt utan att binda din webbläsare.

Steg 4: Använd Subpage Scraping för att berika varje listning

business-profile-verification-process.webp

Sökresultatsidan ger dig grunderna, men det riktiga guldet — öppettider, fullständiga beskrivningar, omdömen, ibland e-post — finns på varje företags detaljsida. Klicka på “Scrape Subpages” så besöker Thunderbit varje listnings detaljsida och hämtar berikade kolumner som öppettider, beskrivning, webbplats-URL och annan kontaktinfo som syns där.

Det här är en process med ett klick. Inget separat arbetsflöde, ingen konfiguration. Den berikade datan läggs direkt till i din befintliga tabell.

Steg 5: Exportera dina leads till Excel, Google Sheets, Airtable eller Notion

När du är nöjd med din data klickar du på Export. Thunderbit låter dig skicka dina leads direkt till:

  • Google Sheets (perfekt för CRM-förberedelse och delning)
  • Airtable (lätta pipeline-tabeller)
  • Notion (forskningsdatabaser)
  • Excel / CSV (import till CRM)
  • JSON (för utvecklare)

cloud50-data-workflow.webp

Alla exportalternativ är gratis. Om du matar leads in i HubSpot eller Salesforce är CSV eller Google Sheets oftast snabbaste vägen.

Proffstips: skrapa efter kategori + stad i stället för breda sökningar på delstatsnivå. “Emergency plumbers Dallas TX” ger en tajtare och mer användbar lista än “plumbers Texas.” Lägg till kolumnerna “Source URL” och “Scraped At” för spårbarhet.

Metod 2: Skrapa SuperPages med ett visuellt skrapverktyg (Octoparse-exempel)

Visuella skrapverktyg som Octoparse ligger i mitten: ingen kod, men mer uppsättning och konfiguration än Thunderbit. Octoparse har till och med en färdig SuperPages-mall för enklare användningsfall.

Svårighetsgrad: Medel
Tidsåtgång: ~20–30 minuter för setup + skrapning
Du behöver: Octoparse-konto (gratisplan finns, med begränsningar)

Steg 1: Skapa en ny uppgift och ladda SuperPages-URL:en

Öppna Octoparse, klicka på “New Task” och klistra in din SuperPages-sök-URL (t.ex. “https://www.superpages.com/los-angeles-ca/plumbers”). Den inbyggda webbläsaren laddar sidan.

Steg 2: Autoidentifiera eller välj datakällor manuellt

Klicka på “Auto-detect” — Octoparse skannar sidan och markerar de datafält som den tror är relevanta. Granska Data Preview-panelen. Min erfarenhet är att auto-detektering ofta hittar de flesta fält, men den kan också plocka med extra saker (som annonsetiketter eller navigeringstext) eller missa vissa. Du behöver sannolikt lägga till eller ta bort några fält manuellt.

Enligt Octoparse-hjälpdokumentationen skapar auto-detektering ett grundläggande arbetsflöde med paginering och extraheringssteg, men användare kan behöva lägga till saknad data manuellt.

Steg 3: Bygg arbetsflödet och konfigurera paginering

Klicka på “Create workflow.” Octoparse genererar en steg-för-steg-sekvens med åtgärder. Kontrollera pagineringssteget — se till att det klickar på “Next” eller laddar fler resultat korrekt. Om du vill ha data från varje företags detaljsida (öppettider, e-post, beskrivning) måste du lägga till en loop för detaljsidor eller en subpage-åtgärd i arbetsflödet. Det här gör lösningen mer komplex än Thunderbits 1-klicksmetod för undersidor.

Steg 4: Kör uppgiften och exportera data

Kör uppgiften lokalt (för mindre jobb) eller i Octoparse’s moln (för schemalagda eller större jobb — moln är en betalfunktion). När den är klar exporterar du som CSV, Excel eller JSON.

Begränsningar att känna till: Octoparse’s gratisplan inkluderar 10 uppgifter, upp till 50 000 rader/månad och endast lokal extraktion. Molnkörningar, IP-rotation, CAPTCHA-lösning och vissa exportintegrationer kräver betald plan (från cirka 69 USD/månad årligen).

Metod 3: Skrapa SuperPages med Python (Requests + BeautifulSoup)

Det här är utvecklarvägen. Full kontroll, fullt ansvar. Om du är bekväm med att skriva och underhålla Python-skript ger detta mest flexibilitet — men också mest huvudvärk.

Svårighetsgrad: Avancerad
Tidsåtgång: ~30–60 minuter (setup + kodning + felsökning)
Du behöver: Python 3.x, pip, requests, beautifulsoup4, lxml, en kodeditor

Steg 1: Sätt upp din Python-miljö

python -m venv .venv
source .venv/bin/activate
pip install requests beautifulsoup4 lxml pandas

Steg 2: Inspektera SuperPages HTML-struktur

Öppna Developer Tools (F12) på en SuperPages-resultatsida. Identifiera CSS-selektorer för företagsnamn, adress, telefon, webbplats och länk till detaljsidan. Tänk på att HTML-strukturen kan ändras utan förvarning, vilket betyder att dina selektorer när som helst kan sluta fungera.

Steg 3: Skriv skraparen för listningar och hantera paginering

Här är ett förenklat exempel. Viktig brasklapp: i mina tester returnerade en direktförfrågan till SuperPages en Cloudflare-sida med meddelandet “Attention Required”. Ett naivt Requests-skript kan därför misslyckas i större skala — du kan behöva webbläsarsession, rate limiting, retries eller godkända alternativ.

import csv, time
from urllib.parse import urljoin
import requests
from bs4 import BeautifulSoup

BASE_URL = "https://www.superpages.com"
HEADERS = {
    "User-Agent": (
        "Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_7) "
        "AppleWebKit/537.36 (KHTML, like Gecko) "
        "Chrome/125.0 Safari/537.36"
    )
}

def fetch(url):
    resp = requests.get(url, headers=HEADERS, timeout=20)
    resp.raise_for_status()
    if "Attention Required" in resp.text or "Cloudflare" in resp.text:
        raise RuntimeError("Blockerad. Sakta ned eller byt till webbläsar-/molnskrapning.")
    return BeautifulSoup(resp.text, "lxml")

def parse_listing(card):
    name_el = card.select_one(".business-name, a.business-name, h2 a, h3 a")
    phone_el = card.select_one(".phones, .phone, [class*=phone]")
    address_el = card.select_one(".street-address, .adr, [class*=address]")
    website_el = card.select_one("a.track-visit-website, a[href*='http']")
    rating_el = card.select_one(".rating, [class*=rating]")
    detail_url = urljoin(BASE_URL, name_el.get("href")) if name_el and name_el.get("href") else ""
    return {
        "business_name": name_el.get_text(" ", strip=True) if name_el else "",
        "phone": phone_el.get_text(" ", strip=True) if phone_el else "",
        "address": address_el.get_text(" ", strip=True) if address_el else "",
        "website": website_el.get("href", "") if website_el else "",
        "rating": rating_el.get_text(" ", strip=True) if rating_el else "",
        "detail_url": detail_url,
    }

def scrape_search(search_url, pages=3):
    all_rows = []
    for page in range(1, pages + 1):
        page_url = f"{search_url}?page={page}"
        soup = fetch(page_url)
        cards = soup.select(".result, .organic, [class*=result]")
        if not cards:
            break
        for card in cards:
            all_rows.append(parse_listing(card))
        time.sleep(5)
    return all_rows

if __name__ == "__main__":
    rows = scrape_search("https://www.superpages.com/los-angeles-ca/plumbers", pages=2)
    with open("superpages_leads.csv", "w", newline="", encoding="utf-8") as f:
        writer = csv.DictWriter(f, fieldnames=sorted({k for row in rows for k in row}))
        writer.writeheader()
        writer.writerows(rows)

Steg 4: Skrapa detaljsidor för berikning

Skriv en separat funktion för att besöka varje detaljsida och extrahera öppettider, e-post, beskrivning och omdömen. Det innebär att du själv måste hantera rate limits, felhantering och eventuellt proxys — allt ligger på dig.

Steg 5: Spara data till CSV eller JSON

Använd Pythons csv- eller json-moduler. Du behöver också skriva din egen logik för dubbletthantering, rensning och export.

Vanliga fallgropar:

  • SuperPages kan blockera förfrågningar med Cloudflare eller liknande anti-bot-system (bekräftat i mina tester).
  • Selektorerna är medvetet breda här eftersom SuperPages markup kan ändras.
  • Anta inte att sökresultatsidor innehåller e-postadresser. Det gör de nästan aldrig.
  • En produktionsfärdig skrapare behöver granskning av robots/TOS, rate limiting, retry/backoff, strukturerad loggning och felhantering.

Om du vill fördjupa dig i Python-scraping, kolla in vår guide om web scraping med Python eller vår BeautifulSoup-handledning.

Från rådata till riktiga leads: hela pipelinen (skrapa → rensa → verifiera → CRM)

Det är här de flesta guider slutar — och där det verkliga värdet börjar. Skrapning ger dig råmaterialet. För att göra det till en användbar leadlista krävs några steg till.

data-pipeline-workflow.webp

Pipelinen ser ut så här:

SuperPages-sökning → skrapa listningar → skrapa detaljsidor/webbplatser → exportera till Google Sheets eller CSV → rensa telefoner, adresser, kategorier → ta bort dubbletter → verifiera e-post/telefoner → berika saknade kontakter → importera till CRM → compliant outreach

Dubbletthantering: ta bort dubbla listningar

SuperPages visar ofta samma företag i flera kategorier. Om du skrapade både “rörmokare” och “avloppsrensning” i samma stad kommer du att få överlappningar.

  • Primär dubblettnyckel: normaliserat telefonnummer + normaliserad gatuadress.
  • Sekundär: domän + stad.
  • Reserv: företagsnamn + postnummer (granska manuellt för kedjor/franchiser).

I Google Sheets kan du använda =UNIQUE(A:H) för exakta radmatchningar, eller skapa en hjälpkolumn som =LOWER(REGEXREPLACE(B2&C2,"[^a-zA-Z0-9]","")) för att fånga nästan-dubbletter. I Excel använder du Data > Remove Duplicates.

Datarening: standardisera telefoner, adresser och formatering

  • Formatera telefonnummer som E.164 (för USA: +1 följt av 10 siffror). Det här är formatet som de flesta CRM och uppringningsverktyg förväntar sig. Du kan använda en Field AI Prompt i Thunderbit för att autoformatera under skrapningen.
  • Normalisera adresser: skriv ut förkortningar, fyll i saknade postnummer, dela upp i kolumner för gata/stad/stat/postnummer vid behov.
  • Ta bort HTML-rester, extra blanksteg och spårningsparametrar från URL:er.
  • Lägg till kolumnerna source_directory, source_url och scraped_at för spårbarhet.

Verifiering av e-post och telefon innan outreach

Skicka inte ett kallt mejl till varje adress du har skrapat fram. Verifiering skyddar din avsändarprofil och håller din bounce-rate låg.

  • E-postverifiering: ZeroBounce (från cirka 39 USD för 2 000 credits, plus 100 gratis credits per månad) eller Bouncer (8 USD för 1 000 credits, credits går aldrig ut) är bra alternativ.
  • Telefonvalidering: Twilio Lookup erbjuder formatering och validering gratis; caller ID kostar 0,01 USD per förfrågan.
  • Thunderbits gratis Email Extractor och Phone Number Extractor kan hämta kontaktuppgifter som saknas på listningssidor.

Berikning: hitta kontakter när SuperPages inte visar e-post

Många SuperPages-listningar visar ingen e-post alls — särskilt inte på sökresultatsidan. Gör så här:

  • Skrapa företagets webbplats, särskilt Contact-, About- eller sidfotsidorna. Thunderbits Subpage Scraping eller Email Extractor kan göra detta i bulk.
  • Använd berikningsverktyg som Apollo, BetterContact, Icypeas eller Prospeo. Varning: för små lokala företag (en rörmokare med två anställda, en ensam tandläkare) ger stora B2B-databaser ofta tomt resultat. Webbplats-först-extraktion fungerar vanligtvis bättre här.
  • Kombinera flera kataloger. Skrapa SuperPages, Yellow Pages och Google Maps för samma kategori/stad, slå ihop dem och ta bort dubbletter. Överlappningen ger mer kompletta poster.

Om du någonsin har försökt köra en lokal SMB-lista genom Apollo och nästan bara fått tomma fält är du inte ensam. Därför är webbplats-först-metoden så viktig för den här målgruppen.

CRM-import: få in leads i HubSpot, Salesforce eller Google Sheets

  • HubSpot: gå till Data Management > Data Integration > Import data > Quick import (contacts only). Ladda upp din .csv eller .xlsx. HubSpots importguide visar hur du mappar fält.
  • Salesforce: använd Data Import Wizard. Förbered en CSV, mappa källdata till Salesforce-fält och kör importen.
  • Google Sheets / Airtable / Notion: Thunderbit exporterar direkt till alla tre — ingen CSV-mellanlänk behövs.

Tips: mappa dina skrapade kolumner till CRM-fält innan importen. Några minuters mappning sparar timmar av manuell städning senare.

SuperPages jämfört med andra lokala företagskataloger: var hittar man de bästa leadsen?

SuperPages är en stark startpunkt, men det är inte den enda katalogen värd att skrapa. Så här står den sig:

KatalogLead-volymTillgängliga datafältDatans färskhetSvårighetsgrad mot skrapningBäst för
SuperPagesStor (USA-fokus)Namn, telefon, adress, webbplats, kategorier, betygMedelMedelHemservice, entreprenörer, småföretag
Yellow PagesStor (USA-fokus)Liknar SuperPagesMedelMedelGenerell lokal företagsoutreach
Google MapsMycket stor (global)Namn, telefon, adress, webbplats, omdömen, öppettider, fotonHög (uppdateras av ägare)Hög (aggressivt bot-skydd)Mest aktuell lokaldatan
YelpStor (USA-fokus)Namn, telefon, adress, omdömen, prisklassHögHögRestauranger, retail, tjänsteföretag
MantaMedelNamn, telefon, adress, intäktsuppskattningar, antal anställdaMedelLågB2B-prospektering (intäkts-/anställddata)
BBBMedelNamn, telefon, adress, ackreditering, klagomålMedelLågTrovärdiga/granskade företag

Källor: SuperPages startsida, VLDB SuperPages paper, Google Places API-dokumentation, Yelp Places API-dokumentation, Manta startsida, BBB-guide.

Thunderbit fungerar på alla dessa — inklusive Instant Templates för populära sajter som Google Maps och SuperPages — så att du kan använda samma arbetsflöde för flera källor och slå ihop dina leadlistor. Enligt min erfarenhet är bästa strategin ofta att skrapa två eller tre kataloger för samma kategori/stad och sedan ta bort dubbletter. Överlappningen fyller luckor och ger en mer komplett bild.

För mer om att skrapa andra kataloger, se våra guider om Yellow Pages-scrapers, Google Maps-scrapers och Yelp-scrapers.

Juridiska och etiska tips för att skrapa SuperPages-leads

data-privacy-compliance-infographic.webp

Jag är inte jurist, och det här är inte juridisk rådgivning — men jag har tillbringat tillräckligt mycket tid i området för att veta att det är ett snabbt sätt att bränna sig om man struntar i compliance. Här är den praktiska versionen.

Publika företagsdata vs. personuppgifter

Företagslistningar — företagsnamn, företagsnummer, företagsadress, företagswebbplats — betraktas i regel som offentliga kommersiella data. Det är något annat än personuppgifter enligt GDPR eller CCPA. Men “offentligt” betyder inte “inga regler gäller”. Kontrollera alltid sajtens användarvillkor.

SuperPages användarvillkor (uppdaterade juli 2019) innehåller en klausul om “Data Mining Prohibited”: användare får inte använda botar, crawlers, spiders eller liknande verktyg för att samla in eller extrahera data utan Thryv's förhandsgodkännande. Artikeln beskriver metoder och arbetsflöden, men du bör granska villkoren och få tillstånd där det krävs innan du skrapar i stor skala.

Outreach-compliance: grunderna i CAN-SPAM och TCPA

Om du använder skrapade e-postadresser för kall outreach säger FTC:s CAN-SPAM-guide att du måste:

  • Inte använda falska eller vilseledande rubriker
  • Inte använda vilseledande ämnesrader
  • Identifiera meddelandet som reklam när det krävs
  • Inkludera en giltig fysisk postadress
  • Erbjuda en tydlig avregistreringsmöjlighet och följa den snabbt

Om du använder skrapade telefonnummer för kalla samtal, kontrollera National Do Not Call Registry och följ TCPA-reglerna — särskilt kring automatiska samtal, förinspelade meddelanden och SMS. FTC meddelade 2024 förändringar för att stärka skyddet mot vilseledande B2B-telemarketing och AI-drivna bedrägerisamtal.

Snabb checklista för compliance

  • ✅ Skrapa endast offentligt listade företagsdata
  • ✅ Granska SuperPages användarvillkor och be om tillstånd där det krävs
  • ✅ Verifiera kontakter innan outreach
  • ✅ Lägg in opt-out i e-post
  • ✅ Respektera robots.txt och rate limits
  • ✅ Underhåll DNC- och e-post-suppressionlistor
  • ⚠️ Undvik att skrapa person-/konsumentdata
  • ⚠️ Återförsälj inte rå skrapad data utan juridisk granskning

Välj metod och börja bygga din leadlista

Att skrapa SuperPages för leads handlar inte bara om att extrahera rader från en webbsida. Det verkliga värdet kommer från hela pipelinen: skrapa, rensa, ta bort dubbletter, verifiera, berika, importera och kontakta på ett compliant sätt.

Här är snabbversionen:

  • Thunderbit är snabbaste vägen för säljteam, byråer och icke-utvecklare. Två klick för att skrapa, ett klick för att berika med undersidor, gratis export till Google Sheets, Airtable, Notion eller Excel. Testa gratis.
  • Octoparse är ett starkt visuellt arbetsflödesverktyg för semi-tekniska användare som vill ha mer konfigurationskontroll.
  • Python ger utvecklare full flexibilitet — men kommer med underhåll, anti-blockeringsproblem och ingen inbyggd berikning.
  • Och kom ihåg: samma arbetsflöde gäller för Yellow Pages, Google Maps, Yelp, Manta och BBB. Skrapa flera källor, slå ihop, ta bort dubbletter, så får du den mest kompletta lokala leadlistan som går att få.

Om du vill se Thunderbit i praktiken, kolla in vår YouTube-kanal för genomgångar, eller utforska Thunderbit-priser för att se vad som passar ditt team.

Nu är det bara att förvandla katalogsidorna till pipeline — och må dina telefonnummer alltid vara korrekt formaterade och dina e-postadresser alltid verifierade.

Vanliga frågor

Är det lagligt att skrapa SuperPages för leads?

Att skrapa offentligt tillgängliga data från företagskataloger för B2B-research är vanligt, men SuperPages användarvillkor förbjuder data mining utan Thryv's förhandsgodkännande. Granska alltid sajtens villkor, få tillstånd där det behövs och följ regler för outreach som CAN-SPAM och TCPA. Den här artikeln beskriver metoder och arbetsflöden i utbildningssyfte — det är ditt ansvar att använda dem på ett compliant sätt.

Vilken data kan jag få från SuperPages?

En typisk skrapning ger företagsnamn, telefon, adress, webbplats, kategori, betyg, öppettider och beskrivningar. E-post visas sällan på sökresultatsidan — du behöver vanligtvis besöka företagets detaljsida eller dess egen webbplats (via subpage scraping eller en email extractor) för att hitta dem.

Kan jag skrapa SuperPages utan kod?

Ja. Verktyg som Thunderbit (AI Chrome-tillägg) och Octoparse (visuell scraper) låter dig skrapa SuperPages utan att skriva en enda kodrad. Thunderbit är det snabbaste alternativet — installera tillägget, öppna en SuperPages-sökning, klicka på “AI Suggest Fields” och sedan “Scrape.”

Hur hanterar jag paginering när jag skrapar SuperPages?

Thunderbit hanterar paginering automatiskt — det upptäcker “Next”-knappar eller oändlig scroll och fortsätter. Octoparse kräver att du konfigurerar ett pagineringssteg i arbetsflödet. I Python måste du skriva logik för att loopa över sidor manuellt (öka sidnummer, känna igen sista sidan).

Hur får jag e-postadresser från SuperPages-listningar?

De flesta SuperPages-listningar visar inte e-post på sökresultatsidan. Använd Thunderbits Subpage Scraping för att besöka varje detaljsida, eller använd den gratis Email Extractor på företagets webbplats. För kvarvarande luckor kan du testa berikningsverktyg som Apollo, BetterContact eller Prospeo — men för små lokala företag fungerar ofta webbplats-först-extraktion bättre än stora B2B-databaser.

Testa AI Web Scraper för SuperPages-leads Get Started Free

Läs mer

Shuai Guan
Shuai Guan
VD på Thunderbit | Expert på AI-driven dataautomatisering Shuai Guan är VD för Thunderbit och alumn från University of Michigan Engineering. Med nästan tio års erfarenhet inom teknik och SaaS-arkitektur är han specialiserad på att omvandla avancerade AI-modeller till praktiska, kodfria verktyg för datautvinning. På den här bloggen delar han raka, beprövade insikter om webbskrapning och automatiseringsstrategier som hjälper dig att bygga smartare, datadrivna arbetsflöden. När han inte optimerar dataflöden ägnar han samma detaljblick åt sin passion för fotografi.
Innehåll

Samla in en webbsida genom att bara fråga

Säg vad du behöver på enkel engelska. Eller ännu bättre, säg ingenting alls.

Prova Thunderbit gratis
Extrahera data med AI
Överför enkelt data till Google Sheets, Airtable eller Notion
Chrome Store Rating
PRODUCT HUNT#1 Product of the Week