Hvert par måneder poster nogen på Reddit den samme klage i en ny udgave: "Jeg scrapede Yellow Pages og fik 500 rækker med telefonnumre og adresser… men nul e-mails." Det er den mest almindelige frustration, jeg ser i lead-gen-fællesskaber, og efter mange år med at bygge automatiseringsværktøjer hos Thunderbit, kan jeg sige, at problemet er strukturelt — ikke et tilfælde.
De fleste Yellow Pages-scrapere henter det, der er synligt på søgeresultatsiden — firmanavn, telefon, adresse og måske et link til webstedet. Men e-mails? De står næsten aldrig på selve kortet. De ligger gemt på de enkelte virksomheders profilsider, eller også findes de slet ikke på Yellow Pages.
Så hvis din scraper ikke besøger undersiderne, lader du de mest værdifulde kontaktdata ligge. Denne artikel gennemgår 9 værktøjer, som jeg har undersøgt og vurderet specifikt ud fra, om de faktisk leverer e-mails fra Yellow Pages — ikke bare telefonnumre og postnumre. Jeg dækker også anti-bot-håndtering, pris og hvilke værktøjer der passer til hvilke typer brugere.
Hvorfor de fleste Yellow Pages-scrapere mislykkes med e-mails
Før vi ser på værktøjerne, er det nyttigt at forstå, hvorfor problemet overhovedet findes.
Yellow Pages’ resultatsider er bygget op omkring telefonnumre, adresser, åbningstider og links til websteder. E-mail er ikke et standardfelt på søgeresultatskortet. Dokumentation og eksempler fra aktuelle scraper-værktøjer bekræfter konsekvent dette: e-mail mangler som regel på listing-kortet og skal findes enten på den enkelte virksomheds profilsiden eller på virksomhedens eget websted.
Apifys ParseBird Yellow Pages Scraper er usædvanligt gennemsigtig omkring dette. Den skelner mellem "listing mode" og "detail mode" og oplyser, at e-mail-udbyttet typisk kun er 15–25 % af listerne, selv når udtræk fra detaljesider er slået til. Det betyder, at selv det bedste scenarie for e-mailudtræk fra Yellow Pages er beskedent — og de fleste værktøjer forsøger det slet ikke.
Der er tre typiske fejlsituationer:
- Scraperen læser kun søgeresultatsiden. Ingen besøg på undersider, ingen e-mails.
- Scraperen følger detaljesiden, men parser ikke e-mailfelter. Stadig ingen e-mails.
- Virksomheden har aldrig publiceret en e-mail på Yellow Pages. Intet værktøj kan udtrække noget, der ikke findes.
Nogle virksomheder bruger også kontaktformularer eller "Email Business"-knapper i stedet for at vise en rå e-mailadresse. En scraper kan teknisk set fungere perfekt og stadig levere et output, der er 95 % telefon og adresse.
Konklusionen: hvis e-mailudtræk er vigtigt for dig, er den afgørende funktion at kigge efter undersidescraping — altså evnen til at besøge hver virksomheds detaljeside og hente data, som ikke står på det primære listingskort.
Hvad du skal kigge efter i de bedste Yellow Pages-scrapere
Jeg vurderede alle 9 værktøjer ud fra syv kriterier, som hver især er forankret i reelle smertepunkter fra Reddit-tråde, scraping-fora og lead-gen-fællesskaber.
Pålidelighed i e-mailudtræk
Hele grunden til, at denne artikel findes. Returnerer værktøjet faktisk e-mailadresser, eller kun navne og telefonnumre? Den vigtigste evne er undersidescraping — at besøge hver virksomheds profilsiden for at finde e-mails, som ikke står på listingskortet.
Håndtering af anti-bot og blokeringer
Yellow Pages kører Cloudflare Bot Management, inklusive krav om JavaScript-rendering, browser-fingerprinting, hastighedsbegrænsning og CAPTCHA-udfordringer. En liveforespørgsel, jeg testede den 27. april 2026, blev mødt af en Cloudflare-blokside inden for få sekunder. Værktøjer, der ikke håndterer dette indbygget, efterlader dig bare med fejlsider.
Pris og gratis niveau
Flere Reddit-brugere spørger specifikt efter "free or cheap scrapers ideally." Der er en reel opdeling mellem helt gratis browserudvidelser, cloud-værktøjer med startkreditter og enterprise-platforme med skræddersyet pris.
Understøttelse af pagination
Yellow Pages viser cirka 30 resultater pr. side, og bredere søgninger kan give 500–2.000+ resultater. En scraper uden automatisk pagination indsamler kun en brøkdel af de tilgængelige data.
Eksportmuligheder
Salgs-teams har brug for CRM-klart output: CSV, Excel, Google Sheets, Airtable. Nogle værktøjer giver kun JSON eller rå HTML, hvilket betyder ekstra behandling, før data er brugbar.
Teknisk niveau
Målgruppen er delt. Salgsrepræsentanter og bureauejere vil have to-klik-værktøjer. Udviklere vil have API-adgang og fleksibilitet med Python. Jeg har vurderet hvert værktøj fra Begynder til Ekspert.
Leadscoring og databerigelse
Som en Reddit-bruger sagde: "rå data uden scoring er bare et regneark." Værktøjer, der kan mærke, kategorisere eller berige data under scrapingen, sparer timer af efterbehandling.
De bedste Yellow Pages-scrapere i overblik
Den fulde sammenligning på tværs af alle 9 værktøjer er nedenfor. En hurtig forklaring på symbolerne: ✅ betyder, at værktøjet håndterer dette godt ud af boksen, ⚠️ betyder, at det er muligt, men kræver ekstra konfiguration eller har begrænsninger, og ❌ betyder, at værktøjet ikke understøtter det indbygget.
| Værktøj | Type | Gratis niveau | E-mails? | Anti-bot | Pagination | Niveau | Eksportformater | Bedst til |
|---|---|---|---|---|---|---|---|---|
| Thunderbit | Chrome-udvidelse + cloud | ✅ (6 sider/md.) | ✅ (underside + Email Extractor) | ✅ Cloud-/browser-skift | ✅ Automatisk | Begynder | Excel, CSV, JSON, Sheets, Airtable, Notion | Ikke-tekniske salgs- og driftsteams |
| Apify YP Scraper | Cloud-aktor | ✅ ($5 i kreditter) | ⚠️ 15–25 % med detaljesider | ✅ Proxy-pool | ✅ Indbygget | Mellem | JSON, CSV, Excel, XML | Cloud-scraping i stor skala |
| WebScraper.io | Chrome-udvidelse + cloud | ✅ (gratis udvidelse) | ⚠️ Manuel opsætning | ✅ Cloud-planer | ✅ Baseret på selector | Mellem | CSV, XLSX, JSON, Sheets | Brugere af visuelle scrapers |
| Instant Data Scraper | Chrome-udvidelse | ✅ Helt gratis | ❌ Ustabil | ❌ Ingen | ⚠️ Manuel | Begynder | CSV, XLSX | Hurtige engangsscrapes |
| Outscraper | API/cloud | ✅ (500 virksomheder) | ⚠️ Berigelse nødvendig | ✅ Administreret | ✅ Automatisk | Begynder–Mellem | CSV, JSON, XLSX | Budgetvenlige mappeopgaver |
| Octoparse | Skrivebordsapp + cloud | ✅ (10 opgaver, 50K/md.) | ⚠️ Skabelonbaseret | ✅ Indbygget | ✅ Automatisk registrering | Mellem | CSV, Excel, JSON, databaser | Visuel scraping på desktop |
| ScrapingBee | API | ✅ (1.000 kald) | ❌ Kun rå HTML | ✅ Administrerede proxies | ❌ Manuel | Avanceret | JSON, HTML | Udviklere, der har brug for renderet HTML |
| Bright Data | Platform | ❌ Betalt (1K prøve) | ✅ Dataprodukter | ✅ Enterprise-niveau | ✅ Indbygget | Avanceret | JSON, CSV, NDJSON, S3, mere | Enterprise-scraping i stor skala |
| Python DIY | Kode | ✅ Gratis (open source) | ⚠️ Manuel parsing | ❌ Selvstyret | ❌ Manuel | Ekspert | Enhver | Ingeniører med specialbehov |
1. Thunderbit — bedst til Yellow Pages-scraping for ikke-tekniske teams
Prøv Thunderbit til Yellow Pages-scraping
Thunderbit er en AI-drevet Chrome-udvidelse, som mit team og jeg byggede specifikt for at gøre webscraping tilgængelig for folk, der ikke er udviklere. I stedet for at konfigurere CSS-selectors eller skrive kode klikker du på "AI Suggest Fields", og AI’en læser siden, finder ud af, hvilke data der er tilgængelige, og foreslår kolonner til dig. Derefter klikker du på "Scrape". Det er det — to klik til strukturerede data.
For Yellow Pages løser workflowet e-mailproblemet direkte. Efter at have scrapet listingsiden kan du klikke på Scrape Subpages, og Thunderbit besøger hver virksomheds detaljeside for at finde e-mails, webadresser, åbningstider, anmeldelser og andre felter, som ikke er synlige på det primære listing-kort. Vi har også bygget en dedikeret Email Extractor og Phone Number Extractor som selvstændige værktøjer, så du kan køre dem på enhver side med ét klik.
Sådan håndterer Thunderbit e-mailudtræk fra Yellow Pages
Den vigtigste forskel er undersidescraping. De fleste scrapers stopper ved søgeresultatsiden og returnerer det, der er synligt — hvilket på Yellow Pages betyder ingen e-mail. Thunderbits undersidefunktion besøger hver virksomhedsprofil og henter data fra det dybere lag. Du kan også bruge Field AI Prompt til at tilføje instruktioner som "udtræk e-mail fra kontaktsektionen" eller "markér virksomheder uden websted" for at forbedre nøjagtigheden og tilføje kontekst under selve scrapingen.
Baseret på aktuelle sidestrukturer og scraper-dokumentation er e-mails på Yellow Pages-listingskort reelt nul. Scraping af detaljesider, som Thunderbits undersidefunktion, genskaber e-mails for omkring 15–25 % af virksomhederne — hvilket er det realistiske loft for Yellow Pages-e-mailudtræk i 2026. Det er ikke en begrænsning i Thunderbit; det er en begrænsning i Yellow Pages-data.
Anti-bot-håndtering og pagination
Thunderbit tilbyder to scraping-tilstande: cloud scraping (som kører via servere i USA/EU/Asien med automatisk proxy-rotation) og browser scraping (som bruger din lokale browsersession). Hvis cloud-tilstand bliver blokeret af Cloudflare, kan du skifte til browsertilstand som backup — din godkendte session kan ofte omgå de beskyttelser, der blokerer headless cloud-forespørgsler.
Pagination er fuldautomatisk. Thunderbit håndterer både klikbaserede "Next"-knapper og uendelig scroll uden nogen konfiguration.
Pris og eksport
- Gratis niveau: 6 sider om måneden
- Gratis prøveperiode: 10 sider
- Starter-plan: fra ca. $9/md. faktureret årligt for 500 kreditter (1 kredit = 1 række)
- Eksport: Excel, CSV og JSON er tilgængelige på gratis niveau; Google Sheets, Airtable og Notion-integration på betalte planer
Du kan se de seneste detaljer på vores prisside.
Bedst til: Salgsrepræsentanter, bureauer og driftsteams, der har brug for lead-data hurtigt uden at skrive kode eller administrere proxies.
2. Apify Yellow Pages Scraper — bedst til cloud-scraping i stor skala
Apify er en cloudbaseret scraping-platform med en markedsplads af forudbyggede "actors" — herunder flere, der er designet specifikt til Yellow Pages. Du konfigurerer en scrape i Apify-konsollen (søgeord, placering, antal resultater), og den kører i skyen uden behov for en browser eller lokal maskine.
ParseBird Yellow Pages-actoren er det mest gennemsigtige værktøj til e-mailudtræk, jeg har fundet. Den skelner eksplicit mellem listing mode og detail mode og dokumenterer, at e-mailudbyttet typisk er 15–25 % af listerne, når detaljesider er aktiveret. Scraping i detail mode koster cirka $6 pr. 1.000 virksomheder mod $1 pr. 1.000 i listing mode — en direkte afspejling af den ekstra beregningskraft, der kræves for at besøge hver underside.
- Proxy-pool inkluderet med understøttelse af residential proxies
- Indbygget pagination til resultatsæt med flere sider
- Eksport: JSON, CSV, Excel, XML, HTML, RSS, JSONL
- Pris: Gratis plan med $5 i kreditter; betalte planer til $49, $99 og $499/md.
Bedst til: Brugere på mellem- til avanceret niveau, der kører større lead-gen-kampagner på tværs af flere byer eller kategorier.
3. WebScraper.io — bedst til at bygge tilpassede Yellow Pages-sitemaps
WebScraper.io tilbyder en Chrome-udvidelse med en visuel "Sitemap Wizard", der automatisk registrerer listingsstrukturen på Yellow Pages. Det er værktøjet bag en af de bedst rangerende tutorials til scraping af Yellow Pages, og med god grund — det giver dig detaljeret kontrol over, hvad der bliver scrapet, og hvordan.
Ulempen: kontrol kræver konfiguration. E-mailudtræk er ikke automatisk; du skal manuelt opsætte selectors til at målrette e-mailfelter og konfigurere scraperen til at følge links til virksomhedens detaljesider. Hvis du sætter det korrekt op, virker det. Hvis du ikke gør, får du det samme telefon- og adresse-output som med alle andre værktøjer.
WebScraper.io’s markedspladsnoter er også usædvanligt ærlige omkring Yellow Pages’ beskyttelse: de dokumenterer Cloudflare bot management, krav om JavaScript-rendering og browser-fingerprinting som konkrete forhindringer.
- Pagination: Håndteres via selector-baseret konfiguration af "Next"-knappen
- Eksport: CSV, XLSX, JSON; cloud-versionen tilføjer Google Sheets, Dropbox, S3, Azure, API og webhooks
- Pris: Gratis Chrome-udvidelse; cloud-planer fra $50/md.
Bedst til: Brugere, der er komfortable med point-and-click selector-værktøjer og vil have fleksibilitet til at tilpasse deres scrape-struktur.
4. Instant Data Scraper — bedste gratis Yellow Pages-scraper (med forbehold)
Instant Data Scraper er svaret på spørgsmålet: "Hvad kan jeg prøve lige nu gratis?" Det er en helt gratis Chrome-udvidelse — ingen konto, ingen kreditter, ingen begrænsninger — som automatisk registrerer tabeldata på websider. Åbn en Yellow Pages-resultatside, klik på udvidelsesikonet, og den finder listingsdataene.
Problemet er alt det, den ikke gør. Den scraper kun det, der er synligt på siden, hvilket betyder ingen besøg på undersider og ingen e-mailudtræk i de fleste reelle workflows. Den har ingen anti-bot-håndtering, så hvis Yellow Pages viser en CAPTCHA eller blokerer din IP, sidder du fast. Understøttelsen af pagination er grundlæggende — du skal måske manuelt klikke på "Next" eller nøjes med begrænset auto-scroll.
- Eksport: CSV, XLSX
- Pris: Gratis for altid
Bedst til: Begyndere, der har brug for en hurtig og gratis scrape af én resultatside og ikke behøver e-mails. Ikke egnet til e-mailfokuserede kampagner eller leadgenerering i stor skala.
5. Outscraper — bedste administrerede API til Yellow Pages og Google Maps
Outscraper er en cloud/API-baseret platform med administreret infrastruktur til scraping af kataloger som Yellow Pages og Google Maps. Værdien er enkelhed: du skal ikke selv håndtere proxies, anti-bot-logik eller pagination.
Til Yellow Pages er de første 500 virksomheder gratis, og derefter er prisen cirka $1 pr. 1.000 virksomheder. E-mailudtræk fra selve Yellow Pages er begrænset til det, der står på siden; til dybere e-mailberigelse tilbyder Outscraper separate berigelsesfunktioner, som kan kombineres med basisscrapen.
Det, Outscraper især er stærk til, er understøttelse af flere kataloger. Hvis du scraper Yellow Pages og Google Maps til den samme kampagne, kan du køre begge dele fra én platform.
- Auto-pagination inkluderet
- Eksport: CSV, JSON, XLSX, API
- Pris: Gratis niveau (500 virksomheder); betaling pr. resultat derefter
Bedst til: Salgsdrifts-teams, der vil have pålidelig, hands-off scraping på tværs af flere kataloger uden at skulle administrere infrastruktur.
6. Octoparse — bedste desktop-app til visuel Yellow Pages-scraping
Octoparse er en desktop-applikation (Windows/Mac) med en visuel point-and-click workflow-bygger. Den tilbyder forudbyggede skabeloner til Yellow Pages og lignende katalogsider samt indbyggede anti-bot-funktioner, herunder IP-rotation, residential proxies og automatisk CAPTCHA-løsning.
E-mailudtræk afhænger af skabelonen. Når skabelonen er konfigureret til at besøge virksomhedens detaljesider eller linkede websteder, kan den hente e-mails. Men skabeloner kan gå i stykker, når Yellow Pages opdaterer sit layout, og brugere rapporterer blandede resultater afhængigt af kategori og geografi.
- Gratis plan: 10 opgaver, 50.000 eksport om måneden
- Automatisk registrering af pagination
- Eksport: CSV, Excel, JSON, HTML, XML, databaser, Google Sheets, API
- Pris: Gratis niveau; betalte planer til cloud-kørsel
Bedst til: Brugere på mellem niveau, der foretrækker en desktop-app med visuel workflow-bygger og ikke har noget imod lidt tilpasning af skabeloner.
7. ScrapingBee — bedste API til udviklere, der har brug for renderet HTML
ScrapingBee er en API-first webscraping-tjeneste. Den håndterer JavaScript-rendering, proxy-rotation og CAPTCHA-løsning — og returnerer derefter rå HTML, JSON eller Markdown. Den udtrækker ikke e-mails eller strukturerede felter ud af boksen. Det er dit ansvar.
ScrapingBees egen Yellow Pages-tutorial demonstrerer manuel pagination ved at tilføje &page=n til URL’en, hvilket understreger, at dette er et udviklerværktøj og ikke en point-and-click-løsning.
- Gratis niveau: 1.000 API-kreditter
- Ingen indbygget pagination eller feltudtræk
- Eksport: JSON, HTML
- Pris: Fra $49/md.
Bedst til: Udviklere, der har brug for pålideligt renderet HTML med anti-bot-håndtering og er trygge ved selv at skrive parser-logik.
8. Bright Data — bedste enterprise-platform til scraping i stor skala
Bright Data driver det største proxy-netværk i branchen og tilbyder en fuld suite af scraping-API’er, browserværktøjer og forudbyggede datasæt. Det er designet til organisationer, der har brug for massivt dataindsamling med compliance-funktioner.
For Yellow Pages er Bright Datas styrke infrastrukturen — residential proxies, CAPTCHA-løsning, browser-fingerprinting-beskyttelse — samt levering downstream til JSON, CSV, NDJSON, S3, Snowflake, GCS, Azure og SFTP. Jeg fandt ikke nogen aktuelt dokumenteret Yellow Pages-specifik skabelon, så positioneringen her er enterprise-platform, ikke et dedikeret YP-e-mailprodukt.
- Pris: Web Scraper API starter med en 1K request gratis prøve, derefter $2,5 pr. 1K records på forbrug; $499/md. i stor skala
- Ingen gratis niveau for de fleste produkter
- Indbygget pagination til alle scraping-værktøjer
Bedst til: Store virksomheder eller bureauer med betydelige databudgetter, der har brug for skala, compliance og proxy-infrastruktur.
9. Python DIY (BeautifulSoup + Playwright) — bedst til fuld kontrol
Dette er open source-ruten: BeautifulSoup til HTML-parsing og Playwright til browserautomatisering. Gratis biblioteker, maksimal fleksibilitet og den højeste tekniske bar på denne liste.
E-mailudtræk kræver, at du skriver tilpasset parser-logik for at navigere til hver virksomheds detaljeside og finde e-mailfelter. Proxy-rotation, CAPTCHA-håndtering, hastighedsbegrænsning og pagination skal enten implementeres eller købes separat. Som en Reddit-bruger sagde: "Once you try Playwright, you will never go back to Selenium" — men du holder heller aldrig op med at fejlfinde din proxy-opsætning.
- Pris: Gratis (open source-biblioteker); infrastruktur koster ekstra
- Eksport: Ethvert format, du koder
- Intet indbygget — du bygger alt selv
Bedst til: Ekspertudviklere med specifikke scrapingkrav, som intet standardværktøj kan håndtere, og som er komfortable med at administrere hele infrastrukturen fra ende til anden.
Hvad der faktisk sker, når Yellow Pages blokerer dig (anti-bot virkelighedstjek)
Jeg vil bruge et øjeblik på dette, fordi det er det største smertepunkt målt i omtaler i scraping-fællesskaber, og de fleste artikler glider hurtigt hen over det med "brug proxies."
Da jeg testede en simpel scriptet forespørgsel til en Yellow Pages-søge-URL den 27. april 2026, var svaret en Cloudflare-blokside: "Sorry, you have been blocked. This website is using a security service to protect itself from online attacks." Det skete ved den første forespørgsel. Ingen advarsel, ingen gradvis begrænsning — bare en mur.
Yellow Pages’ anti-bot-stack omfatter Cloudflare Bot Management, krav om JavaScript-rendering, browser-fingerprinting, hastighedsbegrænsning og reCAPTCHA. IPRoyal’s scraping-guide tilføjer, at symptomerne kan omfatte hårde blokeringer, bløde bannere, CAPTCHA’er, omdirigeringer til splash-sider, sessionssporing og hastighedsgrænser.
Den bredere kontekst gør det værre, ikke bedre. Impervas rapport fra 2025 fandt, at automatiseret trafik udgjorde 51 % af al internettrafik i 2024, og DataDomes rapport fra 2025, der dækkede næsten 17.000 sites, fandt, at kun 2,8 % var fuldt beskyttet. Sites som Yellow Pages, der faktisk investerer i beskyttelse, bliver bedre til at fange scrapers — ikke dårligere.
Her er en praktisk oversigt over, hvordan hvert værktøj håndterer det:
| Værktøj | Proxy-rotation | CAPTCHA-håndtering | Modstandsdygtighed mod rate limits | Fallback ved blokering |
|---|---|---|---|---|
| Thunderbit | ✅ Cloud-tilstand med servere i USA/EU/Asien | ✅ Håndteres via cloud | ✅ Automatisk throttling | Skift til browser-scraping |
| Apify | ✅ Inklusive residential proxies | ✅ Via actor/browser-infrastruktur | ✅ Kan konfigureres | Prøv igen med ny proxy |
| WebScraper.io | ✅ Cloud-planer + proxy-tilføjelse | ✅ Cloud-planer | ✅ Stærk | Brug cloud-kørsel |
| Instant Data Scraper | ❌ Ingen | ❌ Ingen | ❌ Svag | Manuel genforsøg eller stop |
| Outscraper | ✅ Administreret backend | ⚠️ Begrænset dokumentation | ✅ Moderat | Den administrerede service håndterer det |
| Octoparse | ✅ Inklusive residential | ✅ Automatisk CAPTCHA-løsning | ✅ Stærk | Cloud-skabeloner + anti-blokering |
| ScrapingBee | ✅ Administrerede proxies | ✅ Indbygget | ✅ Stærk | Tilpas kode, premium proxies |
| Bright Data | ✅ Enterprise-niveau | ✅ Indbygget | ✅ Meget stærk | Fuld justering af infrastrukturen |
| Python DIY | ❌ Kun selvstyret | ❌ Kun selvstyret | ❌ Varierende | Hvad end du selv bygger |
Mere end rå data: gør Yellow Pages-scrapes til CRM-klare leads
Et mønster, jeg ser hele tiden: nogen scraper 500 Yellow Pages-lister, eksporterer til et regneark og bruger derefter tre timer på manuelt at google hver virksomhed for at finde e-mails, tjekke websteder og finde ud af, hvilke der er værd at kontakte. Scrapingen tog 10 minutter. Berigelsen tog hele eftermiddagen.
Det er her, klagen om, at "rå data uden scoring bare er et regneark", kommer fra. Et råt Yellow Pages-udtræk ser sådan ud:
| Firmanavn | Telefon | Adresse | Websted | Kategori |
|---|---|---|---|---|
| Example Plumbing Co. | 555-0199 | 123 Main St | exampleplumbing.com | VVS-installatører |
| NoSite HVAC | 555-0112 | 456 Oak Ave | Ingen | HVAC |
En beriget lead-tabel — den slags, der faktisk er nyttig til outreach — ser sådan ud:
| Firmanavn | Telefon | Adresse | Websted | Anmeldelser | Har websted? | Prospect-note | |
|---|---|---|---|---|---|---|---|
| Example Plumbing Co. | 555-0199 | 123 Main St | exampleplumbing.com | info@exampleplumbing.com | 42 | Ja | Kontakt-side findes |
| NoSite HVAC | 555-0112 | 456 Oak Ave | Ingen | Ingen | 8 | Nej | Muligt bureau-emne |
Brug af undersidescraping til at berige leads
Thunderbits undersidescraping besøger hver virksomheds detaljeside og tilføjer felter som e-mail, webadresser, åbningstider, anmeldelser og kategorier. For en scrape med 500 lister er det forskellen mellem 10 minutters automatiseret arbejde og 3+ timers manuelt researcharbejde.
Apifys detail-mode scraping gør noget lignende, men til en højere pris pr. record (cirka $6 pr. 1.000 virksomheder mod $1 pr. 1.000 i listing mode).
Mærkning og kategorisering af leads under scrapingen
Thunderbits Field AI Prompt lader dig tilføje instruktioner under selve scrapingen — ting som "markér virksomheder uden websted" eller "kategorisér efter virksomhedsstørrelse." AI’en behandler disse labels, mens den udtrækker data, så du får en forhåndskvalificeret leadliste i stedet for et råt dataudtræk.
En vigtig nuance fra researchen: et manglende websted betyder ikke nødvendigvis, at en virksomhed er et godt prospect. Det er et nyttigt signal til bureau-outreach, men bør ikke være den eneste kvalifikationsfaktor.
Workflow fra eksport til CRM
Det mest almindelige workflow, jeg ser fra vores brugere:
- Thunderbit → Google Sheets eller Airtable → CRM (direkte eksport, ingen mellemtrin)
- Apify → Webhook → CRM (kræver en smule konfiguration)
- Outscraper → CSV-download → CRM-import (manuelt, men ligetil)
Hvis dit CRM integrerer med Google Sheets eller Airtable, fjerner Thunderbits direkte eksport hele fil-download-trinnet. Du kan læse mere om webscraping uden kodning på vores blog.
Bedste Yellow Pages-scraper efter brugsscenarie: hurtig anbefalingsguide
Ikke alle værktøjer passer til alle brugere. Mine anbefalinger efter bruger-type:
Bedst til ikke-tekniske salgsrepræsentanter og bureauejere: Thunderbit (AI-scraping med 2 klik, gratis Email Extractor, undersidescraping) og Instant Data Scraper (gratis, simpelt — men ingen e-mails)
Bedst til leadgenerering i stor skala: Apify (cloud-actors, jobs på tværs af flere byer, e-mailudtræk fra detaljesider) og Outscraper (administreret API, understøttelse af flere kataloger)
Bedste helt gratis løsning: Instant Data Scraper (helt gratis for altid) og Thunderbits gratis niveau (6 sider/md. med AI-funktioner)
Bedst til udviklere: Python DIY med Playwright (maksimal kontrol) og ScrapingBee API (administreret rendering + proxies)
Bedst til enterprise / stor skala: Bright Data (største proxy-netværk, compliance-funktioner, enterprise-priser)
Vi har også skrevet en oversigt over de bedste AI-webscrapere og en dybere guide til AI leadgenerering, hvis du vil længere i gang.
Yellow Pages vs. Google Maps vs. andre kataloger: hvornår bruger man hvad?
De fleste lead-gen-professionelle scraper ikke Yellow Pages isoleret. De trækker fra flere kataloger og krydstjekker. En hurtig sammenligning baseret på den aktuelle datatilgængelighed:
| Faktor | Yellow Pages | Google Maps | Facebook Business |
|---|---|---|---|
| Tilgængelighed af e-mail | Lav (kun detaljesider) | Meget lav (ikke et standardfelt) | Middel (sider kan indeholde e-mail) |
| Telefonnumre | ✅ Konsekvent angivet | ✅ Konsekvent angivet | ⚠️ Nogle gange skjult |
| Anmeldelser/vurderinger | ✅ Tilgængelige | ✅ Mere omfattende data | ✅ Tilgængelige |
| Kategorier/nicher | ✅ Stærk til lokale nicher | ✅ Bred og detaljeret | ⚠️ Ujævn |
| Bedste scraper-værktøj | Thunderbit, Apify YP-actor | Outscraper, Apify Maps-actor | Thunderbit (AI Suggest Fields virker på alle sites) |
Yellow Pages er stærkest til lokal niche-dækning — hvis du har brug for alle VVS-installatører i et bestemt storbyområde, er det svært at slå. Google Maps giver mere detaljerede anmeldelsesdata og friskere signaler. Facebook Business Pages kan nogle gange overgå begge på direkte e-mail-tilgængelighed, fordi sideejere ofte offentliggør deres e-mail.
Thunderbits AI Suggest Fields virker på alle websites, så du kan scrape Yellow Pages, Google Maps og Facebook med den samme udvidelse. Den fleksibilitet betyder meget, når du bygger en leadliste fra flere kilder. Vores guide til hvad webscraping er gennemgår det grundlæggende, hvis du er ny i området.
Juridiske og etiske overvejelser ved scraping af Yellow Pages
Dette afsnit er kort, men vigtigt.
Yellow Pages-data er offentligt tilgængelige, men YP.coms vilkår for brug siger eksplicit, at adgangen er til "individuelle, ikke-kommercielle, informative formål", og at brugere ikke må anvende "bots, scrapers, crawlers, spiders" til at udtrække data. Det nuværende amerikanske juridiske landskab omkring webscraping er nuanceret — offentlig synlighed kan reducere CFAA-risiko sammenlignet med sider bag login, men kontraktret, privacy-regler (CCPA) og marketing-compliance gælder stadig.
FTC sendte advarselsbreve til 21 markedsførere af sundhedsplaner og lead generators i december 2024 om, hvordan forbrugerdata bruges i lead-gen-workflows. Konklusionen: scrape ansvarligt, respekter hastighedsgrænser, videresælg ikke rå data uden at forstå de juridiske rammer, og brug de scrapede data til legitime forretningsformål.
Denne artikel er kun til orientering og udgør ikke juridisk rådgivning.
Konklusion
De fleste Yellow Pages-scrapere misser e-mails, fordi de stopper ved listingsiden. De værktøjer, der klarer sig bedre, er dem, der kan nå virksomhedens detaljesider, følge links til virksomhedens websteder eller køre berigelses-workflows oven på basisscrapen. Selv dér topper e-mailtilgængeligheden fra Yellow Pages omkring 15–25 % af listerne — så realistiske forventninger er lige så vigtige som at vælge det rigtige værktøj.
Hvis du er et ikke-teknisk team, der har brug for leads med faktisk kontaktdata, så prøv Thunderbits gratis niveau — funktionerne til undersidescraping og e-mailudtræk er netop designet til dette problem. Hvis du kører større kampagner, tilbyder Apify og Outscraper solid cloud-infrastruktur. Og hvis du er udvikler og vil have fuld kontrol, kan Python med Playwright og ScrapingBee få dig i mål, om end du selv bygger mere af pipelinen.
Start med sammenligningstabellen ovenfor, vælg ud fra dit tekniske niveau og budget, og husk: den bedste scraper er den, der faktisk giver dig de data, du har brug for til outreach — ikke den med den længste funktionsliste.
Du kan også udforske vores Thunderbit Chrome Extension direkte, eller se vejledninger på vores YouTube-kanal.
Ofte stillede spørgsmål
Kan man faktisk scrape e-mails fra Yellow Pages?
Ja, men de fleste e-mails findes på virksomhedens detalje-(under)sider, ikke på det primære listingskort. Nuværende scraper-dokumentation antyder, at kun omkring 15–25 % af virksomhederne viser en e-mail, som en scraper til detaljesider kan genskabe. Du har brug for et værktøj med undersidescraping — som Thunderbit eller Apifys detail-mode-actors — for de bedste resultater.
Hvad er den bedste gratis Yellow Pages-scraper?
Instant Data Scraper er helt gratis uden konto eller kreditbegrænsning, men den udtrækker ikke e-mails pålideligt og har ingen anti-bot-håndtering. Thunderbit tilbyder et gratis niveau (6 sider/md.) med AI-drevet scraping, adgang til undersider og e-mailudtræk — et stærkere valg, hvis e-mail er vigtigt i dit workflow.
Hvordan undgår jeg at blive blokeret, når jeg scraper Yellow Pages?
Yellow Pages bruger Cloudflare Bot Management, CAPTCHAs, hastighedsbegrænsning og browser-fingerprinting. Brug værktøjer med indbygget proxy-rotation og CAPTCHA-håndtering (Thunderbit, Apify, Octoparse, ScrapingBee, Bright Data). Thunderbits cloud-til-browser-skift giver en praktisk fallback — hvis cloud-scraping bliver blokeret, bruger browsertilstand din lokale session til at omgå nogle af beskyttelserne.
Yellow Pages-scraper vs. Google Maps-scraper — hvad er bedst til leads?
Det afhænger af dine behov. Yellow Pages har stærkere dækning af lokale nicher og viser konsekvent telefonnumre. Google Maps giver mere detaljerede anmeldelsesdata og hyppigere opdateringer. Ingen af dem er særligt gode til e-mails — Facebook Business Pages har faktisk ofte højere e-mailtilgængelighed. Ideelt set bør du krydskrydse flere kataloger for at få de mest komplette leadprofiler.
Er det lovligt at scrape Yellow Pages?
Yellow Pages-data er offentligt tilgængelige, men YP.coms vilkår for brug begrænser automatisk dataindsamling og kommerciel brug af søgeresultater. Det amerikanske juridiske landskab omkring scraping af offentlige data udvikler sig stadig. Brugere bør gennemgå sidens vilkår, overholde gældende privacy-regler (CCPA, GDPR hvor relevant) og bruge de scrapede data ansvarligt. Denne artikel er kun til orientering og udgør ikke juridisk rådgivning.
Prøv Thunderbit til Yellow Pages-scraping Get Started Free
Læs mere


