For noen måneder siden stilte en kollega på salgsteamet vårt meg et spørsmål jeg har hørt dusinvis av ganger: «Hvis jeg skraper konkurrentpriser fra et offentlig nettsted, kan jeg faktisk få trøbbel?» Han hadde funnet en katalog med leverandørkontakter, priser pent og ryddig listet i rader, og alt han ville ha, var et regneark. Tvilens øyeblikk var reelt — og ærlig talt forståelig.
Storbritannia har ingen egen, samlet «web-skrapingslov». I stedet er det fire overlappende juridiske rammeverk som avgjør om en bestemt skrapeaktivitet er lovlig. Derfor er svaret nesten alltid «det kommer an på» — men det trenger ikke være lammende. I denne guiden går jeg gjennom hva loven faktisk sier, hvordan den gjelder i reelle scenarier, hvordan straffene kan se ut, og hvordan du holder deg innenfor reglene.
Jeg har brukt mye tid på å researche dette for teamet vårt hos Thunderbit, og jeg vil dele det jeg har funnet, så du slipper å sette sammen brikkene fra fem ulike advokatblogger og en Reddit-tråd.
Prøv Thunderbit for web-skraping
Hva er web-skraping (og hvorfor bruker britiske bedrifter det)?
Web-skraping betyr å bruke programvare til å samle inn data fra nettsteder automatisk — altså å erstatte den tidkrevende prosessen med å kopiere og lime fra nettsider inn i et regneark.
Teknikken i seg selv er nøytral. Ikke lovlig i seg selv, ikke ulovlig i seg selv. Det som betyr noe, er hva du skraper, hvordan du skraper det, og hva du gjør med dataene etterpå.
Britiske bedrifter bruker skraping til mange legitime formål:
- Prissammenligning: PriceSpy UK, for eksempel, oppdaterer produktpriser tre til fem ganger daglig ved hjelp av automatisert web-skraping.
- Leadgenerering: Salgsteam som henter firmanavn, e-postadresser og telefonnumre fra offentlige kataloger.
- Markedsundersøkelser: Analytikere som følger med på boligannonser, stillingsdatabaser eller konkurrenters produktsortiment.
- Akademisk forskning: Office for National Statistics samlet inn over 2,2 millioner prisnoteringer fra supermarkednettsteder mellom 2014 og 2015.
- Trening av AI-modeller: Et raskt voksende — og juridisk uavklart — bruksområde.
Trenden er tydelig. En Bright Data/Vanson Bourne-undersøkelse blant 500 beslutningstakere (inkludert 200 i Storbritannia) fant at 89 % så offentlige webdata som avgjørende eller svært viktige for den globale økonomien, og 38 % hentet dem minst daglig.
Samtidig sa 73 % at mangelen på tydelig regulering bekymret organisasjonen deres. Det er akkurat derfor denne artikkelen finnes.
Er web-skraping lovlig i Storbritannia? Det korte svaret
Ingen britisk lov forbyr web-skraping direkte. Men flere lover regulerer hvordan det kan gjøres, og lovligheten til et bestemt prosjekt avhenger av fire faktorer:

- Hvilke data du skraper (personopplysninger vs. faktiske/ikke-personlige data)
- Hvordan du får tilgang (offentlig side vs. å omgå innlogging eller CAPTCHA)
- Hva nettstedets vilkår sier (forbyr de automatisert tilgang?)
- Hvordan du bruker dataene etterpå (intern analyse vs. kommersiell videresalg)
Den beste analogien jeg har funnet: web-skraping er som fotografering på et offentlig sted. Det er ikke automatisk ulovlig å ta et bilde offentlig — men bestemte motiver, steder, metoder og bruksområder kan skape juridisk risiko. Skraping er tilsvarende. At noe er offentlig tilgjengelig, er relevant, men det er ikke hele bildet.
ICO sin ferske GenAI-konsultasjon er en av de tydeligste offisielle britiske uttalelsene om skrapede personopplysninger. Den sa at berettiget interesse er det eneste tilgjengelige lovlige grunnlaget for å trene generative AI-modeller med web-skrapede personopplysninger — men bare hvis utvikleren består en streng trepartsprøve. Det er en høy terskel, og det viser hvor alvorlig britiske tilsynsmyndigheter tar skrapede data.
De fire britiske lovene som gjelder for web-skraping
Fire overlappende linser — ethvert skrapingsprosjekt kan utløse én, to eller alle fire.
UK GDPR og Data Protection Act 2018
Skraper du personopplysninger — navn, e-postadresser, telefonnumre, IP-adresser, profiler på sosiale medier — gjelder UK GDPR. «Offentlig tilgjengelig» betyr ikke «fritt å bruke».
Personopplysninger som er synlige offentlig, er fortsatt personopplysninger.
Det mest relevante lovlige grunnlaget for kommersiell skraping er berettiget interesse (artikkel 6) — men du kan ikke bare vise til ordene og håpe det holder. Du må:
- Identifisere et spesifikt og legitimt formål
- Vise at behandlingen er nødvendig for dette formålet
- Veie din interesse opp mot rettighetene til personene hvis data du samler inn
ICO sitt svar på GenAI-konsultasjonen er særlig tydelig: utviklere bør ikke anta at en bred samfunnsnytte er nok, de bør dokumentere hvorfor alternativer til skraping ikke er egnet, og de bør bruke transparensmekanismer som lar enkeltpersoner forstå og utøve rettighetene sine. Kilde: ICO GenAI response.
For B2B-leadgenerering gjelder den samme logikken. Et salgsteam kan støtte seg på berettiget interesse ved innsamling av offentlig oppført bedriftskontaktinfo, men det må fortsatt dokumentere den berettigede interessen, minimere feltene som samles inn, unngå særlige kategorier av personopplysninger, gi personvernsinformasjon der det er praktisk mulig, og respektere reservasjoner.
Opphavsrett, databasevern og TDM-unntaket
Opphavsrett beskytter originalt nettinnhold: tekst, bilder, produktbeskrivelser, artikler. Faktiske datapunkter som priser er vanligvis mindre følsomme i seg selv — men kopierer og publiserer du beskyttet uttrykk på nytt, er du inne i inngrepsområdet.
Databasevern er mer relevant for skraping enn mange tror. Storbritannia beholdt EU-lignende sui generis-databasevern etter Brexit, og å hente ut en «vesentlig del» av en beskyttet database — kuraterte kataloger, produktkataloger, markedsplass-oppføringer — kan være et inngrep selv når de enkelte datapunktene er faktiske.
Unntaket for tekst- og datautvinning (TDM) under Section 29A CDPA tillater kopier for tekst- og dataanalyse bare når brukeren har lovlig tilgang, og formålet er ikke-kommersielt forskningsarbeid. Dette er snevert. Kommersiell skraping, kommersiell AI-trening og kommersiell videresalg av datasett omfattes ikke.
Den britiske regjeringen vurderte å utvide dette unntaket for AI-trening, men bestemte seg per sin March 2026 Copyright and AI report for ikke å innføre reformer før de er sikre på at de oppfyller målene for skapere, AI-utviklere og britisk økonomi. Under dagens ordning trengs det som regel tillatelse for å kopiere beskyttede verk til AI-trening, med mindre et eksisterende unntak gjelder.
Nettstedets bruksvilkår og kontraktsrett
De fleste nettsteder har bruksvilkår som forbyr eller begrenser automatisert skraping. Besøker du nettstedet, kan du allerede være bundet av disse vilkårene — særlig hvis du klikker deg gjennom en godkjenningsside (clickwrap). Browsewrap-avtaler (vilkår bak en lenke i bunnteksten) er mer faktuavhengige, men britiske domstoler har vist vilje til å håndheve vilkår som begrenser skraping. I tvisten Ryanair v Billigfluege behandlet retten synlige nettstedvilkår som bindende i en skjermskrapingskontekst.
robots.txt er ikke en lov. Det er et maskinlesbart signal fra eieren av nettstedet. En typisk fil ser slik ut:
User-agent: *
Disallow: /account/
Disallow: /checkout/
Disallow: /private/
Crawl-delay: 10
Å ignorere robots.txt gjør ikke automatisk skraping ulovlig, men domstoler og ICO ser det som et uttrykk for nettstedseierens intensjon. Å ignorere det øker den juridiske risikoen, særlig hvis det kombineres med brudd på bruksvilkår eller store mengder forespørsler.
Computer Misuse Act 1990
Denne loven holder mange våkne om natten — og det med god grunn. Den skaper straffbare handlinger. Section 1 gjelder uautorisert tilgang til datamaskinmateriale (maksimum 2 års fengsel). Section 3 gjelder uautoriserte handlinger som svekker datamaskinens drift (maksimum 10 års fengsel).
Risikoen etter CMA er lavest når dataene faktisk er offentlige og skraperen ikke omgår tekniske barrierer. Risikoen øker når du:
- Omgår innloggingssperrer, CAPTCHA eller IP-blokkering
- Bruker stjålne innloggingsdetaljer eller oppretter falske kontoer
- Sender trafikkvolumer som svekker tjenesten hos målet
Storbritannia har ikke en ren amerikansk regel om at «offentlige data er fritt vilt». Det gjør britisk rådgivning mer forsiktig: offentlig tilgang reduserer CMA-risikoen betydelig, men nettstedvilkår, tekniske kontroller og skraperens kjennskap til restriksjoner kan fortsatt ha betydning.
«Kan jeg skrape dette lovlig?» — et raskt beslutningsskjema
Før du skraper noe som helst, gå gjennom disse fem beslutningspunktene. Ikke juridisk rådgivning — bare en 60-sekunders risikovurdering.
| Beslutningspunkt | Hvis JA | Hvis NEI |
|---|---|---|
| Er dataene personopplysninger (navn, e-post osv.)? | UK GDPR gjelder. Identifiser lovlig grunnlag, gjør en LIA, minimer feltene, planlegg transparens. | GDPR-delen gjelder kanskje ikke, men fortsett til de andre kontrollene. |
| Forbyr nettstedets vilkår uttrykkelig skraping? | Risiko for kontraktsbrudd. Vurder API, lisens eller juridisk gjennomgang. | Lavere kontraktsrisiko, men sjekk robots.txt. |
| Henter du ut en vesentlig del av en database? | Sannsynlig brudd på sui generis-databasevern. Vurder lisensiering eller snevrere uthenting. | Opphavsrett kan fortsatt gjelde for enkeltinnhold som kopieres. |
| Omgår du innlogging, CAPTCHA eller tilgangskontroller? | Mulig straffbar handling etter CMA 1990. Stopp og få juridisk vurdering. | Lavere CMA-risiko hvis tilgangen faktisk er offentlig. |
| Er formålet ikke-kommersielt forskningsarbeid? | Section 29A TDM-unntaket kan gjelde hvis du har lovlig tilgang. | Ingen bred britisk trygg havn for kommersiell TDM. Full IP- og kontraktsanalyse kreves. |
Ærlig talt skulle jeg ønske noen hadde gitt meg dette da jeg først begynte å undersøke skrapingscompliance for teamet vårt. Det gjør juridisk kompleksitet om til en strukturert egenvurdering du kan gjennomføre på under et minutt.
Virkelige scenarier: Er akkurat din skraping lovlig i Storbritannia?
Abstrakt juss er én ting. Det folk faktisk vil vite, er: «Kommer mitt prosjekt til å skape problemer?»
Helt rimelig. Her er fem vanlige bruksområder for skraping i Storbritannia, med en kort juridisk risikovurdering for hver.
Skraping av produktpriser for sammenligning
Et av de vanligste — og ofte lavest risikoutsatte — forretningsbruksområdene. Priser er faktiske data, og automatisert prisinnsamling er slik nettsteder som PriceSpy fungerer.
Risikoen forsvinner likevel ikke helt. Hvis målnettstedet forbyr skraping i bruksvilkårene, hvis du kopierer produktbeskrivelser eller bilder, eller hvis du henter ut en vesentlig del av en kuratert produktdatabase, kan det oppstå spørsmål om kontrakt, opphavsrett og databasevern.
Risikonivå: LAVT til MIDDELS
Viktig compliance-tiltak: Samle bare inn faktiske prisfelter, unngå å kopiere produktbeskrivelser ordrett, respekter bruksvilkår og robots.txt, bruk rate limiting, og ikke publiser en rå kopi av konkurrentens katalog.
Skraping og videresalg av data kommersielt
Det mest risikable kommersielle scenariet, punktum. Du gjør en annen parts datainvestering om til et salgbart produkt — og det kan berøre alle fire juridiske søyler samtidig.
Risikonivå: HØYT
Viktig compliance-tiltak: Juridisk gjennomgang er helt nødvendig. Vurder lisensavtaler med dataeierne. Hvis produktet inkluderer personopplysninger, legg til en personvernkonsekvensvurdering.
Uttrekking av bedriftskontaktinfo til leadgenerering
Hvert salgsteam jeg har snakket med, gjør en eller annen variant av dette: de skraper e-postadresser, telefonnumre og firmanavn fra kataloger. Haken? Bedriftskontaktdata inneholder ofte personopplysninger. En navngitt ansatts e-postadresse er personopplysning, selv om den er offentlig oppført.
Risikonivå: MIDDELS
Viktig compliance-tiltak: Gjennomfør en Legitimate Interests Assessment, samle bare inn bedriftskontaktdata (ikke privat kontaktinformasjon) der det er mulig, dokumenter lovlig grunnlag, og tilby en enkel reservasjonsmulighet. Verktøy som Thunderbit kan redusere tilgangsrisikoen her fordi Chrome-utvidelsen kjører i brukerens nettleser — den får bare tilgang til det brukeren allerede kan se, uten å omgå tilgangskontroller.
Akademisk eller porteføljebasert dataanalyse
Hvis du driver reell ikke-kommersiell forskning, har du den sterkeste opphavsrettslige unntaksveien: Section 29A CDPA, forutsatt at du har lovlig tilgang.
Risikonivå: LAVT (hvis virkelig ikke-kommersielt)
Viktig compliance-tiltak: Dokumenter det ikke-kommersielle formålet, oppgi kilder, anonymiser eller aggreger der det er mulig, og unngå å videredistribuere beskyttet innhold eller personopplysninger.
Skraping av innhold til trening av AI-modeller
Dette er spørsmålet alle stiller i 2026 — og svaret er fortsatt lite tilfredsstillende. ICO behandler web-skrapede personopplysninger til trening som høyrisiko, usynlig behandling. Den britiske regjeringens rapport fra 2026 innførte ikke et bredt kommersielt TDM-unntak.
Risikonivå: MIDDELS til HØYT
Viktig compliance-tiltak: Lisensiering, sporbarhet for datasett, opphavsrettsanalyse, filtrering av personopplysninger, dokumentasjon av lovlig grunnlag og tett oppfølging av endringer i britisk politikk.
Oversiktstabell over scenarier
| Scenario | Viktigste utløsende lover | Risikonivå | Viktig compliance-tiltak |
|---|---|---|---|
| Overvåking av produktpriser | Bruksvilkår, databasevern, opphavsrett | Lav–Middels | Samle faktiske felter, respekter nettstedssignaler |
| Kommersiell videresalg av data | Alle fire søyler | Høy | Juridisk gjennomgang og lisensiering er nødvendig |
| B2B-leadgenerering | UK GDPR, bruksvilkår | Middels | Gjør LIA, minimer personopplysninger |
| Akademisk forskning | Opphavsrett (TDM-unntak), GDPR hvis personopplysninger | Lav | Hold formålet ikke-kommersielt, ikke republiser |
| Trening av AI-modeller | UK GDPR, opphavsrett, databasevern | Middels–Høy | Lisensier data, dokumenter lovlig grunnlag, følg politikken |
Storbritannia vs. USA vs. EU: Hvordan web-skrapingsloven skiller seg
Hvis du bare opererer i Storbritannia, kan du hoppe over denne delen. Men de fleste virksomhetene jeg snakker med skraper internasjonalt — eller skraper i det minste nettsteder som er hostet i andre jurisdiksjoner. Forskjellene betyr mer enn du kanskje tror.
| Juridisk dimensjon | 🇬🇧 Storbritannia | 🇺🇸 USA | 🇪🇺 EU |
|---|---|---|---|
| Hovedlov om databeskyttelse | UK GDPR + DPA 2018 | Ingen føderal ekvivalent (delstatlige lover varierer) | EU GDPR |
| Viktig presedens for skraping | Clearview AI (ICO-bot på £7,5M) | hiQ v LinkedIn (skraping av offentlige data OK, Ninth Circuit — men hiQ ble permanent nektet og betalte 500 000 dollar i endelig samtykkedom) | Ryanair v PR Aviation (CJEU, C-30/14, databasevern) |
| Lov om datatilgang | Computer Misuse Act 1990 | CFAA (innskrenket av Van Buren, 2021) | Varierer fra medlemsstat til medlemsstat |
| Opphavsrett / TDM-unntak | Snevert: bare ikke-kommersielt forskningsarbeid (Section 29A) | Fair use-doktrinen (bredere, vurderes fra sak til sak) | DSM-direktivet art. 3 og 4 (bredere TDM-rettigheter med rettighetsreservasjon) |
| Databasevern | Ja (beholdt fra EU Database Directive) | Ingen tilsvarende føderal rettighet | Sui generis-rett under Database Directive |
| Håndheving av bruksvilkår | Kontraktsrett gjelder; browsewrap er omstridt | Blandet: browsewrap ofte ikke håndhevbar | Varierer; Ryanair styrket posisjonen til bruksvilkår |
Det praktiske poenget: Hvis du skraper på tvers av jurisdiksjoner, følg den strengeste gjeldende loven. USA er mer tillatende når det gjelder offentlig datatilgang under hiQ, men hiQ er ikke en generell fripass (hiQ fikk til slutt forbud mot å skrape LinkedIn og betalte 500 000 dollar). EU har en bredere TDM-struktur gjennom DSM-direktivet. Storbritannia ligger et sted midt imellom — ingen bred kommersiell TDM-unntaksregel, sterkt databasevern og en aktiv tilsynsmyndighet.
Straffer og håndheving: Hva skjer faktisk hvis du blir tatt?

Vage advarsler om «bøter» og «juridiske problemer» hjelper ingen. Her er de faktiske tallene.
Bøter etter UK GDPR
Maksstraff: £17,5 millioner eller 4 % av årlig global omsetning, det som er høyest.
Virkelig eksempel: Clearview AI fikk en bot på £7 552 800 av ICO i 2022 for å skrape ansiktsbilder fra britiske sosiale medier. First-tier Tribunal opphevet vedtaket på jurisdiksjonsgrunnlag, men Upper Tribunal i oktober 2025 tillot ICOs anke og sendte saken tilbake. ICO opplyste at Clearview per desember 2025 hadde tillatelse til å anke til Court of Appeal.
Straffer etter Computer Misuse Act
- Section 1 (uautorisert tilgang): opptil 2 års fengsel
- Section 3 (uautorisert svekkelse): opptil 10 års fengsel
Straffeforfølgning for vanlig skraping av offentlige sider er ekstremt sjelden.
Risikoen endrer seg dramatisk når handlingene ligner hacking, misbruk av innloggingsinformasjon, CAPTCHA-omgåelse eller svekkelse av tjenesten.
Opphavsrett og databasevern
Erstatning i sivile saker pluss forføyning. Straff er mulig ved forsettlig kommersiell krenkelse, men de fleste skrapetvister behandles som sivile krav.
Brudd på kontrakt (bruksvilkår)
Sivile erstatninger, kontostenging, IP-blokkering. Dette er vanligvis den mest praktiske håndhevingen — og ofte det første som skjer.
Oppsummering av straffenivå
| Juridisk rammeverk | Maksstraff | Sannsynlighet ved typisk forretningsskraping | Reelt eksempel |
|---|---|---|---|
| UK GDPR | £17,5 mill. eller 4 % global omsetning | Middels hvis personopplysninger i stor skala; lav for ikke-personlige data | Clearview AI-bot på £7,5M |
| CMA Section 1 | 2 års fengsel | Lav for offentlige sider; høyere hvis kontroller omgås | CPS-veiledning om uautorisert tilgang |
| CMA Section 3 | 10 års fengsel | Lav med mindre trafikken svekker systemene | DDoS-lignende eksempler på svekkelse |
| Opphavsrett/databasevern | Erstatning og forføyning | Middels ved kopiering av beskyttet innhold eller kuraterte databaser | Ryanair- og BHB-sakene |
| Brudd på bruksvilkår | Erstatning, kontostenging, blokkering | Høy som praktisk håndheving | Ryanair-stridene om skjermskraping |
Hvordan riktig skrapeverktøy reduserer den juridiske risikoen din
Verktøyet du velger, gjør ikke en ulovlig skraping lovlig. Men det kan fjerne unødvendig risiko.
Etter min erfaring er forskjellen mellom et verktøy som respekterer nettstedssignaler og ett som aggressivt omgår alt, ofte forskjellen mellom et rutinebasert dataprojekt og et juridisk hodebry.
Respekterer robots.txt og nettstedssignaler
Et ansvarlig verktøy bør gjøre det enkelt å sjekke og respektere robots.txt før skraping. Selv om det ikke er juridisk bindende, blir etterlevelse av robots.txt sett av domstoler og ICO som bevis på god tro. Thunderbits dokumentasjon anbefaler brukere å skrape offentlig tilgjengelige data og følge robots.txt og vilkår.
Skraping i nettleser vs. skraping i skyen
Dette skillet har juridisk betydning. Skraping i nettleseren får bare tilgang til det brukeren kan se i sin autentiserte økt — i praksis automatisering av det du ellers ville gjort manuelt. Skraping i skyen sender forespørsler fra servere, som er raskere for offentlige nettsteder, men kan fremstå mer som «automatisert tilgang» fra nettstedets perspektiv.
Thunderbit tilbyr begge moduser. Skraping i nettleseren passer for nettsteder som krever innlogging (og reduserer risikoen for «uautorisert tilgang» etter CMA), mens skybasert skraping fungerer godt for offentlig tilgjengelige netthandelsider der fart er viktig. Denne todelte tilnærmingen lar brukere tilpasse skrapemetoden til den juridiske risikoprofilen for hvert nettsted.
Ingen omgåelse av tilgangskontroller
Et verktøy som fungerer i nettleseren og ikke knekker CAPTCHA-er eller omgår innloggingssperrer, har i utgangspunktet lavere risiko etter Computer Misuse Act. Thunderbits Chrome-utvidelse opererer innenfor brukerens nettleserøkt — den får bare tilgang til det brukeren allerede kan se.
Transparente dataeksporter (som støtter GDPR-compliance)
Thunderbit eksporterer direkte til Excel, Google Sheets, Airtable eller Notion. Brukeren kontrollerer hvor dataene går. Dette støtter transparens og dokumentasjon av lovlig grunnlag etter GDPR: du vet nøyaktig hvilke data du samlet inn og hvor de ble sendt. Ingen skjult behandling eller datalagring hos verktøyet.
Rate limiting og ansvarlig tilgang
Aggressive forespørselsvolumer kan utløse CMA Section 3 (uautorisert svekkelse). Rate limiting er ikke bare en teknisk best practice — det er et juridisk sikkerhetstiltak. Ansvarlige verktøy unngår å overbelaste servere, noe som reduserer både juridisk risiko og sjansen for å bli IP-blokkert.

En praktisk compliance-sjekkliste for web-skraping i Storbritannia
Gå gjennom dette før du skraper noe som helst:
- Les nettstedets bruksvilkår og policy for akseptabel bruk.
- Sjekk robots.txt-filen og dokumenter om relevante stier er sperret.
- Avgjør om dataene du vil ha, er personopplysninger. Hvis ja, identifiser lovlig grunnlag etter UK GDPR.
- Vurder om du henter ut en «vesentlig del» av en database.
- Bekreft at du ikke omgår tekniske tilgangskontroller (CAPTCHA, innlogging, rate limits).
- Hvis formålet er ikke-kommersielt forskningsarbeid, dokumenter dette for å kunne bruke TDM-unntaket.
- Bruk rate limiting. Ikke overbelast måltjeneren.
- Dokumenter alt: lovlig grunnlag, gjennomgang av vilkår, hvilke datafelt som ble samlet inn, eksportdestinasjoner, lagringsperiode.
- Hvis du er i tvil, få juridisk rådgivning fra en advokat som spesialiserer seg på personvern og immaterialrett.
Denne sjekklisten erstatter ikke en advokats vurdering — men den gir deg et solid utgangspunkt og viser god tro hvis spørsmål skulle oppstå senere.
Viktigste lærdommer
- Web-skraping er ikke ulovlig i Storbritannia — men det reguleres av fire overlappende juridiske rammeverk: UK GDPR, opphavsrett/databasevern, kontraktsrett og Computer Misuse Act.
- Lovligheten til enhver skraping avhenger av hva du skraper, hvordan du får tilgang, hva nettstedets vilkår sier, og hva du gjør med dataene.
- Skraping av personopplysninger har den høyeste compliance-tyngden. Berettiget interesse er som regel det eneste realistiske lovlige grunnlaget, og det krever en dokumentert avveiing.
- Storbritannia har ikke noe bredt kommersielt TDM-unntak. Kommersiell AI-trening og videresalg av datasett er høyrisiko uten lisens.
- Bruk beslutningsskjemaet og scenariotabellen over for å vurdere din egen situasjon før du starter.
- Velg verktøy som er i tråd med beste praksis for compliance: nettleserbasert tilgang, ingen CAPTCHA-omgåelse, transparent dataeksport og rate limiting. Thunderbit er bygget med disse prinsippene i tankene — men compliance-ansvaret ligger alltid hos brukeren.
- Når du er i tvil, dokumenter resonnementet ditt og snakk med en advokat. Kostnaden for en juridisk vurdering er nesten alltid lavere enn kostnaden ved en ICO-etterforskning.
Prøv AI Web Scraper med Thunderbit Get Started Free
Vanlige spørsmål
Er det lovlig å skrape offentlig tilgjengelige data i Storbritannia?
Generelt, ja — skraping av offentlige data har lavere risiko enn skraping av avstengte eller private data. Men «offentlig tilgjengelig» betyr ikke «fritt å bruke som du vil». UK GDPR kan fortsatt gjelde for offentlige personopplysninger, opphavsrett kan gjelde for kopiert uttrykk, databasevern kan beskytte kuraterte samlinger, og bruksvilkår kan begrense automatisert tilgang.
Kan jeg skrape e-postadresser og telefonnumre fra britiske nettsteder?
Hvis dataene er personopplysninger (noe e-postadresser og telefonnumre vanligvis er), trenger du et lovlig grunnlag etter UK GDPR. Berettiget interesse er det vanligste grunnlaget for B2B-leadgenerering, men du må gjøre en avveiningstest, minimere dataene du samler inn, og tilby en reservasjonsmulighet. Skraping av privat kontaktinformasjon (mobilnummer, private e-poster) er langt mer risikabelt enn bedriftskatalogoppføringer.
Hva er forskjellen mellom web-skraping og web-crawling under britisk lov?
Juridisk sett er det ingen meningsfull forskjell — loven bryr seg om handlingen, ikke etiketten. Crawling betyr vanligvis å oppdage eller indeksere sider; skraping betyr vanligvis å hente ut strukturerte data. Begge innebærer automatisert tilgang til nettsteder og er underlagt de samme juridiske rammeverkene.
Gjør robots.txt skraping ulovlig?
Nei. robots.txt er ikke juridisk bindende. Men å ignorere den øker den juridiske risikoen, fordi domstoler og ICO ser på den som bevis på nettstedseierens intensjon. Hvis du ignorerer robots.txt og nettstedets vilkår også forbyr skraping, bygger du opp risikofaktorer — og det er en mye vanskeligere posisjon å forsvare.
Kan jeg bli straffeforfulgt for web-skraping i Storbritannia?
Bare hvis du omgår tilgangskontroller (CAPTCHA, innlogging, IP-blokkering) eller forårsaker skade på et datasystem under Computer Misuse Act 1990. Vanlig skraping av genuint offentlige data, i rimelige volumer og uten teknisk omgåelse, vil svært sjelden føre til straffesak. Risikobildet endrer seg dramatisk når handlingene ligner hacking eller bevisst tjenestesvekkelse.
Les mer


