AI-driven web scraping

Nyhets-scraper: Knyt rubriker till fullständiga artikeluppgifter

Samla rubriker från ämnes-, sektions- eller söksidor och öppna sedan artikel­länkar för synliga bylines, publiceringsdatum, sammanfattningar, avdelningar och käll-URL:er. Berätta för Thunderbit vilka artikeluppgifter som är viktiga på vanlig svenska innan körningen.

Behöver du fler sätt att samla in data i stor skala?

En snabb testmiljö: prova själv.

Koppla nyhetsrubriker till fullständiga artiklar

Förvandla en bevakningslista med rubriker till artikelposter med källsammanhang.

Öppna artiklar för fullständiga detaljer

Börja från en ämnes-, sektions- eller resultatsida. Thunderbit kan besöka varje länkad artikel och lägga till byline, publiceringstid, sektion, sammanfattning och artikel-URL som visas där.

news-subpage.png

Bearbeta en lista med artikel-URL:er

Klistra in länkar som valts ut av en redaktör eller forskare. Varje tillgänglig artikel blir en egen rad, där källa och publiceringsuppgifter kopplas till rätt rubrik.

news-bulk.png

Uppdatera en nyhetsbevakning

Schemalägg samma källsidor för en senare körning. Den nya tabellen visar de artiklar och rubrikuppgifter som var synliga vid den tidpunkten.

news-scheduled.png

Bygg en nyhetsbevakning utan att bygga en scraper

Gå från rubriker till författare, datum, sektion och källdetaljer i en enda tabell.

Manuella listor eller selektorverktyg

Mer förarbete för varje källa
Kopiera och klistra in mellan listor och artiklar.
Regler måste arbetas om när sidornas struktur ändras.
Sidindelade listor och ”Ladda fler” kräver extra steg.
Bylines och datum varierar mellan olika sektioner.
Extrahera med ett klick

Thunderbit AI Agent

Öppna en nyhetssida och kör igång
Användbara artikeluppgifter föreslås automatiskt.
Valfria besök på undersidor lägger till författare, datum och sektion.
Accepterar en inklistrad lista med artikel-URL:er.
Exporterar till Sheets, Notion eller Excel.

Artikel- och listfält inom räckvidd

Samlas endast in när de syns i din session.

  • headline
  • article_url
  • outlet_name
  • author_name
  • author_profile_url
  • byline
  • publication_date
  • publication_time
  • updated_date
  • updated_time
  • section
  • subsection
  • tags
  • summary
  • lead_paragraph
  • body_text_snippet
  • dateline_location
  • estimated_read_time
  • image_url
  • image_caption
  • image_credit
  • video_url
  • video_title
  • video_duration
  • gallery_image_count
  • comment_count
  • share_count
  • related_titles
  • related_urls
  • publisher_logo_url

Watch news researchers build a usable watchlist

In user videos, news teams show how they match headlines with article details and check each row.

Frågor om att gå från rubriker till sammanhang

Korta svar för nyhetslistor och artiklar.

Continue from headlines to source research

Collect author pages, press releases, publication archives, or topic feeds that support the same news question.

PubMed-scraper

PubMed-scraper

Thunderbits PubMed-scraper hjälper dig att extrahera strukturerad data från PubMeds sökresultat och artikelsidor med hjälp av AI. Skrapa aktuell medicinsk forskning, evidens från kliniska studier, abstract, författare, affilieringar, publiceringsdatum och länkar, och exportera sedan till Excel, Google Sheets, Airtable eller Notion.

Läs mer ->
Wikipedia-skrapare för infoboxar, källor och avsnitt

Wikipedia-skrapare för infoboxar, källor och avsnitt

One Click Extract föreslår användbara artikeldata och fångar sedan det du ser – från faktaruta och uppgifter till referenser och avsnitt – i en enda körning. Besök av länkade artiklar är valfria och går att styra.

Läs mer ->
Trivago-scraper

Trivago-scraper

Extrahera hotellnamn, priser, betyg och omdömen från trivago med 2 klick — och exportera sedan direkt till Excel, Google Sheets eller Notion. Ingen kod eller installation krävs.

Läs mer ->
Amazon-prisextraktor

Amazon-prisextraktor

Följ Amazon-priser som faktiskt går att agera på: aktuellt erbjudande, rabatt, säljare, lagerstatus och variation. Hämta sidan direkt eller schemalägg en ny kontroll till senare.

Läs mer ->
Carousell-scraper

Carousell-scraper

Extrahera Carousell-annonser — rubriker, beskrivningar, priser och säljarinformation — på 2 klick och exportera sedan direkt till Excel, Google Sheets eller Notion. Ingen kod och ingen krånglig uppsättning krävs.

Läs mer ->
Elgiganten Scraper

Elgiganten Scraper

Extrahera produktnamn, priser och lagerstatus från Elgiganten med 2 klick — och exportera sedan direkt till Excel, Google Sheets eller Notion. Thunderbits AI sköter det tunga jobbet så att du kan fokusera på insikterna.

Läs mer ->
Visa alla användningsområden

Redo att växla upp din dataextraktion?

Gå med över 200 000 yrkespersoner som redan använder Thunderbit för att automatisera sina arbetsflöden för web scraping.

Gratis provperiod ger obegränsade credits för 8 webbsidor.