Google News pesca da oltre 50.000 fonti sparse per il mondo, e questo lo colloca tra i feed di notizie in tempo reale più ricchi che si trovino in rete. C'è però un dettaglio che quasi nessuno mette sul tavolo all'inizio: nel 2011 Google ha mandato in pensione la sua API ufficiale per le News, e da allora non ne ha mai messa un'altra al suo posto.
Risultato? Restano col cerino in mano i team PR che tengono d'occhio le menzioni del brand, i commerciali che annusano i segnali di mercato e gli analisti alle prese con dashboard di competitive intelligence. A te servono dati sulle notizie ben strutturati—titoli, fonti, date, testo degli articoli—ma Google fa di tutto per scoraggiare lo scraping automatico, tra CAPTCHA, limiti di frequenza e layout che cambiano in continuazione. In Thunderbit ho passato anni a costruire e collaudare strumenti di estrazione dati, e ti assicuro che lo scarto tra "mi faccio un rapido scraping di Google News" e portare a casa dati davvero affidabili e ben strutturati è molto più largo di quanto la maggior parte della gente immagini.
Questa guida passa in rassegna i 10 migliori Google News scraper che ho scovato tra API, strumenti no-code e piani gratuiti, con confronti senza fronzoli su prezzi, difese anti-bot e quel livello di dettaglio sui campi che fa davvero la differenza nella scelta dello strumento giusto.
Prova Thunderbit per lo scraping di Google News
Perché Google News è ostico da fare scraping (e perché non c'è un'API ufficiale)
Google ha chiuso la sua API News nel 2011. Da quel momento, qualsiasi strumento che si spaccia per "Google News API" è in realtà un wrapper di terze parti che estrae o fa da tramite ai risultati di Google News al posto tuo. L'alternativa programmatica ufficiale che ci va più vicino è la Custom Search JSON API, che mette a disposizione 100 query gratuite al giorno e costa 5 $ ogni 1.000 query. Solo che ti tocca configurare un motore di ricerca personalizzato, e non è certo un rimpiazzo immediato di Google News.
Nel frattempo, le difese anti-scraping di Google sono tutt'altro che teoriche:
- Limitazione di frequenza basata su IP: se martelli Google News troppo in fretta, ti becchi errori 429 o sfide CAPTCHA.
- Pagine di consenso e interstitial: a seconda di dove ti trovi, Google può sbatterti davanti schermate di consenso sui cookie che mandano in tilt la maggior parte dei parser.
- Contenuti renderizzati in JavaScript: buona parte di Google News si carica in modo dinamico, perciò le semplici richieste HTTP ti restituiscono un HTML monco.
- URL incapsulati nei redirect: i link di Google News spesso passano dal livello di redirect di Google prima di sfociare nella pagina del publisher.
- Deriva del layout: Google rimaneggia di continuo la struttura delle card delle notizie, dei cluster di storie e delle sezioni tematiche.
Nel marzo 2025, Google ha pure portato a termine il passaggio alle pagine delle pubblicazioni generate automaticamente, rendendo la piattaforma ancora più mutevole. I thread della community su GitHub e Stack Overflow traboccano di sviluppatori che si scambiano workaround per le pagine di consenso, i selettori andati a pezzi e i formati degli URL che cambiano.
E allora perché si continua a fare scraping? Perché su Google si fanno miliardi di ricerche al giorno e il 15% di queste sono query che Google non aveva mai incontrato prima. Per il monitoraggio del brand, l'analisi dei trend, l'individuazione di segnali per i lead e la competitive intelligence, Google News resta una delle superfici di notizie più ampie e versatili da interrogare.
RSS, API o scraping no-code: come scegliere il metodo giusto
Non tutti i Google News scraper lavorano allo stesso modo. Prima di puntare su uno strumento, vale la pena inquadrare i tre approcci di fondo e capire quando conviene ciascuno.
| Approccio | Ideale per | Limiti | Strumenti di esempio |
|---|---|---|---|
| Feed RSS di Google News | Monitoraggio semplice dei titoli, gratuito, volumi bassi | Nessun testo completo, max ~100 risultati, filtri limitati | Lettori RSS integrati, n8n |
| SERP / News API | Monitoraggio scalabile di parole chiave, metadati strutturati | Costo continuo, di solito solo titoli + snippet | SerpApi, Scrapingdog, Newsdata.io |
| Scraping diretto (no-code) | Contenuto completo degli articoli, campi dati personalizzati, ricerche una tantum | Richiede gestione anti-bot, meno scalabile delle API | Thunderbit, Octoparse, Apify |
| Scraping diretto (codice) | Massimo controllo, pipeline personalizzate | Manutenzione elevata, gestione CAPTCHA, si rompe spesso | Scrapy, BeautifulSoup + Selenium |
La gran parte degli articoli della concorrenza si ferma ad API e librerie Python. Ma i dati sull'intento degli utenti che ho sotto mano raccontano un'altra storia: una bella fetta di chi cerca i "migliori Google News scraper" non sono sviluppatori, bensì PR manager, responsabili operations e team sales che hanno bisogno di una soluzione point-and-click, non di un progetto di coding. Ecco perché in questa lista trovi estensioni browser e piattaforme no-code accanto ai colossi delle API.
Una cosa va detta: i feed RSS di Google News sono ancora gratuiti e tornano utili per un monitoraggio leggero dei titoli. Ti iscrivi a un feed per un argomento o una parola chiave e ti arrivano un centinaio di risultati con titoli, link e date di pubblicazione. Ma se ti servono testo completo, nomi degli autori, sentiment o più di cento risultati, dovrai rivolgerti a uno degli strumenti qui sotto.
Come abbiamo valutato i migliori Google News scraper
Ho passato ogni strumento di questa lista attraverso lo stesso setaccio:
- Facilità d'uso: no-code, richiede codice o è solo API
- Gestione anti-bot / CAPTCHA: cruciale quando si parla di Google
- Campi dati estratti: titolo, fonte, data, snippet, URL, testo completo, autore, immagini, sentiment
- Disponibilità e limiti del piano gratuito
- Costo normalizzato per 1.000 richieste: visto che ogni fornitore usa una metrica diversa (al mese, per credito, per richiesta), ho riportato tutto al costo per 1.000 risultati riusciti sul livello a pagamento più basso
- Formati di esportazione: JSON, CSV, Google Sheets, Airtable, Notion e via dicendo
- Scalabilità: limiti giornalieri, rate limit, concorrenza
- Caso d'uso ideale
Normalizzare i prezzi conta più di quanto sembri. Uno strumento ti fattura per "ricerca" (che ti rende 10 risultati), un altro per "credito" (dove 1 credito = 1 riga), un terzo per "richiesta" (dove il rendering JavaScript costa di più). Senza una base comune, finisci per paragonare mele e arance.
I 10 migliori Google News scraper in sintesi
Ecco la tabella comparativa principale. Più giù entro nel dettaglio di ogni strumento, ma questo quadro d'insieme dovrebbe aiutarti a sfoltire in fretta il campo.
| Strumento | Tipo | Piano gratuito | Costo ~ per 1K risultati | Gestione anti-bot | Estrazione articolo completo | Formati di esportazione | Ideale per |
|---|---|---|---|---|---|---|---|
| Thunderbit | Estensione Chrome / no-code AI | Piano gratuito (6 pagine) | ~$6–$30 per 1K righe (dipende dal piano) | Modalità browser (la tua sessione) + modalità cloud | Sì (scraping delle sottopagine) | Excel, CSV, Sheets, Airtable, Notion, JSON | Utenti non tecnici, team business |
| SerpApi | API SERP | 250 ricerche/mese | ~$5–$15 per 1K risultati | Anti-detection specifica per SERP | No (titoli + snippet) | JSON | Sviluppatori, pipeline API strutturate |
| ScraperAPI | API di scraping generica | 1.000 crediti/mese + prova da 5K | ~$0,10–$0,49 per 1K richieste | Rotazione proxy, rendering JS | Nessun parser dedicato | JSON, HTML | Sviluppatori con budget ridotto, scraping generico |
| Apify | Piattaforma di scraping cloud | Prova di 7 giorni | Varia in base ad actor/compute | Rendering JS, browser headless | Dipende dall’actor | JSON, CSV, Excel, API | Team tecnici, workflow già pronti |
| Bright Data | Scraper/dataset enterprise | 1K richieste di prova | ~$1,30–$2,50 per 1K record | Proxy, risoluzione CAPTCHA, rendering browser | Sì (prodotto News Scraper) | JSON, CSV | Pipeline enterprise |
| Octoparse | Piattaforma no-code visuale | Piano gratuito (limitato) | ~$9–$25 per 1K righe (ammortizzato) | Esecuzione cloud, anti-blocco | Sì (il template include il testo del corpo) | CSV, Excel, JSON, database | Chi costruisce workflow visuali |
| ScrapingBee | API di scraping | Crediti di prova | Variabile (a crediti, il JS costa di più) | Chrome headless, rotazione proxy, CAPTCHA | Nessun parser dedicato | JSON, HTML | Sviluppatori che hanno bisogno del rendering JS |
| Oxylabs | API SERP / scraper | Fino a 2.000 risultati di prova | ~$1,00–$2,35 per 1K risultati | Oltre 100M proxy, risoluzione CAPTCHA | No (dati SERP) | JSON | Scraping su larga scala, geotargeting |
| Scrapingdog | API SERP economica | 1.000 crediti gratuiti | ~$0,10 per 1K richieste | Anti-detection specifica per SERP | No (titoli + snippet) | JSON | Sviluppatori attenti al budget |
| Newsdata.io | API news dedicata | 200 richieste/giorno | Variabile in base al piano | N/D (non fa scraping diretto di Google) | Sì (piani premium) | JSON | Funzionalità NLP specifiche per le news |
Qualcosa salta subito all'occhio. Il costo per richiesta più basso? Scrapingdog e ScraperAPI. La configurazione no-code più indolore? Thunderbit e Octoparse. Affidabilità da enterprise con geotargeting? Bright Data e Oxylabs.
Andiamo nel dettaglio.
1. Thunderbit — Il miglior Google News scraper no-code per utenti business
Thunderbit è lo strumento che abbiamo tirato su nella nostra azienda, perciò te lo dico in chiaro. Ma voglio essere preciso su cosa fa e cosa non fa, perché l'onestà secondo me rende più dell'entusiasmo gonfiato.
Thunderbit è una estensione Chrome guidata dall'AI, pensata per chi vuole dati strutturati dai siti senza mettere mano al codice. Per Google News, il giro è questo:
- Apri i risultati di Google News in Chrome.
- Clicca su "AI Suggerisci campi" — l'AI legge la pagina e rileva da sola colonne come titolo, fonte, data, snippet e URL.
- Clicca su "Scrape" per riversare i dati strutturati in una tabella.
Questa è la pagina di elenco. La vera forza per i casi d'uso legati alle news arriva subito dopo: una volta fatto lo scraping dei risultati di Google News, puoi cliccare su "Scrape Subpages" per visitare ogni URL dell'articolo e tirare fuori testo completo, autore, immagini e altro ancora. È la risposta diretta al classico "ho i link ma mi tocca ancora visitarli e cavare il contenuto vero", quella seccatura che spunta di continuo nei forum.
Field AI Prompt ti permette di aggiungere istruzioni AI su misura per ogni colonna. Per dire, potresti creare una colonna "Sentiment" con un prompt del tipo: "Classifica questo articolo come positivo, negativo o neutro rispetto a [brand]." Così estrai i dati e li arricchisci in un colpo solo: cosa che nessuno dei puri strumenti API ti dà.
Thunderbit supporta sia lo Browser Scraping (gira nella tua sessione Chrome, ereditando cookie e stato di login, e così schiva parecchi trigger di rilevamento bot) sia il Cloud Scraping (macina fino a 50 pagine alla volta con infrastruttura anti-bot integrata). Puoi pure programmare uno scraping pianificato per il monitoraggio ricorrente delle notizie.
Funzionalità principali
- AI Suggerisci campi rileva da solo le colonne di titolo, fonte, data e URL
- Scraping delle sottopagine per contenuto completo, autore e immagini
- Field AI Prompt per analisi del sentiment, traduzione o etichettatura personalizzata
- Modalità di scraping Cloud e Browser
- Scraping pianificato per monitoraggi giornalieri o settimanali
- Esportazione gratuita verso Google Sheets, Airtable, Notion, Excel, CSV, JSON
Prezzi
- Piano gratuito: 6 pagine
- Prova gratuita: 10 pagine
- I piani a pagamento partono da circa 9 $/mese (basati su crediti, 1 credito = 1 riga di output)
- Costo normalizzato per 1.000 righe: circa 6–30 $ a seconda del piano
Ideale per
Team sales, professionisti PR, responsabili operations e chiunque abbia bisogno di dati strutturati da Google News senza scrivere una riga di codice. Dà il meglio quando ti servono i contenuti completi degli articoli più campi arricchiti dall'AI, come il sentiment.
2. SerpApi — La migliore API strutturata per Google News per sviluppatori
SerpApi è la scelta azzeccata se vuoi un endpoint API dedicato a Google News che ti rende JSON pulito e ben strutturato. Mette a disposizione due endpoint rilevanti: uno per news.google.com (la pagina Google News) e uno per la scheda notizie tbm=nws nella ricerca Google standard.
La documentazione dei campi è dettagliata fuori dal comune: porti a casa title, source, authors, link, thumbnail, topic_token, story_token, related_topics e related_publications. Il supporto a story token e topic token torna davvero comodo per de-duplicare le storie raggruppate, un grattacapo che molti strumenti fanno finta di non vedere.
Per esperienza, SerpApi risponde rapidamente (di norma sotto i 2 secondi) e l'uptime è roccioso. Il limite principale: è solo API, quindi ti serve codice o un'integrazione no-code per sfruttare i dati. Niente testo completo dell'articolo—solo titoli, snippet e metadati.
Funzionalità principali
- Endpoint dedicato per la ricerca Google News con JSON strutturato
- Targeting per località e lingua
- Query storiche tramite parametro
tbs - Supporto a story token e topic token per il clustering
Prezzi
- Gratis: 250 ricerche/mese
- Developer: 75 $/mese per 5.000 ricerche
- Production: 150 $/mese per 15.000 ricerche
- Costo normalizzato per 1.000 risultati: circa 5–15 $ (ipotizzando ~10 risultati per ricerca)
Ideale per
Sviluppatori che mettono in piedi pipeline automatiche di monitoraggio news e hanno bisogno di dati SERP affidabili e strutturati con un'ottima copertura dei campi.
3. ScraperAPI — La migliore API generica economica per Google News
ScraperAPI è un'API di scraping generica, non uno strumento ritagliato su Google News. L'abbiamo messa in lista comunque, perché è uno dei modi più economici per colpire le pagine di Google News su larga scala, ammesso che tu sia a tuo agio nello scriverti il parser.
ScraperAPI si occupa di rotazione proxy, rendering JavaScript e risoluzione CAPTCHA dietro una semplice API REST. Le passi un URL e ti torna l'HTML renderizzato. Il punto è che non c'è un parser dedicato a Google News, quindi i campi te li dovrai estrarre da solo (o affiancarci una libreria di parsing).
Qualche utente lamenta tempi di risposta più lenti (7–23 secondi nei benchmark), e il sistema a crediti fa sì che ogni tipo di richiesta consumi un numero diverso di crediti. Detto questo, per chi sa già come smontare l'HTML di Google News, il prezzo di ScraperAPI è difficile da battere.
Funzionalità principali
- Rotazione proxy automatica e geotargeting
- Rendering JavaScript
- Modello basato su crediti (100K crediti nel piano base)
- 1.000 crediti gratuiti/mese + 5.000 crediti di prova
Prezzi
- Gratis: 1.000 crediti/mese
- Hobby: 49 $/mese (100.000 crediti)
- Startup: 149 $/mese (1.000.000 crediti)
- Costo normalizzato per 1.000 richieste: circa 0,10–0,49 $ a seconda del piano
Ideale per
Sviluppatori attenti al budget che hanno bisogno di un livello proxy/rendering economico e non hanno problemi a costruirsi da sé un parser per Google News.
4. Apify — La migliore piattaforma cloud con actor già pronti per Google News
Apify è una piattaforma di scraping nel cloud con un marketplace di "Actor", scraper preconfigurati che lanci senza programmare. Ci sono diversi actor Google News Scraper sfornati dalla community, e la piattaforma si occupa di esecuzione cloud, pianificazione e storage.
Parti in fretta con un actor già pronto. Il rovescio della medaglia: la qualità e la manutenzione degli actor della community sono altalenanti. Alcuni possono andare in crisi quando Google cambia layout, e per le correzioni dipendi dall'autore dell'actor. L'infrastruttura di Apify è solida, ma l'esperienza specifica su Google News dipende dall'actor che scegli.
Funzionalità principali
- Actor specifici per Google News nello Store di Apify
- Esecuzioni pianificate nel cloud
- Integrazioni API e webhook
- Esportazione in JSON, CSV, Excel e via API
Prezzi
- Prova gratuita: 7 giorni
- Piani a pagamento da 49 $/mese
- Costo normalizzato per 1.000 richieste: varia in base ad actor e utilizzo compute
Ideale per
Team tecnici che vogliono workflow di scraping già pronti senza costruirsi tutto da zero, e che hanno bisogno di pianificazione cloud e integrazioni API.
5. Bright Data — Il miglior Google News scraper di livello enterprise
Bright Data è il gigante enterprise. Il suo prodotto News Scraper supporta esplicitamente Google News e mette in campo gestione automatica dei proxy, rendering completo del browser, risoluzione CAPTCHA e gestione batch fino a 5.000 URL. Tra i campi: ID, URL, titolo, autore, topic e altro ancora.
Bright Data vende pure un dataset Google News già raccolto a partire da 2,50 $ per 100K record, comodo per i team che non hanno voglia di fare scraping live.
La rete di oltre 72M proxy residential è ciò che gli dà la marcia in più nella gestione anti-bot. Se fai scraping di Google News da più paesi e a volumi alti, Bright Data si carica sulle spalle tutta la complessità.
Funzionalità principali
- News Scraper con supporto Google News
- Oltre 72M proxy residential con geotargeting
- Risoluzione CAPTCHA integrata
- Web Scraper IDE (visuale, semi-no-code)
- Opzioni pay-as-you-go e in abbonamento
Prezzi
- Prova gratuita: 1.000 richieste
- Pay as you go: circa 2,50 $/1K record
- Scale: 499 $/mese (384K record inclusi, circa 1,30 $/1K aggiuntivi)
Ideale per
Aziende grandi ed enterprise che hanno bisogno di dati Google News ad alto volume e ad alta affidabilità, con copertura geografica globale e infrastruttura di compliance.
6. Octoparse — Il miglior scraper no-code desktop per Google News
Octoparse propone sia un normale template Google News Scraper sia un template Cloud. L'elenco dei campi è trasparente fuori dal comune: parola chiave, fonte, titolo, data di pubblicazione, URL, testo del corpo, autore, abstract, immagini e campi messaggio errore.
Il template cloud arriva persino a dichiarare una tariffa di 0,1 $ per 1.000 righe in Run Mode, una trasparenza sui prezzi rara per uno strumento no-code. Ma il costo vero dipende dal livello di abbonamento che ti serve per la pianificazione cloud e le funzioni anti-blocco.
Il builder visuale dei workflow di Octoparse è tagliato su misura per chi vuole un controllo esplicito sui passaggi di estrazione senza scrivere codice. La curva di apprendimento è più ripida rispetto all'approccio guidato dall'AI di Thunderbit, ma c'è chi preferisce proprio questo livello di granularità.
Funzionalità principali
- Template Google News già pronto con estrazione dettagliata dei campi
- Builder visuale point-and-click
- Esecuzione cloud e locale
- Scraping pianificato e ricorrente
- Esportazione in CSV, Excel, JSON, database
Prezzi
- Piano gratuito con funzionalità limitate
- Piani a pagamento da 69 $/mese
- Costo normalizzato: circa 9–25 $ per 1.000 righe (ammortizzato con il costo del piano)
Ideale per
Utenti non tecnici che preferiscono uno strumento desktop visuale con controllo esplicito, passo dopo passo, sull'estrazione e che hanno bisogno di scraping Google News ricorrente.
7. ScrapingBee — La migliore API per gestire pagine Google News cariche di JavaScript
ScrapingBee è specializzata nel rendering con browser headless, nella rotazione proxy e nell'aggirare le difese anti-bot. È una scelta robusta quando le pagine di Google News pretendono l'esecuzione completa di JavaScript per renderizzare i risultati, cosa che capita sempre più spesso.
L'API è lineare: le invii un URL e ti torna HTML renderizzato o uno screenshot. ScrapingBee si occupa dietro le quinte di rotazione proxy e risoluzione CAPTCHA. Ma, come per ScraperAPI, non c'è un parser dedicato a Google News: i campi te li estrai tu.
Il sistema a crediti fa sì che le richieste renderizzate in JavaScript pesino più delle semplici richieste HTTP, quindi tienilo a mente quando stimi i costi per Google News.
Funzionalità principali
- Rendering Chrome headless per pagine cariche di JS
- Rotazione proxy automatica e bypass CAPTCHA
- Supporto allo scraping di Google Search / News
- Semplice API REST con risposta JSON/HTML
Prezzi
- Piani da 49 $/mese
- Modello a crediti (il rendering JS costa di più per richiesta)
- Costo normalizzato per 1.000 richieste: variabile in base alle esigenze di rendering
Ideale per
Sviluppatori che hanno bisogno di rendering JavaScript affidabile e gestione anti-bot per le pagine di Google News tramite un'API semplice.
8. Oxylabs — Il miglior Google News scraper per risultati geotargettizzati
Oxylabs ha un'API dedicata a Google News Scraper nel suo stack SERP, sorretta da un pool di oltre 100M proxy in 195 paesi. La proposta è chiara: affidabilità da enterprise con risultati ritagliati per area geografica.
Oxylabs supporta output JSON strutturato, modalità di scraping in tempo reale e batch, e logica di parsing personalizzata con XPath e selettori CSS. Il prezzo specifico per Google è esplicito: circa 2,00 $/1K risultati nel piano Micro, che scende verso 0,90 $/1K nei livelli più alti.
La prova gratuita ti dà fino a 2.000 risultati, abbastanza per verificare se la qualità dei dati regge alle tue esigenze.
Funzionalità principali
- SERP Scraper API con supporto Google News
- Oltre 100M proxy in 195 paesi
- Consegna JSON strutturata
- Modalità di scraping real-time e batch
Prezzi
- Prova gratuita: fino a 2.000 risultati
- Micro: circa 2,00 $/1K risultati Google (circa 2,35 $/1K con rendering JS)
- Livelli superiori: circa 0,90 $/1K
- Piani enterprise personalizzati disponibili
Ideale per
Team enterprise e mid-market che hanno bisogno di risultati Google News geotargettizzati su larga scala con alta affidabilità.
9. Scrapingdog — La migliore API Google News economica
Scrapingdog si presenta come l'alternativa conveniente a SerpApi, con un endpoint API dedicato a Google News. La risposta JSON strutturata comprende titolo, fonte, data, snippet e link.
Il prezzo è davvero da battaglia: certi piani offrono 400K richieste per 40 $, ossia circa 0,10 $ per 1.000 richieste. Il tempo di risposta gira di solito intorno ai 2 secondi e hai 1.000 crediti gratuiti per fare le tue prove.
Il compromesso: Scrapingdog è un'azienda più piccola, con meno documentazione e meno integrazioni rispetto ai grandi nomi. Ma per startup e builder con un occhio al budget, i conti tornano alla grande.
Funzionalità principali
- Endpoint API dedicato a Google News Scraper
- Risposta JSON strutturata (titolo, fonte, data, snippet, link)
- Dati storici news tramite parametro
tbs - 1.000 crediti gratuiti per test
Prezzi
- Gratis: 1.000 crediti
- Piani a pagamento da 40 $/mese
- Costo normalizzato per 1.000 richieste: circa 0,10 $
Ideale per
Sviluppatori e startup attenti al budget che hanno bisogno di dati Google News ad alto volume al costo per richiesta più basso possibile.
10. Newsdata.io — La migliore API news dedicata (oltre Google News)
Newsdata.io è un'API per dati news costruita apposta, che mette insieme oltre 50.000 fonti a livello globale. Non è propriamente un Google News scraper—non fa scraping diretto di Google News. Aggrega invece per conto suo le stesse fonti dei publisher (più altre in aggiunta), restituendo JSON strutturato con ricerca news in tempo reale e storica.
I piani premium includono estrazione completa del testo degli articoli, analisi del sentiment e filtri per categoria: funzioni che la maggior parte degli strumenti di scraping SERP non offre di serie. Il piano gratuito ti dà 200 richieste/giorno, una dotazione generosa per fare i test.
Se il tuo scopo è "mettere le mani su dati news per un argomento" e non per forza "fare scraping di Google News", Newsdata.io può rivelarsi una scelta migliore di qualunque strumento SERP di questa lista.
Funzionalità principali
- API per ricerca news in tempo reale e storica
- Estrazione del testo completo degli articoli (premium)
- Analisi del sentiment (premium)
- Filtri per categoria, lingua e paese
- Piano gratuito da 200 richieste/giorno
Prezzi
- Gratis: 200 richieste/giorno
- Piani a pagamento da 99,99 $/mese
- Costo normalizzato per 1.000 richieste: variabile in base al piano
Ideale per
Team che hanno bisogno di una fonte dati news dedicata con funzioni NLP integrate (sentiment, categorizzazione) e non sono obbligati a fare scraping di Google News.
Google News scraper a confronto: gestione anti-bot, campi dati e prezzi
Quando scegli un Google News scraper, ci sono tre dimensioni di confronto che pesano più di tutte le altre. Non ho trovato un'altra guida che le affronti tutte e tre in modo sistematico.
Come ciascuno strumento se la cava con le protezioni anti-bot di Google
La gestione anti-bot è il pensiero numero uno di chiunque faccia scraping di Google News. Ecco come si muove ciascuno strumento:
| Strategia | Strumenti che la usano |
|---|---|
| Rotazione proxy integrata | Bright Data, ScrapingBee, Oxylabs, ScraperAPI |
| Risoluzione CAPTCHA inclusa | Bright Data, ScrapingBee, Oxylabs |
| Rendering JS / browser headless | Apify, Octoparse, ScrapingBee |
| Basato su browser (usa la tua sessione) | Thunderbit (modalità Browser Scraping) |
| Anti-detection specifica per SERP | SerpApi, Scrapingdog |
Vale la pena spendere due parole in più sulla modalità Browser Scraping di Thunderbit. Visto che gira nella tua vera sessione Chrome, eredita cookie e stato di login. Tradotto: schiva molti dei trigger di rilevamento bot che inguaiano gli scraper headless—pagine di consenso, sfide CAPTCHA e controlli di fingerprinting. Per le esigenze a volume elevato, il Cloud Scraping di Thunderbit macina 50 pagine alla volta con una sua infrastruttura anti-bot.
Quali campi dati restituisce ciascun Google News scraper?
Questo è il confronto che nessun altro pubblica, ed è proprio quello che pesa di più al momento di scegliere uno strumento. Certi strumenti ti danno solo titoli e link. Altri sanno estrarre testo completo, nomi degli autori e perfino il sentiment.
| Strumento | Titolo | Fonte | Data | Snippet | URL articolo | Testo completo | Autore | Immagini | Sentiment |
|---|---|---|---|---|---|---|---|---|---|
| Thunderbit | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ (tramite sottopagina) | ✅ (tramite AI) | ✅ | ✅ (tramite Field AI Prompt) |
| SerpApi | ✅ | ✅ | ✅ | ✅ | ✅ | ❌ | ✅ | ✅ | ❌ |
| ScraperAPI | ✅ (parsing personalizzato) | ✅ (parsing personalizzato) | ✅ (parsing personalizzato) | ✅ (parsing personalizzato) | ✅ (parsing personalizzato) | ❌ | ❌ | ❌ | ❌ |
| Apify | ✅ | ✅ | ✅ | ✅ | ✅ | Dipende dall’actor | Dipende dall’actor | ✅ | ❌ |
| Bright Data | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ (News Scraper) | ✅ | ✅ | ❌ |
| Octoparse | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ (template) | ✅ | ✅ | ❌ |
| ScrapingBee | ✅ (parsing personalizzato) | ✅ (parsing personalizzato) | ✅ (parsing personalizzato) | ✅ (parsing personalizzato) | ✅ (parsing personalizzato) | ❌ | ❌ | ❌ | ❌ |
| Oxylabs | ✅ | ✅ | ✅ | ✅ | ✅ | ❌ | ❌ | ✅ | ❌ |
| Scrapingdog | ✅ | ✅ | ✅ | ✅ | ✅ | ❌ | ❌ | ❌ | ❌ |
| Newsdata.io | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ (premium) | ✅ | ✅ | ✅ (premium) |
Il dato più interessante qui è che Thunderbit riesce a estrarre il testo completo dell'articolo tramite lo Scraping delle sottopagine e ad aggiungere campi arricchiti dall'AI, come il sentiment, nello stesso passaggio. Anche Newsdata.io mette a disposizione sentiment e testo completo, ma attraverso un'API news dedicata e non tramite scraping di Google News. La maggior parte delle API SERP restituisce solo ciò che è in bella vista nella pagina elenco di Google News: titoli, snippet e link.
Costo normalizzato per 1.000 risultati
Questa è la tabella che avrei voluto avere quando stavo soppesando gli strumenti e non la trovavo da nessuna parte. Ogni fornitore presenta i prezzi a modo suo, quindi ho riportato tutto al costo per 1.000 risultati riusciti sul livello a pagamento più basso.
| Strumento | Piano gratuito | Piano a pagamento più basso | Costo ~ per 1K risultati | Note |
|---|---|---|---|---|
| Thunderbit | 6 pagine gratis / prova: 10 pagine | Da circa 9 $/mese (basato su crediti) | ~$6–$30 | 1 credito = 1 riga; estrazione AI inclusa |
| SerpApi | 250 ricerche/mese | 75 $/mese (5.000 ricerche) | ~$15 | JSON strutturato, endpoint Google News |
| ScraperAPI | 1.000 crediti/mese | 49 $/mese (100K crediti) | ~$0,49 | Nessun parser dedicato a Google News |
| Apify | Prova di 7 giorni | 49 $/mese | Variabile | Dipende da actor e compute |
| Bright Data | 1K richieste di prova | Pay-as-you-go | Circa $1,30–$2,50 | Di livello enterprise, dataset disponibile |
| Octoparse | Piano gratuito (limitato) | $69/mese | ~$9–$25 | Template cloud: $0,1/1K righe (base) |
| ScrapingBee | Crediti di prova | 49 $/mese | Variabile (il JS costa di più) | A crediti, senza parser dedicato |
| Oxylabs | Fino a 2.000 risultati | Piano Micro | ~$1,00–$2,35 | Geotargeting, JSON strutturato |
| Scrapingdog | 1.000 crediti | 40 $/mese | ~$0,10 | Scelta economica, endpoint News dedicato |
| Newsdata.io | 200 richieste/giorno | 99,99 $/mese | Variabile in base al piano | Non fa scraping diretto di Google; funzioni NLP |
Qualche punto da portarsi a casa. Scrapingdog è di gran lunga l'opzione più economica per richiesta, ma restituisce solo dati a livello SERP (niente testo completo). Bright Data e Oxylabs stanno a metà strada sul costo, però mettono in campo l'infrastruttura anti-bot più solida. Thunderbit è più caro per riga rispetto alle API più economiche, ma è l'unico strumento a offrire estrazione completa degli articoli più arricchimento AI senza scrivere codice.
Quale Google News scraper conviene scegliere?
Il mio consiglio, scenario per scenario:
- Ti bastano i titoli per il monitoraggio, con budget risicato? → Scrapingdog o il piano gratuito di Newsdata.io
- Utente non tecnico che vuole testo completo + arricchimento? → Thunderbit
- Sviluppatore che sta tirando su una pipeline news strutturata? → SerpApi (migliore copertura dei campi) o Scrapingdog (miglior prezzo)
- Enterprise, alto volume, geotargeting? → Bright Data o Oxylabs
- Vuoi un workflow desktop visuale? → Octoparse
- Ti servono dati news oltre Google News con funzioni NLP? → Newsdata.io
- Hai bisogno del livello proxy/rendering generico più economico? → ScraperAPI
Lo strumento giusto dipende da tre fattori: il tuo livello tecnico, il volume di cui hai bisogno e se ti bastano i titoli o vuoi il contenuto completo degli articoli. Se sei in dubbio, parti da un piano gratuito—quasi tutti questi strumenti ne hanno uno—e mettilo alla prova per vedere quanto regge la qualità dei dati nel tuo caso specifico.
Se vuoi tentare la via no-code più veloce, il piano gratuito di Thunderbit ti permette di fare scraping dei risultati di Google News in un paio di clic ed esportare dritti in Google Sheets o Airtable. Per una guida passo passo, fai un salto sul nostro canale YouTube o al template per news scraper.
E che i tuoi titoli siano sempre ben strutturati, i CAPTCHA pochi e le tue esportazioni pulite.
Prova Thunderbit per lo scraping di Google News Get Started Free
FAQ
Google ha un'API ufficiale per le News?
No. Google ha dismesso la sua API News nel 2011 e non l'ha mai rimpiazzata. L'opzione ufficiale che ci va più vicino è la Custom Search JSON API, che dà 100 query gratuite al giorno e costa 5 $ ogni 1.000 query, ma richiede un motore di ricerca personalizzato configurato e non è un prodotto dedicato a Google News. Qualsiasi strumento che oggi si spacci per "Google News API" è un servizio di terze parti.
Posso usare i feed RSS di Google News invece di uno scraper?
Sì, per casi d'uso semplici. I feed RSS di Google News forniscono titoli e link gratis, ma si fermano a circa 100 risultati, non danno il testo completo degli articoli e hanno opzioni di filtro ridotte all'osso. Se ti servono dati più ricchi—contenuto completo, nomi degli autori, analisi del sentiment o più di 100 risultati—dovrai rivolgerti a uno scraper o a un'API dedicata di questa lista.
Come ottengo il testo completo degli articoli dai risultati di Google News?
Gli elenchi di Google News mostrano solo titoli e snippet. Per arrivare al contenuto completo, ti serve uno strumento che segua il link dell'articolo ed estragga il contenuto della pagina. Lo Scraping delle sottopagine di Thunderbit lo fa in automatico dopo aver estratto la pagina elenco di Google News. Gli strumenti API come Newsdata.io offrono il testo completo nei piani premium. La maggior parte delle API SERP (SerpApi, Scrapingdog, Oxylabs) restituisce solo ciò che è visibile nella pagina elenco.
È legale fare scraping di Google News?
Estrarre dati visibili pubblicamente non viene di norma considerato accesso non autorizzato secondo la legge statunitense (in base al precedente hiQ v. LinkedIn), ma questo non vuol dire che sia sempre in linea con le policy. I termini di servizio di Google scoraggiano le query automatiche, e Google sfodera attivamente CAPTCHA e blocchi quando fiuta traffico simile a quello dei bot. Conviene attenersi ai dati pubblicamente disponibili, rispettare il copyright sul testo degli articoli e sentire un legale per i casi d'uso su scala commerciale.
Cosa manda in crisi più spesso i Google News scraper?
I soliti colpevoli sono il rilevamento delle query automatizzate (CAPTCHA ed errori 429), la deriva di localizzazione (risultati diversi per paese/lingua), le pagine di consenso e interstitial, le modifiche al markup delle card delle notizie e la normalizzazione degli URL di redirect. Il livello dati più stabile è il metadato dell'articolo (titolo, fonte, data, URL). Il meno stabile è la superficie di presentazione: clustering delle storie, miniature e organizzazione delle sezioni cambiano spesso.
Scopri di più


