Google News preia conținut din peste 50.000 de surse din întreaga lume, ceea ce îl face una dintre cele mai bogate surse de știri în timp real de pe internet. Dar există un lucru pe care nimeni nu ți-l spune de la început: Google și-a închis API-ul oficial pentru News în 2011 și nu l-a înlocuit niciodată.
Asta înseamnă că echipele de PR care urmăresc mențiunile de brand, reprezentanții de vânzări care monitorizează semnalele din industrie și analiștii care construiesc dashboard-uri de inteligență competitivă rămân blocați. Ai nevoie de date structurate despre știri — titluri, surse, date, textul articolului — dar Google descurajează activ scraping-ul automat cu CAPTCHA-uri, limitări de rată și layout-uri de pagină care se schimbă constant. Am petrecut ani construind și testând instrumente de extragere a datelor la Thunderbit și îți pot spune că diferența dintre „hai să fac rapid un scraping din Google News” și obținerea unor date fiabile, structurate, este mult mai mare decât se așteaptă majoritatea.
Acest ghid acoperă cei 10 cei mai buni Google News scraper pe care i-am găsit, de la API-uri și instrumente no-code până la planuri gratuite — cu comparații oneste de preț, analiză anti-bot și nivelul de detaliu pe câmpuri care chiar te ajută să alegi instrumentul potrivit.
Încearcă Thunderbit pentru scraping Google News
De ce Google News este greu de extras și de ce nu există un API oficial
Google a depreciat API-ul său News în 2011. De atunci, orice instrument care se numește „Google News API” este, de fapt, un wrapper terț — care extrage sau proxy-uiește rezultatele Google News în numele tău. Cea mai apropiată opțiune programatică oficială este Custom Search JSON API, care îți oferă 100 de interogări gratuite pe zi și costă 5 USD pentru 1.000 de interogări. Dar necesită configurarea unui motor de căutare personalizat și nu este un înlocuitor direct pentru Google News.
Între timp, apărarea Google împotriva scraping-ului este reală:
- Limitare de rată bazată pe IP: dacă lovești Google News prea repede, vei vedea erori 429 sau provocări CAPTCHA.
- Pagini de consimțământ și interstițiale: în funcție de locația ta, Google poate afișa ecrane de consimțământ pentru cookie-uri care rup majoritatea parsatoarelor.
- Conținut randat cu JavaScript: mare parte din Google News este încărcată dinamic, așa că cererile HTTP simple returnează HTML incomplet.
- URL-uri învelite în redirect: linkurile din Google News trec adesea prin propriul strat de redirecționare al Google înainte să ajungă la pagina editorului.
- Derivă de layout: Google schimbă frecvent modul în care sunt structurate cardurile de știri, grupurile de articole și secțiunile tematice.
În martie 2025, Google a trecut complet la pagini de publicații generate automat, ceea ce a făcut platforma și mai dinamică. Firele de discuție de pe GitHub și Stack Overflow sunt pline de dezvoltatori care împărtășesc soluții de avarie pentru paginile de consimțământ, selectorii stricați și formatele de URL care se schimbă.
Atunci de ce mai extrag oamenii date de acolo? Pentru că miliarde de căutări au loc pe Google în fiecare zi, iar 15% dintre ele sunt interogări pe care Google nu le-a mai văzut niciodată. Pentru monitorizarea brandului, analiza tendințelor, detectarea semnalelor pentru lead-uri și inteligența competitivă, Google News rămâne una dintre cele mai largi și mai flexibile surse de știri disponibile.
RSS vs. API vs. scraping no-code: cum alegi metoda potrivită
Nu toate Google News scraper-ele funcționează la fel. Înainte să alegi un instrument, ajută să înțelegi cele trei abordări principale — și când are sens fiecare.
| Abordare | Cel mai potrivit pentru | Limitări | Exemple de instrumente |
|---|---|---|---|
| Fluxuri RSS Google News | Monitorizare simplă a titlurilor, gratuit, volum redus | Fără text integral, max. ~100 rezultate, filtrare limitată | Cititoare RSS integrate, n8n |
| SERP / News API | Monitorizare scalabilă pe cuvinte cheie, metadate structurate | Cost continuu, de obicei doar titluri + fragmente | SerpApi, Scrapingdog, Newsdata.io |
| Scraping direct (fără cod) | Conținut integral al articolelor, câmpuri personalizate, cercetare punctuală | Necesită gestionarea anti-bot, mai puțin scalabil decât API-urile | Thunderbit, Octoparse, Apify |
| Scraping direct (cu cod) | Control maxim, pipeline-uri personalizate | Mentenanță ridicată, gestionare CAPTCHA, se strică des | Scrapy, BeautifulSoup + Selenium |
Majoritatea articolelor concurente acoperă doar API-uri și biblioteci Python. Dar datele de intenție ale utilizatorilor pe care le-am văzut spun altceva: o mare parte dintre cei care caută „cele mai bune Google News scraper-e” nu sunt dezvoltatori — sunt manageri PR, responsabili de operațiuni, echipe de vânzări — care au nevoie de o soluție point-and-click, nu de un proiect de programare. De aceea, această listă include extensii de browser și platforme no-code, alături de greii din zona API.
Merită menționat: fluxurile RSS Google News sunt încă gratuite și utile pentru monitorizarea simplă a titlurilor. Te poți abona la un feed pe subiect sau cuvânt-cheie și primești ~100 de rezultate cu titluri, linkuri și date de publicare. Dar dacă ai nevoie de textul integral al articolului, nume de autori, sentiment sau mai mult de o sută de rezultate, vei avea nevoie de unul dintre instrumentele de mai jos.
Cum am evaluat cele mai bune Google News scraper-e
Am aplicat aceleași criterii fiecărui instrument din listă:
- Ușurință în utilizare: fără cod vs. necesită cod vs. doar API
- Gestionarea anti-bot / CAPTCHA: esențială pentru Google
- Câmpurile de date extrase: titlu, sursă, dată, fragment, URL, text integral, autor, imagini, sentiment
- Disponibilitatea și limitele planului gratuit
- Cost standardizat per 1.000 de cereri: pentru că fiecare furnizor își formulează prețurile diferit (pe lună, pe credit, pe cerere), am standardizat la cost per 1.000 de rezultate reușite la cel mai ieftin plan plătit
- Formate de export: JSON, CSV, Google Sheets, Airtable, Notion etc.
- Scalabilitate: limite zilnice de volum, limitări de rată, concurență
- Cel mai bun caz de utilizare
Standardizarea prețurilor contează mai mult decât ai crede. Un instrument taxează per „căutare” (care returnează 10 rezultate), altul per „credit” (unde 1 credit = 1 rând), iar un al treilea per „cerere” (unde randarea JavaScript costă extra). Fără standardizare, compari mere cu urangutani.
Cele 10 cele mai bune Google News scraper-e, pe scurt
Iată tabelul principal de comparație. Mai jos intru în detalii pentru fiecare instrument, dar asta ar trebui să te ajute să restrângi rapid opțiunile.
| Instrument | Tip | Plan gratuit | ~Cost per 1K rezultate | Gestionare anti-bot | Extragere articol integral | Formate de export | Cel mai bun pentru |
|---|---|---|---|---|---|---|---|
| Thunderbit | Extensie Chrome / AI no-code | Plan gratuit (6 pagini) | ~$6–$30 per 1K rânduri (în funcție de plan) | Mod browser (sesiunea ta) + mod cloud | Da (scraping de subpagini) | Excel, CSV, Sheets, Airtable, Notion, JSON | Utilizatori non-tehnici, echipe de business |
| SerpApi | SERP API | 250 de căutări/lună | ~$5–$15 per 1K rezultate | Anti-detectare specifică SERP | Nu (titluri + fragmente) | JSON | Dezvoltatori, pipeline-uri API structurate |
| ScraperAPI | API generic de scraping | 1.000 de credite/lună + 5K trial | ~$0.10–$0.49 per 1K cereri | Rotire proxy, randare JS | Fără parser dedicat | JSON, HTML | Dezvoltatori cu buget redus, scraping generic |
| Apify | Platformă cloud de scraping | Trial 7 zile | Variază în funcție de actor/calcul | Randare JS, browser headless | Depinde de actor | JSON, CSV, Excel, API | Echipe tehnice, fluxuri predefinite |
| Bright Data | Scraper/dataset enterprise | 1K cereri trial | ~$1.30–$2.50 per 1K înregistrări | Proxy-uri, rezolvare CAPTCHA, randare în browser | Da (produsul News Scraper) | JSON, CSV | Pipeline-uri enterprise |
| Octoparse | Platformă vizuală no-code | Plan gratuit (limitat) | ~$9–$25 per 1K rânduri (amortizat) | Execuție în cloud, anti-blocare | Da (șablonul include textul corpului) | CSV, Excel, JSON, baze de date | Utilizatori care preferă fluxuri vizuale |
| ScrapingBee | API de scraping | Credite trial | Variază (pe bază de credite, JS costă mai mult) | Headless Chrome, rotire proxy, CAPTCHA | Fără parser dedicat | JSON, HTML | Dezvoltatori care au nevoie de randare JS |
| Oxylabs | API SERP / scraper | Până la 2.000 de rezultate trial | ~$1.00–$2.35 per 1K rezultate | 100M+ proxy-uri, rezolvare CAPTCHA | Nu (date SERP) | JSON | Scraping la scară mare, geotargetat |
| Scrapingdog | API SERP economic | 1.000 de credite gratuite | ~$0.10 per 1K cereri | Anti-detectare specifică SERP | Nu (titluri + fragmente) | JSON | Dezvoltatori atenți la buget |
| Newsdata.io | API dedicat pentru știri | 200 req/zi | Variază în funcție de plan | N/A (nu face scraping direct din Google) | Da (planuri premium) | JSON | Funcții NLP specifice știrilor |
Câteva lucruri sar imediat în ochi. Cel mai ieftin cost per cerere? Scrapingdog și ScraperAPI. Cea mai ușoară configurare no-code? Thunderbit și Octoparse. Fiabilitate de nivel enterprise cu geotargetare? Bright Data și Oxylabs.
Trecem la detaliile fiecăruia.
1. Thunderbit — cel mai bun Google News scraper no-code pentru utilizatori de business
Thunderbit este instrumentul pe care l-am construit la compania noastră, așa că voi fi sincer de la început. Dar voi fi și specific cu privire la ce poate și ce nu poate face, pentru că sinceritatea mi se pare mai utilă decât hype-ul.
Thunderbit este o extensie Chrome alimentată de AI, concepută pentru oameni care au nevoie de date structurate din site-uri fără să scrie cod. Pentru Google News, fluxul arată așa:
- Deschizi rezultatele de căutare Google News în Chrome.
- Dai click pe „AI Suggest Fields” — AI-ul citește pagina și detectează automat coloane precum titlu, sursă, dată, fragment și URL.
- Dai click pe „Scrape” pentru a extrage datele structurate într-un tabel.
Asta e pentru pagina de listare. Puterea reală pentru cazurile de știri vine după aceea: după ce ai extras rezultatele din Google News, poți da click pe „Scrape Subpages” pentru a vizita fiecare URL de articol și a extrage textul integral, autorul, imaginile și multe altele. Asta rezolvă direct problema „am linkurile, dar tot trebuie să ajung și să extrag conținutul real”, care apare constant pe forumuri.
Field AI Prompt îți permite să adaugi instrucțiuni AI personalizate pentru fiecare coloană. De exemplu, ai putea adăuga o coloană „Sentiment” cu un prompt de genul „Clasifică acest articol ca pozitiv, negativ sau neutru față de [brand].” Asta înseamnă că extragi date și le îmbogățești într-o singură trecere — lucru pe care niciun instrument API pur nu îl oferă.
Thunderbit suportă atât Browser Scraping (rulează în sesiunea ta Chrome, moștenind cookie-urile și starea de autentificare, ceea ce evită multe declanșatoare de detecție bot), cât și Cloud Scraping (procesează până la 50 de pagini simultan, cu infrastructură anti-bot integrată). Poți seta și scraping programat pentru monitorizare recurentă a știrilor.
Funcționalități cheie
- AI Suggest Fields detectează automat coloanele de titlu, sursă, dată, URL
- Scraping de subpagini pentru conținut integral, autor și imagini
- Field AI Prompt pentru analiză de sentiment, traducere sau etichetare personalizată
- Moduri de scraping în Cloud și Browser
- Scraping programat pentru monitorizare zilnică/săptămânală
- Export gratuit de date către Google Sheets, Airtable, Notion, Excel, CSV, JSON
Prețuri
- Plan gratuit: 6 pagini
- Trial gratuit: 10 pagini
- Planurile plătite încep de la ~9 USD/lună (pe bază de credite, 1 credit = 1 rând de ieșire)
- Cost standardizat per 1.000 de rânduri: aproximativ $6–$30, în funcție de plan
Cel mai potrivit pentru
Echipe de vânzări, profesioniști PR, manageri de operațiuni și oricine are nevoie de date structurate din Google News fără să scrie o singură linie de cod. Este deosebit de puternic atunci când ai nevoie de conținut integral al articolelor plus câmpuri îmbogățite de AI, cum ar fi sentimentul.
2. SerpApi — cel mai bun API structurat pentru Google News pentru dezvoltatori
SerpApi este alegerea potrivită dacă vrei un endpoint dedicat Google News API care returnează JSON curat și structurat. Are două endpoint-uri relevante: unul pentru news.google.com (pagina Google News) și altul pentru fila de știri tbm=nws din căutarea standard Google.
Documentația câmpurilor este neobișnuit de detaliată — primești title, source, authors, link, thumbnail, topic_token, story_token, related_topics și related_publications. Suportul pentru story-token și topic-token este cu adevărat util pentru deduplicarea articolelor grupate, o problemă pe care majoritatea instrumentelor o ignoră.
Din experiența mea, timpul de răspuns al SerpApi este rapid (de obicei sub 2 secunde), iar uptime-ul este solid. Principala limitare: este doar API, deci ai nevoie de cod sau de o integrare no-code pentru a consuma datele. Fără text integral al articolului — doar titluri, fragmente și metadate.
Funcționalități cheie
- Endpoint dedicat de căutare Google News cu JSON structurat
- Țintire pe locație și limbă
- Interogări istorice de știri prin parametrul
tbs - Suport pentru story și topic token pentru gruparea articolelor
Prețuri
- Gratuit: 250 de căutări/lună
- Developer: 75 USD/lună pentru 5.000 de căutări
- Production: 150 USD/lună pentru 15.000 de căutări
- Cost standardizat per 1.000 de rezultate: ~$5–$15 (presupunând ~10 rezultate per căutare)
Cel mai potrivit pentru
Dezvoltatori care construiesc pipeline-uri automate de monitorizare a știrilor și au nevoie de date SERP fiabile, structurate, cu acoperire bună a câmpurilor.
3. ScraperAPI — cel mai bun API generic economic pentru Google News
ScraperAPI este un API de scraping general — nu un instrument specific pentru Google News. Dar l-am inclus aici pentru că este una dintre cele mai ieftine modalități de a accesa paginile Google News la scară mare, dacă ești confortabil să scrii propriul parser.
ScraperAPI gestionează rotirea proxy-urilor, randarea JavaScript și rezolvarea CAPTCHA printr-un simplu API REST. Trimiți un URL, iar el returnează HTML-ul randat. Compromisul este că nu există un parser dedicat pentru Google News, așa că va trebui să extragi singur câmpurile (sau să îl combini cu o bibliotecă de parsare).
Unii utilizatori raportează timpi de răspuns mai lenți (7–23 secunde în benchmark-uri), iar sistemul de credite înseamnă că fiecare tip de cerere costă un număr diferit de credite. Dar pentru dezvoltatorii care știu deja cum să parseze HTML-ul din Google News, prețurile ScraperAPI sunt greu de bătut.
Funcționalități cheie
- Rotire automată a proxy-urilor și geotargetare
- Randare JavaScript
- Model pe bază de credite (100K credite în planul de bază)
- 1.000 de credite gratuite/lună + 5.000 de credite trial
Prețuri
- Gratuit: 1.000 de credite/lună
- Hobby: 49 USD/lună (100.000 de credite)
- Startup: 149 USD/lună (1.000.000 de credite)
- Cost standardizat per 1.000 de cereri: ~$0.10–$0.49, în funcție de plan
Cel mai potrivit pentru
Dezvoltatori atenți la buget, care au nevoie de un strat ieftin de proxy/randare și sunt dispuși să construiască propriul parser pentru Google News.
4. Apify — cea mai bună platformă cloud cu actori Google News preconstruiți
Apify este o platformă de scraping bazată pe cloud, cu un marketplace de „Actors” — scraper-e preconstruite pe care le poți rula fără să programezi. Există mai mulți actori Google News Scraper contribuiți de comunitate, iar platforma gestionează execuția în cloud, programarea și stocarea.
Poți începe rapid cu un actor preconstruit. Compromisul: actorii comunității variază ca nivel de calitate și mentenanță. Unii se pot strica atunci când Google își schimbă layout-ul, iar tu depinzi de autorul actorului pentru a-i repara. Infrastructura Apify este solidă, dar experiența specifică Google News depinde de actorul pe care îl alegi.
Funcționalități cheie
- Actori specifici Google News în Apify Store
- Rulare programată în cloud
- Integrări API și webhook
- Export către JSON, CSV, Excel și prin API
Prețuri
- Trial gratuit: 7 zile
- Planuri plătite de la 49 USD/lună
- Cost standardizat per 1.000 de cereri: variază în funcție de actor și consumul de calcul
Cel mai potrivit pentru
Echipe tehnice care vor fluxuri de scraping predefinite fără să construiască de la zero și care au nevoie de programare în cloud și integrări API.
5. Bright Data — cel mai bun Google News scraper de nivel enterprise
Bright Data este greul din zona enterprise. Produsul său News Scraper suportă explicit Google News și include management automat al proxy-urilor, randare completă în browser, rezolvare CAPTCHA și procesare batch până la 5.000 de URL-uri. Câmpurile includ ID, URL, titlu, autor, subiecte și altele.
Bright Data vinde și un dataset Google News pre-colectat, de la 2,50 USD per 100K înregistrări, o opțiune utilă pentru echipele care nu vor să facă scraping live.
Rețeaua de peste 72M de proxy-uri rezidențiale este ceea ce îl diferențiază în gestionarea anti-bot. Dacă extragi Google News din mai multe țări la volum mare, Bright Data absoarbe complexitatea.
Funcționalități cheie
- News Scraper cu suport pentru Google News
- 72M+ proxy-uri rezidențiale cu geotargetare
- Rezolvare CAPTCHA integrată
- Web Scraper IDE (vizual, semi-no-code)
- Opțiuni pay-as-you-go și abonament
Prețuri
- Trial gratuit: 1.000 de cereri
- Pay as you go: ~$2.50/1K înregistrări
- Scale: 499 USD/lună (384K înregistrări incluse, ~$1.30/1K suplimentar)
Cel mai potrivit pentru
Companii mari și enterprise care au nevoie de date Google News cu volum mare, fiabilitate ridicată, acoperire geografică globală și infrastructură de conformitate.
6. Octoparse — cel mai bun scraper desktop no-code pentru Google News
Octoparse oferă atât un șablon obișnuit Google News Scraper, cât și un șablon Cloud. Lista de câmpuri este neobișnuit de transparentă: keyword, source, title, publish date, URL, body text, author, abstract, images și câmpuri pentru mesajele de eroare.
Șablonul cloud publică chiar o rată de 0,1 USD per 1.000 de linii în Run Mode, ceea ce este rar la un instrument no-code. Dar costul real depinde de nivelul de abonament de care ai nevoie pentru programare în cloud și funcții anti-blocare.
Constructorul vizual de fluxuri al Octoparse este potrivit pentru utilizatorii care vor control explicit asupra pașilor de extragere fără a scrie cod. Curba de învățare este mai abruptă decât abordarea bazată pe AI a Thunderbit, dar unii utilizatori preferă finețea controlului.
Funcționalități cheie
- Șablon Google News preconstruit cu extragere detaliată a câmpurilor
- Constructor vizual point-and-click
- Execuție în cloud și local
- Scraping programat și recurent
- Export către CSV, Excel, JSON, baze de date
Prețuri
- Plan gratuit cu funcții limitate
- Planuri plătite de la 69 USD/lună
- Cost standardizat: ~$9–$25 per 1K rânduri (amortizat cu costul planului)
Cel mai potrivit pentru
Utilizatori non-tehnici care preferă un instrument desktop vizual cu control explicit, pas cu pas, asupra extragerii și au nevoie de scraping recurent din Google News.
7. ScrapingBee — cel mai bun API pentru pagini Google News intens dependente de JavaScript
ScrapingBee se specializează în randare headless browser, rotire proxy și ocolirea anti-bot. Este o alegere puternică atunci când paginile Google News necesită execuție completă de JavaScript pentru a afișa rezultatele — ceea ce devine tot mai des cazul.
API-ul este simplu: trimiți un URL și primești HTML randat sau un screenshot. ScrapingBee gestionează în fundal rotirea proxy-urilor și rezolvarea CAPTCHA. Dar, la fel ca ScraperAPI, nu există un parser dedicat pentru Google News — va trebui să extragi singur câmpurile.
Sistemul pe bază de credite înseamnă că cererile randate cu JavaScript costă mai mult decât cererile HTTP simple, așa că ține cont de asta când estimezi costurile pentru Google News.
Funcționalități cheie
- Randare Chrome headless pentru pagini bogate în JS
- Rotire automată a proxy-urilor și ocolire CAPTCHA
- Suport pentru scraping Google Search / News
- API REST simplu cu răspuns JSON/HTML
Prețuri
- Planuri de la 49 USD/lună
- Pe bază de credite (randarea JS costă mai mult per cerere)
- Cost standardizat per 1.000 de cereri: variază în funcție de nevoile de randare
Cel mai potrivit pentru
Dezvoltatori care au nevoie de randare JavaScript fiabilă și gestionare anti-bot pentru paginile Google News printr-un API simplu.
8. Oxylabs — cel mai bun Google News scraper pentru rezultate geotargetate
Oxylabs are un API dedicat Google News Scraper în cadrul stivei sale SERP, susținut de un pool de peste 100M proxy-uri în 195 de țări. Promisiunea: fiabilitate de nivel enterprise cu rezultate specifice geografic.
Oxylabs suportă output JSON structurat, moduri de scraping în timp real și batch, și logică de parsare personalizată cu XPath și selectorii CSS. Prețurile pentru Google sunt clare: ~2,00 USD/1K rezultate pe planul Micro, coborând la ~0,90 USD/1K pe nivelurile superioare.
Trial-ul gratuit îți oferă până la 2.000 de rezultate, suficient cât să testezi dacă nivelul datelor îți satisface nevoile.
Funcționalități cheie
- SERP Scraper API cu suport pentru Google News
- 100M+ proxy-uri în 195 de țări
- Livrare JSON structurată
- Moduri de scraping în timp real și batch
Prețuri
- Trial gratuit: până la 2.000 de rezultate
- Micro: ~2,00 USD/1K rezultate Google (~2,35 USD/1K cu randare JS)
- Niveluri superioare: ~0,90 USD/1K
- Planuri enterprise personalizate disponibile
Cel mai potrivit pentru
Echipe enterprise și mid-market care au nevoie, la scară, de rezultate Google News geotargetate, cu fiabilitate ridicată.
9. Scrapingdog — cel mai bun API Google News prietenos cu bugetul
Scrapingdog se poziționează ca o alternativă rentabilă la SerpApi, cu un endpoint dedicat Google News API. Răspunsul JSON structurat include titlu, sursă, dată, fragment și link.
Prețurile sunt cu adevărat agresive: unele planuri oferă 400K cereri pentru 40 USD, ceea ce înseamnă aproximativ 0,10 USD per 1.000 de cereri. Timpul de răspuns este de obicei în jur de 2 secunde, iar pentru testare primești 1.000 de credite gratuite.
Compromisul: Scrapingdog este o companie mai mică, cu mai puțină documentație și mai puține integrări decât jucătorii mari. Dar pentru startup-uri și constructori atenți la buget, economia este convingătoare.
Funcționalități cheie
- Endpoint dedicat Google News Scraper API
- Răspuns JSON structurat (titlu, sursă, dată, fragment, link)
- Date istorice de știri prin parametrul
tbs - 1.000 de credite gratuite pentru testare
Prețuri
- Gratuit: 1.000 de credite
- Planuri plătite de la 40 USD/lună
- Cost standardizat per 1.000 de cereri: ~0,10 USD
Cel mai potrivit pentru
Dezvoltatori și startup-uri atenți la buget, care au nevoie de date Google News la volum mare, la cel mai mic cost per cerere.
10. Newsdata.io — cel mai bun API dedicat pentru știri (dincolo de Google News)
Newsdata.io este un API creat special pentru date despre știri, care agregă din peste 50.000 de surse la nivel global. Nu este un Google News scraper propriu-zis — nu extrage direct din Google News. În schimb, agregă independent din aceleași surse de publicare (și din altele suplimentare), returnând JSON structurat cu căutare de știri în timp real și istoric.
Planurile premium includ extragerea textului integral al articolelor, analiză de sentiment și filtrare pe categorii — funcții pe care majoritatea instrumentelor de scraping SERP nu le oferă nativ. Planul gratuit îți dă 200 de cereri/zi, ceea ce este generos pentru testare.
Dacă obiectivul tău este „să obțin date despre știri pe un subiect”, nu neapărat „să extrag Google News”, atunci Newsdata.io poate fi o alegere mai bună decât orice instrument SERP din această listă.
Funcționalități cheie
- API de căutare de știri în timp real și istoric
- Extragere text integral al articolului (premium)
- Analiză de sentiment (premium)
- Filtrare pe categorie, limbă și țară
- Plan gratuit cu 200 de cereri/zi
Prețuri
- Gratuit: 200 de cereri/zi
- Planuri plătite de la 99,99 USD/lună
- Cost standardizat per 1.000 de cereri: variază în funcție de plan
Cel mai potrivit pentru
Echipe care au nevoie de o sursă dedicată de date despre știri, cu funcții NLP integrate (sentiment, categorizare) și nu au nevoie neapărat să extragă Google News în sine.
Google News scraper-e comparate: anti-bot, câmpuri de date și prețuri
Trei dimensiuni de comparație contează mai mult decât orice altceva când alegi un Google News scraper. Nu am găsit alt ghid care să le acopere pe toate trei sistematic.
Cum gestionează fiecare instrument protecțiile anti-bot ale Google
Gestionarea anti-bot este preocuparea numărul 1 pentru oricine extrage date din Google News. Iată cum abordează fiecare instrument problema:
| Strategie | Instrumente care o folosesc |
|---|---|
| Rotire proxy integrată | Bright Data, ScrapingBee, Oxylabs, ScraperAPI |
| Rezolvare CAPTCHA inclusă | Bright Data, ScrapingBee, Oxylabs |
| Randare JS / browser headless | Apify, Octoparse, ScrapingBee |
| Bazat pe browser (folosește sesiunea ta) | Thunderbit (mod Browser Scraping) |
| Anti-detectare specifică SERP | SerpApi, Scrapingdog |
Modul Browser Scraping al Thunderbit merită explicat mai detaliat. Pentru că rulează în sesiunea ta reală de Chrome, moștenește cookie-urile și starea de autentificare. Asta înseamnă că evită multe dintre declanșatoarele de detecție bot pe care le întâlnesc scraper-ele headless — pagini de consimțământ, provocări CAPTCHA și verificări de fingerprinting. Pentru nevoi de volum mare, Cloud Scraping-ul Thunderbit procesează 50 de pagini odată cu propria infrastructură anti-bot.
Ce câmpuri de date returnează fiecare Google News scraper?
Aceasta este comparația pe care nimeni altcineva nu o publică — și este cea mai importantă pentru alegerea instrumentului. Unele instrumente îți dau doar titluri și linkuri. Altele pot extrage text integral, numele autorilor și chiar sentiment.
| Instrument | Titlu | Sursă | Dată | Fragment | URL articol | Text integral | Autor | Imagini | Sentiment |
|---|---|---|---|---|---|---|---|---|---|
| Thunderbit | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ (prin subpagini) | ✅ (prin AI) | ✅ | ✅ (prin Field AI Prompt) |
| SerpApi | ✅ | ✅ | ✅ | ✅ | ✅ | ❌ | ✅ | ✅ | ❌ |
| ScraperAPI | ✅ (parsare personalizată) | ✅ (parsare personalizată) | ✅ (parsare personalizată) | ✅ (parsare personalizată) | ✅ (parsare personalizată) | ❌ | ❌ | ❌ | ❌ |
| Apify | ✅ | ✅ | ✅ | ✅ | ✅ | Depinde de actor | Depinde de actor | ✅ | ❌ |
| Bright Data | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ (News Scraper) | ✅ | ✅ | ❌ |
| Octoparse | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ (șablon) | ✅ | ✅ | ❌ |
| ScrapingBee | ✅ (parsare personalizată) | ✅ (parsare personalizată) | ✅ (parsare personalizată) | ✅ (parsare personalizată) | ✅ (parsare personalizată) | ❌ | ❌ | ❌ | ❌ |
| Oxylabs | ✅ | ✅ | ✅ | ✅ | ✅ | ❌ | ❌ | ✅ | ❌ |
| Scrapingdog | ✅ | ✅ | ✅ | ✅ | ✅ | ❌ | ❌ | ❌ | ❌ |
| Newsdata.io | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ (premium) | ✅ | ✅ | ✅ (premium) |
Ce iese în evidență aici este faptul că Thunderbit poate extrage textul integral al articolului prin Subpage Scraping și poate adăuga câmpuri îmbogățite cu AI, precum sentimentul, în aceeași trecere. Newsdata.io oferă și el sentiment și text integral, dar printr-un API dedicat pentru știri, nu prin scraping din Google News. Majoritatea API-urilor SERP returnează doar ce este vizibil pe pagina de listare Google News — titluri, fragmente și linkuri.
Cost standardizat per 1.000 de rezultate
Acesta este tabelul pe care mi-aș fi dorit să-l am când evaluam instrumente și nu-l găseam nicăieri. Fiecare furnizor își exprimă prețurile diferit, așa că am standardizat totul la cost per 1.000 de rezultate reușite, la cel mai ieftin plan plătit.
| Instrument | Plan gratuit | Cel mai ieftin plan plătit | ~Cost per 1K rezultate | Observații |
|---|---|---|---|---|
| Thunderbit | 6 pagini gratuite / trial: 10 pagini | Începe de la ~9 USD/lună (pe bază de credite) | ~$6–$30 | 1 credit = 1 rând; extragere AI inclusă |
| SerpApi | 250 de căutări/lună | 75 USD/lună (5.000 de căutări) | ~$15 | JSON structurat, endpoint Google News |
| ScraperAPI | 1.000 de credite/lună | 49 USD/lună (100K credite) | ~$0.49 | Fără parser dedicat pentru Google News |
| Apify | Trial 7 zile | 49 USD/lună | Variază | Depinde de actor și de calcul |
| Bright Data | 1K cereri trial | Pay-as-you-go | ~$1.30–$2.50 | Nivel enterprise, opțiune de dataset disponibilă |
| Octoparse | Plan gratuit (limitat) | $69/lună | ~$9–$25 | Șablon cloud: 0,1 USD/1K linii (bază) |
| ScrapingBee | Credite trial | 49 USD/lună | Variază (JS costă mai mult) | Pe bază de credite, fără parser dedicat |
| Oxylabs | Până la 2.000 de rezultate | Plan Micro | ~$1.00–$2.35 | Geotargetare, JSON structurat |
| Scrapingdog | 1.000 de credite | 40 USD/lună | ~$0.10 | Alegere economică, endpoint dedicat News |
| Newsdata.io | 200 req/zi | 99,99 USD/lună | Variază în funcție de plan | Nu extrage direct din Google; funcții NLP |
Câteva concluzii. Scrapingdog este, de departe, cea mai ieftină opțiune per cerere, dar returnează doar date la nivel SERP (fără text integral). Bright Data și Oxylabs sunt la mijloc ca preț, dar oferă cea mai puternică infrastructură anti-bot. Thunderbit este mai scump per rând decât cele mai ieftine API-uri, însă este singurul instrument care îți oferă extragere completă a articolului plus îmbogățire AI fără să scrii cod.
Ce Google News scraper ar trebui să alegi?
Recomandarea mea, în funcție de scenariu:
- Ai nevoie doar de titluri pentru monitorizare, cu buget mic? → Scrapingdog sau planul gratuit Newsdata.io
- Utilizator non-tehnic care are nevoie de text integral + îmbogățire? → Thunderbit
- Dezvoltator care construiește un pipeline structurat de știri? → SerpApi (cea mai bună acoperire a câmpurilor) sau Scrapingdog (cel mai bun preț)
- Enterprise, volum mare, geotargetare? → Bright Data sau Oxylabs
- Vrei un flux vizual, desktop? → Octoparse
- Ai nevoie de date despre știri dincolo de Google News, cu funcții NLP? → Newsdata.io
- Ai nevoie de cel mai ieftin strat generic de proxy/randare? → ScraperAPI
Instrumentul potrivit depinde de trei factori: nivelul tău tehnic, volumul necesar și dacă ai nevoie doar de titluri sau de conținut integral al articolelor. Dacă nu ești sigur, începe cu un plan gratuit — majoritatea acestor instrumente oferă unul — și vezi cât de bine rezistă calitatea datelor pentru cazul tău specific.
Dacă vrei să încerci cea mai rapidă cale no-code, planul gratuit al Thunderbit free tier îți permite să extragi rezultatele Google News în câteva clickuri și să le exporți direct în Google Sheets sau Airtable. Pentru un ghid pas cu pas, aruncă o privire pe canalul nostru de YouTube sau pe șablonul de news scraper.
Și fie ca titlurile tale să fie mereu structurate, CAPTCHA-urile puține și exporturile curate.
Încearcă Thunderbit pentru scraping Google News Get Started Free
Întrebări frecvente
Are Google un API oficial pentru News?
Nu. Google a depreciat API-ul său News în 2011 și nu l-a înlocuit niciodată. Cea mai apropiată opțiune oficială este Custom Search JSON API, care oferă 100 de interogări gratuite pe zi și costă 5 USD pentru 1.000 de interogări, dar necesită un motor de căutare personalizat configurat și nu este un produs dedicat Google News. Orice instrument care astăzi se numește „Google News API” este un serviciu terț.
Pot folosi fluxurile RSS Google News în locul unui scraper?
Da, pentru cazuri simple. Fluxurile RSS Google News oferă gratuit titluri și linkuri, dar sunt limitate la aproximativ 100 de rezultate, nu oferă text integral al articolului și au opțiuni minime de filtrare. Dacă ai nevoie de date mai bogate — conținut integral, nume de autori, analiză de sentiment sau mai mult de 100 de rezultate — vei avea nevoie de un scraper dedicat sau de un API din această listă.
Cum obțin textul integral al articolului din rezultatele Google News?
Listările Google News afișează doar titluri și fragmente. Pentru a obține conținutul integral al articolului, ai nevoie de un instrument care urmărește linkul articolului și extrage conținutul paginii. Subpage Scraping de la Thunderbit face asta automat după ce extrage pagina de listare Google News. Instrumentele API precum Newsdata.io oferă text integral în planurile premium. Majoritatea API-urilor SERP (SerpApi, Scrapingdog, Oxylabs) returnează doar ce este vizibil pe pagina de listare.
Este legal să extragi date din Google News?
Extragerea datelor vizibile public este, în general, considerată neacoperită de acces neautorizat în dreptul SUA (conform precedentului hiQ v. LinkedIn), dar asta nu înseamnă că este automat permisă din perspectiva politicilor. Termenii de utilizare ai Google descurajează interogările automate, iar Google trimite activ CAPTCHA-uri și blocări când detectează trafic asemănător unui bot. Utilizatorii ar trebui să rămână la datele disponibile public, să respecte drepturile de autor asupra textului articolelor și să consulte consiliere juridică pentru cazuri de utilizare la scară comercială.
Ce strică cel mai des Google News scraper-ele?
De obicei, vinovații sunt detectarea interogărilor automate (CAPTCHA-uri și erori 429), variațiile de localizare (rezultate diferite în funcție de țară/limbă), paginile de consimțământ și interstițiale, schimbările de markup în layout-ul cardurilor de știri și normalizarea URL-urilor de redirect. Cel mai stabil strat de date este metadatele articolului (titlu, sursă, dată, URL). Cel mai instabil este stratul de prezentare — gruparea articolelor, miniaturile și organizarea secțiunilor se schimbă frecvent.
Află mai multe


