Voici un détail que les fournisseurs d’outils passent volontiers sous silence : Google a fermé son API News officielle en 2011 et ne l’a jamais remplacée. Pourtant, Google News agrège plus de 50 000 sources dans le monde, ce qui en fait l’une des surfaces d’actualité en temps réel les plus riches du web.
Résultat de cette contradiction : les équipes RP qui suivent les mentions de marque, les commerciaux qui guettent les signaux sectoriels et les analystes qui bâtissent des tableaux de bord de veille concurrentielle se retrouvent coincés. Il leur faut des données d’actualité structurées — titres, sources, dates, texte des articles — alors que Google décourage activement le scraping automatisé à coups de CAPTCHA, de limitations de débit et de mises en page qui changent en permanence. J’ai passé des années à concevoir et tester des outils d’extraction de données chez Thunderbit, et croyez-moi : l’écart entre « je vais juste scraper Google News vite fait » et l’obtention de données fiables et structurées est bien plus large qu’on ne l’imagine.
Ce guide passe au crible les 10 meilleurs extracteurs Google News que j’ai trouvés — API, outils sans code et offres gratuites confondus — avec des comparaisons de prix honnêtes, un état des lieux de la résistance aux anti-bots et le niveau de détail qui aide vraiment à choisir le bon outil.
Essayez Thunderbit pour le scraping de Google News
Pourquoi Google News est difficile à scraper (et pourquoi il n’existe pas d’API officielle)
Google a déprécié son API News en 2011. Depuis, tout outil qui se présente comme une « Google News API » n’est qu’une couche tierce : il scrape ou relaie les résultats Google News à votre place. L’option programmatique officielle la plus proche reste la Custom Search JSON API, avec ses 100 requêtes gratuites par jour et sa facturation à 5 $ par 1 000 requêtes (environ 4,60 € par 1 000 requêtes). Mais elle impose de configurer un moteur de recherche personnalisé et ne remplace pas Google News à l’identique.
En parallèle, les défenses anti-scraping de Google sont bien réelles :
- Limitation de débit par adresse IP : interrogez Google News trop vite, et vous récolterez des erreurs 429 ou des CAPTCHA.
- Pages de consentement et interstitielles : selon votre localisation, Google peut afficher des écrans de consentement aux cookies qui mettent la plupart des parseurs en échec.
- Contenu rendu en JavaScript : une bonne part de Google News se charge dynamiquement, donc de simples requêtes HTTP renvoient un HTML incomplet.
- URL encapsulées par des redirections : les liens Google News transitent souvent par la couche de redirection de Google avant d’atteindre la page de l’éditeur.
- Dérive de mise en page : Google remanie régulièrement la structure des cartes d’actualité, des clusters d’articles et des sections thématiques.
En mars 2025, Google est aussi passé entièrement aux pages de publication générées automatiquement, rendant la plateforme plus dynamique encore. Les fils de discussion sur GitHub et Stack Overflow débordent de développeurs qui s’échangent des contournements pour les pages de consentement, les sélecteurs cassés et les formats d’URL qui évoluent.
Alors, pourquoi tant de gens continuent-ils à le scraper ? Parce que des milliards de recherches sont effectuées sur Google chaque jour, et 15 % de ces requêtes sont des recherches que Google n’avait jamais vues auparavant. Pour la veille de marque, l’analyse des tendances, la détection de signaux commerciaux et l’intelligence concurrentielle, Google News demeure l’une des surfaces d’actualité les plus vastes et les plus souples côté requêtes.
RSS vs API vs scraping sans code : choisir la bonne méthode
Tous les extracteurs Google News ne fonctionnent pas de la même façon. Avant de choisir un outil, mieux vaut comprendre les trois grandes approches — et savoir dans quel cas chacune se justifie.
| Approche | Idéal pour | Limites | Outils exemples |
|---|---|---|---|
| Flux RSS Google News | Suivi simple des titres, gratuit, faible volume | Pas de texte intégral, max ~100 résultats, filtrage limité | Lecteurs RSS intégrés, n8n |
| API SERP / News | Suivi de mots-clés à grande échelle, métadonnées structurées | Coût récurrent, titres + extraits seulement (le plus souvent) | SerpApi, Scrapingdog, Newsdata.io |
| Scraping direct (sans code) | Texte complet des articles, champs de données personnalisés, recherches ponctuelles | Nécessite une gestion anti-bot, moins scalable que les API | Thunderbit, Octoparse, Apify |
| Scraping direct (code) | Contrôle maximal, pipelines personnalisés | Maintenance élevée, gestion des CAPTCHA, casse souvent | Scrapy, BeautifulSoup + Selenium |
La plupart des articles concurrents ne couvrent que les API et les bibliothèques Python. Or les données d’intention utilisateur que j’ai observées racontent une autre histoire : une grande partie des personnes qui recherchent les « meilleurs extracteurs Google News » ne sont pas des développeurs — responsables RP, directeurs des opérations, équipes commerciales — et elles veulent une solution en quelques clics, pas un projet de code. D’où la présence, dans cette liste, d’extensions de navigateur et de plateformes sans code, aux côtés des poids lourds de l’API.
À noter : les flux RSS Google News restent gratuits et utiles pour un suivi léger des titres. Vous pouvez vous abonner à un flux par sujet ou par mot-clé et récupérer environ 100 résultats avec titres, liens et dates de publication. En revanche, dès que vous avez besoin du texte intégral, du nom des auteurs, du sentiment ou de plus d’une centaine de résultats, il vous faudra l’un des outils ci-dessous.
Comment nous avons évalué les meilleurs extracteurs Google News
J’ai soumis tous les outils de cette liste aux mêmes critères :
- Facilité d’utilisation : sans code vs code requis vs API uniquement
- Gestion anti-bot / CAPTCHA : essentiel pour Google
- Champs de données extraits : titre, source, date, extrait, URL, texte complet, auteur, images, sentiment
- Disponibilité et limites du niveau gratuit
- Coût normalisé pour 1 000 requêtes : comme chaque fournisseur affiche ses prix différemment (par mois, par crédit, par requête), j’ai tout ramené à un coût pour 1 000 résultats réussis, au niveau payant le moins cher
- Formats d’export : JSON, CSV, Google Sheets, Airtable, Notion, etc.
- Scalabilité : limites quotidiennes, rate limits, concurrence
- Cas d’usage idéal
La normalisation des prix compte bien plus qu’on ne le croit. Un outil facture par « recherche » (qui renvoie 10 résultats), un autre par « crédit » (où 1 crédit = 1 ligne), un troisième par « requête » (où le rendu JavaScript coûte plus cher). Sans cette mise à plat, vous comparez des grandeurs qui n’ont rien à voir entre elles.
Les 10 meilleurs extracteurs Google News en un coup d’œil
Voici le tableau comparatif principal. Je détaille chaque outil plus bas, mais celui-ci devrait déjà vous aider à resserrer rapidement le champ.
| Outil | Type | Niveau gratuit | Coût approx. par 1 000 résultats | Gestion anti-bot | Extraction d’article complet | Formats d’export | Idéal pour |
|---|---|---|---|---|---|---|---|
| Thunderbit | Extension Chrome / IA sans code | Niveau gratuit (6 pages) | ~6 $ à 30 $ par 1 000 lignes (selon le plan) | Mode navigateur (votre session) + mode cloud | Oui (scraping de sous-pages) | Excel, CSV, Sheets, Airtable, Notion, JSON | Utilisateurs non techniques, équipes métier |
| SerpApi | API SERP | 250 recherches/mois | ~5 $ à 15 $ par 1 000 résultats | Anti-détection spécifique aux SERP | Non (titres + extraits) | JSON | Développeurs, pipelines API structurés |
| ScraperAPI | API de scraping générique | 1 000 crédits/mois + essai 5K | ~0,10 $ à 0,49 $ par 1 000 requêtes | Rotation de proxies, rendu JS | Pas de parseur dédié | JSON, HTML | Développeurs au budget serré, scraping générique |
| Apify | Plateforme de scraping cloud | Essai de 7 jours | Varie selon l’actor/le calcul | Rendu JS, navigateur sans interface | Dépend de l’actor | JSON, CSV, Excel, API | Équipes techniques, workflows prêts à l’emploi |
| Bright Data | Extracteur / dataset entreprise | 1K requêtes d’essai | ~1,30 $ à 2,50 $ par 1 000 enregistrements | Proxies, résolution CAPTCHA, rendu navigateur | Oui (produit News Scraper) | JSON, CSV | Pipelines d’entreprise |
| Octoparse | Plateforme visuelle sans code | Plan gratuit (limité) | ~9 $ à 25 $ par 1 000 lignes (amorti) | Exécution cloud, anti-blocage | Oui (le modèle inclut le texte du corps) | CSV, Excel, JSON, bases de données | Créateurs de workflows visuels |
| ScrapingBee | API de scraping | Crédits d’essai | Variable (basé sur les crédits, le JS coûte plus cher) | Chrome headless, rotation de proxies, CAPTCHA | Pas de parseur dédié | JSON, HTML | Développeurs ayant besoin du rendu JS |
| Oxylabs | API SERP / scraper | Jusqu’à 2 000 résultats en essai | ~1,00 $ à 2,35 $ par 1 000 résultats | Plus de 100 M de proxies, résolution CAPTCHA | Non (données SERP) | JSON | Scraping à grande échelle, ciblage géographique |
| Scrapingdog | API SERP à petit budget | 1 000 crédits gratuits | ~0,10 $ par 1 000 requêtes | Anti-détection spécifique aux SERP | Non (titres + extraits) | JSON | Développeurs soucieux du budget |
| Newsdata.io | API d’actualité dédiée | 200 requêtes/jour | Variable selon le plan | N/A (ne scrape pas Google directement) | Oui (plans premium) | JSON | Fonctions NLP dédiées à l’actualité |
Quelques constats sautent aux yeux. Le coût le plus bas par requête ? Scrapingdog et ScraperAPI. La configuration sans code la plus simple ? Thunderbit et Octoparse. La fiabilité de niveau entreprise avec ciblage géographique ? Bright Data et Oxylabs.
Entrons dans le détail.
1. Thunderbit — Le meilleur extracteur Google News sans code pour les équipes métier
Thunderbit est l’outil que nous avons développé en interne, alors autant jouer la transparence. Mais je vais aussi être précis sur ce qu’il sait faire et ce qu’il ne sait pas, parce que l’honnêteté vaut toujours mieux que le tapage.
Thunderbit est une extension Chrome propulsée par l’IA, conçue pour celles et ceux qui ont besoin de données structurées à partir de sites web sans écrire la moindre ligne de code. Sur Google News, le déroulé ressemble à ceci :
- Ouvrez les résultats Google News dans Chrome.
- Cliquez sur « AI Suggest Fields » — l’IA lit la page et détecte automatiquement les colonnes : titre, source, date, extrait, URL.
- Cliquez sur « Scrape » pour récupérer les données structurées dans un tableau.
Voilà pour la page de résultats. La vraie puissance, sur les cas d’usage liés à l’actualité, arrive ensuite : une fois les résultats Google News extraits, cliquez sur « Scrape Subpages » pour visiter chaque URL d’article et en tirer le texte complet, l’auteur, les images, et plus encore. Cela règle directement le problème « j’ai les liens, mais il faut encore crawler et extraire le contenu réel », qui revient sans cesse sur les forums.
Field AI Prompt vous permet d’ajouter des instructions IA personnalisées colonne par colonne. Vous pourriez par exemple ajouter une colonne « Sentiment » avec une consigne du type : « Classez cet article comme positif, négatif ou neutre vis-à-vis de [marque]. » Vous extrayez donc des données et vous les enrichissez en une seule passe — ce qu’aucun outil purement API ne propose.
Thunderbit prend en charge à la fois le scraping navigateur (dans votre session Chrome, en héritant de vos cookies et de votre état de connexion, ce qui désamorce bien des déclencheurs de détection de bot) et le scraping cloud (jusqu’à 50 pages à la fois, avec une infrastructure anti-bot intégrée). Vous pouvez aussi mettre en place un scraping programmé pour un suivi récurrent de l’actualité.
Fonctionnalités clés
- AI Suggest Fields détecte automatiquement les colonnes titre, source, date, URL
- Scraping de sous-pages pour le contenu complet de l’article, l’auteur et les images
- Field AI Prompt pour l’analyse de sentiment, la traduction ou un étiquetage personnalisé
- Modes de scraping cloud et navigateur
- Scraping programmé pour un suivi quotidien/hebdomadaire
- Export gratuit vers Google Sheets, Airtable, Notion, Excel, CSV, JSON
Tarifs
- Niveau gratuit : 6 pages
- Essai gratuit : 10 pages
- Les formules payantes démarrent à environ 9 $/mois (environ 8 €/mois, basées sur les crédits, 1 crédit = 1 ligne de sortie)
- Coût normalisé pour 1 000 lignes : environ 6 $ à 30 $ (environ 6 à 28 €) selon la formule
Idéal pour
Les équipes commerciales, les professionnels des RP, les responsables opérations et quiconque a besoin de données Google News structurées sans écrire une seule ligne de code. Particulièrement fort lorsque vous voulez le texte complet des articles et des champs enrichis par l’IA, comme le sentiment.
2. SerpApi — La meilleure API Google News structurée pour les développeurs
SerpApi est l’outil de référence si vous cherchez un endpoint API Google News dédié qui renvoie un JSON propre et structuré. Il offre deux endpoints pertinents : l’un pour news.google.com (la page Google News) et l’autre pour l’onglet actualités tbm=nws dans Google Search standard.
La documentation des champs est particulièrement fouillée : vous obtenez title, source, authors, link, thumbnail, topic_token, story_token, related_topics et related_publications. La prise en charge des story_token et topic_token est vraiment précieuse pour dédupliquer les articles regroupés, un irritant que beaucoup d’outils laissent de côté.
D’expérience, le temps de réponse de SerpApi est rapide (généralement sous 2 secondes) et la disponibilité tient bon. La principale limite : c’est une solution API uniquement, il faut donc du code ou une intégration sans code pour exploiter les données. Pas de texte d’article complet — seulement titres, extraits et métadonnées.
Fonctionnalités clés
- Endpoint de recherche Google News dédié avec JSON structuré
- Ciblage géographique et linguistique
- Requêtes d’actualités historiques via le paramètre
tbs - Prise en charge des tokens d’histoire et de sujet pour le clustering
Tarifs
- Gratuit : 250 recherches/mois
- Developer : 75 $/mois (environ 69 €/mois) pour 5 000 recherches
- Production : 150 $/mois (environ 138 €/mois) pour 15 000 recherches
- Coût normalisé pour 1 000 résultats : ~5 $ à 15 $ (environ 5 à 14 €), en tablant sur ~10 résultats par recherche
Idéal pour
Les développeurs qui construisent des pipelines automatisés de veille d’actualité et qui ont besoin de données SERP fiables, structurées et riches en champs.
3. ScraperAPI — La meilleure API générique à petit budget pour Google News
ScraperAPI est une API de scraping généraliste — pas un outil spécifique à Google News. Je l’inclus quand même ici, car c’est l’une des façons les moins chères d’interroger Google News à grande échelle, à condition d’être à l’aise avec l’écriture de votre propre parseur.
ScraperAPI gère la rotation des proxies, le rendu JavaScript et la résolution des CAPTCHA via une simple API REST. Vous envoyez une URL, elle renvoie le HTML rendu. Le hic : pas de parseur Google News dédié, vous devez extraire les champs vous-même (ou l’associer à une bibliothèque de parsing).
Certains utilisateurs signalent des temps de réponse plus lents (7 à 23 secondes dans certains benchmarks), et le système de crédits fait que chaque type de requête coûte un nombre différent de crédits. Mais pour les développeurs qui savent déjà analyser le HTML de Google News, le tarif de ScraperAPI est difficile à battre.
Fonctionnalités clés
- Rotation automatique des proxies et ciblage géographique
- Rendu JavaScript
- Modèle basé sur les crédits (100K crédits sur le plan de base)
- 1 000 crédits gratuits par mois + 5 000 crédits d’essai
Tarifs
- Gratuit : 1 000 crédits/mois
- Hobby : 49 $/mois (environ 45 €/mois) pour 100 000 crédits
- Startup : 149 $/mois (environ 137 €/mois) pour 1 000 000 crédits
- Coût normalisé pour 1 000 requêtes : ~0,10 $ à 0,49 $ (environ 0,09 à 0,45 €) selon le plan
Idéal pour
Les développeurs attentifs au budget qui ont besoin d’une couche proxy/rendu bon marché et qui sont prêts à bâtir leur propre parseur Google News.
4. Apify — La meilleure plateforme cloud avec des actors Google News prêts à l’emploi
Apify est une plateforme de scraping cloud bâtie autour d’une place de marché d’« Actors » — des scrapers prêts à l’emploi que vous lancez sans coder. Plusieurs actors Google News Scraper fournis par la communauté sont disponibles, et la plateforme prend en charge l’exécution cloud, la planification et le stockage.
Vous démarrez vite avec un actor préconstruit. La contrepartie : la qualité et la maintenance des actors communautaires varient. Certains peuvent casser quand Google modifie sa mise en page, et vous dépendez alors de l’auteur de l’actor pour les réparer. L’infrastructure d’Apify, elle, est solide, mais l’expérience propre à Google News dépend de l’actor choisi.
Fonctionnalités clés
- Actors dédiés à Google News dans l’Apify Store
- Exécutions planifiées dans le cloud
- Intégrations API et webhook
- Export vers JSON, CSV, Excel et via API
Tarifs
- Essai gratuit : 7 jours
- Plans payants à partir de 49 $/mois (environ 45 €/mois)
- Coût normalisé pour 1 000 requêtes : variable selon l’actor et l’utilisation de calcul
Idéal pour
Les équipes techniques qui veulent des workflows de scraping préconçus sans repartir de zéro, et qui ont besoin de planification cloud et d’intégrations API.
5. Bright Data — Le meilleur extracteur Google News de niveau entreprise
Bright Data est le poids lourd de l’entreprise. Son produit News Scraper prend explicitement en charge Google News et inclut la gestion automatique des proxies, le rendu navigateur complet, la résolution de CAPTCHA et le traitement par lots jusqu’à 5 000 URL. Les champs comprennent l’ID, l’URL, le titre, l’auteur, les sujets, et plus encore.
Bright Data vend aussi un jeu de données Google News précollecté à partir de 2,50 $ pour 100 000 enregistrements (environ 2,30 € pour 100 000), une option pratique pour les équipes qui ne veulent pas scraper en direct.
Son réseau de plus de 72 millions de proxies résidentiels est ce qui le distingue côté gestion anti-bot. Si vous scrapez Google News dans plusieurs pays à haut volume, Bright Data absorbe la complexité.
Fonctionnalités clés
- News Scraper avec prise en charge de Google News
- Plus de 72 millions de proxies résidentiels avec ciblage géographique
- Résolution de CAPTCHA intégrée
- Web Scraper IDE (visuel, semi-sans code)
- Options à l’usage et par abonnement
Tarifs
- Essai gratuit : 1 000 requêtes
- Paiement à l’usage : ~2,50 $/1K enregistrements (environ 2,30 €/1K)
- Scale : 499 $/mois (environ 459 €/mois ; 384K enregistrements inclus, ~1,30 $/1K supplémentaire, soit environ 1,20 €/1K)
Idéal pour
Les grandes entreprises et organisations qui ont besoin de données Google News à haut volume, très fiables, avec une couverture géographique mondiale et une infrastructure de conformité.
6. Octoparse — Le meilleur scraper sans code sur ordinateur pour Google News
Octoparse propose à la fois un modèle Google News Scraper classique et un modèle Cloud. La liste des champs est remarquablement transparente : mot-clé, source, titre, date de publication, URL, texte du corps, auteur, résumé, images et message d’erreur.
Le modèle cloud affiche même un tarif de 0,1 $ pour 1 000 lignes (environ 0,09 € pour 1 000) en Run Mode, ce qui est rare pour un outil sans code. Mais le coût réel dépend du niveau d’abonnement nécessaire à la planification cloud et aux fonctions anti-blocage.
Le générateur de workflows visuels d’Octoparse convient bien aux utilisateurs qui veulent un contrôle explicite des étapes d’extraction sans écrire de code. La courbe d’apprentissage est plus raide que l’approche pilotée par l’IA de Thunderbit, mais certains préfèrent ce niveau de granularité.
Fonctionnalités clés
- Modèle Google News préconfiguré avec extraction détaillée des champs
- Générateur de workflow visuel en quelques clics
- Exécution locale et dans le cloud
- Scraping programmé et récurrent
- Export vers CSV, Excel, JSON, bases de données
Tarifs
- Plan gratuit avec fonctionnalités limitées
- Plans payants à partir de 69 $/mois (environ 64 €/mois)
- Coût normalisé : ~9 $ à 25 $ par 1 000 lignes (environ 8 à 23 €, amorti avec le coût du plan)
Idéal pour
Les utilisateurs non techniques qui préfèrent un outil visuel de bureau avec un contrôle explicite, étape par étape, de l’extraction, et qui ont besoin d’un scraping Google News récurrent.
7. ScrapingBee — La meilleure API pour gérer les pages Google News très dépendantes du JavaScript
ScrapingBee se spécialise dans le rendu par navigateur headless, la rotation de proxies et le contournement des anti-bots. C’est un excellent choix lorsque les pages Google News exigent l’exécution complète de JavaScript pour afficher les résultats — un cas de plus en plus fréquent.
L’API est simple : envoyez une URL, récupérez du HTML rendu ou une capture d’écran. ScrapingBee gère la rotation de proxies et la résolution des CAPTCHA en coulisses. Mais comme ScraperAPI, il n’offre pas de parseur Google News dédié : à vous d’extraire les champs.
Le système de crédits fait que les requêtes rendues en JavaScript coûtent plus cher que les requêtes HTTP simples — gardez-le en tête au moment d’estimer vos coûts pour Google News.
Fonctionnalités clés
- Rendu Chrome headless pour les pages très dépendantes du JS
- Rotation automatique de proxies et contournement des CAPTCHA
- Prise en charge du scraping Google Search / News
- API REST simple avec réponse JSON/HTML
Tarifs
- Plans à partir de 49 $/mois (environ 45 €/mois)
- Modèle basé sur les crédits (le rendu JS coûte plus cher par requête)
- Coût normalisé pour 1 000 requêtes : variable selon les besoins de rendu
Idéal pour
Les développeurs qui ont besoin d’un rendu JavaScript fiable et d’une gestion anti-bot pour les pages Google News, via une API simple.
8. Oxylabs — Le meilleur extracteur Google News pour des résultats géociblés
Oxylabs propose une API dédiée Google News Scraper dans son stack SERP, adossée à un pool de plus de 100 millions de proxies dans 195 pays. L’argument commercial : une fiabilité de niveau entreprise avec des résultats spécifiques à la zone géographique.
Oxylabs prend en charge la sortie JSON structurée, les modes de scraping en temps réel et par lots, ainsi qu’une logique d’analyse personnalisée avec XPath et sélecteurs CSS. La tarification propre à Google est claire : environ 2,00 $/1K résultats (environ 1,85 €/1K) sur le plan Micro, puis elle descend à environ 0,90 $/1K (environ 0,83 €/1K) sur les paliers supérieurs.
L’essai gratuit vous donne jusqu’à 2 000 résultats, de quoi vérifier si la qualité des données répond à vos besoins.
Fonctionnalités clés
- API SERP Scraper avec prise en charge de Google News
- Plus de 100 millions de proxies dans 195 pays
- Livraison JSON structurée
- Modes de scraping en temps réel et par lots
Tarifs
- Essai gratuit : jusqu’à 2 000 résultats
- Micro : ~2,00 $/1K résultats Google (environ 1,85 €/1K ; ~2,35 $/1K, soit environ 2,15 €/1K, avec rendu JS)
- Paliers supérieurs : ~0,90 $/1K (environ 0,83 €/1K)
- Formules entreprise personnalisées disponibles
Idéal pour
Les équipes d’entreprise et du mid-market qui ont besoin de résultats Google News géociblés à grande échelle, avec une grande fiabilité.
9. Scrapingdog — La meilleure API Google News économique
Scrapingdog se positionne comme une alternative plus abordable à SerpApi, avec un endpoint API Google News dédié. La réponse JSON structurée inclut le titre, la source, la date, l’extrait et le lien.
La tarification est franchement agressive : certains plans offrent 400K requêtes pour 40 $ (environ 37 €), soit environ 0,10 $ pour 1 000 requêtes (environ 0,09 € pour 1 000). Le temps de réponse tourne généralement autour de 2 secondes, et vous disposez de 1 000 crédits gratuits pour tester.
La contrepartie : Scrapingdog est une plus petite structure, avec moins de documentation et d’intégrations que les grands acteurs. Mais pour les startups et les équipes soucieuses de leur budget, l’équation économique est très convaincante.
Fonctionnalités clés
- Endpoint API Google News Scraper dédié
- Réponse JSON structurée (titre, source, date, extrait, lien)
- Données d’actualité historiques via le paramètre
tbs - 1 000 crédits gratuits pour tester
Tarifs
- Gratuit : 1 000 crédits
- Plans payants à partir de 40 $/mois (environ 37 €/mois)
- Coût normalisé pour 1 000 requêtes : ~0,10 $ (environ 0,09 €)
Idéal pour
Les développeurs et startups attentifs au budget qui ont besoin de données Google News à haut volume, au coût par requête le plus bas.
10. Newsdata.io — La meilleure API d’actualité dédiée (au-delà de Google News)
Newsdata.io est une API de données d’actualité conçue pour agréger plus de 50 000 sources dans le monde. À proprement parler, ce n’est pas un extracteur Google News — il ne scrape pas Google News directement. Il agrège de son côté les mêmes sources d’éditeurs (et d’autres), en renvoyant du JSON structuré, avec une recherche d’actualité en temps réel et historique.
Les plans premium incluent l’extraction du texte intégral des articles, l’analyse de sentiment et le filtrage par catégorie — des fonctions que la plupart des outils de scraping SERP n’offrent pas nativement. Le niveau gratuit donne 200 requêtes/jour, de quoi tester confortablement.
Si votre objectif est « obtenir des données d’actualité sur un sujet » plutôt que spécifiquement « scraper Google News », Newsdata.io peut s’avérer plus adapté que n’importe quel outil SERP de cette liste.
Fonctionnalités clés
- API de recherche d’actualité en temps réel et historique
- Extraction du texte intégral des articles (premium)
- Analyse de sentiment (premium)
- Filtrage par catégorie, langue et pays
- Niveau gratuit à 200 requêtes/jour
Tarifs
- Gratuit : 200 requêtes/jour
- Plans payants à partir de 99,99 $/mois (environ 92 €/mois)
- Coût normalisé pour 1 000 requêtes : variable selon le plan
Idéal pour
Les équipes qui ont besoin d’une source de données d’actualité dédiée, avec des fonctions NLP intégrées (sentiment, catégorisation), et qui n’ont pas besoin de scraper spécifiquement Google News.
Comparaison des extracteurs Google News : anti-bot, champs de données et prix
Trois dimensions de comparaison priment sur toutes les autres lorsqu’on choisit un extracteur Google News. Je n’ai trouvé aucun autre guide qui couvre systématiquement les trois.
Comment chaque outil gère les protections anti-bot de Google
La gestion anti-bot est la préoccupation numéro 1 de quiconque scrape Google News. Voici l’approche de chaque outil :
| Stratégie | Outils qui l’utilisent |
|---|---|
| Rotation de proxies intégrée | Bright Data, ScrapingBee, Oxylabs, ScraperAPI |
| Résolution de CAPTCHA incluse | Bright Data, ScrapingBee, Oxylabs |
| Rendu JS / navigateur headless | Apify, Octoparse, ScrapingBee |
| Basé sur le navigateur (utilise votre session) | Thunderbit (mode Browser Scraping) |
| Anti-détection spécifique aux SERP | SerpApi, Scrapingdog |
Le mode Browser Scraping de Thunderbit mérite quelques mots de plus. Comme il s’exécute dans votre vraie session Chrome, il hérite de vos cookies et de votre état de connexion. De quoi esquiver une bonne part des déclencheurs de détection que rencontrent les scrapers headless — pages de consentement, CAPTCHA et vérifications d’empreinte navigateur. Pour les gros volumes, le Cloud Scraping de Thunderbit traite 50 pages à la fois avec sa propre infrastructure anti-bot.
Quels champs de données chaque extracteur Google News renvoie-t-il ?
Voici la comparaison que personne d’autre ne publie — et celle qui compte le plus pour choisir un outil. Certains outils ne fournissent que titres et liens. D’autres extraient le texte complet des articles, le nom des auteurs, et même le sentiment.
| Outil | Titre | Source | Date | Extrait | URL de l’article | Texte complet | Auteur | Images | Sentiment |
|---|---|---|---|---|---|---|---|---|---|
| Thunderbit | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ (via sous-page) | ✅ (via IA) | ✅ | ✅ (via Field AI Prompt) |
| SerpApi | ✅ | ✅ | ✅ | ✅ | ✅ | ❌ | ✅ | ✅ | ❌ |
| ScraperAPI | ✅ (analyse personnalisée) | ✅ (analyse personnalisée) | ✅ (analyse personnalisée) | ✅ (analyse personnalisée) | ✅ (analyse personnalisée) | ❌ | ❌ | ❌ | ❌ |
| Apify | ✅ | ✅ | ✅ | ✅ | ✅ | Dépend de l’actor | Dépend de l’actor | ✅ | ❌ |
| Bright Data | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ (News Scraper) | ✅ | ✅ | ❌ |
| Octoparse | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ (modèle) | ✅ | ✅ | ❌ |
| ScrapingBee | ✅ (analyse personnalisée) | ✅ (analyse personnalisée) | ✅ (analyse personnalisée) | ✅ (analyse personnalisée) | ✅ (analyse personnalisée) | ❌ | ❌ | ❌ | ❌ |
| Oxylabs | ✅ | ✅ | ✅ | ✅ | ✅ | ❌ | ❌ | ✅ | ❌ |
| Scrapingdog | ✅ | ✅ | ✅ | ✅ | ✅ | ❌ | ❌ | ❌ | ❌ |
| Newsdata.io | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ (premium) | ✅ | ✅ | ✅ (premium) |
Le point remarquable, ici, c’est que Thunderbit peut extraire le texte complet des articles via le scraping de sous-pages et ajouter des champs enrichis par l’IA comme le sentiment, le tout dans la même passe. Newsdata.io propose aussi sentiment et texte intégral, mais via une API d’actualité dédiée plutôt que par scraping de Google News. La plupart des API SERP, elles, ne renvoient que ce qui est visible sur la page de résultats Google News — titres, extraits et liens.
Coût normalisé pour 1 000 résultats
Voici le tableau que j’aurais aimé avoir quand j’évaluais les outils, et que je ne trouvais nulle part. Chaque fournisseur affiche ses prix à sa façon, alors j’ai tout ramené à un coût pour 1 000 résultats réussis, au niveau payant le moins cher.
| Outil | Niveau gratuit | Formule payante la moins chère | Coût approx. par 1 000 résultats | Notes |
|---|---|---|---|---|
| Thunderbit | 6 pages gratuites / essai : 10 pages | À partir d’environ 9 $/mois (basé sur les crédits) | ~6 $ à 30 $ | 1 crédit = 1 ligne ; extraction IA incluse |
| SerpApi | 250 recherches/mois | 75 $/mois (5 000 recherches) | ~15 $ | JSON structuré, endpoint Google News |
| ScraperAPI | 1 000 crédits/mois | 49 $/mois (100K crédits) | ~0,49 $ | Pas de parseur Google News dédié |
| Apify | Essai de 7 jours | 49 $/mois | Variable | Dépend de l’actor et du calcul |
| Bright Data | 1K requêtes d’essai | Paiement à l’usage | ~1,30 $ à 2,50 $ | Niveau entreprise, option dataset disponible |
| Octoparse | Plan gratuit (limité) | $69/mois | ~9 $ à 25 $ | Modèle cloud : 0,1 $/1K lignes (base) |
| ScrapingBee | Crédits d’essai | 49 $/mois | Variable (le JS coûte plus cher) | Basé sur les crédits, pas de parseur dédié |
| Oxylabs | Jusqu’à 2 000 résultats | Micro plan | ~1,00 $ à 2,35 $ | Ciblage géographique, JSON structuré |
| Scrapingdog | 1 000 crédits | 40 $/mois | ~0,10 $ | Option la moins chère, endpoint News dédié |
| Newsdata.io | 200 req/jour | 99,99 $/mois | Variable selon le plan | Ne scrape pas Google directement ; fonctions NLP |
Quelques enseignements. Scrapingdog est de loin l’option la moins chère par requête, mais il ne renvoie que des données niveau SERP (pas de texte complet). Bright Data et Oxylabs se situent dans le milieu de gamme côté prix, tout en offrant l’infrastructure anti-bot la plus solide. Thunderbit coûte plus cher par ligne que les API les moins chères, mais c’est le seul outil à conjuguer extraction complète des articles et enrichissement IA, sans écrire de code.
Quel extracteur Google News devriez-vous choisir ?
Ma recommandation selon le scénario :
- Vous voulez seulement des titres pour de la veille, avec un petit budget ? → Scrapingdog ou niveau gratuit de Newsdata.io
- Vous êtes un utilisateur non technique et il vous faut le texte complet + enrichissement ? → Thunderbit
- Vous êtes développeur et vous construisez un pipeline d’actualité structuré ? → SerpApi (meilleure couverture de champs) ou Scrapingdog (meilleur prix)
- Besoin d’une solution entreprise, gros volume, ciblage géographique ? → Bright Data ou Oxylabs
- Vous voulez un workflow visuel sur ordinateur ? → Octoparse
- Vous avez besoin de données d’actualité au-delà de Google News, avec des fonctions NLP ? → Newsdata.io
- Vous voulez la couche proxy/rendu générique la moins chère ? → ScraperAPI
Le bon outil dépend de trois facteurs : votre niveau technique, vos besoins en volume et le fait que vous vouliez seulement les titres ou bien le contenu complet des articles. En cas de doute, commencez par un niveau gratuit — la plupart de ces outils en proposent un — et voyez si la qualité des données tient la route pour votre cas d’usage.
Pour tester le chemin le plus rapide sans code, le niveau gratuit de Thunderbit vous permet de scraper les résultats Google News en quelques clics et d’exporter directement vers Google Sheets ou Airtable. Pour un pas-à-pas, consultez notre chaîne YouTube ou le modèle d’extracteur d’actualités.
Et que vos titres soient toujours structurés, vos CAPTCHA rares et vos exports impeccables.
Essayez Thunderbit pour le scraping de Google News Get Started Free
FAQ
Google propose-t-il une API News officielle ?
Non. Google a déprécié son API News en 2011 et ne l’a jamais remplacée. L’option officielle la plus proche est la Custom Search JSON API, qui fournit 100 requêtes gratuites par jour et facture 5 $ par 1 000 requêtes, mais elle nécessite un moteur de recherche personnalisé configuré et ne constitue pas un produit Google News dédié. Tout outil qui se présente aujourd’hui comme une « Google News API » est un service tiers.
Puis-je utiliser les flux RSS Google News à la place d’un scraper ?
Oui, pour des cas d’usage simples. Les flux RSS Google News fournissent gratuitement titres et liens, mais ils plafonnent à environ 100 résultats, n’offrent pas le texte intégral des articles et proposent des options de filtrage minimales. Si vous avez besoin de données plus riches — contenu complet, noms d’auteurs, analyse de sentiment ou plus de 100 résultats — il vous faudra un scraper ou une API dédiée de cette liste.
Comment obtenir le texte complet des articles à partir des résultats Google News ?
Les listes Google News n’affichent que titres et extraits. Pour le contenu complet d’un article, il vous faut un outil qui suit le lien de l’article et en extrait le contenu de la page. Le scraping de sous-pages de Thunderbit le fait automatiquement après le scraping de la page de résultats Google News. Des outils API comme Newsdata.io proposent le texte intégral sur les plans premium. La plupart des API SERP (SerpApi, Scrapingdog, Oxylabs) ne renvoient que ce qui est visible sur la page de résultats.
Est-il légal de scraper Google News ?
Le scraping de données visibles publiquement n’est généralement pas considéré comme un accès non autorisé au sens du droit américain (selon le précédent hiQ v. LinkedIn), mais cela ne signifie pas que tout est permis au regard des conditions d’utilisation. Les conditions de Google découragent les requêtes automatisées, et Google sert activement des CAPTCHA et des blocages dès qu’il détecte un trafic de type bot. Les utilisateurs doivent rester sur les données publiquement disponibles, respecter le droit d’auteur sur le texte des articles et consulter un juriste pour les cas d’usage à l’échelle commerciale.
Qu’est-ce qui casse le plus souvent les extracteurs Google News ?
Les causes habituelles : détection de requêtes automatisées (CAPTCHA et erreurs 429), variation selon la localisation (résultats différents selon le pays/la langue), pages de consentement et interstitielles, changements de balisage dans les cartes d’actualité et normalisation des URL de redirection. La couche de données la plus stable est la métadonnée de l’article (titre, source, date, URL). La moins stable est la surface de présentation — regroupement des sujets, miniatures et organisation des sections changent fréquemment.
En savoir plus


