logo
languageFRdown
menu
GalerieDétails

Scraper de Google News

Médias SociauxMCP
Extraire le titre de l'actualité, la date de publication et le corps du texte de Google Actualités par mot-clé.
Tous
Niveau d'accès
Mode supporté
Gratuit
Coût d'usage
2026/08/05
Dernière mise à jour
Essayez-le !

📌 Quelles données pouvez-vous collecter à partir des résultats de recherche de Google Actualités ?

Ce modèle collecte les enregistrements des résultats de recherche avec Title, NewsURL, PublishDate, Keyword, Source et NewsText. Il est utile pour les chercheurs, les analystes, les journalistes, les bibliothécaires et les équipes de gestion des connaissances.

Les données sont collectées à partir de Google Actualités. Google Actualités organise la couverture médiatique des éditeurs et rend les articles consultables par sujet et par requête.


💰 Tarifs

Ce modèle est actuellement gratuit et n'a pas de frais d'utilisation par ligne. Les limites du forfait ou des ressources Octoparse peuvent toujours s'appliquer.


📦 Sortie

L'implémentation actuellement publiée peut retourner les champs suivants :

  • Keyword
  • Source
  • Title
  • PublishDate
  • NewsURL
  • NewsText
  • error
{
  "Keyword": "Nobel Prize",
  "Source": "The Wall Street Journal",
  "Title": "The Most Fatuous Nobel Peace Prize - WSJ",
  "PublishDate": "2023-10-29T15:54:00Z",
  "NewsURL": "https://www.wsj.com/articles/nobel-peace-prize-obama-eu-7795cf7a",
  "NewsText": "The Most Fatuous Nobel Peace Prize Listen (41 sec) The Most Fatuous Nobel Peace Prize Listen (41 sec) https://www.wsj.com/articles/nobel-peace-prize-obama-eu-7795cf7a Oct. 29, 2023 10:54 am ET Listen (41 sec) In reviewing “Eurowhiteness” by Hans Kudnani (Bookshelf, Oct. 26), Tunku Varadarajan suggests, “Perhaps the most fatuous recent bestowal of the Nobel Peace Prize was its award in 2012 to the European Union for the ‘advancement of peace and reconciliation’ on the continent.” Even more fatuous was President Barack Obama’s 2009 Nobel Peace Prize merely for not being President George W. Bush. Shawn Clark Copyright ©2023 Dow Jones & Company, Inc. All Rights Reserved. 87990cbe856818d5eddac44c7b1cdeb8 Continue reading your article witha WSJ subscription Already a subscriber? Sign In WSJ Membership Customer Service Tools & Features Ads More Dow Jones Products WSJ Membership Customer Service Tools & Features Ads More Copyright ©2023 Dow Jones & Company, Inc. All Rights Reserved",
  "error": null
}

🎯 Cas d'utilisation

  • Construire un ensemble de données de recherche structuré, organisé par Keyword et Title.
  • Analyser le contenu et la chronologie de la source via NewsText et PublishDate.
  • Utiliser NewsURL pour auditer les enregistrements sources ou alimenter des flux de travail en aval avec des pages vérifiées.
  • Examiner et exporter PublishDate pour une analyse opérationnelle ou des rapports.

🐙 Pourquoi Octoparse

  • Flux de travail prêt à l'emploi : Les étapes d'extraction pour Google Actualités sont déjà configurées, vous n'avez donc pas besoin de créer le scraper à partir de zéro.
  • Exécution flexible : Choisissez le mode d'exécution local ou cloud pris en charge pour s'adapter à des vérifications ponctuelles ou à un travail de collecte répétable.
  • Sortie structurée et répétable : Les résultats sont retournés sous forme de lignes cohérentes, plus faciles à comparer, filtrer, dédupliquer et traiter que des pages copiées manuellement.
  • Garde-fous de saisie vérifiés : Le formulaire expose les entrées actuelles, les valeurs sélectionnables et les limites significatives configurées pour ce modèle.
  • Transfert de données pratique : Examinez les résultats dans Octoparse et exportez-les ou traitez-les en utilisant les options prises en charge par votre environnement Octoparse.

📝 Entrée

Remplissez les champs suivants :

  • Mots-clés (Requis) — Saisissez une liste de mots-clés pour rechercher des actualités sur Google Actualités. Jusqu'à 10 entrées par exécution.
  • Nombre de défilements de page (Requis) — Saisissez un nombre pour contrôler le nombre de défilements de la page. Plus le nombre de défilements est élevé, plus de données seront collectées. L'entrée maximale est de 50. Plage acceptée : 1 à 50.

🚀 Comment utiliser

  1. Ouvrez le modèle et sélectionnez Essayer ou Démarrer.
  2. Remplissez les champs de saisie listés ci-dessus.
  3. Démarrez la tâche en utilisant le mode d'exécution local ou cloud pris en charge.
  4. Examinez les lignes de sortie et exportez ou traitez les données structurées.

⚠️ Limites

Les résultats dépendent de ce que le site source expose au moment de l'exécution. Un champ de sortie listé peut être vide lorsque la page source ne fournit pas cette valeur. Les limites de saisie indiquées ci-dessus sont appliquées par le modèle.


💡 Conseils

Utilisez des entrées spécifiques et valides et examinez un résultat représentatif avant de lancer un grand lot. Supprimez les entrées en double lorsque des enregistrements répétés ne sont pas nécessaires.


❓ FAQ

Comment fonctionne ce scraper ?

L'automatisation applique les Mots-clés (1~10) et le Nombre de défilements de page, traite les pages de recherche résultantes et leurs éléments de résultat, et écrit des lignes structurées incluant Keyword, Source, Title et PublishDate.

Que dois-je saisir ?

Utilisez les champs et les valeurs acceptées indiqués dans la section Entrée. Seules les limites pertinentes pour l'utilisateur et les options sélectionnables sont listées.

Quelles données ce modèle retourne-t-il ?

Les champs de sortie actuels et un Aperçu de données JSON représentatif sont listés dans la section Sortie. La disponibilité des champs peut varier lorsque la page source n'affiche pas de valeur.

Ce modèle est-il gratuit ?

Il est actuellement gratuit et n'a pas de frais d'utilisation par ligne. Les limites du forfait ou des ressources Octoparse peuvent toujours s'appliquer.

Pourquoi certains champs de sortie peuvent-ils être vides ?

Les pages sources n'exposent pas toujours toutes les valeurs pour chaque enregistrement, et les mises en page peuvent varier selon l'élément, le marché ou la réponse actuelle du site. Le modèle retourne un champ lorsque la page actuelle le fournit.

Puis-je exporter les données collectées ?

Vous pouvez examiner les lignes structurées dans Octoparse et les exporter ou les traiter en utilisant les options prises en charge par votre environnement Octoparse.


🔗 Modèles associés

  • Google News Scraper (Cloud) — Utilisez Google News Scraper (Cloud) pour un flux de travail complémentaire sur le même site source.
  • Google Search Scraper — Utilisez Google Search Scraper pour un flux de travail de données structurées supplémentaire.
Share