📌 Quelles données de découverte de livres pouvez-vous collecter à partir des résultats de recherche de Goodreads ?
Ce modèle collecte des enregistrements structurés à partir des pages de résultats de recherche, y compris Mot-clé, Progress_result_count, Page_URL, Page, image_url, book_title, author, rating, rating_numbers, published_year, editions. Il est utile pour les éditeurs, les auteurs, les bibliothécaires, les chercheurs en littérature et les spécialistes du marketing du livre.
Les données sont collectées sur Goodreads. Goodreads est une communauté de découverte de livres et de lecture avec des titres, des notes, des éditions et des critiques de lecteurs.
💰 Tarifs
Ce modèle est actuellement gratuit et n'a pas de frais d'utilisation par ligne. Les limites du forfait ou des ressources Octoparse peuvent toujours s'appliquer.
📦 Sortie
L'implémentation actuellement publiée peut renvoyer les champs suivants :
KeywordProgress_result_countPage_URLPageimage_urlbook_titleauthorratingrating_numberspublished_yeareditions
{
"Keyword": "education",
"Progress_result_count": null,
"Page_URL": null,
"Page": "1",
"image_url": "https://i.gr-assets.com/images/S/compressed.photo.goodreads.com/books/1375414895i/17851885._SY75_.jpg",
"book_title": "I Am Malala: The Story of the Girl Who Stood Up for Education and Was Shot by the Taliban",
"author": "Malala Yousafzai",
"rating": "4.14",
"rating_numbers": "504,883",
"published_year": "2012",
"editions": "170"
}
🎯 Cas d'utilisation
- Utilisez
rating,rating_numberspour évaluer les notes et la réputation. - Utilisez
image_url,book_titlepour créer et comparer des catalogues de produits, de contenu ou de menus. - Utilisez
authorpour rechercher des créateurs, des critiques, des vendeurs ou des magasins. - Utilisez
Page_URLpour lier les enregistrements aux pages sources ou à la collecte de détails en aval.
🐙 Pourquoi Octoparse
- Flux de travail prêt à l'emploi : Les étapes d'extraction pour Goodreads sont déjà configurées, vous n'avez donc pas besoin de créer le scraper à partir de zéro.
- Exécution flexible : Choisissez le mode d'exécution local ou cloud pris en charge pour s'adapter à des vérifications ponctuelles ou à un travail de collecte répétable.
- Sortie structurée et répétable : Les résultats sont renvoyés sous forme de lignes cohérentes, plus faciles à comparer, filtrer, dédupliquer et traiter que des pages copiées manuellement.
- Garde-fous d'entrée vérifiés : Le formulaire expose les entrées actuelles, les valeurs sélectionnables et les limites significatives configurées pour ce modèle.
- Transfert de données pratique : Examinez les résultats dans Octoparse et exportez-les ou traitez-les en utilisant les options prises en charge par votre environnement Octoparse.
📝 Entrée
Remplissez les champs suivants :
- Mot-clé (1 par ligne) (Requis) — Entrez les mots-clés de catégorie de livre ou de sujet, un par ligne.
- Nombre de pages (Facultatif) — Définissez le nombre de pages de résultats de recherche Goodreads à traiter.
🚀 Comment utiliser
- Ouvrez le modèle et sélectionnez Essayez-le ou Démarrer.
- Remplissez les champs d'entrée listés ci-dessus.
- Démarrez la tâche en utilisant le mode d'exécution local ou cloud pris en charge.
- Examinez les lignes de sortie et exportez ou traitez les données structurées.
⚠️ Limites
Les résultats dépendent de ce que le site source expose au moment de l'exécution. Un champ de sortie listé peut être vide lorsque la page source ne fournit pas cette valeur. Les limites d'entrée indiquées ci-dessus sont appliquées par le modèle.
💡 Conseils
Utilisez des entrées spécifiques et valides et examinez un résultat représentatif avant de lancer un grand lot. Supprimez les entrées en double lorsque des enregistrements répétés ne sont pas nécessaires.
❓ FAQ
Comment fonctionne ce scraper ?
Le modèle prend les entrées configurées Mot-clé (1 par ligne) et Nombre de pages, soumet chaque valeur fournie et parcourt les enregistrements renvoyés sur les pages de résultats de recherche de Goodreads, puis émet des lignes structurées contenant des champs tels que Mot-clé, Progress_result_count, Page_URL, Page, image_url.
Que dois-je saisir ?
Utilisez les champs et les valeurs acceptées indiqués dans la section Entrée. Seules les limites pertinentes pour l'utilisateur et les options sélectionnables sont listées.
Quelles données ce modèle renvoie-t-il ?
Les champs de sortie actuels et un Aperçu de données JSON représentatif sont listés dans la section Sortie. La disponibilité des champs peut varier lorsque la page source n'affiche pas de valeur.
L'utilisation de ce modèle est-elle gratuite ?
Il est actuellement gratuit et n'a pas de frais d'utilisation par ligne. Les limites du forfait ou des ressources Octoparse peuvent toujours s'appliquer.
Pourquoi certains champs de sortie peuvent-ils être vides ?
Les pages sources n'exposent pas toujours toutes les valeurs pour chaque enregistrement, et les mises en page peuvent varier en fonction de l'article, du marché ou de la réponse actuelle du site. Le modèle renvoie un champ lorsque la page actuelle le fournit.
Puis-je exporter les données collectées ?
Vous pouvez examiner les lignes structurées dans Octoparse et les exporter ou les traiter en utilisant les options prises en charge par votre environnement Octoparse.
🔗 Modèles associés
- Goodreads Comments Scraper — Utilisez le Goodreads Comments Scraper lorsque le texte des critiques de lecteurs, les notes, les dates et les mentions 'J'aime' sont nécessaires.
- Google Books Scraper — Utilisez le Google Books Scraper pour une découverte de livres comparable, ainsi que les champs ISBN, éditeur, description, sujet et lien d'achat.