📌 Quelles données d'avis pouvez-vous collecter sur IMDb ?
Ce modèle collecte les enregistrements d'avis avec le Titre, le Titre de l'avis, le Nom d'utilisateur, l'URL de la page, le Permalien, la Note, le Nombre de notes et la Note de l'avis. Il est utile pour les équipes d'analyse client, les analystes de réputation, les chercheurs et les professionnels de l'intelligence concurrentielle.
Les données sont collectées depuis IMDb. IMDb est une base de données de films, de séries télévisées, d'informations sur les acteurs et l'équipe technique, de notes et d'avis d'utilisateurs.
💰 Tarifs
Ce modèle est actuellement gratuit et n'a pas de frais d'utilisation par ligne. Les limites du forfait ou des ressources Octoparse peuvent toujours s'appliquer.
📦 Sortie
L'implémentation actuellement publiée peut retourner les champs suivants :
TitleRatingRating_CountPlotPage_URLPublished_YearLengthDirectorWritersStarsReview_RatingReview_CountUser_NameReview_DateReview_TitlePremalinkReview_TextHelpful_CountDislike_Count
{
"Title": "Harry Potter à l'école des sorciers",
"Rating": "7.7 /10",
"Rating_Count": "885K",
"Plot": "Un garçon orphelin s'inscrit dans une école de sorcellerie, où il apprend la vérité sur lui-même, sa famille et le terrible mal qui hante le monde magique.Un garçon orphelin s'inscrit dans une école de sorcellerie, où il apprend la vérité sur lui-même, sa famille et le terrible mal qui hante le monde magique.Un garçon orphelin s'inscrit dans une école de sorcellerie, où il apprend la vérité sur lui-même, sa famille et le terrible mal qui hante le monde magique.",
"Page_URL": "https://www.imdb.com/title/tt0241527/?ref_=tt_urv",
"Published_Year": "2001",
"Length": "2h 32m",
"Director": "Chris Columbus",
"Writers": "J.K. RowlingSteve Kloves",
"Stars": "Daniel RadcliffeRupert GrintEmma Watson",
"Review_Rating": "8 /10",
"Review_Count": "2 046 avis",
"User_Name": "Keyan-the-Eagle144",
"Review_Date": "2018/03/23",
"Review_Title": "Le grand début de toute la magie !",
"Premalink": "https://www.imdb.com/review/rw4101904/?ref_=tturv_perm_1",
"Review_Text": "Ayant lu les premiers livres Harry Potter avant 2001 et entendu parler de l'engouement pour le premier film, j'étais enthousiaste. J'ai entendu dire qu'il y aurait un casting entièrement britannique (ce qui est logique, n'est-ce pas ?) et que nous pourrions voir une version en direct de l'un des romans marquants de notre génération. D'après mes souvenirs, je suis allé avec ma famille et un ami de la famille voir le film le lendemain de Noël et j'ai été agréablement surpris. Une fois le film terminé, j'ai regardé le générique et découvert des noms familiers (le regretté Alan Rickman, Maggie Smith de Sister Act, Robbie Coltrane de James Bond 007 et Warwick Davis de Star Wars) ; d'autres moins familiers (les enfants, dont certains faisaient leurs débuts). Mais c'était un bon film et une fête de couleurs et de spectacles pour tous. C'est de loin mon film Harry Potter préféré. Le catalyseur de la série de films !",
"Helpful_Count": "83",
"Dislike_Count": "13"
}
🎯 Cas d'utilisation
- Construire un ensemble de données d'avis IMDb structuré, organisé par Titre, Titre de l'avis et Nom d'utilisateur.
- Comparer la Note, le Nombre de notes, la Note de l'avis et le Nombre d'avis entre les enregistrements collectés.
- Analyser le contenu des avis via le Texte de l'avis et le moment de l'avis via la Date de l'avis.
- Mesurer la réaction du public en utilisant le Nombre de 'Je n'aime pas' et le Nombre de votes utiles.
🐙 Pourquoi Octoparse
- Flux de travail prêt à l'emploi : Les étapes d'extraction pour IMDb sont déjà configurées, vous n'avez donc pas besoin de créer le scraper à partir de zéro.
- Exécution flexible : Choisissez le mode d'exécution local ou cloud pris en charge pour s'adapter à des vérifications ponctuelles ou à un travail de collecte répétable.
- Sortie structurée et répétable : Les résultats sont retournés sous forme de lignes cohérentes, plus faciles à comparer, filtrer, dédupliquer et traiter que des pages copiées manuellement.
- Garde-fous d'entrée vérifiés : Le formulaire expose les entrées actuelles, les valeurs sélectionnables et les limites significatives configurées pour ce modèle.
- Transfert de données pratique : Examinez les résultats dans Octoparse et exportez-les ou traitez-les en utilisant les options prises en charge par votre environnement Octoparse.
📝 Entrée
Remplissez les champs suivants :
- URL (Requis) — Saisissez une liste d'URL de films pour l'extraction des avis. Jusqu'à 50 000 entrées par exécution.
🚀 Comment utiliser
- Ouvrez le modèle et sélectionnez Essayer ou Démarrer.
- Remplissez les champs d'entrée listés ci-dessus.
- Démarrez la tâche en utilisant le mode d'exécution local ou cloud pris en charge.
- Examinez les lignes de sortie et exportez ou traitez les données structurées.
⚠️ Limites
Les résultats dépendent de ce que le site source expose au moment de l'exécution. Un champ de sortie listé peut être vide lorsque la page source ne fournit pas cette valeur. Les limites d'entrée indiquées ci-dessus sont appliquées par le modèle.
💡 Astuces
Utilisez des entrées spécifiques et valides et examinez un résultat représentatif avant de lancer un grand lot. Supprimez les entrées en double lorsque les enregistrements répétés ne sont pas nécessaires.
❓ FAQ
Comment fonctionne ce scraper ?
L'automatisation ouvre chaque page fournie via l'URL (jusqu'à 50 000 par exécution), parcourt le contenu des avis disponibles selon les contrôles configurés, et écrit des lignes d'avis structurées incluant le Titre, la Note, le Nombre de notes et l'Intrigue.
Que dois-je saisir ?
Utilisez les champs et les valeurs acceptées indiqués dans la section Entrée. Seules les limites pertinentes pour l'utilisateur et les options sélectionnables sont listées.
Quelles données ce modèle retourne-t-il ?
Les champs de sortie actuels et un Aperçu de données JSON représentatif sont listés dans la section Sortie. La disponibilité des champs peut varier lorsque la page source n'affiche pas de valeur.
Ce modèle est-il gratuit ?
Il est actuellement gratuit et n'a pas de frais d'utilisation par ligne. Les limites du forfait ou des ressources Octoparse peuvent toujours s'appliquer.
Pourquoi certains champs de sortie peuvent-ils être vides ?
Les pages sources n'exposent pas toujours toutes les valeurs pour chaque enregistrement, et les mises en page peuvent varier selon l'article, le marché ou la réponse actuelle du site. Le modèle retourne un champ lorsque la page actuelle le fournit.
Puis-je exporter les données collectées ?
Vous pouvez examiner les lignes structurées dans Octoparse et les exporter ou les traiter en utilisant les options prises en charge par votre environnement Octoparse.
🔗 Modèles associés
- Scraper de commentaires Goodreads — Utilisez le Scraper de commentaires Goodreads pour un flux de travail complémentaire d'avis d'audience axé sur les livres.
- Scraper de commentaires et réponses YouTube — Utilisez le Scraper de commentaires et réponses YouTube pour étudier les réactions du public au contenu vidéo.