logo
languageFRdown
menu
GalerieDétails

Reddit Post & Comments Scraper

Médias SociauxMCPMCP
Obtenez les publications, commentaires, réponses, dates, etc. de Reddit via les URL d'anciennes publications.
Standard et plus
Niveau d'accès
Mode supporté
$0.1/1000 lignes
Coût d'usage
2026/08/24
Dernière mise à jour
Essayez-le !

📌 Comment extraire les publications, commentaires et réponses de Reddit à partir des URL de publication ?

Ce modèle collecte les données de publication et de discussion à partir des URL de publication Old Reddit soumises, y compris le subreddit, le titre et le corps de la publication, l'auteur, les votes positifs, les images et les liens dans le corps du texte, le nombre de commentaires, le texte et les métadonnées des commentaires, les réponses, ainsi que les URL et les ID des commentaires. Il est utile pour les équipes de veille sociale, les chercheurs universitaires et les analystes de communauté.

Les données sont collectées depuis Old Reddit. Reddit est une plateforme de discussion communautaire organisée en subreddits, publications, commentaires et fils de réponses.


💰 Tarification

Prix actuel : 0,1 $/1 000 lignes. La facturation est basée sur le nombre de lignes de sortie produites par la tâche.


📦 Sortie

L'implémentation publiée actuelle peut retourner les champs suivants :

  • Input_URL
  • SubReddit
  • Post_Title
  • Post_Body
  • Post_Upvote
  • Post_Author
  • Post_Image
  • Post_Body_URLs
  • Comment_Count
  • Comment_body
  • Commentor
  • Commentor_points
  • Comment_Time
  • Comment_URL
  • Comment_ID
  • Replies_body
  • Replier
  • Replier_points
  • Replied_Time
  • Load_More_Comment_Count
  • msg_type
  • content
  • link_id
  • sort
  • children
  • id
  • limit_children
  • r
  • renderstyle
  • HTML_Source
  • Status
{
  "Input_URL": null,
  "SubReddit": null,
  "Post_Title": null,
  "Post_Body": null,
  "Post_Upvote": null,
  "Post_Author": null,
  "Post_Image": null,
  "Post_Body_URLs": null,
  "Comment_Count": null,
  "Comment_body": null,
  "Commentor": null,
  "Commentor_points": null,
  "Comment_Time": null,
  "Comment_URL": null,
  "Comment_ID": null,
  "Replies_body": null,
  "Replier": null,
  "Replier_points": null,
  "Replied_Time": null,
  "Load_More_Comment_Count": null,
  "msg_type": null,
  "content": null,
  "link_id": null,
  "sort": null,
  "children": null,
  "id": null,
  "limit_children": null,
  "r": null,
  "renderstyle": null,
  "HTML_Source": null,
  "Status": null
}

🎯 Cas d'utilisation

  • Analyser les thèmes de discussion en utilisant les corps des publications, les commentaires et les réponses.
  • Mesurer l'engagement en utilisant les votes positifs des publications, le nombre de commentaires et les points des commentateurs.
  • Étudier la structure des conversations en utilisant les ID des commentaires, les URL et les champs de réponse.
  • Créer des ensembles de données de discussion chronologiques en utilisant les horodatages des commentaires et des réponses.

🐙 Pourquoi Octoparse

  • Flux de travail prêt à l'emploi : Les étapes d'extraction pour Old Reddit sont déjà configurées, vous n'avez donc pas besoin de créer le scraper à partir de zéro.
  • Exécution flexible : Exécutez la tâche prête à l'emploi dans le cloud sans avoir à garder un ordinateur local en ligne pour la collecte.
  • Sortie structurée et reproductible : Les résultats sont retournés sous forme de lignes cohérentes, plus faciles à comparer, filtrer, dédupliquer et traiter que des pages copiées manuellement.
  • Garde-fous d'entrée vérifiés : Le formulaire expose les entrées actuelles, les valeurs sélectionnables et les limites significatives configurées pour ce modèle.
  • Transfert de données pratique : Examinez les résultats dans Octoparse et exportez-les ou traitez-les en utilisant les options prises en charge par votre environnement Octoparse.

📝 Entrée

Remplissez les champs suivants :

  • URL des publications Old Reddit (Requis) — URL des publications Old Reddit. Jusqu'à 100 000 entrées par exécution.

🚀 Comment utiliser

  1. Ouvrez le modèle et sélectionnez Essayer ou Démarrer.
  2. Remplissez les champs d'entrée listés ci-dessus.
  3. Démarrez la tâche en utilisant le mode d'exécution cloud pris en charge.
  4. Examinez les lignes de sortie et exportez ou traitez les données structurées.

⚠️ Limitations

Les résultats dépendent de ce que le site source expose au moment de l'exécution. Un champ de sortie listé peut être vide lorsque la page source ne fournit pas cette valeur. Les limites d'entrée indiquées ci-dessus sont appliquées par le modèle.


💡 Astuces

Utilisez des entrées spécifiques et valides et examinez un résultat représentatif avant de lancer un grand lot. Supprimez les entrées en double lorsque des enregistrements répétés ne sont pas nécessaires.


❓ FAQ

Comment Octoparse collecte-t-il les données de Old Reddit ?

L'automatisation Python ouvre chaque URL de publication Old Reddit, analyse la publication, charge l'arborescence des commentaires, demande des branches de commentaires supplémentaires si elles existent, et télécharge des enregistrements structurés de publications, de commentaires et de réponses.

Quelle entrée ce Scraper de publications et commentaires Reddit nécessite-t-il ?

Utilisez les champs et les valeurs acceptées indiqués dans la section Entrée. Seules les limites pertinentes pour l'utilisateur et les options sélectionnables sont listées.

Quelles données puis-je extraire de Old Reddit ?

Les champs de sortie actuels et un Aperçu de données JSON représentatif sont listés dans la section Sortie. La disponibilité des champs peut varier lorsque la page source n'affiche pas de valeur.

Combien coûte ce Scraper de publications et commentaires Reddit ?

Le prix actuel est de 0,1 $/1 000 lignes, et la facturation est basée sur le nombre de lignes de sortie produites par la tâche.

Pourquoi certains champs de Old Reddit peuvent-ils être vides ?

Les pages sources n'exposent pas toujours toutes les valeurs pour chaque enregistrement, et les mises en page peuvent varier selon l'élément, le marché ou la réponse actuelle du site. Le modèle retourne un champ lorsque la page actuelle le fournit.

Puis-je exporter les données collectées de Old Reddit ?

Vous pouvez examiner les lignes structurées dans Octoparse et les exporter ou les traiter en utilisant les options prises en charge par votre environnement Octoparse.


🔗 Modèles associés

  • Reddit Search Scraper — Utilisez Reddit Search Scraper pour un flux de travail complémentaire sur le même site source.
  • Reddit Trending Scraper — Utilisez Reddit Trending Scraper pour un flux de travail complémentaire sur le même site source.
  • Reddit Post Scraper (by Keywords) — Utilisez Reddit Post Scraper (by Keywords) pour un flux de travail complémentaire sur le même site source.
Share