📌 Quelles données de résultats de recherche Xiaohongshu pouvez-vous collecter à partir des URL soumises ?
Ce modèle collecte les enregistrements de résultats de recherche avec le Titre, l'URL de l'image, l'URL de la page de détails, l'URL de l'auteur, la Date et l'heure, l'Auteur et le Nombre de "J'aime". Il est utile pour les chercheurs en médias sociaux, les équipes de contenu, les analystes de marque et les chercheurs d'audience.
Les données sont collectées depuis Xiaohongshu. Xiaohongshu est une plateforme de découverte sociale axée sur les publications des utilisateurs, les produits, les sujets de style de vie et les recommandations.
💰 Tarifs
Ce modèle est actuellement gratuit et n'a pas de frais d'utilisation par ligne. Les limites du plan ou des ressources Octoparse peuvent toujours s'appliquer.
📦 Sortie
L'implémentation publiée actuelle peut renvoyer les champs suivants :
TitleImage_URLDetails_page_URLAuthorDatetimeAuthor_URLLike_count
{
"Title": "推荐3款自动爬虫神器,再也不用手撸代码了",
"Image_URL": "https://sns-webpic-qc.xhscdn.com/202511101556/e6aa53f42ed33364e0afd76422cd9bc3/1040g008314t3depl14005npqjgqg8e7a9v66v7g!nc_n_webp_mw_1",
"Details_page_URL": "https://www.xiaohongshu.com/search_result/66889d19000000000a026420?xsec_token=ABNlEB76L3vQ5N6cIYO-nnMuxpO0YslweSJOt3wLL32-8=&xsec_source=",
"Author": "Python大数据分析",
"Datetime": "2024-07-06",
"Author_URL": "https://www.xiaohongshu.com/user/profile/5f3a9c3500000000010038ea?channel_type=web_search_result_notes&parent_page_channel_type=web_profile_board&xsec_token=AB6uZC_94FYmu431pd_4pk8yP8HtOlqXAyi_kjD4UVbiA=&xsec_source=pc_search",
"Like_count": "511"
}
🎯 Cas d'utilisation
- Construire un ensemble de données de recherche structuré organisé par Titre.
- Analyser le contenu source et le moment de publication via l'Auteur, l'URL de l'auteur et la Date et l'heure.
- Mesurer l'engagement de l'audience ou des clients en utilisant le Nombre de "J'aime".
- Utiliser l'URL de l'image, l'URL de la page de détails et l'URL de l'auteur pour auditer les enregistrements sources ou alimenter des flux de travail en aval avec des pages vérifiées.
🐙 Pourquoi Octoparse
- Flux de travail prêt à l'emploi : Les étapes d'extraction pour Xiaohongshu sont déjà configurées, vous n'avez donc pas besoin de créer le scraper à partir de zéro.
- Exécution flexible : Choisissez le mode d'exécution local ou cloud pris en charge pour s'adapter à des vérifications ponctuelles ou à un travail de collecte répétable.
- Sortie structurée et répétable : Les résultats sont renvoyés sous forme de lignes cohérentes, plus faciles à comparer, filtrer, dédupliquer et traiter que des pages copiées manuellement.
- Garde-fous d'entrée vérifiés : Le formulaire expose les entrées actuelles, les valeurs sélectionnables et les limites significatives configurées pour ce modèle.
- Transfert de données pratique : Examinez les résultats dans Octoparse et exportez-les ou traitez-les en utilisant les options prises en charge par votre environnement Octoparse.
📝 Entrée
Remplissez les champs suivants :
- URL des résultats de recherche Xiaohongshu (Requis) — URL des résultats de recherche Xiaohongshu. Jusqu'à 10 000 entrées par exécution.
- Pré-connexion (Requis) — Activez la pré-connexion avant de collecter les résultats de recherche Xiaohongshu.
🚀 Comment utiliser
- Ouvrez le modèle et sélectionnez Essayer ou Démarrer.
- Remplissez les champs d'entrée listés ci-dessus.
- Démarrez la tâche en utilisant le mode d'exécution local ou cloud pris en charge.
- Examinez les lignes de sortie et exportez ou traitez les données structurées.
⚠️ Limitations
Les résultats dépendent de ce que le site source expose au moment de l'exécution. Un champ de sortie listé peut être vide lorsque la page source ne fournit pas cette valeur. Les limites d'entrée indiquées ci-dessus sont appliquées par le modèle.
💡 Astuces
Utilisez des entrées spécifiques et valides et examinez un résultat représentatif avant de lancer un grand lot. Supprimez les entrées en double lorsque les enregistrements répétés ne sont pas nécessaires.
❓ FAQ
Comment fonctionne ce scraper ?
L'automatisation applique les URL des résultats de recherche Xiaohongshu (jusqu'à 10 000) et la pré-connexion, traite les pages de recherche résultantes et leurs éléments de résultat, et écrit des lignes structurées incluant le Titre, l'URL de l'image, l'URL de la page de détails et l'Auteur.
Que dois-je saisir ?
Utilisez les champs et les valeurs acceptées indiqués dans la section Entrée. Seules les limites pertinentes pour l'utilisateur et les options sélectionnables sont listées.
Quelles données ce modèle renvoie-t-il ?
Les champs de sortie actuels et un Aperçu de données JSON représentatif sont listés dans la section Sortie. La disponibilité des champs peut varier lorsque la page source n'affiche pas de valeur.
Ce modèle est-il gratuit ?
Il est actuellement gratuit et n'a pas de frais d'utilisation par ligne. Les limites du plan ou des ressources Octoparse peuvent toujours s'appliquer.
Pourquoi certains champs de sortie peuvent-ils être vides ?
Les pages sources n'exposent pas toujours toutes les valeurs pour chaque enregistrement, et les mises en page peuvent varier selon l'article, le marché ou la réponse actuelle du site. Le modèle renvoie un champ lorsque la page actuelle le fournit.
Puis-je exporter les données collectées ?
Vous pouvez examiner les lignes structurées dans Octoparse et les exporter ou les traiter en utilisant les options prises en charge par votre environnement Octoparse.
🔗 Modèles associés
- Xiaohongshu Post Details Scraper — Utilisez le Xiaohongshu Post Details Scraper pour enrichir les URL découvertes avec des données de la page de détails.
- Xiaohongshu Search Result Scraper (by keyword) — Utilisez le Xiaohongshu Search Result Scraper (par mot-clé) pour un flux de travail complémentaire sur le même site source.
- Twitter (X) Comments Scraper — Utilisez le Twitter (X) Comments Scraper pour collecter des données de médias sociaux comparables à partir d'une autre source.