📌 送信されたURLから収集できる小紅書(Xiaohongshu)の検索結果データとは?
このテンプレートは、タイトル、画像URL、詳細ページURL、投稿者URL、日時、投稿者、いいね数を検索結果レコードから収集します。ソーシャルメディア研究者、コンテンツチーム、ブランドアナリスト、オーディエンスリサーチャーにとって便利です。
データは小紅書(Xiaohongshu)から収集されます。小紅書(Xiaohongshu)は、ユーザーの投稿、商品、ライフスタイルのトピック、おすすめ情報を中心としたソーシャルディスカバリープラットフォームです。
💰 価格
このテンプレートは現在無料で、行ごとの使用料はかかりません。Octoparseのプランやリソースの制限が適用される場合があります。
📦 出力
現在公開されている実装では、以下のフィールドを返すことができます:
TitleImage_URLDetails_page_URLAuthorDatetimeAuthor_URLLike_count
{
"Title": "推荐3款自动爬虫神器,再也不用手撸代码了",
"Image_URL": "https://sns-webpic-qc.xhscdn.com/202511101556/e6aa53f42ed33364e0afd76422cd9bc3/1040g008314t3depl14005npqjgqg8e7a9v66v7g!nc_n_webp_mw_1",
"Details_page_URL": "https://www.xiaohongshu.com/search_result/66889d19000000000a026420?xsec_token=ABNlEB76L3vQ5N6cIYO-nnMuxpO0YslweSJOt3wLL32-8=&xsec_source=",
"Author": "Python大数据分析",
"Datetime": "2024-07-06",
"Author_URL": "https://www.xiaohongshu.com/user/profile/5f3a9c3500000000010038ea?channel_type=web_search_result_notes&parent_page_channel_type=web_profile_board&xsec_token=AB6uZC_94FYmu431pd_4pk8yP8HtOlqXAyi_kjD4UVbiA=&xsec_source=pc_search",
"Like_count": "511"
}
🎯 ユースケース
- タイトル別に整理された構造化された研究データセットを構築します。
- 投稿者、投稿者URL、日時を通じて、ソースコンテンツとタイミングを分析します。
- いいね数を使用して、オーディエンスや顧客のエンゲージメントを測定します。
- 画像URL、詳細ページURL、投稿者URLを使用して、ソースレコードを監査したり、検証済みのページを後続のワークフローに供給したりします。
🐙 Octoparseを選ぶ理由
- すぐに使えるワークフロー: 小紅書(Xiaohongshu)の抽出ステップはすでに設定済みのため、スクレイパーをゼロから構築する必要はありません。
- 柔軟な実行: サポートされているローカルまたはクラウド実行モードを選択して、1回限りのチェックや反復的な収集作業に対応できます。
- 構造化された反復可能な出力: 結果は一貫した行として返されるため、手動でコピーしたページよりも比較、フィルタリング、重複排除、処理が容易です。
- 検証済みの入力ガードレール: フォームには、このテンプレート用に設定された現在の入力、選択可能な値、および意味のある制限が表示されます。
- 実用的なデータハンドオフ: Octoparseで結果を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理します。
📝 入力
以下のフィールドを入力してください:
- 小紅書(Xiaohongshu)の検索結果URL(必須)— 小紅書(Xiaohongshu)の検索結果URL。1回の実行につき最大10,000件。
- 事前ログイン(必須)— 小紅書(Xiaohongshu)の検索結果を収集する前に事前ログインを有効にします。
🚀 使い方
- テンプレートを開き、「試す」または「開始」を選択します。
- 上記の入力フィールドを入力します。
- サポートされているローカルまたはクラウド実行モードを使用してタスクを開始します。
- 出力された行を確認し、構造化されたデータをエクスポートまたは処理します。
⚠️ 制限事項
結果は、実行時にソースサイトが公開する内容に依存します。ソースページが値を提供しない場合、リストされている出力フィールドは空になることがあります。上記の入力制限は、テンプレートによって強制されます。
💡 ヒント
大規模なバッチを開始する前に、具体的で有効な入力を使用し、代表的な結果を確認してください。繰り返しレコードが不要な場合は、重複した入力を削除してください。
❓ よくある質問
このスクレイパーはどのように機能しますか?
この自動化は、小紅書(Xiaohongshu)の検索結果URL(最大10,000件)と事前ログインを適用し、結果の検索ページとその結果項目を処理し、タイトル、画像URL、詳細ページURL、投稿者を含む構造化された行を書き出します。
何を入力する必要がありますか?
「入力」セクションに示されているフィールドと受け入れ可能な値を使用してください。ユーザーに関連する制限と選択可能なオプションのみがリストされています。
このテンプレートはどのようなデータを返しますか?
現在の出力フィールドと代表的なJSONのデータプレビューは、「出力」セクションにリストされています。ソースページに値が表示されない場合、フィールドの可用性は異なることがあります。
このテンプレートは無料で使用できますか?
現在無料で、行ごとの使用料はかかりません。Octoparseのプランやリソースの制限が適用される場合があります。
一部の出力フィールドが空になることがあるのはなぜですか?
ソースページは、すべてのレコードのすべての値を常に公開しているわけではなく、レイアウトは項目、市場、または現在のサイトの応答によって異なる場合があります。テンプレートは、現在のページがフィールドを提供する場合にそれを返します。
収集したデータをエクスポートできますか?
Octoparseで構造化された行を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理できます。
🔗 関連テンプレート
- Xiaohongshu Post Details Scraper — Xiaohongshu Post Details Scraperを使用して、発見したURLを詳細ページのデータで補強します。
- Xiaohongshu Search Result Scraper (by keyword) — 同じソースサイトで補完的なワークフローとしてXiaohongshu Search Result Scraper (by keyword)を使用します。
- Twitter (X) Comments Scraper — Twitter (X) Comments Scraperを使用して、別のソースから同等のソーシャルメディアデータを収集します。