📌 投稿URLからRedditの投稿、コメント、返信を抽出する方法は?
このテンプレートは、送信されたOld Redditの投稿URLから、サブレディット、投稿のタイトルと本文、作成者、高評価数、画像と本文のリンク、コメント数、コメントのテキストとメタデータ、返信、コメントのURLとIDなど、投稿とディスカッションのデータを収集します。ソーシャルリスニングチーム、学術研究者、コミュニティアナリストにとって有用です。
データはOld Redditから収集されます。Redditは、サブレディット、投稿、コメント、返信スレッドで構成されるコミュニティディスカッションプラットフォームです。
💰 価格
現在の価格:$0.1/1,000行。課金はタスクによって生成された出力行数に基づきます。
📦 出力
現在公開されている実装では、以下のフィールドを返すことができます:
Input_URLSubRedditPost_TitlePost_BodyPost_UpvotePost_AuthorPost_ImagePost_Body_URLsComment_CountComment_bodyCommentorCommentor_pointsComment_TimeComment_URLComment_IDReplies_bodyReplierReplier_pointsReplied_TimeLoad_More_Comment_Countmsg_typecontentlink_idsortchildrenidlimit_childrenrrenderstyleHTML_SourceStatus
{
"Input_URL": null,
"SubReddit": null,
"Post_Title": null,
"Post_Body": null,
"Post_Upvote": null,
"Post_Author": null,
"Post_Image": null,
"Post_Body_URLs": null,
"Comment_Count": null,
"Comment_body": null,
"Commentor": null,
"Commentor_points": null,
"Comment_Time": null,
"Comment_URL": null,
"Comment_ID": null,
"Replies_body": null,
"Replier": null,
"Replier_points": null,
"Replied_Time": null,
"Load_More_Comment_Count": null,
"msg_type": null,
"content": null,
"link_id": null,
"sort": null,
"children": null,
"id": null,
"limit_children": null,
"r": null,
"renderstyle": null,
"HTML_Source": null,
"Status": null
}
🎯 ユースケース
- 投稿の本文、コメント、返信を使用してディスカッションのテーマを分析します。
- 投稿の高評価数、コメント数、コメンターのポイントを使用してエンゲージメントを測定します。
- コメントID、URL、返信フィールドを使用して会話の構造を研究します。
- コメントと返信のタイムスタンプを使用して、時系列のディスカッションデータセットを構築します。
🐙 Octoparseを選ぶ理由
- すぐに使えるワークフロー: Old Redditの抽出ステップはすでに設定済みなので、スクレイパーをゼロから構築する必要はありません。
- 柔軟な実行: 収集のためにローカルコンピュータをオンラインに保つことなく、クラウドで既製のタスクを実行できます。
- 構造化された再現可能な出力: 結果は一貫した行として返されるため、手動でコピーしたページよりも比較、フィルタリング、重複排除、処理が容易です。
- 検証済みの入力ガードレール: フォームには、このテンプレート用に設定された現在の入力、選択可能な値、および意味のある制限が表示されます。
- 実用的なデータハンドオフ: Octoparseで結果を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理します。
📝 入力
以下のフィールドを入力してください:
- Old Redditの投稿URL (必須) — Old Redditの投稿URL。1回の実行につき最大100,000件。
🚀 使用方法
- テンプレートを開き、試すまたは開始を選択します。
- 上記の入力フィールドをすべて入力します。
- サポートされているクラウド実行モードを使用してタスクを開始します。
- 出力行を確認し、構造化されたデータをエクスポートまたは処理します。
⚠️ 制限事項
結果は、実行時にソースサイトが公開する内容に依存します。ソースページが値を提供しない場合、リストされている出力フィールドは空になることがあります。上記に示されている入力制限は、テンプレートによって強制されます。
💡 ヒント
特定の有効な入力を使用し、大規模なバッチを開始する前に代表的な結果を確認してください。繰り返しレコードが不要な場合は、重複した入力を削除してください。
❓ よくある質問
OctoparseはどのようにしてOld Redditからデータを収集しますか?
Pythonオートメーションが各Old Redditの投稿URLを開き、投稿を解析し、コメントツリーを読み込み、存在する場合は追加のコメントブランチを要求し、構造化された投稿、コメント、返信のレコードをアップロードします。
このReddit投稿&コメントスクレイパーにはどのような入力が必要ですか?
入力セクションに示されているフィールドと許容値を使用してください。ユーザーに関連する制限と選択可能なオプションのみがリストされています。
Old Redditからどのようなデータを抽出できますか?
現在の出力フィールドと代表的なJSONデータプレビューは、出力セクションにリストされています。ソースページに値が表示されない場合、フィールドの可用性は異なることがあります。
このReddit投稿&コメントスクレイパーの費用はいくらですか?
現在の価格は$0.1/1,000行で、課金はタスクによって生成された出力行数に基づきます。
なぜ一部のOld Redditフィールドは空になることがあるのですか?
ソースページは、すべてのレコードのすべての値を常に公開するわけではなく、レイアウトはアイテム、マーケット、または現在のサイトの応答によって異なる場合があります。テンプレートは、現在のページがフィールドを提供する場合にそれを返します。
収集したOld Redditデータをエクスポートできますか?
Octoparseで構造化された行を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理できます。
🔗 関連テンプレート
- Reddit Search Scraper — 同じソースサイトでの補完的なワークフローとしてReddit Search Scraperを使用します。
- Reddit Trending Scraper — 同じソースサイトでの補完的なワークフローとしてReddit Trending Scraperを使用します。
- Reddit Post Scraper (by Keywords) — 同じソースサイトでの補完的なワークフローとしてReddit Post Scraper (by Keywords)を使用します。