📌 Xのハッシュタグ検索からどのような公開投稿データを抽出できますか?
このテンプレートは、検索結果ページから構造化されたレコードを収集します。これには、Category、Keyword、Web_Page_URL、Tweet_Website、Author_Name、Author_Web_Page_URL、Tweet_Timestamp、Tweet_Content、Tweet_Image_URL、Tweet_Video_URL、Tweet_AD、Tweet_Number_of_Reviews、その他の公開出力フィールドが含まれます。ソーシャルメディアアナリスト、ブランドチーム、研究者、コンテンツストラテジストにとって有用です。
データはX(旧Twitter)から収集されます。Xは、投稿を公開し、リアルタイムで公開されている会話をフォローするためのソーシャルネットワークです。
💰 価格
現在の価格:$0.3/1,000行。課金はタスクによって生成された出力行数に基づきます。
📦 出力
現在公開されている実装では、以下のフィールドを返すことができます:
keycountfail_counthash_keymsg_typecontentCategoryKeywordWeb_Page_URLTweet_WebsiteAuthor_NameAuthor_Web_Page_URLTweet_TimestampTweet_ContentTweet_Image_URLTweet_Video_URLTweet_ADTweet_Number_of_ReviewsTweet_Number_of_RetweetsTweet_Number_of_LikesTweet_Number_of_Looks
{
"key": null,
"count": null,
"fail_count": null,
"hash_key": null,
"msg_type": null,
"content": null,
"Category": "TopPost",
"Keyword": "#fridayfeeling",
"Web_Page_URL": "https://twitter.com/search?q=#fridayfeeling&src=typed_query&f=top",
"Tweet_Website": "https://twitter.com/Printtapp/status/1768257041947062311",
"Author_Name": "printtapp",
"Author_Web_Page_URL": "https://twitter.com/Printtapp",
"Tweet_Timestamp": "2024-03-14",
"Tweet_Content": "POV: Walking past the office printing queue, knowing our freshly printed documents are waiting for us at home. #fridayfeeling",
"Tweet_Image_URL": null,
"Tweet_Video_URL": "https://twitter.com/Printtapp/status/1768257041947062311",
"Tweet_AD": "False",
"Tweet_Number_of_Reviews": null,
"Tweet_Number_of_Retweets": null,
"Tweet_Number_of_Likes": null,
"Tweet_Number_of_Looks": null
}
🎯 ユースケース
- Keyword、Category、Tweet_Contentを使用して、ハッシュタグ間の会話を比較します。
- Tweet_Number_of_Retweets、Tweet_Number_of_Likes、Tweet_Number_of_Looksを使用して、エンゲージメントをベンチマークします。
- Author_NameとAuthor_Web_Page_URLを使用して、トピックに貢献しているアカウントを特定します。
- Tweet_Timestamp、Tweet_Image_URL、Tweet_Video_URLを使用して、投稿パターンとメディア形式を調査します。
🐙 Octoparseを選ぶ理由
- すぐに使えるワークフロー: X(旧Twitter)の抽出ステップはすでに設定されているため、スクレイパーをゼロから構築する必要はありません。
- 柔軟な実行: 収集のためにローカルコンピュータをオンラインに保つことなく、クラウドで既製のタスクを実行できます。
- 構造化された再現可能な出力: 結果は一貫した行として返されるため、手動でコピーしたページよりも比較、フィルタリング、重複排除、処理が容易です。
- 検証済みの入力ガードレール: フォームには、このテンプレート用に設定された現在の入力、選択可能な値、および意味のある制限が表示されます。
- 実用的なデータハンドオフ: Octoparseで結果を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理します。
📝 入力
以下のフィールドを入力してください:
- キーワード/ハッシュタグ(必須)— 1回の実行につき最大3エントリ。
- スクロールダウン回数(任意)— スクロールダウン回数。許容範囲:1〜200。
🚀 使用方法
- テンプレートを開き、試すまたは開始を選択します。
- 上記の入力フィールドをすべて入力します。
- サポートされているクラウド実行モードを使用してタスクを開始します。
- 出力行を確認し、構造化されたデータをエクスポートまたは処理します。
⚠️ 制限事項
結果は、実行時にソースサイトが公開する内容に依存します。ソースページが値を提供しない場合、リストされている出力フィールドは空になることがあります。上記の入力制限はテンプレートによって強制されます。
💡 ヒント
大規模なバッチを開始する前に、具体的で有効な入力を使用し、代表的な結果を確認してください。繰り返しレコードが不要な場合は、重複した入力を削除してください。
❓ よくある質問
OctoparseはどのようにしてX(旧Twitter)からデータを収集しますか?
このテンプレートは、設定されたキーワード/ハッシュタグ(最大3つ)、スクロールダウン回数(最大200回)の入力を受け取り、提供された各値を送信してX(旧Twitter)の検索結果ページで返されたレコードを反復処理し、Category、Keyword、Web_Page_URL、Tweet_Website、Author_Nameなどのフィールドを含む構造化された行を出力します。
このTwitterスクレイパー(ハッシュタグ別)にはどのような入力が必要ですか?
入力セクションに示されているフィールドと許容値を使用してください。ユーザーに関連する制限と選択可能なオプションのみがリストされています。
X(旧Twitter)からどのようなデータを抽出できますか?
現在の出力フィールドと代表的なJSONデータプレビューは、出力セクションにリストされています。ソースページに値が表示されない場合、フィールドの可用性は異なることがあります。
このTwitterスクレイパー(ハッシュタグ別)の費用はいくらですか?
現在の価格は$0.3/1,000行で、課金はタスクによって生成された出力行数に基づきます。
なぜ一部のX(旧Twitter)フィールドは空になることがあるのですか?
ソースページは、すべてのレコードのすべての値を常に公開するわけではなく、レイアウトはアイテム、市場、または現在のサイトの応答によって異なる場合があります。テンプレートは、現在のページがフィールドを提供する場合にそれを返します。
収集したX(旧Twitter)データをエクスポートできますか?
Octoparseで構造化された行を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理できます。
🔗 関連テンプレート
- Twitter (X) コメントスクレイパー — レビューまたはコメントレベルのレコードが必要な場合は、Twitter (X) コメントスクレイパーを使用します。
- Twitter 高度な検索コメントスクレイパー — レビューまたはコメントレベルのレコードが必要な場合は、Twitter 高度な検索コメントスクレイパーを使用します。
- Twitter スクレイパー(アカウントURL別) — 同じソースサイトでの補完的なワークフローには、Twitter スクレイパー(アカウントURL別)を使用します。