チャプロAI
サービス操作マニュアル
ログイン新規無料登録
トップサービス操作マニュアル
ログイン新規無料登録
通常データ分析・統計

Webページからhタグの見出しを抽出するプロンプト

whaja

Webページの見出しの効率的抽出

指定したWebページからh1~h6タグの見出しを効率的に抽出し、階層構造を保持する。

WebページのHTMLを解析し、h1〜h6タグの見出しを出現順に抽出します。抽出された見出しは、階層構造を保持したネストリスト形式でまとめます。これにより、Webページの構造を把握しやすくなり、データとして他の用途に活用することができます。Webスクレイピングの手法を活用して行います。

プロンプト本文

# 前提条件:
- タイトル:Webページからhタグの見出しを抽出する
- 依頼者条件:Webページの構造を解析し、見出し情報を取得したい人
- 前提情報:HTML構造の基本的な知識と、Webスクレイピングの手法を理解していること
- 目的と目標: 指定したWebページからh1~h6タグの見出しを効率的に取得し、整理されたデータとして活用する
- 解析には、一般的なWebスクレイピング手法(例:PythonのBeautifulSoup、Selenium、JavaScriptのPuppeteerなど)を活用できます。

# 実行指示:
{%%input1%%}を解析し、見出しタグ(h1〜h6)を抽出してください。
それぞれの見出しの階層を保持し、ネストされたリスト形式で出力してください。
見出しはHTML上の出現順にリストアップしてください。
出力形式は[# 出力フォーマット]に従ってください。

# 出力フォーマット

見出し一覧:
- [h1] [見出しの内容]
- [h2] [見出しの内容]
- [h3] [見出しの内容]
- [h4] [見出しの内容]
- (必要に応じて追加)
Webページ
チャプロAI
運営会社利用規約個人情報保護方針
© 2026 チャプロAI All rights reserved.