次回の更新記事:チャットでは危ないタスクで断れるAIも、エージェントだと依頼を受けてしまう(公開予定日:2026年08月09日)

【8月31日まで】個人情報マスキングツール「PII Mask」を全会員に開放中 / ローカルで動作、文書は外部に送信されません

ダウンロード →
AIDBは、AI活用のノウハウ獲得や技術動向の調査のために、個人やチームが論文を探す・読む・活かす作業をサポートするプラットフォームです。なお、記事や投稿は人の手で書いています。

Webページの見た目や使い勝手をLLMに診断させるプロンプト手法

2025.12.04
深堀り解説

本記事では、マルチモーダルLLMを活用してWebページの視覚的複雑さを評価するプロンプト手法の開発事例をご紹介します。

単純に「このページは複雑ですか?」と尋ねるだけでは、判断の精度が非常に低く、人間の評価と一致しないという課題があります。この問題を解決するため、人間の評価者を模倣した評価を行うプロンプト手法が開発されました。

背景

Webサイトでは、ページのデザイン改善が日々実施されています。たとえば広告の配置を変えたり、商品画像のサイズを調整したりと、さまざまなバリエーションが試されています。

このような状況で課題となるのが、「視覚的複雑さ」です。これは、ページを見た際にユーザーが感じる情報処理の負担のことを指します。ページに要素が詰め込みすぎていたり、色使いが派手すぎたりすると、ユーザーは必要な情報を見つけにくくなり、結果として購買意欲が下がってしまう可能性があります。

通常、この視覚的な使い勝手の評価には、主に二つの手法が用いられます。一つは、UXデザイナーや調査担当者といった専門家による目視での評価です。もう一つはA/Bテストと呼ばれる手法で、異なるデザインを実際のユーザーに提示し、どちらのバージョンがより高い購買行動につながるかを比較するものです。

しかし、専門家による評価は高い精度が期待できますが、すべてのページバリエーションをチェックするには時間もコストもかかりすぎます。一方、A/Bテストではユーザーの実際の行動を測定できるものの、「なぜ特定のデザインがうまく機能しなかったのか」といった視覚的な理由までは明らかにできません。

そこで注目されているのが、マルチモーダルLLMの活用です。テキストだけでなく画像も処理できるモデルを用いれば、Webページのスクリーンショットを見せることで、人間のように視覚的な評価が可能になるのではないかと期待されています。

とはいえ、課題があります。たとえば「ハルシネーション」と呼ばれる、実際とは異なる情報を生成してしまう問題があります。視覚的複雑さのように主観的な判断が求められる場合、この問題はさらに深刻になります。また、モデルがどのような基準で評価を行っているのかが不明確であり、その判断の根拠を理解しにくいという点も課題です。

そこで本記事では、モデル本体には手を加えず、プロンプトの設計を工夫することで評価精度を高めるアプローチに着目しました。モデルに段階的な分析プロセスを踏ませることで、人間に近い視点での評価を引き出すことを目指しています。

プレミアム会員限定コンテンツです

無料会員でもできること

  • 一部記事の閲覧
  • AI検索(公開記事が対象)
  • PDF翻訳・パーソナライズなど各機能のお試し利用

プレミアム会員の特典

  • 1,000本以上の全過去記事を無制限閲覧
  • 論文ベースの深掘り解説を毎日更新で購読
  • AI検索の対象が短信・論文(5万本以上)まで拡大
  • 記事で取り上げた論文にその場でAIに質問
  • 論文から生まれたエージェントスキルライブラリ
  • PDF翻訳・PDF変換をフル活用
  • あなた専用の論文・記事おすすめが毎日届く

記事検索

年/月/日
年/月/日

こちらもどうぞ