次回の更新記事:【論文著者インタビューあり】そのAIエージェントはどれくらい危ない恐れがあるのか、点数で決める方法(公開予定日:2026年07月30日)
AIDBは、AI活用のノウハウ獲得や技術動向の調査のために、個人やチームが論文を探す・読む・活かす作業をサポートするプラットフォームです。なお、記事や投稿は人の手で書いています。

Among UsのようなゲームでLLMエージェントはどれほど活躍できるか

2024.07.26
深堀り解説

本記事では、LLMを用いた複雑なマルチエージェントゲーム環境の研究を紹介します。研究者らは「Among Us」をベースにした環境で、LLMエージェントの推論能力や戦略的思考を評価しました。また、エージェントのパーソナリティ(性格)などがゲームにもたらす影響も検証されました。

参照論文情報

  • タイトル:AMONGAGENTS: Evaluating Large Language Models in the Interactive Text-Based Social Deduction Game
  • 著者:Yizhou Chi, Lingjun Mao, Zineng Tang
  • 所属:UC Berkeley, Tongji University

背景

これまで、複数のLLMをエージェントとして実行する実験において、人間のような社会的行動のシミュレーションが可能であることが示されてきました。

こうしたLLMの能力をより複雑な状況で試すため、研究者たちは「人狼」など言葉を駆使するゲームを用いた実験を行っています。曖昧な表現や相手を欺く発言など、人間でも判断が難しい言語使用が求められるのがゲームの特徴です。

しかし、これまでの研究では、単純な会話やゲーム内の単純な動きを超えた部分は十分に探求されていませんでした。そこで今回研究者らは、「Among Us」というゲームを題材に、「不完全な情報」や「多様な行動選択肢」がある中でのLLMの能力を検証することにしました。

Among Usは、戦略の立案、他プレイヤーの欺き、協力してタスクをこなすなど、複雑な要素を含む(非常に有名な)ゲームです。研究チームは、このゲームを模したテキストベースの環境「AMONGAGENTS」を開発し、LLMがゲームのルールを理解し、勝利を目指してどのように行動するかを観察しました。また、エージェントに異なる性格を与えたり、行動を計画する機能の有無を変えたりすることで、それらが性能にどう影響するかも調べました。

以下で全貌を詳しく紹介します。

プレミアム会員限定コンテンツです

無料会員でもできること

  • 一部記事の閲覧
  • AI検索(公開記事が対象)
  • PDF翻訳・パーソナライズなど各機能のお試し利用

プレミアム会員の特典

  • 1,000本以上の全過去記事を無制限閲覧
  • 論文ベースの深掘り解説を毎日更新で購読
  • AI検索の対象が短信・論文(5万本以上)まで拡大
  • 記事で取り上げた論文にその場でAIに質問
  • 論文から生まれたエージェントスキルライブラリ
  • PDF翻訳・PDF変換をフル活用
  • あなた専用の論文・記事おすすめが毎日届く

記事検索

年/月/日
年/月/日

こちらもどうぞ