冒頭を聴く(高品質音声)約1分
速度:
全文の音声はプレミアム会員限定です。
本記事で取り上げる論文の著者にインタビューを行いました。許諾を頂きましたので、下部に回答を掲載いたします。

会社の中でAIエージェントを使う場面が増えてきました。コードを書くもの、社内文書に答えるもの、外部サービスを呼び出すもの。種類が増えると、「このうちどれをどれくらい警戒すべきか」という問いが重くなります。
この問いに点数で答えるための採点方法が提案されました。12個の質問に1点から3点で答えていくと、そのエージェントが「低・中・高」のどのリスクにあたるかが決まる仕組みです。
実際に試してみると、意外な結果が出てきます。人間に助言するだけのおとなしいツールが、最も危ない「高リスク」に分類されるのです。なぜそうなるのでしょうか。
以下で詳しく見ていきましょう。