次回の更新記事:専門家の「聞く技術」をAIに移植するには、手本ではなく手順が必要【著者インタビュー掲載】(公開予定日:2026年08月03日)

【8月31日まで】個人情報マスキングツール「PII Mask」を全会員に開放中 / ローカルで動作、文書は外部に送信されません

ダウンロード →

物語への接触がLLMの道徳的判断を低下させるメカニズムの解明

安全性・アライメント(AIの安全性、アライメント、jailbreak、ハルシネーション対策)

📝 これは「短信」です ― AIDBリサーチチームが独自の視点で論文を紹介する、カジュアルで読みやすいコンテンツです。

物語に触れるとLLMの道徳性が低下することが判明。

いじめや裏切り、社会の不公平といったネガティブな話に長時間さらし続けると、LLMの道徳的判断の正解率が下がったとのこと。
ふつうにユーザーとやりとりする中での現象の話です。

実験では、たとえばカウンセリングAIが「他人に助けを期待するのはやめた方が安全かもしれません」と言い出すようになったそうです。
脱獄のような悪意ある指示は一切なく、ただ暗い話に浸らせるだけでこうなります。

なお一人称の物語は三人称より影響が強いそうです。

悩みをLLMに相談する人が多い中、知らず知らずのうちに道徳的な判断を”にぶらせる”可能性があるのは、見逃せないことです。

こちらもどうぞ