o1モデルが人間のように6つの思考パターンを使い分けているとの実験結果

本記事では、AIの性能向上における「推論...
Read More

IBMから日本語対応の商用可能オープンソースLLM「GRANITE 3.0」公開 8Bから

本記事では、IBMが新たに開発した軽量な...
Read More

計画のステップが増えるほど、LLMは最初の目標を見失っていく傾向がある

本記事では、LLMを活用したエージェント...
Read More

LLMの推論能力は単純に文脈を繰り返すだけでも大幅に向上 最大で30%改善

本記事では、LLMの多段階推論能力を向上...
Read More

エージェント

民事裁判をLLMで模倣 シミュレートを経てLLMの法律能力が強化される
LLMから「LLMエージェント」へ ソフトウェアエンジニアリングにおける今後の展開
Sakana AIが科学研究自動化フレームワーク『The AI Scientist』開発
LLMベースの万能エンジニアを構築する『OpenDevin』プラットフォーム
Appleが「LLMエージェントの評価」に特化したベンチマーク『MMAU』を開発 5領域5能力で測る
Among UsのようなゲームでLLMエージェントはどれほど活躍できるか
キャラが自律的に対話しながら物語の台本を生成するLLMベースのシステム『IBSEN』
LLMで心理評価をゲーミフィケーションする方法
PAGE TOP