論文紹介: LLMエージェントの「存在しないツール呼び出し」を扱う新しい測定研究

要点

  • ツールを使うLLMエージェントが、存在しないツール名を呼び出したり、定義されていない引数を渡したりする問題を扱っています。
  • 既存の防御は、適切なツールを選ぶ仕組みや、実在するツールの利用を制限する仕組みが中心で、このタイプの失敗は想定しきれていないと説明されています。
  • 著者は、この問題を構造的な見落としとして捉え、測定を通じて整理していると要旨から読み取れます。

概要

arXivに掲載された新着プレプリントで、ツールを使うLLMエージェントが「存在しないツールを呼び出す」「定義されていない引数を渡す」といった失敗をどう捉えるべきかを扱っています。要旨では、既存の対策は主に「正しいツールを選ぶ」ことや「実在するツールの利用を制限する」ことに焦点があり、この種類の失敗を十分に扱えていないと説明されています。

著者は、この問題が単なる選択ミスではなく、仕組みの前提から外れた構造的な見落としだと位置づけているようです。要旨の範囲では、本論文は主として測定研究として書かれていると読めます。

技術的なポイント

  • 対象は、ツール拡張型のLLMエージェントです。
  • 論点は、ツール選択やゲーティングの防御だけでは「存在しない呼び出し」を拒否できない、という点にあります。
  • 要旨では、この失敗は「ゲートが下した決定」ではないため、従来型の防御の枠組みでは取りこぼされると述べられています。
  • 公開情報の範囲では、具体的な評価設定や実験結果の詳細はまだ限られています。

研究上の位置づけ

LLMエージェントの安全性研究では、どのツールを選ぶか、どの操作を許すかに注目が集まりやすい一方で、そもそも呼び出し自体が実在しない場合の扱いは見落とされがちです。本論文は、その盲点を整理する入口として読めます。

現時点では、ツール利用の安全対策を考える際に「正しいツールを選ぶ」だけでなく、「存在しない呼び出しをどう検知・遮断するか」も別の論点として考える必要がある、という示唆が得られます。

実務への示唆

  • エージェント設計では、ツール名の検証やスキーマ一致の確認をより厳密に見る必要がありそうです。
  • 防御を評価する際は、実在ツールへの不正利用だけでなく、幻覚的な呼び出しもテスト項目に含めるとよいでしょう。
  • 運用面では、ツール実行前の検証層を分けて設ける設計が有用かもしれません。

子こども向むけの説明せつめい

AIが道具箱どうぐばこを使つかう場面ばめんを思おもい浮うかべてみてください。ふつうは「はさみを取とって」と言いえば、ちゃんとある道具どうぐを取とります。でも、この研究けんきゅうは、AIが道具箱どうぐばこにない名前なまえの道具どうぐを呼よんでしまうことがある、という話はなしです。

もし道具箱どうぐばこに入はいっていないものを「ある」と思おもいこむと、困こまってしまいますよね。この論文ろんぶんは、そのような間違まちがいを見みつけて、どう気きをつければよいかを考かんがえるための研究けんきゅうです。ただし、どこまで改善かいぜんできるかは、これから詳くわしく確たしかめる必要ひつようがあります。

考かんがえてみよう

  • AIが道具どうぐの名前なまえをまちがえないようにするには、どんな工夫くふうがあるでしょうか。
  • 道具箱どうぐばこにないものを使つかおうとしたとき、どうやって止とめればよいでしょうか。
  • AIが便利べんりに働はたらくために、どんな安全あんぜんのしくみがあると安心あんしんでしょうか。

注意点

  • arXivの新着プレプリントで、公開情報は要旨と書誌情報に限られます。
  • 本文の詳細、評価条件、実験結果、結論の強さは現時点では要旨から十分に確認できません。
  • 著者の主張は、要旨の範囲では主に問題設定と測定の方向性として把握できますが、効果の大きさや実運用での有効性は要確認です。
  • 査読済みかどうかは不明ではなく、プレプリントとして扱うのが適切です。

出典

Source: arXiv AI新着論文
Original title: Closed-World Resolution Against Tool Hallucination in LLM Agents
Published: 2026-09-18 04:00:00
URL: https://arxiv.org/abs/2609.19425

※本記事は、原文の全文翻訳ではなく、公開情報をもとにした日本語要約・解説です。内容の正確性については、必ず原文もご確認ください。