AI関連ニュース
論文紹介: 信頼できるAIの実装を支えるツールや認証枠組みを批判的に分析

arXivの新着プレプリントとして、信頼できるAI(Trustworthy AI)の実装を支えるツールや認証枠組みを批判的に分析する論文です。 / 要旨では、AI倫理の指針は増えている一方で、実務で使える具体的な仕組みが不足しているという問題意識が示されています。 / OECDのデータセットを用いて、ツールやトラストマークの枠組みを地図化し、比較する分析を行ったと説明されています。

続きを読む
AI関連ニュース
論文紹介: LLMのChain-of-Thoughtが前提に本当に依存しているかを調べるブラックボックス手法

arXivで公開されたプレプリントで、LLMのChain-of-Thoughtが見た目には筋が通っていても、実際には前提にどれだけ依存しているかを点検する手法が提案されています。 / 提案手法は、1つの前提の述語を新しい記号に置き換えて再実行し、各推論ステップの結論が変わるかを確認するブラックボックス型のテストです。 / 著者は、合成的な多段推論ベンチマークProntoQAで評価したと説明しています。

続きを読む
AI関連ニュース
論文紹介: 自己改善するエージェントシステムの整理と見取り図を示すサーベイ

arXivで、自己改善する自律エージェントを扱うサーベイ論文が公開されています。 / 要旨では、経験をもとに能力を蓄積していく「自己改善」を、現代的なエージェントのシステム全体として整理しています。 / エージェントを、基盤モデルと、プロンプト・記憶・ツール・制御ロジックからなる運用層の組み合わせとして捉える枠組みを提案していると説明されています。

続きを読む
AI関連ニュース
論文紹介: Belnapの型付き意図論理に基づくニューロシンボリックAGIロボットの確率的拡張

arXivに、ニューロシンボリックAIの論理基盤を確率的に拡張する研究のプレプリントが公開されています。 / 要旨では、未確定な文に対する確率計算を導入し、知識ベースと論理的推論を保ちながら扱える枠組みを広げると説明されています。 / また、知識ベースと論理的推論を保つ対称変換を提案したとされています。

続きを読む
AI関連ニュース
論文紹介: SPINE: エージェント型AIでロボットの実機導入を支える手法

Foundation models をロボットの判断に活用する流れの中で、実機への導入や調整の手間が課題だと説明されています。 / SPINE は、二腕ロボットのデバッグと導入を、複数のエージェントが協調する枠組みで進める手法として提案されています。 / 著者らは、ロボット工学の専門知識が少ない状況でも、実機への適用を進めやすくすることを目指しています。

続きを読む
AI関連ニュース
論文紹介: 矛盾する仮説を扱う新しいアブダクション拡張を提案した preprint

arXiv に、cs.AI 分野の preprint として新しい論文が公開されています。 / 要旨では、既存の AGM 的なアブダクション拡張を土台に、矛盾する説明仮説を取り込めるパラコンシステントな拡張操作を提案するとされています。 / 論文の公開範囲からは、説明仮説の扱いと、その公理・公準の整理が主な焦点とみられます。

続きを読む
AI関連ニュース
論文紹介: YUKTIの提案する、自然言語の状況説明から検証可能な意思決定を導く手法

arXiv上の新着プレプリントで、自然言語で書かれた状況説明から、数値計画を作るAIの枠組みが提案されています。 / 要旨では、従来の手法が単一の目的関数や固定値の係数に依存しやすく、前提が少しずれるだけで計画が脆弱になりうる点が問題として挙げられています。 / YUKTIは、前提や不確実性を扱うための表現を用い、頑健性や検証可能性を重視した意思決定に向けた枠組みを目指す内容だと説明されています。

続きを読む
AI関連ニュース
論文紹介: フォーマットの違いがLLM評価に与える影響を測る新指標「FSI」「PSI」

arXivの新着プレプリントで、プロンプトの見た目や書式の違いがモデル評価にどれだけ影響するかを扱っています。 / 著者は、正答率の振れ幅を示すFSIと、回答を機械的に解析できるかの振れ幅を示すPSIという2つの指標を提案しています。 / 7つのQAタスク、5種類のラッパー、4つの指示追従モデルを用いた大規模な生成実験に基づく内容です。

続きを読む
AI関連ニュース
論文紹介: トゥールミン・モデルを用いた画像診断の説明可能な支援手法

arXivの新着プレプリントとして、画像ベースの診断結果をそのまま受け取るのではなく、主張・根拠・反論などに分けて整理する枠組みが提案されています。 / 要旨では、網膜診断の機械学習予測に対して、説明可能AI(XAI)とは別に、議論の構造を使って診断を支援する考え方が示されています。 / 画像から生体指標を抽出するモデルと、診断の妥当性を構造化するモデルを組み合わせる設計が述べられていますが、詳細は要旨の範囲では限定的です。

続きを読む
AI関連ニュース
論文紹介: 多層パーセプトロンの敵対的頑健性を区間認証で扱う理論枠組み

arXivに、敵対的頑健性を対象にした理論研究の新着プレプリントが公開されています。 / 多層パーセプトロン(MLP)について、認証可能な区間を用いて問題をラティス走査に還元する枠組みを提案しています。 / AI安全性の基礎的な課題に対し、証明や認証の観点から整理した研究として紹介できる内容です。

続きを読む