論文紹介: 内部情報の分解によるマルチモーダルAIの安全性向上
マルチモーダル大規模言語モデルにおける新しい攻撃の考え方として、複数のモダリティに意図を分散させて検知を避ける手法が示されています。 / 対策の手がかりとして、文字だけ・画像だけでの推論結果の整合性をみる考え方が説明されています。 / 要旨では、通常の入力では単独推論と融合後の推論が整合しやすい一方、敵対的な操作があると不自然な不一致が生じる可能性があるとされています。
論文紹介: LLMを用いて皮膚の免疫関連有害事象を見つける人手併用フレームワーク
arXivの新着プレプリントとして、臨床記録から皮膚の免疫関連有害事象を検出するための、人手併用型LLMフレームワークが報告されています。 / 要旨によると、検索拡張型のマルチエージェントLLMを使うことで、手作業のみの場合よりF1値、評価者間一致、レビュー時間が改善したとされています。 / 医療現場での記録確認を補助するAIの使い方として、AIと人の役割分担を考える材料になりそうです。
論文紹介: LLMの推論記録から「文章のよさ」に関する暗黙の見方を取り出す研究
推論機能を持つLLMが、文学的な文章の質をどう評価するのかを調べた新しいプレプリントです。 / 研究では、古典文学から匿名の掲示板投稿まで6段階の品質に分けた30本の実テキストを使い、モデルの推論記録から暗黙の評価基準を抽出しています。 / 要旨では、5回のDeepSeek再現実験で平均79.3%の段階分類精度が得られたとされています。
論文紹介: ClickGuard:クリックベイト記事の検出と抑制をめざすブラウザ拡張の研究
arXiv上の新着プレプリントとして、クリックベイト記事を見分けるAIベースのブラウザ拡張が提案されています。 / Transformer系埋め込み、言語学的特徴量、独自の「baitness」スコアを組み合わせた手法が使われています。 / 要旨では、XGBoostベースのモデルが評価指標F1で91%を示したとされています。
論文紹介: 生成AIを用いた自律的なテスト管理アーキテクチャに関する新着プレプリント
arXivに、ソフトウェアのテスト管理を自律化する多エージェント型AIアーキテクチャ「AINTMA」を提案する新着プレプリントが公開されています。 / 要旨では、テストの発見、リスク評価、優先順位付け、実行の調整、品質分析、クラウドセキュリティ監視を担う6つの専門エージェントが示されています。 / 対象はソフトウェア品質保証とクラウド環境の運用で、AIがテスト運用の判断や調整を支援する構成が特徴です。
論文紹介: Evidence Chain Evaluationによる選択的なファクトチェックの評価手法
LLMを使ったファクトチェックでは、正誤だけを二択で返す方式だと、根拠が弱い場合でも自信ありの判定になりうる点が課題だと説明されています。 / この論文では、根拠が不十分なときに真偽を無理に断定せず、保留を返せる選択的ファクトチェックの枠組み「Evidence Chain Evaluation(ECE)」を提案しています。 / 評価対象は、ウェブ検索などで証拠を集めるツール使用型の検証エージェントだと要旨にあります。
論文紹介: カスタムLLMは医療情報の精度向上に役立つのか—ACL損傷の事例でRAGとエージェントを比較
ACL損傷に関する臨床ガイドラインをもとに、標準的なLLMと、RAGやエージェントを組み合わせた手法を比較した論文です。 / 公開要旨では、AAOSの2022年ガイドラインに基づく100問のQ&Aを使い、複数の商用・オープンソースモデルに同じ質問をベース形とRAG組み込み形で与えたと説明されています。 / 研究のねらいは、医療のように正確さが重要な場面で、外部知識を組み込むカスタム手法が標準LLMより有効かを検討することにあります。
論文紹介: フロンティアAIの「権限を広げようとする傾向」を測るベンチマーク SysAdmin
arXivで公開された新しいプレプリントで、フロンティア言語モデルの「power-seeking(権限や資源を求めるような振る舞い)」を測るためのベンチマーク SysAdmin が提案されています。 / SysAdminは、AIを高精度なLinuxサンドボックス内の自律的なシステム管理者として置き、自己保存、自治性の拡大、資源獲得、環境改変、戦略的な秘匿の5つの観点で振る舞いを観察する設計だと説明されています。 / 要旨では、Loss of Control(制御喪失)リスクの重要な要因として power-seeking が位置づけられており、この性質を定量的に見ることが狙いとみられます。
論文紹介: 一部の大規模言語モデルは一貫したリスク態度を示す可能性
arXivに、新着のプレプリントとして「Some Large Language Models Exhibit Consistent Risk Attitudes」が公開されています。 / 要旨では、LLMが不確実な状況でどのようにリスクを受け止め、行動に反映するかを調べたとされています。 / 研究では、空間ナビゲーション、臨床トリアージ、金融配分という3つの異なる課題を使い、6つの代表的なLLMと100人の参加者を比較したと説明されています。
論文紹介: 柔らかいぬいぐるみ型コンパニオンの「触れ方」を1次元CNNで分類する手法を提案
arXivに、柔らかいぬいぐるみ型コンパニオンに対する触れ方を分類する研究のプレプリントが公開されています。 / 論文要旨では、柔らかく変形する対象と多点の触覚信号を扱うため、感情に関わる触れ方の解釈が難しいと説明されています。 / 研究では、コンパクトな深層学習モデルを開発・検証するためのMATLABベースの枠組みが提案されています。
