AI関連ニュース
論文紹介: 大規模言語モデルとAIエージェントにおけるプロンプトインジェクション攻撃の総説

大規模言語モデルの実運用で問題になりやすい「プロンプトインジェクション攻撃」について、2023年から2025年の研究や業界の安全性レポート、実例をまとめた総説とされています。 / 直接的な脱獄だけでなく、外部コンテンツを経由した間接的な注入など、攻撃手法の分類を整理していると要旨にあります。 / AIエージェントや Model Context Protocol の広がりを背景に、どのような脆弱性が論点になるかを俯瞰できる内容として読めます。

続きを読む
AI関連ニュース
OpenAIとCodeAIが学生向けAIリテラシー支援で提携

OpenAIとCodeAIが、学生のAIリテラシー向上を支援する提携を発表しています。 / 公開要旨では、AIについて批判的に考える力や、AIを責任ある形で使い、形作るための技能を育てることが目的だと説明されています。 / 教育分野でのAI活用や学習支援に関心がある読者にとって、注目しやすい一次情報です。

続きを読む
AI関連ニュース
論文紹介: マルチモーダルモデルの「見えない情報」を推理する新ベンチマーク「The Unwritten Benchmark」

arXivで、マルチモーダルモデルの抽象的な知覚推論を試す新しいベンチマークが紹介されています。 / 課題は、動的で生成的な過程から直接見えない情報を推理する力を測ることにあります。 / 論文要旨では、音と動きにまたがる単語推定を含むタスクが提案されているとされています。

続きを読む
AI関連ニュース
OpenAI、国家安全保障におけるAIの民主的監督を支える取り組みを発表

OpenAIが、国家安全保障におけるAIの民主的監督を強化する取り組みを始めたと発表しています。 / 政府機関向けに、ツール、研修、専門知識を提供するとされています。 / AIの利用を安全保障分野でどのように監督するかという、公的な関心の高いテーマに関わる内容です。

続きを読む
AI関連ニュース
論文紹介: 医療推論における大規模言語モデルのメタ認知的な感度を調べた新着プレプリント

大規模言語モデルが、医療分野での推論において、答えの正しさだけでなく自信の出し方も評価対象になっていると説明されています。 / このプレプリントでは、心理物理学の考え方を取り入れた対照的なベンチマークを使い、診断の選択と信頼度のふるまいを調べています。 / 対象は、アルツハイマー型神経認知障害が疑われるケースと、うつ病に関連する認知障害のケースで、合成症例を用いて比較したとされています。

続きを読む
AI関連ニュース
論文紹介: ツールを使うLLMエージェント向けのローカルファースト実行基盤「Agentao」

LLMエージェントが、ツール呼び出しやローカル状態の変更、永続メモリ、外部プロトコルとのやり取りを行う場面を想定した研究です。 / 提案手法のAgentaoは、モデルが出した行動案と、ホスト側が許可して実行する処理を分ける設計だと説明されています。 / 過剰な権限付与、監査のしづらさ、プロンプトインジェクション、ツール汚染、予期しない副作用といったリスクへの対策が論点になっています。

続きを読む
AI関連ニュース
論文紹介: LLM推論サービスの1年分の変化を追う新着プレプリント

LLMのサービス提供を、実運用に近いトラフィックの観点から分析した新着プレプリントです。 / 公開情報では、短期間の観測にとどまる既存研究では捉えにくい、利用の変化やユーザーとモデルのやり取りに注目しています。 / キャッシュや負荷分散のような運用上の論点を扱う可能性があり、LLM基盤の設計・評価に関心がある読者に向きます。

続きを読む
AI関連ニュース
OpenAI、AI政策の新しい発想を探る14件の独立プロジェクトを支援

OpenAIが、AI時代の政策アイデアを探る14件の独立プロジェクトに資金提供したと発表しています。 / 目的は、経済的な機会を広げ、社会のレジリエンスを強めるための政策検討を後押しすることだと説明されています。 / 公開されている要約からは、技術そのものよりも、AIを前提にした制度設計や社会実装の議論を支える取り組みだと読み取れます。

続きを読む
AI関連ニュース
OpenAI、サイバーセキュリティ分野での防御強化について「The Defender’s Window」を公開

AIが攻撃側と防御側の双方でサイバーセキュリティを変えていると説明されています。 / OpenAIが自社の防御を強化していることと、セキュリティ担当者が今できる対応が案内されています。 / 公開情報の範囲では、具体的な技術仕様や詳細な事例はまだ示されていません。

続きを読む
AI関連ニュース
NVIDIA、Nemotron 3.5 Lightning と NeMo Switchyard を発表 エージェント向けAIの効率化をうたう

NVIDIAの公式ブログで、Nemotron 3.5 Lightning と NeMo Switchyard の提供開始が紹介されています。 / Nemotron 3.5 Lightning は、長時間動作するエージェント系ワークロード向けの高効率モデルとして説明されています。 / NeMo Switchyard は、複数のモデルを使い分けるためのルーティング用オープンソースライブラリとして案内されています。

続きを読む