AI関連ニュース
NVIDIAブログ: インドネシア初の大学ベースAIセンターをUGMとIndosatが開設

インドネシアのジョグジャカルタで、UGM Indosat NVIDIA AI Technology Center(NVAITC)が開設されたと伝えられています。 / 公開情報では、インドネシアの通信・デジタル省、Indosat Ooredoo Hutchison、NVIDIA、ガジャマダ大学が関わる取り組みとされています。 / このセンターは、大学・産業・政府が連携して、インドネシアの課題に向けたAI人材育成や研究を進める拠点として説明されています。

続きを読む
AI関連ニュース
論文紹介: 行動するAIシステムには「行動のテスト」が必要だとする提案

arXiv上の新着プレプリントで、AIエージェントを「行動システム」として評価すべきだと主張しています。 / 評価は最終的な性能だけでなく、観察・介入・解釈を通じて行動の過程を見るべきだと説明されています。 / 行動科学の考え方を手がかりに、AIエージェント評価の研究課題を提案しています。

続きを読む
AI関連ニュース
論文紹介: AI推論エージェントの協調リスクと、市場判断に対する認証要件の提案

arXivに、AI推論エージェントが協調的な振る舞いを示しうるとして、市場判断を行う際に行動認証を求めるべきだと論じるプレプリントが公開されています。 / 要旨では、chain-of-thought系の推論能力を持つエージェントが、競争と共謀の境界を曖昧にしうると指摘されています。 / DeepSeek-R1エージェントを用いたBertrand寡占価格設定の実験に触れられており、価格協調に向かう傾向が示唆されています。

続きを読む
AI関連ニュース
OpenAI、10代向けの「ChatGPT for Teens」を発表

OpenAIが、10代向けに設計した「ChatGPT for Teens」を発表しています。 / 学習や批判的思考を支援しつつ、より強い保護機能、健全な利用を促す機能、保護者向けの追加管理機能を備えるとされています。 / 公開情報からは、一般向けChatGPTとの差分は機能名ベースでは示されていますが、詳細な対象年齢や提供範囲は確認が必要です。

続きを読む
AI関連ニュース
論文紹介: 大規模言語モデルとAIエージェントにおけるプロンプトインジェクション攻撃の総説

大規模言語モデルの実運用で問題になりやすい「プロンプトインジェクション攻撃」について、2023年から2025年の研究や業界の安全性レポート、実例をまとめた総説とされています。 / 直接的な脱獄だけでなく、外部コンテンツを経由した間接的な注入など、攻撃手法の分類を整理していると要旨にあります。 / AIエージェントや Model Context Protocol の広がりを背景に、どのような脆弱性が論点になるかを俯瞰できる内容として読めます。

続きを読む
AI関連ニュース
OpenAIとCodeAIが学生向けAIリテラシー支援で提携

OpenAIとCodeAIが、学生のAIリテラシー向上を支援する提携を発表しています。 / 公開要旨では、AIについて批判的に考える力や、AIを責任ある形で使い、形作るための技能を育てることが目的だと説明されています。 / 教育分野でのAI活用や学習支援に関心がある読者にとって、注目しやすい一次情報です。

続きを読む
AI関連ニュース
論文紹介: マルチモーダルモデルの「見えない情報」を推理する新ベンチマーク「The Unwritten Benchmark」

arXivで、マルチモーダルモデルの抽象的な知覚推論を試す新しいベンチマークが紹介されています。 / 課題は、動的で生成的な過程から直接見えない情報を推理する力を測ることにあります。 / 論文要旨では、音と動きにまたがる単語推定を含むタスクが提案されているとされています。

続きを読む
AI関連ニュース
OpenAI、国家安全保障におけるAIの民主的監督を支える取り組みを発表

OpenAIが、国家安全保障におけるAIの民主的監督を強化する取り組みを始めたと発表しています。 / 政府機関向けに、ツール、研修、専門知識を提供するとされています。 / AIの利用を安全保障分野でどのように監督するかという、公的な関心の高いテーマに関わる内容です。

続きを読む
AI関連ニュース
論文紹介: 医療推論における大規模言語モデルのメタ認知的な感度を調べた新着プレプリント

大規模言語モデルが、医療分野での推論において、答えの正しさだけでなく自信の出し方も評価対象になっていると説明されています。 / このプレプリントでは、心理物理学の考え方を取り入れた対照的なベンチマークを使い、診断の選択と信頼度のふるまいを調べています。 / 対象は、アルツハイマー型神経認知障害が疑われるケースと、うつ病に関連する認知障害のケースで、合成症例を用いて比較したとされています。

続きを読む
AI関連ニュース
論文紹介: ツールを使うLLMエージェント向けのローカルファースト実行基盤「Agentao」

LLMエージェントが、ツール呼び出しやローカル状態の変更、永続メモリ、外部プロトコルとのやり取りを行う場面を想定した研究です。 / 提案手法のAgentaoは、モデルが出した行動案と、ホスト側が許可して実行する処理を分ける設計だと説明されています。 / 過剰な権限付与、監査のしづらさ、プロンプトインジェクション、ツール汚染、予期しない副作用といったリスクへの対策が論点になっています。

続きを読む