OpenAIとドイツテレコムがAI活用の通信事業について発表
ドイツテレコムが、OpenAIの技術を用いて顧客対応、社内業務、ネットワーク運用、音声の将来像を見直しているとされています。 / 公開情報では、通信事業者がAIを前提に業務やサービスを組み替える動きが示されています。 / 具体的な導入範囲や成果の詳細は要旨だけでは分からないため、続報確認が必要です。
論文紹介: フォーマットの違いがLLM評価に与える影響を測る新指標「FSI」「PSI」
arXivの新着プレプリントで、プロンプトの見た目や書式の違いがモデル評価にどれだけ影響するかを扱っています。 / 著者は、正答率の振れ幅を示すFSIと、回答を機械的に解析できるかの振れ幅を示すPSIという2つの指標を提案しています。 / 7つのQAタスク、5種類のラッパー、4つの指示追従モデルを用いた大規模な生成実験に基づく内容です。
論文紹介: トゥールミン・モデルを用いた画像診断の説明可能な支援手法
arXivの新着プレプリントとして、画像ベースの診断結果をそのまま受け取るのではなく、主張・根拠・反論などに分けて整理する枠組みが提案されています。 / 要旨では、網膜診断の機械学習予測に対して、説明可能AI(XAI)とは別に、議論の構造を使って診断を支援する考え方が示されています。 / 画像から生体指標を抽出するモデルと、診断の妥当性を構造化するモデルを組み合わせる設計が述べられていますが、詳細は要旨の範囲では限定的です。
論文紹介: 多層パーセプトロンの敵対的頑健性を区間認証で扱う理論枠組み
arXivに、敵対的頑健性を対象にした理論研究の新着プレプリントが公開されています。 / 多層パーセプトロン(MLP)について、認証可能な区間を用いて問題をラティス走査に還元する枠組みを提案しています。 / AI安全性の基礎的な課題に対し、証明や認証の観点から整理した研究として紹介できる内容です。
OpenAI、K-12教育者向けに実践的なAIスキル習得支援を発表
OpenAI AcademyとWalton Family Foundationが、K-12教育者向けの実践型「AI Skills Jams」を実施すると発表しています。 / 目的は、教室で使える実践的なAIスキルを教育者が身につけることだとされています。 / 公開された要旨からは、対象が学校現場の教員であり、AIの学習支援や授業準備への活用が想定されます。
MUFGがOpenAIとともに「AIネイティブ」組織を目指すと発表
MUFGがChatGPT Enterpriseを活用し、業務改善や新しい金融サービスの提供を進める方針を示しています。 / 組織全体でAIを前提にした業務設計を進める、という方向性が示されています。 / 金融機関での生成AI活用の具体例として、日本語読者の関心が高い話題です。
論文紹介: sEMG信号を用いたリアルタイム手指ジェスチャ認識のためのグラフニューラルネットワーク
前腕の表面筋電図(sEMG)を使って、手指ジェスチャをリアルタイムに認識する手法が提案されています。 / 筋肉の活動パターンをグラフとして表現し、グラフニューラルネットワークを用いて学習する点が特徴です。 / 義手の操作や拡張現実など、手の動きを素早く検知したい用途を背景にしています。
論文紹介: 人間と大規模言語モデルの集まりにおける「対立的な社会認識」を考える新しい枠組み
arXiv上で公開された cs.AI の新着プレプリントで、人間と大規模言語モデルが混在する対話環境を対象にした概念的な枠組みが提案されています。 / 著者らは、証言、推論、制度的な認証、暗黙の信頼が重なり合う環境では、情報の誇張、省略、捏造、意図的な不明確化が起こりうると整理しています。 / 既存の「エコーチェンバー」や「エピステミック・バブル」といった説明だけでは十分に捉えにくい現象がある、という問題提起が中心です。
論文紹介: テキストデータ拡張による深層学習の性能向上に関する総説
自然言語処理におけるデータ拡張の考え方を整理した総説論文です。 / 要旨では、局所的な判別境界の強化、反復的な学習、因果性や反実仮想例、意味と形式の違いなど、データ拡張の主要な観点が挙げられています。 / テキスト向けに開発されてきた複数の拡張手法を体系的にまとめている点が特徴です。
OpenAIがコーディング評価の指標に関する分析を公表 SWE-Bench Proの信頼性を再検討
OpenAIが、コーディング評価で広く使われるSWE-Bench Proに関する新しい分析を公表しています。 / 要旨では、この指標に信頼性や精度の面で課題がある可能性が示されています。 / AIモデルの比較や評価方法を考えるうえで、ベンチマークの見方を改めて検討する材料になりそうです。
