論文紹介: LLM推論サービスの1年分の変化を追う新着プレプリント
LLMのサービス提供を、実運用に近いトラフィックの観点から分析した新着プレプリントです。 / 公開情報では、短期間の観測にとどまる既存研究では捉えにくい、利用の変化やユーザーとモデルのやり取りに注目しています。 / キャッシュや負荷分散のような運用上の論点を扱う可能性があり、LLM基盤の設計・評価に関心がある読者に向きます。
OpenAI、AI政策の新しい発想を探る14件の独立プロジェクトを支援
OpenAIが、AI時代の政策アイデアを探る14件の独立プロジェクトに資金提供したと発表しています。 / 目的は、経済的な機会を広げ、社会のレジリエンスを強めるための政策検討を後押しすることだと説明されています。 / 公開されている要約からは、技術そのものよりも、AIを前提にした制度設計や社会実装の議論を支える取り組みだと読み取れます。
OpenAI、サイバーセキュリティ分野での防御強化について「The Defender’s Window」を公開
AIが攻撃側と防御側の双方でサイバーセキュリティを変えていると説明されています。 / OpenAIが自社の防御を強化していることと、セキュリティ担当者が今できる対応が案内されています。 / 公開情報の範囲では、具体的な技術仕様や詳細な事例はまだ示されていません。
NVIDIA、Nemotron 3.5 Lightning と NeMo Switchyard を発表 エージェント向けAIの効率化をうたう
NVIDIAの公式ブログで、Nemotron 3.5 Lightning と NeMo Switchyard の提供開始が紹介されています。 / Nemotron 3.5 Lightning は、長時間動作するエージェント系ワークロード向けの高効率モデルとして説明されています。 / NeMo Switchyard は、複数のモデルを使い分けるためのルーティング用オープンソースライブラリとして案内されています。
GPT-5.6の活用ガイドを公開 スタートアップ向けにエージェント構築の考え方を紹介
OpenAIが、GPT-5.6を使ってAIエージェントをより速く、費用対効果よく構築するためのガイドを公開しています。 / スマートなモデル選択や、Responses APIの新しい機能に触れながら、実務での使い分けを示す内容とみられます。 / スタートアップがどのように導入を進めるかという観点が中心で、製品開発や運用設計に関心のある読者に向いた内容です。
論文紹介: LLMの安全性評価で、プロンプト言語が判断に影響する可能性を示す新着プレプリント
arXivの新着プレプリントで、LLMの安全性や応答のばらつきがプロンプトの言語によって変わる可能性を検討しています。 / 著者は9つのモデルを6つの提供元から集め、高リスクな架空シナリオで英語と日本語のプロンプトを比較しています。 / 要旨では、日本語のプロンプトで発射判断が下がる傾向が見られたと述べられていますが、詳細な条件や統計的な解釈は本文確認が必要です。
論文紹介: 「Agreement Is Not Alignment」— 人間とLLMの倫理判断が一致しても、判断の根拠は同じとは限らない
人間とLLMの最終的な判断が一致していても、その根拠まで同じとは限らない、という点を扱うプレプリントです。 / ETHICS由来の500件のベンチマークを使い、5つの道徳判断分野で人間注釈とLLM注釈を比較したとされています。 / 単なる正解一致だけでは、倫理的な整合性を十分に測れない可能性がある、という問題提起が読み取れます。
OpenAI、GPT-5.6 Sol向けの高速モード「Ultrafast mode」を予告
OpenAIが、API向けの新しいサービス階層として「Ultrafast mode」の予告を公開しています。 / GPT-5.6 Solを最大14倍高速で動かし、最大で毎秒750トークンの出力に対応するとされています。 / 高速化の基盤にはCerebrasが使われていると説明されています。
論文紹介: LLMの研究協力者としての研究倫理を評価するベンチマーク「IntegrityBench」
arXivで公開された新着プレプリントで、LLMが「共同研究者」として振る舞う場面における研究倫理を評価する枠組みが提案されています。 / 提案されたIntegrityBenchは、誤った行為の分類、倫理的な判断の理由づけ、資料に基づく意思決定などを、36の課題と複数段階の圧力条件で調べる設計です。 / 要旨によれば、18種類の先端モデルを評価した結果、強い圧力条件では重要な倫理判断の一部で失敗が見られたとされています。
OpenAIのDaybreakモデル、AWSのAmazon Bedrockで利用可能に
OpenAIとAWSが、Daybreakのサイバーセキュリティ機能をAmazon Bedrock経由で提供すると発表しています。 / 企業向けのセキュリティ業務を支える用途が想定されており、既存のAWS環境で利用しやすくなる可能性があります。 / 現時点では、具体的な機能範囲や利用条件は公開情報の範囲で確認が必要です。
