論文紹介: 言語モデルは「0」を発見できるのか? 数学的発見と外れ値一般化を探る新着プレプリント
arXivに、言語モデルが未知の数学的概念を見いだせるかを扱う新着プレプリントが公開されています。 / 要旨では、数学的発見には学習データの範囲を超えた一般化が必要であり、言語能力がその一般化を支える可能性があると問題提起しています。 / 著者はPhoebe Zeng氏、Thomas L. Griffiths氏、Brenden M. Lake氏で、カテゴリはcs.AIです。
Hugging Face Blog: オープンモデルは自前ツールでどこまで「エージェント的」かを検証
Hugging Face Blog が、オープンモデルの「エージェント的な振る舞い」を自前のツール環境で評価する取り組みを紹介しています。 / 記事の主題は、モデル単体の性能だけでなく、ツール利用を含む実運用に近い条件でのベンチマークにあります。 / 日本語読者にとっては、オープンモデルの導入可否や業務利用時の見極め方を考える材料になりそうです。
NVIDIA、広告・マーケティング分野でのAI活用事例を紹介 Cannes Lionsにあわせて複数企業の取り組みを公開
NVIDIAの公式ブログで、広告・マーケティング分野におけるAI活用事例が紹介されています。 / Cannes Lionsにあわせて、Alembic、AWS、Criteo、Higgsfield、KERV.ai、TaboolaなどがNVIDIA技術の活用例を示しているとされています。 / 本文の抜粋では、広告やマーケティングの現場で、生成系の活用だけでなく、因果推論や自律的な運用を支える基盤の重要性が強調されています。
Hugging Face Blog: MosaicLeaksが示す、研究エージェントの機密保持をめぐる検討
Hugging Face Blogに、ServiceNowによる「MosaicLeaks: Can your research agent keep a secret?」という研究系ブログ記事が公開されています。 / タイトルからは、研究エージェントが機密情報をどこまで保持できるか、という安全性・信頼性に関する論点を扱っているとみられます。 / AIエージェントの実運用では、情報漏えいの抑止や取り扱いルールの設計が重要になるため、関連分野の読者にとって確認する価値がありそうです。
論文紹介: Legal case retrievalのための自己進化型エージェントによるルール駆動クエリ書き換え
法的事例検索において、法律文の複雑さと、問い合わせと関連事例の語彙的な一致の難しさが課題とされています。 / 概要では、BM25はこの分野でなお強い基準線であり、そのBM25をパラメータ学習なしで強化する枠組みが提案されています。 / 提案手法は、LLMベースのエージェントに自動評価環境を与え、反復的にクエリ書き換えを改善する設計と説明されています。
NVIDIA、ARグラス向けのマルチモーダルAIエージェント開発用フレームワーク「NVIDIA XR AI」を公開ベータで提供
NVIDIAの公式ブログで、ARグラスやXRデバイス向けのマルチモーダルAIエージェントを構築するためのフレームワーク「NVIDIA XR AI」が公開ベータになったと案内されています。 / 開発者向けの提供であり、AIを“使う”だけでなく、視覚や音声などを組み合わせたエージェントをXR環境に組み込むための基盤として位置づけられています。 / ARグラスやXRの文脈でのAI活用は、ハンズフリー操作や現場支援などに結びつく可能性がありますが、実際の使い勝手や対応機種は今後の確認が必要です。
OpenAIとMolecule.one、GPT-5.4を使った近自律型AI化学者が医薬品化学の反応改善を示したと発表
OpenAIとMolecule.oneが、GPT-5.4を用いた近自律型AI化学者の取り組みを紹介しています。 / 医薬品化学で重要とされる反応を改善したと説明されており、研究開発への応用が注目されます。 / 原文の要旨からは、AIが化学反応の改善支援にどこまで寄与したかが示されていますが、詳細条件は追加確認が必要です。
論文紹介: エージェント検索の並列サンプリングで生じる重複を減らす初期クエリの工夫
arXivの新着プレプリントで、エージェント型検索におけるテスト時スケーリングを扱っています。 / 並列ロールアウトを増やしても効果が伸びにくくなる一因として、最初の検索クエリが似通い、参照する証拠が重なりやすい点を指摘しています。 / 著者らは、追加学習なしで最初のクエリの多様性を高めるDivInitという介入を提案しています。
論文紹介: PrologMCP — LLMエージェント向けの標準化されたPrologツールインターフェース
arXivに、新着プレプリントとして「PrologMCP: A Standardized Prolog Tool Interface for LLM Agents」が公開されています。 / 要旨では、深い推論を要する演繹タスクで言語モデルがまだ苦戦しており、内部推論を伸ばす方法は計算コストが増えやすいと説明されています。 / その代替として、モデルが問題を言語化し、Prologのような記号推論系が実際の推論を担う「symbolic delegation」の考え方が示されています。
論文紹介: Relational Structural Causal Models
arXivに、cs.AI分野の新しいプレプリント『Relational Structural Causal Models』が公開されています。 / 要旨では、AIが介入や反実仮想を扱える因果的なモデルと、見たことのない組み合わせにも一般化できる組合せ的なモデルの両方を持つ必要があると述べられています。 / 著者らは、構造的因果モデルを、対象や対象間の関係が変化する設定へ拡張する「relational structural causal models」を提案し、未見の組み合わせに対する因果・観測クエリの扱いを理論的に検討しています。
