NVIDIA、Vera Rubin NVL72のMLPerf Inference v6.1結果を公開
NVIDIAの公式ブログで、Vera Rubin NVL72システムのMLPerf Inference v6.1に関する結果が紹介されています。 / 公開要旨では、推論の経済性を左右する要素として、システム性能、効率的なスケーリング、継続的なソフトウェア最適化が挙げられています。 / 初回のMLPerf Inference提出で、Vera Rubin NVL72はGB300 NVL72と比べて最大3.7倍のスループット向上を示したとされています。
論文紹介: 長期の物理タスクを自律的に扱うLLMエージェントの可能性を探る新着プレプリント
arXivに、LLMエージェントが長期の物理タスクを自律的に管理できるかを探る新着プレプリントが公開されています。 / 要旨では、物理環境では継続的な観察や状況変化への対応が必要であり、既存手法には再学習の負担や仮想環境中心という課題があると説明されています。 / この論文は、自己適応する物理AIエージェントの実現可能性を検討する内容とみられます。
Hugging Face Blog: HF Jobs上でLoRAを使ったAsync GRPOの実装と運用の工夫
Hugging Face Blogで、HF Jobs上におけるAsync GRPOとLoRAの組み合わせについて紹介されています。 / NCCLを使わずに動かす構成や、bucket、proxyといった運用上の工夫が取り上げられています。 / 強化学習系の学習・実行基盤の設計や、分散実行の実務的な工夫に関心がある読者に向く内容と考えられます。
NVIDIA、AIデータセンターの電力制御と計算負荷調整の取り組みを紹介
NVIDIAのブログで、AIデータセンターの電力需要を電力網の状況に合わせて調整する取り組みが紹介されています。 / 公開情報では、パートナー企業のプラットフォームが送られる信号に応じて、待てる処理を遅らせたり再スケジュールしたりする仕組みが説明されています。 / 目的は、電力網が混み合う時間帯に需要を下げつつ、重要なAI処理を止めないことだとされています。
論文紹介: ZGCM-1 — 数学とエージェント検索向けの完全公開・高効率な基盤モデル
arXivで、cs.AI分野の新着プレプリントとしてZGCM-1が公開されています。 / 7B規模の密な基盤モデルをゼロから学習し、データ・システム・アルゴリズムの効率を重視した設計だと説明されています。 / 要旨では、小さめのモデルはウェブをそのまま記憶するのではなく、内部で考える仕組みと外部ツールの利用を組み合わせることで能力を補える、という考え方が示されています。
論文紹介: 近岸波動モデル向けのパラメータ効率なニューラル演算子「DU-NO」
arXivの新着プレプリントとして、近岸域の波の振る舞いを扱うニューラル演算子「DU-NO」が紹介されています。 / 要旨では、従来の高精度な波動モデルは計算コストが高く、アンサンブル予測や不確実性評価、リアルタイム警報には重いと説明されています。 / DU-NOは、双U字型の構造を取り入れたパラメータ効率のよいモデルとして提案されており、波が支配的な領域での学習モデルの軽量化が論点になっています。
論文紹介: 競合する予測を踏まえた言語モデルの価値評価と予測統合
arXivの新着プレプリントで、カテゴリはcs.AIです。 / この論文は、言語モデルを単独で当てる道具としてではなく、市場予測・群衆予測・統計予測など既存の予測に対してどれだけ上乗せできるか、という観点で評価しています。 / Brier損失のもとで、モデルの不一致が外部予測の改善につながる条件や、分野ごとのモデルを使うことで得られる利点を扱っていると要旨では説明されています。
NVIDIA、ロボタクシー向け技術基盤について解説 商用運行の拡大を支える計算基盤を紹介
NVIDIAのブログで、ロボタクシー市場の拡大と、それを支える計算基盤・ソフトウェア基盤が紹介されています。 / 要旨では、訓練、シミュレーション、安全性検証、車載処理までを含む広い技術領域が必要だと説明されています。 / 公開情報によると、NVIDIAはAI学習、シミュレーション、車載計算を支えるオープンプラットフォームを提供しているとされています。
FyxerがOpenAIモデルを活用したAI秘書機能をどのように構築したか
Fyxerが、OpenAIモデルを使ったメール整理と文面下書きの仕組みを紹介しています。 / 個々の利用者の文体に合わせるために、fine-tuning、memory、実際のユーザーフィードバックを組み合わせているとされています。 / AI関連の実務事例として、受信箱の整理や返信文作成の運用設計を知る手がかりになりそうです。
OpenAI、Agents APIを発表 長時間セッションやツール利用に対応する管理型サービス
OpenAIがAgents APIを発表し、クラウド上でエージェントを構築・公開できる管理型サービスとして案内しています。 / オーケストレーション、長時間セッション、ツール利用を支える仕組みとして、Codex harnessを活用すると説明されています。 / 日本語読者にとっても、業務自動化や対話型アシスタントの実装方針を考えるうえで関心が高い内容です。
