ChatGPTでGPT-5.6 Solを改善、無料利用者向けにGPT-5.6 Lunaの提供も拡大
OpenAIの公式発表で、ChatGPT内のGPT-5.6 Solについて、精度と一貫性を高めた改善が案内されています。 / あわせて、無料利用者向けにGPT-5.6 Lunaへのアクセス拡大と、日常的な利用に関する無制限の会話提供が説明されています。 / モデルの挙動改善と利用条件の拡大が同時に示されており、一般利用者への影響が読み取りやすい発表です。
論文紹介: 消費者向けGPUで動かすローカルLLMの消費電力を比べた予備的ベンチマーク
ローカル環境でのLLM実行は、プライバシーやオンプレミス利用の観点から注目されています。 / このプレプリントは、消費者向けGPU上で9つのオープンソースLLMの消費電力を、同じ条件で比較した予備的な定量評価を示しています。 / 評価では、RTX 4060Ti 16GB、Ollama、nvidia-smiによる2Hzサンプリング、固定プロンプト सेटが使われたと説明されています。
論文紹介: SME向けの誤情報対策にRAGをどう使うかを扱う新着プレプリント
小規模・中規模企業でのLLM活用において、誤情報につながる幻覚の問題をどう抑えるかがテーマです。 / 外部知識を取り込むRAGを使い、文脈に合った知識で回答精度や信頼性を高める方向性が示されています。 / 要旨の範囲では、SMEの意思決定支援や質問応答での利用を想定した分析だと読み取れます。
Hugging Face Blog: LFM2.5-2.6Bでローカルエージェントを各所に展開する方法
Hugging Face Blogで、LFM2.5-2.6Bを使ってローカルエージェントを展開する話題が紹介されています。 / 公開されている書誌情報からは、AIエージェントの実装やローカル実行に関心のある読者向けの内容である可能性があります。 / 要旨や抜粋は空ですが、題名と提供元だけでも、実務寄りのAI活用に関連する話題として日本語読者向けに扱う価値があります。
論文紹介: AIの安全性をめぐる古典的思考実験を再検討した研究ノート
arXivの新着プレプリントとして、レイプニッツの「機械」、チューリングの模倣ゲーム、サールの中国語の部屋を、Conservation-Congruent Encoding(CCE)という枠組みで見直した研究ノートです。 / 要旨によると、タスク性能を表す指標と、内部構造がその性能をどれだけ保っているかを表す指標を区別する、簡略化された記号的な設定を定式化しています。 / 単純な検索型の仕組みとコンパクトな生成型の仕組みが、行動面では似た成果を示しうる一方で、内部の構造と働き方には違いがある、という問題意識がうかがえます。
NVIDIA、AI向けストレージ基盤の強化を紹介 大規模データ処理を支える設計を説明
AIの利用拡大で、システムメモリだけでは収まりきらない大規模データや長いコンテキストを扱う必要が増していると説明されています。 / 公開情報では、単純に保存容量を増やすだけでなく、暗号化・圧縮・検証・復元などの処理を効率よく回すストレージ基盤が重要だとされています。 / NVIDIAはFMS(Future of Memory and Storage)会議に合わせて、ストレージ関連の新しい取り組みを紹介するとしています。
NVIDIA、ロボタクシー向けのオープン推論モデル「Alpamayo 2 Super」を商用利用可能にと発表
NVIDIA Blogで、ロボタクシーや自動運転車向けの新しいオープン推論モデル「Alpamayo 2 Super」が商用利用可能になったと案内されています。 / このモデルは、単なる物体検出や動作予測だけでなく、状況理解、因果関係の推論、行動選択、安全で快適な走行経路の生成までを含む複数の機能をまとめて扱うことを目指すと説明されています。 / 原文では、NVIDIA Cosmos 3 Super Reasonerを土台にし、強化学習による追加学習が行われたとされています。
論文紹介: 自然言語だけでOpenFOAMのシミュレーションを作成・評価・反復する自律エージェント AutoFOAM
CFD(計算流体力学)とOpenFOAMの設定作業を、自然言語の指示だけで進める自律エージェントAutoFOAMが提案されています。 / ベースモデルとしてQwen-coder 2.5-14Bを用い、252件のテキストプロンプトで7種類のOpenFOAM課題に合わせて調整したとされています。 / エージェントがシミュレーションを作成するだけでなく、評価し、実行し、反復的に改善する点が特徴として示されています。
OpenAI、第三者によるサイバーセキュリティ評価に関する対応を説明
OpenAIが、同社モデルに関わる第三者のサイバーセキュリティ評価で起きた最近の事案について説明しています。 / あわせて、モデルのテストや評価を強化するための新しい安全対策を導入するとしています。 / 公開情報の範囲では、評価の具体的な内容や影響の詳細は限定的です。
論文紹介: 大規模言語モデルは自律的な臨床判断支援にまだ安全ではないのか——新着プレプリントの要旨から
arXiv上のcs.AI新着プレプリントで、医療現場における大規模言語モデルの自律的なトリアージや臨床判断支援の安全性を論じています。 / 要旨では、LLMが医師国家試験系の問題で成果を示したことや、診断推論で医師に迫る場面があることを前提にしつつ、特に『患者が最初に受診する場面』での自律的判断には安全性の証拠がまだ十分でないと問題提起しています。 / 対象は、医師の関与がほとんどない状態での症状評価・振り分けであり、医療AIの中でも実運用上の影響が大きい領域だと考えられます。
