AI関連ニュース
論文紹介: LLMの推論記録から「文章のよさ」に関する暗黙の見方を取り出す研究

推論機能を持つLLMが、文学的な文章の質をどう評価するのかを調べた新しいプレプリントです。 / 研究では、古典文学から匿名の掲示板投稿まで6段階の品質に分けた30本の実テキストを使い、モデルの推論記録から暗黙の評価基準を抽出しています。 / 要旨では、5回のDeepSeek再現実験で平均79.3%の段階分類精度が得られたとされています。

続きを読む
AI関連ニュース
OpenAI、米国の科学研究を後押しする取り組みを発表

OpenAIが、米エネルギー省や国立研究所と連携し、最先端のAIを科学発見の加速に活用する方針を示しています。 / 公開情報の範囲では、国家レベルの研究機関と協力して科学研究を進める姿勢が示されており、研究支援や計算活用の広がりが注目されます。 / 具体的な研究テーマや成果の詳細は要旨からは十分に分からないため、発表内容の範囲に沿った紹介が必要です。

続きを読む
AI関連ニュース
論文紹介: ClickGuard:クリックベイト記事の検出と抑制をめざすブラウザ拡張の研究

arXiv上の新着プレプリントとして、クリックベイト記事を見分けるAIベースのブラウザ拡張が提案されています。 / Transformer系埋め込み、言語学的特徴量、独自の「baitness」スコアを組み合わせた手法が使われています。 / 要旨では、XGBoostベースのモデルが評価指標F1で91%を示したとされています。

続きを読む
AI関連ニュース
NVIDIAとKAIST、韓国のAI研究拠点強化に向けた共同研究ラボを発表

NVIDIAのブログで、韓国のAI Summitにあわせた取り組みとして、韓国のAI基盤整備と研究体制の強化に関する発表が紹介されています。 / NVIDIAとKAISTは、ソウルのKAIST Kim Jaechul Graduate School of AIに共同AI研究ラボを設立するとしています。 / 公開情報では、このラボはエージェント型AIの研究を韓国向けに進めることを目的としており、韓国の大学とグローバルなテクノロジー企業の共同AIラボとしては初めてだと説明されています。

続きを読む
AI関連ニュース
論文紹介: 生成AIを用いた自律的なテスト管理アーキテクチャに関する新着プレプリント

arXivに、ソフトウェアのテスト管理を自律化する多エージェント型AIアーキテクチャ「AINTMA」を提案する新着プレプリントが公開されています。 / 要旨では、テストの発見、リスク評価、優先順位付け、実行の調整、品質分析、クラウドセキュリティ監視を担う6つの専門エージェントが示されています。 / 対象はソフトウェア品質保証とクラウド環境の運用で、AIがテスト運用の判断や調整を支援する構成が特徴です。

続きを読む
AI関連ニュース
NVIDIA、Vera Rubin向けのSpectrum-6 Ethernetスイッチを発表

NVIDIAの公式ブログで、Gigascale規模のAIファクトリー向けにSpectrum-6 Ethernetスイッチが紹介されています。 / Spectrum-6は102.4Tbpsの帯域をうたい、前世代比で2倍の容量と説明されています。 / NVIDIAは、AIファクトリーをGPUやCPU、ネットワークを含む一体の計算システムとして動かす考え方を強調しています。

続きを読む
AI関連ニュース
NVIDIAブログ、米テキサス州フォートワースでのWistron新工場稼働を紹介

Wistronが米テキサス州フォートワースで、米国初の製造拠点を開設したとNVIDIAブログで紹介されています。 / 工場では、NVIDIA GB300 Grace Blackwell Ultra Superchipの製造ラインと、Vera Rubin Superchip向けのラインがあると説明されています。 / NVIDIAのジェンスン・フアンCEOが開所式で登壇し、AIインフラを米国内で整備する意義について述べたとされています。

続きを読む
AI関連ニュース
NVIDIA、米海軍大学院にDGX GB300搭載のAIスーパーコンピューターを導入

NVIDIAの創業者兼CEOが、米カリフォルニア州モントレーのNaval Postgraduate Schoolを訪れ、DGX GB300システムの稼働開始を発表したと伝えられています。 / 同校の学生、研究者、教員向けに、モデル学習や推論を含む大規模なAI計算環境がオンプレミスで利用できるようになったとされています。 / 用途としては、天気予測、サイバーセキュリティ、災害対応・レジリエンス計画などが挙げられています。

続きを読む
AI関連ニュース
論文紹介: Evidence Chain Evaluationによる選択的なファクトチェックの評価手法

LLMを使ったファクトチェックでは、正誤だけを二択で返す方式だと、根拠が弱い場合でも自信ありの判定になりうる点が課題だと説明されています。 / この論文では、根拠が不十分なときに真偽を無理に断定せず、保留を返せる選択的ファクトチェックの枠組み「Evidence Chain Evaluation(ECE)」を提案しています。 / 評価対象は、ウェブ検索などで証拠を集めるツール使用型の検証エージェントだと要旨にあります。

続きを読む
AI関連ニュース
論文紹介: カスタムLLMは医療情報の精度向上に役立つのか—ACL損傷の事例でRAGとエージェントを比較

ACL損傷に関する臨床ガイドラインをもとに、標準的なLLMと、RAGやエージェントを組み合わせた手法を比較した論文です。 / 公開要旨では、AAOSの2022年ガイドラインに基づく100問のQ&Aを使い、複数の商用・オープンソースモデルに同じ質問をベース形とRAG組み込み形で与えたと説明されています。 / 研究のねらいは、医療のように正確さが重要な場面で、外部知識を組み込むカスタム手法が標準LLMより有効かを検討することにあります。

続きを読む