ICMLで発表された研究が、大規模言語モデルは system や user のタグではなく文体で役割を判断していると指摘しました。思考の連鎖を偽造するだけで安全対策を回避でき、完全な防御は不可能だと結論づけています。
記憶を外部モジュールでなくモデル内部に組み込む「メモリ基盤モデル」Metisが登場。勾配計算なしのフォワード計算だけで情報を保存・検索するネイティブ記憶を実現し、重みを凍結したまま推論時に記憶を更新する新パラダイムを解説します。
Microsoftが決算説明会で自社AIモデル群「MAIファミリー」12モデル超を発表。初の推論モデルやAnthropic対抗の半額セキュリティモデルを投入し、OpenAI・Anthropicと本格競合する戦略転換を解説します。
視覚とLLM、行動を直列につなぐ従来のVLAからLLMを外し、視覚と言語を直接行動へ変換するTurboVLAが登場。0.2BパラメータでLIBERO成功率97.7%を保ちつつ、RTX 4090で32Hz動作を実現した手法を解説します。
NVIDIAが提案した並列デコード蒸留「PDD」を解説します。複数区間の平均速度を1回でまとめて予測し、単純なMSE損失だけでImageNet FID2.69(NFE=1)や動画VBench84.92(NFE=4)を達成した高速生成手法です。
OpenAIがAIコーディングエージェントを科学研究の現場で検証したフィールドレポートを公開しました。Codexなどが8つの生命科学プロジェクトでソフト開発をどう加速し、研究者の役割をどう変えたかを解説します。
オンポリシー蒸留で生徒が序盤の推論ミスを引きずる問題を、教師が要所で引き継ぐ軌跡リレー方式Relay-OPDで解決。Qwen3-1.7Bで標準OPD比+5.73%、学習軌跡長を50%以上短縮した新手法を解説します。
Liquid AIが軽量エンコーダLFM2.5-Encodersを公開しました。GPU不要のCPU上で8192トークンの長文をModernBERT比約3.7倍で処理でき、分類やPII検出など実務タスクのコストを抑えます。
Salesforce Researchが発表したPC操作エージェントStateActを解説。画面ではなくプログラム状態を直接扱い、OSWorld 2.0で成功率を20.6%から26.9%へ改善しコストを約9分の1に削減した仕組みを紹介します。
SamsungからSK Hynixへ半導体技術者200人超が4カ月で移籍しました。約3倍の賞与格差とHBM好況が招く人材争奪戦の実態を、具体的な数値とともに解説します。
音声と動画を別々に符号化してきた従来手法に対し、単一VAEで統一潜在空間を学習する「OmniVAE」を解説します。セグメント単位の対照学習と特徴蒸留でクロスモーダル同期を高め、text-to-audio-video生成の品質を一貫して向上させました。
AnthropicのアモデイCEOがオープンウェイトモデルの禁止を提唱したことはないと表明。中国AIへの懸念から半導体輸出規制とモデル蒸留の取り締まりを主張した背景と、NVIDIA共同声明との違いを解説します。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
PP-OCRv6: わずか34Mパラメータで235B超の大規模VLMを超えた軽量OCRシステム