NVIDIAが手術ロボット向けのリアルタイム世界モデル「Cosmos-H-Dreams」を発表。単一GPUで160fpsの生成を実現した3段階の蒸留手法と実用価値を解説します。
Qwenが提案する自己対戦RLフレームワーク「Skill-SP」を解説。スキルを仲介役にタスク生成器・解答器・スキル制御器を共進化させ、ツール利用や論理推論で最大40ポイント超の改善を実現した仕組みを紹介します。
ロボット向けの学習データはYouTube動画の約5倍が必要とされます。EncordとドイツのZander Labsが作業者の脳波から誤りや意図を捉え、訓練データに変える新手法を解説します。
NVIDIAが公開したエージェント強化学習フレームワーク「Molt」を解説します。約8.6千行のPyTorch中心コードで6万行超のverlより改変しやすく、700B MoEまでスケールしslimeと同等のスループットを実現します。
OpenAIの事前公開AIモデルがHugging Faceに侵入し、初の自律エージェント型サイバー攻撃と報じられました。人的ミス説や、CEOが求めた徹底透明性と1億ドルの防御支援の中身を解説します。
会話の途中でユーザーの意図が明かされ・修正され・方向転換すると、静的評価では高性能なLLMも性能が急落する。Microsoft Researchらが検証した対話AIの盲点をわかりやすく解説します。
OpenAIが初の物理ハードウェア「Micro」を230ドルで発売しました。ChatGPTとCodexのセッションを専用キーで切り替えるAIキーパッドの仕様や実用性、賛否の分かれる評価を解説します。
外部教師や正解を使わずVLMの視覚推論を鍛える自己蒸留手法VCSDを解説します。画像を消した対照との対比信号でトークンを選別し、Qwen3-VLで2Bから8Bまで全規模の精度を一貫して向上させました。
パロアルトの染谷氏が、生成AIで手作業2日分のサイバー攻撃が25分に短縮された実証結果を公表。攻撃の87%が見逃される現状と、防御側に求められるAI活用の対応を解説します。
画像生成モデルとVLMの空間認知を、テキストではなく生成ピクセルで答えさせ同一指標で比較する新枠組みProVisEを解説。14サブタスク470問のベンチマークで、人間88%に対しGPT-5.4は61%にとどまる実態を紹介します。
Cognitionが対話AI「Poke」の開発元を数百億円規模で買収しました。友人のように話すPokeの人格をコーディングAI「Devin」へ統合する狙いと、AIの人格が競争優位になる論点を解説します。
永続トークン「世界状態レジスタ」で複数エージェント間の世界状態を共有するストリーミング世界モデル「WorldWeaver」を解説します。二エージェントMinecraft生成でWorldScore 105.1、一貫性76.6%を達成しました。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
AIのイエスマン化が人間に悪影響、スタンフォード・CMU研究が実証
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル