外部教師や正解を使わずVLMの視覚推論を鍛える自己蒸留手法VCSDを解説します。画像を消した対照との対比信号でトークンを選別し、Qwen3-VLで2Bから8Bまで全規模の精度を一貫して向上させました。
パロアルトの染谷氏が、生成AIで手作業2日分のサイバー攻撃が25分に短縮された実証結果を公表。攻撃の87%が見逃される現状と、防御側に求められるAI活用の対応を解説します。
画像生成モデルとVLMの空間認知を、テキストではなく生成ピクセルで答えさせ同一指標で比較する新枠組みProVisEを解説。14サブタスク470問のベンチマークで、人間88%に対しGPT-5.4は61%にとどまる実態を紹介します。
Cognitionが対話AI「Poke」の開発元を数百億円規模で買収しました。友人のように話すPokeの人格をコーディングAI「Devin」へ統合する狙いと、AIの人格が競争優位になる論点を解説します。
永続トークン「世界状態レジスタ」で複数エージェント間の世界状態を共有するストリーミング世界モデル「WorldWeaver」を解説します。二エージェントMinecraft生成でWorldScore 105.1、一貫性76.6%を達成しました。
2026年7月、北バージニアで送電線1本の故障により3GW超のAIデータセンターが一斉に停止し、電力網が停電寸前に陥りました。事故の原因と、バッテリーや規制による対策を解説します。
NVIDIAのSANA-Video 2.0は、ソフトマックスアテンションを3対1で線形アテンションに置き換えるハイブリッド設計を採用。VBench 84.30を維持しつつ720pのDiT前向き計算を3.2倍高速化し、単一H100で13.2秒生成を実現した仕組みを解説します。
AnthropicがClaude Opus 5を公開しました。Fable 5級の性能を半額で提供し、Frontier-Benchで前世代の2倍を記録。拒否時に旧モデルへ切り替える自動フォールバック機能も解説します。
RoPEの周波数を反周期的に設計し系列の両端をメビウス境界条件で結ぶ新手法Möbius RoPEを解説。ニードル検索の精度を文脈長512で63.3%から90.3%へ高め、乱数シードによる性能のばらつきを解消します。
米トランプ政権が中国製オープンウェイトAIモデルの禁止を検討しています。Kimi K3の蒸留疑惑を発端に、NvidiaやMistralなど業界6社が広範な規制に反対する公開書簡を提出した経緯と論点を解説します。
拡散モデルの画像生成にLLM流の推論時スケーリングを持ち込む新手法Progressive Seed Pruningを解説します。多数のシードを初期段階で評価して有望な候補へ計算を集中させ、同じ予算でGenEvalと人手評価の両面でBest-of-Nを上回ります。
OpenAIやAnthropicの安全ガードレールが脆弱性研究など正当な防御作業まで拒否し、研究者が制限のない中国製モデルGLMへ流出しています。NCC Group等の実名証言からAI安全対策の逆説的な副作用を解説します。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
AIのイエスマン化が人間に悪影響、スタンフォード・CMU研究が実証
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル