専用のVLAを訓練せず、汎用VLMに意味的なアクション単位を与えるだけでロボット操作を実現するShow-Harnessを解説します。ゼロショット制御の仕組みと、π0.5との比較結果、残る空間グラウンディングの課題まで紹介します。
OpenAIがアライメント研究者Paul Christiano氏の財団理事就任を発表。RLHFの基礎を築きNIST傘下のCAISIでも活動した同氏の役割と、営利部門を監督するガバナンス体制の変化を解説します。
音声生成、内容編集、強調分離、パラ言語編集、音響編集の5タスクを自然言語指示で統一的に扱う基盤モデルAuKを解説。195万時間の学習データと4.5倍高速な蒸留版の性能を紹介します。
IBM Research が時系列基盤モデル Granite PatchTST-FM-r2 を公開しました。GIFT-Eval のゼロショット部門で2位、Apache 2.0 で商用利用も可能なモデルの構成と性能を解説します。
複数モデルのルーティング記録を事後学習データに変える「NeoHorse-1」を解説。サブシーン分割と6観点評価により、11ベンチマーク平均で4Bが58.94→64.87、9Bが65.60→69.04に改善しました。
OpenAIがミレニアム懸賞問題ナビエ・ストークスの証明に到達したと発表。約1万エージェント並列という手法と、先行研究のクレジットを巡る数学界の議論を解説します。
GoogleのMaxKernelは、計画・実装・デバッグ・計測を分担するLLMエージェント群がTPUカーネルを自動生成する枠組みです。JaxBenchで1.58倍、実モデルでは専門家の手動実装を上回る成果を解説します。
Google DeepMindがヒトゲノムの一塩基変異90億件の分子影響を予測した1PBのデータセット「AlphaGenome Atlas」を公開。AVIスコアの仕組みと研究成果、利用方法を解説します。
LLMの重みを自己回帰重みと拡散重みに分離する新手法Unoを解説。サンプラー族Ψ-Specによりドラフトモデルなしで出力を変えずに最大3倍高速化し、8Bで26Bモデルを上回った成果を紹介します。
Googleが2026年9月8日にGemini 3.8 Flashの一般提供を開始。100万トークン文脈、思考レベル3段階、エージェント基盤への標準採用と料金体系を解説します。
Cerebrasらが2,400回超の実験で、LLM事前学習にレイヤードロップアウトを使うべきと実証。訓練FLOPsを最大25%削減し、early exitや自己投機的デコーディングで推論を最大1.55倍高速化する手法を解説します。
Gartnerが2026年版ハイプ・サイクルを発表しました。フィジカルAIが初登場でピーク期に入り、幻滅期にあったエージェント型AIが再浮上した背景と、導入判断への示唆を解説します。