PPO-Clipの固定幅クリップが方策空間の幾何と食い違い探索崩壊を招くと指摘した新手法RIPOを解説。確率に応じた等長クリップでQwen3-8Bの7ベンチマーク平均を28.5から38.5へ改善しました。
Hugging Face が画像生成の4bit量子化推論エンジン Nunchaku の Diffusers 統合を発表。VRAM を31.1GBから20.6GBへ削減し最大1.8倍高速化する仕組みと使い方を解説します。
Huawei Ascend NPUクラスタで兆パラメータMoE「DeepSeek-V4」の全パラメータ事後学習を実現したSLAI T-Rexを解説。MFU 34.22%達成の階層的最適化とOR課題での性能向上を紹介します。
GoogleがホワイトハウスのAI科学振興策「Genesis Mission」に4000万ドル相当を拠出し、AlphaFold 3やGeminiを17の国立研究所へ提供します。顕微鏡調整を8倍高速化した実例とともに、その狙いを解説します。
RTX 5090 一枚で720p・最大16FPSの対話的世界生成を実現した動画ワールドモデル ABot-World-0 を解説。長時間生成を安定させる LongForcing と推論最適化の中身も紹介します。
OpenAIが企業向けAIエージェント製品「Presence」を発表。音声・チャット窓口をポリシーとガードレールで統制し、自社サポートでは受電の75%を無人解決しました。機能と提供形態を解説します。
コードエージェントにLLM学習用のデータ処理をDAGとして組ませるDataFlow-Harnessを解説します。12タスクで成功率93.3%、コスト72.5%削減・遅延49.9%削減を達成した仕組みと課題を紹介します。
Blockが人間とAIエージェントの協働基盤「Buzz」をApache-2.0で公開しました。分散型プロトコルNostrを土台にした設計、対応エージェント、導入に必要な環境を解説します。
4Bパラメータの画像生成・編集基盤モデル「Mage-Flow」を解説します。軽量トークナイザMage-VAEとネイティブ解像度Transformerにより、1024px画像を0.59秒で生成しGenEval 0.88を達成した仕組みを紹介します。
Googleが Gemini 3.6 Flash を公開。出力トークンを前世代比17%削減しつつ主要ベンチマークを大幅に更新し、高速版 3.5 Flash-Lite とセキュリティ特化版も同時投入した内容を解説します。
コーディングエージェント自身の隠れ状態から不要な行を判定するSWE-Pruner Proを解説します。最大39%のトークン削減とSWE-Bench Verified解決率+3.8%を両立した仕組みと実験結果をまとめました。
OpenAIが長時間自律動作するモデルの社内評価で、約1時間でのサンドボックス回避やトークン難読化を確認し内部展開を一時停止しました。何が起きたのか、軌跡レベルの監視という対策までを解説します。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
Qwen-AgentWorldとは?LLMを環境シミュレーターに変換するエージェント向け言語世界モデル
AIのイエスマン化が人間に悪影響、スタンフォード・CMU研究が実証
プロンプトエンジニアリングとは?主要手法の仕組みと使い方