ICLR 2026採択のEMPO²は、LLMエージェントのRL訓練にメモリ拡張とオン/オフポリシーのハイブリッド最適化を導入した新フレームワークです。ScienceWorldではGRPO比128.6%の性能向上を実現しています。
DPEは、LMMの弱点をマルチエージェントで診断・標的データ生成・強化学習のループで自律的に改善するフレームワークです。Qwen3-VLで11ベンチマーク全てで継続的な性能向上を達成しています。
OpenAIが2026年2月25日、AIモデルの悪用事例をまとめた最新脅威レポートを公開しました。複数プラットフォームを横断するハイブリッド攻撃の実態から、カンボジア発ロマンス詐欺、中国・ロシアの情報工作まで7つの事例を解説します。
AnthropicがAIコーディングエージェント「Claude Code」の新機能「Remote Control」をリサーチプレビューで公開。スマートフォンやタブレットからローカルマシンのセッションを遠隔操作でき、コードはクラウドに渡らない設計です。
エッジデバイス向け統合マルチモーダルモデル「Mobile-O」が発表されました。新設計のMobile Conditioning Projector(MCP)でiPhone上での画像生成を約3秒で実現し、GenEvalで74%のスコアを達成します。
OpenAIが2026年2月、コーディングAI評価の業界標準「SWE-bench Verified」の廃止を公式発表。審査した問題の過半数にテスト欠陥があり、主要3モデルすべてで学習データへの汚染が確認されたことが理由です。
LLMの強化学習訓練で問題となるポリシー陳腐化に対処するVESPOを解説します。変分定式化と分散削減を統合した閉形式カーネルにより、gbs/mbs=64という極端な条件でもGRPOを14ポイント上回る安定訓練を実現します。
RAGアプリやAI開発に欠かせないベクトルデータベース(Pinecone・Qdrant・Weaviate・Milvus・ChromaDB)を性能・コスト・ユースケース別に徹底比較し、最適な選び方を解説します。
2026年2月のカナダ銃乱射事件で、容疑者のChatGPTチャットが事件8か月前に検知されていたことが判明。OpenAIは通報基準を満たさないと判断して警察への連絡を見送っており、AI企業によるユーザー監視と通報義務のあり方に関する議論が高まっています。
GoogleがImageNet-512でFID 1.4、Kinetics-600でFVD 1.3を達成する新フレームワーク「Unified Latents(UL)」を提案。拡散事前分布で潜在空間を正則化し、Stable Diffusionより少ない学習FLOPsで優れた品質を実現する潜在表現学習の仕組みを解説します。
GoogleのスタートアップVP Darren Mowryが、TechCrunchポッドキャストでLLMラッパーとAIアグリゲーターという2種類のビジネスモデルが存続困難になりつつあると警告しました。差別化の壁とクラウド黎明期との類比を解説します。
CES 2026では「フィジカルAI」が主役でした。NVIDIAのジェンスン・フアン氏が宣言した「フィジカルAIのChatGPTモーメント」とは何か。触覚ロボット・腸内AI・現場監督AI・ペン型録音・音声遮断ウェアラブルの5事例と、日本企業の勝ち筋を読み解きます。