中国人民大学NLPIR Labが提案するArborは、仮説・実験・知見を1本のツリーで累積管理する自律研究フレームワークです。6タスク全てでClaude Code比2.5倍以上の改善を実現し、MLE-Bench Liteでは86.36%を達成しました。
Google DeepMindが数百万のAIエージェントが相互作用する際のリスク研究に1000万ドルを投資。まだ存在しない学術分野を立ち上げ、企業展開前に安全基盤の確立を目指します。
MoEモデルのルーター設計に数学的根拠を与えるManifold Power Iteration(MPI)を解説。エキスパート行列の主特異方向への整合で損失を改善し、下流タスク性能も向上させる新手法を紹介します。
AnthropicのダリオCEOが航空機の安全審査に相当するフロンティアAIへの第三者評価義務化を提言。政府のデプロイ差し止め権限の付与と、失業対策として3.5億ドルの拠出も表明しました。
スタンフォード大が300以上の実験で体系化したテキスト→画像拡散モデルの設計レシピ。公開データのみで訓練した3Bパラメータモデルが5ベンチマーク平均で既存オープンモデルを29.5pt上回る性能を達成しました。
Googleが2026年6月10日に公開したDiffusionGemma 26Bは、256トークンを並列生成する拡散モデルの手法でGPU推論速度を最大4倍に高速化したオープンモデルです。仕組みと性能を解説します。
Kuaishouが開発した30B MoE型マルチモーダルモデル「Keye-VL-2.0」を解説します。3Bのアクティブパラメータで256Kコンテキストを処理し、LongVideoBenchで235B超のモデルを上回る長尺動画理解性能を実現しました。
Decartが自動運転テスト向け世界モデル「Oasis 3」をAPI公開しました。フォトリアルな走行環境を1秒あたり$0.02でリアルタイム生成し、稀少なテストシナリオの量産を可能にします。
CoT微調整がハイブリッドLLMの長文書検索性能を67%から9%へ激減させる「Attention Amnesia」問題と、追加学習不要の修復法QK-Restoreを解説します。
Anthropicが最上位「Mythosクラス」モデル「Claude Fable 5」を2026年6月9日に一般公開しました。独立したAI分類器が悪用リクエストを自動検知してClaude Opus 4.8に切り替える新セーフガードと、入力100万トークンあたり10ドルのAPIを発表しました。
ARMは7Bパラメータの単一モデルで画像の理解・生成・編集を統合した自己回帰型マルチモーダルAIです。独自の離散視覚トークナイザーと強化学習でWISE総合スコアが0.50から0.56に向上し、コードも公開されています。
70言語超の音声をほぼリアルタイムで翻訳するGemini 3.5 Live Translateを発表。話者の声の抑揚やピッチを保ちながら、Google Translate・Meet・AI Studioで利用できます。