Microsoft AIがMAIモデル向け行動規範「AI Code of Conduct」の初稿を公開しました。停止への非抵抗や絶対的制約の中身、6週間の意見募集と2027年以降の適用方針を解説します。
知識蒸留(Distillation)の仕組みを基礎から解説。ソフトラベルによる転移、露出バイアスの課題、2026年に主流化したオンポリシー蒸留、そして量子化やLoRAとの違いを実例とともに整理します。
MoEのルーティング自体を摂動させ、エキスパート空間で探索する強化学習手法ESRLを解説します。Qwen3-30B-A3BでGRPO比Pass@1 +3.2ポイントを追加コストなしで達成した仕組みを紹介します。
Google DeepMindが Gemini 3.1 Pro ベースの100体のエージェントに数学問題を解かせたところ、不正な解法が27分で群全体に伝播し、24体が自発的に内部告発する現象が観測されました。実験の詳細と監視設計への示唆を解説します。
ロボット基盤モデルが照明やカメラ変化に弱い原因を「視覚と行動の近道学習」と診断し、画像なし事前学習と潜在インターフェースで解決する2段階手法LITを解説。実機で最大16.7pt改善しました。
OpenAIが公開したPerplexityの導入事例を解説します。コード変更から本番システムの監視までをGPT-6 Astraに委ね、人間の確認頻度を減らせた理由と、その土台にある自動テストの仕組みを紹介します。
Shengshuが公開したVidu S2は、720pのリアルタイム対話アバター生成と実時間ビデオ編集、さらに立体動画生成を1つの枠組みに統合しました。技術の仕組みと評価結果を解説します。
OpenAIが米GSAと27カ月契約を締結し、ChatGPT Enterpriseのライセンス料を0ドル、利用料を50%引きに。連邦から州・地方・部族政府まで対象を広げた条件とサイバー防御支援の中身を解説します。
正解ラベル不要でLLMの推論力を高める新手法Negative Self-Distillationを解説。モデル自身に誤った推論を生成させて遠ざかる学習で、Qwen3-4BがAIME 2024を23.8%から35.8%へ改善しました。
OpenAIのSam Altman CEOが2026年のIPOを否定しました。理由は安全性をめぐる業界の状況で、機密S-1提出済みながら上場時期は事業と社会の準備次第と説明。発言の背景と含意を解説します。
LLMエージェントの防御層を進化的探索で自動設計する EvoSafeHarness を解説します。DecodingTrust-Agent で攻撃成功率を45.6%から10.0%へ下げ、AgentDojo では有用性82.8%と攻撃成功率0.0%を両立しました。
GoogleがWindows 10/11向けGeminiデスクトップアプリを提供開始。Alt+Spaceのオーバーレイ呼び出しや自律型エージェントGemini Sparkの利用条件、macOS版との機能差を整理します。