ストリーミング動画対話の知覚・記憶・能動応答を統一したOneStreamerを解説。映像を文字記録化して文脈トークンを93.1%削減し、4Bモデルで8ベンチマーク全てで最高性能を達成した仕組みを紹介します。
Ai2が引用付き科学レポート生成モデル「AstaBrief」をオープンウェイト公開しました。Qwen3-8Bベースで平均51.1秒、Claudeベースの約3.5倍高速。学習データと評価結果を解説します。
実OSを動かさず画像生成モデルで次の画面を描き、GUIエージェントの操作軌跡7.9万件を合成するAutoGUIWorldを解説。OSWorld 33.0→40.8%の改善と残る課題を紹介します。
Microsoft AIが初のストリーミング文字起こし「MAI-Transcribe-2-Streaming」を公開。約100ms遅延・60言語対応の性能と価格、同時発表のTTS 2モデルを解説します。
プロンプトインジェクションの仕組みを直接攻撃と間接攻撃の違いから解説します。OWASP Top 10 for LLM 2026で3位に上がった過剰な代理権を踏まえ、権限最小化や出力検証などの多層防御を実装レベルで紹介します。
On-Policy蒸留の新手法RIDEを解説。強化学習が生んだ隠れ表現の残差を方向として外挿し、4組のモデルペアすべてで生徒がRL教師に匹敵または超過した仕組みと限界を紹介します。
Google DeepMindが2026年9月30日に公開したSynthID Bioは、AI設計タンパク質の配列や立体構造に電子透かしを埋め込む技術です。3標的の実験で機能が落ちないことを確認した仕組みを解説します。
共有Transformerブロックを各デノイズステップ内で繰り返すLooped-DiTを解説します。260Mパラメータで6.5倍大きいモデルを6ベンチ平均2.5ポイント上回り、推論計算量は4.9分の1に収まります。
Googleがフロンティアモデル「Gemini 4 Argon」を発表。出力上限を64Kから100万トークンへ拡大し、DeepSWE 77.9%を記録。性能・価格・安全対策を解説します。
IBM ResearchがAIエージェントの再現性問題を提起。GPT-4.1のReActは平均77.4%でも全試行成功は53.0%でした。ALTK-Evolveが一貫性ギャップを12.0ポイントに縮小した手法を解説します。
Googleが発表した Dream-RSI は、過去の探索履歴をリプレイシミュレータとして再利用し、探索方針を低コストで自己改善する枠組みです。3領域で同等性能を最大50分の1の予算で達成した仕組みを解説します。
Googleが音声対話モデル Gemini 3.8 Live と Live Extended Thinking を公開。会話中の97言語自動切替、near-realtimeの視覚理解、思考と発話の並列化の仕組みとベンチマーク結果を解説します。