スクウェア・エニックスがGoogle CloudのマルチモーダルAI「Gemini」を使い、ゲームのQAテストを自動化する事例を発表しました。AIが画面を見てコントローラーを自走操作し検証を進める仕組みを解説します。
正解のない要約や創作を「スパイ探し」ゲームに変換し、検証可能な報酬を自動生成する強化学習RLSVRを解説。Qwen3-8Bで要約75.4%、創作77.3%の勝率を達成し、既存の自己改善手法を上回った成果を紹介します。
Alibaba Cloudが2.4兆パラメータの新モデルQwen3.8-Maxを公開しました。一部ベンチマークでFable 5やGPT-5.6 Solを上回り、来週には重みと中規模版も公開予定です。
頂点集合VAEとFlow Matchingを組み合わせた3Dメッシュ生成手法「Meshy T2」を解説します。画像からメッシュまでを中央値6秒で生成し自己回帰手法の10倍以上高速、面数制御やマルチパート資産にも対応します。
OpenAIが公式ブログで「豊富な知能」構想を公開しました。AIインフラの価値を規模ではなく実現できることで測り、フルスタック戦略と成果あたりのコストで供給拡大を目指す方針をまとめました。
同じ動きを異なる見た目で二重描画する「シャドウペア」で、動作と見た目を分離する動画ワールドモデル「ShadowDancer」を解説します。ラベルや微調整なしで動作を環境間転送し、人間動作PSNR22.4を達成しました。
Googleがパーソナルエージェント「Gemini Spark」を日本を含む160カ国以上で提供開始しました。搭載モデルや連携サービス、米国先行のChrome統合機能による予約手続き自動代行の仕組みと安全設計を解説します。
35BのAIエージェント「Frontis-MA1」が機械学習開発の自己改善を実現しました。4つの進化操作と探索を組み合わせ、単一GPUでメダル獲得率を71.21%へ高めGPT-5.5+Codexを超えた仕組みを解説します。
OpenAIがアクティブユーザー10億人・導入企業200万社を突破。モデル提供コスト20%削減やトークン生成効率向上の成果をGPT-5.6の値下げに還元する経営戦略を解説します。
線形注意KDAとMLAを融合したハイブリッド拡散Transformer「Chimera」を解説します。Wan-2.1比7.3倍の計算効率と、5秒学習から30秒動画へのゼロショット外挿でFID劣化6.5%を実現した手法と成果を紹介します。
ミネソタ地区連邦地裁がxAIの差止請求を棄却し、米国初の「nudify」アプリ禁止法が施行されました。Grok悪用を発端とする本件の経緯と、AI規制の先例としての意味を解説します。
デコーダ型LLMが記憶と推論を同じパラメータに詰め込む構造を分離する新手法「Memory Decoder」を解説します。410M本体に6.9Bの記憶を組み合わせ、総パラメータ39%減で12Bモデルを17ベンチマークで上回りました。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
PP-OCRv6: わずか34Mパラメータで235B超の大規模VLMを超えた軽量OCRシステム