Googleがパーソナルエージェント「Gemini Spark」を日本を含む160カ国以上で提供開始しました。搭載モデルや連携サービス、米国先行のChrome統合機能による予約手続き自動代行の仕組みと安全設計を解説します。
35BのAIエージェント「Frontis-MA1」が機械学習開発の自己改善を実現しました。4つの進化操作と探索を組み合わせ、単一GPUでメダル獲得率を71.21%へ高めGPT-5.5+Codexを超えた仕組みを解説します。
OpenAIがアクティブユーザー10億人・導入企業200万社を突破。モデル提供コスト20%削減やトークン生成効率向上の成果をGPT-5.6の値下げに還元する経営戦略を解説します。
線形注意KDAとMLAを融合したハイブリッド拡散Transformer「Chimera」を解説します。Wan-2.1比7.3倍の計算効率と、5秒学習から30秒動画へのゼロショット外挿でFID劣化6.5%を実現した手法と成果を紹介します。
ミネソタ地区連邦地裁がxAIの差止請求を棄却し、米国初の「nudify」アプリ禁止法が施行されました。Grok悪用を発端とする本件の経緯と、AI規制の先例としての意味を解説します。
デコーダ型LLMが記憶と推論を同じパラメータに詰め込む構造を分離する新手法「Memory Decoder」を解説します。410M本体に6.9Bの記憶を組み合わせ、総パラメータ39%減で12Bモデルを17ベンチマークで上回りました。
OpenAI のアルトマン CEO が AI 開発のペース調整を求める姿勢へ転じ、OpenAI と Anthropic が嘆願書『Pacing the Frontier』を支持しました。方針転換の背景と業界への影響を解説します。
自己反省手法Self-RefineやReflexionは本当に有効なのか。同じトークン予算で繰り返しサンプリングと比較したところ、1.5Bから7Bまで一貫して反省が劣り、10件の設定で基準を下回った実証研究を解説します。
OpenAIは未公開モデルAstraが10年以上未解決の数学難問10件に進展したと発表。非ソフィック群の証明やコンヌ予想の反証など、幾何・暗号・計算複雑性の成果を約2000ドルの費用で得た経緯を解説します。
PhiZeroは4秒の動画を256トークンの離散「物理言語」に圧縮し、VLMで未来を推論してから拡散モデルで描画する世界モデルです。Physics-IQ Verifiedなど主要ベンチマークで最高スコアを達成した仕組みを解説します。
avatarinがOpenAIのGPT-Realtimeを使い、ヤマダ電機に24時間対応の多言語音声接客AIを導入しました。2週間で約3万人が利用し、アンケートの92%が肯定的と回答した実装事例を解説します。
Alibabaが発表した基盤GUIエージェント「Qwen-UI-Agent」を解説します。実機Android100台超で学習し、GUI操作とCLIを統合。MobileWorld-Realで92.2%を達成し、モバイルからWebまで横断する実力を紹介します。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
PP-OCRv6: わずか34Mパラメータで235B超の大規模VLMを超えた軽量OCRシステム