NVIDIAが自動運転オープンモデルAlpamayoのライセンスをOpenMDW-1.1へ変更し、商用利用を解禁しました。新モデルAlpamayo 2 SuperはLingoQAで約40モデル中首位、累計ダウンロード50万超の実力を解説します。
正解から逆探索して各ステップに密な報酬を与える強化学習手法ABSeekerを解説します。Qwen3.5-4BをわずかBrowseComp 37.3%(文脈管理で55.3%)に引き上げ、30B級に匹敵させた仕組みを紹介します。
Metaがターミナル動作型のコーディングエージェント「Muse Code」を発表。新モデルMuse Spark 1.2はTerminal-Bench 2.1で82.9%を記録し、Claude CodeやCodexに対抗します。その仕組みと実力を解説します。
推論、検索、画像生成を1つのモデルに統合したエージェント型画像生成ToolArtistを解説します。Emu3.5とRAD-GRPO強化学習でWISE0.79を達成し、Qwen-Imageを上回った手法を紹介します。
Google の中核研究者Jeff Dean氏らが退社し、科学研究の自動化を目指す新会社Discovery Loopを設立。Alphabet自身も出資する異例の構図とその狙いを解説します。
音声・映像・テキストを扱うオムニモーダルLLMを学習不要で高速化する2段階トークン圧縮OmniPackを解説。Qwen2.5-Omni-7BでFLOPsを16.7%に抑えつつ性能98.0%を維持する仕組みを紹介します。
AnthropicがカスタムAIチップの設計チームを新設しました。ハードウェアとモデルを協調設計してClaudeの推論を高速化・効率化する狙いで、GoogleやOpenAIに続くAI業界の垂直統合の動きを解説します。
1枚の画像から3Dシーンを再構成する新視点合成手法InfiniSplatを解説します。ピクセル整列ではなく深度から導く表面構造にガウスを配置し、大きな視点変化でもSOTAを達成しました。
JFrogがGitHubで公開された55件の脆弱性報告を検証し、54件がAI生成とみられる捏造だったと発表しました。SQLite関連はNVDで最高評価を受けており、公的脆弱性DBの構造的欠陥を解説します。
Tencentが公開したHunyuan3D-Buffalo 1.0は、3Dの生成・理解・編集・パーツ生成を単一モデルに統合した基盤モデルです。テキストから3D生成で選好率約3倍、編集でChamfer距離86.7%削減を達成した仕組みを解説します。
テキサス州が全新規データセンターに監査を義務付け、実質的に建設を停止しました。接続待機キューは半年で233GWから474GWへ倍増。AIインフラ集積地に生じた転機を数値とともに解説します。
因果的自己注意を勾配経路として使い、報酬勾配を連続潜在状態へ直接割り当てるテスト時推論手法「GradCuit」を解説します。5つのLLMと3ベンチマークで平均64.5%を達成し、CoTを6.6ポイント上回りました。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
PP-OCRv6: わずか34Mパラメータで235B超の大規模VLMを超えた軽量OCRシステム