VAE潜在空間を使わずピクセル空間で直接学習するテキスト画像拡散モデルの訓練レシピを解説します。潜在拡散と同等以上の品質を保ちつつ、推論を最大4.75倍高速化した最新研究の要点を紹介します。
AI推論チップでNvidiaに挑んだGroqが、Nvidia GPUを運用するネオクラウド事業へ転換しました。3.5億ドルを調達した一方、評価額が69億ドルから35億ドルへほぼ半減した背景を解説します。
上海AI Labが知識を蓄えるFFNと推論を担うSelf-Attentionを分離した新アーキテクチャMobiusを提案。7Bは学習データ62.6%でTransformer同等、35BのIntern-S2-Mobiusは約4倍の推論高速化を実現しました。
Midjourney、Stable Diffusion、FLUX、Nano Bananaなど主要な画像生成AIを2026年最新情報で比較。アーキテクチャ、商用ライセンス、ローカル実行の違いから目的別の選び方までわかりやすく解説します。
中国Unitreeが開発中の新型ヒューマノイドを公開しました。助走なしで高さ2m、走行で時速45.6kmという人間を超える数値を、開発開始からわずか3カ月で達成した点をわかりやすく解説します。
戦争や災害のAI生成フェイク動画に特化した検出ベンチマーク「RA-Bench」を解説します。実動画と生成動画あわせて1.8万本で各種検出器を検証し、精度がほぼ偶然並みに低下し、SNS拡散でさらに悪化する実態を明らかにしました。
Hugging Faceが2026年8月14日に公開したオープンモデル総括を解説します。ダウンロードの83%は1B未満、Qwen派生は15万件超でMetaの2.6倍、エージェントが最大利用層になった構造変化を数字で読み解きます。
論文執筆を13個の合成可能なスキルに分解した自動生成システム「Spark-to-Paper」を解説します。結果を見る前に証拠を規定する設計で捏造検出率を14%から92%へ高め、引用正確性99.5%、1本8.1ドルを実現しました。
AnthropicがClaude生成テキストに埋め込む電子透かしの仕組みを公開しました。秘密鍵と文脈から単語選択を操作し、品質や料金に影響なく統計的パターンを残す方式です。検出方法や効かない場面まで解説します。
どのクエリにも万能なLLMは存在しません。LLMRouterはルーティングを5要素で定式化し、汎用から視覚まで5トラックのベンチマークで16種以上のルーターを評価。学習型は固定モデル比で相対14.6%の改善を達成しました。
マスク拡散LLMが推論の途中で答えを先に固定してしまう欠陥を特定した研究を解説します。単一パラメータ「frontier-gated commitment」でGSM8K精度を0.528から0.852へ改善し、最大4倍の並列デコードを維持した成果を紹介します。
元Anthropicの研究者が設立したAIラボMirendilが、Google Cloudと1億ドル超の複数年契約を締結。TPUとNvidia GPUを確保し、再帰的自己改善AIで科学研究の自動化を目指す狙いを解説します。
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
OpenAI、企業向けAIエージェント基盤「Presence」発表 — 電話対応の75%を無人解決