2026年3月2日のBloomberg報道によると、AIコーディングツール「Cursor」のARRが20億ドルを突破しました。2025年末の約10億ドルから3ヶ月で倍増した急成長の背景を解説します。
ByteDance Seedが開発したCUDA Agentは、アジェンティック強化学習でGPUカーネルを自動生成・最適化します。KernelBenchで幾何平均2.11倍のスピードアップを達成し、Claude Opus 4.5やGemini 3 Proなどフロンティアモデルを大きく凌駕する性能を実証しました。
推論モデルの仕組み、o3・DeepSeek-R1などの主要モデル、テストタイムコンピュートとコスト構造、使い分けのポイントをわかりやすく解説します。
OpenAIとAmazonが複数年にわたる戦略的パートナーシップを締結。AWSがFrontierの唯一の外部クラウド配信プロバイダーとなり、Amazonは合計500億ドルを投資。エンタープライズAI展開の新たな経路が整った背景を解説します。
オムニモーダルLLMの推論能力を訓練なしで向上させるフレームワーク「ThinkOmni」を解説します。LRM-as-a-Guide機構とStepwise Contrastive Scalingにより、MathVistaで70.2、MMAUで75.5を達成しました。
OpenAIがAmazon・NVIDIA・SoftBankから総額1,100億ドルの資金調達を発表しました。企業価値は7,300億ドルに達し、合計5GW規模の計算資源確保やAmazonとの戦略的パートナーシップも同時に発表されています。
拡散言語モデル(DLM)が並列デコードを謳いながら自己回帰的に収束する根本原因を特定。訓練データの逐次的構造が問題と診断し、独立推論軌跡を使うNAP手法でGSM8Kの256ステップ精度を14.4ポイント改善しました。
予測的双シミュレーション指標を活用し、疎報酬下の視覚強化学習でタスク関連表現と探索を統合するTEBを解説します。MetaWorldでStick-pull成功率87.9%を達成し、最先端ベースラインを大きく上回りました。
ICLR 2026採択のEMPO²は、LLMエージェントのRL訓練にメモリ拡張とオン/オフポリシーのハイブリッド最適化を導入した新フレームワークです。ScienceWorldではGRPO比128.6%の性能向上を実現しています。
DPEは、LMMの弱点をマルチエージェントで診断・標的データ生成・強化学習のループで自律的に改善するフレームワークです。Qwen3-VLで11ベンチマーク全てで継続的な性能向上を達成しています。
OpenAIが2026年2月25日、AIモデルの悪用事例をまとめた最新脅威レポートを公開しました。複数プラットフォームを横断するハイブリッド攻撃の実態から、カンボジア発ロマンス詐欺、中国・ロシアの情報工作まで7つの事例を解説します。
AnthropicがAIコーディングエージェント「Claude Code」の新機能「Remote Control」をリサーチプレビューで公開。スマートフォンやタブレットからローカルマシンのセッションを遠隔操作でき、コードはクラウドに渡らない設計です。
ゴールドマン・サックスがClaude AIを会計業務に導入 — 金融AI活用の最前線
NVIDIAが日本語特化LLM「Nemotron 2 Nano 9B」を公開 — ソブリンAI実現に向けた性能を解説
AIエージェントフレームワーク比較【2026】LangGraph・CrewAI・OpenAI Agents SDKの選び方
開発者向け検索AI「Phind 2」登場、視覚的検索強化!
Step 3.5 Flashとは?110億パラメータでGPT-5.2級の性能を達成したオープンモデル