本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 本論文の概要 生成モデルの進化によって、画像や音声の生成だけでなく、3Dオブジェクトや動的なシーンの生成も可能になっています。近 […]
マルチモーダルLLMを医療画像解析に応用する研究を解説。CTやX線など多様な医療画像に対応するデータセット「Med-MAT」の構築手法と、診断支援における精度向上への貢献を紹介します。
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 概要 この論文は、視覚タスクの理解とゼロショット一般化を目指した「Explanatory Instructions」というアプロ […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? この論文では、人間の視覚的な注意と反応を予測する統合モデル「UniAR」を提案しています。 背景と概要 […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? この論文では、LLMが快感と苦痛を考慮した意思決定ができるかを検証しています。 この成果は、AIの感情理 […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? 本論文は、動画生成AIの処理速度を改善する「AdaCache」という新手法を提案しています。 背景 近年 […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? 本論文は、画像と言語の学習において、従来のCLIPのような対照学習の課題を解決する手法「SuperCla […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? Metaが発表したMovieGenは、テキストから高品質な動画生成を実現する画期的なAIモデルです。課題 […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? 本論文は、Transformerモデルが不要な文脈に過剰に注意を向けてしまう問題に着目し、新しい「Dif […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? 本論文は、多数の会話を含む検索拡張生成(RAG)システムの評価のための新しいベンチマーク「CORAL」を […]
本記事で使用している画像は論文中の図表、またはそれを参考に作成した画像を使用しております。 この研究のポイントは? 本論文は、大規模言語モデル(LLM)の「誤った出力(ハルシネーション)」について、その原因を「知識の欠如 […]
LLM高速化手法「Self-Distillation Through Time(SDTT)」を解説。自己蒸留により投機的デコーディングを改善し、最大32トークンの同時生成を実現する仕組みと性能評価を紹介します。
Agents-A1とは?35Bモデルで1兆パラメータ超の性能を達成するエージェント水平スケーリング
LLMはなぜ日本文化に偏る? 欧州研究が明かすAIの隠れた文化バイアス
プロンプトエンジニアリングとは?主要手法の仕組みと使い方
Mage-Flowとは?4Bで1024px画像を0.59秒生成する基盤モデル
AIのイエスマン化が人間に悪影響、スタンフォード・CMU研究が実証