本文へスキップ
AI-Papers

OpenAIがGPT-6をChatGPTの全ユーザーに展開、Intelligent UIも同時提供

OpenAIがGPT-6をChatGPTの全ユーザーに展開、Intelligent UIも同時提供
  • OpenAIがGPT-6をChatGPTのChatタブで全世界に展開、有料プランが先行し、FreeとGoは翌日から利用可能になる
  • 応答をテキストだけでなく図表・地図・操作できるUIで返す「Intelligent UI」を同時に提供し、形式は質問内容に応じて切り替わる
  • Web検索を伴う質問でGPT-6 InstantはGPT-5.6 Instantより平均44%早く応答を開始し、マルチターン攻撃への耐性も強化された

全プランへ段階展開

OpenAIは10月7日、ChatGPTの全ユーザーに向けてGPT-6の展開を開始したと発表しました。先月に有料顧客向けとして投入された最初のGPT-6シリーズが、週あたり12億人が使うというChatGPTの一般向け利用に広がる形です。

展開対象はChatGPTのChatタブに限られ、WorkとCodexで使われるモデルは変更されません。Enterpriseでの利用可否は職場の管理者設定に依存します。プランごとに割り当てられるモデルは次のとおりです。

プラン

モデル

提供開始

Plus・Pro・Business・Enterprise

GPT-6 Sol

発表当日から順次

Free・Go

GPT-6 Luna

翌日から

SolとLunaはいずれも日常的な会話向けに調整されたモデルとされています。発表ではGPT-6 InstantとGPT-6 Extra Highという名称も登場しますが、両者の位置づけや使い分けの詳細は示されていません。モデルの選び分けや推論強度の考え方は、OpenAIが公開したGPT-6の実践ガイドが参考になります。

Intelligent UIとは?

今回の発表でもう一つの柱となるのが、Intelligent UIと呼ばれる応答の提示方法です。GPT-6はテキスト、視覚要素、操作できる要素を組み合わせて回答を構成し、どの形式で見せるかを質問の内容から判断します。比較を尋ねられれば横並びの表、場所を含む相談なら地図といった具合で、単純なテキストが最も役立つ場面ではテキストのまま返します。

使われる構成要素は、グラフィック、タップできるボタン、入力フォーム、チャート、そしてその場で動くインタラクティブな体験です。OpenAIが挙げた例では、日曜のラム肉のローストについて尋ねると人数別の分量表と時間割つきの手順が返り、ロードトリップの相談では立ち寄り先が地図上に表示されます。複雑なテーマには操作できる図解が添えられ、貯蓄の計算機や割り勘ツール、簡単なゲームのように、求めに応じたツール自体を作ることもできます。

技術的な裏付けとして、ネイティブでストリーミング可能なコンポーネントのライブラリと、生成の進行に合わせて画面を段階的に描き出すコンパイラが挙げられています。モデルが出力し終わるのを待たずにUIが組み上がっていくため、図やフォームでも待ち時間の体感を抑えられるという設計です。図1はこの流れを示したものです。

図1: Intelligent UIが応答の形式を選び、段階的に描画する流れ
図1: Intelligent UIが応答の形式を選び、段階的に描画する流れ

応答開始が44%速く

速度面では、Web検索が必要な質問においてGPT-6 InstantがGPT-5.6 Instantより平均44%早く回答を開始すると説明されています。思考が完全に終わる前から回答を書き始められるようになった点が、この短縮につながっています。

社内のエージェント課題の評価では、GPT-6 Extra HighがGPT-5.6 Mediumと同程度の時間で応答を開始しながら、GPT-5.6 Extra Highを上回るスコアを記録したとしています。難しい質問の核心部分に触れる頻度もGPT-5.6より高いとされますが、こちらは具体的な数値が公開されていません。

安全性の更新点

安全性については、以下の点が改善として挙げられています。

  • 安全性の訓練を回避しようとする試み、特にマルチターン攻撃への耐性を強化
  • サイバー攻撃、生物学的脅威、暴力に関わる高リスクな悪用への保護を更新
  • 単一のプロンプトでは見えないリスクを会話履歴から検知
  • 無害な要求に対する不要な拒否を低減
  • 情報やツールの不足など、自身の能力の限界を認識して明示

詳細はGPT-6のシステムカードとして別途公開されています。一方で、今回の発表にはAPIでの提供状況、プランごとの利用上限、旧モデルの扱いについての記載はありません。

チャット画面の前提が動く

これまでのチャットAIは、入力と出力の双方が文字列であるという前提のうえに成り立っていました。Intelligent UIは、出力側をモデルが組み立てるインターフェースへ置き換えるもので、回答を読んで理解する作業の一部を、画面を操作して確かめる作業に移す試みと言えます。

開発者やプロダクト側の視点では、モデルが生成したUIが既存のアプリ機能と重なる領域が出てきます。計算機や分割ツールのような軽量な機能をチャットの中で完結させられるようになると、どこまでを自社のUIで提供し、どこからをモデルに任せるかという線引きが実務の論点になりそうです。

シェア:

投稿には GitHub アカウントが必要です。投稿内容は公開され、利用規約に反するものは予告なく削除します。