sakutto
生成AI

GPT-5.6 Solが最大14倍速へ|新モード「Ultrafast」の中身

OpenAIGPT-5.6GPT-5.6 Sol
GPT-5.6 Solが最大14倍速へ|新モード「Ultrafast」の中身

Ultrafastとは

Ultrafastの概要

速度
標準処理の最大14倍・毎秒最大750トークン
基盤
Cerebras
提供
OpenAI API・限定プレビュー

Ultrafastとは OpenAI が2026年8月13日に公開した新しいサービスティアです。

標準比で最大14倍という新ティア

UltrafastはGPT-5.6 Solを標準処理と比べて最大14倍の速さで動かします。 ティア(等級)とあるとおり、モデルを差し替えるのではなく同じ最上位モデルを走らせる速度の等級を新設した形です。提供はまず OpenAI API から始まります。GPT-5.6 Sol 自体の位置づけは GPT-5.6 Solの解説記事 にまとめてあります。

公式情報を見る →
"Today, we're sharing an early look at Ultrafast, a new service tier that runs GPT-5.6 Sol up to 14× faster than Standard processing, launching first in the OpenAI API." — OpenAI 公式発表より

速度と賢さの二択を外す

ここが今回の肝です。これまで実時間の応答が欲しければ、小型モデルや特化モデルを選ぶしかありませんでした。 OpenAIはUltrafastを「毎秒あたりの有用な仕事量」を増やす方向への前進だと表現しています。賢さを落とさずに速さを取れるなら、待ち時間を理由に諦めていた業務にAIを差し込めます。

公式情報を見る →
"Until now, getting real-time speed typically meant choosing a smaller or more specialized model. Ultrafast points to progress in a new direction: more useful work per second."/"When speed no longer requires giving up intelligence, AI can move into the most time-sensitive parts of a business and new kinds of work become possible."(いずれも冒頭の解説段落)— OpenAI 公式発表より

速度の根拠と使いどころ

公式が挙げた想定ユースケース

障害対応
ログ・変更差分を読み原因特定と修正案を作る
金融・不正検知
相場や取引を状況が動くうちに評価する
音声・接客
会話を止めずに複数手順の回答を返す
EC
離脱前に在庫確認や決済トラブルを解消する
ライブ研究
一晩かかる検証を対話的な作業に変える

速度の出どころと、公式が挙げた使いどころを見ていきます。

Cerebrasが支える毎秒750トークン

基盤はCerebrasです。出力で毎秒最大750トークンを生成するとされています。 Cerebrasは、OpenAIが待ち時間の短い推論(AIが答えを作る処理)で提携している相手です。トークンは文章を細かく区切った単位なので、毎秒750トークンは長文がほぼ待たずに流れてくる速さにあたります。

公式情報を見る →
"Powered by Cerebras, Ultrafast generates up to 750 output tokens per second, bringing our most intelligent model to products and workflows where every second matters."(冒頭段落)/"Ultrafast marks the next step in our partnership with Cerebras to bring ultra-low-latency inference to OpenAI's platform."(Powered by Cerebras の節)— OpenAI 公式発表より

一刻を争う業務での使いどころ

公式が挙げた領域は5つ。障害対応、金融リサーチとセキュリティ、カスタマーサポートと音声、コマース、そして実験を回すライブリサーチです。 どれも「答えが出るまでに状況が変わってしまう」種類の仕事で、速さがそのまま結果を変えます。障害対応なら、障害が続いているうちにログと直近のコード変更を読んで原因の当たりをつける使い方です。

公式情報を見る →
"Incident response and reliability: When a critical system fails, analyze application logs, recent code changes, and engineer reports to identify the likely cause and help prepare a fix while the outage is still unfolding."/"Financial research and security: Analyze market signals, assess transactions, and identify suspicious activity while conditions are still changing."/"Customer support and voice: Resolve complex customer issues in real time without interrupting the conversation, even when finding the answer requires multiple steps or systems."/"Commerce: Answer product questions, check inventory, personalize recommendations, and resolve checkout issues while the shopper is still deciding, before hesitation becomes an abandoned cart."/"Live research and experimentation: Turn research that previously took an overnight run into an interactive working session, letting teams test an idea, examine the results, adjust their approach, and run another experiment without breaking their flow."(いずれも想定ユースケースの箇条書き5項目)— OpenAI 公式発表より

使える条件とまとめ

提供状況

現在
限定プレビュー・一部顧客のみ
今後
処理能力の拡大にあわせて対象を拡大

最後に、いま実際に使えるのかを確認します。

限定プレビューという段階

Ultrafastは限定プレビューで、対象は選ばれた一部の顧客だけです。 誰でもAPI経由で使えるわけではありません。OpenAIは処理能力の拡大にあわせて対象を広げるとしており、公式ページには開放時の通知を受け取る申し込み口が用意されています。導入を検討するなら、自社のどの処理が「秒単位で価値が変わるか」を先に洗い出しておくと枠が開いたときに動けます。

公式情報を見る →
"GPT-5.6 Sol on Ultrafast mode is available in a limited preview today to a select group of customers. We'll expand access as capacity grows."(Availability の節)/"If your business requires frontier intelligence at the highest speed, you can sign up to get notified when access expands."(冒頭の解説段落)— OpenAI 公式発表より

OpenAI社内での使い方

社内でも実際に使われています。研究チームは従来、実験をまとめて夜間に流して翌朝に結果を見ていました。Ultrafastではこのループが縮み、日中に何度も回せるようになったとしています。 一晩かかっていた検証が対話的な作業に変わります。

公式情報を見る →
"A common workflow in research is for our team members to launch a batch of experiments over night, and review the results in the morning. With Ultrafast, we see this loop tightening to support multiple iterations during the workday instead." — OpenAI 公式発表より

海外の発表は英語のまま出ます。見出しや表の構造を保ったままマークダウンにして手元で読むなら、次のツールが使えます。

無料ツールURLマークダウン変換URL(ウェブページ)を入力するだけでマークダウン(Markdown)に変換。見出し・表・リスト・リンクを保持したままmd化でき、LLMやRAGの前処理、調査資料の整形にも最適な無料オンラインツール。今すぐ使ってみる →

よくある質問

Q. Ultrafast とは何ですか?
OpenAIが2026年8月13日に公開した新しいサービスティアです。GPT-5.6 Solを標準処理と比べて最大14倍の速さで動かすもので、まずOpenAI APIから提供されます。
OpenAI 公式発表
Today, we're sharing an early look at Ultrafast, a new service tier that runs GPT-5.6 Sol up to 14× faster than Standard processing, launching first in the OpenAI API. OpenAI 公式発表
Q. Ultrafast はどれくらいの速度が出ますか?
Cerebrasを基盤に、出力で毎秒最大750トークンを生成するとされています。標準処理に対して最大14倍という位置づけです。
OpenAI 公式発表
Powered by Cerebras, Ultrafast generates up to 750 output tokens per second, bringing our most intelligent model to products and workflows where every second matters. OpenAI 公式発表
Q. Ultrafast は誰でも使えますか?
現時点では使えません。限定プレビューとして一部の顧客にのみ提供されており、処理能力の拡大にあわせて対象を広げるとされています。
OpenAI 公式発表
GPT-5.6 Sol on Ultrafast mode is available in a limited preview today to a select group of customers. We'll expand access as capacity grows. OpenAI 公式発表

関連ツール

関連ツールカテゴリ

記事