OpenAIが最大14倍速の「Ultrafast」を限定公開 — 速さは何を変えるのか
2026年8月13日、OpenAI が Ultrafast という新サービス階層を限定公開した。最上位モデル GPT-5.6 Sol の推論を、標準の最大14倍速で実行するもの。毎秒750トークンという速度は、従来は物理的ボトルネックとして受け入れられてきたメモリ帯域幅を、Cerebras 社のウェハースケール・エンジン(チップ上に44GB の SRAM を搭載)で解決している。ただし現時点では一部法人のみへの限定公開で、価格は公表されていない。「品質を落とさずに」という公式の謳い文句は、速さが商品そのものになったことを示している。
だが本当に重要なのは、速さそのものではなく、速さが何を変えるかという点だ。「14倍速」と聞くと、1時間の作業が5分になると考えたくなる。だが実務的には違う。提案書を作るとき、記事を書くとき、コードを生成するとき、人間は「出力を読む→期待とのズレを見つける→指示を変える→もう一度出す」を反復している。その反復の単位時間が短くなるほど、単位時間あたりの試行回数が増える。応答に5分かかれば1案で妥協するしかないが、応答が20秒なら10案出して最良を選べる。成果物の質は、1回の精度より「何試した数」に左右される軸へ動く。同じ人間、同じプロンプト設計でも、選択母数が変われば成果物の質は変わる。AIの鬼が注目するのは、その経営含意だ。
受注条件が変わる可能性がある。見積書に「修正3回まで」と書くのは、現在の反復コストを前提にした条件だ。反復が速く安くなるほど、この上限は外せる。「納得いただけるまで何案でも出します」と言える側が、これからの価格競争で選ばれる。速さは、単なる効率化ではなく、営業条件の武器になる。
※ 上記は配信元記事をもとにAIの鬼編集部が要約・再構成したものです。正確な内容は出典元をご確認ください。
このニュースの全文は、配信元でお読みいただけます。 Zenn AIで元記事を読む →


