OpenAI、GPT-5.6 Solを14倍高速化する『Ultrafast』モード発表
OpenAIが新しい推論モードUltrafastを発表した。最新かつ最強モデルのGPT-5.6 Solを14倍高速化し、最大750トークン/秒の出力スループットを実現するというもの。Cerebrasというチップメーカーとのパートナーシップで実現。現在はプレビュー段階で限定的なユーザーにのみ提供されているが、容量に応じて拡大予定。インシデント対応、カスタマーサービス、金融市場分析、e-commerce など幅広い企業向けユースケースを想定している。
ここで注目すべきは「14倍高速」という単純な数字ではなく、その先にある「スループット」という実務単位だ。つまり「一度の問い合わせが速い」のではなく、「毎秒750トークンを処理できる=同時に複数の顧客対応ができる」ということ。言い換えれば、AIモデルの性能軸が「精度」から「実務単位のコスト」へシフトしている。この転換は重要だ。
AIの利用コスト曲線は、「高性能・低速・高コスト」と「中程度性能・高速・安価」のどちらかに分岐せざるを得ない。Ultrafastは後者を狙うもので、企業向けチャットボットや自動応対システムといった「スケール重視」の用途に最適化している。中小企業がAI導入を考えるなら、まずこの分岐点を理解することだ。「最先端のモデルが欲しい」という憧れと「実際に欲しいのは、毎日安定稼働するシステム」は別問題。Ultrafastのようなオプションが現れたのは、市場が「完璧より実用」を求め始めた証拠。自社の課題が「精度」なのか「スケール」なのか、それを見極めることが、AI投資の成否を分ける。
※ 上記は配信元記事をもとにAIの鬼編集部が要約・再構成したものです。正確な内容は出典元をご確認ください。
このニュースの全文は、配信元でお読みいただけます。 TechCrunch AIで元記事を読む →


