Sign In

OpenAI、GPT-5.6 Solに14倍速い「Ultrafast」モード公開… Cerebrasチップによる毎秒750トークンの処理

팀제이커브
OpenAIが最上位モデルGPT-5.6 Solを既存の標準処理に比べて最大14倍速く実行する新しいAPIサービス層「Ultrafast」を去る8月13日(現地時間)公開した。 AI半導体企業Cerebrasの超低遅延推論インフラ上で駆動されるこのモードは、毎秒最大750個の出力トークンを生成し、現在一部選別された顧客を対象に制限的なプレビューで提供されている。
今回の発表の核心は「知能とスピードのトレードオフ」を破ったという点だ。これまでのリアルタイムレベルの応答速度を必要とするサービスは、より小さいか特化されたモデルを選択しなければならなかったが、UltrafastはOpenAIの最もスマートなモデルをそのまま使いながら速度だけの桁数以上引き上げた。 OpenAIはこれを「毎秒より多くの有用な作業(more useful work per second)」という新しい発展方向に規定し、障害対応、金融リサーチと異常取引の検出、リアルタイム音声顧客サポート、コマースの離脱直前の応対、実験の繰り返し周期が長い研究作業などを代表活用シナリオとして提示した。
初期顧客群の反応も共に公開された。 OpenAIはJane Street、Podium、Basis、Rogoなどのコーディング、コマース、金融リサーチ、カスタマーサポート分野の企業とプレビューテストを進めている。ジェーン・ストリートのAIアシスタント担当のJohn Crepezziは、「Cerebrasがもたらす速度の向上は印象的です。モデルの書き方自体を変え、開発者がモデルと並んでより集中的で生産的に働くことを実用的にする」と評価した。 OpenAI内部でも障害通知が鳴ると、ログとトレース、最近のコード変更をリアルタイムで分析し、原因候補と修正案を準備するインシデント対応にUltrafastを投入しており、一晩回した実験配置を勤務時間中に何度も繰り返すレベルに研究サイクルを短縮したと明らかにした。
今回の協力は、OpenAIとCerebrasのパートナーシップの次の段階という点でも注目される。 Cerebrasはウエハスケールチップベースの超高速推論として知られる企業であり、これまで主にオープンソースモデルや軽量モデルサービングで強みを見せてきた。今回、OpenAIの最上位フロンティアモデルを直接サポートすることになり、NVIDIA GPU中心に組み込まれていた大型モデル推論インフラの地形に意味のある変数ができた。 OpenAIの立場では、GPT-5.6系列で進めてきた効率化、価格引き下げの流れに続き、「速度」という軸を競争優位要素として追加したわけだ。
展望も明確だ。 OpenAIは、プレビュー期間中に初期の顧客と共に速度が最大の価値を生み出す点を検証し、その結果を製品全体に反映しながら容量の拡充に合わせてアプローチを段階的に拡大する計画だ。知能の損失なしに応答遅延が消えれば、AIはビジネスで最も時間に敏感な領域、すなわち障害が進行中の瞬間、顧客が決済を躊躇する瞬間、市場が動く瞬間に入ることができるようになる。 「どのくらいスマートなのか」を超えて「どのくらい早くスマートなのか」がフロンティアモデル競争の新しい戦線になっているという信号だ。
AI Native 백과사전
「AI Native百科事典」を購読する
サイトを購読すると、新しい投稿などの最新のアップデートを通知やメールで最初に受け取ることができます。
Slashpageに参加して「AI Native百科事典」を購読してください!
購読
👍