Home
AIリーダーシップ
AI NEWS
AIツール
AI Trends
AI Native Lab
購読

OpenAI、フロンティアモデルGPT-5.6 Solプレビュー

팀제이커브
カテゴリー
Empty

画像 - アルトテキストを含める

OpenAIが次世代フロンティアモデル「GPT-5.6 Sol」をプレビューで公開し、7月中にCerebrasのウエハスケールハードウェアで毎秒最大750トークンの推論速度でサービスすると明らかにした。従来のGPUクラスタでフロンティア級モデルが通常1秒あたり40~120トークンレベルでストリーミングされるのと比べると、最大10倍に近い速度で、「最もスマートなモデルは遅い」という業界の長年の公式を正面から破る試みだ。
GPT-5.6 Solは6月26日、ホワイトハウスの自発的事前配布レビュー(voluntary pre-deployment review)手続きを経て初めて姿を現した。今回の発表の核心は、モデル自体の知能向上よりサービングインフラの転換にある。 Cerebrasはウエハ一枚全体を一つのチップで使うウエハスケールAI加速器を作る会社で、GPU数百枚をネットワークに結びつける従来方式に比べメモリボトルネックが少なくスループットを劇的に引き上げることができる。 OpenAIはCerebrasでサービングされるSolが既存のディストリビューションと「同じモデル」であることを確認し、初期には限られた顧客に先に提供した後、Cerebrasの容量拡充に合わせてアプローチを広げる計画だ。
機能的には、Solは画像、スクリーンショット、図、文書を理解するネイティブマルチモーダルビジョンと拡張されたコンテキストウィンドウを備えています。 API価格は入力100万トークン当たり5ドル、出力100万トークン当たり30ドルと策定された。外部アナリストのブレイス・グッドソン(Bleys Goodson)は、Solがウエハ1枚当たりのモデルレイヤー1枚で70~100枚のCerebrasウエハに分散サービングされると推定し、合計3兆パラメータに活性パラメータ1,500億、70層規模のMoE構造である可能性を提起した。ただし、OpenAIは詳細なアーキテクチャとベンチマークの数値を公開していない。
今回の配布の背景にはOpenAIとCerebrasが結んだことが知られている200億ドル規模、750メガワット級推論コンピューティング多年契約がある。今年初め、IPOを申請したCerebrasの立場でフロンティアモデルの実戦配布は上場を控えた強力な検証信号と解釈される。 OpenAIは同時にBroadcomのカスタムチップ「Jalapeño」にも同じモデルを並行配布することが伝えられ、NVIDIA GPUの一辺図から抜け出し、カスタムシリコンで推論インフラを多様化する戦略が明らかになっている。
速度がまもなく製品になる局面だ。毎秒750トークンの推論は、リアルタイムコーディングアシスタント、AI検索、音声エージェント、長文文書分析など、応答遅延がユーザーエクスペリエンスを左右する領域で質的に異なる体験をする。特にモデルが答えを出す前に数千トークンを「考える」推論(reasoning)ワークロードでは生成速度がまもなく待ち時間なので、スループット10倍は単純な便宜ではなくエージェントアーキテクチャ設計自体を変える変数だ。
業界の競争軸がベンチマークスコアから遅延時間に移動しているという点も注目に値する。これまでGroq, Cerebrasのような推論特化チップメーカーはオープンソースモデルの高速サービングで存在感を育ててきたが、最前線閉鎖型モデルがウエハスケールハードウェアに上がったのは今回が事実上初めてだ。開発者と企業にとっては、モデル選択時の知能だけでなく、エンドツーエンドのトークン処理速度を一級指標にする必要があるというシグナルであり、フロンティア知能と超低遅延が代わりとなる時代が開かれていることを示している。
AI Native 백과사전
「AI Native百科事典」を購読する
サイトを購読すると、新しい投稿などの最新のアップデートを通知やメールで最初に受け取ることができます。
Slashpageに参加して「AI Native百科事典」を購読してください!
購読
👍