Home
AIリーダーシップ
AI NEWS
AIツール
AI Trends
AI Native Lab
購読

OpenAI、GPT-5.6「Sol・Terra・Luna」3種全面公開...

팀제이커브
カテゴリー
Empty
OpenAIが7月9日(現地時間)、次世代言語モデルファミリーGPT-5.6を一般公開した。最上位モデル「Sol」、バランス型「Terra」、軽量高速型「Luna」で構成された3段階ラインナップだ。サム・オルトマンCEOは、フラッグシップSolがAIコーディング作業で前作対比トークン効率が54%改善されたと明らかにした。注目すべき課題は公開方式だ。今回のモデルは6月26日から米国政府の要請により約20の承認機関にのみ制限提供され、商務省傘下のAI標準革新センター(CAISI)の検討が終わってから13日ぶりに全面公開に転換された。
3つのモデルの基本仕様は同じです。コンテキストウィンドウ100万トークン、最大出力12万8,000トークン、知識基準日は2026年2月16日だ。価格は100万トークン基準Solが入力5ドルに出力30ドル、Terraが2.50ドルに15ドル、Lunaが1ドルに6ドルに策定された。パフォーマンスに対するコストの削減に焦点を当てた構成で、OpenAIは長時間の自律作業を実行するエージェントの使用を中心的な使用先として打ち出しました。実際、エージェント持続遂行能力を計る「Agents」Last Exam」ベンチマークでSolは53.6点を記録し、AnthropicのClaude Fable 5を13.1点差で上回った。
ただし、コーディングベンチマーク全般で優位を確保したわけではない。実際のソフトウェアのバグ修正能力を評価するSWE-Bench Proでは、Claude Fable 5が80%でSolの64.6%を大きく上回った。 OpenAIはそのベンチマークの質問の約30%に欠陥があると反論したが、AI研究者サイモン・ウィリソンは自身の複雑なコーディング作業実験で「Solは明らかに有能だがFableほど優れていなかった」と評価した。ベンチマークの選択によって勝者が分かれる、いわゆる「基盤モデル戦争」が再び激化する様相だ。
モデルと共に発売されたAPI機能もエージェント時代を正準化した。開発者がコードでツール呼び出しを組み合わせる「プログラマティックツールコール」、並列作業のためのサブエージェントを生成するマルチエージェントオーケストレーション機能がレスポンスAPIに追加された。プロンプトキャッシュも明示的なキャッシュポイント指定と少なくとも30分のキャッシュ保持をサポートして予測可能性を高めた。インフラ側ではCerebrasチップベースで毎秒最大750トークンの推論速度を7月中に提供するという計画も公開された。
今回の発売で業界が最も注視する点は「政府先行公開」先例だ。フロンティアモデルが一般公開前に連邦機関のレビュー関門を通過したのは、自発的なAI安全フレームワークが実際に動作した最初の大規模なケースと評価される。サイバーセキュリティなど二重用途能力が向上したモデルに対して、政府が事前アクセス権を持つ構造が、今後、アントロピック、グーグルなどの競合他社にも慣行に広がるかがカギだ。規制のない自律条約方式が維持されるか、法制化圧力につながるかによって、フロンティアモデルの発売周期自体が変わることがある。
市場の観点から、GPT-5.6は、パフォーマンス競争よりも費用対効果の高い競争に重心が移動したことを示しています。コーディングエージェントのベンチマーク新記録を前作比半分以下のコストで達成したという点は、トークン単価と効率が企業導入の実質変数になったという信号だ。エージェントが数時間から数日単位で自律動作する環境では、単発性能よりも累積コストが総所有コストを左右するためだ。下半期予告された競合他社の次期モデルがこの効率競争にどのように応受するかが次の観戦ポイントだ。
AI Native 백과사전
「AI Native百科事典」を購読する
サイトを購読すると、新しい投稿などの最新のアップデートを通知やメールで最初に受け取ることができます。
Slashpageに参加して「AI Native百科事典」を購読してください!
購読
👍