OpenAIがGPT-6 SolとLunaを発表、コスト効率と知能の両立が加速

GPT-6ファミリーの拡充と価格改定

OpenAIはGPT-6 Astraに続き、GPT-6 SolとGPT-6 Lunaを発表した。Astraが最性能を担う一方、SolとLunaはコスト効率を重視したモデルとして位置づけられる。API価格はGPT-5.6のプロモーション価格から50パーセント引き下げられ、Solは入力2ドル・出力10ドル、Lunaは入力0.10ドル・出力0.50ドルに設定された。キャッシングと推論の改善により大規模提供が可能になり、その恩恵を直接ユーザーに還元する形だ。

実務性能の向上と競合モデルとの比較

AutomationBenchではGPT-6 Solのxhigh設定がClaude Opus 5 maxを上回り、コストはわずか9パーセントだった。Agents’ Last ExamではGPT-6 Sol maxが56.4パーセントを記録し、Claude Opus 5を60パーセント低コストで超えた。FrontierCodeではGPT-6 SolがGPT-5.6 Solから大幅に改善され、Claude Fable 5.1 xhighと同等性能をより低いコストで実現した。DeepSWE v1.1ではGPT-6 Sol maxが68.8パーセント、Luna maxが66.6パーセントを達成し、Claude Opus 5やFable 5に対して93〜96パーセントのコスト削減を実現した。OSWorld 2.0でもSolがClaude Opus 5 mediumと同等スコアを80パーセント低コストで達成している。

事実性と対話スタイルの改善

内部の事実性評価では、GPT-6 Solは前身モデルの約半分の誤りに抑え、Astra並みの信頼性に近づいた。Lunaも大幅に改善され、高いeffort設定でGPT-5.6 Solと同等の事実性を約百分の一のコストで実現する。対話スタイルもAstraの改善がSolとLunaに反映され、技術的な会話での明快さが増し、冗長な表現や専門用語の乱用が減った。プロンプトキャッシングも強化され、キャッシュヒット率の向上とキャッシュ入力トークン読み取りの90パーセント割引が適用される。コストと性能のトレードオフを前提とした従来の発想を覆し、高度なAIを日常業務に広く組み込むための基盤が整いつつある。