GPT-5.6登場:圧倒的なコスパでAIの限界を突破する
Advancing the price-performance frontier with GPT‑5.6
Advancing the price-performance frontier with GPT‑5.6
GPT-5.6がリリースされ、コストパフォーマンスの境界線が塗り替えられました。最新の性能向上と効率化により、開発者がより手軽に高度なAIモデルを活用できる環境が整っています。
カーネルの最適化でモデルの推論コストが20%削減され、実験段階ではトークン生成効率が15%以上向上したとのこと。
もしGPT-5.6の推論コストが20%も下がったとしたら、月間で数十億ドル単位のコスト削減になるんじゃないか?
AnthropicがSpaceX(Colossusデータセンター2拠点)から推論リソースを借りるために12.5億ドルを費やしていることはSpaceXのIPOで明らかになったけど、それがAnthropicの全推論リソースのうちどれくらいの割合かは分からない(以前からAWSなども使っていたはずだし、ほんの一部だろうけど)。
OpenAIの月額推論コストの数字は見たことがないけど、間違いなく同じように数十億ドル規模にはなっているはず。
だから、この20%削減ってのはとんでもなくデカい話だよ。
元々かなり安くて高性能だったLunaが、さらに5倍も安くなるなんて正気の沙汰じゃない。仕事ではSolを使ってるけど、自宅ではLunaを使っていて、確かに違いはあるものの、そこまで劇的な差とは感じないんだよね。この1年ずっと値上げが続いていたのに、これやKimi K3、GLM 5.2が出てきて、急激に価格が下がり始めた感じがする。
本日より、最も高速で手頃なモデルであるGPT-5.6 Lunaの価格を80%値下げします
言葉が出ない。
正直なところ、もう進化は停滞気味で、ここからは数ヶ月かけて5〜10%の改善が積み重なるような段階だと思ってたよ。こんな急激な変化を見ると、一体どこまで安くなるのか底が見えないな。
Lunaの80%値下げはかなり攻めた価格設定だな。
最先端の知能が必要ないほとんどのワークロードにおいて、現状ダントツでベストな選択肢になったね(LunaはOpus 5に匹敵することもあるってことをお忘れなく!)。
これはまるでダイヤルアップからブロードバンドに移行した時のような感覚だ。
もともと深いリサーチなんかのタスクでLunaを推してたけど、同じコストで5倍の処理ができるってのは単純にヤバい。うちはHypothesis(仮説)生成のためにすでに10個の並列エージェントを走らせてるけど、これが50個になるなんて想像もつかないよ。予算を気にせず同じプロンプトとモデルで何百ものサンプルを回せるようになると、統計データがより面白く、強力になるはず。
"広告費の半分は無駄になっている。問題は、どちらの半分が無駄なのか分からないことだ" - ジョン・ワナメイカー
これ、モデル選びにはそれ以上に当てはまるよ。自分の仕事の大部分はそこまで強力なモデルを必要としないってことは分かってるんだけど、単純なタスクとそうでないタスクを分けるのって、有名な難問だからね(そもそも判定可能かどうかすら怪しい)。
普段はOpenrouterの価格/性能グラフ(https://openrouter.ai/rankings#performance#benchmarks )をチェックしてるよ。右側の「Show Pareto」トグルをオンにするのがおすすめ。
個人プロジェクトではGLM-5.2を使い続けてたけど、今回の件でLunaを選ぶのがめちゃくちゃ簡単になったな。
予想外だった。Lunaの価格設定、今やイカれてるよ。この価格性能比で競合できるモデルは市場に存在しないんじゃないかな。
プロダクション環境のアプリについては、OpenAIが明らかにベストなプロバイダーだね。APIは信頼性が高くて便利な機能も多いし、モデルラインナップのコスパも信じられないくらい良い。長いことFireworks経由でオープンウェイトモデル(Kimi K2.5など)を使ってた。Fireworksも良いプロバイダーだけど、やっぱりあちこちでトラブルはあったしね(AnthropicやGoogleも同様)。OpenAIはとにかく安定していて高速だし、あらゆる知能レベルにおいてコスパが最高だと思う。
Lunaの80%値下げは完全にイカれてる。個人的には、来年あたりにはAPI経由の強力なモデルの方が、サブスクリプションで使うより安くなるんじゃないかと思ってる。コンピューティングコストは下がり続けてるからね。
競争ってのは素晴らしいね。100万出力トークンあたり1.20ドルなんて狂ってるけど、OpenAIが10〜12ヶ月ほど前にモデルの値上げを始めた最初の会社の一つだったことも忘れないでおこう。
GPT-5は(100万出力トークンあたり)10ドルだったしね。
彼らには、あの巨額の投資を何とかして回収しなきゃいけない理由があるんだよ。
今日、開発者ができる最善のことは、ロックインを避けるためにアプリをLLMやプロバイダーに依存しない設計にするか(あるいはLLMゲートウェイを使うこと)だね。