次世代AIの先駆け?噂の「GPT-6 Sol」と「Luna」とは一体何なのか
GPT-6 Sol and Luna
GPT-6 Sol and Luna
現在、AI業界で密かに噂されている「GPT-6」のコードネームとされる「Sol」と「Luna」。OpenAIの次なる一手として期待が高まっていますが、現時点では詳細な公式発表はされていません。今後の動向から目が離せません。
5.6の価格から50%値下げっていうのはワクワクするね。GPT-6 Lunaが入力100万トークンあたり0.10ドル、出力100万トークンあたり0.50ドルって、完全にどうかしてる(いい意味で)。
追記:AzureやAWSでいつ使えるようになるのかについては何も書かれてないな。そのうち出てくるとは思うけど、もしなかったらそれはそれで面白い。
この価格設定でどうやってClaudeを使う人がいるのか不思議だよ。モデルの品質と価格の両面において、OpenAIチームがやってることは本当に凄まじいね。
[表のデータは省略して、OpenAIの価格改定について言及]
GPT-6 Solは5.6と比べて価格が50%オフ、GPT-6 Lunaも同じく50%オフになってる。
今年はずっとエージェントと仕事をしてきたけど、5.6 Solは自分にとってスイートスポットだったんだ。会話のやり取りとかエンジニアリングの勘所がしっくりきてて、予測しながら一緒に作業できる相棒みたいな感じだった。初めて愛着が湧いたモデルだよ。次に取って代わるモデルが、技術的には良くても、使うと何か自然じゃない…ってなるのが心配だ。ラボ(AI企業)に依存してるせいで、仕事上の立場が脆くなってる気がするよ。Jetbrainsみたいに信頼できて予測可能な企業が重要なツールを提供してくれてた頃が懐かしい。
この50%値下げって、サブスクの利用上限も2倍になるってこと?それともAPIだけなのかな。
追記:どうやらサブスクにも適用されるみたいだね。ソースはこちら:https://x.com/thsottiaux/status/2102463847714247142
現時点で、Claude Code 20xとCodex Pro 20xで迷うときの決定打はこんな感じかな。
利用制限:コスト面もそうだけど、リセットのタイミングとか複雑なプラン計算が面倒すぎる。今はCodexが圧倒的勝者だね。特にChatGPTの利用(6 Astra Pro含む)が20xプランだとほぼ無制限なのはデカい。ちょっとした質問をするだけでコードを書く枠を消費しちゃうのはやっぱり萎えるからね。特に難しい問題に対してMCP経由でProモデルを自動で呼び出して、いい設計案を出してもらう時なんかは本当に助かる。
コンテキストウィンドウ:これはClaude Codeの勝ち。昔はTOMLでCodexのGPTコンテキストを100万に拡張する裏技があったけど、プラン経由だと使えなくなってトークン単位の課金限定になったんだ(追記:noname120が指摘してくれた通り、今はまた有効化できるみたい)。252kじゃ全然足りないし、Codexの圧縮は優秀だけど頻繁に走るから、Astraみたいな強力なモデルでも長時間タスクだと迷子になることがある。
公式の環境以外でプランを使えるか:Codexの勝ち。Anthropicはcommitの中にhermes.mdが入ってると勝手にリクエストを追加消費としてカウントしたりするからね。
いろいろサブスクを乗り換えて両方契約してた時期もあるけど、結局2/3の理由でCodexに戻ってきてる。
追記:どうやらAltmanたちの動向を追えてなかったみたいで、20xの新規受付は数週間前から停止してるらしいね。自分は既存ユーザーだから特例で契約できてるけど、上記の比較は新規にはあまり意味ないかも。
GPT5.6 SOLの「過剰にエンジニアリングして複雑にする」癖は直ったんだろうか?単純なことを頼んだだけで、使い捨てのメソッドを4つも作ったり、インターフェースやファクトリーパターンを重ねたりしてくるからね。
実は技術的には劣ってても5.6-Terraの方が好きだったんだ。あっちの方が変なことをしない勘が働いてたからね。
PS:勘の良さでいうと、UIデザインの差は埋まったのかな?UIデザインやフィードバックの質に関しては、OpenAIよりClaudeの方が明らかに高いから、それだけでClaudeのサブスクを維持してるんだよね。
GPT-6 Lunaが5.6の半額っていうのはかなりデカいニュースだね。
GPT-6 Lunaの生成したペリカン(図)を置いておくよ:(URL)
そしてGPT-6 Sol:(URL)
一番下までスクロールするとSol Maxが見れるよ:(URL)
比較として、GPT-6 Astraで作ったペリカンも:(URL) - 個人的にはAstra Maxのが一番好きだな。
全モデルの比較グリッドはこちら:(URL)。こうして見ると、5.6ファミリーの方が6ファミリーより色が鮮やかな傾向があるのが面白いね。
Codexでモデルを使うとき、モデルの選択と推論レベルの2軸があるけどさ。Astra、Sol、Lunaから選べて、推論レベルも5段階あるでしょ?これの違いは何なんだろう。問題が簡単ならモデルを落とすべきか、推論レベルを落とすべきか?Astra MediumとLuna Highの差は何?今のところAstraにしておいて、難易度に合わせて推論レベルを上げ下げしてるだけなんだよね。
ニュース見出しがどんどん鬱陶しくなってきた。もうこれ以上進化しなくていいよ…。数年後、自分のキャリアがどうなってるのか全く想像つかない。
「平均的なユーザー」の視点から言えば、ChatGPTは素晴らしいプロダクトだよ。
普通のチャット、ウェブ検索、たまの画像編集、軽いコーディング、ドキュメント確認なんかだと、ChatGPT Plusは5.6以降ほぼ無制限だし「そのまま使える」。まだできないタスクに出会ったことがないよ。
適切な指示を出せば、変な言い回しや不自然な構成にイライラさせられることもほとんどない。
アプリもすごく優秀(Codexの最初のひどいアプリは無視してね)。
月23ドル払う価値は十分あるね。