GPT-6と「誰でも使える」インテリジェントUIの未来
GPT‑6 and Intelligent UI for everyone
GPT‑6 and Intelligent UI for everyone
GPT-6の登場により、AIがUIのあり方を根本から変えようとしています。これまでの複雑な操作を覚える必要はなく、ユーザーの意図を汲み取った「インテリジェントUI」が誰にとっても当たり前のものになる時代がすぐそこまで来ています。
GPTに何かを説明してもらうときは、一度に全部書かせるんじゃなくて、数文ずつやり取りする方がうまくいくことが多いな。まとめて書かせると、質問の一部を取り違えた時に会話全体が微妙な方向に行っちゃうし。こっちから適宜質問して軌道修正する方が、AIの制御もしやすいし、対話としても面白い気がする。
最近音楽の勉強をしてるんだけど、AIが同じコード進行の図を何度も何度も貼り付けてきて、しかも質問とほとんど関係ない時もあって困ってたんだよね。だから、今回のはあんまり押し付けがましくないことを期待してるよ。プロンプトで制御できるといいんだけど!
個人的に、GPT-6のデザインセンスはちょっとやりすぎだと思う。
キャッチコピーとか、アイキャッチ用のテキスト、小見出し、無駄な余白、ピル(ボタンのデザイン)、カードUIなんかを控えめにするよう明示的に指示してるのに。
これがチャットの方まで侵食してこないことを祈るよ...
自動化されるものなんていくらでもあるだろうけど、Bartosz Ciechanowskiの解説コンテンツまで自動化される対象になるなんて思わなかったよ。
冗談はさておき、彼が愛を込めて職人芸で作った解説記事は、プラスチックで固められた現代のクォーツ時計みたいな世界の中で、手作りの伝統的な時計のような価値を持ち続けると思う。でも、PCがどんなニッチなトピックでもそれなりのインタラクティブ解説を生成できる時代になったっていうのは、本当にすごいことだよね。
5.6と6をサンデーローストに例えてた比較はすごく興味深かった。ほとんどの人は6を好むだろうけど、個人的には画像だらけで余白が多くて、チェックリストが並んでるようなUIは正直拒絶反応が出る。子供扱いされているような気分になるんだよね。
OpenAIは仕事とチャットを統合しようとしているみたいだけど(個人的には最悪のアイデアだと思う)、WorkはCodexに似てるし…。こういう要素が実際の業務ツールの方まで入り込んでこないことを切に願うよ。
チャットが6.1じゃなくて6.0ベースなのは期待外れだね。「視覚的でインタラクティブな説明」は確かに便利そうだけど、6.1の方が圧倒的に上だし。6.1ですら100%信頼できるわけじゃないけど、6.0よりはマシなはず。計算資源に限りがあるのは分かるけど、多くの人はチャットしか使わないわけで、AIモデルを真実のソースとして扱ったり、学習に使ったりする人が増えている今、「解説役」のモデルの質は重要だよ。
まあ、モデルは進化し続けるだろうし、視覚的な解説というアイデア自体はMVPとしてはなかなか良いんじゃないかな。
自分はこれを「使い捨てUI」とか「紙皿UI」って呼んでる。一回使っておしまい、みたいな感じね。個人的に気になるのは、シンプルに答えが欲しいだけなのに、UIを表示させることに躍起になりすぎないかってこと。全体としては気に入ってるけどね、生成速度が速ければの話だけど。レスポンスのレイテンシにどれくらい影響が出るのか知りたいな。
OpenAIやサム・アルトマンのファンってわけじゃないけど、彼らのブログ記事は大好きだよ。チームやプレゼンの構成を決めてる人たちは本当にセンスがいい。これだけ素晴らしいリリース用のページを作れるのは、他にAppleくらいじゃないかな。以前、Appleでブログ記事を書いていた人を引き抜いたっていう噂も聞いたことがある気がする。
面白いのは「インテリジェントUI」についてなんだけど、2年以上前から言ってる通り、AI企業はもっと既存のチャットUIという枠組みから脱却して考えるべきなんだよ。あちこちで少しずつ改善はしてるけど、この分野のイノベーションの少なさには本当にがっかりさせられる。コーディング用の環境も同じで、UIはもっと劇的に良くなるはずだよ。
世界で最も資金を集めているテック企業がUIについてのブログ記事を書いてるってのも笑えるけど、そのプレイヤーのUIが史上最悪レベルなんだけど:
音量はオンとオフの2段階しかない
再生ボタンは1回しか効かなかった。動画がループし始めて、その後停止もできない。
動画のプログレスバーに、どこが開始でどこが終了なのかという視覚的な表示がない..
Phindが死んだのはこのためなのか?
これって、ChatGPTで広告を表示するための布石じゃない?つい2日前、広告主向けに新しいビジュアル広告フォーマットを発表したばかりだしね:https://openai.com/index/new-chatgpt-ads-format-and-measurem...
https://cdn.openai.com/pdf/gpt-6-october.pdf
ブログ記事にリンクされてたシステムカードを見たんだけどさ。
過激なコンテンツの評価において性能が低下(回帰)
GPT-5.6と比較して、GPT-6 Sol(10月版)は自傷行為に関する項目で統計的に有意な性能低下が見られ、GPT-6 Luna(10月版)は自傷行為、グロテスクな表現、性的なコンテンツにおいて同様に有意な性能低下が見られる
「GPT-6 SolとLunaは、正当なリクエストに対する有用性は向上しているが、安全に関する一部のリクエストではスコアが低下している」
これほど多くの重要なベンチマークで深刻な性能低下が起きているのに、UIが新しくてキラキラしているからという理由だけで「良いもの」として扱われるのはどうなんだろう。
PDFでこうして安全性リスクの増大を記録しておきながら、平気でモデルをリリースして、発表の焦点は全部新しいUIに当ててるってのが本当に信じられないよ。
個人的には、あらゆるプロダクトをChatGPTに詰め込もうとするのは間違いだと思う。まずはコア機能の改善に集中すべきじゃないかな。