Mercury 2.5がついに登場!主なアップデートと注目ポイントまとめ
Mercury 2.5
Mercury 2.5
Mercury 2.5がリリースされました。詳細なアップデート内容については、追って報告します。
このモデル、気に入ったよ。
参考までに:
「自分のユーザー投稿をモデルのトレーニングに使われたくない場合は、APIプラットフォームのユーザー設定にある『すべての人に向けてモデルを改善する』オプションをオフにすることでオプトアウトできるよ」
おめでとう!この方向性を本気で追求しているところが見られて嬉しいよ。
「広く普及しているGPU」って書いてあったからオープンウェイトになるのかと期待したんだけど、どうやらそうじゃないみたいで残念だ。
ここがそこそこまともなモデルを作れたら、今の時点では買収ターゲットになりそうだな。オーケストレーションの中に拡散モデルのサブエージェント(あるいはサブサブエージェント)を組み込むのはかなりメリットがあるはずだしね。
Inceptionは拡散モデルベースのアーキテクチャを持つ、最も興味深いネオラボの一つだね。彼らの主な事業は低遅延の音声アプリケーションだと思ってるけど、コーディングにも本気で取り組んでいるみたい。
Mercury 2.5 Previewをテストしてみたけど、最先端レベルとは程遠い(そもそもそう謳っていないけどね)。ただ、汎用チャットボットとしては実際に使えるレベルだ。問題解決能力は前世代のオープンウェイトモデルと同等だし、価格とコストを考えるとかなり魅力的。ただ、汎用的なツール利用やエージェント型のコーディングはまだ解決できていない(カスタムハーネスを与えると、うちの問題に対しては性能が落ちる)。もしそこをクリアできれば、速度とコストが活きるリアルタイムな用途がたくさん見えてきそうだ。
これはllm-consortiumのアービター(判定役)として素晴らしい選択肢になるはず。Mercury-2もかなり良かったしね。マルチモデルシステムの主な欠点の一つはLLMジャッジによるレイテンシの増加だけど、1100tpsで動くモデルがあれば、それを緩和するのに大いに役立つだろう。
興味深いな:
品質:Mercury 2から知能が40%向上。GPT-5.6 Luna (Low)、Gemini 3.5 Flash-Lite、Claude Haiku 4.5といったコスト最適化されたフロンティアモデルに匹敵するレベル。
利用可能リンク: https://openrouter.ai/inception/mercury-2.5
Mercury 2.0使ったことある人いる?どんな感じか感想を聞いてみたい。
現時点で試した範囲だと、論理的および歴史的なコンテンツに関するテキスト出力はいい感じだと思う。
比較対象が2、3世代前のフラッシュ/高速モデルなのは純粋にtok/s(トークン毎秒)のためだよね。で、知能についてはMercury 2としか比較していない。これはかなりミスリーディングだし、このモデルは実質的に使い物にならないんじゃないかという疑念がある。