ついに登場!StepFunの爆速100万トークン対応MoE「Step 5」がOpenRouterで利用可能に
Step 5 Preview, a 1M-context MoE from StepFun, shows up on OpenRouter
Step 5 Preview, a 1M-context MoE from StepFun, shows up on OpenRouter
StepFun社が開発した、100万トークンのコンテキストウィンドウに対応するMoE(混合エキスパート)モデル「Step 5」のプレビュー版が、OpenRouter上で利用できるようになりました。超長文入力が求められるタスクにおいて、新たな選択肢として注目が集まっています。
ペリカンがいないと何て言えばいいのか分からないわ。-------------
https://postimg.cc/c6L2MjSt (https://postimg.cc/c6L2MjSt)
12分0秒、コスト0.28ドル。
「Hacker News風のスレッドを描いて。トップコメントは『pelican_enjoyer』というユーザーで内容は『ペリカンがいないと何て言えばいいのか分からない』。それに対する『minimaxir』からの不機嫌な返信で『みんながやるから言っておくけど、新しいLLMのスレッドが立つたびにSimonのペリカンの話を引っ張り出す必要はないぞ。Redditのミームよりも低レベルなジョークだ』と。スレッドの横には、自転車に乗って得意げな顔をしているペリカンを描いて」
どの側面から見ても競合できてないように見えるな:https://artificialanalysis.ai/models/step-5#intelligence-comparisons
次はもっと頑張ってほしいね。
これが例のspace bunny alphaモデルだったのかな
それの何が面白いの?
新しいモデルを試すのは好きだけど、純粋に新しいものが出てほしいな。新しいアーキテクチャとかさ。LLMは正直飽き飽きだよ。もっと上手くやれるはず。
まあ、Artificial Analysis(自分でモデルを比較する手間を省くための杖代わりにしてるから人によるけど)によると、自分が「安くて十分賢い」の基準にしてるGemini 3.8 Flashより賢くてわずかに安いらしい。とりあえず今週はOpenCodeで試してみるけど、Muse Spark 1.3から乗り換えるほどになるかは微妙かな。
Stepモデルは、128GBの共有メモリでまともに動く最初のローカルモデルだったと思う。Qwen Flash Nextとどう比較されるか楽しみ。
追記:残念、600B-A27Bだとは知らなかった。228GBの環境で動かすのは無理だな。