Qwen3.5ベースの超軽量モデル「Kev」が登場!Jevライクな意思決定モデルの新鋭
Kev: Tiny Jev-like family of decision models built on top of Qwen3.5
Kev: Tiny Jev-like family of decision models built on top of Qwen3.5
Qwen3.5を基盤に構築された、Jevのような超軽量意思決定モデルファミリー「Kev」が公開されました。非常にコンパクトなサイズ感で、効率的な意思決定タスクをこなすための新しい選択肢となりそうです。
OSSのJevライクなモデル作りにみんなが注ぎ込んでるエネルギーには正直感心するよ。盛り上がってるのはわかるけど、こういうモデルのユースケースって何があるんだろう?コーディングエージェントの文脈で使えるのか、それとも全く別の状況で需要があるのかな?
今、ちょっとしたJevブームが起きてるよね。これって、みんなが理解しやすかった単純な時代に回帰してるってことなのかな?分類モデル自体はずっと前からあるわけだし。
こういうモデルの素晴らしいユースケースは、巨大なコンテキストウィンドウを持っていて、フロントエンド開発のスタイリングルールやReactのコンポーネント作成ルールを強制できるようになった時だと思う。そうすれば、スタイルガイドやスタイリングのスキルに頼らなくても、ルールを強制するデシジョンツリーを作れるから、スタイルの不一致や重複問題に悩まされることがなくなる。今、機能ごとに発生するUX/UIの問題を修正する作業にかなりの時間を奪われてるから、これには期待してるよ。
Jevが根本的にRLCDを使って学習されているのに対して、ベースのQwenモデルがRLHFで学習されている場合、最終的に出来上がるモデルをどうやって「Jevライク」と呼べるのか不思議なんだけど。
これらがもっと小さくて優秀になれば、ゲーム用の「ペットみたいな」AIを作れるようになるんじゃないかな。例えばNPCに向かって「ついてきて」って叫ぶと、STTスタックが翻訳してローカルのJevライクモデルに送って、そこからNPCがどう動くか判断してくれるみたいな。
Jevクラスのモデルのベンチマークを見つけたよ: https://benchmarkheaven.com/jev-models (https://benchmarkheaven.com/jev-models)
もう既にたくさんのJevライクなモデルが載ってるね。
追記: 宣伝とかじゃないよ。ただ見つけて、面白いかなと思って共有しただけ。
Jevライクなモデルって、拡散モデル(diffusion models)ベースで作るべきじゃないの?例えば GSAI-ML/iLLaDA-8B-Instruct みたいにさ。少なくともそれが一番良い結果を出してたと思うけど。
なあ、もうJevの話はお腹いっぱいだよ。
Jevに唯一評価できる点があるとしたら、専任の会社が製品を良くして維持することに全力を注いでいるってところかな。世の中のJevっぽいプロジェクトには飛びつく気が起きないんだ。ほとんどが日和見主義でリリースされてるように見えるからね。日和見主義者が淘汰されて、誰が本当にオープンウェイトコミュニティに価値をもたらそうとしているのかが見えてくるまで待ってようと思う。
Jevは従来のML界隈が評価する以上に優れているとは思うけど、データポリシーの話になると熱が冷めるね。あれは本当に厳しすぎる。システムに入力したデータは何でも保持されるんだから。
JevチームはZDR製品を出さないと、このプラットフォームは先がないよ。オープンなJev形状のモデルこそが、その一点だけで勝利することになるはず。
もし分類だけでいいなら、学習データを用意してCodexやClaudeに「embeddings + ロジスティック回帰」の分類モデルを作らせるのがいいよ。
メールなら、たった50〜100件の学習例で95%の精度が出せるし。
モデルの学習もCPUで5分かからない。
完成したモデルは1MB未満で、推論も100ms以下だよ。
このアプローチの良いところを挙げると:
補足:より一般的なテストとして、Banking77データセットで分類器を作ってみたんだ。モデルは10MB未満、CPUで30秒以内に学習できて精度は94.5%。このデータセットでの精度トップ5に入るレベルだよ(最高精度が94.86%だけど、そっちはサイズが350MBもあるしGPUで何時間もかかるからね)。
Jev APIとフロンティアAPIを指す小さなプロキシを書いたよ。私のハーネスはプロキシにだけ接続して、フロンティアAPIやモデル、コマンドなんかを見ている感じ。ツール呼び出し付きのプロンプトを送ると、プロキシがJevにルーティングして、Jevがツールを絞り込み、プロキシがそれを綺麗にしてフロンティアAPIに投げる仕組み。
今のところのテストだと、ツール呼び出しが約60%減った。安価なモデルを使えるようにモデル切り替えも実装するつもり。自分のワークベンチのハーネスはプロンプトの整理が必要そうだな。