爆誕!Qwen-Image-3.0:圧倒的な表現力と深い知識で画像認識をネクストレベルへ
Qwen-Image-3.0: Rich Content, Authentic Details, Deep Knowledge
Qwen-Image-3.0: Rich Content, Authentic Details, Deep Knowledge
Qwen-Image-3.0がついに登場しました。この最新モデルは、よりリッチなコンテンツ生成能力、細部まで妥協しない圧倒的な描画精度、そして高度な専門知識を融合させています。画像処理とマルチモーダルAIの境界を押し広げる、注目のアップグレードです。
いつ、あるいは実際にモデルのウェイトを公開するのかについて、一言も触れられていないんだけど、私が見落としてるだけかな?
HTMLのmetaキーワードがすごく興味深い。hentaiとかnudesとか、NSFW関連のトピックが100回以上も参照されてるよ。
GPT Image 1の出力を学習データに使ったに違いないね。この黄色っぽい色味、間違いないよ。
https://qianwen-res.oss-accelerate.aliyuncs.com/Qwen-Image/i... (https://qianwen-res.oss-accelerate.aliyuncs.com/Qwen-Image/image3/whale.jpg)
https://qianwen-res.oss-accelerate.aliyuncs.com/Qwen-Image/i... (https://qianwen-res.oss-accelerate.aliyuncs.com/Qwen-Image/image3/update5.png)
https://qianwen-res.oss-accelerate.aliyuncs.com/Qwen-Image/i... (https://qianwen-res.oss-accelerate.aliyuncs.com/Qwen-Image/image3/mlp.png)
https://qianwen-res.oss-accelerate.aliyuncs.com/Qwen-Image/i... (https://qianwen-res.oss-accelerate.aliyuncs.com/Qwen-Image/image3/image%20-%202026-07-21T003745.645.png)
オンラインショッピングでこういうモデルを推進しようとしてるのがすごく変な感じがする。「ドレスやシャツ、パンツを着用した時のイメージ」なんて言われても、モデルは常に服を体にフィットさせたり、見栄えを良くしたりするからね。実際に服がどんなサイズ感になるかは、これらのツールが登場する前と同じく、結局よく分からないままだよ。
「おしっこフィルター(黄色い色調)」が相変わらず至るところにあるな。
すごくクールだけど、タイトル画像ののアラビア語テキストが明らかにめちゃくちゃに崩れてるね。面白いことに、実際にモデルを使うときはそうならないのに。このメイン画像はQwen Image 3.0で生成されたものじゃないのかな?
3x3のグリッド全体を正確に記述するには3.7kトークンをフルに使う
そのプロンプトを共有してくれなかったのは残念だね。それがあればデモの説得力がもっと増したはずだよ。
出力の質がかなり低くてびっくりした。構成や解剖学的な正確さにおいて、Qwen image 1のレベルにすら達していないよ。chat.qwen.aiで試してみたけどさ。
足が3本生えてたり、目が光ってたりするし。Microsoft Lensレベルの品質で、あちらは(問題があって)公開停止になったものと同等だよ。
私が大学にいた頃にこういうモデルがあったら本当によかったのに。視覚的に学ぶタイプだから、文字の羅列を読み込むよりも、図解で説明してくれる方が特定のトピックを理解しやすかったはずだ。
画像生成のひどさには笑っちゃうよ。さっき試してみたんだけど、実際のロゴを2つと、詳細なデザイン言語仕様、それに実際のアプリケーションのスクリーンショットを3枚渡したのに、出てきたのはどれもひどい画像ばかり。しかも、送ったロゴと一致するものは一つもなかった。