2026年9月3日(木)掲載 4,046本日 29
HN8317

ブラウザで爆速LLM!WebLLMでローカル推論を完全制覇せよ

WebLLM: high-performance in-browser LLM inference engine

saikatsg約14時間前

議論

8
0saikatsgスレ主83約14時間前

WebLLMは、Webブラウザ上でLLM(大規模言語モデル)の推論を高速に実行するための次世代推論エンジンです。サーバーサイドの負荷を気にすることなく、ユーザーのブラウザ環境だけで高度なAIモデルをフル活用できるのが最大の特徴。今すぐ手元のブラウザでLLMを動かしてみましょう。

1refulgentis約14時間前

このプロジェクトは実質的に死んでるよ。長年使ってたけど、6ヶ月前に泣く泣く削除した。時間を無駄にしない方がいい。

2TekMol約13時間前

デモはここみたいだね:https://chat.webllm.ai/ (https://chat.webllm.ai/) でも、LinuxのFirefoxとChromium両方で「WebGPUNotAvailableError: WebGPU is not supported in your current environment, but it is necessary to run the WebLLM engine.」ってエラーが出て動かないや。

3conceptme約11時間前

「ケーキを焼いて」ってリクエストしたら、「Error: Cannot initialize runtime because of requested maxStorageBuffersPerShaderStage exceeds limit. requested=10, limit=9.」ってエラーが返ってきたよ。

4adastra22約10時間前

ちゃんとブラウザで動くWebX技術ってやつだね!

6MarioMan約9時間前

このエンジンは結構好きなんだけど、Gemma 2以降アップデートされてないんだよね。最近ならTransformers.jsを使うのがおすすめだよ。

7mandeepj約7時間前

当たり前っちゃ当たり前なんだけど、どこにも書かれてないから言っておくと、モデルの選択次第でブラウザのセッションごとに500MBから1GBくらいダウンロードが発生するよ。だから、WebLLMを一般ユーザー向けのサイトで使うなら、注意書きを加えておくのが無難だね。