Qwen3.5 WebGPU
Qwen3.5 WebGPUは、WebGPU技術を活用してブラウザ上で直接動作する大規模言語モデルです。特別なサーバーやGPUハードウェアを必要とせず、クライアントサイドで高速な推論を実現します。
背景メモ
AlibabaのQwenチームが公開した「Qwen3.5」は、WebGPU対応のブラウザ上で直接動作する大規模言語モデル(LLM)のデモ。通常、LLMはクラウド上のGPUサーバーで動かすが、このモデルはWebGPU(ブラウザからGPUを直接利用できるAPI)を使い、ユーザーのローカル環境で推論を完結させる。データが外部に出ないためプライバシー面で有利で、サーバー費用も不要になる。Hugging Face Spaces上で手軽に試せるが、動作にはWebGPU対応のブラウザ(ChromeやEdgeなど)と十分なVRAMが必要。Qwen3.5は汎用のテキスト生成モデルで、中国製LLMとしては高い性能を誇る。