Qwen3.8は正直どう?今話題のローカルLLM「Qwen3.8」をAIのプロが徹底解説
概要
Alibaba製のオープンウェイト系LLM「Qwen3.8」について、複数のモデルバリエーションの違いや実際のユーザー評価を整理して解説する動画。ローカルLLMとして注目度の高いQwenシリーズの進化と、リリース直後の実態(期待と課題の両面)を紹介している。
主なポイント
- Qwen3.8には3つの提供形態がある:クラウド専用の「MAX」(マルチモーダル非対応・思考オフ不可)、超大規模MoEの「2.4T-A95B」(公開ウェイトだが個人PCでは実質動作不可)、そして軽量な「27B」(ローカル向け、画像動画入力・思考オンオフ対応)
- 実用上は27Bが本命で、前バージョン(3.6の27B)からエージェント動作・PC操作・オフィス業務系タスクのベンチマークが大きく向上している
- 一方でX上では出力速度の遅さや、思考が終わらず数時間止まらないなどの不具合報告も相次いでおり、評価が割れている
- MoE(Mixture of Experts)構造を採用し、2.4兆パラメータのうち実際に動くのは950億(全体の約4%)、512個のエキスパートのうち11個だけが稼働する仕組み
- Qwenの音声認識(ASR)・音声合成(TTS)モデルは軽量で実用性が高く、音声入力ソフト開発などに活用できる
- 画像生成モデル「Qwen Image 2.0 Pro」(20Bパラメータ)も用意されている
- API価格は入力$2/出力$6程度と、他の主要モデルと比べて安価
- ローカルLLMは深い会話用途には向かず、大量データ処理やバッチタスク向きという位置づけ
実践に使えること
- ローカルで試すなら27Bモデルを選び、LM StudioやOllamaでインストールする
- 高スペックPCまたは専用のローカルLLM実行環境(自宅サーバー等)を用意すると現実的
- 音声認識・音声入力ソフトを開発する際はQwenのASR/TTSモデルの活用を検討する
- リリース直後で不具合報告も多いため、思考が止まらない等のトラブルを踏まえて様子見しつつ導入判断する
- ローカルLLMは深い対話ではなく、大量処理・バッチ的なタスクへの活用を優先する