【世界最高性能を更新】開発も動画生成もこなす、Claude Codeを超えてきた最強AIモデルとは?
概要
中国発のAIモデル「Qwen 3.8 Max」(Alibaba)と「MiniMax H3」が、コストと速度でClaude Opus 5を大きく上回るモデルとして登場した。ベンチマークの一部指標ではOpus 5を超え、Claude Codeへの直接接続にも対応している。
主なポイント
- Qwen 3.8 Maxは2.4兆パラメータ(アクティブ950億)のMoE型モデルで、100万トークンの長文コンテキストとコーディングエージェント用途に強い設計
- MiniMax H3はコーディング特化のエージェント型モデルで、動画生成では従来最強とされたKling(クリン)を上回る性能を持つ
- ベンチマークではQwen 3.8 MaxがTerminal-Bench・OSWorld Verified・PaperBenchでClaude(Fable 5/Opus 4.8)を上回るが、SWE-bench ProやHLEなど大規模コード改修・複雑知識問題ではClaudeが依然優位
- 料金はOpus 5が入力$5/出力$25に対し、Qwen 3.8 Maxは$2/$6、MiniMaxは$0.3/$1.2と大幅に安い(Opus 5比で最大約1/15のコスト)
- Claude Code側の設定(ANTHROPIC_BASE_URL等)を3行書き換えるだけでQwen/MiniMaxを接続して利用可能
- OpenRouterの「フュージョン」機能を使うと複数モデルを同時実行し1つの出力に集約する使い方もできる
- タスクごとにモデルを使い分けるのが今のトレンド:企画・最終チェックはOpus 5、実装部分は安価で高性能なQwen 3.8 Max/MiniMaxを使うワークフローが推奨
- Anthropicは過去にDeepSeek・Moonshot・MiniMaxを「モデル蒸留」の疑いで名指しし、Alibabaは社内でClaude Codeの利用を禁止するなど米中間で摩擦が起きている
- スクリーンショット1枚からWebページをほぼ忠実に再現できるなどマルチモーダル性能が高く、Webサイト制作や大規模コードベースのレビューにも活用できる
実践に使えること
- Claude CodeのANTHROPIC_BASE_URL/ANTHROPIC_AUTH_TOKEN/ANTHROPIC_MODEL設定を書き換え、Qwen 3.8 MaxやMiniMax H3を接続して試す
- 企画・設計はOpus 5、実装作業はQwen 3.8 Max/MiniMaxのような安価モデルに任せ、最終チェックを再びOpus 5で行う多段階のモデル使い分けワークフローを組む
- サブエージェントに安価モデルを割り当てて、コストを抑えながら並列実装・検証を行う
- 個人用の業務効率化アプリや、既存Webサイトのスクショからの再現制作など、長時間・反復タスクにコストの低いモデルを充てる
- OpenRouterの複数モデル並列実行(フュージョン)機能でリサーチタスクの精度を上げる