Qwen3.8-Maxとは—Alibabaの最新かつ最大モデル
AlibabaのQwenチームは、最新の大規模言語モデル「Qwen3.8-Max」を広く利用可能にしました。これは 2.4兆ものパラメータを持つMoE(Mixture-of-Experts)モデル で、Qwenシリーズの中で現時点で最も高性能なモデルとされています。テキスト、画像、動画をインプットとして受け付け、テキストをアウトプットできるマルチモーダル対応である点が特徴です。
同時に、より規模の小さい「Qwen3.8-27B」も提供され、これら2つのモデルのオープンウェイト版が来週には公開される予定です。(出典)この規模のモデルがオープンソースとして提供されるのは、AIコミュニティにとってかなり衝撃的なニュースだと感じます。特にローカルLLMを動かしている開発者にとっては、その可能性に胸が躍るのではないでしょうか。
Qwen3.8-Maxは、2.4兆パラメータを持つMoEモデルであり、テキスト、画像、動画をインプットとして受け付け、テキストを出力するマルチモーダル機能を備えている点が最大の特長です。
APIとオープンウェイトによる展開
Qwen3.8-Maxのデプロイ方法は、利用するアーティファクトによって異なります。
- ホスト型API:即座に利用可能で、OpenAIおよびDashScopeと互換性があります。これにより、既存のシステムへの統合が非常に容易になっています。APIのレートリミットは、1分あたり200万トークン、または1分あたり1万5000リクエストです。(出典)
- オープンウェイト版:来週公開予定ですが、2.4兆パラメータという規模から、これは単一のGPUでは扱えない、マルチノードのデータセンター環境向け のアーティファクトです。Alibabaはアクティブ化されるパラメータ数を公開していないため、現時点では正確な運用コストを算出することはできません。一方で、Qwen3.8-27Bは、通常のオンプレミスGPUハードウェアに適したサイズだそうです。(出典)
個人開発でQwen3.8-Maxをローカルで動かすのは現実的ではないかもしれませんが、Qwen3.8-27Bであれば自宅のRTX 3090搭載PCでも可能性を探れるかもしれません。Pythonバインディングがあれば、すぐにでも試してみたいところです。
Qwen3.8-Maxの技術的詳細とAPI価格
Qwen3.8-Maxは、技術的なスペックも非常に印象的です。
| 項目 | 詳細 |
|---|---|
| コンテキストウィンドウ | 100万トークン |
| 最大入力トークン | 99万1000トークン (思考有効時98万3000トークン) |
| 最大出力トークン | 13万1000トークン (両モードで共通) |
| 最大推論予算 | 26万2000トークン |
(出典)
APIの料金体系は以下の通りです。
- 入力トークン:100万トークンあたり2.00ドル
- 出力トークン:100万トークンあたり6.00ドル
- Implicit cache読み込み:100万トークンあたり0.25ドル
- Explicit cache作成:2.50ドル
- Explicit cache読み込み:100万トークンあたり0.17ドル
キャッシュされた入力は新規入力と比較して8倍も安価であるため、プロンプトの長さよりもプレフィックスの安定性がコストに大きく影響する とのことです。(出典)これは、APIを利用する開発者にとって、コスト最適化の重要なヒントになりますね。自分の個人プロダクトで利用する際にも、キャッシュの活用は必須になりそうです。
また、サポートされる機能には以下のようなものがあります。
- ファンクションコーリング
- 構造化出力
- バッチ処理
- プレフィックス補完
- ファインチューニング
Responses APIには、code_interpreter、web_search、web_extractor、t2i_search、i2i_searchの5つの組み込みツールが搭載されています。(出典)特にcode_interpreterは、Claude Code を使ったバイブコーディングを実践している私にとって、非常に魅力的な機能です。
業界への応用とパフォーマンス
Qwen3.8-Maxは、特に以下の4つの業界での活用が見込まれています。
- ソフトウェアエンジニアリング
- 法務・金融文書レビュー
- メディア・Eコマース運営
- デザイン
具体的なアプリケーション例としては、リポジトリ規模のコーディングエージェント、長文対応のナレッジベース、長尺動画のインデックス作成、構造化データ抽出、複数ステップのリサーチアシスタントなどが挙げられます。(出典)
Alibabaは、Qwen3.8-Maxの性能ベンチマークも公開しており、Terminal-Bench 2.1で86.6スコアを達成し、Claude Opus 4.8やClaude Fable 5といった競合モデルを上回る結果を出しています。(出典)これは、モデルの性能が非常に高いことを示しており、特に業務効率化の領域で大きなインパクトをもたらす可能性を秘めていると感じます。うちのスクリプトにも使えそうな予感がします。