コーディングや長時間の作業に最適な高速Qwenモデル
Qwen3.8 Flashは、Qwen3.8シリーズにおけるAlibabaの高速階層モデルです。コーディング、ツールを使用するエージェント、短いチャットに収まらないドキュメント処理向けに設計されています。
大規模モデルを低コストで
総パラメータ数1,250億、トークンごとの使用パラメータ数は約60億。そのため、大量の処理でも高速かつ低コストを維持できます。
100万トークンのコンテキスト
長大な仕様書、大量のファイル、長いエージェントのトレースも1回のリクエストに収まります。1回の返答で最大131,072トークンまで出力可能です。
テキストだけでなく画像も読み取り可能
プレーンテキストだけでなく、スクリーンショット、図表、ドキュメントも理解します。画面上の情報から始まるタスクに最適です。
約0.057ドル / 0.193ドル
100万トークンあたり、入力は約0.057ドル、出力は約0.193ドルで、公式価格の約半額です。キャッシュされた入力はさらに安価です。上記の価格バーはリアルタイムレートです。
Qwen3.8 Flashの強み
2026年8月のリリースとともに公開されたQwen公式モデルカードにおいて、Flashは比較されたモデルの中でコーディングとツール使用において最高スコアを記録しています。
リポジトリ作業
SWE-bench Pro 62.5、SWE-bench Multilingual 81.0。バグの発見、複数ファイルの編集、結果の確認に活用できます。
ツール呼び出しエージェント
DeepSWE 58.7、Toolathlon 73.5。失敗の確認、ツールの呼び出し、再試行というマルチステップのループを実行できます。
コードと難問
LiveCodeBench v6は91.9、GPQA Diamondは91.7。競技プログラミングや科学分野の難問にも対応可能です。
画面の認識
OSWorldの部分スコア52.3。MathVision 90.6(コード実行時は95.7)。質問と一緒にスクリーンショットや図表を入力できます。
FlashかMaxか
Flashを選択する場合
コーディングエージェント、テストと修正のループ、長文ドキュメント、そしてコストを重視するあらゆるワークロードに最適です。1Mのウィンドウにより、長いトレースを分割することなく処理できます。
Maxを選択する場合
Qwen3.8 Maxは2.4兆パラメータのフラッグシップモデルです。トークン価格よりも最高性能のQwenを優先したい場合に使用します。/chat/qwen3-8-max からご利用いただけます。
同じリクエスト形式
どちらのモデルも通常のchat completionを受け付けます。Flashの場合、modelにqwen3.8-flashを設定します。長いトレースの回答が必要な場合はmax tokensを増やしてください。デフォルトは8,192で、上限は131,072です。
よくある質問
コンテキスト、料金、画像認識、Maxとの比較について。
/ 01Qwen3.8 Flashの用途は何ですか?
高速なコーディング、ツール利用エージェント、長文ドキュメント処理に最適です。Maxの縮小版ではなく、より安価で高速なQwen3.8モデルです。
/ 02コンテキスト長はどのくらいですか?
100万トークンです。1回の応答で最大131,072トークンまで出力可能です。
/ 03料金はいくらですか?
100万トークンあたり入力約$0.057、出力約$0.193で、公式定価の約半分です。キャッシュからの読み取りはさらに低コストになります。ツール呼び出しごとの追加料金はありません。価格バーにはリアルタイムレートが表示されます。
/ 04画像を読み込めますか?
はい。テキストに加えて、スクリーンショット、グラフ、ドキュメント画像などをモデルでネイティブに処理できます。
/ 05どのような場合にQwen3.8 Maxを使うべきですか?
最高峰のフラッグシップ性能を求め、トークンあたりのコストを許容できる場合です。Maxは2.4Tモデルであり、Flashは大量処理・高ボリューム向けのモデルです。