AIREITER
QwenText Chat

Qwen3.8 Flash

Qwen3.8 Flashはコーディング、エージェント、長文ドキュメント向けの高速モデルです。コンテキスト長1M。100万トークンあたり入力約0.057ドル、出力約0.193ドル。

入力公式 $0.1143 100万トークンあたりAIReiter $0.0571 100万トークンあたり出力公式 $0.3857 100万トークンあたりAIReiter $0.1929 100万トークンあたりキャッシュ読み取り公式 $0.0143 100万トークンあたりAIReiter $0.0071 100万トークンあたりキャッシュ作成公式 $0.1429 100万トークンあたりAIReiter $0.0714 100万トークンあたり
APIで実行

入力

出力

Example
Generated in
42.7 seconds
入力 Token
134
出力 Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

モデル詳細

Playground、APIリクエスト、社内ワークフローで同じモデルキーを使用してください。

モデル ID
qwen3.8-flash
プロバイダー
Qwen
プロトコル
OpenAI Chat Completions
コンテキストウィンドウ
1,000,000 トークン
最大出力
131,072 トークン
入力 Token
5.7143 credits / 100万トークン
出力 Token
19.2857 credits / 100万トークン
キャッシュ読み取り
0.7143 credits / 100万トークン
キャッシュ書き込み
7.1429 credits / 100万トークン

コーディングや長時間の作業に最適な高速Qwenモデル

Qwen3.8 Flashは、Qwen3.8シリーズにおけるAlibabaの高速階層モデルです。コーディング、ツールを使用するエージェント、短いチャットに収まらないドキュメント処理向けに設計されています。

大規模モデルを低コストで

総パラメータ数1,250億、トークンごとの使用パラメータ数は約60億。そのため、大量の処理でも高速かつ低コストを維持できます。

100万トークンのコンテキスト

長大な仕様書、大量のファイル、長いエージェントのトレースも1回のリクエストに収まります。1回の返答で最大131,072トークンまで出力可能です。

テキストだけでなく画像も読み取り可能

プレーンテキストだけでなく、スクリーンショット、図表、ドキュメントも理解します。画面上の情報から始まるタスクに最適です。

約0.057ドル / 0.193ドル

100万トークンあたり、入力は約0.057ドル、出力は約0.193ドルで、公式価格の約半額です。キャッシュされた入力はさらに安価です。上記の価格バーはリアルタイムレートです。

Qwen3.8 Flashの強み

2026年8月のリリースとともに公開されたQwen公式モデルカードにおいて、Flashは比較されたモデルの中でコーディングとツール使用において最高スコアを記録しています。

リポジトリ作業

SWE-bench Pro 62.5、SWE-bench Multilingual 81.0。バグの発見、複数ファイルの編集、結果の確認に活用できます。

ツール呼び出しエージェント

DeepSWE 58.7、Toolathlon 73.5。失敗の確認、ツールの呼び出し、再試行というマルチステップのループを実行できます。

コードと難問

LiveCodeBench v6は91.9、GPQA Diamondは91.7。競技プログラミングや科学分野の難問にも対応可能です。

画面の認識

OSWorldの部分スコア52.3。MathVision 90.6(コード実行時は95.7)。質問と一緒にスクリーンショットや図表を入力できます。

FlashかMaxか

Flashは終日稼働させるタスク向け、Maxはコストよりもタスクの難易度を重視する場合のフラッグシップです。
01

Flashを選択する場合

コーディングエージェント、テストと修正のループ、長文ドキュメント、そしてコストを重視するあらゆるワークロードに最適です。1Mのウィンドウにより、長いトレースを分割することなく処理できます。

02

Maxを選択する場合

Qwen3.8 Maxは2.4兆パラメータのフラッグシップモデルです。トークン価格よりも最高性能のQwenを優先したい場合に使用します。/chat/qwen3-8-max からご利用いただけます。

03

同じリクエスト形式

どちらのモデルも通常のchat completionを受け付けます。Flashの場合、modelにqwen3.8-flashを設定します。長いトレースの回答が必要な場合はmax tokensを増やしてください。デフォルトは8,192で、上限は131,072です。

よくある質問

コンテキスト、料金、画像認識、Maxとの比較について。

/ 01

Qwen3.8 Flashの用途は何ですか?

高速なコーディング、ツール利用エージェント、長文ドキュメント処理に最適です。Maxの縮小版ではなく、より安価で高速なQwen3.8モデルです。

/ 02

コンテキスト長はどのくらいですか?

100万トークンです。1回の応答で最大131,072トークンまで出力可能です。

/ 03

料金はいくらですか?

100万トークンあたり入力約$0.057、出力約$0.193で、公式定価の約半分です。キャッシュからの読み取りはさらに低コストになります。ツール呼び出しごとの追加料金はありません。価格バーにはリアルタイムレートが表示されます。

/ 04

画像を読み込めますか?

はい。テキストに加えて、スクリーンショット、グラフ、ドキュメント画像などをモデルでネイティブに処理できます。

/ 05

どのような場合にQwen3.8 Maxを使うべきですか?

最高峰のフラッグシップ性能を求め、トークンあたりのコストを許容できる場合です。Maxは2.4Tモデルであり、Flashは大量処理・高ボリューム向けのモデルです。