AIREITER
XiaomiText Chat

MiMo V2.6 Pro

1Mコンテキスト対応のXiaomi MiMo V2.6 Proにアクセス。総パラメータ数1.02T・アクティブ42BのスパースMoE。テキスト、画像、動画、音声を横断するネイティブなオムニモーダル推論により、複雑なコーディングやエージェント構築を実現。

入力AIReiter $0.435 100万トークンあたり出力AIReiter $0.87 100万トークンあたり
APIで実行

入力

出力

Example
Generated in
42.7 seconds
入力 Token
134
出力 Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

モデル詳細

Playground、APIリクエスト、社内ワークフローで同じモデルキーを使用してください。

モデル ID
mimo-v2.6-pro
プロバイダー
Xiaomi
プロトコル
OpenAI Chat Completions
コンテキストウィンドウ
1,048,576 トークン
最大出力
131,072 トークン
入力 Token
43.5 credits / 100万トークン
出力 Token
87 credits / 100万トークン
キャッシュ読み取り
-
キャッシュ書き込み
-

Xiaomi 1.02T フラグシップ・マルチモーダルMoEアーキテクチャ

MiMo-V2.6-Proは、1.02兆パラメータのスパースMoEと1,048,576トークンの広大なコンテキストウィンドウを組み合わせた、MITライセンスに基づくXiaomiの最高峰オープンウェイトマルチモーダルモデルです。

動的スパースMoE(アクティブ42B)

総パラメータ1.02兆のうちトークンごとに420億パラメータを動的にアクティブ化することで、Proは効率的な推論コストを維持しながらフロンティア級の推論性能を実現します。

1,048,576トークンのネイティブコンテキスト

コンテキストのチャンク分割を行うことなく、完全なソフトウェアリポジトリ、数時間に及ぶ音声録音、数百本もの研究論文、または詳細なマルチターンのエージェント実行履歴を1回のリクエストで取り込めます。

ネイティブなオムニモーダル認識

統合されたマルチモーダルアーキテクチャにより、テキスト、高解像度画像、長時間動画のフレーム、音声をネイティブに処理し、高精度で論理的根拠のあるテキストを生成します。

最大128Kの出力トークン上限

網羅的なエンドツーエンドのアプリケーション、包括的なアーキテクチャ設計書、複雑な複数ファイルのリファクタリング計画を、途切れることなく1回の生成で出力できます。

高度なソフトウェアエンジニアリングと自律型エージェントのために設計

マルチステップの推論軌道、複数ファイルにまたがるコードベース、ツール拡張による自律実行のために徹底的に最適化されています。

リポジトリ規模のコードインテリジェンス

複雑なディレクトリツリー全体の依存関係を分析し、特定困難な並行処理やメモリのバグを特定して、リグレッション単体テストスイートを備えた検証済みパッチを作成します。

持続的なマルチステップ・エージェントプランニング

長期にわたるマルチステップのツール利用ループ全体で一貫した実行状態を維持し、曖昧な指示を確定的かつ検証可能な実行シーケンスへと分解します。

ネイティブ適応型推論エンジン

組み込みのディープシンキングモードが複数の演繹的経路を探索し、回答を統合する前に中間仮説を検証することで、困難なエッジケースにおけるハルシネーションを最小限に抑えます。

決定論的なツール利用とスキーマ準拠

Chat Completionsリクエストにおいて、OpenAI形式のFunction CallingおよびJSON Schema出力をサポートします。

フリート戦略:Pro と Flash の使い分け

両方の V2.6 モデルは、同様に 1M コンテキストウィンドウとマルチモーダル入力に対応しています。タスクの特性に合わせて適切なコンピュート層を選択してください。
01

MiMo V2.6 Proを選ぶ場合

システムアーキテクチャの設計、複雑なリポジトリのリファクタリング、ミッションクリティカルな自律型エージェント、速度よりも精度が最優先される重要度の高い分析タスク。

02

MiMo V2.6 Flashを選ぶ場合

高スループット処理、サブエージェントの並列ファンアウト、リアルタイム対話アシスタント、テスト自動生成、約1/3のコストで行うバックグラウンドの継続的インデックス作成。

03

フリクションレスなモデル切り替え

リクエストのペイロード、スキーマ、ツール定義を変更することなく、modelをmimo-v2.6-proまたはmimo-v2.6-flashに切り替えるだけで、ProとFlashをシームレスに切り替えられます。

04

透明性の高いトークン決済

ロングコンテキストによるペナルティ料金や隠れたプラットフォーム追加料金なしで、実際のトークンレート(100万トークンあたり 入力$0.435 / 出力$0.87)に基づいて厳密に課金されます。

クイックスタート:OpenAI 互換 API による呼び出し

MiMo V2.6 Pro を既存の OpenAI SDK クライアントや LangChain/LlamaIndex スタックにわずか数秒で統合できます。

01

ベース URL を AIReiter に設定

ベース URL を https://aireiter.com/api/v1 に設定し、AIReiter API キーを指定します。ベンダー独自のカスタム SDK を使用することなく、公式の OpenAI ライブラリを利用できます。

02

Chat Completion リクエストの送信

POST https://aireiter.com/api/v1/chat/completions Authorization: Bearer $AIREITER_API_KEY Content-Type: application/json { "model": "mimo-v2.6-pro", "messages": [ {"role": "user", "content": "Analyze this architectural migration plan for race conditions."} ], "temperature": 0.2 }

03

本番環境でのストリーミングとツール呼び出し

リアルタイムなタイプライター風出力を得るには stream: true を有効にし、自動関数呼び出しを行うには標準の tools 配列を渡します。思考トークンもスムーズにストリーミングされます。

技術 FAQ & 統合ガイド

MiMo V2.6 Pro の技術仕様、マルチモーダル機能、および統合ガイダンス。

/ 01

コンテキストウィンドウと最大生成長はどのくらいですか?

MiMo V2.6 Pro はネイティブで 1,048,576 トークン(1M)のコンテキストウィンドウを備え、1 回の応答生成で最大 131,072 トークン(128K)をサポートします。

/ 02

API はどのような入力モダリティをサポートしていますか?

API は標準の Chat Completions メッセージ内でテキスト、画像 URL/base64、音声ファイル、動画クリップを受け付け、リッチな構造化テキストを返します。

/ 03

MiMo V2.6 Pro の思考モードはどのように動作しますか?

思考モードは厳密な段階的推論を保証するためにデフォルトで有効になっています。レイテンシーに敏感なタスクのために調整または無効化する場合は、リクエストペイロードで thinking パラメータを指定してください。

/ 04

公式の API モデル識別子は何ですか?

Chat Completions リクエストの model フィールドに mimo-v2.6-pro を指定してください。

/ 05

AIReiter ではトークンの課金はどのように処理されますか?

利用料金は実際のプロンプト長および完了長に基づきトークン単位で正確に請求され、ロングコンテキストの階層割増料金やアイドル料金は一切発生しません。