AIREITER
XiaomiText Chat

MiMo V2.6 Pro

1M 컨텍스트를 지원하는 Xiaomi MiMo V2.6 Pro를 이용해 보세요. 42B 활성 파라미터 기반의 1.02T 희소 MoE. 복잡한 코딩 및 에이전트를 위해 텍스트, 이미지, 비디오, 오디오 전반에 걸친 네이티브 옴니모달 추론을 제공합니다.

입력AIReiter $0.435 100만 토큰당출력AIReiter $0.87 100만 토큰당
API로 실행

입력

출력

Example
Generated in
42.7 seconds
입력 Token
134
출력 Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

모델 세부정보

플레이그라운드, API 요청, 내부 워크플로에서 동일한 모델 키를 사용하세요.

모델 ID
mimo-v2.6-pro
공급자
Xiaomi
프로토콜
OpenAI Chat Completions
컨텍스트 창
1,048,576 토큰
최대 출력
131,072 토큰
입력 Token
43.5 credits / 100만 토큰
출력 Token
87 credits / 100만 토큰
캐시 읽기
-
캐시 쓰기
-

Xiaomi 1.02T 플래그십 멀티모달 MoE 아키텍처

MiMo-V2.6-Pro는 MIT 라이선스로 제공되는 Xiaomi의 최고급 오픈 웨이트 멀티모달 모델로, 1.02T 파라미터 희소 MoE와 방대한 1,048,576 토큰 컨텍스트 윈도우를 결합했습니다.

동적 희소 MoE (42B 활성)

총 1조 200억(1.02T) 개의 파라미터 중 토큰당 420억(42B) 개가 동적으로 활성화되는 Pro는 효율적인 추론 비용을 유지하면서도 최고 수준의 프론티어급 추론 성능을 달성합니다.

1,048,576 토큰 네이티브 컨텍스트

컨텍스트 분할(청킹) 없이 단일 요청으로 전체 소프트웨어 리포지토리, 수 시간 분량의 오디오 녹음, 수백 건의 연구 문서 또는 심층 멀티턴 에이전트 추적 데이터를 처리할 수 있습니다.

네이티브 옴니모달 인식

통합 멀티모달 아키텍처를 통해 텍스트, 고해상도 이미지, 긴 영상 프레임, 음성 오디오를 정밀하고 논리적 근거를 갖춘 텍스트로 네이티브 처리합니다.

128K 출력 토큰 상한

단 한 번의 중단 없는 생성으로 완성도 높은 엔드투엔드 애플리케이션, 포괄적인 아키텍처 사양, 복잡한 다중 파일 리팩토링 계획을 생성합니다.

복잡한 소프트웨어 엔지니어링 및 자율 에이전트에 최적화

다단계 추론 궤적, 여러 파일로 구성된 코드베이스, 도구 기반 자율 실행에 폭넓게 최적화되었습니다.

리포지토리 규모의 코드 인텔리전스

복잡한 디렉터리 트리 전반의 종속성을 분석하고, 찾기 힘든 동시성 및 메모리 버그를 격리하며, 회귀 단위 테스트 스위트가 완비된 검증된 패치를 생성합니다.

지속적인 다단계 에이전트 계획

장기적인 다단계 도구 사용 루프 전반에서 일관된 운영 상태를 유지하며 모호한 명령어를 결정론적이고 검증 가능한 실행 시퀀스로 분해합니다.

네이티브 적응형 추론 엔진

내장된 딥씽킹(심층 사고) 모드는 답변을 종합하기 전에 여러 연역적 경로를 탐색하고 중간 가설을 검증하여 까다로운 엣지 케이스에서의 환각(할루시네이션)을 최소화합니다.

결정론적 도구 사용 및 스키마 준수

Chat Completions 요청에서 OpenAI 스타일의 함수 호출(Function Calling) 및 JSON Schema 출력을 지원합니다.

플릿 전략: Pro vs. Flash 선택 가이드

두 V2.6 모델 모두 동일한 1M 컨텍스트 윈도우와 멀티모달 수집 기능을 제공합니다. 작업 특성에 맞춰 연산 티어를 선택하세요.
01

MiMo V2.6 Pro 선택 시

시스템 아키텍처 설계, 복잡한 리포지토리 리팩토링, 미션 크리티컬 자율 에이전트, 속도보다 정확성이 우선시되는 중요 분석 작업에 적합합니다.

02

MiMo V2.6 Flash 선택 시

약 1/3 비용으로 높은 처리량이 필요한 작업, 서브 에이전트 병렬 팬아웃, 실시간 대화형 어시스턴트, 자동화된 테스트 생성, 지속적인 백그라운드 인덱싱에 적합합니다.

03

매끄러운 모델 전환

요청 페이로드, 스키마 또는 도구 정의를 수정할 필요 없이 모델 파라미터를 mimo-v2.6-pro 또는 mimo-v2.6-flash로 변경하기만 하면 Pro와 Flash 간을 매끄럽게 전환할 수 있습니다.

04

투명한 토큰 정산

긴 컨텍스트에 대한 페널티성 추가 요금이나 숨겨진 플랫폼 수수료 없이 실시간 토큰 요율(100만 토큰당 입력 $0.435 / 출력 $0.87)로만 투명하게 청구됩니다.

빠른 시작: OpenAI 호환 API로 호출

몇 초 만에 기존 OpenAI SDK 클라이언트 또는 LangChain/LlamaIndex 스택에 MiMo V2.6 Pro를 연동할 수 있습니다.

01

Base URL을 AIReiter로 설정

Base URL을 https://aireiter.com/api/v1 로 설정하고 AIReiter API 키를 제공하세요. 별도의 벤더 SDK 없이 공식 OpenAI 라이브러리를 사용할 수 있습니다.

02

Chat Completion 요청 전송

POST https://aireiter.com/api/v1/chat/completions Authorization: Bearer $AIREITER_API_KEY Content-Type: application/json { "model": "mimo-v2.6-pro", "messages": [ {"role": "user", "content": "Analyze this architectural migration plan for race conditions."} ], "temperature": 0.2 }

03

프로덕션 스트리밍 및 Tool Calling

실시간 타자기 방식 출력을 위해 stream: true를 활성화하고, 자동화된 함수 호출을 위해 표준 tools 배열을 전달하세요. 추론 토큰이 매끄럽게 스트리밍됩니다.

기술 FAQ 및 연동 가이드

MiMo V2.6 Pro의 기술 사양, 멀티모달 기능 및 연동 가이드입니다.

/ 01

컨텍스트 윈도우와 최대 생성 길이는 얼마인가요?

MiMo V2.6 Pro는 네이티브 1,048,576 토큰(1M) 컨텍스트 윈도우를 갖추고 있으며, 단일 응답 생성 시 최대 131,072 토큰(128K)을 지원합니다.

/ 02

API에서 지원하는 입력 모달리티는 무엇인가요?

API는 표준 Chat Completions 메시지 내에서 텍스트, 이미지 URL/base64, 오디오 파일 및 비디오 클립을 입력받아 풍부한 구조화된 텍스트를 반환합니다.

/ 03

MiMo V2.6 Pro에서 사고 모드(Thinking Mode)는 어떻게 작동하나요?

철저한 단계별 추론을 보장하기 위해 사고 모드가 기본적으로 활성화되어 있습니다. 지연 시간에 민감한 작업을 위해 이를 조정하거나 비활성화하려면 요청 페이로드에 thinking 파라미터를 지정하세요.

/ 04

공식 API 모델 식별자는 무엇인가요?

Chat Completions 요청의 model 필드에 mimo-v2.6-pro를 전달하세요.

/ 05

AIReiter는 토큰 정산을 어떻게 처리하나요?

실제 프롬프트 및 완성 길이를 기준으로 토큰 단위까지 정확하게 사용량이 청구되며, 긴 컨텍스트 티어 할증이나 유휴 요금이 전혀 없습니다.