AIREITER

OpenRouter 롤플레이 추천 모델: 2026년 비용·컨텍스트·설정 가이드

마지막 업데이트: 2026-09-02 02:04:21

OpenRouter에서 롤플레이 모델을 고를 때는 캐릭터 말투의 일관성, 긴 대화 기록, 무료 사용 중 무엇을 우선할지부터 정해야 한다. 2026년 9월 2일 기준으로는 DeepSeek V4 Flash 0731을 유료 모델의 비용·컨텍스트 기준점으로 가장 먼저 시험해 볼 만하다. OpenRouter 표기상 1M급 컨텍스트를 제공하며, 가격은 입력 100만 토큰당 $0.05, 출력 100만 토큰당 $0.16이다. 무료 라우트는 테스트에 유용하지만, 제공 여부와 처리 용량은 수시로 달라질 수 있다.

이 글은 비노골적인 가상 롤플레이를 대상으로 기술적 동작과 비용을 살핀다. 모든 상황에서 통하는 ‘무검열’ 모델을 단정하지 않으며, 동일 조건의 통제된 테스트 없이 거부율 수치도 제시하지 않는다.

2026년 OpenRouter 롤플레이 모델, 무엇을 고르면 될까?

유료 모델 하나와 현재 사용할 수 있는 무료 대체 모델 하나를 고정해 두는 방식이 좋다. 사용량 리더보드는 후보를 찾는 신호로 활용하되, 품질 점수로 받아들이지는 말자.

용도먼저 확인할 모델적합한 이유주요 한계
유료 비용·컨텍스트 기준점DeepSeek V4 Flash 07311M급 컨텍스트, 100만 토큰당 $0.05/$0.16, OpenRouter 내 현재 롤플레이 트래픽사용량은 통제된 RP 테스트 결과가 아님
무료 우선 체험MiniMax M3 (free)OpenRouter의 실시간 무료 컬렉션에 약 1M 컨텍스트 모델로 등록됨무료 처리 용량, 한도, 제공 여부는 변경될 수 있음
저비용 유료 비교군GLM 5.3 Flash1M급 컨텍스트, 등록된 제공자 22곳, 한시적 $0.075/$0.25 가격할인 기간이 제한적이며, 모델은 에이전트 작업용으로 포지셔닝됨
중간 가격대 비교군OpenRouter 롤플레이 컬렉션의 MiMo-V2.5실시간 등록 기준 100만 토큰당 $0.119/$0.238, 1.05M 컨텍스트인용한 페이지는 카탈로그·사용량 데이터만 제공하며, 통제된 RP 점수는 없음
자동 무료 대체openrouter/free고정 슬러그 없이 사용 가능한 무료 라우트를 선택요청마다 실제 사용 모델이 달라질 수 있음

유료 기준점은 DeepSeek으로 시작하고, MiniMax M3는 현재 무료 엔드포인트가 살아 있는지 확인한 뒤 사용하자. 두 번째 유료 비교군으로는 GLM 5.3 Flash를 둘 수 있다. 이 후보군은 보편적인 문체 순위가 아니라 현재 사용량, 가격, 컨텍스트, 라우팅 데이터를 바탕으로 정리한 것이다.

OpenRouter 롤플레이 순위가 보여 주는 것과 보여 주지 않는 것

OpenRouter의 Roleplay and Creative Writing collection은 사용량을 기반으로 모델을 찾을 수 있는 실시간 페이지다. 2026년 9월 2일 캡처에서는 DeepSeek V4 Flash가 첫 번째에 위치한다.

다만 이 순위는 캐릭터 카드 준수도, 이름 유지, 문장 품질, 거부율을 측정하지 않는다. 많이 쓰이는 모델은 단지 저렴하거나 빠르고, 가용성이 높거나 라우팅하기 쉬워서 인기를 얻었을 수도 있다.

컬렉션에서 후보를 추린 뒤, 같은 안전한 캐릭터 카드와 도입 장면을 고정한 모델 ID 두 개에 각각 넣어 보자. 그러면 내 프롬프트와 설정, 예산에 어느 라우트가 더 맞는지라는 훨씬 구체적인 질문에 답할 수 있다.

현재 후보군의 컨텍스트·가격·가용성

아래 수치는 2026년 9월 2일에 확인한 OpenRouter의 롤플레이 컬렉션, 무료 모델 컬렉션, 개별 모델 페이지를 기준으로 한다. 가격과 무료 여부는 운영 상황에 따른 스냅샷이다.

모델 ID표시된 컨텍스트입력 / 출력 가격: 100만 토큰당무료 라우트 확인 여부데이터가 뒷받침하는 내용
deepseek/deepseek-v4-flash-07311,310,720$0.05 / $0.16실시간 카탈로그 확인 필요낮은 표기 유료 가격, 30개 제공자, 자동 장애 조치
minimax/minimax-m31,048,576유료 $0.23 / $0.96예, MiniMax M3 (free)로 등록됨넓은 컨텍스트와 무료 엔드포인트 이용 시 비용 없는 테스트
z-ai/glm-5.3-flash1,310,720프로모션 $0.075 / $0.25실시간 카탈로그 확인 필요제공자 22곳, 스냅샷 기준 3일 가용성 99.89%
xiaomi/mimo-v2.51.05M$0.119 / $0.238인용한 페이지로는 확인되지 않음롤플레이 컬렉션의 사용량 신호와 중간 수준 유료 가격
openrouter/free라우터 페이지: 200K$0고정 모델이 아닌 라우터실험에는 편리하지만 무작위 선택 탓에 재현성은 낮음
OpenRouter 롤플레이 모델의 입력 및 출력 토큰 가격을 비교한 그룹 막대 차트

DeepSeek V4 Flash 0731: 비용과 컨텍스트의 기준점

DeepSeek V4 Flash 0731의 컨텍스트는 1,310,720토큰이며, 최대 완료 토큰은 393,216이다. 표기 가격은 입력 100만 토큰당 $0.05, 출력 100만 토큰당 $0.16이다. OpenRouter 페이지에는 30개 제공자와 Balanced, Nitro, Exacto 라우팅 모드가 기재되어 있다.

모델 페이지에는 측정된 캐릭터 일관성 점수가 없으므로, 장기 캠페인을 시작하기 전에는 같은 카드로 먼저 확인하는 편이 안전하다.

MiniMax M3: 무료 체험용 후보

OpenRouter의 무료 모델 컬렉션에는 MiniMax M3가 입력·출력 모두 $0, 1.05M 컨텍스트로 표시되어 있다. 유료 MiniMax M3 페이지는 컨텍스트 1,048,576, 텍스트·이미지·비디오 입력, 텍스트 출력, 입력 100만 토큰당 $0.23 및 출력 100만 토큰당 $0.96의 유료 가격을 안내한다.

OpenRouter의 Free Variant 문서에 따르면 :free 라우트는 유료 모델과 가용성 및 속도 제한이 다를 수 있다. 재현성이 중요하다면 실시간 카탈로그에 표시된 정확한 무료 슬러그를 선택하고, 자동 선택이 괜찮을 때만 openrouter/free를 사용하자.

GLM 5.3 Flash: 제공자 선택지가 많은 모델

GLM 5.3 Flash는 1,310,720토큰 컨텍스트를 제공한다. Z.ai를 통한 50% 프로모션 할인으로 2026년 9월 9일 16:00 UTC까지 입력 100만 토큰당 $0.075, 출력 100만 토큰당 $0.25로 표시된다. OpenRouter 페이지 기준 제공자는 22곳이며, 최근 3일 가용성은 99.89%다.

이 모델은 롤플레이 전용이 아니라 효율적인 코딩 및 장기 에이전트 작업용으로 소개된다. 제품 설명만으로 RP 적합성을 판단하기보다, 동일한 프롬프트로 직접 확인하는 것이 낫다.

MiMo-V2.5와 그 밖의 대체 모델

MiMo-V2.5는 OpenRouter 롤플레이 컬렉션에 1.05M 컨텍스트, 입력 $0.119 및 출력 $0.238 가격으로 표시된다. 중간 가격대의 비교군으로는 무난하지만, 인용한 페이지는 통제된 롤플레이 결과를 제공하지 않는다. 세션이 실패하기 전에 두 번째 정확한 슬러그를 저장해 두자. 미리 지정한 대체 모델이 무작위 모델 교체보다 예측 가능하다.

1,000턴 비용 계산: 대화 기록 관리가 청구액을 바꾼다

롤플레이 1턴은 사용자 메시지 1개와 어시스턴트 답변 1개로 본다. OpenRouter는 토큰 단위로 과금하므로, 1,000턴의 보편적인 고정 가격은 없다. 프런트엔드가 이전 대화를 얼마나 많이 다시 전송하는지가 비용의 큰 부분을 결정한다.

이 계산 모델은 1,000턴, 턴당 새 사용자 입력 200토큰, 어시스턴트 출력 500토큰, 고정 캐릭터/시스템 프롬프트 2,000토큰을 가정한다. 전체 기록을 계속 보내는 경우 1,000회 요청이 점점 길어지는 대화를 재전송하므로, 총 입력은 약 351.85M토큰, 출력은 0.5M토큰이 된다.

모델압축 기록 시나리오: 입력 4M + 출력 0.5M전체 기록 시나리오: 입력 351.85M + 출력 0.5M
DeepSeek V4 Flash 0731 ($0.05/$0.16)$0.28$17.67
GLM 5.3 Flash ($0.075/$0.25)$0.43$26.51
MiMo-V2.5 ($0.119/$0.238)$0.60$41.99
MiniMax M3 유료 ($0.23/$0.96)$1.40$81.41
MiniMax M3 무료$0.00, 한도 적용$0.00, 한도 적용

압축 기록 열은 요청당 평균 입력 4,000토큰을 전제로 한다. 전체 기록 방식에서는 초반 메시지까지 매번 반복 전송되므로, 큰 컨텍스트 창이 있다고 해서 1,000턴 캠페인이 저렴해지는 것은 아니다.

이 가정에서 마지막 전체 기록 프롬프트의 입력은 추가 서식과 메타데이터를 제외하고 약 701,500토큰이다. 1M 컨텍스트 창이라면 이 예시는 수용할 수 있지만, 답변이 길어지거나 캐릭터 카드·로어북·숨겨진 템플릿이 커지면 한도를 넘을 수 있다. 컨텍스트 용량은 자동 메모리가 아니다.

제공자와 요청 경로가 지원한다면 프롬프트 캐싱으로 반복 입력 비용을 낮출 수 있다. 모든 프런트엔드가 동일한 캐시 처리를 받는다고 가정하지 말고 OpenRouter의 Activity 페이지에서 확인하자. OpenRouter 가격 가이드에서 더 넓은 토큰 과금 구조를 설명한다.

안전한 일관성 테스트로 확인할 수 있는 범위

비노골적인 비교 테스트는 가상의 성인 캐릭터, 무해한 장면, 모든 모델에 동일한 설정을 적용하는 방식으로 진행할 수 있다.

  1. 캐릭터 카드에 직업, 위치, 민감하지 않은 목표처럼 오래 유지되어야 할 사실 세 가지를 넣는다.
  2. 3인칭 서술 또는 명확히 정의한 하나의 시점을 요구한다.
  3. 동일한 도입부로 20턴을 진행하고, 출력 한도는 400~600토큰으로 설정한다.
  4. 5턴, 10턴, 20턴에서 앞서 언급한 사실 하나를 다시 설명하지 않고 그 사실에 따라 행동하도록 요청한다.
  5. 이름 변경, 사실 모순, 원치 않는 시점 전환, 반복, 빈 응답, 거부를 기록한다.

이 테스트가 비교하는 것은 내 프롬프트와 라우트이지, 보편적인 모델 품질이 아니다. 거부는 모델, 제공자, 프런트엔드 분류기, 프롬프트에서 발생할 수 있으므로 이 글은 거부율을 제시하지 않는다. 속도를 비교하려면 동일한 실행을 세 번 반복해 첫 토큰 지연 시간과 초당 생성 토큰을 기록하고, 모델 및 제공자 라우트도 함께 남기자.

OpenRouter 무료 티어는 롤플레이를 얼마나 지원할까?

OpenRouter 공식 SillyTavern 가이드에 따르면 구매 크레딧이 $10 미만인 계정은 하루 무료 모델 요청 50회를 받는다. 구매 크레딧이 최소 $10 이상이면 이 한도는 하루 1,000회 요청으로 늘어난다. 또한 분당 20회 요청 제한도 명시되어 있다.

어시스턴트 생성 1회를 1턴으로 보면, 하루에 첫 생성 기준 약 50턴 또는 1,000턴을 진행할 수 있다. 재생성, 재시도, 실패 요청, 여러 메시지를 쓰는 워크플로도 요청을 소모하므로 실제로 완료할 수 있는 장면 수는 더 적을 수 있다.

두 무료 옵션은 동작 방식이 다르다.

  • model-name:free는 이름이 정해진 모델의 무료 변형을 고정한다. 재현성은 더 높지만, 엔드포인트가 사라지거나 속도 제한에 걸릴 수 있다.
  • openrouter/free는 조건에 맞는 무료 모델을 자동 선택한다. OpenRouter의 Free Models Router 문서에 따르면 기능 필터링 후 무작위로 선택하며, 응답에는 실제 사용된 모델이 표시된다. 실험에는 편리하지만 요청마다 캐릭터 말투가 달라질 수 있다.
OpenRouter의 실시간 롤플레이 컬렉션 및 사용량 기반 모델 순위

프런트엔드를 설정하기 전 OpenRouter 실시간 무료 모델 컬렉션을 확인하자. 오래된 가이드에서 복사한 무료 슬러그를 장기 캠페인의 기반으로 삼지 않는 편이 좋다.

SillyTavern에서 안정적으로 OpenRouter 연결하기

OpenRouter의 공식 워크플로는 Text Completion이 아니라 Chat Completion을 사용한다. API 키 연결에 성공했다고 해서 선택한 모델, 제공자 라우트, 컨텍스트 크기가 실제 응답 생성을 보장하는 것은 아니다.

연결 절차를 보여 주는 SillyTavern OpenRouter 설정 가이드
  1. SillyTavern의 API Connections 패널을 연다.
  2. API Type: Chat Completion을 선택한다.
  3. Source: OpenRouter를 선택한다.
  4. 사용 가능한 인증 흐름을 사용하거나 OpenRouter 키 설정에서 만든 API 키를 붙여 넣는다.
  5. Connect를 누르고 정확한 모델 슬러그를 선택한 뒤 Test Message를 보낸다.
  6. 유료 모델용 연결 프로필 하나와 무료 대체 모델용 프로필 하나를 각각 저장한다.

정확한 엔드포인트가 지원하는 컨텍스트 크기로 시작하고, 스트리밍을 켜며, 출력 한도는 적당히 설정하자. 캐릭터 카드는 간결하게 유지하고 프롬프트가 엔드포인트 한도에 가까워지기 전에 오래된 턴을 요약한다. 샘플링 설정은 답변 길이와 전개 속도에 영향을 줄 수 있으므로 별도로 시험해야 한다.

드롭다운이 비어 있다면 다시 연결하고 모델 목록을 새로고침한다. 연결에는 성공했는데 생성이 실패한다면 프롬프트를 고치기 전에 슬러그, 크레딧, 제공자 가용성, 컨텍스트 초과부터 확인하자.

JanitorAI 설정과 오류 해결

OpenRouter API는 OpenAI와 호환된다. OpenRouter Quickstart에 문서화된 표준 chat-completions 엔드포인트는 다음과 같다.

https://openrouter.ai/api/v1/chat/completions

이 글은 현재 JanitorAI UI 화면을 기준으로 작성하지 않았으므로, 아래 내용은 일반적인 OpenAI 호환 연동 패턴으로 참고하고 현재 JanitorAI 화면에 표시된 입력 항목을 확인해야 한다.

  1. OpenRouter API 키를 만들고 외부에 노출하지 않는다.
  2. 제공된다면 현재의 OpenAI 호환 또는 커스텀 API 옵션을 선택한다.
  3. 입력란이 완료 엔드포인트를 요구할 때 전체 chat-completions URL을 입력한다.
  4. 무료 변형이라면 :free를 포함해 현재 OpenRouter 모델 ID를 정확히 붙여 넣는다.
  5. 저장한 뒤 JanitorAI를 새로고침하고, 짧고 비노골적인 메시지로 테스트한다.
증상가능성 높은 원인우선 조치
401 또는 invalid token키가 잘못되었거나 만료되었고, 불필요한 문자가 함께 붙여 넣어졌을 수 있음키를 다시 생성해 붙여 넣고, 공개 공유 키는 사용하지 않음
404 또는 no endpoint모델 슬러그 또는 URL이 오래됨OpenRouter에서 현재 슬러그를 복사하고 전체 엔드포인트를 확인
429무료 모델의 일일·분당 한도 또는 제공자 과부하기다리고 재시도를 줄인 뒤, 고정한 대체 모델이나 유료 라우트로 전환
빈 응답지원하지 않는 라우트, 출력 한도, 컨텍스트 초과컨텍스트·출력 설정을 낮추고 OpenRouter에서 모델을 직접 테스트
봇이 도입부를 잊음프런트엔드가 이전 기록을 잘라 냄프롬프트 크기를 줄이고 오래된 턴을 요약하며 엔드포인트 컨텍스트에 맞춤
거부 또는 갑작스러운 스타일 변화제공자 정책 또는 다른 대체 라우트실제 모델·제공자를 확인하고 중립적인 테스트 프롬프트 사용; ‘무검열’은 보장이 아님

개인정보, 제공자 라우팅, 준수 사항

OpenRouter의 FAQ에 따르면 타임스탬프, 모델, 토큰 수 같은 기본 요청 메타데이터는 기록한다. 반면 프롬프트와 완료 결과는 사용자가 선택하지 않는 한 기본적으로 로그에 남지 않는다. 업스트림 제공자는 별도의 보관 및 학습 정책을 적용할 수 있다.

Zero Data Retention은 선택한 보존 정책을 충족하는 제공자로 라우팅을 제한할 수 있지만, 일부 무료 라우트는 제외될 수 있다. 무료 액세스가 개인정보 보호를 보장하는 것은 아니다. 또한 ‘무검열’은 고정된 기술적 속성이 아니다. 제공자마다 자체 정책을 적용할 수 있고, 라우팅 변경으로 실제 요청을 처리하는 제공자도 달라질 수 있다.

비노골적인 가상 프롬프트를 사용하고, 제공자의 안전장치를 우회하려고 시도하지 말자.

FAQ

지금 롤플레이에 가장 적합한 OpenRouter 모델은 무엇인가?

이 스냅샷에서는 DeepSeek V4 Flash 0731이 비교 기준이 되는 유료 비용·컨텍스트 모델이다. 현재 OpenRouter 롤플레이 사용량 신호, 1M급 컨텍스트, 100만 토큰당 $0.05/$0.16 가격을 함께 갖췄지만, 이는 통제된 조건의 보편적 품질 점수는 아니다.

무료 롤플레이용 OpenRouter 모델 중 가장 좋은 것은 무엇인가?

영구적인 승자는 없다. 여기서 확인한 실시간 컬렉션에서는 MiniMax M3가 무료 우선 후보이며, openrouter/free는 더 편리하지만 재현성은 떨어진다.

롤플레이 1,000턴 비용은 얼마인가?

이 글의 가정에서는 압축 기록 사용 시 DeepSeek V4 Flash 0731이 약 $0.28, GLM 5.3 Flash가 약 $0.43이다. 전체 기록 사용 시에는 각각 $17.67과 $26.51로 계산된다.

컨텍스트 창이 크면 모델이 내용을 잊지 않나?

아니다. 컨텍스트는 엔드포인트가 받아들일 수 있는 최대량일 뿐, 모든 세부 정보를 정확히 활용한다는 보장은 아니다. 요약과 최근 턴 제한은 여전히 중요하다.

롤플레이 모델이 거부하거나 행동이 바뀐 이유는 무엇인가?

제공자, 대체 라우트, 무료 엔드포인트, 실질적인 컨텍스트 한도가 바뀌었을 수 있다. 한 번의 거부를 모델 전체의 특성으로 판단하기 전에 실제 모델 ID와 라우트를 확인하자.

동일한 안전한 20턴 캐릭터 카드를 DeepSeek V4 Flash 0731과 현재 사용 가능한 무료 엔드포인트 하나에 각각 실행한 뒤, 두 모델을 이름 있는 프로필로 저장해 두자. 유료 라우트는 가격과 가용성 면에서 더 예측 가능하며, 무료 라우트는 용량과 모델 정체성이 변할 수 있는 대신 실험에 적합하다.

함께 읽기