Artificial Analysis에서 44점을 받은 모델치고는 Step 5 Preview의 가격이 상당히 저렴해 보입니다. 하지만 실제 도입 여부를 토큰 단가만 보고 결정하기는 어렵습니다. StepFun은 모델과 API 사용 경로를 발표했지만, 현재 공개 문서만으로는 완전한 모델 페이지와 과금 명세, 프로덕션 사용에 필요한 계약 조건을 모두 확인하기 어렵습니다. 관련 정보가 정리될 때까지는 기본 엔드포인트가 아니라 제한적인 파일럿 후보로 보는 편이 안전합니다.
‘사용 가능’의 기준부터 나눠 봐야 한다
Step 5 Preview는 더 이상 단순한 소문이 아닙니다. StepFun 공식 계정은 2026년 9월 20일 이 모델을 발표하면서 오픈 웨이트를 10월 15일 공개할 예정이라고 밝혔습니다. 다만 StepFun의 공개 플랫폼 페이지를 Google에서 검색하면 여전히 일반 포털과 Step 3.7 문서가 주로 노출되며, step-5-preview를 명시한 페이지는 명확하게 색인되지 않은 상태입니다. 발표를 통해 접근 경로가 언급됐다는 것과, 누구나 문서를 보고 바로 프로덕션에서 사용할 수 있다는 것은 전혀 다른 이야기입니다.
| 확인할 내용 | 현재 답변 | 신뢰도 |
|---|---|---|
| StepFun이 공식 발표했나? | 그렇다. 공식 계정 @StepFun_ai를 통해 발표했다 | 높음 |
| API 모델 ID가 알려졌나? | step-5-preview | 중간 수준. 계정에서 직접 확인 필요 |
| 공개 토큰 단가가 알려졌나? | 입력 100만 토큰당 1달러 / 출력 100만 토큰당 2.70달러 | 중간 수준. 서드파티 측정 및 등록 정보 |
| 지금 웨이트를 내려받을 수 있나? | 공개된 웨이트는 확인되지 않음 | 9월 20일 기준 높음 |
| 오픈 웨이트 공개가 약속됐나? | StepFun 발표에 따르면 10월 15일 | 약속 자체는 높음. 실제 공개는 향후 일정 |
StepFun이 확인한 내용과 아직 검증되지 않은 내용
공식 발표에 따르면 Step 5 Preview는 6,000억 개 파라미터를 사용하는 희소 MoE 모델이며, 실제 활성 파라미터는 270억 개입니다. 컨텍스트 윈도우는 100만 토큰이고 텍스트와 이미지 입력을 지원하며, 에이전트 작업과 소프트웨어 엔지니어링, 금융 분야에 강점을 갖췄다고 소개됐습니다. 다만 이는 공급자가 제시한 설명이지, 모든 API 경로에서 광고된 한도가 동일하게 제공된다는 독립적인 증거는 아닙니다.
2026년 9월 20일 확인 당시 공식 플랫폼 검색에서는 Step 5의 전용 가격표나 API 문서를 찾을 수 없었습니다. 따라서 요청 한도, 최대 출력량, 함수 호출, 캐시 과금, 지역별 사용 가능 여부 같은 운영 정보는 아직 공식 출처로 확인되지 않습니다. 서드파티 모델 디렉터리에 적힌 내용을 StepFun 공식 문서인 것처럼 프로덕션 설정에 그대로 복사해서는 안 됩니다.
@xueyu1125가 작성한 실제 사용 후기에 따르면 간단한 SVG 애니메이션 테스트에서 Artificial Analysis 점수만큼의 성능을 체감하기 어려웠으며, 특히 3D와 추론 작업에서 아쉬움이 있었다고 합니다(출처). 초기 사용자 한 명의 경험이므로 벤치마크 결과로 볼 수는 없지만, 종합 점수 하나만으로 모든 작업에서의 역량을 판단해서는 안 된다는 점을 보여주는 사례입니다.
“현재 간단히 사용해 본 느낌은 Artificial Analysis의 44 Index 점수가 무색할 정도입니다. 적어도 3D와 사고 능력에서는 GLM-5.3-Flash 수준에 미치지 못합니다🤣” — @xueyu1125, 초기 실사용 테스트 공유(X)
Step 5 Preview API 가격: 공개된 단가는 참고용으로 봐야 한다
현재 널리 알려진 Step 5 Preview API 가격은 입력 100만 토큰당 1.00달러, 출력 100만 토큰당 2.70달러입니다. Artificial Analysis는 캐시 할인율을 95%로 제시하며, 캐시 적중률 70%, 입력 20%, 출력 10%라는 특정 조건에서는 토큰 100만 개당 평균 비용을 0.51달러로 계산합니다. 이 혼합 단가는 특정 사용 패턴을 가정한 값이지, 모든 청구서에 적용되는 보편적인 가격이 아닙니다.
| 사용량 | 알려진 단가 | 출시 전 확인할 내용 |
|---|---|---|
| 입력 | 토큰 100만 개당 1.00달러 | 공식 가격인지, 지역별로 다른지 여부 |
| 출력 | 토큰 100만 개당 2.70달러 | 추론 토큰이 출력량으로 계산되는지 여부 |
| 캐시 적중 | 95% 할인 적용 시 약 100만 토큰당 0.05달러 | 캐시 적용 조건과 캐시 생성 규칙 |
| 예시: 입력 10만 토큰 + 출력 2만 토큰 | 약 0.154달러 | 세금, 최소 과금, 재시도, 숨겨진 추론 사용량 |
기본 계산식은 간단합니다. (입력 토큰 ÷ 1,000,000 × 1.00) + (출력 토큰 ÷ 1,000,000 × 2.70)으로 계산하면 됩니다. 따라서 입력 100,000토큰과 출력 20,000토큰을 사용하는 요청은 할인이나 공급자별 추가 요금을 적용하기 전 기준으로 $0.10 + $0.054 = $0.154 정도입니다.
문제는 출력이 길어질 수 있다는 점입니다. Artificial Analysis의 Intelligence Index 평가에서는 약 1억 6,000만 개의 출력 토큰을 측정했는데, 비교 모델의 중앙값은 9,200만 개였습니다. 출력 단가가 낮더라도 모델이 추론이나 답변 생성에 더 많은 토큰을 사용하면 최종 비용은 커질 수 있습니다. 한 초기 사용자는 사고 토큰이 출력 과금에 포함될 수 있다고도 경고했습니다(출처).
성능 지표는 인상적이지만 항목별 편차가 크다
Artificial Analysis는 Intelligence Index 44점, 초당 약 100개 출력 토큰, 첫 답변 토큰까지 2.96초라는 결과를 제시합니다. 한편 BenchLeader는 100만 토큰 컨텍스트, 초당 100개 토큰의 출력 속도, 첫 답변까지 23초라는 수치를 별도로 기재하고 있습니다. 이처럼 지연 시간을 측정하는 방식이 다르기 때문에 대시보드에 표시된 숫자를 서로 같은 기준으로 비교해서는 안 됩니다.
| 지표 | 보고된 결과 | 구매자가 읽어야 할 의미 |
|---|---|---|
| Intelligence Index | 44 | 종합적으로 강한 결과지만 모든 작업에서의 성능을 보장하지는 않음 |
| 출력 속도 | 초당 99.8토큰 | 생성이 시작된 이후의 속도는 경쟁력 있음 |
| 첫 답변 토큰 | Artificial Analysis 기준 2.96초 | 측정 기준과 실제 사용 경로를 확인해야 함 |
| 컨텍스트 윈도우 | 100만 토큰 | 모델 프로필이 아니라 실제 배포된 API 한도를 확인해야 함 |
| 평가 중 출력량 | 1억 6,000만 토큰 | 긴 답변과 추론 사용량을 고려해 예산을 잡아야 함 |
| 장문 컨텍스트 결과 | 88.3%, BenchLeader 집계에서 2위 | 고무적인 결과지만 벤치마크 설정을 함께 봐야 함 |
벤치마크 결과가 모든 영역에서 고르게 강한 것은 아닙니다. BenchLeader에서 Step 5 Preview의 SciCode 점수는 58.9%로 8위이며, MMMU-Pro 결과는 64위에 그쳤습니다. 특히 멀티모달 성능을 종합적으로 가장 약한 영역으로 분류합니다. Artificial Analysis는 이미지 입력을 지원한다고 보고하지만, CloudPrice 카탈로그에서는 이미지 입력을 비롯한 여러 기능을 사용할 수 없는 것으로 표시합니다. StepFun이 정확한 API 기능표를 공개하기 전까지는 애플리케이션 설계에서 가장 제한적인 지원 범위를 기준으로 잡는 편이 안전합니다.
프로덕션 전환보다 안전한 파일럿 운영
현재까지의 자료는 무조건적인 전환보다 범위를 제한한 평가를 지지합니다. 소규모 테스트 예산을 배정하고, 서드파티 페이지로는 확인할 수 없는 API의 실제 동작을 직접 검증해야 합니다.
- 공식 계정에서 엔드포인트와 모델 ID를 확인하세요.
step-5-preview를 사용해 문제가 없는 요청을 하나 보내고, 응답에 포함된 모델명과 지역, 상태 코드, 요청 제한 헤더를 기록합니다. - 청구서 항목을 확보하세요. 입력, 출력, 캐시, 추론 토큰 사용량을 각각 비교합니다. 공개된
$1/$2.70숫자만으로 실제 청구액을 추정해서는 안 됩니다. - 긴 컨텍스트는 단계적으로 테스트하세요. 먼저 50K 토큰에서 시작한 뒤 요청이 성공할 때만 100K, 350K, 그 이상으로 늘립니다. 첫 토큰까지 걸린 시간과 잘림, 오류 동작을 기록합니다.
- 텍스트 품질과 도구 사용을 따로 검증하세요. 함수명과 인자 형식, 재시도 동작, 편집 전에 모델이 대상 상태를 읽는지 확인합니다. Intelligence Index 점수만으로 안정적인 도구 실행을 판단할 수는 없습니다.
- 대체 경로를 유지하세요. 실패하거나 시간 초과가 발생한 요청, 형식이 잘못된 도구 호출은 현재 스택에서 이미 지원하는 모델로 전달합니다. 고객 대상 워크플로에서 프리뷰 엔드포인트를 유일한 경로로 사용해서는 안 됩니다.
여러 공급자를 함께 사용하는 환경이라면 통합 API 게이트웨이를 통해 대체 경로를 구성하기가 쉬워질 수 있습니다. 그렇더라도 StepFun의 실제 과금 방식과 한도를 직접 확인해야 한다는 점은 달라지지 않습니다. 핵심은 검증되지 않은 모델을 예산과 로그, 테스트된 대체 경로 뒤에 두고 영향 범위를 제한하는 것입니다.
Step 5 Preview API FAQ
Step 5 Preview는 공식 출시됐나요?
StepFun은 2026년 9월 20일 Step 5 Preview를 공식 발표했습니다. 다만 공개 문서와 폭넓은 프로덕션 사용 가능 여부는 아직 명확하지 않습니다. 따라서 ‘발표됐다’는 사실을 ‘문서화와 안정화가 모두 끝났다’는 의미로 해석해서는 안 됩니다.
Step 5 Preview API 모델 ID는 무엇인가요?
초기 보고에서는 모델 ID를 step-5-preview로 식별합니다. 코드에 고정하기 전에 공식 StepFun 계정이나 API 응답에서 정확한 식별자를 확인하세요.
Step 5 Preview의 가격은 얼마인가요?
서드파티 목록과 Artificial Analysis는 입력 100만 토큰당 1.00달러, 출력 100만 토큰당 2.70달러로 보고합니다. 추론 토큰과 캐시 생성, 재시도, 지역별 요금이 다르게 과금되는지는 별도로 확인해야 합니다.
Step 5 Preview는 현재 오픈 소스인가요?
2026년 9월 20일 확인한 자료에서는 공개 웨이트를 찾을 수 없었습니다. StepFun은 10월 15일 오픈 웨이트를 공개할 예정이라고 발표했지만, 이는 현재 사용 가능하다는 뜻이 아니라 향후 계획입니다.
이미지와 100만 토큰 컨텍스트를 지원하나요?
StepFun의 발표와 Artificial Analysis는 이미지 입력과 100만 토큰 컨텍스트를 지원한다고 보고합니다. 하지만 카탈로그마다 정보가 엇갈리므로 실제 API 경로에서 직접 테스트해야 하며, 광고된 모든 기능이 모든 환경에서 활성화돼 있다고 가정해서는 안 됩니다.
따라서 결론은 모델보다 오히려 간단합니다. 가격 대비 성능이 자신의 작업에 맞는다면 소규모 계측형 파일럿을 진행할 수 있습니다. 하지만 StepFun이 개발자에게 필요한 모델 페이지와 과금 규칙, 기능 목록, 사용 한도를 공개하기 전까지는 Step 5 Preview를 프로덕션의 핵심 의존성으로 삼지 않는 편이 좋습니다.
