StepFun Step 5 Preview 리뷰: 600B MoE, 1M 컨텍스트 신규 LLM
중국 StepFun이 600B 파라미터 MoE 모델 Step 5 Preview를 출시했다. 1M 컨텍스트와 저가 API가 특징이다. 오픈웨이트는 10월 15일 공개된다.
중국 StepFun이 600B 파라미터 MoE 모델 Step 5 Preview를 출시했다. 1M 컨텍스트와 저가 API가 특징이다. 오픈웨이트는 10월 15일 공개된다.
핵심 요약
중국 AI 스타트업 StepFun이 2026년 9월 20일 신규 대형 언어모델 "Step 5 Preview"를 공개했다 (StepFun 발표, MarkTechPost 보도). 이 모델은 600B 총 파라미터 중 27B만 활성화하는 스파스 MoE(Mixture of Experts) 아키텍처를 사용한다.
현재는 API 형태로만 제공되며, 오픈웨이트 공개는 2026년 10월 15일로 예정되어 있다 (datastudios.org 보도). 아직 가중치가 공개되지 않았다는 점을 명확히 해둔다.
주요 기능
1. 스파스 MoE 아키텍처
Step 5 Preview는 92개의 Transformer 레이어로 구성되며, 600B 총 파라미터 중 27B 파라미터만 추론 시 활성화된다. 이 방식은 대형 모델의 지식 용량을 유지하면서도 실제 연산 비용을 낮추는 것이 목적이다.
2. 1M 토큰 컨텍스트 윈도우
최대 1M 토큰의 컨텍스트를 지원한다 (StepFun 공식 발표). 대규모 문서나 코드베이스를 통째로 입력하는 작업에 활용할 수 있다.
3. 멀티모달 입력, 텍스트 출력
텍스트, 이미지, 비디오를 입력으로 받을 수 있으나 출력은 텍스트로 제한된다. 이미지나 비디오를 생성하지는 않고, 시각 정보를 이해하고 텍스트로 응답하는 구조다.
4. 3단계 추론 강도 조절
사용자가 추론 강도를 3단계로 조절할 수 있는 기능을 제공한다. 간단한 질의에는 낮은 강도로 빠르게 응답하고, 복잡한 문제에는 높은 강도로 더 깊게 추론하도록 설정할 수 있다.
5. 툴 콜링 지원
외부 도구나 API를 호출하는 툴 콜링 기능을 지원해 에이전트형 워크플로우에 활용할 수 있다.
사용성 분석
API 가격은 입력 토큰 100만 개당 $1.00, 캐시 히트 시 $0.05, 출력 토큰 100만 개당 $2.70이다 (StepFun 공식 가격표). 이 가격대는 동급 성능 모델들과 비교했을 때 낮은 편에 속한다.
Artificial Analysis Intelligence Index 기준 44점을 기록했는데, 이는 유사 가격대 모델들의 중앙값인 24점을 크게 웃돈다 (Artificial Analysis 벤치마크). 다만 이 지수는 여러 벤치마크를 종합한 상대 지표이므로, 실제 업무 적합성은 세부 태스크별로 별도 검증이 필요하다.
세부 벤치마크로는 FrontierFinance 66.4점, DRACO 83.3점, DeepSWE v1.1 67.7점을 기록했다 (Artificial Analysis). 각각 금융 추론, 코딩/에이전트 관련 벤치마크로 알려져 있으며, 특히 DRACO 점수가 높게 나타났다.
현재 오픈웨이트가 없어 로컬 실행이나 자체 파인튜닝은 불가능하고, API를 통한 사용만 가능한 상태다.
장점 및 단점
1M 토큰 컨텍스트와 저렴한 API 가격, 3단계 추론 조절 기능이 실무적으로 유용한 강점이다. 반면 오픈웨이트 미공개로 인한 이용 제약, 이미지·비디오 출력 미지원은 한계로 꼽힌다.
전망
10월 15일로 예정된 오픈웨이트 공개가 이뤄지면, 로컬 배포와 파인튜닝이 가능해져 활용 범위가 넓어질 것으로 예상된다. StepFun이 실제로 이 일정을 지킬지, 그리고 공개되는 가중치의 라이선스 조건이 어떻게 될지가 관전 포인트다.
중국발 오픈소스/오픈웨이트 LLM 경쟁이 이어지는 가운데, Step 5 Preview는 MoE 기반 대형 모델의 또 다른 선택지로 자리매김할 가능성이 있다.
결론
Step 5 Preview는 저렴한 API 가격과 넓은 컨텍스트 윈도우를 앞세운 신규 MoE 모델이다. 현재는 API 전용이라는 제약이 있어, 오픈웨이트 공개 전까지는 API 기반 프로토타이핑이나 벤치마크 비교 목적의 사용자에게 적합하다. 로컬 배포를 원하는 개발자는 10월 15일 오픈웨이트 공개 이후를 기다려볼 필요가 있다.
장점
- 1M 토큰의 넓은 컨텍스트 윈도우
- 동급 가격대 대비 우수한 Intelligence Index 벤치마크 점수
- 낮은 API 가격(입력 $1.00/1M, 캐시 히트 $0.05/1M)
- 3단계 추론 강도 조절과 툴 콜링 등 실무 기능 지원
단점/한계
- 현재 오픈웨이트 미공개로 로컬 실행/파인튜닝 불가
- 이미지·비디오는 입력만 지원, 출력은 텍스트로 한정
- API 전용 제공으로 데이터 프라이버시 민감 환경에서는 제약
- 10월 15일 오픈웨이트 공개 일정이 실제 지켜질지는 아직 미확정
참고 자료
댓글0개
주요 기능/특징
1. 600B 총 파라미터 / 27B 활성 파라미터 스파스 MoE 아키텍처 2. 92개 Transformer 레이어 구성 3. 최대 1M 토큰 컨텍스트 윈도우 지원 4. 텍스트·이미지·비디오 입력, 텍스트 출력 멀티모달 이해 5. 3단계 추론 강도 조절 기능 6. 툴 콜링(에이전트 연동) 지원 7. API 전용 제공, 오픈웨이트는 2026년 10월 15일 공개 예정
핵심 인사이트
- 27B 활성 파라미터로 600B 규모 모델 성능을 노리는 MoE 설계 전략이다
- 입력 $1.00/1M, 출력 $2.70/1M 토큰의 API 가격은 동급 대비 낮은 편이다
- Artificial Analysis Intelligence Index 44점은 동급 가격대 중앙값 24점을 상회한다
- 1M 토큰 컨텍스트는 대규모 코드베이스나 문서 분석에 활용 가치가 있다
- 3단계 추론 강도 조절로 응답 속도와 정확도 간 트레이드오프를 사용자가 직접 조정 가능하다
- 오픈웨이트가 아직 공개되지 않아 현재는 API로만 접근 가능하다
- 10월 15일 오픈웨이트 공개 여부가 실제 활용 확산의 분수령이 될 전망이다
- 이미지·비디오는 입력만 가능하고 생성 출력은 지원하지 않는다
이 리뷰가 유용했나요?
공유하기
관련 AI 리뷰
Grok Bot 음성 모드 출시: 말로 업무 위임하는 AI 팀원
xAI가 Grok Bot에 음성 대화 모드를 추가했다. Grok Voice Think Fast 2.0 기반으로 데스크톱·모바일에서 말로 업무를 위임할 수 있다.
LG 엑사원 기반 제조·품질·소재 전문가 AI 3종 공개
LG AI연구원이 엑사원 기반 산업 특화 AI 3종을 공개했다. 공정 예측, 외관 검사, 신소재 설계를 각각 담당하며 자율형 공장 구축을 예고했다.
Sakana AI Fugu Max·Ultra v2 리뷰: 오케스트레이터형 LLM 등장
Sakana AI가 2026년 9월 10일 오케스트레이터 방식의 Fugu Max와 Fugu Ultra v2를 출시했다. 여러 모델을 조율해 비용과 성능의 파레토 곡선을 최적화한다. 비용 효율과 멀티스텝 작업을 원하는 개발자에게 적합하다.
DeepSeek V4.1 Flash 정식 전환: V4-Pro API 트래픽 대체 예고
DeepSeek가 V4.1 Flash를 임시 테스트에서 정식 프로덕션 모델로 전환했다. 9월 14일부터 기존 V4-Pro API 요청은 V4.1 Flash로 자동 라우팅·과금된다.
