DeepSeek V4-Flash-0731 출시: 재학습으로 코딩·에이전트 성능 강화
DeepSeek가 V4-Flash 재학습판 V4-Flash-0731 API를 퍼블릭 베타로 출시했다. Terminal-Bench 2.1 82.7점을 기록했으며 Responses API·Codex 연동을 지원한다.
DeepSeek가 V4-Flash 재학습판 V4-Flash-0731 API를 퍼블릭 베타로 출시했다. Terminal-Bench 2.1 82.7점을 기록했으며 Responses API·Codex 연동을 지원한다.
핵심 요약
DeepSeek가 2026년 7월 31일 V4-Flash 모델의 재학습(retrained) 버전인 V4-Flash-0731 API를 퍼블릭 베타로 공식 출시했다 (DeepSeek API 공식 Changelog). 아키텍처와 파라미터 규모는 기존 V4-Flash-Preview와 동일하게 유지됐다. 대신 재포스트트레이닝(re-post-training)을 통해 에이전트 작업과 코딩 성능을 끌어올린 것이 이번 업데이트의 핵심이다.
이번 발표에는 V4-Pro API와 자체 코딩 도구 'Harness'는 포함되지 않았다. 두 제품 모두 별도로 출시될 예정이지만, 구체적인 일정은 아직 공개되지 않았다.
주요 기능
1. 재포스트트레이닝 기반 성능 개선
V4-Flash-0731은 모델 크기를 키우지 않고도 성능을 끌어올린 사례다. 아키텍처 변경 없이 재학습 과정만으로 에이전트·코딩 작업 수행 능력을 향상시켰다 (MarkTechPost). 공식 벤치마크 결과는 다음과 같다 (DeepSeek API 공식 Changelog).
| 벤치마크 | 점수 |
|---|---|
| Terminal-Bench 2.1 | 82.7 |
| CyberGym | 76.7 |
Terminal-Bench 2.1은 터미널 환경에서 에이전트가 실제 작업을 얼마나 잘 수행하는지 측정하는 벤치마크다. CyberGym은 보안·취약점 대응 관련 작업 능력을 평가한다.
2. Responses API 포맷 신규 지원
V4-Flash-0731부터 Responses API 포맷을 새롭게 지원한다 (DeepSeek API 공식 Changelog). 기존 채팅 완성형 API와 다른 구조로, 개발자가 에이전트 워크플로우에 응답을 통합하기 쉬워진다.
3. Codex 연동 지원
Codex와의 연동도 함께 지원한다 (DeepSeek API 공식 Changelog). 코딩 에이전트 파이프라인에 V4-Flash-0731을 직접 연결할 수 있는 경로가 마련됐다.
4. 가격 정책
API 가격은 다음과 같다 (DeepSeek API 공식 Changelog).
| 구분 | 가격 |
|---|---|
| 입력 100만 토큰 | $0.14 |
| 출력 100만 토큰 | $0.28 |
사용성 분석
퍼블릭 베타 형태로 출시된 만큼, 기존 V4-Flash-Preview API 사용자는 큰 절차 변경 없이 전환할 수 있을 것으로 예상된다. Responses API와 Codex 연동을 지원하는 점은 에이전트 기반 코딩 워크플로우를 운영 중인 개발자에게 실용적이다.
다만 이번 발표는 Flash 라인의 API 업데이트에 한정된다. 더 큰 규모의 작업을 염두에 둔 V4-Pro API와 Harness 도구는 아직 공개되지 않았다. 대규모 에이전트 파이프라인을 계획 중인 팀이라면 후속 발표를 계속 확인할 필요가 있다.
장점
- 비용 효율성: 입력 $0.14, 출력 $0.28로 대량 에이전트 호출에 부담이 적다.
- 에이전트·코딩 성능 개선: Terminal-Bench 2.1 82.7, CyberGym 76.7을 기록했다 (공식 발표).
- 개발 편의성: Responses API 포맷과 Codex 연동으로 기존 워크플로우 통합이 쉬워졌다.
- 모델 크기 유지: 아키텍처 변경 없이 재학습만으로 성능을 끌어올려 인프라 부담이 크지 않다.
단점 및 한계
- V4-Pro 미공개: 상위 모델인 V4-Pro API는 이번 발표에 포함되지 않았고 출시 일정도 아직 공개되지 않았다.
- Harness 정보 부족: 자체 코딩 도구 Harness의 상세 스펙과 출시 시점이 공개되지 않아 구체적인 평가가 어렵다.
- 베타 단계: 퍼블릭 베타 상태이므로 프로덕션 환경에서는 안정성 검증이 추가로 필요하다.
경쟁 서비스 비교
공식 발표에는 경쟁 모델과의 직접적인 비교 수치가 포함되어 있지 않다. 입력 $0.14, 출력 $0.28의 가격 구조와 Terminal-Bench 2.1, CyberGym 점수는 DeepSeek가 공개한 자체 지표일 뿐이다. 다른 API 대비 정확한 우위를 판단하려면 각 서비스의 최신 공식 가격표와 동일 벤치마크 결과를 직접 비교해야 한다.
전망
DeepSeek는 이번 업데이트로 모델 크기를 키우지 않고도 재학습만으로 성능을 개선할 수 있음을 보여줬다. 이는 인프라 비용을 크게 늘리지 않고도 에이전트·코딩 성능을 향상시키는 전략으로 해석할 수 있다.
다만 V4-Pro API와 Harness 도구의 공개 시점에 따라 DeepSeek의 전체 제품 라인업 완성도가 달라질 것으로 보인다. 두 제품의 구체적인 스펙과 일정은 아직 공개되지 않았으므로, 후속 발표를 지켜볼 필요가 있다.
결론
DeepSeek V4-Flash-0731은 기존 아키텍처를 유지하면서 재학습만으로 에이전트·코딩 성능을 끌어올린 업데이트다. 낮은 API 가격과 Responses API·Codex 연동 지원은 에이전트 개발자에게 실용적인 선택지가 될 수 있다. 다만 V4-Pro와 Harness의 부재, 베타 단계라는 점은 감안해야 한다.
장점
- 낮은 API 가격 (입력 $0.14 / 출력 $0.28, 100만 토큰당)
- Terminal-Bench 2.1, CyberGym 벤치마크에서 개선된 성능 (공식 발표)
- Responses API 포맷과 Codex 연동 지원으로 개발 편의성 향상
- 아키텍처 변경 없이 재학습만으로 성능 개선, 인프라 부담이 적음
단점/한계
- V4-Pro API 출시 일정 미공개
- 자체 코딩 도구 Harness의 상세 스펙 미공개
- 퍼블릭 베타 단계로 프로덕션 안정성 검증 필요
댓글0개
주요 기능/특징
1. V4-Flash 재학습 버전, 아키텍처·파라미터 규모는 기존 V4-Flash-Preview와 동일 2. Terminal-Bench 2.1 82.7점, CyberGym 76.7점 (공식 벤치마크) 3. Responses API 포맷 신규 지원 4. Codex 연동 지원 5. 가격: 입력 100만 토큰당 $0.14, 출력 100만 토큰당 $0.28 6. V4-Pro API 및 Harness는 이번 발표에 미포함, 출시 일정 미공개
핵심 인사이트
- 모델 크기를 키우지 않고 재학습만으로 에이전트·코딩 성능을 끌어올렸다
- Terminal-Bench 2.1 82.7점은 터미널 기반 에이전트 작업 능력의 개선을 보여준다
- CyberGym 76.7점은 보안 관련 작업 대응 능력을 나타낸다
- Responses API 지원으로 개발자의 에이전트 워크플로우 통합이 쉬워졌다
- Codex 연동 지원은 코딩 에이전트 파이프라인 구축에 실질적인 도움이 된다
- 입력 $0.14, 출력 $0.28의 가격은 대량 API 호출 시 비용 부담을 낮춘다
- V4-Pro API와 Harness는 아직 공개되지 않아 DeepSeek의 전체 라인업은 미완성 상태다
- 퍼블릭 베타 단계이므로 프로덕션 도입 전 안정성 검증이 필요하다
이 리뷰가 유용했나요?
공유하기
관련 AI 리뷰
MS-Mistral 파트너십 확대: Foundry에 Medium 3.5·OCR 4 통합
Microsoft와 Mistral이 2026년 7월 21일 전략적 파트너십을 확대했다. 규제 산업 대상 소버린 AI 배포 모델과 Foundry 모델 통합이 핵심이다.
Qwen3.8-Max 프리뷰 공개: 2.4조 파라미터, 검증되지 않은 '2위' 자평
알리바바 Qwen팀이 2.4조 파라미터 규모의 Qwen3.8-Max 프리뷰를 공개했다. 가중치는 추후 공개 예정이며, 'Fable 5 다음으로 강력하다'는 알리바바 자체 주장은 아직 독립 검증되지 않았다.
Kimi K3 공개: 2.8조 파라미터 오픈웨이트, 100만 토큰 지원
Moonshot AI가 7월 16일 공개한 Kimi K3는 2.8조 파라미터 MoE 모델로 100만 토큰 컨텍스트를 지원한다. 자체 벤치마크에서 Opus 4.8·GPT-5.5를 상회했다고 밝혔다. 가중치는 7월 27일 공개 예정이다.
딥시크, 15억 달러 추가 투자 협상...중국 본토 IPO 준비 착수
딥시크가 6월 70억 달러 펀딩 한 달 만에 15억 달러 추가 투자를 논의 중인 것으로 알려졌다. 밸류에이션은 710억 달러로 상승했고 중국 본토 IPO도 준비 중이다.
