DeepSeek은 7월 31일 V4 Flash 0731을 공개 베타로 출시했다. 회사는 이전 미리보기의 구조와 크기를 유지하면서 새 후속 훈련 단계를 추가했다고 밝혔다. API에서 제공됐으며 소비자 앱, 웹 서비스 또는 API의 DeepSeek Pro 모델을 대체하지 않았다.
DeepSeek 문서에 따르면 모델은 100만 token 맥락 창과 최대 384,000 token 출력을 지원한다. Responses API와 Codex에 맞춘 기능도 포함한다. 긴 문서와 코딩 활용 가능성을 넓히지만 매우 큰 맥락을 받을 수 있다는 사실이 모든 부분을 얼마나 잘 활용하는지 보여주지는 않는다.
공식 100만 token당 가격은 캐시 적중 입력 0.0028달러, 캐시 미적중 입력 0.14달러, 출력 0.28달러였다. 캐시 입력과 새 입력의 차이가 커 작업 형태가 비교의 중심이 된다. 캐시 적중을 전제로 한 대표 가격은 매번 새 맥락을 보내는 작업을 설명하지 못한다.
token 가격만으로는 지연, 추론 token, 재시도, 실패 호출과 출력 품질을 알 수 없다. 반복 수정이 필요하면 token당 저렴한 모델도 승인된 결과 하나당 비용은 높을 수 있다. GPT, Claude, Gemini 또는 Kimi와 비교할 때 같은 입력을 쓰고 캐시 동작과 완료 기준을 공개해야 한다.
베타 제품이므로 모델 ID와 가격은 바뀔 수 있다. 개발자는 배포 전 현재 API 항목을 확인하고 비용 기록에 날짜를 붙여야 한다. 모든 token이 최저가로 청구된다고 가정한 출시표보다 재현 가능한 작업당 비용 시험이 더 오래 유용할 것이다.
다음에 주목할 점
현재 베타 모델과 가격을 확인한 뒤 캐시율, 지연, 재시도, 맥락 사용과 실패 호출을 공개한 전체 작업 비용을 측정해야 한다.
출처
이 회고 기사는 2026년 8월 3일 DeepSeek의 업데이트, 가격 페이지와 모델 저장소, 시장 맥락을 위한 Axios 보도를 바탕으로 작성됐다. AI News of Today는 API 비용 또는 품질 시험을 하지 않았다.
가능한 경우 원문 자료와 현장 취재 보도로 연결합니다.