🎁 신규 무료 가입, 10회 호출 제공. 최대 $1, 카드 불필요.

DeepSeek V4 Flash (0731) 2026-07-31 출시

DeepSeek chat코드리즈닝도구 호출구조화 출력스트리밍프롬프트 캐싱
입력$0.2/M
출력$0.4/M
캐시 읽기$0.04/M
컨텍스트1M
GPT-4o 대비약 96% 저렴

공급사 정가. 플랫폼 마진 없음, 종량제. 아래는 공식 정가입니다. 로그인한 고객은 /console/pricing 에서 워크스페이스 할인이 반영된 실제 가격을 볼 수 있습니다. 캐시 적중률 70% 기준 실효 입력 단가:$0.088/M. 자동 디스크 KV 프리픽스 캐싱이 적용됩니다. 캐시 적중은 옵트인이나 쓰기 수수료 없이 할인된 캐시 읽기 요율로 과금됩니다.

30초 만에 DeepSeek V4 Flash (0731) 사용하기

OpenAI 호환. base_url만 바꾸면 SDK는 그대로. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

스펙 및 제한

토큰

컨텍스트 윈도우(공급사 사양)
1,000,000
최대 출력(벤더 스펙)
393,216

프롬프트 캐싱

캐싱 방식
자동

사고

파라미터
reasoning_effort
minimal · low · medium · high 허용 범위는 공급사가 정함

모델

모달리티
텍스트 → 텍스트
파라미터
전체 284B · 활성 13B MoE
라이선스
MIT
  • July 2026 release of DeepSeek V4 Flash
  • same 284B/13B-active MoE design, gains from a stronger post-training pipeline rather than a new architecture

출처: DeepSeek 공식 문서 ↗

DeepSeek V4 Flash (0731) 소개

284B MoE에 13B 활성화, MIT 라이선스
기존 V4 Flash의 후속
100만 컨텍스트와 384K 최대 출력

DeepSeek V4 Flash 0731은 DeepSeek의 빠르고 경제적인 V4 Flash 계열의 2026년 7월 릴리스이며, 기존 V4 Flash와 나란히 놓이는 변형이 아니라 그 후속입니다.

  • 아키텍처와 규모는 그대로여서 총 284B 파라미터에 추론 시 13B를 활성화하는 Mixture-of-Experts이고, DeepSeek은 개선의 원인을 새로운 설계가 아니라 크게 강화된 사후 학습 파이프라인으로 설명하며 에이전트 워크플로와 추론 품질에 집중했다고 밝힙니다.
  • 이 계열을 운영 측면에서 매력적으로 만들던 요소는 모두 유지됩니다.
  • 100만 토큰 컨텍스트 윈도, 384K 최대 출력, MIT 라이선스 가중치, 함수 호출, 구조화 출력, 스트리밍입니다.
  • 사고는 기본으로 켜져 있고 트레이스는 reasoning_content로 돌아오는데, 이 점이 대부분의 모델보다 중요합니다.
  • 짧은 프롬프트에서는 추론 트레이스가 출력 토큰의 대부분을 차지할 수 있어 max_tokens 예산이 빡빡하면 본문이 빈 채로 반환되지만 사고에 쓴 토큰은 그대로 과금됩니다.
  • 지연에 민감한 경로에 넣기 전에 그만큼을 감안하거나 추론 강도를 낮추십시오.
  • 입력과 출력 모두 텍스트 전용이며 이미지 입력은 지원하지 않으므로, 비전이 필요하면 멀티모달 메시지를 보내는 대신 비전 모델과 함께 사용하십시오.
  • 날짜가 붙은 릴리스와 붙지 않은 롤링 이름이 모두 호출 가능하므로 재현성이 필요하면 날짜가 붙은 id를 고정하고, 날짜 없는 이름은 시간이 지나며 앞으로 이동한다고 가정하십시오.
  • Synthorai는 OpenAI 호환 chat completions 엔드포인트로 제공합니다.

자주 묻는 질문

DeepSeek V4 Flash (0731) API는 무료로 사용해 볼 수 있나요?

네, 신규 계정에는 10회의 체험 호출과 최대 $1의 무료 크레딧이 제공되며, 카드 등록이 필요 없습니다. 입력 토큰 $0.2/M 기준으로, 이 크레딧만으로도 DeepSeek V4 Flash (0731)에 약 8K 토큰 규모의 요청을 대략 625회 보낼 수 있습니다.

DeepSeek V4 Flash (0731)은 무엇에 가장 강한가요?

284B MoE에 13B 활성화, MIT 라이선스, 기존 V4 Flash의 후속, 100만 컨텍스트와 384K 최대 출력. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 소개 섹션을 참고하세요.

DeepSeek V4 Flash (0731)의 가격은 얼마인가요?

Synthorai에서 DeepSeek V4 Flash (0731)은 입력 토큰 100만 개당 $0.2, 출력 토큰 100만 개당 $0.4입니다. 공급사 정가 그대로이며 플랫폼 마진이 없습니다. 캐시된 입력 토큰은 $0.04/M로 과금됩니다.

DeepSeek V4 Flash (0731)은 프롬프트 캐싱을 지원하나요?

네, 자동으로 지원합니다. DeepSeek에서 서빙되는 프롬프트는 코드 변경 없이 캐시됩니다. 캐시된 입력 토큰은 $0.04/M로 과금됩니다(미캐시 시 $0.2/M). 프롬프트 캐싱 가이드 →

DeepSeek V4 Flash (0731)은 어떻게 이용하나요?

기존 OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="deepseek-v4-flash-0731"로 설정하면 끝입니다. API 키 하나로 게이트웨이의 모든 모델을 사용할 수 있습니다.

DeepSeek V4 Flash (0731)은 오픈소스인가요?

네, 가중치가 MIT 라이선스 하에 공개되어 있습니다. GPU를 직접 마련할 필요도 없습니다: 여기서 제공되는 호스팅 버전은 종량제이며 운영할 인프라가 없습니다. 오픈 웨이트 모델 실행하기 →

관련 모델

무료 API 키 받기 내 비용 비교하기 →