DeepSeek V4 Pro 종료 철회, 유지 요금·Flash 차이

DeepSeek V4 Pro 종료 철회 여부를 확인하면, 2026년 9월 15일 기준 공식 안내는 9월 14일 이후에도 V4 Pro API를 제공하며 기존 과금 방식을 유지한다는 내용입니다. 따라서 Pro 요청이 모두 Flash로 바뀌고 Flash 요금이 적용된다는 이전 안내를 현재 정책으로 받아들이면 안 됩니다.
이 글은 DeepSeek의 Your First API Call과 Models & Pricing 원문을 직접 확인해 서비스 유지 범위와 요금 차이를 정리합니다.
- 9월 14일 이후 적용되는 공식 공지의 범위
- Pro와 구형 Flash 요청 이름의 차이
- 캐시·시간대별 API 가격 읽는 법
- 모델 변경 여부와 에이전트 품질의 관계
- 운영 설정과 청구 내역 점검 순서
검색 결과나 웹 추출본에는 이전 공지가 남아 있을 수 있습니다. 이번 확인에서도 추출본은 자동 전환을 안내했지만, 같은 공식 URL의 현재 원문은 서비스 유지로 바뀌어 있었습니다. 아래 내용은 현재 원문의 각주를 기준으로 합니다.
1. DeepSeek V4 Pro 종료 철회 공지는 무엇인가
사용자 요청에 따라 서비스 지속
공식 첫 API 호출 안내와 가격표의 각주 (2)는 사용자 수요에 따라 V4 Pro 서비스를 계속 제공한다고 명시합니다. 후속 변경이 있으면 추가로 알리겠다는 문구도 있습니다.
종료 시점을 새로 확정한 것은 아니다
현재 문구에는 새 종료 날짜가 없습니다. 이를 무기한 제공 보장이나 특정 후속 모델의 출시 일정으로 확대 해석할 근거도 없습니다.
2. Pro 유지와 구형 Flash 전환은 별개다

deepseek-v4-pro는 별도 항목으로 남아 있다
가격표는 deepseek-v4-pro의 모델 버전을 DeepSeek-V4-Pro-0813으로, deepseek-flash는 DeepSeek-V4.1-Flash로 표기합니다. 이번 안내는 DeepSeek가 직접 제공하는 API에 관한 것이므로 제삼자 중계 서비스의 별칭이나 자체 라우팅 정책까지 동일하다고 볼 수는 없습니다.
기존 Flash 계열 이름은 V4.1 Flash를 가리킨다
각주 (1)에 따르면 deepseek-v4-flash와 deepseek-v4-flash-vision-exp는 요청 이름으로 계속 허용되지만, 해당 구형 모델은 종료됐습니다. 요청은 V4.1 Flash가 처리하고 Flash 가격으로 청구되며, 문서는 새 설정에 deepseek-flash 사용을 안내합니다.
이전에 다룬 DeepSeek V4 Flash Vision 이미지 인식, 성능·제약 정리의 실험 모델 이름을 사용하고 있다면 이 각주를 함께 확인해야 합니다. 이전 모델을 설명한 글의 기능·상태를 현재 API에 그대로 적용하지 않는 것이 중요합니다.
3. Pro 유지 요금과 Flash 가격은 얼마나 다른가

입력·출력·캐시를 나눠 비교한다
아래는 2026년 9월 15일 공식 가격표의 100만 토큰당 미국 달러 가격입니다. Pro의 기존 과금 유지 공지를 읽었다면 Pro 사용량에 Flash 단가를 대입하면 안 됩니다.
| 항목 | Flash 비피크 | Flash 피크 | Pro 비피크 | Pro 피크 |
|---|---|---|---|---|
| 입력: 캐시 적중 | $0.003 | $0.006 | $0.022 | $0.044 |
| 입력: 캐시 미적중 | $0.15 | $0.30 | $0.66 | $1.32 |
| 출력 | $0.60 | $1.20 | $1.98 | $3.96 |
피크 시간은 UTC 기준으로 공지된다
공식 피크 시간은 월요일부터 금요일까지 UTC 01:00~04:00, 06:00~10:00입니다. 한국 시간으로는 평일 10:00~13:00, 15:00~19:00에 해당하며, 나머지 시간은 비피크입니다. 가격표는 비피크 단가가 피크의 절반이라고 설명합니다.
표는 확인 시점의 공시 단가입니다. DeepSeek는 가격을 변경할 수 있다고 명시하므로 장기 비용 예산에는 현재 가격표를 다시 대조하는 절차를 두는 편이 좋습니다.
4. 에이전트 운영에서 달라지는 판단 기준
이름 유지가 항상 구형 모델 유지를 뜻하지 않는다
구형 Flash 이름이 계속 받아들여지는 사례는 요청 문자열의 호환성과 내부 모델의 지속성이 서로 다른 문제임을 보여줍니다. 운영 기록에는 설정된 모델 이름뿐 아니라 호출 날짜, 사용한 제공자, 응답 메타데이터도 함께 남기는 것을 권합니다. 이는 공식 의무가 아니라 변경 원인을 추적하기 위한 운영 제안입니다.
Flash로 직접 바꿀지는 작업 결과로 정한다
낮은 토큰 단가만으로 에이전트 전환의 적합성을 확정할 수는 없습니다. 실제 업무의 도구 인자 정확도, 구조화 출력 유효성, 실패 후 재시도, 완료까지의 비용을 같은 샘플로 비교하는 것이 합리적입니다. 이 글에서는 유료 API를 호출해 Pro와 Flash의 성능 우열을 측정하지 않았습니다.
5. 모델 설정과 청구는 무엇부터 점검할까

공식 각주와 실제 요청 문자열부터 확인한다
- 공식 첫 API 호출 안내와 가격표를 직접 열고 각주 (1)·(2)를 읽습니다.
- 애플리케이션이 보내는
model값과 접속 제공자를 확인합니다. - 중계 서비스가 있다면 자체 별칭·라우팅 설정이 개입하는지 확인합니다.
작은 샘플과 청구 내역을 같은 기간으로 맞춘다
| 점검 대상 | 확인할 증거 | 성급한 판단 |
|---|---|---|
| 응답 품질 | 같은 입력·도구 조건의 실제 결과 | 모델명만 보고 품질을 단정 |
| 비용 | 시간대·토큰 유형별 사용량과 청구 | Pro에 Flash 요금을 적용 |
| 정책 변경 | 현재 공식 원문과 확인 시각 | 검색 요약을 최종 공지로 취급 |
6. Q&A와 정리
Q1. 앱이나 웹 채팅의 모델도 같은 공지로 판단하나요?
이 글의 근거는 API 문서입니다. 소비자용 앱·웹 채팅의 모델 선택과 제공 조건까지 같다고 단정하지 않았습니다.
Q2. 공식 표의 Vision 지원은 두 모델이 같은가요?
현재 표는 Flash에는 Vision 지원을 표시하고 Pro에는 미지원으로 표기합니다. 이미지 입력이 필요한 워크플로라면 요금과 별개로 이 차이를 확인해야 합니다.
Q3. 이미 충전한 잔액의 차감 순서는 어디에서 보나요?
가격표의 Deduction Rules는 충전 잔액 또는 제공된 잔액에서 비용을 차감한다고 설명합니다. 두 잔액이 모두 있으면 제공된 잔액을 우선 사용한다고 안내합니다.
Q4. Pro를 쓰려면 새로운 API 주소가 필요한가요?
현재 표는 OpenAI 형식에 https://api.deepseek.com, Anthropic 형식에 https://api.deepseek.com/anthropic를 안내합니다. 두 형식의 요청 구조는 각각의 문서를 따라야 합니다.
Q5. 공식 페이지마다 내용이 다르게 보이면 어떻게 하나요?
확인한 URL·시각·문구를 남기고 현재 공지와 가격표를 다시 대조하는 편이 안전합니다. 불일치가 해소되지 않으면 전체 설정을 일괄 변경하지 말고 제공자 확인을 우선하세요.
7. 참고 자료
'LLM' 카테고리의 다른 글
| MiniCPM5-2B 공개, 로컬 에이전트 성능과 제약 정리 (0) | 2026.09.09 |
|---|---|
| DeepSeek V4 Flash Vision 이미지 인식, 성능·제약 정리 (0) | 2026.09.08 |
| Muse Spark 1.3 성능·가격, 코딩 1위로 봐도 될까? (0) | 2026.09.03 |
| Claude Fable 5.1 마이그레이션: 도구 호출·thinking 변경점 (0) | 2026.09.02 |
| PhoneLLM Alpha 1 공개, 94% 저렴한 음성 모델인가? (0) | 2026.08.30 |