오픈웨이트 LLM 2026년 8월 5일 약 20분 DeepSeek V4 Harness

DeepSeek 신모델이 정말 Claude보다 100배 저렴한가?
V4-Flash 벤치마크 해부

2026년 7월 31일 · V4-Flash-0731 정식판 · 후학습만 · Harness 예고 · Pro 일정 미정

DeepSeek V4 Flash 0731 정식판 오픈웨이트 모델 벤치마크 개념

요약: 7월 31일 DeepSeek은 deepseek-v4-flash를 공식 퍼블릭 API 빌드(태그 0731)로 승격했습니다. 4월 프리뷰와 동일한 284B 파라미터 아키텍처에서 새 후학습 패스만으로 성능이 올랐습니다. Agent 점수는 Claude Opus 4.8에 근접하고, 가격은 벤더 리스트 기준 대략 1/36~1/179 수준입니다. 플래그십 V4-Pro와 자체 Agent 프레임워크 Harness는 아직 미공개입니다. 본문은 타임라인, 가격표, 아키텍처, 중국 오픈웨이트 경쟁, 벤치마크 주의점, 「斩杀线」가격 담론, 개발자 5단계 체크리스트를 다룹니다.

01

전환 전 알아둘 네 가지 함정

  1. 01

    레거시 API 이름 폐기: deepseek-chatdeepseek-reasoner는 7월 24일 퇴역. 미이전 프로덕션은 즉시 중단

  2. 02

    「정식판」≠ 새 아키텍처: 0731은 재학습된 Flash이지 더 큰 모델이 아님. 잘못된 기대가 라우팅 판단을 왜곡

  3. 03

    Agent 점수는 Harness 의존: Terminal Bench 2.0 수치는 미공개 Harness 미니멀 모드 사용. Claude Code나 Cursor에 그대로 이식하지 말 것

  4. 04

    Pro와 Harness 미공개: 공식인 것은 Flash뿐이며 API 전용. 앱·웹 채팅 미지원. 8월 10~20일 GA 루머 미확인

02

타임라인: 4월 프리뷰에서 7월 「정식판」까지

날짜사건
2026년 4월 24일V4 프리뷰 + MIT 오픈 웨이트: V4-Pro(1.6T/49B active), V4-Flash(284B/13B active), 100만 컨텍스트
2026년 7월 24일레거시 별칭 폐기. 모든 트래픽 V4 패밀리명으로 라우팅
2026년 7월 27일Moonshot AI Kimi K3 오픈 웨이트(총 2.8T) 공개 — 직접 경쟁 압력
2026년 7월 31일V4-Flash-0731 공식 API 베타. Hugging Face 웨이트 공개. changelog에 Harness 「곧 공개」. API만
2026년 8월 5일 기준공식 V4-Pro는 「가능한 한 빨리」. 언론의 8월 10~20일 창은 DeepSeek 미확인
03

핵심 수치(벤더 공시 요금)

모델상태총 / active컨텍스트입력 $/M(miss/hit)출력 $/M라이선스
V4-Flash-0731정식284B / 13B1M$0.14 / $0.0028$0.28MIT
V4-Pro프리뷰만1.6T / 49B1M$0.435 / $0.003625$0.87MIT
Kimi K37월 27일 오픈 웨이트2.8T / 약104B 추정약1.05M$3.00 / $0.30$15.00Modified MIT
GLM-5.22026년 6월 오픈약744B / 약40B1M본문 미검증MIT
Qwen3.8-Max8월 2일 API GA2.4T / 95B1M$2.00 / 약$0.17–0.25$6.00웨이트 대기

DeepSeek은 향후 베이징 평일 9–12시·14–18시 2배 피크 요금을 발표했으나 시행일 미정. 수치는 2026년 8월 5일 기준.

04

스케일업 없이 성능이 오른 이유

동일 아키텍처, 새 후학습

V4-Flash-0731은 4월 프리뷰와 크기·구조가 동일합니다. DeepSeek은 Agent 벤치마크 점프를 재실행한 후학습에만 돌립니다. 284B/13B 모델이 패밀리 내 1.6T/49B 프리뷰를 여러 agentic 태스크에서 이기는 사실은, 2026년 후반 경쟁이 원시 파라미터 수만이 아니라 학습 데이터와 방법의 싸움이기도 함을 보여줍니다.

하이브리드 어텐션, mHC, Muon

기술 보고서는 CSA + HCA 하이브리드 어텐션(「DSA」), manifold-constrained hyper-connections(mHC), Muon 옵티마이저를 설명합니다. 벤더는 100만 토큰에서 V4-Pro가 V3.2 대비 토큰당 FLOPs 27%, KV 캐시 10%라 주장하나 독립 재현은 대기 중.

Harness: 최초 자체 Agent 프레임워크

7월 31일 DeepSeek Harness가 처음 공식 언급됐습니다. 파일 I/O, 도구 호출, 엔지니어링 워크플로 — Claude Code에 대한 DeepSeek의 답입니다. 공개된 Agent 점수(Terminal Bench 2.0, Toolathlon 등)는 모두 Harness 미니멀 모드(미공개)로 측정됐습니다. changelog는 점수가 「하네스 선택에 극도로 민감」하다고 경고합니다.

05

나란히 비교: 중국 오픈웨이트 쟁탈전

모델총 파라미터AA Intelligence Index태스크당 비용(AA)
V4-Flash-0731DeepSeek284B50$0.03
Kimi K3Moonshot2.8T57$0.86
GLM-5.2Zhipu약744BFlash보다 약1pt↑미검증
GPT-5.6 SolOpenAI비공개9pt+↑$1.86
Claude Fable 5Anthropic비공개9pt+↑$3.15

Artificial Analysis 독립 인덱스에서 Flash는 최고 지능은 아니지만, 태스크당 비용은 Kimi K3의 약 1/29, Claude Fable 5의 약 1/105입니다. DeepSeek은 「충분한 지능을 압도적 가격으로」에 최적화했으며, 프리뷰가 7주 연속 OpenRouter 이용량 1위였던 배경과도 맞습니다.

의사결정 매트릭스

시나리오추천이유
대량 Agent / API 배치V4-Flash-0731최저 비용. 0731 Agent 점수가 Pro 프리뷰 상회
독립 인덱스 최대화Kimi K3 또는 클로즈드 플래그십AA 점수 높지만 단가도 높음
셀프호스트 + 100만 컨텍스트V4-Flash MIT 웨이트Hugging Face 오픈 라이선스
Harness 대기Pro 정식판 대기프레임워크 미공개. 제3자 Agent 여전히 필요
06

주의점: 헤드라인을 맹신하지 말 것

  1. 01

    Harness 락인: Terminal Bench 2.0 82.7(Pro 프리뷰 67.9 대비)은 미공개 Harness 미니멀 모드 결과. 벤더+프레임워크 조합으로 보고 이식 가능한 진실로 취급하지 말 것

  2. 02

    실사용 보고: 해외 개발자들은 입력 캐시 히트율 저하, 안전 분류기 타임아웃을 보고

  3. 03

    Pro/Harness 일정: 8월 10~20일 GA 루머는 익명 출처 언론 — DeepSeek 확인 아님

  4. 04

    자금 조달 루머: 약 74억 달러 라운드/약 487억 달러 밸류에이션 보도는 규제 제출 없음 — 배경 정보만

07

「斩杀线」가격론과 칩주 무반응

중국 포럼에서는 Pro가 7월 중순을 넘겨도 안 나오자 창업자 양원봉을 「양빈약」이라 놀렸지만, 0731이 기대를 넘기자 「양선인」이 복귀 — 감정의 빠른 바로미터입니다.

개발자들은 斩杀线(zhǎn shā xiàn)이라는 말도 씁니다. 충분한 능력과 바닥 가격이 경쟁사가 양축 모두 넘어야 할 기준선을 긋는다는 뜻입니다. OpenAI Luna 80% 인하 보도도 이 맥락에 맞습니다. 7월 31일 Nvidia·Broadcom·AMD는 거의 움직이지 않았습니다. 시장은 「DeepSeek 효율화」를 2025 R1 때의 쇼크가 아닌 일상적 엔지니어링으로 받아들이기 시작했습니다.

개발자 5단계 체크리스트

  1. 01

    프로덕션을 deepseek-v4-flash로, 레거시 별칭 폐기

  2. 02

    벤더 Agent 점수와 AA 독립 인덱스를 라우팅에서 분리

  3. 03

    발표된 2배 피크 시간대 밖에 벌크 작업 스케줄(시행일 미정)

  4. 04

    OpenClaw / Claude Code에서 Agent 검증 — TB2.0만 믿지 말 것

  5. 05

    changelog로 Harness·Pro 모니터 — API와 웨이트가 다시 갈라질 수 있음

인용하기 좋은 수치

  • Flash 0731: 284B / 13B active. 입력 캐시 히트 $0.0028/M까지
  • Opus 4.8 대비: 캐시 미스 입력 약 1/36, 캐시 히트 약 1/179, 출력 약 1/89(21세기경제보 벤더 리스트)
  • Terminal Bench 2.0: 82.7(Harness 미니멀 모드, 벤더 보고)
08

자주 묻는 질문

예. V4-Pro와 V4-Flash(0731 포함)는 Hugging Face MIT 오픈 웨이트입니다.

리스트 가격 기준 입력 약 36~179배, 출력 약 89배 Opus 4.8 백만 토큰당보다 저렴(벤더 공시, 감사 아님).

확정일 없음 — changelog는 「가능한 한 빨리」. 8월 루머 미확인.

SWE-bench Verified가 더 강한 신호. Agent 점수는 Harness 제3자 재현 필요.

DeepSeek 자체 Agent 프레임워크(파일, 도구, 엔지니어링 태스크). 7월 31일 명칭 공개, 아직 미공개.

마무리

V4-Flash-0731은 후학습과 가격이 또 다른 파라미터 증가보다 중요할 수 있음을 보여줍니다. 그러나 실제 공정에서 OpenClaw 멀티모델 라우팅을 검증하거나 Harness와 Claude Code Agent 차이를 비교하거나 API를 일괄 이전해 GUI로 테스트하려면 macOS GUI 세션이 유효합니다. Windows·Linux가 주력이고 Agent 권한 대화상자를 클릭하려 Mac을 사는 건 부담이고 SSH만으로는 시스템 대화상자를 못 다룹니다. VNCMac 원격 Mac을 시간 단위로 임대해 VNC로 DeepSeek V4를 연결하고 격리 환경에서 Agent 워크로드를 돌린 뒤 프로젝트 종료 시 중단하세요. Mac 임대 플랜과 SSH-VNC 가이드를 참고하세요. 관련: V4 GA 총정리, Kimi K3 오픈 웨이트.

출처: DeepSeek API 문서·changelog, 기술 보고서, Artificial Analysis(금융 언론 경유), 21세기경제보. 게시 전 요금·출시 상태 재확인. 수치는 2026년 8월 5일 기준.