딥시크 V4 플래시 0731 공개 베타 전환, 에이전트 성능 대폭 강화
딥시크가 7월 31일, V4 플래시(0731) 업데이트를 공개하며 프리뷰에서 공개 베타로 전환했습니다.
## 핵심 변화
0731 버전은 기존 프리뷰와 동일한 아키텍처와 모델 규모(약 300B 파라미터)를 유지하면서, 에이전트 워크로드 성능을 대폭 끌어올린 것이 특징입니다. 벤치마크 결과는 전 분야에서 기존 V4 프로 프리뷰를 크게 앞섰습니다.
주요 벤치마크 성적:
- Terminal Bench 2.1: 82.7
- NL2Repo: 54.2
- Cybergym: 76.7
- DeepSWE: 54.4
- Toolathlon(verified): 70.3
- DSBench-FullStack(자체 풀스택 개발 테스트): 68.7
- DSBench-Hard(코딩 에이전트 난제): 59.6
## 에이전트 시대를 겨냥한 설계
V4 플래시 0731은 Responses API 포맷을 네이티브로 지원하며, 코딩 에이전트 도구(Codex 등)에 특화되어 있습니다. 터미널 조작, 저장소 탐색, 사이버 보안 태스크, 풀스택 개발 등 실무 에이전트 시나리오에서 두각을 나타냅니다.
## 압도적인 가성비
해외 커뮤니티에서는 여러 코딩 벤치마크에서 GPT-5.6 Luna를 능가하면서도 훨씬 저렴한 비용으로 운영할 수 있다는 평가가 나오고 있습니다. 몇 달러로 수백만 토큰을 처리할 수 있는 수준의 가격 경쟁력은 에이전트 자동화 워크플로우를 운영하는 개발자에게 특히 매력적입니다.
## 스펙 요약
- 컨텍스트 윈도우: 1M 토큰
- 최대 출력: 384K 토큰
- 전체 파라미터 약 284B(활성 13B), 하이브리드 어텐션 기반의 효율적 구조
정식 버전인 딥시크 V4 프로의 출시도 임박한 것으로 알려졌습니다. 에이전트 코딩과 AI 자동화에 관심이 있다면 이번 0731 업데이트를 눈여겨볼 만합니다.