모델 출시
DeepSeek-V4-Flash-0731 공식 출시, 에이전트 능력 강화
- DeepSeek-V4-Flash-0731이 미리보기를 대체하는 공식 출시 버전으로 공개됐다.
- 에이전트 능력이 강화됐고 벤치마크에서 DeepSeek-V4-Pro를 능가하며, reasoning_effort는 low/high/max 세 단계를 지원한다.
| 모델 | DeepSeek-V4-Flash-0731 |
|---|---|
| 저장소 | deepseek-ai/DeepSeek-V4-Flash-0731 |
| 개방성 | 오픈형 |
| 라이선스 | MIT |
- DeepSeek-V4-Flash-0731은 미리보기 버전을 대체하는 DeepSeek-V4-Flash의 공식 출시 버전이며, 에이전트 능력이 대폭 향상되었다고 밝혔다.
- 이 모델은 DeepSeek-V4-Flash-DSpark와 동일한 모델 구조를 가지고 있으며, 추측 디코딩 모듈이 함께 제공된다.
- 회사는 DeepSeek-V4-Flash-0731이 훨씬 더 작은 활성화 파라미터 수에도 불구하고 벤치마크에서 DeepSeek-V4-Pro (Preview)를 능가하며, 사용 가능한 가장 강력한 독점 모델들과 전반적으로 경쟁력이 있다고 밝혔다.
- 이번 출시에는 Jinja 형식의 챗 템플릿이 포함되어 있지 않다.
- reasoning_effort 매개변수는 이제 low, high, max 세 가지 수준을 지원하며, 이는 모델이 답변하기 전에 얼마나 많은 숙고를 하는지를 제어한다.