llmfeed

DeepSeek-V4-Flash-0731 공식 출시, 에이전트 능력 강화

딥시크
  • DeepSeek-V4-Flash-0731이 미리보기를 대체하는 공식 출시 버전으로 공개됐다.
  • 에이전트 능력이 강화됐고 벤치마크에서 DeepSeek-V4-Pro를 능가하며, reasoning_effort는 low/high/max 세 단계를 지원한다.
모델DeepSeek-V4-Flash-0731
저장소deepseek-ai/DeepSeek-V4-Flash-0731
개방성오픈형
라이선스 MIT
  • DeepSeek-V4-Flash-0731은 미리보기 버전을 대체하는 DeepSeek-V4-Flash의 공식 출시 버전이며, 에이전트 능력이 대폭 향상되었다고 밝혔다.
  • 이 모델은 DeepSeek-V4-Flash-DSpark와 동일한 모델 구조를 가지고 있으며, 추측 디코딩 모듈이 함께 제공된다.
  • 회사는 DeepSeek-V4-Flash-0731이 훨씬 더 작은 활성화 파라미터 수에도 불구하고 벤치마크에서 DeepSeek-V4-Pro (Preview)를 능가하며, 사용 가능한 가장 강력한 독점 모델들과 전반적으로 경쟁력이 있다고 밝혔다.
  • 이번 출시에는 Jinja 형식의 챗 템플릿이 포함되어 있지 않다.
  • reasoning_effort 매개변수는 이제 low, high, max 세 가지 수준을 지원하며, 이는 모델이 답변하기 전에 얼마나 많은 숙고를 하는지를 제어한다.

원문