DeepSeek-V4-Flash正式版上线 Agent能力显著提升

  DeepSeek-V4-Flash正式版API已上线公测,而DeepSeek-V4-Pro正式版预计在8月初推出。这次更新距DeepSeek V4预览版发布已有三个月。

  DeepSeek-V4-Flash正式版采用MoE架构,总参数规模达到284B(激活13B),支持最长100万token上下文,并能切换非思考与思考模式。其模型结构和尺寸与预览版一致,但经过了重新训练。

  

  DeepSeek V4预览版已针对Claude Code、OpenClaw、OpenCode、CodeBuddy等主流Agent产品进行了适配和优化。Flash正式版还支持OpenAI的Responses API格式,并针对性适配Codex,开发者无需修改Base URL即可切换模型。

  

  根据DeepSeek API文档,DeepSeek-V4-Flash正式版的Agent能力显著增强,基准测试成绩远超4月发布的DeepSeek-V4-Pro-Preview。具体成绩包括:Terminal Bench 2.1: 82.7, NL2Repo: 54.2, Cybergym: 76.7, DeepSWE: 54.4, Toolathlon verified: 70.3, Agent Last Exam: 25.2, Automation Bench (Public): 25.1, DSBench-FullStack: 68.7, DSBench-Hard: 59.6。

  

  4月24日,DeepSeek发布了并开源了DeepSeek-V4系列预览版本。其中,DeepSeek-V4-Pro主打高性能,对标闭源旗舰模型;而DeepSeek-V4-Flash则通过缩小参数规模和激活规模来降低延迟和成本。

  

评论

发表回复