博主:DeepSeek要当全球Agent底座 模型与框架双升级。8月13日凌晨,DeepSeek推出了V4 Pro正式版,并同步开源了Agent运行框架DeepSeek Harness。这次更新中,Agent能力提升了5倍,而GitHub上的星标一夜之间突破了5万。尽管没有发布会和倒计时,API文档里的版本号变更却在AI圈内引起了轰动。
作为长期关注企业数字化的人士,我看到的不仅是模型能力的提升,更是背后深层的趋势:随着AI模型能力和国际旗舰产品持平,以及Agent框架变成开源基础设施,企业构建AI应用的成本结构正在被彻底改写。在这个过程中,低代码平台不仅没有被淘汰,反而迎来了新的机会窗口。
关于数据方面,V4 Pro正式版在DeepSWE基准测试中的得分从预览版的12.8提高到了62.7,增幅达到390%。这意味着模型已经能够自主完成编码任务,甚至超过了Claude Opus 4.8的58.0分。值得注意的是,此次升级并未更换架构,而是通过优化后训练阶段的方法实现了显著提升。这表明现有模型参数规模远未达到极限,仅靠训练方法优化就能获得巨大收益。
横向对比显示,在10项Agent基准测试中,V4 Pro正式版在4项上超过Claude Opus 4.8,3项基本打平,3项落后。性能相近的情况下,价格却相差几十倍,Opus 4.8输出约25美元/百万token,而V4 Pro只需6元人民币/百万token。此外,DeepSeek还宣布将从8月17日起采用峰谷定价策略,闲时价格仅为高峰时段的一半。
开源的Harness框架则让Agent从“黑箱”变成了“乐高”。其核心设计理念是“一切皆插件”,允许开发者完全替换Agent的主循环。相比传统框架,Harness提供了更大的灵活性和可定制性,支持20多个模型提供商,开发者只需填入API Key即可切换。这套基于Cordis微内核的架构具备“时空可组合性”,并设计了完整的工具调用流水线,解决了Agent系统中最棘手的问题之一:出错时能准确知道模型当时看到了什么。
发表回复
要发表评论,您必须先登录。