当前位置:首页 > Deepseek最新资讯 > 正文内容

叫板OpenAI,DeepSeek-V3.1正式发布

4小时前Deepseek最新资讯18

  8月21日,DeepSeek 正式发布 V3.1版本,并将其称为“迈向 Agent 时代的*步”。与以往的大模型迭代不同,它*的特征是混合推理架构,一个模型同时支持思考模式与非思考模式。这意味着模型在保持性能稳定的同时,能够根据需求选择是快速给出答案,还是展开更长链路的推理。

  更重要的是,经过思维链压缩训练,新版模型在生成结果时的token数量减少了20%至50%(同前代模型DeepSeek-R1-0528相比),这不仅带来响应速度的提升,也直接降低了使用成本。

  配合128K的上下文扩展和FP8精度推理,V3.1在工程层面强化了吞吐效率与能耗表现,为大规模应用打下基础。

  除了推理效率上的改进,V3.1在智能体能力上的进化尤为关键。官方测试显示,在代码修复和命令行任务等编程智能体场景中,新模型展现出更强的执行力和稳定性,能够在真实环境中完成多轮迭代修正,避免“越改越乱”的问题。

  在复杂搜索任务上,V3.1则展现了更成熟的检索与整合能力,它可以规划搜索步骤、筛选证据并综合多源信息,在高难度的多学科题目测试中,性能已经远超前代模型。

  在商业与生态层面,DeepSeek 选择了“双轨”策略deepseek,一方面继续提供 API 服务,但将于9月6日起调整价格并取消夜间优惠;另一方面,V3.1的Base模型与后训练版本已在Hugging Face和魔搭同步开源。

  值得一提的是,在这一次的官方发布说明中,DeepSeek提到“V3.1使用了 UE8M0 FP8 Scale的参数精度”,更为通俗的说,它设置了一个适配于即将发布的新一代国产芯片的技术规范与设计标准。“建议有部署需求的用户仔细阅读新版说明文档。”而在此之前,国产芯片部署DeepSeek通常会有一定性能减弱,除非再做专门的软件适配。

  本次DeepSeek-V3.1的发布也似有与GPT5对垒的意味,都支持超长上下文,都有更强的复杂任务处理能力,基础模型调用更为灵活,成本更为弹性。原文出处:叫板OpenAI,DeepSeek-V3.1正式发布,感谢原作者,侵权必删!

标签: deepseek

“叫板OpenAI,DeepSeek-V3.1正式发布” 的相关文章

七夕心动预告!Cleer ARC 5 音弧为爱上色!

七夕心动预告!Cleer ARC 5 音弧为爱上色!

  七夕将至,空气中弥漫着甜蜜的气息,许多人都希望在这特别的日子里来表达专属的爱意。今年,Cleer ARC 5音弧开放式AI耳机携全新色彩惊艳登场,用“燃动红”与“幻彩银”两种极具张力的...

DeepSeek分析: 高速免费,新放假通知来了!

DeepSeek分析: 高速免费,新放假通知来了!

  中秋国庆长假安排出炉!这些新规影响上亿车主出行【核心提示】即将到来的2025年中秋国庆双节假期出现重大调整。最受关注的节假日高速免费政策继续实施,而江苏省推出的全国首个全免费救援服务,...

2025财富中国40位40岁以下商界精英榜发布:DeepSeek梁文锋排首位

2025财富中国40位40岁以下商界精英榜发布:DeepSeek梁文锋排首位

  DeepSeek创始人梁文锋(39岁)、宇树科技创始人王兴兴(35岁)、泡泡玛特创始人王宁(38岁)、Insta360创始人刘靖康(33岁)、赛力斯集团轮值总裁张正萍(36岁)...

DeepSeek母公司总监被查!套取上亿佣金

DeepSeek母公司总监被查!套取上亿佣金

  幻方量化,是今年在科技圈惊艳四座的DeepSeek母公司,它们的创始人都是梁文锋。成立仅十年,其便因市场总监的行为卷入亿元级风暴。   据报道,李橙曾任职于招商证券,...

QuestMobile:2025年6月DeepSeek月活降至1629.5万

QuestMobile:2025年6月DeepSeek月活降至1629.5万

  QuestMobile数据显示,其月活跃用户规模从2025年3月的1936.1万降至6月的1629.5万,下滑趋势明显。   而对5月流失用户的追踪揭示了他们的去向:...

“奋力打开改革发展新天地”——进一步全面深化改革不断向广度和深度进军

“奋力打开改革发展新天地”——进一步全面深化改革不断向广度和深度进军

  星火·AIGC底座,2024年10月,2024年7月,2024年8月召开的中心周全深化革新委员会第六次会议,宣示革新决心、擘画改改革局。开拓AIGC赋能视听家当成长新场景。孵化优质AI...