当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek-V3模型悄然更新,编程数学能力更强了

1个月前 (03-25)DeepSeek技术交流106

交汇点讯 3月24日晚间,deepseek 悄然发布一款新的大语言模型——deepseek-v3-0324。这款 641gb 大小的模型在开源平台hugging face上亮相,几乎未作任何宣传。



本次更新为deepseek v3模型的版本小幅更新,并非市场此前一直期待的deepseek-v4或r2。deepseek 在其官方交流群宣布称,“deepseek-v3 模型已完成小版本升级,欢迎前往官方网页、app、小程序试用体验(关闭深度思考),api 接口和使用方式保持不变。”

deepseek-v3和deepseek-r1都是幻方量化旗下ai公司深度求索(deepseek)推出的两款高性能大语言模型,分别在2024年12月26日和2025年1月20日发布。尽管两款模型均基于混合专家(moe)架构,但在设计目标、训练方法、应用场景和性能表现上存在差异。

其中,deepseek-v3为通用型模型,专注于自然语言处理、知识问答、内容创作等通用任务,目标是实现高性能与低成本的平衡,适用于智能客服、个性化推荐系统等场景。deepseek-r1为推理专用模型,专为数学、代码生成和复杂逻辑推理任务设计,通过大规模强化学习提升推理能力,对标open ai o1系列。

此次发布值得关注的是,该模型采用mit许可(允许模型蒸馏、商用),并且有报道称它可以直接在消费者级“硬件”上运行,尤其是配备m3 ultra芯片的苹果mac studio。

有海外测试者称,相比于前一版本,deepseek-v3-0324在各项指标上有了显著提升。人工智能xeophon在社交媒体上发帖宣称:“我在内部基准测试平台上测试了新版deepseek v3,在所有测试中,它在各项指标上都有巨大的跃升。它现在是最好的非推理模型,把claude sonnet 3.5拉下王座。”

claude sonnet 3.5由anthropic公司发布,是业内公认顶尖的商业人工智能系统之一。而且与需要订阅的sonnet模型不同,deepseek-v3-0324的权重文件供任何人免费下载使用。

还有国内博主测试发现,新版deepseek-v3在网站开发能力、ui设计方面展现出巨大的进步。测试者在输入“设计一个美观的个人博客网站,带有科技感,直接开发成可用网页”的提示词之后,新版deepseek-v3在2分钟的时间内交付了一个总计400多行代码、设计精良的网站。

据其介绍,网站采用了粒子背景动画、赛博朋克ui(霓虹光效、悬浮动画和科技感配色)等设计元素,标题使用打字机动画,按钮具备光波扩散效果。甚至,这一网站还使用了响应式设计,能自动适配手机和桌面设备。

有用户按照下面的提示词,同时对新版 v3 与 r1 下达任务,实际产出的效果已经出现巨大差异——

创建一个包含 css 和 javascript 的单个 html 文件,以生成一个动画天气卡片。卡片应通过不同的动画直观地表示以下天气条件:

风:(例如,移动的云朵、摇曳的树木或风线);雨:(例如,落下的雨滴、形成的水坑);晴:(例如,闪耀的光线、明亮的背景);雪:(例如,落下的雪花、积雪)并排显示所有天气卡片。卡片应具有深色背景。在此单个文件中提供所有 html、css 和 javascript 代码。javascript 应包含一种在不同天气条件之间切换的方法(例如,一个函数或一组按钮),以演示每种天气的动画。



左侧是 deepseek 新版 v3 模型的生成结果,右侧为 r1 的生成结果 deepseek 没有同时公开表示 r2 或者 v4 模型会在何时发布,但不少用户在体验过新版 v3 后,都觉得似乎 r2 的到来,也已经不远了。

有网友发现,deepseek-v3-0324模型的交流风格发生了明显变化。此前的模型因对话式、拟人化的语气备受好评,但这一版本呈现出更加正式、技术导向的风格。

有海外科技媒体评价,这种明显的风格变化似乎是deepseek工程师的有意设计。转向更精准、分析式的交流风格,表明该公司正将模型重新定位至专业和技术应用,而非休闲对话。

新华日报·交汇点记者 杨易臻 综合整理自网络


“DeepSeek-V3模型悄然更新,编程数学能力更强了” 的相关文章

中国石油大学(华东)“i石大”版满血DeepSeek正式上线

中国石油大学(华东)“i石大”版满血DeepSeek正式上线

2月26日,中国石油大学(华东)宣布,属于石大人自己的“i石大”版满血DeepSeek大模型——AI智能助手正式上线。石大师生可通过学校微信企业号或直接点击PC端链接进入使用,随时随地体验DeepSe...

华阳集团:DeepSeek部署有效提升研发效率和生产力

华阳集团:DeepSeek部署有效提升研发效率和生产力

中证报中证网讯(王珞)2月18日,华阳集团微信公众号发文表示,公司自研的软件开放平台已接入DeepSeek的API接口,公司的研发系统已初步完成了对DeepSeek的部署,有效提升了研发效率和生产力。...

接入DeepSeek能干什么?如何发挥大模型效力?专业人士分享秘籍↓

接入DeepSeek能干什么?如何发挥大模型效力?专业人士分享秘籍↓

 央视网消息:近期,DeepSeek访问使用量急速上升,已经成为目前最快突破3000万日活跃用户量的应用程序。记者从工业和信息化部了解到,三家基础电信企业已经全面接入国产开源大模型DeepSeek。接...

保山市人民医院完成DeepSeek本地化部署-DeepSeek医疗智能操作系统“AI+医疗”为患者提供更精准、更高效的诊疗服务,进一步推动医院智慧化建设迈向新高度

保山市人民医院完成DeepSeek本地化部署-DeepSeek医疗智能操作系统“AI+医疗”为患者提供更精准、更高效的诊疗服务,进一步推动医院智慧化建设迈向新高度

       应用中的DeepSeek医疗智能操作系统。  近日,保山市人民医院紧跟国内人工智能趋势,正式完成DeepSeek医疗智能系统的本地化部署,这一举措...

编辑谈DeepSeek丨数智化浪潮中编辑的“智能觉醒”与转型

编辑谈DeepSeek丨数智化浪潮中编辑的“智能觉醒”与转型

  当前,数字洪流与人工智能技术正重构着当代出版业的面貌,出版人也正站在千年出版文明与智能革命的交汇点上。山东出版(601019)集团提出的“数智五化”战略,正如一把打开未来之门的钥匙,在内容生产及形...

全国首创!重庆“产业大脑”深度融合DeepSeek大模型

全国首创!重庆“产业大脑”深度融合DeepSeek大模型

在人工智能技术加速与实体经济深度融合的背景下,重庆市创新打造的“产业大脑”近日取得突破性进展。2月23日,上游新闻记者从市经济信息委获悉,“产业大脑”通过深度集成国产大模型DeepSeek,正逐渐构建...