当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324

1个月前 (03-25)Deepseek最新资讯159

3月24日晚,DeepSeek发布了模型更新——DeepSeek-V3-0324。本次更新为DeepSeek V3模型的版本更新,并非市场此前一直期待的DeepSeek-V4或R2。目前,其开源版本已上线Hugging Face。据悉,其开源版本模型体积为6850亿参数。

同日,DeepSeek在其官方交流群宣布称,DeepSeek V3模型已完成小版本升级,欢迎前往官方网页、App、小程序试用体验(关闭深度思考),API接口和使用方式保持不变。


从网友反馈的实测效果来看,V3编码能力已经接近 Claude3.7,数学能力也有提升,能像推理模型一样解题。

此前于2024年12月发布的DeepSeek-V3模型曾以“557.6万美金比肩Claude 3.5效果”的高性价比著称,其多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等其他开源模型,并在性能上和世界顶尖的闭源模型GPT-4o以及Claude-3.5-Sonnet不分伯仲。但截至目前,还没有任何关于新版 DeepSeek-V3的能力基准测试榜单出现。


其后,DeepSeek于2025年1月发布了性能比肩OpenAI o1正式版的DeepSeek-R1模型,该模型在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的情况下,极大提升了模型推理能力。

2025年2月25日,市场上也曾出现DeepSeek-R2模型的发布时间或将提前的消息。路透社称,DeepSeek正在加快推出DeepSeek-R1模型的后续产品DeepSeek-R2。据悉,DeepSeek-R2原计划在5月初发布,但公司现在希望尽早推出。

综合/上海证券报、第一财经微信

来源:经济日报


“DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324” 的相关文章

有问题AI来回答 快速之外更需精准 四川多地政务服务接入DeepSeek大模型

有问题AI来回答 快速之外更需精准 四川多地政务服务接入DeepSeek大模型

“办理退休相关手续,要准备哪些材料?”3月12日,记者走进绵阳市政务服务中心,一楼大厅内一块电子屏上的数字人“绵宝”吸引不少办事群众驻足。一名群众提问后,接入DeepSeek大模型不久的“绵宝”,思索...

微信回应“接入DeepSeek”:不会使用用户朋友圈、聊天记录

微信回应“接入DeepSeek”:不会使用用户朋友圈、聊天记录

日前,微信宣布接入DeepSeek-R1模型,目前为灰度测试阶段,部分用户在微信搜索框选择AI搜索,可使用DeepSeek-R1的深度思考功能。消息一出,引发网友热议,随后微信发文回应几个疑问:微信A...

梁文锋的秘密武器:DeepSeek R2或5月问世,成本仅GPT-4o的2.7%

梁文锋的秘密武器:DeepSeek R2或5月问世,成本仅GPT-4o的2.7%

五月将至,中美科技巨头或将迎来新一轮巅峰对决。先是在4月中旬,OpenAI一口气发布了GPT-4.1 o3、o4 mini系列模型;谷歌则拿出了Gemini 2.5 Flash Preview,一个混...

DeepSeek如何嵌入Excel和Wps?一键完成

DeepSeek如何嵌入Excel和Wps?一键完成

昨天兰色的表格助手正式开放,强大的功能让很多同学直呼好用。想让Excel帮你做什么,只需要说句话即可。合并表格。三个列不同的表格10秒可以合并成一个表格很复杂的地址拆分,对于表格助手也是小菜一碟数据分...

华西证券:DeepSeek有望开启AI产业的“安卓时刻”

华西证券:DeepSeek有望开启AI产业的“安卓时刻”

华西证券研报表示,DeepSeek的开源是真正通往AI下游应用生态繁荣之路:部署大模型成本大幅降低,下游行业已经全面铺开,如金融、政府、医疗等领域行业私有化部署如火如荼;大厂开启开源部署之路,腾讯、阿...

deepseek怎么样?与豆包相比呢?

deepseek怎么样?与豆包相比呢?

我认为deepseek和豆包两个AI软件没有可比性,主要是定位不同,有各自的特点1️⃣比如deepseek偏推理性,能够把自主思考和推理的过程展示出来,你会发现其实自己有时候陷在自有思维里面 dee...