当前位置:首页 > DeepSeek技术交流 > 正文内容

文心大模型X1对上最新版DeepSeek V3,表现谁更好?

4个月前 (03-27)DeepSeek技术交流303

3月26日,在多个公开数据集测评中,百度最新发布的文心大模型X1,在数学、代码、推理等能力上表现优异,超越升级后的DeepSeek-V3-0324。

在数学场景中,GSM8K数据集测试后结果显示,文心X1得分95.6,DeepSeek-V3-0324得分93.6;代码生成层面,HumanEval数据集测试后结果显示,文心X1得分90.9,DeepSeek-V3-0324得分86.6;在知识推理层面,C-Eval数据集测试后结果显示,文心大模型X1得分88.6,DeepSeek-V3-0324得分85.1。

近日,DeepSeek官方宣布V3模型完成小版本升级的消息,包括推理、前端开发、中文写作、中文搜索几个方面的能力优化。

而在不久前,百度正式发布文心大模型X1,具备更强的理解、规划、反思、进化能力。文心X1由百度的慢思考技术发展而来。作为能力更全面的深度思考模型,兼备准确、创意和文采,在中文知识问答、文学创作、文稿写作、日常对话、逻辑推理、复杂计算及工具调用等方面表现尤为出色。

据悉,文心大模型X1即将上线千帆大模型平台,API调用价格为DeepSeek-R1调用价格的50%。


“文心大模型X1对上最新版DeepSeek V3,表现谁更好?” 的相关文章

三大领域落地应用 陆金所控股完成DeepSeek接入

三大领域落地应用 陆金所控股完成DeepSeek接入

DeepSeek凭借其开源、低成本、高性能等优势,掀起人工智能领域的新一轮热潮。作为平安集团金融科技生态圈的重要组成部分,陆金所控股(LU.US;6623.HK)近日已完成DeepSeek的接入。通过...

全市首个!大兴人才服务平台用上DeepSeek大模型

全市首个!大兴人才服务平台用上DeepSeek大模型

4月14日,记者从北京电信获悉,公司在大兴区上线了全市首个基于DeepSeek大模型的人工智能人才服务AI助手,开创“AI+政务”服务新模式。只需输入关键词,用户就能与AI助手展开对话,找政策、办手续...

贵阳贵安DeepSeek部署应用新闻发布会举行

贵阳贵安DeepSeek部署应用新闻发布会举行

3月7日,贵阳贵安DeepSeek部署应用新闻发布会举行,全面介绍当前贵阳贵安推进DeepSeek大模型的本地化部署与应用情况。作为全国首个国家大数据综合试验区核心区,自DeepSeek发布后,贵阳贵...

宿迁移动助力市城管局开展DeepSeek启动仪式暨知识讲座

宿迁移动助力市城管局开展DeepSeek启动仪式暨知识讲座

为深入贯彻落实市委市政府关于智慧城市建设的决策部署,推动人工智能技术在城市管理领域的创新应用,近日,宿迁移动助力市城管局开展DeepSeek启动仪式暨知识讲座。宿迁市城管局党组书记、局长,市二级巡视员...

探索跳跃式思维链:DeepSeek创造力垫底,Qwen系列接近人类顶尖水平

探索跳跃式思维链:DeepSeek创造力垫底,Qwen系列接近人类顶尖水平

在大语言模型 (LLM) 的研究中,与以 Chain-of-Thought 为代表的逻辑思维能力相比,LLM 中同等重要的 Leap-of-Thought 能力,也称为创造力,目前的讨论和分析仍然较少...

航天宏图:“天权”大模型产品矩阵均已全面接入DeepSeek大模型

航天宏图:“天权”大模型产品矩阵均已全面接入DeepSeek大模型

每经AI快讯,有投资者在投资者互动平台提问:董秘您好!请问贵公司是否已经部署了DeepSeek?如果已经部署了,请问主要应用于哪些具体的业务?公司接入DeepSeek有哪些成本、收益方面的考量?如果公...