当前位置:首页 > Deepseek最新资讯 > 正文内容

报道:DeepSeek决定使用华为人工智能芯片训练部分模型

2个月前 (08-30)Deepseek最新资讯153

  观点网讯:8月29日,据媒体报道,DeepSeek已决定使用华为的人工智能芯片来训练其部分模型,反映其正在减少对英伟达芯片的依赖。

  DeepSeek方面称,本次升级包含以下主要变化:混合推理架构让一个模型同时支持思考模式与非思考模式;相比DeepSeek-R1-0528,DeepSeek-V3.1-Think能在更短时间内给出答案,让模型拥有更高的思考效率;通过Post-Training优化,让新模型有更强的Agent能力,在工具使用与智能体任务中的表现有较大提升。

  据悉,DeepSeek-V3.1采用了UE8MO FP8 Scale参数精度,该模型与UE8M0FP8动态范围大,提升稳定性与效率,适配华为昇腾等芯片deepseek。原文出处:报道:DeepSeek决定使用华为人工智能芯片训练部分模型,感谢原作者,侵权必删!

标签: deepseek

“报道:DeepSeek决定使用华为人工智能芯片训练部分模型” 的相关文章

美团大模型来了!开源“长猫”,性能追平DeepSeek V3.1,同样主打“算力

美团大模型来了!开源“长猫”,性能追平DeepSeek V3.1,同样主打“算力

  LongCat-Flash推理速度超过100词元/秒,每处理一百万输出词元的成本仅为0.7美元。该模型不仅在多个方面与DeepSeek V3.1、Qwen3等顶尖模型旗鼓相当,甚至在某...

青云首登 AI Ping,刷新 DeepSeek 吞吐性能榜首

青云首登 AI Ping,刷新 DeepSeek 吞吐性能榜首

  青云科技旗下 AI 算力云服务——基石智算CoresHub 近日加入 AI Ping 大模型服务性能评测,在 9 月 11 日至 9 月 18 日的连续评测中,所提供的DeepSeek...

《财富》:2025年中国科技50强华为DeepSeek入选

《财富》:2025年中国科技50强华为DeepSeek入选

  除上述三家公司,登上榜单的还有阿里巴巴、腾讯科技、比亚迪deepseek、字节跳动、宇树科技、大疆创新、联想等。   关于华为,该榜单评价称,华为是中国最具全球竞争力...

DeepSeek 缺席 WAIC 却成焦点?梁文锋的深度求索该何去何从

DeepSeek 缺席 WAIC 却成焦点?梁文锋的深度求索该何去何从

来源:大模型之家今年的世界人工智能大会(WAIC)现场有个挺有意思的现象:DeepSeek明明从未到场,却成了绕不开的“隐形主角”。这种“存在感”首先体现在技术对标上——阶跃星辰在大会前一天发布的 S...

DeepSeek 重磅出手!力推UE8M0 FP8标准,国产芯片要逆袭了?

DeepSeek 重磅出手!力推UE8M0 FP8标准,国产芯片要逆袭了?

  近日,深度求索宣布正式发布DeepSeek-V3.1。这个看似普普通通的版本更新,实际背后藏着不少惊喜。   最大的惊喜无疑是DeepSeek 官微在置顶留言里表示:...

哈佛团队研发HPV-DeepSeek,已启动更大规模临床验证

哈佛团队研发HPV-DeepSeek,已启动更大规模临床验证

  HPV-DeepSeek 是什么?乍一看,你可能觉得这是不是和中国的 DeepSeek 公司有什么关系?事实上,这是一群科学家于近期打造的一款液体活检检测方法,该方法可以在无症状个体出...