当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek 又上新!DeepGEMM 发布,有哪些突破点值得一看?

2个月前 (02-26)DeepSeek技术交流145

一开始,我还以为 DeepSeek 会走传统路线,比如大厂常见的蒸馏技术,搞个小参数的 Flash 模型。毕竟这种方法能有效降低计算需求,但缺点也很明显,就是小模型再怎么优化,和大模型比起来,性能还是会有损失 结果 DeepSeek 完全没按套路出牌,它不是去压缩模型,而是换了个角度,直接假设未来算力足够,然后想办法更高效地用好现有显卡架构。换句话说,不是缩小参数规模,而是在同等规模下优化计算方式,让计算更具性价比 这种思路比纯工程优化要“硬核”得多。一般来说,搞小模型是比较务实的工程方案,但 DeepGEMM 这种技术驱动的做法更有延展性。它不仅和小模型方法兼容,而且即使以后显卡更强、模型规模更大,这套技术依然能继续用,不会过时

“DeepSeek 又上新!DeepGEMM 发布,有哪些突破点值得一看?” 的相关文章

“效率神器”已接入!赣州市国投集团“争先”让DeepSeek赋能发展

“效率神器”已接入!赣州市国投集团“争先”让DeepSeek赋能发展

  大江网/大江新闻客户端讯 (通讯员 陈肖屹、张声宁、魏玲娇)DeepSeek凭借其先进的模型设计、训练算法和开源生态,引发全球人工智能领域关注,并快速进入人们的日常生活,在各行各业中发挥...

神州鲲泰问学一体机DeepSeek版发布 垂直场景深度赋能,破局企业AI落地难题

神州鲲泰问学一体机DeepSeek版发布 垂直场景深度赋能,破局企业AI落地难题

2025年2月28日,神州鲲泰问学一体机DeepSeek版在第三届北京人工智能产业创新发展大会上正式发布,以创新的技术能力和行业洞察力,为企业提供了高性价比的智能化升级方案。通过精准解决部署痛点,并提...

DeepSeek专题培训会助力民营企业把握AI技术革新机遇

DeepSeek专题培训会助力民营企业把握AI技术革新机遇

为深入贯彻落实党的二十届三中全会精神,促进数字经济与实体经济深度融合,助力民营企业把握人工智能技术革新机遇,近日,怀来县工商联举办以“把握AI浪潮,赋能企业创新,共启智慧未来”为主题的DeepSeek...

DeepSeek 的“修炼”之路,还要闯几关?

DeepSeek 的“修炼”之路,还要闯几关?

DeepSeek 的“修炼”之路,还要闯几关?半月谈记者 张漫子以小博大、逆袭吊打,曾是修仙爽文、微短剧里让人上头却略显荒诞的剧情,而今,DeepSeek(深度求索)让它在真实世界里发生了。火爆全球超...

为什么作家阿来不用DeepSeek

为什么作家阿来不用DeepSeek

日前,作家、四川省作家协会主席阿来亮相复旦大学,在“人是出发点,也是目的地”主题研讨会间隙接受文汇报记者专访。原标题:《为什么作家阿来不用DeepSeek》...

“AI+”行动提速!中国人寿持续布局DeepSeek

“AI+”行动提速!中国人寿持续布局DeepSeek

人工智能是新一轮科技革命和产业变革的重要驱动力,近期DeepSeek强势“出圈”,在业界引发广泛关注,也成为全国两会热词。中国人寿集团推动各成员单位接入DeepSeek人工智能平台,在智能协同、智能客...