当前位置：首页 > Deepseek最新资讯 > 正文内容

核心模型被曝蒸馏DeepSeek？前女友一纸控诉，曝出欧版OpenAI塌房真相！

2个月前 (08-16)Deepseek最新资讯255

　　【新智元导读】曾被誉为「欧洲OpenAI」的Mistral AI，陷入「抄袭」丑闻！在分手小作文中，前员工爆料核心技术是蒸馏DeepSeek，却误导外界称为自主RL成果。

　　几天前就有人在X上爆料：Mistral的新模型是直接蒸馏自DeepSeek，而且基准测试结果还被歪曲了。

　　这个被视为欧洲版OpenAI「全村希望」的公司，地位就如同中国的DeepSeek一般，如今居然塌房了？

　　你早知道Mistral做事不讲道德：把DeepSeek蒸馏后当成自己的模型，使用OpenAI的数据，对外却误导称是RL在发挥作用，但它实际上只是DS3的产物，还歪曲基准测试结果。

　　你不仅明知这些，还积极参与其中。当我指出这些问题时，你没有承担任何责任，反而选择无视我、对我冷处理。

　　也就是说，这位Mistral离职的女员工，不仅在小作文中曝光了自己和前男友、Mistral同事的感情纠葛，还爆出Mistral套壳DeepSeek的丑闻。

　　在「小作文」里，这位Mistral前员工痛诉自己如何接连遭遇上司排挤、伴侣出轨、求职无望，还要靠抗抑郁药物试图让情感生活重回正轨。

　　其实早在今年6月，就有一位火眼金睛的AI行内人发现，Mistral Small 3.2写的东西，它怎么这么像DeepSeek呢！

　　为了比较Mistral-small-3.2和DeepSeek-v3之间的相似性，这位博主在模型的创意写作输出中，提取了跟人类基线相比最过度呈现的单词和n-gram词组。

　　肉眼可见，Mistral-small-3.2和DeepSeek-v3在谱系图中的位置非常接近，从而表明它们的特征是极其相似的。

　　比如DeepSeek-R1非常擅长在对话中保持角色的一致性，而Gemini Pro 2.5也是如此，简直惊人的相似。

　　而且蒸馏大模型也不简单，DeepSeek蒸馏自己的R1模型就不太成功。Paech本人也表示，其实蒸馏也不算什么大错，现在很多模型都是这么干的。

　　大模型会把自己的「经验」（比如语言模式、写作风格）以一种简单的方式传给小模型。小模型通过大量练习，逐渐学会了类似的表现，但用更少的计算资源。

　　说到头来，Mistral的问题不在于蒸馏DeepSeek，而在于把模型的进步归功于自家的RL方法，甚至蓄意改变基准测试。

　　在今年2月，才成立一年多的Mistral AI已经估值62亿美金，成为法国的骄傲，欧洲的骄傲。

　　2023年，这三位来自谷歌DeepMind、Meta的前员工希望打造一家遵循欧洲模式的AI公司——开源、高效、注重隐私。

　　在当时，当OpenAI斥资超1亿美金训练GPT-4时deepseek，Mistral仅用2200万美元就打造出了最具竞争力的AI模型。

　　甚至马克龙还信誓旦旦表示，法国未来几年将投资1090亿欧元用于建设AI，尽最大努力为包括Mistral在内的公司创造空间。

　　在成立仅仅七个月的时间里，Mistral就在两个主要「权重级别」上发布了SOTA开源大语言模型（mistral-7b 和 mixtral）。原文出处：核心模型被曝蒸馏DeepSeek？前女友一纸控诉，曝出欧版OpenAI塌房真相！，感谢原作者，侵权必删！

标签: deepseek

返回列表

　　除了几个很抽象的单刀我觉得抢点还可以射门有时候超神有时候抽象他有练好头球的条件但是意愿强不强不知道　　除了几个很抽象的单刀我觉得抢点还可以射门有时候超神...

　　9月29日晚间，深度求索公司发布了DeepSeek-V3.2-Exp模型deepseek，其宛如再次向国产芯片江湖投入一枚巨石。　　官方公告显示，新版本模型实验性地...

　　区块链周刊（Blockchain Weekly）是一家成立于2025年、总部位于香港的专业区块链与Web3媒体平台，具有国际期刊资质（ISSN 3104-5227），专注于行业深度研究...

　　DeepSeek作为一款现象级的AI工具，凭借强大的功能和广泛的应用场景，迅速在全网走红。它不仅可以帮助用户高效完成写作、数据分析等任务，还能在创意设计和商业决策中提供支持。然而，随着...

　　金融界8月25日消息，有投资者在互动平台向新疆交建提问：“deepseek大模型，公司在哪些方面部署？” 　　针对上述提问，新疆交建回应称：“尊敬的投资者，公司主要以...

　　9月5日，全球主流大模型之一Claude的开发商Anthropic公司发布公告宣称，“由于法律、监管和安全风险”，将立即停止向“中国控股公司”提供服务。　　根据相关...