当前位置:首页 > Deepseek最新资讯 > 正文内容

被曝蒸馏DeepSeek还造假!欧版OpenAI塌方了

2个月前 (08-14)Deepseek最新资讯203

  Mistral最新模型疑似直接蒸馏自DeepSeek,却对外包装成RL成功案例,并刻意歪曲基准测试结果。

  说到Mistral,这家公司被誉为欧洲版OpenAI,是全球开源明星玩家之一,模型性能一直备受好评。

  结果半年过去,剧情反转:Mistral不仅没跑赢DeepSeek,还被曝“借”了人家的成果。

  就像我们开头提到的,推特博主Sam Peach通过分析模型输出中过度使用的词汇模式(Slop),发现了Mistral-small-3.2与DeepSeek-v3之间令人惊讶的高度相似性。

  这种相似性通常很难通过独立训练偶然出现,所以很可能就是蒸馏(distillation)的结果:

  他先统计了模型在创意写作(creativewriting)的输出中,比人类文本更常出现的词和n-gram(词组)。

  最后把这些高频特征进行层次聚类(hierarchicalclustering),生成了一张“相似性图”。

  通过比较相似性图中模型的远近位置,就可以发现Mistral-small-3.2和DeepSeek-v3在图中非常接近,这就表明了它们的输出模式高度相似。

  最新的爆料则进一步指明,Mistral模型和DeepSeek相似不是巧合,而是可能使用了蒸馏。

  离职员工说,Mistral这样做是在假装自家模型的强化学习有效,这不仅歪曲了基准测试结果,而且误导公众。

  而在上一轮融资中(2024年6月),Mistral完成了一轮由General Catalyst领投的6亿欧元(6.45亿美元)的融资,这使其估值上升至58亿欧元(62亿美元),排名全球第四(美国湾区外排名第一)。

  从公司成立以来,Mistral一直保持开源路线,今年开源的模型就包括轻量级模型Mistral Small和主打编程的Mistral Code等。

  相较于主流的大语言模型,主打开源、小快灵的Mistraldeepseek,在多语言处理和推理能力方面具备相当的竞争力,在大模型市场中占据着独特的地位。

  同时他们也推出了自家聊天机器人LeChat,对标ChatGPT,内置深度研究模式、原生多语言推理和高级图像编辑等功能。

  截至目前,Mistral官方还没有回应,就在昨天他们还发布了新模型Mistral Medium V3.1。原文出处:被曝蒸馏DeepSeek还造假!欧版OpenAI塌方了,感谢原作者,侵权必删!

标签: deepseek

“被曝蒸馏DeepSeek还造假!欧版OpenAI塌方了” 的相关文章

福建舰三型机弹射成功,军工行业再迎DeepSeek时刻!军工含量最高的航空航天E

福建舰三型机弹射成功,军工行业再迎DeepSeek时刻!军工含量最高的航空航天E

  福建舰三型机弹射成功,军工行业再迎DeepSeek时刻!军工含量最高的航空航天ETF天弘(159241)反弹两连阳,昨日“吸金”近4800万元   福建舰三型机弹射成...

热议!DeepSeek V3.1惊现神秘「极」字 Bug,模型故障了?

热议!DeepSeek V3.1惊现神秘「极」字 Bug,模型故障了?

  上周三,DeepSeek 开源了新的基础模型,但不是万众期待的 V4,而是 V3.1-Base,而更早时候,DeepSeek-V3.1 就已经上线了其网页、App 端和小程序。...

DeepSeek-V3.1发布:国产算力生态跃迁新纪元

DeepSeek-V3.1发布:国产算力生态跃迁新纪元

  DeepSeek最新发布的V3.1大模型,通过自研的UE8M0 FP8精度标准,首次实现了从算法架构到硬件适配的全栈国产化协同。该技术通过动态调整浮点数的尾数与指数位分配,在国产芯片制...

国内外AI大厂重押,初创梭哈,谁能凭记忆成为下一个DeepSeek?

国内外AI大厂重押,初创梭哈,谁能凭记忆成为下一个DeepSeek?

  如果时间往前推半年或四五个月,业界对于这一问题可能都是疑惑、不解:彼时 DeepSeek 将大模型推理能力推至高潮引起的余波仍在蔓延,Manus 在全球范围内开启通用 AI Agent...

DeepSeek V3.1 终极版拆解:“人类最后测试”表现提升36.5%,或为

DeepSeek V3.1 终极版拆解:“人类最后测试”表现提升36.5%,或为

  据官方介绍,此次更新是基于原有模型能力,着重改进了语言一致性问题deepseek,并进一步优化了Code Agent与Search Agent的表现。   值得一提的...

DeepSeek炒股,坑惨牛市股民

DeepSeek炒股,坑惨牛市股民

  李超混迹股市十年,在社交媒体上以“钞哥”自称,常分享炒股心得。年初DeepSeek爆火后,李超对AI炒股跃跃欲试。他认为AI的   5月初,李超发现AI给出的加减仓策...