小红书大模型IMO满分夺金 创新解法惊艳全场

  小红书大模型IMO满分夺金 创新解法惊艳全场!小红书在国际数学奥林匹克竞赛(IMO)2026中取得了令人瞩目的成绩。其大模型dots-note-3.0在比赛中六道题全部答对,以满分成绩获得金牌。这是中国大模型首次获得IMO官方金牌认证,也是继谷歌Gemini模型之后全球第二个达到该成绩的大模型。谷歌当年仅答对了5/6的题目。

  

  小红书大模型dots-note-3.0的表现让人眼前一亮。它仅用自然语言完成了从读题、解析到写证明的全过程,并且在部分题目上提出了非常规解法。双CMO金牌得主刘涵祚评价说,这种解法结构紧凑、逻辑自然,在IMO解答中也属于较为简洁优雅的一类。另一位CMO金牌得主汪千桐也认为,小红书大模型的解答非常漂亮且优雅,直接攻克了题目最难的部分。

  IMO是一项国际性的数学竞赛,每年吸引世界各地最顶尖的中学生参加。比赛分两天进行,每天4.5小时完成3道题,总计6道题,每题7分,满分42分。参赛者必须写出完整的证明过程才能得分。这对大模型来说极具挑战性,但也是展示其能力的最佳途径。

  谷歌的Gemini模型在2024年首次挑战IMO时只拿到28分的银牌水平,第二年改进后才以自然语言端到端完成证明,获得了金牌。相比之下,小红书大模型dots-note-3.0不仅拿到了满分,还使用了创新的解题方法。这表明其具备强大的推理能力和通用性。

  IMO的赛题由专家命制并严格保密,确保模型无法提前训练。因此,参与IMO测评可以真实反映模型的能力。小红书大模型dots-note-3.0在本届IMO中的表现不仅证明了其推理系统的稳定性,还展示了其可迁移的通用推理能力。此外,模型在第三题中的创新思维尤为突出,通过归纳法抓住了问题的本质结构。

  今年IMO的金牌线分,这意味着这一届的金牌更加难拿。小红书大模型dots-note-3.0能够拿到满分,显示了其在高难度未知问题上的深度推理能力。这次技术亮相让外界重新认识了小红书在基础模型领域的实力,使其成为值得关注的新玩家。据悉,该模型即将开源。小红书大模型IMO满分夺金 创新解法惊艳全场!

评论

发表回复