中国2家AI公司连发新模型赶超OpenAI 性能测试超过OpenAI的o1正式版模型 “3 在一个领先模型中有来自中国的两个实验室?在美国著名的技术社区Hacker,中国的追求速度真是令人惊叹。 News,一个开发者是如此的感慨。“中国创业公司已经表现出追赶美国人工智能模型的迹象,他们的追求速度比很多业内人士预期的要快。”在12月24日的一份外媒报道中,上述结论也通过对比中美AI推理模型的表现和R&D速度得出结论。
一月二十日,国内两家备受关注的人工智能大模型初创公司月之暗面(Kimi)和深度追寻(DeepSeek)最新的模型几乎同时发布,在功能测试中都超过了OpenAI的o1正式版本。中国2家AI公司连发新模型赶超OpenAI 性能测试超过OpenAI的o1正式版模型
在月亮暗面发布的k1.5多模式思维模式中,多模式思维模式完成了SOTA等级多模式推理和通用推理能力。(注:SOTA通常是指某一方面最先进的技术或方法)short-在CoT模式中,Kimi k1.5在全球范围内,SOTA模型GPT-4o和Claude显著超越了SOTA模型GPT-4o和Claude的数学、代码、视觉多模态和通用性, 3.5 领先550%的Sonnet水平;但在long-在CoT模式中,Kimi k1.5的数学、代码、多模态推理能力,也能达到长期思考OpenAISOTA模型。 O1官方版本水平。中国2家AI公司连发新模型赶超OpenAI 性能测试超过OpenAI的o1正式版模型
然而,在后训练阶段,深度追求发布的DeepSeek-R1大规模使用强化学习技术,大大提高了模型推理能力,只标注数据很少。在数学、代码、自然语言推理等任务中,性能堪比OpenAI o1正式版。
在不到两个月的时间里,两个国产推理模型已经完成了OpenAI。与OpenAI不同,OpenAI正式版本的对比甚至超过了OpenAI,两家中国企业都公布了他们的原则和技术报告:Kimi k1.5发布原创技术long2short,高效思维链原生多模,DeepSeek R1继续推高性价比。报告一出,就吸引了大量海外从业者的解读和关注。
范麟熙,英伟达高级科学家。(Jim Fan)“两篇论文披露了大量的技术细节,并且惊人地得出了类似的结论,假期阅读令人鼓舞。”中国2家AI公司连发新模型赶超OpenAI 性能测试超过OpenAI的o1正式版模型
保罗·库弗特,Answera公司的创始人(Paul Couvert)还有一种感觉,“两个中国o1同日发布,中国AI追求速度越来越快。”
中央民族大学教授郭全中说:“中国AI公司以前基本上都在摸Open。 AI的石头过河,但从K1.5等国产大模型开始,以硅谷为核心的模式已经悄然改变。国内大模型的突破不仅在于技术指标的提高,也在于中国AI技术正在走向自主创新的新阶段。我们期待看到更多的中国公司在全球AI舞台上展示自己的实力,推动人工智能技术走向更高的水平。"
猜你喜欢
韩国为何规定将“死子”放入棋盒盖 世界围棋规则不统一导致类似争议时有发生
日本老年女性犯罪现象日益严重 日本社会老龄化现以及孤独的问题普遍存在
2025春运细微处见暖意 众多车站站台设置安全绳

