DeepSeek R1推理AI模型更新版或涉Google Gemini数据训练

DeepSeek最新AI模型R1在数学和编程基准测试中表现优异,其训练数据来源成谜。有开发者发现其与Google Gemini2.5Pro存在相似之处,引发关于数据来源的讨论。

11效率工具AI模型DeepSeek数据训练Google Gemini

DeepSeek R1推理AI模型更新版解析

DeepSeek近期发布了其R1推理AI模型的新版本,该模型在多项基准测试中展现出卓越的性能。然而,关于其训练数据的具体来源,DeepSeek并未公开透露,这引起了业界的广泛关注。

有开发者指出,DeepSeek的R1-0528模型在用词和表达方式上与Google的Gemini2.5Pro有诸多相似之处。尽管这一发现并不能直接证明DeepSeek使用了Google的数据,但仍然引发了关于数据来源的讨论。

去年12月,DeepSeek因V3模型频繁将自己标识为OpenAI的ch*tg*t而受到指责,这暗示该模型可能通过ch*tg*t的聊天记录进行训练。今年早些时候,OpenAI透露发现了DeepSeek与“数据蒸馏”技术相关的证据。

DeepSeek可能使用了Google Gemini数据训练新 AI 模型插图

尽管“数据蒸馏”技术在AI界并不罕见,但OpenAI明确禁止用户使用其模型输出构建竞争产品。同时,由于开放网络中充斥着大量低质量内容,AI模型在训练中可能会错误地模仿彼此的用词和措辞,使得深度剖析训练数据源变得更加复杂。

人工智能专家Nathan Lambert认为,DeepSeek使用Google Gemini的数据进行训练并非不可能。他提到,DeepSeek拥有充足的资金,能够利用市面上最佳的API模型生成合成数据。同时,为了防止数据被提炼,AI公司们也在不断加强安全措施。