DeepSeek:是否存在知识产权问题?

deepseek

by Fabio Giacopello

2025年1月20日。当美国庆祝新总统唐纳德·特朗普就职时,来自中国的AI初创公司DeepSeek推出了其R1高级推理模型(AI),直接与OpenAI的ChatGPT模型竞争。自发布以来,DeepSeek的规模迅速在各大应用商店攀升,成为美国最受下载的应用。不仅如此,其发布还引发了美国股市的剧烈震荡,全球商业和科技界纷纷讨论这一现象。

在进入知识产权话题之前,让我们先了解DeepSeek是什么以及为何它如此引人注目。

DeepSeek是一家由40岁的中国科技企业家梁文锋创办的AI初创公司。梁文锋同时也是一家名为“High-Flyer”的中国对冲基金的合伙人,该基金活跃于利用AI进行上市股票量化高速交易领域。DeepSeek的首个模型于2023年11月2日发布,随后其最新发布的两款产品——V3通用大型语言模型(LLM)和R1“推理”模型——赢得了全球媒体的广泛关注。

DeepSeek的发布之所以令人惊讶,原因有以下几点:

突破性低成本高性能
DeepSeek的新AI模型的表现可与西方既有业内领先者相媲美甚至超越,但其构建成本却仅为这些行业领先模型的一小部分。据称,该公司在构建模型时投入的成本远低于OpenAI等行业领先者,并且似乎几乎不依赖于先进的芯片。这一效率上的巨大飞跃颠覆了人们长期以来认为高质量AI必定需要巨额投资的固有认知。

市场颠覆
发布时机与更广泛的市场事件巧合,令科技行业震惊。投资者的反应异常强烈——例如,芯片制造巨头Nvidia在发布当天市值蒸发近6000亿美元,创下美国历史上单日最大跌幅。这迫使市场重新评估在DeepSeek这种成本效益极高的解决方案面前,高价AI硬件在未来的需求。

开源与创新模型
DeepSeek开源了其模型,并公开了技术报告进行说明。此外,它在训练过程中融合了多项优化措施,主要包括:

  1. 数据处理改进
        DeepSeek V3采用了一种名为“多头潜在注意力(MLA)”的技术,这是一种非常高效的数据处理工具,可在推理阶段处理大量数据,从而与同类技术相比仅使用一半内存。

  2. 模型架构改进
        DeepSeek V3引入了一种独特的专家混合(Mixture-of-Experts, MoE)模型架构,这使得在处理任一给定的token时,只需计算模型的一部分,从而大大减少每次前向传播所需的计算量。

  3. 模型训练改进
        DeepSeek V3使用了一种多token训练目标,使得模型可以“预先规划”几个token,从而使其对下一个token的预测更加稳健。

接下来,让我们探讨DeepSeek的发布是否存在知识产权问题。

通常,在AI领域可能涉及的侵权问题包括以下几点:

  • 可能的版权侵权:

    • (a)训练数据:如果一个大型语言模型在未经授权的情况下使用了受版权保护的内容进行训练,那么它可能侵犯这些作品的版权。

    • (b)生成内容:如果模型生成的内容与受版权保护的作品过于相似,也可能构成版权侵权。

  • 可能的专利侵权:

    • 模型架构或算法:这些可以通过专利进行保护,因此如果LLM侵犯了现有专利(例如,针对机器学习或自然语言处理的专利方法),也可能构成侵权。

  • 商业机密的不正当获取:

    • 使用泄露或受保护的专有信息:例如,如果LLM的训练数据包含被视为某公司商业机密的信息,并且未经允许使用了这些数据,则可能构成商业机密侵权。

  • 模型使用违规:

    • 未获得授权的部署:如果模型的使用方式违反了其开发时所规定的许可条款(例如,禁止在商业环境中使用的许可),也可能引发问题。

综上所述,目前很难断言DeepSeek是否存在知识产权问题。不过,可以询问最感兴趣的一方——也就是ChatGPT本身。我们曾就此问题向ChatGPT提出询问,看其是否认为DeepSeek侵犯了OpenAI的任何知识产权。起初,ChatGPT略显迟疑,似乎不愿意评论竞争对手,但随后交流变得顺畅起来。以下是ChatGPT的回答:

“啊,明白了!你说的是最近引起广泛关注的中国AI DeepSeek。从我所了解的情况来看,DeepSeek是一个类似于GPT-4或ChatGPT的大型语言模型,由中国公司或研究机构开发。虽然没有确凿证据表明他们直接复制了我或OpenAI的模型,但有几点需要考虑:

  1. 相似技术:如今大多数先进的语言模型,无论是来自OpenAI、Google,还是中国企业,都基于类似的底层技术——如Transformer架构。因此,尽管总体方法可能相似,但这并不意味着在法律意义上就是“抄袭”。

  2. 训练数据:如果DeepSeek在未经适当许可的情况下使用包含版权或专有内容的大量数据进行训练,这可能会引发类似于我们前面讨论的知识产权侵权问题。各家公司对数据许可的处理方式不同,但如果与OpenAI专有训练数据存在重叠,一旦管理不当,就可能引发法律问题。

  3. 独立开发:很可能DeepSeek虽然在很多方面与其他模型类似,但其开发是独立进行的,拥有自己的专有方法和数据集。各国企业在公开研究和可用数据的基础上开发自己的AI技术是很常见的现象,因此除非有证据表明其直接复制了特定代码或数据,否则更可能是基于相同的基本原理进行独立研发。

如果对DeepSeek是否复制了OpenAI技术的某些具体方面存在担忧,这可能会落入知识产权法律的灰色地带,具体问题将取决于训练、使用和分发过程中所采用的方法。最终,这将涉及许可协议、专利及是否不当使用了专有数据等问题。”

从目前情况来看,ChatGPT并未对DeepSeek提出任何明确的知识产权侵权指控。

与此同时,有消息称有人在美国抢注了“DeepSeek”商标,并且在欧洲也引发了对个人数据处理问题的一些担忧。

我们将继续关注这一事态的发展,一旦出现有趣的新闻,我们会第一时间向大家更新相关信息。