OpenAI指控中国公司DeepSeek非法使用数据来训练R1模型。

OpenAI指控中国公司DeepSeek非法使用数据来训练R1模型。

36 software

简短概述OpenAI与中国初创公司DeepSeek之间的冲突

时间线与指控
- 2024年,OpenAI(ChatGPT的创建者)在一份向美国国会提交的报告中指责DeepSeek“窃取”美国人工智能模型的数据,用以训练其聊天机器人R1。
- Bloomberg报道显示,DeepSeek利用“蒸馏”技术快速获取已训练模型的知识,而不需要直接访问源代码。
- 2023年起,中国公司(包括DeepSeek)开始使用此方法。
- 风险:所得到的模型可能缺失原始开发者设定的限制,易被用于恶意用途。
- 2023年夏季,DeepSeek有望获得Nvidia H200加速器,这将提升其在全球AI市场的竞争力。
- 自2024年初,美国政策制定者开始关注此事。

事件概述

1. OpenAI指控
OpenAI在Bloomberg发布的声明中称,DeepSeek使用蒸馏方法“免费”转移美国公司(包括ChatGPT)开发的技术。

2. 向国会提交报告
文件详细分析了DeepSeek如何规避现有防护机制,并通过“旁路”渠道获取美国AI模型数据。该报告递交给国会专门委员会。

3. 重要性
- 蒸馏加速第三方模型训练,无需源代码。
- 获得的模型往往缺少原系统的限制,可能被用于有害目的。
- DeepSeek不提供付费订阅,使其解决方案在中国乃至俄罗斯更易普及,竞争力强于西方商业同类产品。

4. Nvidia H200潜在风险
美国官员担心DeepSeek在特朗普总统允许向中国出口后可能获得最新的Nvidia H200加速器,这将显著提升该初创公司的技术实力,并削弱美国在全球AI领域的地位。

5. 行业反应
OpenAI和微软去年已开始调查DeepSeek,但尚未完全堵住通过中介实现对美国模型使用的“跳板”。

结论
OpenAI声称中国竞争者利用蒸馏技术加速学习并获取受保护数据,威胁到美国商业利益与安全,因为获得的模型可能绕过内置限制。为应对此类威胁,美国政策制定者正在考虑加强对高科技设备出口至中国的管控。

评论 (0)

分享你的想法——请保持礼貌并围绕主题。

暂无评论。留下评论,分享你的观点!

要发表评论,请先登录。

登录后发表评论