DeepSeek 选择华为而非 Nvidia 开发其下一代人工智能模型

DeepSeek 选择华为而非 Nvidia 开发其下一代人工智能模型

29 hardware

DeepSeek 更倾向于在 AI 模型的最终优化中使用中国加速器

*据路透社报道*,在开发大型语言模型的过程中存在一个最终阶段,在产品发布前,它们会在专用计算加速器上进行细调。对于最新的 DeepSeek(V4)模型,公司选择了中国供应商——华为和其他国内制造商来完成这项工作。

为什么重要

根据路透社的分析,“第一夜之权”在行业中通常属于美国巨头,主要是 Nvidia。在最近之前,DeepSeek 遵循这一趋势:他们的模型专门针对 Nvidia 加速器进行优化。然而,新版本 V4 已经为中国平台进行了调优。发布前几周,公司仅向国内加速器供应商开放了该模型,以最大限度地利用本土硬件基础设施的特点并提升 AI 的工作效率。

优化速度

独立专家指出,现代工具可以在数周内完成调优,而以前则需要数月。这表明中国技术已高度准备好用于大规模应用。

政治背景

分析人士认为,这种优先方法符合中国政府政策:本土设备和软件相较于国外同类产品具有优势。然而,有关 DeepSeek 在 V4 训练中使用 Nvidia Blackwell 加速器的秘密数据中心的信息,与公司关于转向华为的声明相矛盾。美国官员担心,该公司可能隐藏了使用 Blackwell 的事实,并正式宣布与中国加速器合作。

因此,DeepSeek 显示出明显向本土技术转移的趋势,同时面临透明度和国际竞争的挑战。

评论 (0)

分享你的想法——请保持礼貌并围绕主题。

暂无评论。留下评论,分享你的观点!

要发表评论,请先登录。

登录后发表评论