中国科学家正从推理转向在华为加速器上训练人工智能模型

中国科学家正从推理转向在华为加速器上训练人工智能模型

34 hardware

华为的中国芯片成功完成了DeepSeek‑V4‑Pro模型的后训练

根据《南华早报》的报道,中国已使用华为Ascend 910C芯片对大型AI模型DeepSeek‑V4‑Pro进行了完整再训练。这是国产半导体行业发展的重要一步,旨在从单纯推理转向复杂学习,以应对美国加剧的制裁。

发生了什么
阶段 描述 启动项目
华为技术与合作伙伴(深圳环路研究院、深圳哈尔滨工业大学校区、深圳大数据科研院)启动目标是训练DeepSeek‑V4‑Pro模型。
规模 模型包含1.6万亿参数,部署在至少1000颗Ascend 910C芯片的集群上。
后训练 完全“参数化”再训练:整个模型架构更新,无任何妥协,仅仅是单层调整。

为何重要
* 迄今为止,中国芯片主要用于推理——模型仅回答请求。
* 通过新项目,模型能够在运行中自我反思和校正,为原本单向的数据流添加了“复杂的跨越与循环”,提升计算与通信需求,但使系统更具自治性。

预期结果
深圳政府表示,此研究将提升中国人工智能产业的自主性,并在外部限制下巩固国产芯片的地位。

评论 (0)

分享你的想法——请保持礼貌并围绕主题。

暂无评论。留下评论,分享你的观点!

要发表评论,请先登录。

登录后发表评论