英伟达正准备在推理领域展开竞争,正在为OpenAI和人工智能代理开发基于Groq技术的芯片。
新款 Nvidia 芯片——迈向更快 AI 应用的步伐
Nvidia 计划在三月推出一款专为加速推理(已训练模型的计算)而设计、面向 OpenAI 等客户的新处理器。这是公司方向的一次转变,之前主要聚焦于 AI 系统的训练。
将会出现什么
- 新平台将在 GTC(Graphics Technology Conference)开发者大会上展示。
- 平台核心将集成来自初创企业 Groq 的芯片——目前最快的推理解决方案之一。
- 该平台旨在与 Google 和 Amazon 自有加速器竞争,后者已取得显著成果。
为何重要
随着“web‑coding”(AI 根据文本生成代码)的流行,对快速且节能基础设施的需求不断上升。
对 OpenAI 来说,新处理器成为关键因素:
- 一月,公司与 Cerebras 签署了面向推理的芯片协议,据其估计,该芯片比竞争者更快。
- 在此之前,OpenAI 宣布与 Nvidia 的大额交易,获得“专用推理资源”,并从这家“绿色”制造商投资 300 亿美元。
竞争环境
| 公司 | 产品 | 定位 |
|------|------|------|
| Nvidia | Hopper、Blackwell、Rubin GPU 系列 | 训练与推理 |
| Google | TPU | 推理 |
| Amazon | Trainium | 推理 |
| Cerebras | 专用芯片 | 推理 |
| Groq | 带“语言处理块”的芯片 | 推理 |
Nvidia 在 GPU 市场占有率超过 90%,但其芯片往往被认为价格高且能耗大,尤其在推理任务中。这吸引了寻求替代方案的公司关注。
关键应用
- 代码生成:Claude Code(Anthropic)和 Codex(OpenAI)使用 Amazon 与 Google 的云基础设施,但 Codex 正计划迁移至 Nvidia 新平台。
- 广告定向:Meta 与 Nvidia 合作进行 AI 系统推理,核心处理器被证明最为高效。
结论
Nvidia 不仅在扩展产品线,也正直接与行业巨头竞争。与 Groq 集成的新芯片可能成为那些追求更快、更经济的 AI 模型处理公司的决定性因素。
评论 (0)
分享你的想法——请保持礼貌并围绕主题。
登录后发表评论