亚马逊计划在巨大的Cerebras芯片上部署AI模型。
74
hardware
亚马逊与 Cerebras 合作加速大型语言模型
亚马逊网络服务(AWS)宣布,将在 2026 年中期开始使用 Cerebras Systems Inc. 的芯片,与其自有的 Trainium 处理器一起使用。据公司内部信息,这将为运行和维护大型语言模型(LLM)创造“最佳条件”。交易的财务细节尚未披露。
具体操作流程
* AWS 的 Trainium 3 芯片负责处理用户请求——“理解”其含义。
* 随后 Cerebras 的 Wafer‑Scale Engine (WSE) 芯片负责生成答案。
因此,两种专业加速器配合工作,为 LLM 提供推理计算。
> “不同组件之间的交互通常会减慢过程,”AWS 副总裁 Nafea Bshara 说,“但我们旨在通过使用更快处理推理的芯片获得优势。”
这一优势在需要快速响应的场景中尤为明显,例如逐步编写代码或实时生成文本。
重要性
* 亚马逊是最大的云服务提供商之一,也是 Nvidia GPU 制造商的重要用户。目前公司正在研发自有 AI 芯片,以提升数据中心效率并向客户提供独特服务。
* 对于 Cerebras 来说,与 AWS 的合作是其首个大型数据中心巨头合同,提升了品牌在潜在市场中的知名度。这对其即将进行的 IPO 也至关重要。
结论
AWS 与 Cerebras 正共同打造新的大型语言模型基础设施:Trainium 3 芯片处理请求,WSE 生成答案。尽管单独使用 Trainium 的服务可能更便宜,但组合方案承诺显著加速,在“时间即金钱”的场景中尤为突出。这既强化了亚马逊作为 Nvidia 大客户的地位,也推动其自有 AI 芯片向更高效方向发展。
评论 (0)
分享你的想法——请保持礼貌并围绕主题。
登录后发表评论