跳到正文
AMD Press Releases·· 2026-07-24精选AI 评分69

AMD 与 Cerebras 合作发布超低延迟高吞吐 AI 推理解耦方案

AMD and Cerebras Announce Industry-Leading Ultra-Low-Latency and High Throughput AI Inference Solution

AI 导读

AMD 与 Cerebras 宣布技术合作,在 Advancing AI 2026 上发布解耦式 AI 推理方案:AMD Helios 机架级方案负责高吞吐 prompt 处理,Cerebras 晶圆级引擎负责超低延迟的 token 生成,双方建模显示组合方案每瓦 token 生成速率最高可达单用 Cerebras WSE 的 5 倍。

AI 生成摘要 · 以原文为准

关注理由

两家公司以解耦推理组合高吞吐 GPU 与低延迟晶圆级引擎,为推理基础设施按负载分层选型提供了新的架构方向,并明确部署时间点。

正文 · AI 翻译

新闻要点 

  • AMD 与 Cerebras 正在合作推进面向工作负载优化的超低延迟 AI 推理基础设施方案。 
  • AMD Helios™ 与 Cerebras 晶圆级引擎(Wafer-Scale Engine)将作为一个单一 disaggregated 推理工作流运行,结合 AMD Instinct™ GPU 的超高吞吐量与 Cerebras 晶圆级引擎的超快 token 生成能力。
  • Cerebras 计划在其数据中心部署 AMD Helios,联合解决方案预计将于 2026 年下半年率先通过 Cerebras Cloud 提供。 

旧金山和加利福尼亚州桑尼维尔,2026 年 7 月 23 日(GLOBE NEWSWIRE)—— AMD(纳斯达克:AMD)与 Cerebras Systems(纳斯达克:CBRS)宣布建立技术合作伙伴关系,推出一种全新的 disaggregated AI 推理解决方案,将 AMD Helios™ 机架级解决方案与 Cerebras 晶圆级引擎相结合。该方案在 Advancing AI 2026 上首次亮相,旨在为最先进的 AI 应用提供所需的超低延迟,同时大幅提升吞吐量和效率。 

AMD 与 Cerebras 的联合解决方案将把 AMD Helios 与 Cerebras 晶圆级引擎技术集成在一个单一推理工作流中部署,以实现最大性能和效率。AMD Helios 将提供高性能、可扩展的吞吐引擎。Cerebras 晶圆级引擎技术将提供超快、超低延迟的解码和 token 生成。两款计算引擎结合后,预计每瓦每秒 token 数(T/s/W)最高可提升 5 倍i。 

AI 推理工作负载在延迟、吞吐量、token 容量、成本和规模等方面的需求日益多样化。大批量工作负载优先考虑最大化 token 生成,而编程、实时副驾驶(copilot)、实时智能体(agent)以及 agentic 工作流则要求更快的响应时间。这些差异正推动对异构基础设施的需求,以将计算技术匹配到特定的工作负载要求。  

AMD 与 Cerebras 的解决方案通过 disaggregated 推理应对这一挑战,对工作流的两个主要阶段分别进行优化。AMD Helios 提供超高吞吐量,处理提示词(prompt)和大型上下文窗口。Cerebras 晶圆级引擎以超低延迟加速内存带宽密集型的 token 生成。通过将这两款业界领先的引擎连接到一个集成工作流中,两家公司打造了一个差异化的超低延迟推理平台,同时不牺牲吞吐量或规模。 

“AI 推理正在成为 AI 领域最大的基础设施机遇之一,其日益增长的多样性需要更灵活的方式,”AMD 董事长兼 CEO 苏姿丰(Lisa Su)博士表示。“AMD Helios 为最广泛的推理工作负载提供领先的性能和规模。与 Cerebras 携手,我们将把这一领先优势延伸到对延迟最敏感的应用中,并为实时 agentic AI 打造一个强大的全新平台。”   

 “对超高速推理的需求正以前所未有的速度增长。Cerebras 提供全球最快、超低延迟的推理,”Cerebras 首席执行官兼联合创始人 Andrew Feldman 表示。 “与 AMD 合作给了我们一个绝佳的机会,能够将这种性能带给更多客户。” 

随着 AI 进入软件开发、自主智能体、机器人、科学发现及其他应用领域,快速生成 token 正变得日益重要,在这些场景中,响应时间直接影响用户体验和系统的实用性。这一联合解决方案将专为这些需求打造、彼此互补的架构结合在一起。  

AMD Helios 提供高吞吐量的提示引擎、机架级效率和部署规模,能够处理大量复杂请求。Cerebras Wafer-Scale Engine 技术提供实时返回 token 所需的超低延迟和解码性能。其结果是一款专为推理市场超低延迟细分领域设计的解决方案,以 AMD Helios 作为数据中心内高吞吐量和均衡推理工作负载的基础。 

Cerebras 计划在其数据中心部署 AMD Helios 系统,联合解决方案预计将于 2026 年下半年率先通过 Cerebras Cloud 提供。  

支持资源

关于 AMD
AMD(纳斯达克代码:AMD)推动高性能计算和 AI 计算领域的创新,以解决全球最重要的挑战。如今,AMD 技术为云端与 AI 基础设施、嵌入式系统、AI PC 和游戏领域的数十亿体验提供支持。凭借广泛的 AI 优化 CPU、GPU、网络和软件产品组合,AMD 提供全栈 AI 解决方案,为智能计算新时代提供所需的性能和可扩展性。更多信息请访问 www.amd.com。

关于 Cerebras Systems

Cerebras Systems(纳斯达克代码:CBRS)构建全球最快的 AI 基础设施。Cerebras 团队由颇具开拓精神的计算机架构师、计算机科学家、AI 研究人员和各类工程师组成,大家携手通过创新与发明让 AI 速度飞快。我们相信,当 AI 变得足够快时,它将改变世界。全球领先的企业、研究机构和政府机构选择 Cerebras 来运行其 AI 工作负载。Cerebras 解决方案可部署于本地和云端。请访问 cerebras.ai 了解更多信息。

AMD 风险提示声明

本新闻稿 包含 有关超威半导体公司(AMD)的前瞻性陈述,例如 AMD 与 Cerebras 的合作及联合解决方案的特性、功能、性能、可用性、可扩展性、部署、时间安排和预期收益,这些陈述是根据 1995 年《私人证券诉讼改革法案》的安全港条款作出的。前瞻性陈述通常通过诸如 "would"、"may"、"expects"、"believes"、"plans"、"intends"、"projects" 等词语以及其他含义类似的术语来识别。特此提醒投资者,本新闻稿中的前瞻性陈述基于当前的信念、假设和预期,仅截至本新闻稿发布之日有效,并且涉及可能导致实际结果与当前预期产生重大差异的风险和不确定性。此类陈述受某些已知和未知的风险和不确定性影响,其中许多难以预测且通常超出 AMD 的控制范围,这些风险和不确定性可能导致实际结果和其他未来事件与前瞻性信息和陈述中所表达、暗示或预测的内容产生重大差异。可能导致实际结果与当前预期产生重大差异的重要因素包括但不限于以下内容: 政府行为和法规(如出口管制、进口关税、贸易保护措施和许可要求)的影响;AMD 产品销售所处的竞争市场;半导体行业的周期性;AMD 产品销售所处行业的市场状况;AMD 按时推出具有预期特性和性能水平产品的能力;失去重要客户;经济和市场不确定性;季度性和季节性销售模式;AMD 充分保护其技术或其他知识产权的能力;不利的汇率波动;第三方代工厂商按时以足够数量并采用具有竞争力的技术制造 AMD 产品的能力;关键设备、材料、组件(如内存供应)、基板或制造工艺的可用性;实现 AMD 产品预期制造良率的能力;AMD 从其半定制 SoC 产品中获得收入的能力;潜在的安全漏洞;潜在的安全事件,包括 IT 中断、数据丢失、数据泄露和网络攻击;涉及 AMD 产品订购和装运的不确定性;AMD 在设计和推出新产品时对第三方知识产权的依赖;AMD 在主板、软件、内存和其他计算机平台组件的设计、制造和供应方面对第三方公司的依赖;AMD 依靠 Microsoft 和其他软件供应商的支持来设计和开发可在 AMD 产品上运行的软件;AMD 对第三方分销商和插卡合作伙伴的依赖;AMD 内部业务流程和信息系统被修改或中断的影响;AMD 产品与部分或全部行业标准软件和硬件的兼容性;与缺陷产品相关的成本;随着客户需求变化未能保持高效的供应链;AMD 依赖第三方供应链物流职能的能力;AMD 有效控制其产品在灰色市场销售的能力;气候变化对 AMD 业务的影响;AMD 实现其递延所得税资产的能力;潜在的纳税义务;当前和未来的索赔与诉讼;环境法律、冲突矿产相关条款及其他法律或法规的影响;政府、投资者、客户和其他利益相关方对企业责任问题不断变化的期望;与负责任使用 AI 相关的问题;管辖 AMD 票据、Xilinx 票据担保以及循环信贷协议的协议所施加的限制;AMD 履行担保、租赁和其他商业承诺项下财务义务的能力;收购、合资和/或投资对 AMD 业务的影响以及 AMD 整合被收购企业的能力;合并后公司资产任何减值的影响;政治、法律和经济风险及自然灾害;技术许可采购的未来减值;AMD 吸引和留住关键员工的能力;以及 AMD 的股价波动。强烈建议投资者详细查阅 AMD 向美国证券交易委员会提交的文件中的风险和不确定性,包括但不限于 AMD 最新的 10-K 和 10-Q 表格报告。   

CEREBRAS 信息披露声明

Cerebras 通过其投资者关系页面(investors.cerebras.ai)、其 X 账号(@cerebras)以及其 LinkedIn 页面(linkedin.com/company/cerebras-systems/)披露重大非公开信息,并履行其在 Regulation FD(公平披露规则)下的信息披露义务。因此,除了关注 Cerebras 的新闻稿、美国证券交易委员会(SEC)备案文件、公开电话会议和公开网络直播外,投资者还应关注上述渠道。

前瞻性声明

本新闻稿包含适用证券法意义上的“前瞻性声明”。除历史事实陈述之外的所有陈述均可能被视为前瞻性声明,包括但不限于关于 Cerebras 与 AMD 的合作及联合解决方案所涉及的功能、容量、可扩展性、性能、时间安排、数据中心部署与实施、成本以及预期效益和机遇的陈述,以及与之相关的任何假设。“可能”“将”“应当”“应该”“预期”“计划”“预计”“可以”“打算”“目标”“项目”“考虑”“相信”“估计”“预测”“潜在”“目标”或“继续”等词语,或这些词语的否定形式或其他涉及我们预期、战略、计划或意图的类似术语或表达,旨在识别前瞻性声明,尽管并非所有前瞻性声明都包含这些识别性词语。这些前瞻性声明受到诸多风险和不确定性的影响,其中许多涉及超出 Cerebras 控制范围的因素或情况。这些风险和不确定性包括但不限于:Cerebras 维持和管理其增长、以可接受的条件获得借款及其他资本来源、以及调配可用资本以支持增长的能力;其净亏损历史以及实现并维持盈利的能力;其在当前规模下经营历史有限,以及准确预测收入并合理编制预算和管理开支的能力;其依赖数量有限的重要客户,包括 OpenAI、Group 42 Holding Ltd、穆罕默德·本·扎耶德人工智能大学和 AWS,以及来自这些客户的需求减少、与这些客户的关系出现重大不利发展、或未能履行对这些客户的义务(包括根据其与 OpenAI 的主关系协议)可能产生的影响;其战略客户、合作伙伴及融资安排的时机、执行和预期效益;其历史上对硬件系统销售的依赖,以及其云端产品和 AI 基础设施尚处早期且快速演变的市场;其获取足够数据中心容量和资本以支持其云端产品的能力;其推出新服务和增加新产品功能的能力;以及其在快速演变且竞争激烈的 AI 计算解决方案市场中有效竞争的能力。

由于多种因素的影响,Cerebras 的实际结果可能与前瞻性陈述中所述或暗示的内容存在重大差异。因此,不应过度依赖此类陈述。这些前瞻性陈述自首次发布之日起作出,其依据是 Cerebras 在该日期可获得的信息,以及 Cerebras 截至该日期的预期、估计、预测、展望、信念和假设。不应将这些前瞻性陈述视为代表 Cerebras 在本新闻稿发布日期之后任何日期的观点。过往表现不一定代表未来结果。除非法律要求,否则 Cerebras 无意亦无义务更新或修订任何前瞻性陈述,无论是否由于新信息、未来事件或其他原因。

有关可能影响实际结果的潜在风险的更多信息,请参见 Cerebras 向美国证券交易委员会(“SEC”)提交的最新文件,包括 Cerebras 最新的 10-Q 季度报告,副本可通过访问 Cerebras 投资者关系网站 investors.cerebras.ai 或 SEC 网站 www.sec.gov 获取。

联系方式:
Aaron Grabein
AMD Communications
737-256-9518
aaron.grabein@amd.com

Liz Stine
AMD Investor Relations
720-652-3965
liz.stine@amd.com

Kriselle Laran
Cerebras
pr@cerebras.ai

Sean Dorsey
Cerebras Investor Relations
investors@cerebras.ai

_______________
i 基于 AMD Performance Labs 和 Cerebras 于 2026 年 7 月进行的建模,在可比交互性水平下使用 Kimi 2.6 1T 模型,将采用 Cerebras WSE 的 AMD Helios 机架级解决方案与仅使用 Cerebras WSE 的配置进行比较,以确定每千瓦每秒的 token 数(TPS/kW)。系统制造商可能会采用不同配置,从而产生不同结果。MI400-021

AMD logo

来源:Advanced Micro Devices, Inc.

发布于 2026 年 7 月 23 日

来源:AMD Press Releases · ir.amd.com