Cerebras 電話會:“快速推理需求是無限的”,明年一季度上線 AWS Bedrock

華爾街見聞
2026.08.12 22:47

Cerebras 公佈 2026 年 Q2 財報,GAAP 營收 1.801 億美元同比增 74%,但硬件收入下滑致股價跌 17%。核心口徑收入 2.099 億美元超預期,雲業務激增。公司上調全年指引,預計 2027 年 Q1 通過 AWS Bedrock 上線,押注快速推理需求無限及超大規模客户拓展。

Cerebras 第二季度呈现明显分化:云业务高速增长、硬件收入承压,但管理层仍上调全年指引,并把 2027 年 “增长 3 倍以上” 的目标押在快速推理、产能扩张和超大规模客户拓展上。

美国当地时间 8 月 12 日,AI 芯片公司 Cerebras 公布 2026 年第二季度财报并举行电话会。公司 GAAP 营收为 1.801 亿美元,同比增长 74%;硬件收入 5410 万美元,同比下降 23%,成为市场关注的主要压力点。财报公布后,公司股价盘后一度跌约 17%。

不过,按公司 “核心” 口径,第二季度收入达到 2.099 亿美元,同比增长 103%,超过此前指引。其中核心云及其他服务收入 1.277 亿美元,同比增长 287%;核心硬件收入 8210 万美元,同比增长 17%。

第二季度 Cerebras 签署了六笔超过 3000 万美元的交易,并与 Figma、Cognition、lovable、Block、AlphaSense 和 GSK 等公司达成新协议。

这一模式也意味着 Cerebras 可以利用现有 GPU 基础设施,而不必要求客户完全替换已有设备。管理层认为,这有望把市场从 Cerebras 硬件客户进一步扩展至庞大的 GPU 存量市场。

Cerebras 预计其方案将在 2027 年第一季度通过 AWS Bedrock 上线。管理层同时强调,目前 254 亿美元的剩余履约义务(RPO)并未包含来自 AWS 或其他超大规模企业的积压订单

Andrew Feldman
第二季度是强劲的一个季度。我们完成了公开上市,但这并没有分散我们对执行的注意力。我们实现了创纪录的核心收入,并在所有指标上都超出了预期:核心收入、核心毛利率和核心营业利润率。展望未来,我们看到对快速推理的需求是无限的。市场正在意识到速度不是一项基准指标。速度改变了用户参与度,改变了智能体性能,也改变了 AI 生产力。快速推理解锁了新应用和新市场。

正如我们之前与大家分享的,2026 年是 Cerebras 奠定基础的一年。自上次财报电话会议以来的七周里,我们在多个方面取得了卓越进展,为我们实现大规模增长的 2027 年、2028 年和 2029 年做好了准备,届时我们将交付目前账面上 250 亿美元的剩余履约义务。凭借这些进展,我们预计 2027 年核心收入将增长两倍以上,并在接下来的几年里继续保持倍数增长。我们认为进展体现在产能、能力和客户三个方面。

我们正在通过在全球范围内为数据中心签订新合同、扩大制造能力以及与供应商合作来确保供应和支持我们非凡的增长,从而扩大产能。我们正在通过发明新技术来提升我们的能力,这些技术扩展了我们的性能、吞吐量和能效。我们正在通过加速现有市场(如编码和智能体流程)中的 AI 生产力,并开拓安全等新领域来扩大我们的客户基础——在这些新领域,速度带来了全新的机会。

在产能方面,数据中心空间仍然是整个行业的瓶颈,我们也不例外。我们和客户建设新数据中心的速度越快,我们的增长就越快。因此,在过去七个月里,我们全力以赴地争取和建设数据中心。我们有两个优势。首先,由于我们服务于推理,我们不需要像训练集群所需的那种千兆瓦级占地面积的位置。这使我们在全球多个地点的产能扩展上具有更大的灵活性。其次,我们已经建立了一个可重复的场地选择、集群部署和客户激活流程,这是将千兆瓦级电力转化为全球规模生产性令牌所需的运营能力。

我很高兴地报告,我们的推进非常成功。我们现在在阿拉巴马州、达拉斯、丹佛、明尼阿波利斯、圣克拉拉、斯托克顿以及美国以外的法国、芬兰、马尼托巴省、蒙特利尔、挪威、萨斯喀彻温省和多伦多都拥有已建成或已签约的数据中心。总的来说,在过去七个月里,我们已经获得了超过 600 兆瓦的数据中心容量,这些容量要么已经上线,要么将在 2027 年底前交付。虽然这还远远不能满足我们的需求,但我们的数据中心新增扩张机会的渠道仍在增长,现在已以吉瓦为单位衡量。换句话说,随着我们继续建设我们的第一方云,它将成为最大的非超大规模 AI 云之一。而在 2025 年底,我们还处于陡峭的学习曲线上。今天,我很高兴地报告,我们在数据中心建设方面已经相当擅长,并且有明确的路径变得卓越。

产能的其他关键维度包括制造和供应链。在这方面,我们成功提高了制造能力,并正在与 Flex 和 Sanmina 建设新工厂,预计在 2026 年将制造能力提高 10 倍以上,并在 2027 年继续扩展,再次为我们预期未来几年的卓越增长做好准备。我们与供应链供应商的合作也已转化为显著优势。台积电再次给予了支持,我们拥有推动增长所需的晶圆。我们获得晶圆供应的能力也得益于我们能够在台积电的 5 纳米节点上提供行业领先的性能,而该节点的晶圆成本较低且供应不那么受限。我们与供应伙伴数十年的合作关系增强了我们对未来能够实现增长计划的信心。这些关系稀有而宝贵,尤其是在供应短缺时期。最后,请记住,行业目前面临的大多数关键供应链限制对我们并不适用。例如,我们不使用 HBM 内存、封装,也不获取 3 纳米晶圆厂产能。

在能力方面,在第二季度,我们为 OpenAI 的 GPT-5.6 Sol 提供了支持,这是最大、能力最强的前沿模型。事实上,Cerebras 服务 GPT-5.6 Sol 的速度比使用 GPT-5.6 Sol 时快 10 倍,这消除了关于我们支持大型前沿模型能力的任何剩余担忧。作为 GPT-5.6 Sol 交付的合作伙伴并在我们的云中提供服务,这体现了我们软件栈的成熟度。达到能够提供超大规模质量和可靠性的水平,需要数百万小时的系统生产环境加固。我们为我们的推理云能够满足最苛刻客户的要求而感到自豪。我们在服务前沿模型方面的合作开辟了以前只有 NVIDIA 才能获得的新的、重要的战略优势。闭源前沿模型包含了源源不断的新见解和新 AI 技术。服务这些模型使我们能够洞察未来并为之做好准备。我们的硬件到软件栈的路线图现在反映了我们所看到的情况,并将在未来几年给我们带来复合优势。

继续围绕能力的主题,让我们转向解耦。我们现在与两家领先的芯片公司——AMD(与其 Helios)和 AWS(与其 Trainium)——拥有解耦推理解决方案。这种聚合扩大了 GPU 提供商和 Cerebras 的市场机会。这种聚合使 GPU 能够参与目前对它们关闭的市场,即快速推理。这种聚合使 Cerebras 能够将我们的机会扩展到那些对价格更敏感的客户,并提高我们数据中心的盈利能力。让我们看看这是如何运作的。与任何计算市场一样,随着推理的增长和成熟,专业化的机会就会出现。解耦是一种专业化形式,特别适用于具有已知流量模式的工作负载。在这些情况下,解耦通过将推理分为两个阶段:预填充和解码,并为每个阶段使用不同的处理器来实现优势。预填充处理来自用户或智能体的输入。这是一个可并行化的工作负载。因此,预填充非常适合 GPU 及其基于 HBM 的内存架构。解码生成输出令牌。这是更难的技术问题,也是解耦解决方案中的主要计算工作。它是顺序执行的,并且对内存带宽要求很高,特别适合我们的引擎。预填充和解码处理器需要连接以创建端到端解决方案。而这正是基于标准的 I/O 和开放参与策略使 Cerebras 的集成变得简单直接的地方。

几周前,我们宣布与 AMD 建立合作伙伴关系,以构建解耦推理解决方案。这些解决方案将他们的 Helios 机架与 RCS 系统相结合。组合解决方案在保持速度的同时,将吞吐量提高了 5 倍。要理解这有多强大,重要的是要理解速度和吞吐量之间的区别。速度是每个用户的度量标准。它以每个用户每秒的令牌数来衡量。它是您的查询得到回答的速度,或者智能体完成任务所需的时间。这体现在 x 轴上。另一方面,吞吐量是解决方案每秒可以产生的令牌总数。它通过将所有并发用户的所有令牌加起来来衡量。这通常显示在 y 轴上。速度对用户体验至关重要。吞吐量对推理经济性至关重要。GPU 解决方案可以支持高吞吐量,但只能在低速度下。当配置为支持甚至中等速度时,GPU 吞吐量会急剧下降。这不仅适用于 GPU,也适用于 ASIC 和所有使用 HBM 的解决方案。HBM 内存架构迫使在吞吐量和速度之间进行权衡。像 Cerebras 这样的基于 SRAM 的架构则完全相反。我们支持极快的令牌,但吞吐量适中。因此,GPU 希望在不放弃吞吐量的情况下变得更快。Cerebras 希望在不放弃速度的情况下获得更多吞吐量。这就是我们解耦解决方案的优势所在。它以 5 倍更高的吞吐量提供速度。在保持我们行业领先速度的同时将吞吐量提高 5 倍,对令牌生成的经济性产生了深远影响。这意味着每个系统可以产生多达 5 倍的高速、高价值令牌。每个系统以更低成本产生更多令牌意味着更多的收入和更高的毛利率。每个 CS 系统产生更多令牌也意味着每瓦特更多令牌,使每个数据中心更有利可图。也许在数据中心受限的环境中,最重要的是,解耦解决方案使我们能够服务 RPO 中更多的需求。

最后,我们相信这种解耦方法对任何 GPU 都具有性能和经济效益。对于已经部署了大量 GPU 的运营商来说,与 Cerebras 的解耦为他们提供了通过将其部分 GPU 与 Cerebras 解决方案配对来利用其现有投资创造有意义杠杆的机会,从而显著提高其数据中心足迹的价值和实用性。

继续围绕能力的主题,让我们转向我们的路线图。我们的工程执行正在持续推进。我们预计在未来几年内每年都会交付速度翻倍的新系统。请记住,我们是在比业内其他所有人都快 15 倍的性能优势基础上再翻倍性能的。此外,在保持性能桂冠的同时,我们计划在未来 18 个月内交付将吞吐量提高 20 倍以上的解决方案。下周在我们的年度 Supernova 大会上,我们将发布我们的第四代系统 CS4。这将是一个充满产品公告的重要活动,所以我建议您参加。最后,我们目前按计划在 2027 年下半年推出我们的 CS5。展望更远的未来,我们的发明引擎正在蓬勃运转。我们与美国政府就交付堆叠内存解决方案以及集成晶圆级光学解决方案建立了重要合作伙伴关系。在未来几年,您可以期待我们在芯片和芯片架构以及系统设计的所有要素(包括封装、I/O 和电力传输)方面的发明。

总结能力部分,我们期望继续在产品和技术上提供开创性的进步,以提高速度和吞吐量,降低每令牌的功耗,并削减我们解决方案的每令牌成本。

现在让我们转向客户方面。快速令牌需求旺盛,在市场上享有溢价,而具有前沿智能的快速令牌仅可通过与 OpenAI 的合作获得。我们与 AWS 的合作仍在继续,我们预计解决方案将在 2027 年第一季度通过 AWS 的 Bedrock 平台全面上市。这个 AWS 合作伙伴关系扩大了我们的市场机会,并通过一个受到全球几乎每家企业信任的行业领导者为我们提供了全球覆盖。我们与其他超大规模企业的讨论也进展顺利。我们预计从 2027 年年中开始产生首批收入,并在 2028 年及以后逐步提升。

鉴于所有这些进展,我认为重要的是要记住,我们 250 亿美元的 RPO 目前并未反映来自 AWS 或任何其他超大规模企业的任何积压业务。我们在 OpenAI 和超大规模企业之外的业务继续良好增长。例如,在第二季度,我们签署了六笔超过 3000 万美元的交易。AI 编码继续保持高速增长。根据我们的经验,在编码时没有人会说他们对慢速令牌感到满意。因此,毫不奇怪,在编码类别中,我们的足迹持续增长。我们与 Figma 等上市公司以及 Cognition 等初创企业领军者签署了新协议,并在欧洲扩大了我们的影响力,在 lovable 取得了重大胜利。

随着智能体操作迅速向多步骤、多智能体解决方案演变,流程增长迅速,速度的价值成倍增加。Block、AlphaSense 和 GSK 等多元化公司在第二季度与 Cerebras 签署了新协议,利用快速推理为其客户提供智能体服务。

快速 AI 也开辟了新市场,扩展了 Cerebras 的 TAM(总可寻址市场)。安全就是一个例子。我们最近与 CrowdStrike 的合作是一个只有在 AI 足够快的情况下才存在的应用。快速 AI 使基于 AI 的安全设备能够嵌入企业流量,并使用 LLM 来保护流量,速度快到无人察觉。快速 AI 使 LLM 能够提供对用户不可见的安全保障。AI 提供安全,速度创造了这种隐身性,使安全能够避免延迟和中断。我们预计,鉴于快速演变的威胁格局,这种安全类型将成为常态。企业很快将期望其大部分流量以这种方式被检查,这创造了仅通过快速 AI 才能实现的大量新机会。

前沿实验室、超大规模企业、领先的芯片制造商、增长最快的初创公司以及大型企业现在都已成为 Cerebras 的客户和合作伙伴,并从我们的快速推理中受益。

总而言之,总体而言,这是一个强劲的季度。我们成功完成了 IPO 上市。我们在所有指标上均超出预期:核心收入、核心毛利率和核心营业利润率。我们在每个关键领域——产能、能力和客户——都取得了进展。这些是我们实现 2027 年和 2028 年大规模增长目标,并在 2029 年及以后继续保持这一非凡增长率的基础。说到这里,我将把电话交给 Bob。Bob?

Bob Komin{BIO 16602976 <GO>}
谢谢,Andrew,大家下午好。我们在 2026 年上半年取得了巨大的进展。正如我们所描述的,2026 年是为未来几年倍数增长奠定基础的一年。进入今年时,我们赢得了有史以来最大的技术交易之一,创造了超过 250 亿美元的 RPO。这要求我们立即着手大幅提升产能的三个关键组成部分。首先,我们需要增加晶圆供应。

正如 Andrew 所描述的,由于我们与台积电的牢固关系和支持,我们做到了这一点,并且现在不仅为今年余下时间,也为明年做好了充分准备。其次,我们需要扩大我们的制造能力。我们已经是 2025 年上半年水平的四倍,并且我们将在 2026 年将制造能力提高 10 倍以上。所以我们在这方面取得了很大进展。

第三,我们需要大幅增加我们的数据中心容量。我们取得了显著进展,目前已拥有或已签约超过 600 兆瓦的容量,预计在 2027 年底前交付,此外还有以吉瓦计量的渠道。因此,支持 2027 年核心收入增长两倍或更多以及未来年份更多倍数增长的基础已经到位。

这种增长也为我们在 2027 年及以后的显著利润率扩张奠定了基础。转向第二季度的财务业绩。我们又迎来了一个业绩强劲的季度,在指导的每个方面都超出了预期。我们实现了创纪录的核心收入,超出了核心毛利率和核心营业利润率的预期。我将使用与上季度介绍的核心业务相同框架来描述我们的进展。核心业务指标的定义以及它们与 GAAP 的调节表均包含在今天的财报和我们的网站上。

核心收入为 2.099 亿美元,同比增长 103%。我们的私有云业务正以惊人的速度增长。核心云及其他服务收入为 1.277 亿美元,同比增长 287%。这一近四倍的增长反映了对 Cerebras 快速推理服务的巨大需求。本季度核心硬件收入为 8210 万美元,同比增长 17%。我们关注的是核心总收入,而非两者之间的组合,因为组合可能因大型新云容量增加和硬件发货的时间安排而在季度间出现显著差异。在第二季度,大部分核心总收入归因于我们核心云产品的增长,反映了我们 OpenAI 部署的增加、其他云客户使用量的增加,以及那些也在努力解决新数据中心容量时间安排的硬件客户。

对快速推理的需求依然强劲,来自新客户的数亿美元后期硬件交易以及 2027 年重要的新云交易都在管道中。现有的快速推理市场正在增长,新的市场也在启动。我们认为解耦是推动新用例的重要解锁方式,因为它显著改善了推理和数据中心所有权的经济性。如今,这意味着每个 CS 系统可产生多达 5 倍的令牌,因此每令牌的功耗和成本显著降低。通过持续在研发和产品路线图上进行大量投资,Cerebras 将在 2027 年底前将我们目前的行业领先速度提高四倍,并将吞吐量提高 20 倍以上,从而大幅改善我们的性能和推理经济性。

现在转向毛利率。核心毛利率同比大幅提升。第二季度核心毛利率为 40.6%,比 2025 年第二季度高出约 940 个基点。这反映了市场对快速推理价值的认可、我们持续的产品改进以及额外的规模经济效应。将核心总毛利率分解为其组成部分,核心云及其他服务毛利率为 41.8%,比 2025 年第二季度高出 1600 个基点。核心硬件毛利率为 38.8%,比去年同期高出 510 个基点。

正如我们上季度所述,我们通过暂时从云客户那里租回我们自己的部分系统,并通过 Cerebras 云提供,来满足对我们快速推理服务的一些巨大需求。更早地服务这种推理需求增强了我们满足云客户需求并随时间推移与他们共同成长的能力。我们相信这将为 Cerebras 及其股东创造额外的长期价值。短期内,这会降低毛利率,因为我们为这种租用容量支付了更高的成本。因此,环比来看,核心毛利率为 40.6%,而 2026 年第一季度为 46.5%。如果我们没有因为通过租回更多系统来增加私有云容量而产生更高成本,核心毛利率将高出约 500 个基点,更接近上季度的水平。展望未来,我们预计第三季度将是核心毛利率的低点,然后在 2026 年第四季度显著改善,届时我们将上线更多由成本更低的 Cerebras 自有系统填充的数据中心,这将使核心云毛利率回升。核心毛利率也将在 2027 年继续改善,并向我们 60% 以上的目标迈进,原因如下:市场已经认识到快速令牌是更有价值的令牌,这支持了更高的定价,这将在未来几个季度确认的硬件和云交易中得到体现;在未来几个季度,我们将逐步淘汰成本更高的租用系统,并在我们的私有云中用成本更低的自有系统替换;我们的产品路线图要求在未来 18 个月内将吞吐量提高 20 倍,这降低了每个系统和每单位功率产生令牌的成本;随着我们规模的扩大,我们在供应链中的物料成本将进一步改善;由于我们采用 5 纳米节点,我们的晶圆成本低于那些需要采用 3 纳米或 2 纳米节点的其他公司,我们也在以更高的数量购买晶圆;最后,我们不依赖 HBM,这给那些使用 HBM 的公司带来压力,迫使他们要么提高价格,要么损失利润率。我们没有暴露于这种风险,我们相信这将提升我们的价值主张和定价灵活性。

转向营业利润率。核心营业亏损为 3360 万美元。核心营业利润率为负 16%,而去年同期为负 42%,同比提高了约 2600 个基点。我们在收入翻倍多并加大各方面投资的同时,能够实现核心营业利润率的显著提升,这展示了我们商业模式中固有的强大运营杠杆。如今,我们正在投资于世界级人才、制造和数据中心容量以及公司基础设施,以支持我们预计在未来几年实现的规模显著增长。

截至 2026 年 6 月 30 日的剩余履约义务为 254 亿美元。这一积压订单为我们提供了可见性,使我们能够对未来收入增长抱有高度信心,并根据需要提前进行投资。我们现有的大型战略客户提供了验证、合同可见性以及按规模建设新产能所需的经济支持。与此同时,我们在扩大可寻址市场和客户群方面也取得了成功。OpenAI 提供了(除其他外)规模和前沿洞察。AWS 提供了全球企业覆盖。最近与 AMD 的合作将市场机会扩展到包括解耦推理,而快速推理则开拓了像安全这样的新市场。

我们在第二季度结束时拥有超过 86 亿美元的现金、现金等价物、受限现金和有价证券。我们还拥有一笔高达 8.5 亿美元的循环信贷额度,迄今为止尚未使用。我们的流动性和资产负债表状况强劲,并在第二季度的 IPO 中得到增强。这是一个显著的优势,为我们提供了灵活性,可以在这些非常动态和高增长的市场条件下进行投资和调整机遇。此外,在绝大多数 AI 云提供商中,我们每兆瓦的净资本支出要低得多,这有两个关键原因。首先,我们主要为部署自己的硬件和数据中心承担资本支出,其物料成本要低得多,不包含许多其他公司必须支付的高额利润。其次,我们最大客户以数据中心转嫁成本补偿的形式,为我们报销了剩余数据中心装修资本支出的相当一部分。

现在转向我们的展望。对于 2026 年第三季度,我们预计核心收入在 2.14 亿美元至 2.16 亿美元之间。核心毛利率在 38% 至 40% 之间,核心营业利润率在负 25% 至负 23% 之间。对于整个 2026 财年,我们将核心收入预期上调至 8.8 亿美元至 8.9 亿美元,将核心毛利率预期上调至 41% 至 43%,并将核心营业利润率预期上调至负 19% 至负 17%。

最后,第二季度对 Cerebras 来说是持续执行和增长非常强劲的一个季度。我们实现了创纪录的核心收入,云和服务收入几乎翻了两番,毛利率和营业利润率也显著优于我们的指引。我们提高了这些项目全年的指引。我们在建设能力、产能和客户方面取得了巨大进展,并以超过 86 亿美元的现金、现金等价物和投资结束了本季度,以继续执行我们的增长计划。我们处于有利地位,能够在 2027 年实现收入增长 3 倍以上,并在接下来的几年实现巨大的额外增长,同时显著扩大毛利率和营业利润率,朝着我们的目标迈进。我现在将把电话转交给 Andrew 做最后总结。

Andrew Feldman{BIO 20728605 <GO>}
谢谢,Bob。十多年前,我们创立 Cerebras 时相信,我们可以为 AI 构建更好的处理器,并相信要交付该处理器,我们需要构建一个完整的加速器系统和机架。如今,Cerebras 是仅有的四家公司之一——谷歌、亚马逊、NVIDIA 和 Cerebras——能够构建处理器、系统、数据中心,并向客户提供基于 AI 的云服务。

感谢您收听我们的既定发言。说到这里,我请接线员打开提问线路。

问答环节

接线员
(接线员说明)请稍等,我们正在整理问答名单。我们的第一个问题来自瑞银的 Timothy Arcuri。您的线路已开通。

Q - Timothy Arcuri{BIO 3824613 <GO>}
非常感谢。Andrew,我想问关于客户集中度的问题。您确实说过明年收入将增长两倍以上。显然,我们知道 OpenAI 目前正在提升规模。所以这可能是你们当前增量收入的一大块。我想 AWS 明年可能贡献 10 亿美元,类似这样,也许更多。那么您如何看待明年的客户集中度?比如说,这两个客户是否会占你们收入的三分之二?另外,您能否谈谈与其他公司(如谷歌和微软等)的谈判情况?非常感谢。

A - Andrew Feldman{BIO 20728605 <GO>}
当然。我认为这是一个好问题。我认为一些历史视角可能是有价值的,对吧?在 2021 年,人们抱怨我们只有政府客户。然后当我们赢得一个 10 亿美元的主权云项目时,人们担心我们只有一个主权云客户;然后我们赢得了最大的实验室,最大的前沿实验室;然后人们担心我们没有超大规模客户;然后我们赢得了 AWS。

所以我认为在每一种情况下,我们都能够利用前一步带来的势头来扩展我们的业务。我认为 OpenAI 是一个巨大的客户,他们不仅是我们业务的重要组成部分,也是该领域所有企业业务的重要组成部分。我认为他们明年仍将是我们业务的重要部分。但您说得完全正确,AWS 和其他客户,无论是快速增长的编码公司还是一些安全用例,它们所占的比例将会更大,而 OpenAI 占我们收入的比例将随时间推移而缩小。但我认为,对于明年,您可以预期他们仍将是我们收入的重要组成部分。

Q - Timothy Arcuri{BIO 3824613 <GO>}
很好。然后紧接着一个快速跟进问题。我知道,Bob,您说过产能,我想您说今年同比将增长 10 倍。有没有关于明年将增长多少的预期?我知道 Andrew 说收入将增长 3 倍,但您能否谈谈制造产能明年同比增长幅度?

A - Andrew Feldman{BIO 20728605 <GO>}
是的,我们将在今年年底实现制造产能超过 10 倍的增长,而且我们已经为 2027 年的增长承包了 3 倍或 4 倍以上的设施,我们还有一些时间来承包更多。因此,我们正在关注未来数年内的巨大增长。

接线员
谢谢。我们的下一个问题来自 TD Cowen 的 Joshua Buchalter。您的线路已开通。

Q - Joshua Buchalter{BIO 19890074 <GO>}
嘿,各位。感谢接受我的提问。也许可以接着 Tim 之前的问题。您能否简单介绍一下亚马逊交易的经济性将如何运作?计划是明年在其 AWS 云中提供,然后我们基本上会看到需求有多大,因此目前很难预测?谢谢。

A - Andrew Feldman{BIO 20728605 <GO>}
当然,它将可用。它部署在亚马逊数据中心。它将通过亚马逊的 API 服务 Bedrock 提供。我们现在正在组织部署的过程中。所以,我认为这就是思考这个问题的方式。我们预计该服务将在第一季度上线。

Q - Joshua Buchalter{BIO 19890074 <GO>}
明白了。谢谢您,Andrew。然后关于与 AMD 的合作,您能否就销售策略提供更多细节,因为它是与 Helios 机架连接,以及您预计何时产生收入?另外,关于 AMD 的合作,他们最近收购了一家推理硬件公司。您能否谈谈这与你们提供的产品如何契合,因为我们在考虑他们更广泛的产品组合?谢谢。

A - Andrew Feldman{BIO 20728605 <GO>}
当然。我认为有几点。我认为我们将随着时间的推移宣布与 AMD 安排的其他部分。但我认为,在 Cerebras 系统前端配置 Helios 机架的联合解决方案——Helios 机架负责预填充,Cerebras 负责解码——是一个非常强大的产品,对吧,这个产品提供了比 Helios 单独能提供的快得多的速度,以及比 Cerebras 单独能提供的多得多的吞吐量。

这个解决方案极具吸引力,我们已经有了买家。第二个问题是关于 AMD 最近的收购。看,我认为他们收购的那家公司很有趣且具有创新性,没有人比我们更对创新硬件感到兴奋。我认为收购硬件初创公司,从收购到交付之间需要很长时间,我们确实对那些人正在做的工作印象深刻,并认为在 AMD 的产品组合中,它们有很多应用。我认为数据中心推理不会是它们的首要应用。

接线员
谢谢。我们的下一个问题来自巴克莱银行的 Tom O'Malley。您的线路已开通。

Q - Kyle Bleustein{BIO 23692250 <GO>}
嘿,各位,我是代表 Tom O'Malley 的 Kyle Bleustein。感谢接受我们的提问。我想回到 Josh 关于 AMD 交易经济性的问题。运作方式是你们购买 AMD Helios 机架并安装到你们的云中,然后客户租用解耦推理解决方案产生的所有收入都归你们吗?还是这里存在某种收入分成协议?

A - Andrew Feldman{BIO 20728605 <GO>}
对问题的第一部分回答是 “是”。

Q - Kyle Bleustein{BIO 23692250 <GO>}
好的。谢谢。然后是我的跟进问题。AWS 交易是安装在他们自己的云中。您是否看到一种最终路径,可以让你们在自己的云或其他超大规模云中共同托管 Trainium 和 CS-3?只是想思考一下 Cerebras 推理在未来部署中可能如何演变?

A - Andrew Feldman{BIO 20728605 <GO>}
我认为我们对这种方法非常感兴趣。我认为,正如您在谷歌身上看到的,拥有自己部件的超大规模企业有机会在其数据中心边界之外部署这些部件。这是我们不仅对 AWS,而且对其他公司都感兴趣的事情。所以我认为这在未来与 AWS 的合作中是很有可能的。

接线员
谢谢。我们的下一个问题来自 Needham & Co 的 Quinn Bolton。您的线路已开通。

Q - Quinn Bolton{BIO 3192909 <GO>}
我想就 AMD 交易做一点澄清。Andrew,如果你们购买并安装 Helios 机架到你们的 Cerebras 云中,但该服务是根据你们的合同交付给 OpenAI 的。这代表了一个额外的收入机会吗?或者我们应该如何看待在这种情况下收入的潜力?然后我有一个跟进问题。

A - Andrew Feldman{BIO 20728605 <GO>}
我认为,当你在保持性能不变的同时提高吞吐量时,你就增加了收入机会。吞吐量是你可以同时支持的客户数量。如果你能在不放弃速度的情况下做到这一点,那么每个系统你就有更多的收入。现在我不想深入讨论我们与 OpenAI 关系的具体细节,但使我们对这种合作感到如此兴奋的事情之一是,你保持了我们的速度并增加了吞吐量,这使得每个系统更有利可图。每个系统产生更多令牌。这意味着每个令牌成本更低,每个令牌使用的电力更少。所以我们不仅在收入上赚得更多,而且我们的利润率也提高了。不仅我们的利润率和收入提高了,而且这使得每项数据中心投资更有价值,因为数据中心是一个电力容器。如果你能从那个电力容器中榨取更多令牌,那就能转化为更多美元。所以这是一个非常强大的事情,随着 AWS 与我们进行解耦,AMD 也与我们进行解耦,我们已经联合了大约一半的领先芯片制造商,所以这是一个非常、非常强大的故事。

Q - Quinn Bolton{BIO 3192909 <GO>}
那很有趣。然后我的跟进问题是,您在发言中几次提到,到 2027 年底,您将把晶圆级引擎的吞吐量提高 20 倍。这是否消除了您所谈论的这些解耦计算或异构推理的需求?还是说这只会使异构解决方案的整体吞吐量变得更快……

A - Andrew Feldman{BIO 20728605 <GO>}
对。我认为……

Q - Quinn Bolton{BIO 3192909 <GO>}
还是只是更高的吞吐量?

A - Andrew Feldman{BIO 20728605 <GO>}
我认为我们正在探索各种提高吞吐量的方法,对吧?如果你的吞吐量提高 20 倍,而成本保持不变,你的状况就非常非常好,对吧?所以我们——我们的系统正在提高吞吐量。我们正在寻找方法来提高解耦解决方案的吞吐量。我们正在研究各种不同的发明、技术、合作伙伴关系,以延续我们行业领先性能的模式并大幅提高吞吐量。

接线员
谢谢。

A - Andrew Feldman{BIO 20728605 <GO>}
这是一个非常好的问题。我的意思是,这正是我们在路线图中思考的问题,正是这一点。

接线员
谢谢。我们的下一个问题来自摩根士丹利的 Joe Moore。您的线路已开通。

Q - Joe Moore{BIO 17644779 <GO>}
是的。谢谢。关于您刚才谈到的内容,当您谈到解耦解码时,你们在这个方面的商业化进展如何?比如,你们是否——我们知道你们可以进行大规模的快速推理,你们已经做到了,但解耦方面,它现在是否已经准备好部署了?以及——嗯,在接下来的大约一年里,需要做哪些工作才能达到你们所谈论的那种改进?

A - Andrew Feldman{BIO 20728605 <GO>}
当然。我认为我们现在已经在实验室里运行着 GPU 的解耦推理。我认为它将在第四季度部署并可用。

Q - Joe Moore{BIO 17644779 <GO>}
好的。谢谢。然后您在发言中谈到了与已安装的 GPU 基础配合工作的能力。当你们与亚马逊更紧密地合作,与 AMD 更紧密地合作时,这些合作会比你们能够与现有的 NVIDIA 已安装基础 GPU 合作效果更好吗?

A - Andrew Feldman{BIO 20728605 <GO>}
嗯,我认为公平地说,虽然我们还没有做到,但当然可以说,Helios 机架将给我们带来比使用 355s 更大、更好的解决方案,对吧?而 Trainium-3 将给我们带来比使用 Trainium-2 更好的解决方案。如果我们使用其他 GPU,当前世代,即前三代,会给我们比前一代(即前三代减一代)更好的性能。但我认为同样公平地说,前一代在解耦解决方案中的表现将远远优于不在解耦解决方案中的表现。在一个每个人都试图延长其硬件寿命并继续使其交付有价值的令牌的环境中,这是一个重要的选择。

这样说有道理吗?

接线员
谢谢。我们的下一个问题来自瑞穗证券的 Vijay Rakesh。您的线路已开通。

A - Andrew Feldman{BIO 20728605 <GO>}
嘿,Vijay。

Q - Vijay Rakesh{BIO 5884146 <GO>}
是的,嗨。嘿,Andrew。只是几个快速问题。关于您提到的已签约的 600 兆瓦容量和年底前 10 倍的产能增长。您认为这应该有助于加速 2027 年的部分增长吗?

A - Andrew Feldman
是的,当然。我认为我们每天都在全球范围内寻找数据中心容量。我们这样做是因为我们对快速推理有巨大的需求。我们部署得越快,收入增长就越快。这不仅适用于我们的云业务,也适用于我们客户的本地部署业务,对吧,他们获得数据中心的越快,我们就能越快地向他们发货硬件。所以这是头等大事。这是我花费大量时间的事情。我们现在有一个完整的团队。我们在全球范围内追逐数据中心方面已经相当擅长。一旦你签约了,你的工作并没有结束。正如您所熟知的。我们每天都有人在现场。我们在每个阶段都与开发商和建筑公司接触,尽力让他们按计划进行。因此,我们做得越快,我想我们就能越快提升收入。

Q - Vijay Rakesh
明白了。然后,关于合作伙伴关系,我知道您提到了超大规模企业,但还有一群新兴的 Neocloud(新型云服务商)正在涌现,他们正在获得融资。华尔街正在开发许多融资结构。您认为这个渠道对您来说发展如何?谢谢。

A - Andrew Feldman
当然,对吧。我认为早期,Neocloud 非常专注于 NVIDIA。我认为随着业务对投资者变得更加清晰,一些 Neocloud 正在多元化,并发现自己对单一硬件供应商的依赖程度降低。所以我们在这一类别中的机会很大。有采用多供应商的 Neocloud,有只采用 AMD 的 Neocloud,还有由拥有电力资产的人创办的 Neocloud,我认为在 2027 年,这将是我们业务的重要组成部分。

市场有风险,投资需谨慎。本文不构成个人投资建议,也未考虑到个别用户特殊的投资目标、财务状况或需要。用户应考虑本文中的任何意见、观点或结论是否符合其特定状况。据此投资,责任自负。