首页 - 财经 - 全球市场 - 正文

30倍Token速度挑战GPU王座! 法巴盛赞Cerebras(CBRS.US)CS-4开启“晶圆级+解耦式推理”纪元

(原标题:30倍Token速度挑战GPU王座! 法巴盛赞Cerebras(CBRS.US)CS-4开启“晶圆级+解耦式推理”纪元)

智通财经APP获悉,在人工智能(AI)芯片公司Cerebras Systems(CBRS.US)于周二举办了Supernova Day活动后,法国巴黎银行表示,该公司公布的合作伙伴和相关公告给其留下了深刻印象。

法国巴黎银行分析师Karl Ackerman在给客户的一份报告中写道:“与英伟达(NVDA.US)的LPU一样,Cerebras与OpenAI、亚马逊(AMZN.US)AWS和AMD(AMZ.US)达成的新合作关系凸显出市场对改善推理过程中对延迟高度敏感的解码环节的需求正在不断增长。”

分析师进一步表示,在快速推理方面,新近公布的基于SRAM的CS-4晶圆级引擎(Wafer-Scale Engine)提供了“惊人的43.2 PB/s片上内存带宽”,并配备了一种利用RDMA的新型晶圆I/O接口。Cerebras自豪地表示,CS-4系统生成Token的速度比当前生产环境中的GPU系统快30倍。

此外,分析师表示,Cerebras每年将性能提升一倍、并计划到2027年将吞吐量提高20倍的产品路线图令人钦佩。分析师称:“Cerebras正专注于解耦式推理,通过将其晶圆级引擎定位为超高速解码引擎,以实现快速Token生成,并与AWS Trainium或AMD Helios等计算密集型系统协同工作。Cerebras表示,其解耦式推理系统预计将比GPU快最高10倍,并且相较于仅采用WSE的配置,性能提升5倍。”

最后,分析师表示,Arista Networks(ANET.US)已经成为Cerebras的“关键”网络合作伙伴,并预计随着时间推移,这一合作关系将帮助Arista拓展新的客户应用场景。

据悉,Cerebras周二在Supernova Day活动上正式推出新一代机架级AI系统Cerebras CS-4,宣称其为“业界最快的AI加速器”。该系统面向大模型推理赛道,直接对标英伟达的GPU服务器产品。此外,Cerebras在活动上还宣布了与OpenAI、AMD、Arista Networks、AWS、Figma、Cognition和CrowdStrike等公司的合作伙伴关系。

CS-4是Cerebras新一代Nexus机架级平台架构的首款产品,由三颗全新的Wafer Scale Engine 3 Turbo(WSE-3T)晶圆级处理器驱动。WSE-3T是迄今为止规模最大的AI处理器,每颗芯片集成4万亿个晶体管和90万个AI优化核心,覆盖46,225平方毫米硅面积,内置44GB SRAM。CS-4系统提供750 PFLOPs的AI算力、每秒129.6 PB的内存带宽以及每秒7.2 Tbps的I/O吞吐量。单颗WSE-3T芯片的AI算力从上一代的125 PFLOPS翻倍至250 PFLOPS,内存带宽从21.6 PB/s翻倍至43.2 PB/s。

Cerebras宣称CS-4在推理速度方面树立了新的行业标杆。在GPT-OSS-120B模型上的直接对比测试中,CS-4每用户每秒可生成超过4,400个Token,最高达到GPU方案的30倍。系统可支持超过50万亿参数的模型。与前代CS-3相比,CS-4速度提升两倍,每瓦吞吐量提升10倍,显著改善数据中心的经济效益。

APP下载
广告
下载证券之星
郑重声明:以上内容与证券之星立场无关。证券之星发布此内容的目的在于传播更多信息,证券之星对其观点、判断保持中立,不保证该内容(包括但不限于文字、数据及图表)全部或者部分内容的准确性、真实性、完整性、有效性、及时性、原创性等。相关内容不对各位读者构成任何投资建议,据此操作,风险自担。股市有风险,投资需谨慎。如对该内容存在异议,或发现违法及不良信息,请发送邮件至jubao@stockstar.com,我们将安排核实处理。如该文标记为算法生成,算法公示请见 网信算备310104345710301240019号。
网站导航 | 公司简介 | 法律声明 | 诚聘英才 | 征稿启事 | 联系我们 | 广告服务 | 举报专区
欢迎访问证券之星!请点此与我们联系 版权所有: Copyright © 1996-