872
0
2691
超级版主
摘要:8 月 18 日 Cerebras 在 SUPERNOVA 大会发布第四代机架级系统 CS‑4,搭载 3 颗 WSE‑3 Turbo 晶圆级处理器。官方测试中,在 GPT‑OSS‑120B 模型下单用户 Token 吞吐最高可达主流 GPU 方案 30 倍,目标面向万亿、甚至 50 万亿参数级大模型与 AI 智能体业务。本文梳理硬件规格、架构创新,同时说明性能测试边界与行业客观争议。 当地时间 8 月 18 日,晶圆级计算厂商 Cerebras 正式对外发布第四代机架级 AI 系统CS‑4,整套系统以整张硅晶圆作为处理器单元,不再对晶圆进行切割,延续其独有的晶圆级引擎 (WSE) 技术路线。
摘要:8 月 18 日 Cerebras 在 SUPERNOVA 大会发布第四代机架级系统 CS‑4,搭载 3 颗 WSE‑3 Turbo 晶圆级处理器。官方测试中,在 GPT‑OSS‑120B 模型下单用户 Token 吞吐最高可达主流 GPU 方案 30 倍,目标面向万亿、甚至 50 万亿参数级大模型与 AI 智能体业务。本文梳理硬件规格、架构创新,同时说明性能测试边界与行业客观争议。
⚠️重要边界提示:30 倍为特定测试场景的上限值,并非所有模型、上下文长度、精度下都可以达到该倍率;实际业务吞吐量受模型、上下文窗口、并发数量、计算精度共同影响,现实部署性能会存在折扣36氪。
举报
本版积分规则 发表回复 回帖后跳转到最后一页
相关侵权、举报、投诉及建议等,请发 E-mail:2026@typc.net
Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|晋ICP备2026008270号-1|晋公网安备14010602111293号