Cerebras Systems 股价下跌 7%,此前业界猜测 OpenAI 绕过了该初创公司的专用 AI 硬件来为其新发布的高速 AI 层 GPT-6.1 Sol Ultrafast 提供支持。
在您购买 NVIDIA 之前:我们的 AI 模型的股票选择优于市场 120% 以上。立即查看列表 »
当半导体研究公司 SemiAnalysis 在 X(前身为 Twitter)上发布消息称 OpenAI 的最新旗舰模型正在传统 Nvidia GPU 上以低批量运行,而不是在 Cerebras 芯片上运行时,引发了抛售。这一消息立即引发了分析师的质疑,即 Cerebras 是否会在未来为备受期待的 GPT-6.1 Sol Ultrafast 模型提供服务,从而打击近期投资者的信心。
OpenAI 最近推出了其“超快”层,承诺代币生成速度比标准部署快八倍(估计达到每秒 300 个代币)。以如此极高的速度生成文本需要大量内存带宽,以便在请求到达时立即处理请求,而 Cerebras 的硬件正是为了解决这一计算挑战而设计的。
通过将自己定位为传统 GPU 集群的首要替代品,Cerebras 凭借其晶圆级引擎 (WSE) 建立了声誉。与标准处理器不同,WSE 是一块巨大的平板大小的芯片,在一块硅片上容纳了数十亿个核心和大量内存。这种架构使其能够将整个大规模神经网络直接保存在芯片上,理论上可以实现闪电般的快速响应,而不会出现在数百个独立 GPU 之间重新整理数据的延迟。
找不到合适的股票?我们的人工智能 10 月份投资者级股票精选名单刚刚下降 »
SemiAnalysis报告的技术关键在于“低批量”这句话。
在人工智能推理中,“批处理”是指将多个用户查询分组在一起并同时处理它们,以最大限度地提高 GPU 效率。传统的 Nvidia GPU 通常需要大批量才能实现峰值利用率和成本效益。相反,“低批量大小”(一次处理一个或几个请求)优先考虑即时响应速度(低延迟)而不是最大吞吐量——在这一领域,Cerebras 的海量片上内存通常拥有明显的架构优势。
如果 OpenAI 已成功优化 Nvidia GPU,以低批量且具有成本效益的效率运行像 GPT-6.1 Sol 这样的前沿模型,它将直接挑战 Cerebras 最有力的卖点之一。
这一猜测触及了 Cerebras 增长叙事的核心。为 OpenAI 等顶级厂商提供先进、高速的人工智能推理工作负载被认为是人工智能硬件挑战者的圣杯。虽然人工智能芯片市场正在迅速扩张,但英伟达根深蒂固的 CUDA 软件生态系统和不断的硬件改进使其成为了令人敬畏的老牌企业。
如果 Nvidia 现有的基础设施本身就能实现下一代实时人工智能代理所需的超低延迟,投资者担心像 Cerebras 这样的专业替代品可能会在确保企业数据中心合同方面面临一场更加艰难的战斗。 Cerebras 尚未发表公开声明,确认或否认其参与 OpenAI 未来基础设施路线图。
原创文章
据报道 Nvidia 为 OpenAI 的“超快”层提供支持,Cerebras 股价下跌
花旗对陶氏化学和利安德巴塞尔持谨慎态度:需求疲软限制聚乙烯上涨空间