OpenAI研究员盛赞AMD联合AI推理方案:表现“令人难以置信”

发布时间:2026-07-29 11:14

  该解决方案主要针对超低延迟 AI 推理场景,将整合 AMD 的 Helios 机架级解决方案与 Cerebras 的晶圆级引擎,从而应对英伟达和 Groq 合作。

  按照双方披露的路线,Helios 机架承担高性能、可扩展吞吐引擎角色,主要处理提示词与大上下文窗口。

  Cerebras 的 Wafer-Scale Engine 则负责对内存带宽要求更高的 Token 生成与解码环节,强调超低时延表现,结合使用 2 个计算引擎,预估可以将每瓦每秒 token 数量提高 5 倍。

  我们内部在 Cerebras 芯片上运行某些 OpenAI 模型,表现非常出色,其推理速度非常亮眼。 对于我们日常工作而言,以前我可能需要等待几分钟才能完成一项任务,而现在切换任务的瞬间,该任务就已经完成了,这大大提高了我们的工作效率。

排行

精选