OpenAI 与 Cerebras 达成合作,将新增 750 兆瓦高速 AI 算力以降低推理延迟,让 ChatGPT 在实时 AI 负载下响应更快。
据 OpenAI 新闻页面披露,此次合作的重点是补充高速算力,规模为 750 兆瓦,指向推理环节,即模型响应用户请求的过程。OpenAI 表示,这批算力将降低推理延迟,并使 ChatGPT 对实时 AI 工作负载的运行更快。
孤本观察:此次新增算力被明确投向推理环节,说明响应速度正成为大模型产品的直接竞争指标。但 750 兆瓦的算力规模能否转化为用户可感知的延迟改善,仍取决于后续的实际部署与调度方式。
来源:OpenAI News