报告概述
本报告属于广发证券‘AI的Memory时刻’系列专题研究,聚焦SRAM(静态随机存取存储器)在AI推理中的应用。报告首先介绍了存储分级架构中SRAM作为片上高带宽存储层的角色,具备纳秒级访问时延和高确定性带宽。随后分析了SRAM如何降低大模型推理中的权重与激活数据访存延迟,提升Time-to-First-Token和尾时延表现,并以Groq和Cerebras两家明星创业公司为例展示其芯片架构与性能优势。最后讨论了SRAM架构进入主流视野的标志性事件,包括英伟达获得Groq知识产权授权以及OpenAI与Cerebras的大规模合作。报告旨在揭示AI记忆基础设施的价值提升趋势,为投资者提供产业链核心受益标的参考。
报告的核心结论
SRAM可显著提升AI推理速度与稳定性。
相比依赖外置HBM,SRAM集成在计算核心附近,能大幅降低权重与激活数据的访存延迟与抖动。Groq LPU单芯片集成约230MB SRAM,存储带宽达80 TB/s,在Llama3.3 70B模型上维持275-276 token/s稳定推理速度,优于其他平台。Cerebras WSE-3芯片集成44GB SRAM,片上带宽21 PB/s,在GPT-OSS 120B任务中实现超3000 tokens/s输出,较主流GPU云推理快约15倍。
SRAM架构已获得行业主流认可与大规模投入。
2025年12月,英伟达斥资200亿美元获得Groq知识产权非独家授权,包括其语言处理单元(LPU)和软件库,并引入核心工程团队。2026年2月,Cerebras完成10亿美元F轮融资,估值达230亿美元,同时OpenAI与Cerebras签署100亿美元合同,部署多达750兆瓦的定制AI芯片。这些事件标志着SRAM架构从创业公司进入主流视野。
AI记忆基础设施的价值量与重要性将持续提升。
报告指出,AI的Memory时刻来临,AI记忆(包括SRAM等片上存储)持续扩展模型能力边界,AI Agent等应用加速落地,推动上游存储基础设施需求增长。建议关注产业链核心受益标的,如澜起科技、兆易创新等。
报告回答的关键问题
SRAM如何提升AI推理性能?
SRAM作为片上高带宽存储层,集成在CPU/GPU计算核心附近,具备纳秒级访问时延和确定性带宽。在大模型推理中,它减少了对片外HBM的依赖,显著降低权重与激活数据的访存延迟和抖动,从而改善首Token生成时间和尾时延,实现稳定高速推理。Groq LPU和Cerebras WSE-3芯片均以此优势在基准测试中取得领先表现。
Groq和Cerebras的SRAM芯片有哪些技术特点?
Groq的LPU单芯片集成约230MB片上SRAM,存储带宽高达80 TB/s,远高于GPU片外HBM的约8 TB/s,在Llama3.3 70B模型上推理速度稳定在275-276 token/s。Cerebras的WSE-3晶圆级引擎集成44GB SRAM,片上存储带宽达21 PB/s,在OpenAI GPT-OSS 120B推理任务中输出速度超3000 tokens/s,较主流GPU云推理快约15倍,且性价比提升8.4倍。
英伟达和OpenAI为何投资SRAM芯片公司?
英伟达于2025年12月斥资200亿美元获得Groq知识产权非独家授权,包括LPU和软件库,并引入其工程团队,旨在吸收SRAM架构优势以强化自身AI芯片生态。OpenAI于2026年2月与Cerebras签署100亿美元合同部署定制AI芯片,并推出首个运行在Cerebras加速器上的模型GPT-5.3-Codex-Spark,支持超1000 tokens/s的代码生成响应,表明业界对SRAM路线的高度认可和战略投入。
报告中的代表性数据
Groq LPU片上SRAM容量与存储带宽
报告发布时,根据Groq官网,单芯片集成约230MB片上SRAM,存储带宽高达80 TB/s,对比GPU片外HBM带宽约8 TB/s。
Cerebras WSE-3片上SRAM容量与存储带宽
报告发布时,根据Cerebras官网,晶圆级引擎3(WSE-3)芯片集成44GB SRAM,片上存储带宽达21 PB/s,在OpenAI GPT-OSS 120B推理任务中实现>3000 tokens/s输出速度。
英伟达获得Groq知识产权授权的交易金额
2025年12月,根据Groq官网和半导体行业观察公众号数据,英伟达斥资200亿美元获得Groq知识产权非独家授权,包括LPU和配套软件库。
以上数据根据报告摘要整理,具体统计口径和数值请以完整报告原文为准。
完整报告包含什么
- 完整的存储分级架构示意图,展示SRAM、HBM、DRAM和SSD在时延和带宽上的层级关系。
- Groq LPU芯片架构详细示意图及Rack级部署图,帮助理解其并行计算与片上存储交互机制。
- Groq LPU在不同上下文长度下的推理速度基准测试图,展示其维持270+ token/s的稳定性。
- Cerebras WSE-3晶圆级引擎实物示意图及与GPU在速度、延迟上的对比图表,突出其性能优势。
- Cerebras在token/s性价比方面的提升数据图(较主流GPU提升8.4倍)。
- 英伟达与Groq签订非独家授权协议的官方来源截图及条款摘要。
- OpenAI与Cerebras达成合作的官方公告及相关融资信息(10亿美元F轮融资,估值230亿美元)。
- 重点公司估值和财务分析表,覆盖澜起科技、兆易创新、中微公司等产业链标的的评级、目标价及2025-2026年EPS和PE预测。
- 投资建议部分:AI记忆持续扩展模型能力边界,建议关注产业链核心受益标的。
- 风险提示:AI产业发展及需求、服务器出货量、国产厂商进展不及预期等三大风险。
本页内容由川海智库整理,用于帮助读者快速了解报告主题、核心观点和主要内容。由于报告量大、人工能力有限,部分观点、数据、统计口径或表述可能存在偏差,具体内容请以完整报告原文为准。





