老董的视界深处

· Citi · 公司/行业基本面

花旗 美国半导体:AI基础设施峰会第1天:AI安全与对齐需要更多的算力,而不是更少

摘要公开阅读;PDF 仅限有效会员阅读与下载,所有会员权限相同。 邮件登录

摘要

花旗研究员参加了在加州圣克拉拉举行的AI基础设施峰会首日,聚焦算力相关要点,核心结论是前沿AI模型开发者将AI安全与对齐视为计算密集型过程,安全要求趋严可能推动更多而非更少的算力需求,与投资者担心“更严格安全监管将拖慢前沿模型开发和算力需求”形成反差。 开发者认为算力扩张并未放缓,瓶颈正从模型架构创新转向获取大规模算力、电力与基础设施,同时通过Astra等平台和Vera Rubin等下一代硬件提升效率;新一代设施可多容纳30-40%的GPU,Vera Rubin开箱即用实现3倍token吞吐提升、优化后达5倍。 Nvidia的Ian Buck指出agentic AI需求是2023年Chat的100倍(ISL/KV Cache Size/对话轮数/子代理数从1K/4K/3/0升至142K/1M/65/4),全栈协同设计在agentic工作负载上带来最高30倍AI工厂吞吐。 Intel CEO陈立武强调公司正从传统CPU厂商转型为全栈AI基础设施公司,管理层级从约10-12层减至4-5层,18A已量产、14A临近发布。 Meta介绍了Titan AI训练集群Prometheus 1GW+的扩张经验,未来几年将走向Hyperion 5GW。 花旗维持三家覆盖公司买入(评级1):INTC目标价130美元、META目标价800美元、NVDA目标价315美元。

主要观点

  • 核心结论:前沿AI模型开发者将AI安全与对齐视为计算密集型过程,安全担忧可能推动更多而非更少的算力需求,反驳了“更严格安全要求将放缓前沿模型开发和算力需求”的投资者担忧
  • 算力扩张并未放缓,瓶颈正从单纯的模型架构创新转向获取大规模算力、电力和基础设施,同时借助Astra等平台与Vera Rubin等下一代硬件提升效率
  • AI基础设施全栈(GPU、网络、电力、散热、数据中心容量)需求将持续强劲;下一代设施可多容纳30-40%的GPU以提升基础设施效率
  • Vera Rubin是重大升级,开箱即用token吞吐量提升3倍、优化后达5倍;随着前沿模型能力更强、需要更广泛测试与对齐,训练与推理基础设施支出都将持续增加
  • Nvidia(Ian Buck):agentic AI需求是2023年Chat的100倍,ISL/KV Cache Size/对话轮数/子代理数分别从1K/4K/3/0升至142K/1M/65/4,需要新基准反映当前工作负载;全栈协同设计在agentic工作负载上带来最高30倍AI工厂吞吐,Vera CPU是规模化下最快CPU和最强单线程CPU
  • CUDA平台实现客户多样性;NVLink Fusion将把下一代d-Matrix XPUs连接到Nvidia AI平台;D-Matrix采用memory-first推理架构补充而非替代GPU,Corsair是高效SRAM推理平台、Raptor瞄准高容量3D堆叠DRAM
  • Intel(CEO陈立武):从传统CPU厂商向全栈AI基础设施公司转型,依靠组织精简、更强的软件能力、先进封装领导力和内存/系统级创新;管理层级从约10-12层减至4-5层;不认为当前AI周期值得担忧,认为AI最终影响将大于互联网;CPU在强化学习、agentic AI、编排层和通用计算仍高度相关
  • Intel制程进展:18A已量产、14A临近发布,0.9 PDK预计10月推出,1.0 PDK预计下季度推出
  • Meta(基础设施负责人Santosh Janardhan):分享Titan AI训练集群Prometheus 1GW+的规模化经验,未来几年向Hyperion 5GW推进;跨多区域建设大型集群数据中心的最大挑战是无损网络
  • 估值与评级:Intel基于SOTP给出目标价130美元;Meta目标价800美元,基于约22倍2027E GAAP EPS 36.92美元、隐含约11倍2027E EV/EBITDA;Nvidia目标价315美元,基于约21倍C27E市盈率;三家公司评级均为1(按Citi评级体系为Buy)

论述逻辑

  • 参会AI Infra Summit Day 1(Santa Clara)获取一线信息 → 前沿模型开发者视安全与对齐为计算密集型过程 → 推翻“安全监管收紧将拖累算力需求”的投资者担忧:安全与对齐需要更多而非更少算力 → 瓶颈从模型架构创新转向获取大规模算力/电力/基础设施 → 训练+推理基础设施支出将持续增加,GPU、网络、电力、散热、数据中心全栈受益(下一代设施+30-40% GPU容量、Vera Rubin 3x开箱/5x优化后吞吐、agentic AI需求为2023年Chat的100x、全栈协同设计最高30x工厂吞吐) → 公司层面印证:Nvidia CUDA客户多样性+NVLink Fusion开放连接XPUs,Intel向全栈AI基础设施转型(组织精简至4-5层、18A量产/14A临近),Meta集群从Prometheus 1GW+迈向Hyperion 5GW → 维持INTC($130)/META($800)/NVDA($315)买入评级

关键展望

  • 报告明确预期:随着前沿模型能力更强、需要更广泛的测试与对齐,训练和推理基础设施支出将继续增加
  • AI基础设施需求展望:下一代设施可多容纳30-40%的GPU,帮助提升基础设施效率以支撑不断增长的AI需求
  • Intel验证点:14A临近发布,0.9 PDK预计10月推出,1.0 PDK预计下季度推出,18A已量产
  • Meta容量路线图:Titan AI训练集群Prometheus 1GW+,未来几年向Hyperion 5GW推进
  • 风险提示:Intel约90%收入来自PC与服务器业务、最大PC OEM客户合计约占45%收入;Nvidia面临游戏市场竞争、新平台采用慢于预期、数据中心与汽车市场波动等下行风险;Meta面临ATT/IDFA变化、广告支出放缓、竞争、元宇宙投资贡献有限及反垄断/数据/隐私监管等风险

推荐标的

  • Intel Corp(INTC.O;现价US$97.14;评级1;目标价$130):基于SOTP分部估值,覆盖分析师Atif Malik;转型全栈AI基础设施公司,18A量产、14A临近
  • Meta Platforms Inc(META.O;现价US$670.24;评级1;目标价$800):基于约22倍2027E GAAP EPS 36.92美元、隐含约11倍2027E EV/EBITDA;看好用户规模、参与度增长、产品超级周期与AI机会
  • NVIDIA Corp(NVDA.O;现价US$212.17;评级1;目标价$315):基于约21倍C27E盈利能力市盈率,与1年均值一致;CUDA生态与agentic AI全栈协同设计强化竞争壁垒

关键图表

图1. NVIDIA CUDA 平台多样性:CUDA 平台赋能的客户多样性

**图1. NVIDIA CUDA 平台多样性:CUDA 平台赋能的客户多样性**

图2. NVIDIA BW 与 VR Token 性能对比

**图2. NVIDIA BW 与 VR Token 性能对比**

查找相关研报 →