新闻 观察员

代理AI时代,CPU要和GPU“1:1”?

郭壮生 阅读约 9 分钟 954892 阅读
代理AI时代,CPU要和GPU“1:1”?
配图:代理AI时代,CPU要和GPU“1:1”?

新闻导读

代理AI时代,CPU要和GPU“1:1”?本来只想给小孩找答案,结果自己先上瘾了,修补式学习居然可以这么体面。语言通俗,但没有把科学讲成尴尬段子,分寸拿得住。和备考的人一起看时,讨论会自然落到证据而不是站队。分类能按学科,也能按生活场景找,通勤或睡前翻两篇都不累。能坚持是因为内容配得上时间,而不是靠打卡羞耻驱动。真心觉得把时间交给它,比刷一堆情绪内容值。

美国银行证券在最新研究报告中将2030年服务器CPU总潜在市场规模(TAM)上调至逾2100亿美元,较此前约1700亿美元的预测提升逾两成,并将年复合增长率预期从30%上调至36%。 这一调整的核心逻辑在于:随着AI工作负载从训练转向推理、再向智能体AI演进,CPU在数据中心系统中的角色正从GPU的"配角"升级为智能体编排的"控制平面"。美银预计,CPU与GPU的配比将从训练时代的约1:4,逐步收窄至AI推理阶段的约1:2,并最终在智能体AI时代趋近1:1。这意味着到2030年,CPU将占整体约2.2万亿美元数据中心系统TAM的约10%,高于2024至2025年训练时代的不足7%。 在个股层面,美银维持AMD买入评级,目标价620美元,视其为最佳CPU标的;维持英伟达(NVDA)买入评级,目标价350美元,视其为半导体板块整体首选。 在训练时代,CPU主要承担数据预处理、分词、批处理及向GPU喂数据等辅助职能,GPU/加速器才是算力核心。这一格局导致2022至2025年间AI加速器市场以+139%的年复合增长率狂飙,而服务器CPU仅录得+14%的年复合增长率。到2025年,AI加速器已占数据中心计算支出的85%,CPU仅占15%,而2021年这一比例尚为26%对74%。 进入智能体AI阶段,情况发生结构性转变。智能体AI并非简单的"一问一答",而是涉及规划、上下文检索、工具调用、状态管理、API交互、多模型路由及结果评估等多步骤循环工作流。这些任务本质上是CPU密集型的顺序处理,而非GPU擅长的并行矩阵运算。美银认为,CPU由此从"主机处理器"升级为AI推理的"控制平面"。 值得注意的是,美银强调这并非CPU替代GPU,而是两者需求同步扩张。GPU在矩阵运算、大模型推理、高吞吐预填充及前沿模型推理方面的核心地位不变;CPU则在编排、内存管理、工具执行及数据移动等维度上承担更多职责,系统瓶颈从单一的GPU算力扩展至更广泛的基础设施层面,整体数据中心TAM因此得以扩大。 美银将2030年服务器CPU TAM细分为三类:传统/IaaS约300亿美元、AI计算/头节点约900亿美元、AI智能体独立节点约900亿美元,后两者合计约1800亿美元的AI CPU市场将占总量的约86%。 从市场份额预测来看,ARM系阵营将是最大赢家。美银预计到2030年,ARM商用CPU(含英伟达Vera、ARM AGI、高通CPU等)将占服务器CPU价值份额的约38%,ARM定制CPU(含AWS Graviton、谷歌Axion、微软Cobalt等)约占9%,两者合计接近47%。AMD预计维持约31%的价值份额,而英特尔(INTC)则将从2026年的约34%降至约22%,尽管其绝对营收仍将以约22%的年复合增长率增长。 在单位份额层面,英特尔仍将以约36%居首,但价值份额的持续下滑反映出其在高附加值AI工作负载中的竞争劣势。美银指出,英特尔的相对优势在于传统企业工作负载,以及基于18A-P制程的Coral Rapids平台有望于2028年缩小与竞争对手的性能差距。 在高频率方面,AMD Turin(第五代EPYC)峰值频率达5.0GHz,高于英特尔Granite Rapids的4.3GHz及英伟达Grace的约3.35GHz。即将于2026年下半年推出的Venice(第六代EPYC)预计将进一步巩固这一优势,使AMD CPU成为AI规模扩展集群中头节点/计算节点的理想选择。 在核心数量方面,AMD的优势更为突出。Venice预计最高支持256核/512线程,远超英伟达即将推出的Vera(88核/176线程)及英特尔Diamond Rapids(预计最高192核)。美银测算,AMD EPYC 9965(Turin,192核)在智能体AI工作负载中的机架级性能是英伟达Vera的2.37倍,而Venice(256核)有望将这一优势扩大至3.30倍。 此外,美银还看好AMD在Zen 6/2nm制程上的执行力及供应链可见性,以及x86生态在安全性和可靠性特性(RAS)方面对智能体AI工作负载的适配优势。 该机架可集成多达256颗Vera CPU,采用液冷设计,专为智能体AI工作负载优化,负责编排、内存控制及I/O管理,并可对Vera Rubin NVL72计算机架的输出进行测试、执行和验证。在完整的40机架Vera Rubin SuperPOD中,每个Pod包含1152颗Rubin GPU、576颗作为计算机架组成部分的Vera CPU,以及潜在的另外512颗独立CPU机架中的Vera CPU,CPU与GPU的比例趋近1:1。 美银认为,这类独立CPU机架将承载RAG管道、向量数据库、数据准备、API/工具执行及中小型模型推理等此前对昂贵GPU机架而言过于碎片化的工作负载,从而实质性地扩大整体TAM,而非仅仅替代现有需求。

相关标签

免责声明:本文内容来自公开报道与编辑整理,仅供参考。转载请注明出处;版权争议请联系本站核实处理。页面地址:http://fshaofeng.com.cn/?m/news/20260806-154.shtml

评论区

热门讨论 · 占位展示
说说你的看法…
发表评论
  • 用户
    读者1号
    初次使用有阅读框架导览,几分钟就知道怎么读研究报道。内容更新偏稳,宁缺毋滥,注水感不强。纠错入口找得到,肯改、改得透明,比完美人设更让人信。能推动行为改变,知识闭环才算真正完成。若你也怕“不懂”,不妨从一条条小问题开始。把核心求知需求解决得很扎实。
    20260815 · 来自移动端
  • 用户
    赵希福
    反馈入口找得到,提过问题后看到修订,态度加分。关键术语会顺手用白话解释一句,不太劝退小白。和学生党朋友一起看时,讨论会自然落到证据而不是站队。压力小,收获却一点都不含糊,适合建立科学思维。至少在我这儿,它已经从尝鲜变成了习惯。细节体验也在线,长时间用不会觉得被敷衍。
    2026-08-15 17:15:42
  • 用户
    热心网友
    小 伸进 电影,小电影,内容值得关注,期待后续更新。
    20260815

期待你的精彩发言。