调用CPU要排队数日?AWS整顿算力浪费 拟批量关停虚拟服务器
随着人工智能代理兴起,算力资源的缺货窘境,正式从GPU蔓延至CPU。
据报道,亚马逊旗下AWS正彻查工程师对其内部算力资源的浪费问题。今年5月,其已向内部工程团队发出预警,要求各团队严控算力消耗,保障业务能够持续承接客户的算力需求。为此,工程师正在批量关停此前用于软件开发的EC2虚拟服务器。
值得注意的是,此番算力节流不仅针对AI专用芯片,矛头同样对准了长期支撑网络运营的传统CPU服务器。
一名AWS员工透露,过去申请CPU服务器资源几小时内就能审批到位,如今往往要等待数天,这种资源排队的情况十分罕见,甚至会直接拖慢项目推进节奏。对此,AWS回应称,虽然市场算力需求规模巨大,但公司依然可以满足绝大多数内外部客户的算力诉求。
业内分析认为,本轮CPU资源紧张,根源来自AI代理应用的大规模普及。大量企业落地AI代理用于软件开发,带动企业人均IT支出直接翻倍。
眼下,CPU缺货潮正在行业内扩散:英特尔、AMD正分别与客户签署更长期的服务器CPU采购协议,以应对数据中心处理器价格上涨和供应紧张问题。英特尔管理层直言,当前数据中心客户的需求已远超英特尔的供应能力。为应对这一局面,公司将2026年全年的资本支出预期从180亿美元上调至超过200亿美元。
机构认为,服务器CPU需求已供不应求,正复刻存储芯片式的紧平衡周期,量价逻辑同步走强。产业链层面的交叉印证更为鲜明:受AI算力集群部署驱动,服务器CPU年内部分产品价格涨幅已超40%、单月涨幅超10%,交付周期最长拉长至六个月。服务器CPU正步入“类内存/HBM”的紧平衡周期。这标志着CPU从AI周期中被忽视的配角,转变为兼具量增与价升弹性的确定性受益环节。
国泰海通证券指出,随着AI迈向推理与Agentic AI,算力瓶颈正由GPU转向CPU调度执行。CPU在任务规划、数据处理、KV Cache管理、工具调用及多智能体协作中作用凸显,正迎来估值重塑与供需错配,或成继存储后的稀缺溢价环节。未来两三年,CPU供需紧张与涨价压力有望延续。
(来源:天天基金网)

