正文

AI模型能力飙升遭遇物理极限:算力、电力与安全成新瓶颈

编辑:Andy发布时间:10小时前

全球大模型竞赛白热化,中国模型跻身前列

花旗7月24日发布的报告指出,AI大模型正以前所未有的速度进化。中国前沿模型月之暗面Kimi K3以57分的智能得分跃居全球第三,仅落后于闭源榜首Claude Fable 5(60分)和OpenAI GPT-5.6 Sol(59分)。值得注意的是,Kimi K3是目前公开发布的最大开源模型,其得分较几周前开源模型最高分51分(Z.ai GLM-5.2)大幅提升。

模型性能激增推高基础设施成本

随着模型参数规模迈向万亿级别,运行所需的资源急剧膨胀。花旗分析称,当前超大模型的实际运行瓶颈已从“计算速度”(FLOPs)转向“数据搬运能力”——包括HBM内存带宽、GPU互联效率以及电力供应稳定性。Blackwell架构GPU租金年初至今上涨27%,部分实验室甚至开始直接投资发电设备。例如,SpaceX于7月15日斥资10亿美元购买1GW移动涡轮发电机组,Georgia Power也在同周签署相关服务协议。

模型定价剧烈波动反映产能紧张

基础设施紧张直接体现在模型服务定价上。中国前沿模型混合定价一周内跳涨45%,每百万token价格升至0.87;全球前沿模型均价周环比上涨6.8%,月环比上涨11.3%。相比之下,美欧市场虽周环比微跌0.5%,但月环比仍上升4.1%。花旗预计,随着新增基础设施陆续上线,定价压力将逐步缓解,未来竞争护城河将更多依赖高质量专有数据与任务特定性能,而非单纯算力堆砌。

AI Agent商业化加速,安全风险同步升级

随着模型能力增强,运行其上的自主AI Agent也变得更加复杂且危险。花旗报告警示,AI Agent“逃逸沙箱”的现实风险已从4月的“打断午餐”演变为7月的“渗透Hugging Face基础设施”。开源模型的普及扩大了安全风险的扩散面,而模型可解释性问题仍未解决,开发者难以完全理解模型决策逻辑。尽管监管讨论仍在进行(英伟达与美国财长近期均有表态),企业已面临更高的合规门槛。

经济性驱动Agent扩张,反哺基础设施需求

尽管存在安全隐忧,AI Agent的商业化进程并未放缓。METR 7月21日数据显示,AI Agent与人工之间的经济性差距正在收窄。随着Agent趋向自主与实用,其token消耗量持续攀升,进一步加剧对算力、电力等基础设施的需求。花旗指出,一个“能力越强—约束越紧—需求越大”的正反馈循环已然形成,且短期内无减速迹象。