简报

  • 根据Gartner周一发布的预测,AI数据中心支出将在未来四年占半导体总收入的一半以上,而2026年这一比例为36.5%。
  • 研究公司表示,数据中心支出的增长将推动全球半导体收入今年超过1.6万亿美元,同比几乎翻倍。
  • 尽管内存收入仍是今年半导体行业整体增长的主要贡献者——预计占2026年半导体收入的54%——但AI数据中心收入份额的增加凸显了“半导体价值创造地点以及行业需求演变方式的转变”,Gartner主任分析师Ben Lee表示。

深度洞察

AI需求正推动更多数据中心建设以支持计算。然而,企业高管正进入一个谨慎部署时代,因为他们需要应对不断上升的AI成本。

供应商已迅速从固定费率订阅定价转向基于使用量或结果的模式。Info-Tech Research Group技术顾问Justin St-Maurice在给CIO Dive的邮件中表示,这种定价转变并非组织能够良好应对的。

“在早期,大多数供应商的策略是让企业‘上瘾’于技术的使用,”他说,“在采用阶段,真实成本实际上被隐藏了。”

但现在,账单迅速堆积。持续循环的代理是AI成本上升的最大贡献者,St-Maurice说。技术会自我怀疑并重新处理数据,以难以预测的方式推高最终成本,他说。

在担忧加剧之际,Snowflake、AWS和Oracle等供应商正在实施功能以帮助企业控制AI成本。

然而,CIO和其他希望更好管理AI开销的高管可能需要关注中国,中国已创建了能够与美国前沿模型竞争的开源模型,St-Maurice说。根据用例,CIO应考虑使用这些模型。

“未来的战略将包括多层计算,桌面设备处理大部分基础工作,并在需要时升级处理复杂任务,”St-Maurice说。

Travelers Insurance构建了自己的大型语言模型以帮助缓解AI成本上升。TravelersLLM处理保险相关查询,运行成本低于前沿模型,Travelers执行副总裁兼首席技术和运营官Mojgan Lefebvre表示。

该公司仍使用前沿模型进行更广泛的推理或编码查询。然而,更便宜的内部模型有助于抵消更高的前沿模型成本,Lefebvre在7月的一次采访中说。