Google 正在为 AI 代理工作负载准备数据中心

该公司正在开发新芯片,升级软件、网络和存储系统。

来源:OSP网站大数据新闻

随着人工智能代理的日益普及和用例的增加,谷歌正在准备新的芯片来支持中间件的变化,以及改造网络和存储系统以加速模型的训练和推理。据谷歌称,该公司的数据中心每月处理约 3.2 千万亿代币,大约是 2025 年 5 月的七倍。

Google 的数据中心架构现代化愿景包括升级硬件、软件和编排层,以便与 AI 代理无缝运行,从而提供比非代理工作负载多 100 倍的推理事务。谷歌数据中心重新设计的基础设施堆栈足够高效,可以将代理分布在系统的不同集群中,使它们能够长时间连续工作并做出独立决策。

让智能体更快地行动、推理和决策的最重要条件是系统中没有瓶颈的高效数据流。谷歌已将 Google Kubernetes Engine 托管服务调整为基于代理的环境,其中人工智能代理可以在沙箱和容器中快速启动。

Google自己的芯片也得到了显着改进,以支持中间件的变化。最近推出了用于训练的 TPU-8t 张量处理器和用于推理的 TPU-8i。 TPU-8t 的性能是 Ironwood 芯片的三倍,TPU-8i 拥有 384 MB SRAM 和 288 GB HBM3e,比上一代芯片增加 50%。

全新 Axion N4A CPU 为基于代理的任务(例如编排和工具调用)提供了更高的能效。

网络和存储系统已升级,以减少训练和推理时间。因此,TPUDirect 技术允许您快速将数据从存储系统移动到张量处理器的内存,而无需编排开销。