SpaceXAI 引入了英伟达的下一代 AI 专用 CPU “Vera”,旨在提高 AI 代理的任务处理速度并实现效率最大化。
想象一下。你早上醒来对 AI 助理说:“整理一下今天下午的会议资料,并发送邮件给团队成员。”以前的 AI 可能只会帮你总结内容,但现在的 AI 可以直接打开文件、搜索信息、开启邮件程序并完成发送。我们将这种自主规划并使用工具的 AI 称为“代理 AI”(Agentic AI,即能够自主判断、使用工具并执行任务的 AI)。
然而,随着这种代理 AI 变得越来越聪明,计算机的“大脑”背后的负担也越来越重。最近,SpaceXAI (SpaceXAI) 宣布引入英伟达 (NVIDIA) 的新型 CPU “Vera”,以加速代理 AI 时代的发展。这究竟是一款怎样的 CPU,为何能引起 AI 行业的如此关注?
为什么这很重要?
到目前为止,AI 技术主要集中在提升“模型本身”的智能。然而,对于代理 AI 来说,将模型输出的答案转化为现实世界的执行过程至关重要。在这个过程中,涉及处理工具、执行代码、管理数据等,使得 CPU(中央处理器,计算机的大脑)需要处理的复杂任务急剧增加。
简单来说,如果 AI 模型是聪明的主厨,那么 CPU 就是负责厨房备菜和准备工具的助理厨师。如果 CPU 无法及时处理这些工作,那些昂贵的 GPU(图形处理器,负责高强度计算的核心部件)就会因为等待指令而闲置。Vera CPU 的引入将使代理 AI 的运行如同齿轮啮合般顺滑,从而显著提高用户感受到的 AI 响应速度和处理能力。
打个比方
想象一下你聘请了一位顶级“厨师 AI”。无论厨师知道多么精湛的食谱,如果厨房设备不能及时处理食材,做菜的速度也必然会变慢。
迄今为止的普通 CPU 就像“家用厨房设备”,无法完全跟上专业厨师 AI 的工作节奏。相比之下,Vera CPU 从一开始就被设计为“超高速大型餐厅专用厨房设备”。英伟达 Vera 是首款专为 AI 代理打造的 CPU。
也就是说,当 AI 模型下达“写邮件!”指令时,Vera CPU 可以无需等待立即执行代码并处理数据,迅速发送邮件。在此过程中,它比传统 CPU 的效率提高了两倍,得出结果的速度也快了 50%。
当前现状
目前,包括 SpaceXAI 在内,OpenAI、Anthropic、Oracle 等全球 AI 领军企业已经开始接收并引入这款 Vera CPU(英伟达 Vera CPU 开始出货)。Vera CPU 针对 AI 代理在处理使用工具、编写代码、分析数据等 CPU 密集型任务方面进行了优化。
SpaceXAI 已经制定了将其用于下一代 AI 工作负载的计划,特别是在解决轨道 AI 部署等高难度技术挑战方面,人们对其寄予厚望。这标志着 AI 已不仅仅是一个聊天机器人,正迈向解决更复杂的现实世界问题。
未来会怎样?
在代理 AI 时代,仅靠模型本身聪明是不够的。模型与基础设施能否有机连接将成为关键。在构建和运行代理系统的整个过程中,CPU 位于决定响应速度和学习效率的核心路径上。
以后当你给 AI 分派任务时,它将像真正的助理一样,处理过程顺畅无阻。Vera CPU 等专用处理器的出现,正在让我们所憧憬的“真正 AI 自动化”未来更进一步。
MindTickleBytes 的 AI 记者视角
代理 AI 的发展现在不仅需要软件的更新,更要求硬件的重组。随着 AI 技术的发展,基础设施的效率——即如何将模型的智能连接到现实世界的工具——正成为拉开差距的关键。归根结底,AI 的完整度取决于聪明的大脑(模型)与快速精准的手脚(CPU/GPU)协作得有多好。
参考资料
- SpaceXAI Adopts NVIDIA Vera CPU to Accelerate Agentic AI at Massive Scale
- SpaceXAI Will Use NVIDIA Vera CPUs To Power Its Next-Gen Agentic AI Workflows
- SpaceXAI uses the NVIDIA Vera CPU to accelerate agentic AI
- NVIDIA Vera CPU Targets Agentic AI Efficiency - Blockchain.News
- Nvidia(NVDA) Begins Shipping Vera CPUs to AI Industry Leaders - Parameter
- If AI, Data, Power, Nemotron Coaliton, Vera CPU, NemoClaw, Physical…
- AI Innovators Adopt NVIDIA Vera — Why Max Single-Threaded CPU at Scale Matters
- 它是专用于图形处理的 CPU
- 它是专为代理 AI 工作负载而设计的
- 它是智能手机专用处理器
- 提高 AI 代理的运行速度并最大化 GPU 利用率
- 完全消除功耗
- 增加聊天机器人的对话长度
- 较现有水平提升 10%
- 较现有水平效率翻倍,结果处理速度提升 50%
- 较现有水平速度提升 100 倍