OpenAI 发布了自研芯片“墨西哥辣椒”,其生成 AI 回答的效率远超英伟达 GPU,预示着 AI 基础设施市场即将迎来新变局。
试想一下。今天早上,你对着智能手机说:“整理一下今天的日程告诉我。”AI 回答的速度比平时快多了。明明是同一个问题,为什么会更快呢?仅仅是因为 AI 变聪明了吗?不,其实在那背后,还隐藏着一场不为人知的“芯片战争”。
长期以来,英伟达(Nvidia)的 GPU(图形处理器)几乎垄断了 AI “大脑”的角色。然而,随着 OpenAI 最近发布了自研芯片“墨西哥辣椒(Jalapeño)”,这一市场开始出现震荡。这个名字听起来很辣的芯片究竟是什么来头,竟让 AI 行业如此轰动?
为什么这很重要?
回顾我们日常使用的 ChatGPT,我们提出问题,AI 给出回答的过程,专业术语称为“推理(Inference)”。然而,这个过程中消耗着巨额的电力和成本。每天有数百万人提出问题,这笔费用就像滚雪球一样不断增加。
OpenAI 打造的“墨西哥辣椒”,正是为了让这一“推理”过程变得更高效而诞生的。参考资料 1 技术分析师认为,此次发布可能对英伟达的市场统治地位和盈利结构构成重大威胁。参考资料 9 换言之,这意味着 AI 服务将以更低廉、更迅捷的方式渗透进我们的生活,基础设施环境正在发生重塑。
轻松解读
好吧,抛开晦涩的半导体术语,我们打个比方。
如果说英伟达的 GPU 是“样样精通的全能厨师”,那么“墨西哥辣椒”就像是“专为特定料理设计的专用烹饪工具”。全能厨师可以做韩餐、日餐、西餐,但如果需要连续不断地制作大量炒饭,其效率可能还不如一台专用的炒饭机。
参考资料 14 人工智能(AI)给出回答的过程中,最大的瓶颈并非在于“计算数据”本身,而在于“移动数据”。“墨西哥辣椒”通过高效地铺设数据移动路径,实现了算力效率的最大化。参考资料 14 简单来说,就是在制作炒饭的过程中,大幅缩短了搬运食材的路线,从而制造出了一台专用设备。
参考资料 17 这台机器不仅能出色地搬运食材,消耗的电力还不到英伟达高性能设备的一半,同时生成结果的速度却快得多。参考资料 11
当前现状
目前,“墨西哥辣椒”正忠实地履行着其专用“推理加速器”的角色。参考资料 12 但有一点至关重要,“墨西哥辣椒”只擅长“回答”。它无法完成从零开始教授模型的“训练(Training)”工作。参考资料 10
因此,OpenAI 并未完全与英伟达分道扬镳。在开发更高智能的训练阶段,仍然必须使用英伟达的 GPU。参考资料 10, 参考资料 18 与大众的预期相反,这与其说是“与英伟达彻底决裂”,不如说是“为了服务效率优化的职责分担”。参考资料 18
未来展望
未来,AI 服务将会快到让我们难以察觉。参考资料 12 在维持相同能耗的情况下,支持更多用户与 AI 对话,这对企业而言将大大降低运营成本。参考资料 12
对于用户来说,需要记住的是,重要的不再是“使用了最昂贵芯片的 AI”,而是“使用了针对特定目的优化芯片的 AI”。OpenAI 的这次尝试,将成为全球科技巨头们竞相配备最适合自己口味的“AI 专用烹饪工具”的竞争序幕。
MindTickleBytes 的 AI 记者视角
OpenAI 的“墨西哥辣椒”就像一把在英伟达巨大垄断体制上凿开缝隙的小锤子。在追求“万能”的通用 GPU 时代,针对各模型特性设计的定制化芯片,将成为决定 AI 效率的核心竞争力。
参考资料
-
[OpenAI’s Jalapeño: What a Custom AI Inference Chip… Pinggy Blog](https://pinggy.io/blog/openai_jalapeno_custom_inference_chip/) - OpenAI’s Jalapeño Chip: A Custom ASIC to Challenge Nvidia…
- OpenAI Unveils Jalapeño: Its First Custom Inference Chip
-
[OpenAI Jalapeño Breaks Nvidia’s Inference… TechFastForward](https://techfastforward.com/articles/openai-jalapeno-breaks-nvidia-inference-monopoly) - OpenAI’s First Custom AI Chip “Jalapeño”: 50% Cheaper Inference…..
- OpenAI Launches First AI Chip Jalapeño With Broadcom to Reduce…
- OpenAI Jalapeño: Better Than Nvidia Blackwell
- OpenAI’s Jalapeño AI chip brings new ‘threat’ to Nvidia margins as custom silicon gains ground
-
[OpenAI Jalapeño Chip Explained: What OpenAI’s First Custom Inference ASIC Means for GPU Cloud (2026) Spheron Blog](https://www.spheron.network/blog/openai-jalapeno-chip-gpu-cloud-inference-2026/) -
[OpenAI’s 700W Jalapeño ASIC outpaces 1,400W Nvidia flagship GPU — claims up to 1.9x throughput per kilowatt and 3.6x lower latency, co-developed with Broadcom Tom’s Hardware](https://www.tomshardware.com/tech-industry/semiconductors/openai-says-its-jalapeno-chip-beats-nvidias-gb300-in-first-published-benchmarks) -
[OpenAI Jalapeño Results: What the Chip Means for NVIDIA LLM Rumors](https://www.llmrumors.com/news/openai-jalapeno-nvidia-inference-chip) - OpenAI Jalapeño Chip Posts 1.9x Efficiency Lead Over Nvidia; Huang Answers With $96B Quarter
- OpenAI’s First Chip, Jalapeño, Takes Aim at NVIDIA’s Inference Margins
-
[OpenAI Jalapeño Chip: Inference ASIC vs Nvidia GPUs AnIntent](https://anintent.com/blog/openai-jalapeno-inference-asic-vs-nvidia/) - OpenAI ‘Jalapeño’ Chip Benchmark Debut: 700W Processor …
- OpenAI Inference Chip Jalapeño: Not a Nvidia Decoupling
- OpenAI Publishes First Jalapeño Benchmarks Against Nvidia …
- AI 模型推理
- AI 模型训练
- 数据传输优化
- 提升训练速度
- 更低的价格和更高的能效
- 通用数据处理能力
- 是的,已完全替代。
- 没有,模型训练仍然需要。
- 是的,推理任务也继续使用英伟达。