OpenAI 定制芯片揭示 AI 的下一个战场:算力
2026 年 6 月 24 日,OpenAI 与博通(Broadcom)联合发布 Jalapeño——这不仅是芯片发布,更是一个信号:AI 竞争正在转向计算基础设施。

过去两年,关于 AI 的讨论大多围绕模型能力展开:上下文长度、多模态、编码表现、推理能力、速度。2026 年 6 月 24 日 OpenAI 与博通联合发布 Jalapeño,把注意力引向更深的层面:计算基础设施。OpenAI 称 Jalapeño 为它的第一款「智能处理器」(Intelligence Processor),一款围绕大语言模型推理设计的定制加速器。它不是消费级芯片,而是 ChatGPT、Codex、API 以及未来智能体产品的基础设施。
1. 这不只是芯片的故事,而是全栈信号
Jalapeño 背后的关键词不单是「芯片」,而是「推理」。训练决定模型能学到什么;推理决定每一次用户查询、每一次代码生成请求、每一次 API 调用的成本与体验。OpenAI 将 Jalapeño 描述为针对现代 LLM 推理的「白板式」(blank-slate)设计,其设计参考了自身的模型路线图、内核(kernels)、服务系统与产品需求。
这意味着 OpenAI 不再只构建模型和产品。它还在设计它们之下的基础设施:芯片架构、内存搬运、网络、调度、部署系统和产品体验。AI 竞争的下一阶段不会只由模型决定,还将由算力供给、推理成本、能效和系统工程共同塑造。
2. 为什么推理芯片比看起来更重要
用户所体验到的 AI,大部分都是推理。当一个人向 ChatGPT 提问、当 Codex 修改代码、当 API 返回结构化答案时,系统做的是推理。训练是前期的大工程;推理是日常的运营成本。
路透社报道,OpenAI 和 Anthropic 等 AI 实验室正在为强大的聊天机器人和编码应用争取足够的算力。自研芯片让公司能够降低成本,并创造 Nvidia GPU 之外的替代选择。Jalapeño 专为推理而设计——也就是把用户查询变成答案的那部分计算。
3. 博通的角色:OpenAI 懂工作负载,博通把它工业化
OpenAI 理解模型和产品工作负载;博通理解硅实现、网络和大规模芯片平台。OpenAI 表示,Jalapeño 是基于对 LLM 基础原理的理解从零设计的,而博通和 Celestica 则通过芯片实现、板卡与机架集成、高性能网络和可扩展的生产体系,帮助这个平台实现工业化。
这正是现代 AI 基础设施的本质:芯片只是其中一块。真正的系统还包括内存、网络、机架、数据中心、电力、调度和部署。
4. 10 吉瓦到底意味着什么
2025 年 10 月,OpenAI 与博通宣布合作部署 10 吉瓦(gigawatts)由 OpenAI 设计的 AI 加速器,目标是在 2026 年下半年开始部署,2029 年底前完成。这个数字令人瞩目,但更大的意义在于战略层面:AI 公司需要提前锁定多年的算力产能。
当 AI 产品成为高频服务,算力就不再只是采购清单上的一个条目。它变成一个长期的供应链、能源、数据中心和合作伙伴生态问题。谁能获得更可靠的算力并降低每次推理的成本,谁就有更大的空间改进产品、降低价格、扩大使用量。
5. 这会威胁 Nvidia 吗?
不会立刻。通用 GPU 在训练、研究、实验和多样化工作负载中仍然不可或缺。定制 ASIC 更适合稳定、大规模、效率和成本最关键的推理任务。
更可能的未来不是简单替换 GPU,而是一个分层市场:GPU、TPU、Trainium、定制 ASIC 和专门的推理系统将各自服务不同的工作负载形态。Nvidia 仍然处于中心,但超大规模 AI 提供商将越来越多地为它们最了解的工作负载构建定制硅片。
6. 独立开发者和小团队应该学到什么
这看起来可能只是 AI 巨头的故事,但其中的经验同样适用于更小的构建者。第一,AI 产品的最终形态由成本结构决定。一个好的 AI 应用不只关乎模型质量,还关乎响应速度、可靠性和每个有效操作的成本。
第二,小团队不应该总是默认使用最大的模型。对于工具、迷你应用、知识库、发票工作流或阅读助手,模型路由(model routing)很重要:简单任务可以用更便宜或本地的模型,困难任务再调用更强的系统。
第三,缓存、批处理、提示压缩和结果复用将变得更加重要。OpenAI 正在造芯片,以便在超大规模上降低推理成本。小团队造不了芯片,但他们可以设计出避免不必要调用的系统。
结论
OpenAI 的定制芯片之所以重要,不是因为多了一个硬件发布,而是因为它指明了 AI 竞争的去向。战场正从模型发布向下移动:芯片、网络、数据中心和成本曲线。
未来的 AI 公司不只是拥有最聪明模型的公司,而是能以更低成本、更可靠地把智能交付给更多用户的那家公司。Jalapeño 只是开始。更深层的信号很明确:AI 正在进入计算基础设施时代。
资料来源:[1] OpenAI,「OpenAI and Broadcom unveil LLM-optimized inference chip」,2026 年 6 月 24 日。[2] 路透社,「OpenAI unveils custom chip it designed with Broadcom to boost its AI infrastructure」,2026 年 6 月 24 日。[3] OpenAI,「OpenAI and Broadcom announce strategic collaboration to deploy 10 gigawatts of OpenAI-designed AI accelerators」,2025 年 10 月 13 日。[4] 博通投资者关系,「OpenAI and Broadcom Unveil LLM-Optimized Intelligence Processor」,2026 年 6 月 24 日。