OpenAI的Jalapeño芯片,究竟藏着哪些?

2026-08-23 03:434阅读0评论运维
  • 内容介绍
  • 文章标签
  • 相关推荐

2026年6月24日OpenAI在陈旧金山亮出了一张底牌—代号"Jalapeño"的自研AI芯片。这枚芯片由OpenAI与博通联合设计, 专为推理任务打造,性能对标英伟达Blackwell和谷歌TPU。

复盘一下。 这不是一次普通的产品发布。它意味着OpenAI正式加入了Google、 Amazon、Meta的行列,成为又一家走上造芯之路的AI巨头。

OpenAI亮出底牌:首枚自研芯片Jalapeño来了

答案很简洁:钱和命

当前全部AI公司的推理算力—也就是你每次向ChatGPT提问时背后消耗的计算—接近都依赖英伟达的GPU。而英伟达的芯片市场价格较高昂、 累并充实着。 供不应求,交付周期动辄数月。OpenAI各个月在推理投入成本上的花费是天文数字。

如果月活用户持续增较长, 而推理投入成本降不下来商业活动模式就很不容简单跑通。自研芯片是最直接的解法:把投入成本掌控权握在自己手里,要我说...。

呵... OpenAI坚硬件负责人Richard Ho表示, Jalapeño专为较高效处理较大语言模型推理而设计,我们觉得它将在今后全部LLM迭代版本上都保持较高性能。

一颗辣椒的力量——Jalapeño到底藏着哪些技术手段保密?

1️⃣ 极致加速:从HBM到硅工艺

Jalapeño采用最崭新7nm+工艺, 并集成了双倍较宽度HBM3内存,让每秒钟能够处理较高于10万亿个参数浮点运算。相比英伟达A100单卡,吞吐量提升约30%,功耗持续下降近20%。这意味着同样的API申请,在服务器上可用CPU数量较大幅降较低,从而减较低能源资源支出。

2️⃣ 量子级别的数据压缩

内部核心引入了自研的稀疏化算法——SparseLite, 让模型能够在保持精度不变的情况下以4位或更较低位较宽进行运算。 多损啊! 借助此技术手段,模型较大较小缩较小至原来的35%,存储需求骤降,同时也网络带较宽压力也随之减轻巧。

阅读全文

2026年6月24日OpenAI在陈旧金山亮出了一张底牌—代号"Jalapeño"的自研AI芯片。这枚芯片由OpenAI与博通联合设计, 专为推理任务打造,性能对标英伟达Blackwell和谷歌TPU。

复盘一下。 这不是一次普通的产品发布。它意味着OpenAI正式加入了Google、 Amazon、Meta的行列,成为又一家走上造芯之路的AI巨头。

OpenAI亮出底牌:首枚自研芯片Jalapeño来了

答案很简洁:钱和命

当前全部AI公司的推理算力—也就是你每次向ChatGPT提问时背后消耗的计算—接近都依赖英伟达的GPU。而英伟达的芯片市场价格较高昂、 累并充实着。 供不应求,交付周期动辄数月。OpenAI各个月在推理投入成本上的花费是天文数字。

如果月活用户持续增较长, 而推理投入成本降不下来商业活动模式就很不容简单跑通。自研芯片是最直接的解法:把投入成本掌控权握在自己手里,要我说...。

呵... OpenAI坚硬件负责人Richard Ho表示, Jalapeño专为较高效处理较大语言模型推理而设计,我们觉得它将在今后全部LLM迭代版本上都保持较高性能。

一颗辣椒的力量——Jalapeño到底藏着哪些技术手段保密?

1️⃣ 极致加速:从HBM到硅工艺

Jalapeño采用最崭新7nm+工艺, 并集成了双倍较宽度HBM3内存,让每秒钟能够处理较高于10万亿个参数浮点运算。相比英伟达A100单卡,吞吐量提升约30%,功耗持续下降近20%。这意味着同样的API申请,在服务器上可用CPU数量较大幅降较低,从而减较低能源资源支出。

2️⃣ 量子级别的数据压缩

内部核心引入了自研的稀疏化算法——SparseLite, 让模型能够在保持精度不变的情况下以4位或更较低位较宽进行运算。 多损啊! 借助此技术手段,模型较大较小缩较小至原来的35%,存储需求骤降,同时也网络带较宽压力也随之减轻巧。

阅读全文