OpenAI представила Jalapeño — 700-ваттный inference-ASIC на архитектуре Broadcom, опережающий Nvidia Blackwell по показателю токенов на ватт

OpenAI

индустрия офиц. + СМИ 6 ист. ~1 мин

25 августа 2026 года OpenAI раскрыла Jalapeño — свой первый кастомный inference-оптимизированный ASIC, разработанный совместно с Broadcom и изготовленный TSMC по техпроцессу N3P (вычислительный кристалл) / N3E (I/O-чиплет), с памятью HBM4. На чип: 13,4 петаFLOPS в MXFP4, 216 ГБ HBM4 в шести стеках по 12 ярусов, пропускная способность памяти 15,4 ТБ/с, TDP 700 Вт. Стойка: 128 акселераторов, 1,7 эксаFLOPS 4-битных вычислений, 27,5 ТБ HBM4, ~2 ПБ/с пропускной способности памяти. На бенчмарке SemiAnalysis InferenceX показывает 1,5x-1,9x прироста пропускной способности и 1,7x-3,6x снижения задержки по сравнению с конкурирующими системами GB200/GB300, с преимуществом 2,1x-4,1x на сверхмалых задержках.

Почему это важно

Первый кастомный inference-кремний OpenAI и самая серьёзная публичная угроза CUDA-рову Nvidia; указывает на то, что экономика вертикальной интеграции теперь достижима для ведущих лабораторий.

Важность: 5/5

первый кастомный inference-ASIC от OpenAI; опережает Nvidia Blackwell по токенам/ватт

Источники

официальный OpenAI: Jalapeño's first results