OpenAI показала собственный чип Jalapeño и язык ядер Gluon
На конференции Hot Chips 2026 компания OpenAI раскрыла технические характеристики своего первого инференс-чипа Jalapeño. Ускоритель разработан совместно с Broadcom и производится по 3-нанометровому техпроцессу TSMC. По данным тестов InferenceX на открытых моделях GPT-OSS и DeepSeek R1, чип показал в 1,5–1,9 раза большую энергоэффективность на ватт и снизил задержку до 3,6 раза по сравнению с Nvidia Blackwell GB300.
Один кристалл Jalapeño выдает 13,4 PFLOPS вычислений в формате MXFP4 и потребляет 700 Вт. Пропускная способность памяти HBM4 составляет 15,4 ТБ/с. Базовая система из двух стоек объединяет 128 чипов с общим потреблением 160 кВт и масштабируется до 2048 ускорителей. Для программирования оборудования OpenAI создала язык Gluon на базе Triton в обход стека CUDA. Базовую библиотеку низкоуровневых ядер, включая код MLA для DeepSeek, сгенерировала модель Codex без участия инженеров.
Чип спроектирован исключительно для внутренней инфраструктуры OpenAI и не поступит в продажу. Первые партии ускорителей заработают до конца 2026 года, а вывод на гигаваттные мощности запланирован на первую половину 2028 года.