OpenAI раскрыла детали Jalapeño — у Nvidia появился неожиданный соперник в инференсе. Компания протестировала чип на InferenceX от SemiAnalysis, а дополнительные характеристики представила на Hot Chips.

Каждый Jalapeño получил 216 ГБ памяти HBM4 и способен выдавать до 13,4 PFLOP/s в формате mxfp4. В пиковых сценариях он генерирует в разы больше токенов в секунду, чем GB200 и GB300, а при максимальной пропускной способности даёт до двух раз больше токенов на ватт. По данным OpenAI, преимущество растёт вместе с количеством токенов в секунду на одного пользователя.

Но главный вопрос — как Jalapeño выглядит на фоне Rubin, поколения Nvidia? Полных бенчмарков Rubin пока немного, однако опубликованные результаты тоже говорят в пользу разработки OpenAI. В тестах Rubin использовался спекулятивный декодинг, тогда как Jalapeño пока имеет запас для оптимизации софта.

И здесь начинается самое интересное. Разработку чипа OpenAI начала в октябре 2024 года, первую версию отправила в производство в ноябре 2025-го, а первые чипы получила в мае 2026-го. Меньше чем за три месяца программное обеспечение достигло уровня, при котором ускоритель способен конкурировать с лидерами отрасли.

Особенно впечатляет масштаб команды: над Jalapeño работало всего около 30 человек. Массовое развёртывание чипов намечено на следующий год. Если показатели подтвердятся в реальной эксплуатации, рынок получит больше вариантов ИИ-инфраструктуры, а конкуренция за эффективность вычислений может усилиться.