25 августа OpenAI опубликовала первые измеренные результаты своего чипа для инференса Jalapeño. По данным компании, в проведённых тестах ускоритель обеспечил на 1,5–1,9 раза больше вычислительной работы на ватт и на 1,7–3,6 раза меньшую задержку по сравнению с системами на базе Nvidia GB200 и GB300. Материал опубликован.

Что заявляет OpenAI

Jalapeño — первый собственный чип OpenAI для инференса. В компании сообщают, что результаты испытаний указывают на серьёзный прирост эффективности: больше вычислений на каждый ватт и более быстрые ответы. Внутренние тесты, на которые ссылается OpenAI, демонстрируют сочетание более высокой пропускной способности с меньшей задержкой в рамках одной архитектуры.

Сравнение с Nvidia Blackwell

Сопоставление проводилось с системами на базе Nvidia Blackwell — конфигурациями GB200 и GB300. В этих тестах Jalapeño показал 1,5–1,9-кратное преимущество по объёму выполненной работы на ватт и 1,7–3,6-кратное сокращение задержки. Все приводимые метрики — по измерениям OpenAI.

Компания позиционирует результаты как шаг вперёд в эффективности инференса. Детали методологии и конфигураций в публикации не раскрыты; сравнение ограничено указанными метриками энергии и задержки относительно систем на GB200 и GB300.