OpenAI показала результаты чипа Jalapeño для ИИ-инференса: он обошёл NVIDIA GB300 в тестах

OpenAI опубликовала первые результаты тестов Jalapeño, своего первого собственного чипа для ИИ-инференса, который компания разрабатывает вместе с Broadcom. В испытаниях на публичном бенчмарке SemiAnalysis InferenceX он показал более высокую эффективность и меньшую задержку, чем сравниваемые системы на базе NVIDIA GB200 и GB300. Разработчик также сообщил, что планирует начать внедрение Jalapeño в свою инфраструктуру к концу 2026 года.
Характеристики и результаты тестов
- OpenAI тестировала Jalapeño на GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T.
- На пиковых нагрузках чип показал в 1,5-1,9 раза больше ИИ-работы на ватт.
- Задержка end-to-end оказалась в 1,7-3,6 раза ниже, чем у систем на NVIDIA GB200 и GB300.
- Для интерактивных сценариев OpenAI заявляет преимущество в 2,1-4,1 раза.
- При DeepSeek R1 Jalapeño показал 19 641 mixed tokens per second per kilowatt против 11 781 у NVIDIA GB300.
- Задержка в этом тесте снизилась с 5,99 секунды до 1,65 секунды.
- Рейтинг потребления Jalapeño составляет 700 Вт, а в испытаниях оно держалось на уровне 550 Вт или ниже.
OpenAI отдельно отметила, что чип проектировали вместе с подсистемами памяти, сети, программного обеспечения и rack-scale-инфраструктуры, чтобы сократить перемещение данных. Компания также сказала, что её модели помогали в разработке и программировании самого чипа. От первоначального проекта до tapeout Jalapeño дошёл за девять месяцев.
В июне 2026 года OpenAI и Broadcom уже представляли Jalapeño как первый собственный чип компании для ИИ-инференса. Тогда OpenAI говорила, что он должен опережать существующие ускорители по производительности на ватт, но подробных чисел не приводила. Сейчас у компании уже идёт работа над чипом Gen 2, а над Gen 3 она тоже начала работать.
OpenAI заявляет, что продолжит использовать ускорители NVIDIA и других производителей для обучения и инференса. Компания связывает это с ростом спроса на вычисления в своих планах по внедрению новых чипов. Ранее Nvidia вложила $1,5 млрд в дата-центр для OpenAI.



