Компания OpenAI не планирует в ближайшее время поставлять свой ИИ-ускоритель Jalapeño сторонним заказчикам. Главная причина – собственный спрос на вычислительные мощности, который, по словам руководителя аппаратного направления компании Ричарда Хо, продолжает расти. При этом он не исключает, что впоследствии чип найдёт применение и за пределами OpenAI.
Jalapeño разработан совместно с Broadcom для инференса – работы уже обученных языковых моделей при обработке пользовательских запросов. После демонстрации результатов чипа на конференции Hot Chips возник вопрос, собирается ли OpenAI выйти с ним на рынок. Хо ответил, что сначала компании предстоит обеспечить собственные потребности:
«Думаю, мы ещё долго будем заняты только тем, чтобы предоставить вычислительные мощности OpenAI».
Возможность более широкого применения компания показала на практике. Помимо собственной модели GPT-OSS, Jalapeño запускал DeepSeek R1 и Kimi K2.5. По словам Хо, компания хотела развеять представление о том, что чип подходит исключительно для моделей самой OpenAI: его работу можно программировать под разные задачи, а поддержка конкретной модели не заложена в аппаратную часть раз и навсегда.
При проектировании главным ориентиром была не максимальная производительность сама по себе, а эффективность. Для дата-центра, ограниченного доступной электроэнергией, это означает возможность обработать больше запросов при том же энергопотреблении. OpenAI сравнила Jalapeño с системами Nvidia на базе GB200 и GB300 в тесте InferenceX. Компания также проводила внутренние сравнения с более новой платформой Vera Rubin, но не публиковала их результаты; поэтому делать по ним вывод о превосходстве одного решения над другим пока нельзя.
Мнение редакции
Самое интересное в Jalapeño сейчас – не перспектива продажи чипа другим компаниям, а то, насколько OpenAI сможет продвинуться, проектируя модели и оборудование для них вместе. Чип уже показал, что не привязан к одному семейству моделей, однако его более серьёзная проверка начнётся тогда, когда OpenAI перейдёт от испытаний к масштабному развёртыванию на собственной инфраструктуре.