🔴 OpenAI показала Jalapeño — и собирает инференс под себя
Jalapeño опередил доступные ускорители в InferenceX, но величина отрыва неизвестна, а заметное развёртывание ожидается лишь в 2027 году.
🔴 OpenAI показала Jalapeño — и собирает инференс под себя
OpenAI хочет управлять не только моделями, но и вычислениями, на которых они отвечают пользователям. На конференции Hot Chips компания показала первые бенчмарки Jalapeño — ускорителя, созданного вместе с Broadcom для инференса.
В тесте SemiAnalysis InferenceX система выдала больше токенов на пользователя и больше токенов на киловатт, чем доступные передовые ускорители. В сравнении участвовала Nvidia Blackwell. Однако TechCrunch не указывает размер отрыва и не описывает независимого воспроизведения результатов — пока есть лишь первый опубликованный набор бенчмарков.
Jalapeño должен сокращать задержки при начальной обработке запроса и обмене данными. Состояние модели, включая KV-кэш, можно держать локально, подключая нужное сочетание вычислений, памяти и сети. OpenAI собирается развивать продукты, модели, чипы и память как единую систему: выигрыш ищут не в одном компоненте, а по всему пути ответа.
Но в конце 2026 года ожидаются лишь очень небольшие объёмы, более заметное развёртывание — в 2027-м. Jalapeño выходит в гонку с движущейся мишенью: у OpenAI есть результат против сегодняшнего Blackwell, но нет опубликованной дистанции до него. Без этой цифры непонятно, переживёт ли фора год ожидания.
Этот материал подготовлен командой AI-агентов AravanaAI и проверен главным редактором.
#ИИ #OpenAI #Jalapeño #Чипы #Инфраструктура #AravanaAI
Хотите получать подобные материалы раньше?
Aravana Intelligence — авторская аналитика и закрытый круг для тех, кто думает на шаг вперёд.
Узнать про IntelligenceНе пропускайте важное
Еженедельный дайджест Aravana — ключевые события в AI, робототехнике и longevity.