Спеціальний висновок OpenAI Jalapeno AI ASIC призначений для внутрішнього використання OpenAI, але компанія відкриває двері для ширшого розповсюдження — компанія каже, що «ще довго працюватиме з Jalapeño».
після Відкрийте для себе ASIC Jalapeño від OpenAIпостало чітке питання: для кого це? Це не означає, що акселератор не має мети, а скоріше те, що OpenAI не чітко визначив, які його цілі в апаратному просторі. З одного боку компанія припустив, що він створює ASIC для своїх власних цілей коли були виявлені OpenAI і Broadcom їхня співпраця минулого року. З іншого боку, OpenAI порівняв Jalapeño з прискорювачами Blackwell від Nvidia та подвоїв його на карті кількох поколінь у Hot Chips 2026. Jalapeno було створено для обчислювальних потреб OpenAI, сказав Річард Хо, керівник апаратного забезпечення OpenAI. Обладнання Tom’s Premium. Але, як каже віце-президент, «чесно кажучи, ви можете використовувати його для всіх», залишаючи двері відкритими для ширшого поширення. Повний текст інтерв’ю можна прочитати тут.
«Ми маємо такий попит на обчислення всередині компанії. Потрібно багато часу, щоб не відставати від нашого постійно зростаючого попиту», — сказав Хо. «Я думаю, що в довгостроковій перспективі ми будемо зайняті лише забезпеченням обчислень для OpenAI. Це не означає, що його не можна використовувати деінде. Я впевнений, що можна, але я вважаю, що наш пріоритет — спершу задовольнити обчислювальні потреби OpenAI».
Конкурентна позиція Jalapeño здебільшого зумовлена тестами OpenAI, якими ділилися під час Hot Chips, у порівнянні SemiAnalysis InferenceX і порівнянні Jalapeño з GB200 і GB300 від Nvidia. ASIC популярні, але конкурентоспроможність для них не є звичною, і це не дарма. Вони призначені для прискорення конкретного навантаження. Однак разом із Jalapeño OpenAI продемонструвала відкриту модель чіпа зваженого прискорення GPT-OSS, а також DeepSeek R1 і Kimi K2.5.
Нові відео відОбладнання Тома
Спочатку OpenAI не планувала демонстрацію на Hot Chips, і компанія не була впевнена, чи буде вона взагалі на заході, сказав нам Хо. Генеральний директор розповів історію OpenAI на сцені Hot Chips, переказавши, як команда інженерів запустила Kimi та DeepSeek у Халапеньо за два місяці між прототипом A0 і презентацією Hot Chips.
(Кредит зображення: OpenAI)
Хоча Хо був ясний, що Jalapeno був і залишатиметься вітчизняним на даний момент, він, безперечно, відкрив двері для ширшого входу на ринок обладнання. Стосовно контрольних показників, показаних на Hot Chips, Хо сказав: «Що ми справді хотіли показати та покінчити з помилковими уявленнями в галузі про те, що наш власний чіп висновку призначений лише для моделей OpenAI… Він програмований і загального призначення, а не жорстко закодований для моделей OpenAI».
Одним із можливих пояснень небажання продавати зовнішнє обладнання є пропозиція. «Є нова основа для пропозиції», — сказав Хо, вказуючи на нещодавню дворічну поїздку Хо та генерального директора OpenAI Сема Альтмана, щоб відвідати фабрики та вимагати збільшення потужності. Хоча Хо каже:[OpenAI is] у хорошому стані» на внутрішньому фронті поставок, постачання для зовнішніх клієнтів, ймовірно, буде іншою історією.
Jalapeño працює з іншими моделями, але головною метою дизайну не було конкурентоспроможність. Коли я запитав про рушійну силу дизайну Халапеньо, Хо прямо сказав: «Це була ефективність». Лідер назвав ефективність двоюрідним братом обчислень, зазначивши, що сучасний центр обробки даних зі штучним інтелектом обмежений обмеженою потужністю, і що більш ефективний механізм ефективніший за обчислення.
Отримуйте найкращі новини та докладні огляди Tom’s Hardware просто у свою поштову скриньку.
Хо також вказав на те саме прагматичне прийняття рішень як рушійну силу дизайну Jalapeno, особливо щодо дизайну коду з внутрішніми моделями OpenAI. “[Codesign is] те, що ви не можете зробити дуже добре зі стороннім постачальником кремнію, тому що в моделях є багато дослідницької IP-адреси, і тому ви не можете поділитися нею широко, оскільки вона стане витоком. Незалежно від того, скільки NDA ви виставите, це з’явиться».
Якби Jalapeño було призначено для більш широкого розповсюдження, це було б не проти платформи Grace Blackwell від Nvidia, а проти новішої платформи Vera Rubin. Хо сказав, що порівняння з Блеквеллом було «тому що це були найкращі опубліковані результати, які ми могли знайти». Однак компанія запровадила більше тестів як проти Vera Rubin, так і для більших контекстних вікон.
Тести InferenceX розглядали лише тести 8k1k, що представляють 8000 вхідних токенів і 1000 вихідних токенів. Хо сказав, що внутрішні тести OpenAI показують, що ASIC «здається, перевершує навіть існуючі тести деяких інших доступних пристроїв». Більш цікавим є порівняння з Вірою Рубін, яка, на думку OpenAI, виглядає добре.
«Очевидно, але це буде, коли ми розгорнемося [Vera Rubin]можливо, навіть VR Ultra в деяких частинах графіка розгортання. Ми зробили наші внутрішні роботи, але, очевидно, ми їх не публікуємо. Вони повинні були надійти від Nvidia та інших людей, які можуть це зробити… так, ми справді добре справляємося з ними», – сказав Хо.
Подальші дії Пристрій Тома в Новинах Googleабо Додайте нас як бажаний ресурсщоб отримувати останні новини, аналізи та огляди на наших каналах.
Національний лідер Полін Хенсон розкритикувала Channel Nine після того, як він показав інтерв’ю з високопоставленим членом Ку-клукс-клану, який її підтримав.…