OpenAI показала чип Jalapeño: він розгромив флагмани Nvidia
OpenAI набридло віддавати всі гроші Nvidia: компанія презентувала власний чип для інференсу нейромереж, який виявився значно швидшим та енергоефективнішим за топові системи конкурентів.
Компанія OpenAI опублікувала результати тестування власного прискорювача під кодовою назвою Jalapeño, зіштовхнувши його з комерційними системами на базі Nvidia GB200 та GB300 у публічному бенчмарку InferenceX.
Власний ASIC продемонстрував тотальний відрив у швидкості генерації токенів. На моделі DeepSeek R1 670B залізо видало близько 700 токенів на секунду на користувача проти 169 у конкурента, на Kimi K2.5 зафіксували 694 проти 182, а на GPT-OSS 120B швидкість досягла 1459 токенів проти 535. У пікових навантаженнях розробка показала до 1,9 раза більше корисної роботи на ват зі зниженням затримки до 3,6 раза.
Архітектуру спроєктували суто під генерацію відповідей та агентні задачі, інтегрувавши кеш моделі впритул до обчислювальних ядер. Попри паспортний ліміт у 700 Вт, реальне споживання плати під навантаженням не перевищувало 550 Вт.
Для оптимізації софтверної частини залучили самі нейромережі: інструменти Codex та GPT-Astra скомпілювали низькорівневі блоки уваги та MoE, які виявилися до 1,8 раза швидшими за вручну написаний експертами код. OpenAI розраховує розгорнути перші партії кремнію у власній інфраструктурі до кінця року, паралельно розробляючи друге та третє покоління.
Монополія універсальних графічних карт починає тріщати під тиском спеціалізованого заліза. Коли софтверні корпорації самі проєктують чипи, які значно випереджають серійні прискорювачі, ринок дата-центрів неминуче переходить до нової реальності.
Джерело: openai.com
Коментарі
Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.