
Открываем твой цифровой клуб…
Игры и железо
В июне OpenAI представила собственный ИИ-чип Jalapeno, над которым вместе с Broadcom работали специалисты. Вице-президент OpenAI по аппаратному обеспечению Ричард Хо рассказал в интервью Tom’s Hardware, как проходил процесс разработки и чем полученный опыт может быть полезен для всей полупроводниковой отрасли. Источник иллюстрации к материалу — OpenAI.
По словам Хо, активное использование искусственного интеллекта на этапе проектирования позволило сократить общий цикл от традиционных 18–24 месяцев до девяти. При этом утверждается, что речь не идёт о полном замещении инженеров: небольшая по числу сотрудников команда стала гораздо производительнее за счёт ИИ, хотя и пришлось пойти на компромиссы в архитектуре из-за сжатых сроков. В дальнейшем, если потребуется создать более сложный чип, OpenAI планирует делать это быстрее, чем при использовании прежних методов.
Хо подчёркивает, что цель Jalapeno — повысить эффективность вычислительной инфраструктуры в условиях нехватки ресурсов. Чип ориентирован на инференс и должен минимизировать задержки при обработке запросов, чтобы улучшать пользовательский опыт при работе с ИИ-моделями различного поставщика, а не только собственными разработками OpenAI. В этой связи экономия времени и ресурсов в инфраструктуре рассматривается как ключевой фактор.
По позициям руководителя, Jalapeno должен быть совместим с моделями сторонних компаний и легко адаптироваться под них за сравнительно короткое время — на это указываются месяцы для доводки совместимости. Также Хо отмечает, что внутренний спрос на вычислительные ресурсы у OpenAI настолько велик, что говорить об использовании Jalapeno внешними заказчиками ещё довольно долго не приходится.
OpenAI намерена делиться опытом, полученным в ходе разработки Jalapeno, чтобы ускорить выход на рынок новых чипов у других производителей и повысить общую грамотность индустрии. При этом не планируется отказываться от сотрудничества с компонентами других разработчиков, например AMD и Nvidia, если итоговая аппаратная конфигурация ЦОД обеспечивает требуемую производительность при заданном уровне затрат. Новые поколения собственных чипов OpenAI будут выходить по мере готовности и должны приносить заметный прирост производительности по сравнению с предшественниками, без фиксированного графика анонсов.