Первый ускоритель OpenAI: перчик без перчинки
OpenAI и Broadcom
вышли с первым заявлением о совместном чипе. Имя ему
Легион Jalapeño (Халапеньо).
Это не GPU, но и не экзотика уровня Groq или Cerebras. По всем признакам обычный инференс-ASIC, ближайший родственник Google TPU, где чип и память тоже разделены по архитектуре фон Неймана. Ничего радикального.
Полезной информации в анонсе примерно ноль. Ни архитектуры, ни производительности во флопсах, ни пропускной способности памяти, ни частоты, ни энергопотребления на чип. Только фраза «производительность на ватт существенно лучше текущего SOTA» и обещание техотчета через несколько месяцев. Перец есть, перчинки нет.
Что все-таки известно, и в основном не из анонса, а из прошлых утечек по сделке и
интервью гендира Broadcom Хока Тана.
Производит TSMC, техпроцесс 3нм. Память HBM, поставщики SK Hynix и Samsung. Сеть на Ethernet-стеке Broadcom с коммутаторами Tomahawk, то есть scale-out поверх Ethernet, а не проприетарщина как NVLink у NVIDIA. Сервера собирает Celestica, исключительно под OpenAI. В продажу чип не идет, это чистый внутренний инференс. На инженерных образцах уже гоняют рабочие нагрузки, в том числе GPT-5.3-Codex-Spark.
Лидом разработки стал Ричард Хо, бывший руководитель разработки Google TPU. Это логично, учитывая, что Broadcom плотно связаны с разработкой чипов для Google, как TPU, так и части Google-ARM зоопарка.
Тан в интервью заявил, что Jalapeño «не хуже Blackwell и TPU». Слова главы компании-подрядчика, без единого бенчмарка. Ровно это же в свое время говорили про Amazon Trainium и Microsoft Maia.
И каждый из них продолжил крутить нагрузки на NVIDIA.
Отдельно забавный тейк про «самый быстрый ASIC-цикл в истории» и девять месяцев от дизайна до первого производства, часть которого якобы ускоряли собственными моделями. Девять месяцев, видимо, считают только фазу дизайна.
А самого интересного в анонсе нет, это деньги. В мае The Information
писал, что первую фазу Broadcom готов финансировать только если Microsoft выкупит около 40% чипов. По схеме Microsoft ставит их у себя и сдает обратно OpenAI в аренду. Твердого обязательства Microsoft не давала. Стороны уперлись в принципиальное расхождение: OpenAI хочет дата-центры под свой кремний, Microsoft привычные GPU. При этом сегодня Microsoft уже уверенно вписана в партнеры по гигаваттным дата-центрам с 2026 года. То ли договорились, то ли просто не стали упоминать.
Самая честная деталь от Тана: маржа Broadcom на этом чипе ниже, чем на сетевых свитчах. Виновата дорогая HBM.
Пока что это анонс ради анонса: чип показали, Альтману в руки вручили, а цифры обещают потом.
@anti_agi
Обсуждение 3
Обсуждение не доступно в веб-версии. Чтобы написать комментарий, перейдите в приложение Telegram.
Обсудить в Telegram