ChatCrawlerпоиск по публичному Telegram Открыть приложение
О

Общероссийское движение Предпринимателей

сообщение · 2026-08-30 16:40 UTC
В
OpenAI заявила, что ее Jalapeño обошел Nvidia GB200 и GB300 в задачах инференса: на InferenceX системы с новым процессором дали 1,5–1,9 раза больше работы на ватт и сократили сквозную задержку ответа в 1,7–3,6 раза на GPT-OSS-120B, DeepSeek R1 и Kimi K2.5. Чип рассчитан на 700 Вт, а устойчивое потребление на испытанных нагрузках оставалось на уровне до 550 Вт. Для компании, которая ежедневно обслуживает огромный поток запросов ChatGPT, Codex и API, эти показатели напрямую связаны с себестоимостью каждого ответа. Главный масштаб задан еще соглашением OpenAI и Broadcom на 10 ГВт собственных ускорителей. Развертывание стоек начинается во 2-й половине 2026 года и рассчитано до конца 2029-го. Такая мощность переводит разницу в ваттах и миллисекундах из лабораторной характеристики в расходы на электричество, охлаждение, память, сеть, стойки и площадь дата-центров. Один блок на 128 Jalapeño заявлен на 1,7 экзафлопса вычислений в 4-битном формате. При массовом инференсе снижение числа ресурсов на единицу полезной работы позволяет обслуживать больше запросов той же физической инфраструктурой. OpenAI получила такое преимущество за счет специализации. Компания проектировала Jalapeño вокруг собственных языковых моделей, ядер, движения данных, памяти, сетевого обмена и реальных профилей нагрузки. Broadcom занимается воплощением кристалла и сетью, Celestica — платами и стойками. От начала разработки до передачи дизайна в производство прошло 9 месяцев. Универсальный ускоритель Nvidia обязан обслуживать широкий набор клиентов и задач. Jalapeño создается под тот тип нагрузки, который OpenAI сама генерирует, измеряет и способна менять вместе с программным стеком. Экономическая разница выходит за рамки энергопотребления. Nvidia завершила 2026 финансовый год с выручкой $215,9 млрд и валовой маржей 71,1%, а ее дата-центровый бизнес вырос на 68%. Покупатель GPU оплачивает готовую платформу вместе с коммерческой прибылью поставщика. OpenAI строит чип как внутренний компонент своего сервиса и получает выгоду от снижения полной стоимости обработки запроса, даже если сам процессор продается внутри цепочки без отдельной рыночной наценки. Часть стоимости, которая оседала у поставщика универсальных ускорителей, компания пытается превратить в собственную экономию и дополнительную вычислительную емкость. Jalapeño атакует инференс — постоянно повторяющуюся операцию после обучения модели. Передовые модели по-прежнему требуют внешних ускорителей для тренировки, серийный выпуск Jalapeño зависит от партнеров по производству, памяти, упаковке и сборке. Граница проекта поэтому ясна: OpenAI сохраняет внешнюю цепочку поставок, одновременно забирая себе архитектуру оборудования для крупнейшего потока ежедневных вычислений. Это уже достаточно, чтобы Nvidia потеряла часть гарантированного спроса со стороны одного из самых крупных потребителей ИИ-мощностей. Второй эффект появляется в цене самого ИИ. Более дешевый и быстрый инференс позволяет OpenAI дольше выполнять агентные задачи, обслуживать больше параллельных запросов и снижать стоимость продуктов без пропорционального роста дата-центров. Рост использования затем повышает загрузку собственной платформы и делает следующее поколение специализированных процессоров экономически оправданнее. У OpenAI возникает цикл, в котором масштаб сервиса финансирует собственное железо, а собственное железо удешевляет дальнейший масштаб. Jalapeño поэтому меняет положение OpenAI в цепочке ИИ-инфраструктуры. Компания уже контролировала модель, программный стек и пользовательский продукт, а теперь получает контроль над архитектурой процессора, определяющего цену ответа. На программе в 10 ГВт заявленное превосходство над Nvidia по работе на ватт и задержке превращается в долгосрочное снижение расходов и рост собственной вычислительной емкости. Nvidia сохраняет огромный рынок обучения и универсальных ускорителей. Самый массовый участок работы OpenAI перестает быть для нее безусловно гарантированной продажей. @ex_trakt

Вся лента · оригинал в Telegram

Открыть в Telegram Каталог площадок Искать в ChatCrawler

Слепок открытой публичной ленты из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог