Веб-версияОткрыть в Telegram

ПостNVIDIA заявила о 30-кратном росте эффективности Vera Rubin NVL72 для AI-агентов

24 августа 2026
P
Python RU
Фотография
нажмите — покажем
NVIDIA заявила о 30-кратном росте эффективности Vera Rubin NVL72 для AI-агентов По новым замерам NVIDIA, система Vera Rubin NVL72 показывает до 30x больше throughput на мегаватт и до 35x меньшую стоимость токенов по сравнению с GB300 NVL72 на агентных нагрузках. Тестировали не обычный чат, а реальные coding-сессии из SemiAnalysis AgentX: длинный растущий контекст, вызовы инструментов, запуск субагентов и многошаговое рассуждение. По данным OpenRouter, такие сценарии могут потреблять примерно в 15 раз больше токенов, чем обычный запрос в чат. В Vera Rubin NVIDIA отдельно оптимизировала работу с длинным контекстом: distributed KV-cache, KV-aware routing, разделение prefill и decode, expert parallelism и новые CUDA-кернелы. На DeepSeek V4 Pro Vera Rubin NVL72, по данным NVIDIA, даёт до 30x больше throughput на мегаватт относительно GB300 NVL72. Эти результаты пока ожидают проверки SemiAnalysis. https://blogs.nvidia.com/blog/vera-rubin-nvl72-efficiency-ai-agents/
4 · 1.5K ·

Рядом в ленте

PPython RU🔥 Хочешь быстрее расти в IT? Хватит учиться в одиночку Окружение решает больше, чем кажется. Собрал папки и каналы, где можно быстрее влиться в нужное направленPPython RUПроект Python опубликовал документацию на русском языке Объявлено о переводе на русский язык официальной документации по языку программирования Python. На русск
это сообщение
PPython RUФотографияPPython RU🔥 Вышли официальные GGUF-квантизации GLM-5.3 Flash Uncensored Модель: 320B параметров, 18B активных. Доступные варианты: - Q6_K — 263 ГБ / 94,3% Top-1 - Q4_K_M

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем