Индустрия искусственного интеллекта столкнулась с физическим пределом: нехваткой электроэнергии. В ответ на этот вызов компания NVIDIA начала глобальное развертывание новой вычислительной платформы Vera Rubin NVL72. Главная цель этой архитектуры — максимизировать количество вычислений на каждый затраченный ватт энергии.
Проблема энергопотребления стала критической с появлением агентных систем. В отличие от традиционных чат-ботов, ИИ-агенты способны выполнять многошаговые задачи, что требует до 15 раз больше вычислительных ресурсов (токенов). Масштабировать такие центры обработки данных на старом оборудовании экономически и физически невозможно из-за ограничений электросетей.
Первые независимые тесты подтверждают заявленные характеристики новой платформы. Провайдер облачной инфраструктуры CoreWeave протестировал работу модели DeepSeek-R1 на оборудовании Vera Rubin. Результаты показали десятикратное увеличение пропускной способности на мегаватт по сравнению с предыдущим поколением Grace Blackwell NVL72.
At SIGGRAPH, NVIDIA Advances Graphics and Simulation With Agentic and Physical AI
Такой скачок эффективности стал возможен благодаря подходу, который создатели называют «экстремальным совместным проектированием». Инженеры перестали собирать серверы из разрозненных компонентов. Платформа Vera Rubin изначально спроектирована как единая система, объединяющая семь различных чипов и пять типов стоечных модулей. Центральным элементом выступает процессор Vera CPU с ядрами Olympus, созданный специально для работы с агентными нагрузками.
Сетевая инфраструктура также претерпела значительные изменения. Для обмена данными внутри стойки используется технология NVLink шестого поколения, обеспечивающая пропускную способность 260 терабайт в секунду. Это позволяет всей стойке серверов функционировать как единый гигантский ускоритель, что критически важно для моделей с архитектурой Mixture of Experts (MoE), где данные постоянно распределяются между различными подсетями.
Особое внимание уделено физической инфраструктуре дата-центров. Стойки Vera Rubin лишены привычных кабелей и вентиляторов во внутренних вычислительных модулях. Использование жидкостного охлаждения с температурой теплоносителя 45 градусов Цельсия позволяет отказаться от энергоемких чиллеров. Для крупных ИИ-фабрик это означает экономию миллионов литров воды ежегодно.
Внедрение новой архитектуры уже влияет на глобальную расстановку сил в технологическом секторе. В Европе компании Microsoft и Mistral используют платформу Vera Rubin для создания суверенной ИИ-инфраструктуры. Это позволяет государственным учреждениям и регулируемым отраслям внедрять передовые модели, сохраняя полный контроль над своими данными в рамках местного законодательства.
Одновременно с этим стартапы, такие как Ineffable Intelligence, используют мощности Vera Rubin в Google Cloud для разработки систем обучения с подкреплением. Вместо работы со статичными наборами данных, их алгоритмы непрерывно обучаются в симулированных средах. Такие циклы обучения требуют минимальных задержек и колоссальной пропускной способности памяти.
Платформа Vera Rubin демонстрирует важный сдвиг в развитии отрасли. Гонка за чистой вычислительной мощностью сменяется борьбой за инфраструктурную эффективность. Способность извлекать больше «интеллекта» из того же объема электроэнергии становится главным конкурентным преимуществом для облачных провайдеров и разработчиков моделей в ближайшие годы.