Bitget App
Торгуйте разумнее
Купить криптоРынкиТорговляФьючерсыEarnПлощадкаПодробнее
Nvidia выпустила новое поколение платформы Rubin, стоимость инференса снижена в 10 раз по сравнению с Blackwell, планируется поставка во второй половине года

Nvidia выпустила новое поколение платформы Rubin, стоимость инференса снижена в 10 раз по сравнению с Blackwell, планируется поставка во второй половине года

美股ipo美股ipo2026/01/05 23:48
Показать оригинал
Автор:美股ipo
Производительность платформы Rubin в обучении в 3,5 раза выше, чем у Blackwell, а производительность при запуске AI-программ увеличена в 5 раз, количество необходимых GPU для обучения гибридных экспертных моделей уменьшено в 4 раза. Дженсен Хуанг сообщил, что все шесть чипов Rubin успешно прошли ключевые тесты, подтверждающие готовность к внедрению по графику. Nvidia заявила, что платформа полностью введена в серийное производство, а такие облачные провайдеры, как Amazon AWS, Google Cloud, Microsoft и Oracle Cloud, будут первыми внедрять её.

Nvidia представила на выставке CES новое поколение AI-платформы Rubin, что свидетельствует о сохранении ежегодного цикла обновлений в области чипов для искусственного интеллекта. Платформа, созданная на базе интеграции шести новых чипов, значительно повысила эффективность обучения и снизила стоимость инференса, а первые поставки клиентам запланированы на вторую половину 2026 года.

Nvidia выпустила новое поколение платформы Rubin, стоимость инференса снижена в 10 раз по сравнению с Blackwell, планируется поставка во второй половине года image 0

5 числа по восточному времени США, в понедельник, генеральный директор Nvidia Дженсен Хуанг в Лас-Вегасе сообщил, что шесть чипов Rubin уже вернулись от производственных партнеров и прошли часть ключевых тестов, проект движется в соответствии с планом. Он отметил: «AI-гонка уже началась, и все стараются выйти на следующий уровень». Nvidia подчеркнула, что эксплуатационные расходы систем на Rubin будут ниже, чем у версий Blackwell, так как для достижения тех же результатов требуется меньше компонентов.

Microsoft и другие крупные облачные провайдеры станут первыми клиентами, внедряющими новое оборудование во второй половине года. Следующее поколение AI-суперфабрики Fairwater от Microsoft будет оснащено системой Nvidia Vera Rubin NVL72 на уровне стойки, масштабируемой до сотен тысяч чипов Nvidia Vera Rubin. CoreWeave также станет одним из первых поставщиков систем Rubin.

Запуск платформы совпал с ростом опасений на Уолл-стрит по поводу усиления конкуренции для Nvidia и сомнений в том, что расходы в AI-секторе смогут поддерживать текущие темпы. Однако Nvidia сохраняет оптимистичный долгосрочный прогноз, полагая, что общий размер рынка может достигнуть триллионов долларов.

Увеличение производительности для новых потребностей AI

Согласно заявлению Nvidia, производительность обучения на платформе Rubin в 3,5 раза выше, чем на предыдущем поколении Blackwell, а производительность при запуске AI-программ увеличена в 5 раз. По сравнению с платформой Blackwell, Rubin может снизить стоимость генерации токенов при инференсе до 10 раз и уменьшить необходимое количество GPU для обучения моделей Mixture of Experts (MoE) в 4 раза.

Новая платформа оснащена процессором Vera CPU с 88 ядрами, производительность которого вдвое превышает аналоги. Этот CPU специально разработан для инференса агентов и является самым энергоэффективным процессором для крупных AI-фабрик, с 88 кастомными ядрами Olympus, полной совместимостью Armv9.2 и сверхбыстрым соединением NVLink-C2C.

Графический процессор Rubin оснащен третьим поколением Transformer-движка с аппаратным ускорением адаптивного сжатия и обеспечивает 50 петафлопс вычислительной мощности NVFP4 для AI-инференса. Каждый GPU обеспечивает пропускную способность 3,6 ТБ/с, а стойка Vera Rubin NVL72 – до 260 ТБ/с.

Успешные испытания чипов

Дженсен Хуанг сообщил, что все шесть чипов Rubin вернулись от производственных партнеров и успешно прошли ключевые тесты, подтверждающие возможность внедрения по графику. Это заявление подчеркивает, что Nvidia сохраняет лидерство в качестве производителя AI-ускорителей.

Платформа включает пять ключевых инноваций: шестое поколение NVLink, Transformer-движок, доверительные вычисления, RAS-движок и Vera CPU. Третье поколение доверительных вычислений делает Vera Rubin NVL72 первой платформой на уровне стойки с защитой данных между CPU, GPU и доменами NVLink.

Второе поколение RAS-движка охватывает GPU, CPU и NVLink, обеспечивая мониторинг состояния в реальном времени, отказоустойчивость и проактивное обслуживание для максимизации производительности системы. Стойка выполнена в модульном исполнении с бескабельными лотками, что позволяет собирать и обслуживать её в 18 раз быстрее, чем Blackwell.

Широкая поддержка экосистемы

Nvidia сообщила, что Amazon AWS, Google Cloud, Microsoft и Oracle Cloud в 2026 году первыми внедрят инстансы на базе Vera Rubin, а облачные партнеры CoreWeave, Lambda, Nebius и Nscale также присоединятся к ним.

Генеральный директор OpenAI Сэм Альтман отметил: «Интеллект масштабируется с увеличением вычислений. Чем больше вычислений, тем мощнее становятся модели, решая более сложные задачи и влияя на людей. Платформа Rubin от Nvidia помогает нам продолжать этот прогресс».

Соучредитель и CEO Anthropic Дарио Амодей отметил, что повышение эффективности платформы Rubin от Nvidia «обозначает инфраструктурный прогресс, позволяющий реализовать более длинную память, лучшее рассуждение и более надежные результаты».

Генеральный директор Meta Марк Цукерберг заявил, что «платформа Rubin от Nvidia способна обеспечить скачкообразный рост производительности и эффективности, необходимый для внедрения передовых моделей среди миллиардов пользователей».

Nvidia также сообщила, что Cisco, Dell, Hewlett Packard Enterprise, Lenovo и Supermicro планируют выпустить серверы на базе Rubin. AI-лаборатории, такие как Anthropic, Cohere, Meta, Mistral AI, OpenAI и xAI, рассчитывают использовать платформу Rubin для обучения более крупных и мощных моделей.

Заранее раскрыты детали продукта

Комментаторы отмечают, что в этом году Nvidia раскрыла детали нового продукта раньше обычного — это часть стратегии компании по сохранению зависимости индустрии от её аппаратного обеспечения. Обычно компания подробно рассказывает о новых продуктах весной на GTC в Сан-Хосе, Калифорния.

Для Дженсена Хуанга CES — всего лишь очередной этап в его марафоне публичных выступлений. На разных мероприятиях он объявляет о продуктах, партнерствах и инвестициях, всё ради ускорения внедрения AI-систем.

Среди новинок Nvidia — сетевые и коммуникационные компоненты, которые станут частью суперкомпьютера DGX SuperPod, но также будут доступны отдельно для клиентов, желающих использовать их более модульно. Этот прирост производительности необходим, так как AI-системы уже стали более специализированными сетями моделей, которые не только анализируют огромные объемы данных, но и решают узкоспециализированные задачи в несколько этапов.

Nvidia активно внедряет AI-приложения во все сферы экономики, включая робототехнику, здравоохранение и тяжелую промышленность. В рамках этих усилий компания анонсировала ряд инструментов для ускорения разработки автономных автомобилей и роботов. Сейчас основная часть расходов на вычисления на базе Nvidia приходится на капитальные бюджеты немногих клиентов, среди которых Microsoft, Google Cloud (принадлежит Alphabet) и AWS (принадлежит Amazon).

Nvidia выпустила новое поколение платформы Rubin, стоимость инференса снижена в 10 раз по сравнению с Blackwell, планируется поставка во второй половине года image 1
Источник: Ведомости Уолл-стрит

1
0

Дисклеймер: содержание этой статьи отражает исключительно мнение автора и не представляет платформу в каком-либо качестве. Данная статья не должна являться ориентиром при принятии инвестиционных решений.

PoolX: вносите активы и получайте новые токены.
APR до 12%. Аирдропы новых токенов.
Внести!

Вам также может понравиться

На фоне роста цен на нефть и фискального давления долгосрочные облигации США распродаются, доходность 30-летних бумаг поднялась до максимума почти за 20 лет

В понедельник доходность казначейских облигаций США в целом выросла, поскольку очередной рост мировых цен на нефть усилил опасения инвесторов по поводу сохраняющейся высокой инфляции, увеличения дефицита бюджета США и роста предложения государственного долга.

智通财经2026/08/17 22:41
На фоне роста цен на нефть и фискального давления долгосрочные облигации США распродаются, доходность 30-летних бумаг поднялась до максимума почти за 20 лет

Ночная торговля на фондовом рынке США | США в июне сократили вложения в американские гособлигации: Китай, Япония и Великобритания также снизили свои вложения. Основные три индекса закрылись снижением, акции SanDisk (SNDK.US) выросли почти на 9%.

По итогам торгов индекс Dow Jones снизился на 272,39 пункта, или на 0,51%, до 53 460,02 пункта; индекс S&P 500 упал на 40,39 пункта, или на 0,52%, до 7 745,37 пункта; индекс Nasdaq Composite снизился на 84,25 пункта, или на 0,32%, до 26 644,91 пункта.

智通财经2026/08/17 22:36
Ночная торговля на фондовом рынке США | США в июне сократили вложения в американские гособлигации: Китай, Япония и Великобритания также снизили свои вложения. Основные три индекса закрылись снижением, акции SanDisk (SNDK.US) выросли почти на 9%.

Доходность 30-летних казначейских облигаций США достигла максимума с 2007 года, выпуск инвестиционных облигаций в США в августе достиг рекордного уровня для этого периода.

В понедельник доходность 30-летних государственных облигаций США на время превысила 5,31%. Компании в условиях бума искусственного интеллекта активно размещают крупные выпуски облигаций, что усугубляет дисбаланс спроса и предложения на рынке долгосрочных бумаг. В августе объем выпуска инвестиционных облигаций в США достиг 145,2 млрд долларов, превысив рекорд августа 2020 года в 136 млрд долларов. Одновременно ежегодный бюджетный дефицит правительства США, близкий к 2 трлн долларов, продолжает увеличивать предложение государственных облигаций.

华尔街见闻2026/08/17 19:21