Согласно данным приложения Zhihui Caijing, компания по производству AI-чипов Cerebras Systems (CBRS.US) официально представила на презентации SUPERNOVA в Сан-Франциско новое поколение серверных AI-систем - Cerebras CS-4, заявив о ней как о “самом быстром ускорителе искусственного интеллекта в индустрии”. Эта система ориентирована на задачи AI-инференса и напрямую конкурирует с GPU-серверами Nvidia (NVDA.US). Ожидается, что CS-4 начнёт поставляться в третьем квартале 2026 года, в настоящее время образцы проходят тестирование у небольшого числа клиентов.
Технические характеристики: три кристалльных процессора обеспечивают вычислительную мощность 750 PFLOPS
CS-4 — первый продукт новой серверной архитектуры Nexus от Cerebras, приводимый в действие тремя совершенно новыми чипами Wafer Scale Engine 3 Turbo (WSE-3T). WSE-3T — это самый крупный на сегодняшний день AI-процессор, каждый из которых насчитывает 4 триллиона транзисторов и 900 000 специализированных AI-ядер, занимая площадь 46 225 мм² кремния и оснащённый встроенной памятью SRAM объёмом 44 ГБ.
Система CS-4 предоставляет 750 PFLOPS AI-мощности, пропускную способность памяти 129,6 PB/s и I/O-пропускную способность в 7,2 Тбит/с. В сравнении с предыдущей моделью CS-3, скорость CS-4 увеличена вдвое, а производительность на ватт — в 10 раз, что значительно улучшает экономическую эффективность дата-центров. По сравнению с прошлым поколением WSE-3, WSE-3T удвоил вычислительную производительность одного чипа с 125 PFLOPS до 250 PFLOPS и увеличил пропускную способность памяти с 21,6 PB/s до 43,2 PB/s. Потребление энергии одного чипа также выросло с 15 кВт до примерно 33 кВт.
С точки зрения архитектуры, CS-4 внедряет модульную платформу Nexus, разделяя вычисления, электропитание и I/O на независимые компоненты. Модуль преобразования питания был перемещён с традиционного GPU-плата с расстояния около 50 мм от процессора до примерно 0,5 мм, практически устранив потери энергии на уровне платы. Съёмная «рюкзачная» конструкция объединяет преобразователь питания, жидкостное охлаждение и управляющую электронику, сокращая время развертывания системы с нескольких дней до нескольких часов.
Прорыв в производительности: свыше 4400 токенов в секунду на пользователя в тесте GPT-OSS-120B
Cerebras утверждает, что CS-4 устанавливает новый отраслевой стандарт по скорости инференса. В прямых тестах на модели GPT-OSS-120B CS-4 генерирует более 4400 токенов на пользователя в секунду, что в 30 раз превышает показатели GPU-решений. Система поддерживает модели с количеством параметров свыше 50 триллионов.
Технический директор и сооснователь Cerebras, Шон Ли, отметил: “В 30 раз быстрее — это не просто более отзывчивая система, а принципиально новая возможность: агенты могут выполнять инференс, верификацию или вызов инструментов на порядок масштабнее”. Генеральный директор Cerebras, Эндрю Фельдман, добавил: “Ранее быстрая инференция означала использование меньших и менее мощных моделей. Благодаря CS-4 мы достигли лидирующей скорости даже на самых крупных моделях, что кардинально меняет подходы в индустрии”.
С точки зрения энергоэффективности, CS-4 обеспечивает до 10-кратного увеличения производительности на ватт по сравнению с CS-3, что значительно повышает экономическую эффективность дата-центров. Эндрю Фельдман подчёркивает: “Быстрые токены ценнее медленных — CS-4 позволяет генерировать большее количество и более качественные токены в рамках заданного энергопотребления, что радикально изменяет представления рынка”.
CS-4 также отличается на 50% меньшим количеством компонентов, что значительно упрощает и ускоряет установку для клиентов. В архитектуре системы новая платформа Nexus модульно разделяет вычисления, питание и I/O — преобразователь питания теперь находится всего в 0,5 мм от процессора (вместо привычных 50 мм на GPU-плате), что существенно снижает потери энергии и поддерживает более высокую рабочую частоту. Съёмная конструкция “рюкзака” объединяет преобразование питания, жидкостное охлаждение и управляющую электронику в едином модуле, что сокращает развертывание системы с нескольких дней до нескольких часов.
Важно отметить, что система с чипами Cerebras использует статическую оперативную память (SRAM), а не привычную для отрасли DRAM. SRAM обладает гораздо большей скоростью по сравнению с DRAM, но при этом занимает больше места и стоит дороже — кремниевый “блин” размера обеденной тарелки от Cerebras предоставляет необходимое пространство для использования SRAM. К тому же, монолитная конструкция чипа обеспечивает значительно меньшие расстояния передачи данных по сравнению с многочиповыми системами Nvidia или AMD.
Экологическое партнерство: союз с AMD Helios и цель — пятикратное повышение эффективности
Программируемая I/O-подсистема CS-4 поддерживает сетевой стандарт RoCE v2 RDMA на базе Ethernet, облегчая интеграцию с гетерогенными системами. Cerebras уже сотрудничает с AMD (AMD.US) по данной архитектуре: совмещая серверное решение AMD Helios с WSE, можно получить до 5 раз больше токенов на ватт в секунду по сравнению с чистой конфигурацией Cerebras. AWS Trainium также указан в числе партнёров.
Основатель и CEO SemiAnalysis Дилан Пател отметил, что за счёт улучшения в развёртывании и сетевых возможностях CS-4 способна масштабироваться для поддержки крупнейших моделей, создавая “фабрику токенов промышленного масштаба”.
Рынок: после выхода на биржу акции упали на 35% от максимума, CS-4 — ключевая точка поворота
Cerebras дебютировала на Nasdaq 14 мая 2026 года по цене размещения 185 долларов за акцию, открытие составило 350 долларов, а к закрытию акции стоили 311,07 доллара, что отражает рост на 68%. Однако после этого котировки продолжали снижаться, и во вторник цена составила примерно 220 долларов, опустившись примерно на 35% от максимума.
Квартальная отчётность компании неоднозначна: основной доход — 209,9 млн долларов, рост на 103% по сравнению с прошлым годом; однако убыток на акцию составил 2,98 доллара против прибыли 1,91 доллара годом ранее. Прогноз трёхкратного роста основного дохода к 2027 году и оптимистичный взгляд на третий квартал не смогли полностью убедить инвесторов. С другой стороны, объём неисполненных контрактных обязательств достигает 25,4 млрд долларов, что даёт хорошую видимость будущих поступлений.
Значение для отрасли: рынок AI-инференса стоит на пороге трансформации
Выход CS-4 совпал с фазой бурного роста спроса на AI-инференс. По мере того как большие языковые модели переходят от этапа обучения к крупномасштабному внедрению, эффективность инференса становится ключевым критерием конкурентоспособности инфраструктуры искусственного интеллекта. Если заявленный Cerebras 30-кратный прирост производительности подтвердится независимым тестированием, это может серьёзно повлиять на закупочные решения крупнейших операторов дата-центров.
Появление Cerebras CS-4 демонстрирует ускорение конкурентной борьбы на рынке AI-чипов: акцент смещается от задач обучения к инференсу. Вопрос о том, сможет ли система действительно поколебать доминирование Nvidia на рынке AI-инференса, зависит от подтверждения её характеристик независимыми тестами и способности CS-4 масштабно и быстро поставляться — чтобы удовлетворить всё возрастающий спрос операторов гипермасштабных дата-центров на быструю генерацию токенов.
Облачный бизнес Cerebras в сфере инференса продемонстрировал 287%-й рост во втором квартале, достигнув 127,7 млн долларов основного облачного дохода. Выход CS-4 знаменует новый этап перехода компании от продажи аппаратного обеспечения к бизнес-модели предоставления вычислительных мощностей для инференса в аренду.