Bitget App
Cмартторгівля для кожного
Купити криптуРинкиТоргуватиФ'ючерсиEarnЦентрБільше
Націлений на Nvidia! Cerebras (CBRS.US) представила "найшвидший AI-акселератор" CS-4, заявляючи, що швидкість інференції у 30 разів перевищує рішення на GPU

Націлений на Nvidia! Cerebras (CBRS.US) представила "найшвидший AI-акселератор" CS-4, заявляючи, що швидкість інференції у 30 разів перевищує рішення на GPU

智通财经智通财经2026/08/19 11:01
Переглянути оригінал
-:智通财经

Cerebras випустила систему CS-4 і назвала її найшвидшим AI-акселератором у галузі.

За інформацією UkrainianTechNews, компанія Cerebras Systems (CBRS.US), що спеціалізується на AI-чіпах, офіційно представила на конференції SUPERNOVA в Сан-Франциско нову генерацію стійкового AI-системи Cerebras CS-4, заявивши її як «найшвидший AI-акселератор в індустрії». Система орієнтована на сегмент AI-інференції, напряму конкурує з GPU-серверними рішеннями Nvidia (NVDA.US). Очікується, що CS-4 почне поставлятися у цьому кварталі (третій квартал 2026 року), наразі деякі клієнти тестують зразки.

Технічні характеристики: три процесори на рівні кристалу забезпечують 750 PFLOPs обчислювальної потужності

CS-4 — перший продукт Cerebras нового покоління стійкової платформи Nexus, оснащений трьома абсолютно новими процесорами Wafer Scale Engine 3 Turbo (WSE-3T). WSE-3T — найбільший на сьогодні AI-процесор: кожен чіп має 4 трильйони транзисторів та 900 тисяч AI-оптимізованих ядер, площа кремнію — 46 225 мм², вбудовано 44 ГБ SRAM.

Система CS-4 забезпечує 750 PFLOPs обчислювальної потужності для AI, 129,6 PB/с пропускної здатності пам'яті та 7,2 Tbps I/O. У порівнянні з попередником CS-3, CS-4 швидше у 2 рази, енергоефективність на ват зросла у 10 разів, що значно покращує економічність дата-центрів. У порівнянні з минулим поколінням WSE-3, WSE-3T збільшує AI-потужність на одному кристалі з 125 PFLOPS до 250 PFLOPS, пропускну здатність пам’яті — з 21,6 PB/с до 43,2 PB/с. Потужність одного чіпа — із 15 кВт виросла до близько 33 кВт.

В архітектурі CS-4 застосовується модульна Nexus-платформа, де обчислення, живлення й I/O розділені в окремі компоненти. Модуль перетворення живлення переміщено з класичної GPU-плати (відстань близько 50 мм від процесора) до 0,5 мм, майже повністю усунувши втрати енергії на платі. Вставна «рюкзакова» конструкція інтегрує живлення, рідинне охолодження й контрольну електроніку в єдиний блок, скорочуючи час розгортання з кількох днів до кількох годин.

Прорив у продуктивності: понад 4400 Token на користувача за секунду у тесті GPT-OSS-120B

Cerebras заявляє, що CS-4 встановлює новий стандарт швидкості інференції. У прямому порівняльному тесті на моделі GPT-OSS-120B, CS-4 видає понад 4400 Token на користувача за секунду — до 30 разів більше, ніж рішення на GPU. Система підтримує моделі з понад 50 трильйонами параметрів.

Головний технічний директор та співзасновник Sean Lie наголосив: «30-кратна швидкість — це не просто більш плавні відповіді, вона дозволяє агентним системам на однаковий реальний час мати більш ніж на порядок більший простір для інференції, верифікації чи виклику інструментів». CEO Cerebras Andrew Feldman зазначив: «Історично швидка інференція означала використання менших, слабших моделей. CS-4 забезпечує галузеве лідерство при роботі з найбільшими передовими моделями, що радикально змінює парадигму».

Щодо енергоефективності, CS-4 на ват у 10 разів продуктивніший за CS-3, суттєво підвищуючи економічність дата-центрів. CEO Andrew Feldman підкреслив: оскільки швидкі Token більш цінні за повільні, CS-4 у заданому енергобюджеті генерує якісніші й загалом більше Token, «радикально змінюючи парадигму».

CS-4 також має дизайн із на 50% меншим числом компонентів, що спрощує й пришвидшує розгортання для клієнтів. В архітектурі нова платформа Nexus розділяє обчислення, живлення й I/O на модулі — блок живлення скорочено з ~50 мм (традиційна GPU-плата) до ~0,5 мм від процесора, що суттєво знижує платні втрати потужності та дозволяє працювати на вищих частотах. Вставний «рюкзак» об'єднує живлення, рідинне охолодження й електроніку керування в окрему одиницю, скорочуючи розгортання з днів до годин.

Слід зазначити, що система Cerebras на рівні кристалу використовує статичну пам'ять (SRAM), а не стандартну для галузі DRAM. SRAM набагато швидша за DRAM, але має більший об'єм і коштує дорожче — кристал розміром із піднос забезпечує необхідний фізичний об’єм. Одночіпова конструкція скорочує дистанцію передачі даних у порівнянні з багаточіповими системами Nvidia або AMD.

Екосистемна співпраця: альянс із AMD Helios, ціль — 5-кратне зростання ефективності

Програмований підсистемний I/O CS-4 підтримує RDMA по RoCE v2 через Ethernet і може інтегруватись із гетерогенними системами. Cerebras вже почала співпрацю з AMD (AMD.US), комбінуючи Helios rack-рішення з WSE; таких Token на ват за секунду генерується у 5 разів більше, ніж у чистих Cerebras-конфігураціях. Партнерами також зазначений AWS Trainium.

Ділан Пател, CEO та засновник SemiAnalysis, коментує: підвищена розгортуваність і мережеві можливості CS-4 дозволять масштабуватися до ще більших моделей, створюючи «масштабну фабрику Token».

Ринковий контекст: після IPO ціна акцій впала на 35%, CS-4 — ключовий переломний момент

Cerebras здійснила IPO 14 травня 2026 року за ціною 185 доларів США за акцію, відкрилася по 350 доларів, закрилася по 311,07 долара (+68%). Однак з того часу акції впали: на вівторок близько 220 доларів, що на 35% нижче максимуму.

Другий квартал приніс змішані фінансові результати: основний дохід — 209,9 млн доларів США (+103% рік до року); проте збиток на акцію — 2,98 долара (рік тому — прибуток 1,91 долара). Прогноз збільшення основного доходу у 2027 році втричі й кращі очікування на Q3 не повністю задовольнили інвесторів. Проте зобов'язання за контрактами складають 25,4 млрд доларів, що забезпечує майбутню стабільність доходів.

Значення для галузі: ринок AI-інференції готується до переосмислення

Вихід CS-4 співпав із стрімким зростанням попиту на AI-інференцію. По мірі переходу великих моделей із стадії тренування до розгортування, інференція стає ключовою конкурентною площиною AI-інфраструктури. Якщо заявлене 30-кратне прискорення буде підтверджено незалежними тестами, це може вплинути на рішення операторів дата-центрів щодо закупівлі обладнання.

Вихід Cerebras CS-4 знаменує зміщення AI-чіпового змагання від тренування до інференції. Чи зможе система реально потіснити Nvidia у сфері AI-інференції, залежить від того, чи підтвердяться заявлені характеристики у незалежних тестах — і чи зможе CS-4 швидко масштабуватися для задоволення зростаючого попиту на швидке генерування Token у супермасштабних дата-центрах.

Хмарні сервіси інференції Cerebras у другому кварталі виросли на 287% рік до року й досягли 127,7 млн доларів основного дохід. Вихід CS-4 означає новий етап переходу Cerebras від продажу обладнання до оренди інференційної потужності.

0
0

Відмова від відповідальності: зміст цієї статті відображає виключно думку автора і не представляє платформу в будь-якій якості. Ця стаття не повинна бути орієнтиром під час прийняття інвестиційних рішень.

PoolX: Заробляйте за стейкінг
До понад 10% APR. Що більше монет у стейкінгу, то більший ваш заробіток.
Надіслати токени у стейкінг!

Вас також може зацікавити

Міністерство фінансів США терміново втручається для стабілізації ринку держоблігацій! Обсяг зворотного викупу довгострокових облігацій США як мінімум подвоївся, прибутковість держоблігацій США знизилася по всій кривій

Міністерство фінансів США у середу повідомило, що щонайменше вдвічі збільшить обсяги операцій з підтримки ліквідності викупу облігацій із терміном від 10 до 30 років.

智通财经2026/08/19 14:01
Міністерство фінансів США терміново втручається для стабілізації ринку держоблігацій! Обсяг зворотного викупу довгострокових облігацій США як мінімум подвоївся, прибутковість держоблігацій США знизилася по всій кривій

AI-центр обробки даних спричиняє вибуховий попит на чипи управління живленням! ADI.US зафіксувала рекордний дохід у третьому кварталі, а прогноз на четвертий квартал перевищує очікування

Завдяки попиту на чіпи, викликаному розвитком штучного інтелекту, результати компанії Analog Devices перевищили очікування.

智通财经2026/08/19 13:36
AI-центр обробки даних спричиняє вибуховий попит на чипи управління живленням! ADI.US зафіксувала рекордний дохід у третьому кварталі, а прогноз на четвертий квартал перевищує очікування

Стратегія новопризначеного CEO щодо виходу з убитків продовжує давати результати! Виторг Target (TGT.US) за другий квартал перевищив очікування, повернення митних зборів сприяло різкому зростанню прибутку, річний прогноз знову підвищено

Завдяки ефективним заходам нового генерального директора Фіделька, які вже приносять результати, Target знову підвищила свої річні прогнози щодо фінансових показників.

智通财经2026/08/19 12:46
Стратегія новопризначеного CEO щодо виходу з убитків продовжує давати результати! Виторг Target (TGT.US) за другий квартал перевищив очікування, повернення митних зборів сприяло різкому зростанню прибутку, річний прогноз знову підвищено