Bitget App
Cмартторгівля для кожного
Купити криптуРинкиТоргуватиФ'ючерсиEarnAIЦентрБільше
Націлений на Nvidia! Cerebras (CBRS.US) представила "найшвидший AI-акселератор" CS-4, заявляючи, що швидкість інференції у 30 разів перевищує рішення на GPU

Націлений на Nvidia! Cerebras (CBRS.US) представила "найшвидший AI-акселератор" CS-4, заявляючи, що швидкість інференції у 30 разів перевищує рішення на GPU

智通财经智通财经2026/08/19 11:01
Переглянути оригінал
-:智通财经

Cerebras випустила систему CS-4 і назвала її найшвидшим AI-акселератором у галузі.

За інформацією UkrainianTechNews, компанія Cerebras Systems (CBRS.US), що спеціалізується на AI-чіпах, офіційно представила на конференції SUPERNOVA в Сан-Франциско нову генерацію стійкового AI-системи Cerebras CS-4, заявивши її як «найшвидший AI-акселератор в індустрії». Система орієнтована на сегмент AI-інференції, напряму конкурує з GPU-серверними рішеннями Nvidia (NVDA.US). Очікується, що CS-4 почне поставлятися у цьому кварталі (третій квартал 2026 року), наразі деякі клієнти тестують зразки.

Технічні характеристики: три процесори на рівні кристалу забезпечують 750 PFLOPs обчислювальної потужності

CS-4 — перший продукт Cerebras нового покоління стійкової платформи Nexus, оснащений трьома абсолютно новими процесорами Wafer Scale Engine 3 Turbo (WSE-3T). WSE-3T — найбільший на сьогодні AI-процесор: кожен чіп має 4 трильйони транзисторів та 900 тисяч AI-оптимізованих ядер, площа кремнію — 46 225 мм², вбудовано 44 ГБ SRAM.

Система CS-4 забезпечує 750 PFLOPs обчислювальної потужності для AI, 129,6 PB/с пропускної здатності пам'яті та 7,2 Tbps I/O. У порівнянні з попередником CS-3, CS-4 швидше у 2 рази, енергоефективність на ват зросла у 10 разів, що значно покращує економічність дата-центрів. У порівнянні з минулим поколінням WSE-3, WSE-3T збільшує AI-потужність на одному кристалі з 125 PFLOPS до 250 PFLOPS, пропускну здатність пам’яті — з 21,6 PB/с до 43,2 PB/с. Потужність одного чіпа — із 15 кВт виросла до близько 33 кВт.

В архітектурі CS-4 застосовується модульна Nexus-платформа, де обчислення, живлення й I/O розділені в окремі компоненти. Модуль перетворення живлення переміщено з класичної GPU-плати (відстань близько 50 мм від процесора) до 0,5 мм, майже повністю усунувши втрати енергії на платі. Вставна «рюкзакова» конструкція інтегрує живлення, рідинне охолодження й контрольну електроніку в єдиний блок, скорочуючи час розгортання з кількох днів до кількох годин.

Прорив у продуктивності: понад 4400 Token на користувача за секунду у тесті GPT-OSS-120B

Cerebras заявляє, що CS-4 встановлює новий стандарт швидкості інференції. У прямому порівняльному тесті на моделі GPT-OSS-120B, CS-4 видає понад 4400 Token на користувача за секунду — до 30 разів більше, ніж рішення на GPU. Система підтримує моделі з понад 50 трильйонами параметрів.

Головний технічний директор та співзасновник Sean Lie наголосив: «30-кратна швидкість — це не просто більш плавні відповіді, вона дозволяє агентним системам на однаковий реальний час мати більш ніж на порядок більший простір для інференції, верифікації чи виклику інструментів». CEO Cerebras Andrew Feldman зазначив: «Історично швидка інференція означала використання менших, слабших моделей. CS-4 забезпечує галузеве лідерство при роботі з найбільшими передовими моделями, що радикально змінює парадигму».

Щодо енергоефективності, CS-4 на ват у 10 разів продуктивніший за CS-3, суттєво підвищуючи економічність дата-центрів. CEO Andrew Feldman підкреслив: оскільки швидкі Token більш цінні за повільні, CS-4 у заданому енергобюджеті генерує якісніші й загалом більше Token, «радикально змінюючи парадигму».

CS-4 також має дизайн із на 50% меншим числом компонентів, що спрощує й пришвидшує розгортання для клієнтів. В архітектурі нова платформа Nexus розділяє обчислення, живлення й I/O на модулі — блок живлення скорочено з ~50 мм (традиційна GPU-плата) до ~0,5 мм від процесора, що суттєво знижує платні втрати потужності та дозволяє працювати на вищих частотах. Вставний «рюкзак» об'єднує живлення, рідинне охолодження й електроніку керування в окрему одиницю, скорочуючи розгортання з днів до годин.

Слід зазначити, що система Cerebras на рівні кристалу використовує статичну пам'ять (SRAM), а не стандартну для галузі DRAM. SRAM набагато швидша за DRAM, але має більший об'єм і коштує дорожче — кристал розміром із піднос забезпечує необхідний фізичний об’єм. Одночіпова конструкція скорочує дистанцію передачі даних у порівнянні з багаточіповими системами Nvidia або AMD.

Екосистемна співпраця: альянс із AMD Helios, ціль — 5-кратне зростання ефективності

Програмований підсистемний I/O CS-4 підтримує RDMA по RoCE v2 через Ethernet і може інтегруватись із гетерогенними системами. Cerebras вже почала співпрацю з AMD (AMD.US), комбінуючи Helios rack-рішення з WSE; таких Token на ват за секунду генерується у 5 разів більше, ніж у чистих Cerebras-конфігураціях. Партнерами також зазначений AWS Trainium.

Ділан Пател, CEO та засновник SemiAnalysis, коментує: підвищена розгортуваність і мережеві можливості CS-4 дозволять масштабуватися до ще більших моделей, створюючи «масштабну фабрику Token».

Ринковий контекст: після IPO ціна акцій впала на 35%, CS-4 — ключовий переломний момент

Cerebras здійснила IPO 14 травня 2026 року за ціною 185 доларів США за акцію, відкрилася по 350 доларів, закрилася по 311,07 долара (+68%). Однак з того часу акції впали: на вівторок близько 220 доларів, що на 35% нижче максимуму.

Другий квартал приніс змішані фінансові результати: основний дохід — 209,9 млн доларів США (+103% рік до року); проте збиток на акцію — 2,98 долара (рік тому — прибуток 1,91 долара). Прогноз збільшення основного доходу у 2027 році втричі й кращі очікування на Q3 не повністю задовольнили інвесторів. Проте зобов'язання за контрактами складають 25,4 млрд доларів, що забезпечує майбутню стабільність доходів.

Значення для галузі: ринок AI-інференції готується до переосмислення

Вихід CS-4 співпав із стрімким зростанням попиту на AI-інференцію. По мірі переходу великих моделей із стадії тренування до розгортування, інференція стає ключовою конкурентною площиною AI-інфраструктури. Якщо заявлене 30-кратне прискорення буде підтверджено незалежними тестами, це може вплинути на рішення операторів дата-центрів щодо закупівлі обладнання.

Вихід Cerebras CS-4 знаменує зміщення AI-чіпового змагання від тренування до інференції. Чи зможе система реально потіснити Nvidia у сфері AI-інференції, залежить від того, чи підтвердяться заявлені характеристики у незалежних тестах — і чи зможе CS-4 швидко масштабуватися для задоволення зростаючого попиту на швидке генерування Token у супермасштабних дата-центрах.

Хмарні сервіси інференції Cerebras у другому кварталі виросли на 287% рік до року й досягли 127,7 млн доларів основного дохід. Вихід CS-4 означає новий етап переходу Cerebras від продажу обладнання до оренди інференційної потужності.

0
0

Відмова від відповідальності: зміст цієї статті відображає виключно думку автора і не представляє платформу в будь-якій якості. Ця стаття не повинна бути орієнтиром під час прийняття інвестиційних рішень.

PoolX: Заробляйте за стейкінг
До понад 10% APR. Що більше монет у стейкінгу, то більший ваш заробіток.
Надіслати токени у стейкінг!