
AMD, схоже, вдало обрала партнера для покращення можливостей висновку (inferencing) системи Helios масштабу стійки, адже дослідник OpenAI нещодавно висловив справжню оду на честь Wafer-Scale Engine від Cerebras.
Дослідник OpenAI про можливості чипів від партнера AMD Helios, Cerebras: “Вони неймовірні завдяки надшвидкому висновку”
Як ми нещодавно пояснювали у спеціальній статті, Helios — це перше комплексне рішення AMD на рівні стійки для завдань ШІ, яке складається з:
- Графічних процесорів AMD Instinct MI455X
- Процесорів AMD EPYC 6-го покоління
- Мережевих карт AMD Pensando для ШІ (NICs)
- DPU AMD Pensando
- AMD Infinity Fabric
- Програмного стеку AMD ROCm
Щоб ще більше підвищити корисність своїх систем Helios для робочих навантажень зі штучним інтелектом, AMD об’єдналася з Cerebras і планує інтегрувати Wafer-Scale Engine від Cerebras у свої системи Helios для блискавичного висновку.
Для тих, хто, можливо, не знає, Wafer-Scale Engine від Cerebras розміщує пам’ять і обчислювальні потужності цілого суперкомп’ютера для ШІ на одній гігантській, взаємопов’язаній кремнієвій пластині, де сотні тисяч обчислювальних ядер і десятки ГБ SRAM бездоганно з’єднані, дозволяючи даним ефективно рухатися без вузьких місць зовнішньої мережі.
По суті, Wafer-Scale Engine від Cerebras може вмістити цілу модель середнього розміру — або величезні частини великої моделі — в межах свого уніфікованого блоку SRAM. Крім того, універсальність підходу Cerebras дозволяє як навчання, так і висновку.
Згідно з дорожньою картою AMD, Helios забезпечить високопродуктивний, масштабований двигун пропускної здатності, тоді як технологія Cerebras надасть надзвичайно швидкий декод і генерацію токенів з наднизькою затримкою. Очікується, що разом ці два обчислювальні двигуни забезпечать до 5 разів більше токенів за секунду на ват.
OpenAI researcher Jeffrey Wang reveals the internal models running on Cerebras chips are so fast that tasks now finish before he even has the opportunity to context-switch, and it increases his productivity.
“Internally, we have some OpenAI models that are on Cerebras chips.… https://t.co/Aajgm9J5xl pic.twitter.com/I9DZwBzwVW
— Fireside Alpha (@firesidealpha) July 28, 2026
Це підводить нас до головної теми. Дослідник OpenAI Джеффрі Ванг нещодавно щедро похвалив чіпи від Cerebras, які, ймовірно, використовують архітектуру Wafer-Scale Engine, зазначивши:
“Всередині ми маємо деякі моделі OpenAI, які працюють на чіпах Cerebras. Вони неймовірні, тому що мають такий швидкий висновок.”
Ванг продовжує:
“І для мене це означає на щодень: раніше мені могло знадобитися кілька хвилин, щоб завдання завершилося, а тепер воно завершується ще до того, як я встигну переключити контекст. Це робить мене значно продуктивнішим.”
Для освіження пам’яті: моделі ШІ зазвичай перемикають контекст, коли переходять від одного завдання до іншого. Це може статися в середовищі з кількома агентами, де модель повинна виконувати низку різноманітних завдань, або в моделях Mixture of Experts (MoE), де різні під-нейронні мережі спеціалізуються на виконанні певного завдання.
Той факт, що OpenAI вже вражена системами Cerebras, свідчить про те, що системи Helios від AMD масштабу стійки, інтегровані з Wafer-Scale Engines, ймовірно, будуть розкуплені миттєво після дебюту.
Morgan Stanley laid out the economics of AI “intelligence factories.”
Data centers that sell tokens (AI inference output) could post net margins of 58-90%, depending on the NVIDIA GPU generation running them.
Blackwell-based centers: around 59% margins.
Rubin: around 78%.… pic.twitter.com/aDdHCEFjPt— Semiconductor Insider (@SemiconductorsX) July 28, 2026
Це стає ще важливішим, коли врахувати, що витрати на висновок зараз є головним чинником прибутковості центрів обробки даних.

Про автора: Письменництво – моя незаперечна пристрасть. Протягом останніх шести років я написав понад 2200 окремих статей на фінансові та технологічні теми, обсягом майже 1 мільйон слів. Я є членом мобільної команди Wccftech з 2025 року. Будучи випускником програми Rotman Commerce Університету Торонто, я привношу нюанси, глибокі знання та унікальну перспективу в кожну тему, яку висвітлюю. Коли я не пишу, я подорожую світом, досліджуючи приховані кондитерські та ресторани як аспірант-гурман.
Слідкуйте за Wccftech на Google, щоб отримувати більше наших новин у вашій стрічці.
Подальше читання

Ціни на відеокарти NVIDIA та AMD різко зросли в Китаї на тлі зростання вартості GDDR6 та GDDR7, а магазини почали накопичувати GPU через подальше зростання цін на пам’ять
Хассан Муджтаба
Процесори AMD Ryzen з ядрами Zen 7 можуть стати останнім сімейством “Zen” для AM5, оскільки Zen 8, ймовірно, перейде на AM6 з підтримкою DDR6 та PCIe 6.0
Хассан Муджтаба
Генеральний директор MoonShot каже: “OpenAI нічого нового не винайшла”, тоді як Сем Альтман підписав лист із закликом до відкритих моделей ШІ постфактум і під тиском
Рохаїл Салім
20 років з моменту придбання ATI компанією AMD за 5,4 мільярда доларів: угода, яка сформувала Radeon, консолі та майбутнє ШІ AMD
Сарфраз Хан
Дізнатися більше на: wccftech.com
