Нова парадигма пам'яті для ШІ-прискорювачів

Дата25 серп. 2026 р.
Читати3 хв
Нова парадигма пам'яті для ШІ-прискорювачів
Сучасна гонка озброєнь у сфері штучного інтелекту зміщується від етапу навчання до масового інференсу. Головним обмеженням стає не стільки чиста обчислювальна потужність, скільки доступний обсяг пам'яті для розміщення гігантських мовних моделей. Intel пропонує радикальний перегляд цього підходу, відмовляючись від дороговартісних стандартів на користь масштабованості. Проєкт Crescent Island має на меті переосмислити економіку роботи з нейромережами в дата-центрах.

На конференції Hot Chips 2026 компанія Intel розкрила подробиці про Crescent Island — спеціалізований акселератор, покликаний кардинально змінити правила гри в сегменті інференсу штучного інтелекту. Поки індустрія зациклилася на гонці за піковими терафлопсами, Intel зосередилася на розв'язанні фундаментальної проблеми: вартості та доступності пам'яті під час роботи з великими моделями.

Технічний фундамент Crescent Island базується на обчислювальному ядрі GPU, що складається з 32 ядер Xe3P, розподілених на чотири блоки Compute Slice. Кожен такий блок об'єднує вісім ядер, які працюють у зв'язці з 256 векторними та матричними двигунами XMX. Саме блоки XMX беруть на себе основне навантаження з прискорення тензорних операцій, що лежать в основі роботи сучасних нейромереж. Для мінімізації затримок Intel реалізувала багаторівневу систему кешування: кожне ядро Xe оснащене 512 Кбайт об'єднаного кешу L1 та локальною пам'яттю SLM, що в сумі дає 16 Мбайт, доповнених спільним кешем другого рівня обсягом 32 Мбайт.

Архітектура Xe3P є глибокою еволюцією сімейства Xe3, де пріоритетами стали енергоефективність та чиста продуктивність в обчислювальних задачах. Аби оптимізувати транзисторний бюджет, інженери пішли на сміливий крок: з чипа були повністю вилучені блоки, що відповідають за традиційну 3D-графіку. Звільнений простір дозволив розширити обчислювальні ресурси та впровадити підтримку широкого спектра форматів даних. Спектр варіюється від надлегкого FP4, ідеального для швидкого інференсу, до високоточного FP64, необхідного для складних наукових обчислень.

Проте головною інновацією Crescent Island стала стратегія роботи з пам'яттю. В індустрії домінує стандарт HBM (High Bandwidth Memory), який забезпечує колосальну пропускну здатність, проте коштує надзвичайно дорого та потребує складних технологічних рішень. Intel обрала інший шлях, зробивши ставку на LPDDR5X. Хоча цей стандарт поступається HBM у швидкості передачі даних, він дозволяє кратно збільшити обсяг пам'яті за помірних витрат та енергоспоживання.

Еталонна версія карти отримає 160 Гбайт пам'яті, проте відкрита специфікація дозволить партнерам створювати конфігурації обсягом до 480 Гбайт. Такий підхід розв'язує критичну задачу: дозволяє розміщувати масивні мовні моделі цілком на одному акселераторі, підтримувати довші контекстні вікна та одночасно обслуговувати більшу кількість ШІ-агентів без необхідності розподіляти модель між кількома пристроями.

Crescent Island не претендує на роль лідера в області навчання нейромереж, де пропускна здатність пам'яті є визначальним фактором. Його мета — максимально дешева та ефективна генерація токенів. Intel робить ставку на експлуатаційні витрати та простоту інтеграції. Пристрій випускається у форматі PCIe-карт із енергоспоживанням 350 Вт, що дозволяє використовувати стандартне повітряне охолодження. Це означає, що нові акселератори можна впроваджувати в існуючу серверну інфраструктуру без дороговартісного переходу на рідинні системи.

Фактично, Intel формує нову ринкову нішу. Замість того щоб конкурувати в гонці за максимальною потужністю, компанія пропонує збалансоване рішення, де обсяг пам'яті та вартість володіння стають головними перевагами. У сценаріях інференсу великих моделей можливість утримати весь контекст у пам'яті часто виявляється важливішою за пікову швидкість обчислень.

Перші зразки Crescent Island очікують у другій половині 2026 року. Хоча точні показники продуктивності поки що тримають у секреті, сама концепція пристрою вказує на прагнення Intel зробити ШІ-інфраструктуру доступнішою та масштабованішою для реального бізнесу.

Тала знає • Використання матеріалів сайту дозволено виключно за умови розміщення активного, прямого і відкритого для пошукових систем гіперпосилання на першоджерело. Посилання має бути клікабельним і розташовуватися безпосередньо в тілі публікації — до або після запозиченого тексту. Будь-яке копіювання, відтворення або цитування контенту без дотримання цієї умови розглядається як порушення авторських прав.