Новая парадигма памяти для ИИ-ускорителей

Дата25 авг. 2026 г.
Читать3 мин
Новая парадигма памяти для ИИ-ускорителей
Современная гонка вооружений в сфере искусственного интеллекта смещается от этапа обучения к массовому инференсу. Главным ограничением здесь становится не столько сырая вычислительная мощность, сколько доступный объем памяти для размещения гигантских языковых моделей. Intel предлагает радикальный пересмотр этого подхода, отказываясь от дорогостоящих стандартов в пользу масштабируемости. Проект Crescent Island призван переопределить экономику работы с нейросетями в дата-центрах.

На конференции Hot Chips 2026 компания Intel представила детали устройства Crescent Island — специализированного ускорителя, который должен изменить правила игры в сегменте ИИ-инференса. В то время как индустрия привыкла гнаться за пиковыми терафлопсами, Intel сосредоточилась на решении фундаментальной проблемы: стоимости и доступности памяти при работе с крупными моделями.

Технический фундамент Crescent Island базируется на вычислительном ядре GPU, состоящем из 32 ядер Xe3P, разделенных на четыре блока Compute Slice. Каждый такой блок объединяет восемь ядер, которые работают в связке с 256 векторными и матричными движками XMX. Именно XMX-блоки берут на себя основную нагрузку по ускорению тензорных операций, которые лежат в основе работы современных нейросетей. Для минимизации задержек Intel реализовала многоуровневую систему кеширования: каждое ядро Xe оснащено 512 Кбайт объединенного кеша L1 и локальной памяти SLM, что в сумме дает 16 Мбайт, дополненных общим кешем второго уровня объемом 32 Мбайт.

Разработка Xe3P представляет собой глубокую эволюцию семейства Xe3, где приоритетом стали энергоэффективность и чистая производительность в вычислительных задачах. Чтобы оптимизировать транзисторный бюджет, инженеры пошли на смелый шаг: из чипа были полностью удалены блоки, отвечающие за традиционную 3D-графику. Освободившееся пространство позволило расширить вычислительные ресурсы и внедрить поддержку широкого спектра форматов данных. Спектр варьируется от сверхлегкого FP4, идеально подходящего для быстрого инференса, до высокоточного FP64, необходимого для сложных научных вычислений.

Однако главной инновацией Crescent Island стала стратегия работы с памятью. В индустрии доминирует стандарт HBM (High Bandwidth Memory), который обеспечивает колоссальную пропускную способность, но стоит крайне дорого и требует сложных технологических решений. Intel пошла по иному пути, выбрав LPDDR5X. Хотя этот стандарт уступает HBM в скорости передачи данных, он позволяет кратно увеличить объем памяти при умеренных затратах и энергопотреблении.

Эталонная версия карты будет оснащена 160 Гбайт памяти, но открытая спецификация позволит партнерам создавать конфигурации объемом до 480 Гбайт. Такой подход решает критическую задачу: позволяет размещать массивные языковые модели целиком на одном ускорителе, поддерживать более длинные контекстные окна и одновременно обслуживать большее количество ИИ-агентов без необходимости распределять модель между несколькими устройствами.

Crescent Island не претендует на роль лидера в области обучения нейросетей, где пропускная способность памяти является определяющим фактором. Его цель — максимально дешевая и эффективная генерация токенов. Intel делает ставку на эксплуатационные расходы и простоту интеграции. Устройство выпускается в формате PCIe-карт с энергопотреблением 350 Вт, что позволяет использовать стандартное воздушное охлаждение. Это означает, что новые ускорители можно внедрять в существующую серверную инфраструктуру без дорогостоящего перехода на жидкостные системы.

Фактически, Intel формирует новую рыночную нишу. Вместо того чтобы конкурировать в гонке за максимальной мощностью, компания предлагает сбалансированное решение, где объем памяти и стоимость владения становятся главными преимуществами. В сценариях инференса крупных моделей возможность удержать весь контекст в памяти часто оказывается важнее, чем пиковая скорость вычислений.

Первые образцы Crescent Island ожидаются во второй половине 2026 года. Хотя точные показатели производительности пока держатся в секрете, сама концепция устройства указывает на стремление Intel сделать ИИ-инфраструктуру более доступной и масштабируемой для реального бизнеса.

Тала знает • Использование материалов сайта разрешено исключительно при условии размещения активной, прямой и открытой для поисковых систем гиперссылки на первоисточник. Ссылка должна быть кликабельной и располагаться непосредственно в теле публикации — до или после заимствованного текста. Любое копирование, воспроизведение или цитирование контента без соблюдения этого условия рассматривается как нарушение авторских прав.