Skip to content
AMD и Cerebras объединились для создания платформы ИИ-инференса с сверхнизкой задержкой
24 июля 17:57 0 Просмотров Новости

AMD и Cerebras объединились для создания платформы ИИ-инференса с сверхнизкой задержкой

Стратегическое партнерство на рынке искусственного интеллекта

AMD и Cerebras Systems объявили о сотрудничестве, направленном на создание высокопроизводительной платформы для инференса (вывода) ИИ со сверхнизкой задержкой. Это решение становится ответом на интеграцию технологий Groq в платформу NVIDIA Vera Rubin после покупки стартапа Nvidia за $20 млрд в декабре 2025 года. Серверная стойка AMD Helios

Технологическая основа партнера

Совместное решение объединяет стойки AMD Helios и ускорители Cerebras Wafer-Scale Engine (WSE). Система Helios двойной ширины спроектирована специально для ресурсоемких ИИ-задач и объединяет процессоры EPYC Venice с ядрами Zen 6, ускорители Instinct MI400 и DPU Vulcano. В свою очередь, чипы WSE, насчитывающие сотни тысяч ядер, используют встроенную в чипы память SRAM вместо HBM4, что обеспечивает значительное преимущество в скорости.

Гендиректор и соучредитель Cerebras Эндрю Фельдман (Andrew Feldman) подчеркнул, что оборудование Cerebras является одним из быстрейших в мире в задачах инференса — скорость генерации часто превышает 2000 токенов в секунду. Чип Cerebras Wafer-Scale Engine WSE

Преимущества и производительность

В новой платформе два основных этапа задачи оптимизируются независимо друг от друга: стойки Helios обеспечивают сверхвысокую пропускную способность, обрабатывая запросы и большие контекстные окна, тогда как ускорители WSE отвечают за генерацию токенов с минимальной задержкой. В результате показатель токенов в секунду на ватт (Т/с/Вт) возрастает пятикратно по сравнее с конфигурациями, использующими только изделия WSE при работе с мультимодальной моделью Kimi 2.6 1T (1 трлн параметров).

Кроме того, для обслуживания модели с 1 трлн параметров Kimi K2.5 требуются две тысячи чипов Groq, тогда как в системах AMD и Cerebras хватит нескольких десятков. График эффективности токенов на ватт

Рынок и доступность решения

AMD представила свою первую серверную ИИ-стойку Helios, серверный процессор Venice и ИИ-чип Instinct MI455 на презентации продуктов для ИИ-дата-центров в Сан-Франциско. Эти решения помогают компании завоевать быстрорастущий рынок вычислительных решений для ИИ, который по оценкам компании к 2030 году достигнет значительных показателей.

Новое аппаратное решение станет доступно клиентам через облако Cerebras Cloud во второй половине 2026 года. В рамках партнерства Cerebras намерена развернуть системы Helios в своих дата-центрах. На фоне объявления о партнерстве акции Cerebras выросли на 11%.

Поделиться

Похожие публикации