История
июль 24, 2026

AMD и Cerebras рассчитывают, что разделение AI‑нагрузок поможет ослабить хватку Nvidia

AMD и стартап по выпуску чипов для ИИ Cerebras объявили о партнёрстве для усиления производительности инференса ИИ за счёт объединения своих технологий. В рамках сотрудничества Cerebras будет использовать новые серверные системы AMD Helios для разделения задач ИИ: чипы AMD возьмут на себя начальную обработку, а системы Cerebras — генерацию токенов.

AMD и Cerebras формулируют чёткий тезис о том, куда далее движется инфраструктура ИИ: не к одному доминирующему чипу, который делает всё, а к системам, которые делят работу. Это партнёрство также является прямым вызовом доминированию Nvidia на фоне того, как отрасль смещает фокус от обучения моделей к их эффективному запуску в реальном мире.

В рамках этой новой схемы Cerebras развернёт серверы AMD Helios в своих дата‑центрах: оборудование AMD будет обрабатывать запросы и большие контекстные окна, в то время как системы Cerebras возьмут на себя генерацию токенов. Обе компании делают ставку на то, что в отрасли всё чаще называют «дезагрегированным инференсом» — идею о том, что разные стадии AI‑нагрузки лучше подходят для разных типов чипов.

Это важно, потому что инференс — этап, на котором обученная модель превращается в ответ, — стал ключевым полем битвы в экономике ИИ. Скорость, пропускная способность памяти и стоимость теперь имеют такое же значение, как и чистая мощность обучения. Посыл AMD в том, что эти задачи достаточно сильно различаются по своей природе, чтобы оправдать отдельные аппаратные пути, а не традиционную модель, в которой одна система справляется с обеими задачами.

Два первоисточника в целом совпадают в оценке этого стратегического сдвига, но по‑разному расставляют акценты. Business Insider описывает сделку как попытку AMD «нанести удар по Nvidia», сделав ставку на «следующий крупный сдвиг» в ИИ, подчёркивая конкурентный аспект и более широкие усилия AMD по позиционированию Helios против стоечных решений Nvidia. Axios, напротив, фокусируется на операционной логике: разделение нагрузок может сделать повседневные AI‑сервисы быстрее и дешевле, особенно по мере того, как клиенты требуют всё более эффективного инференса в масштабах.

Генеральный директор AMD Лиза Су предельно ясно сформулировала эту идею, заявив: «Я думаю, мы увидим больше дезагрегации рабочих нагрузок». Если этот взгляд оправдается, партнёрство AMD и Cerebras может оказаться не разовой коалицией, а предвестником того, как будут строиться будущие системы ИИ.