AMD наносит ответный удар NVIDIA — 24 июля 2026 г. в 12:17:52.673
AMD наносит ответный удар NVIDIA AMD и Cerebras на конференции Advancing AI 2026 объявили о технологическом партнерстве: компании предложат единое решение для инференса LLM, распределяя работу по разным ускорителям. Схема делит инференс на две части. Обработку промпта и длинного контекста берет на себя свой AMD Helios на 72 GPU Instinct MI455X. Генерацию токенов отдают стойкам с Wafer-Scale Engine от Cerebras: у него вся модель лежит в быстрой памяти (SRAM) на самой пластине, и токены генерятся с очень низкой задержкой. Логика в том, чтобы каждый чип делал то, что у него выходит лучше: у GPU много памяти под контекст, у пластины Cerebras скорость генерации токенов. Cerebras планирует поставить стойки Helios в свои дата-центры, совместное решение обещают запустить сначала в Cerebras Cloud во второй половине 2026 года. Конкретных замеров перфоманса производительности этой связки нет и, видимо, не будет до первых клиентов. Очень похожую связку в этом году уже собрала NVIDIA. На GTC Хуанг рассказал, как они встроили купленный за 20 миллиардов долларов Groq в платформу Vera Rubin: GPU Rubin обрабатывают контекст, а LPU от Groq выдают токены. AMD отвечает той же схемой, с одной разницей: NVIDIA свой чип для генерации купила, AMD договорилась с Cerebras. @anti_agi

