#обзор_itelon — 14 июля 2026 г. в 11:46:00.592
#обзор_itelon 🧠Dell PowerEdge XE7740: AI-сервер под инференс В линейке PowerEdge появилась отдельная платформа под запуск моделей — XE7740. Не под обучение флагманских LLM, а под то, что чаще нужно в корпорациях: RAG по внутренним базам, чат-ассистенты, обработка обращений, видеоаналитика. 📦 Шасси разделено на две зоны Верхние 1U — процессоры: 2× Intel Xeon 6, 32 слота DIMM (до 4 ТБ DDR5), NVMe E3.S. Нижние 3U — до восьми ускорителей PCIe Gen5, каждый до 600 Вт TDP. У зон отдельное охлаждение и своя схема питания. Смысл — изолировать тепловую нагрузку ускорителей, чтобы 600-ваттный GPU-стек не грел процессорную секцию. Все это укладывается в стандартный 4U-корпус под 19-дюймовую стойку. 📦 Ускорители — любые из серии PCIe Gen5 К шасси подходят NVIDIA RTX PRO 6000, H100/H200, L40S, L4, A16 — и Intel Gaudi 3. Не надо выбирать одного вендора на пять лет вперед. 🥰 В тесте XE7740 гоняли с 4× Intel Gaudi 3 на связке vLLM, 128 одновременных запросов. Цифры дают ориентир по возможностям платформы: Llama 3.1 8B — до 17 900 tok/s, Llama 3.1 70B — 3 600 tok/s, Qwen3 Coder 30B (MoE) — 14 300 tok/s, Qwen3 235B Thinking — 2 500 tok/s с TTFT около 7 секунд. Конфигурация: 2× Xeon 6787P (по 86 ядер) + 2 ТБ DDR5. На NVIDIA H200 показатели должны быть выше — за счет большей емкости HBM3e и пропускной способности памяти. Это делает H200 предпочтительным вариантом для сценариев с длинным контекстом и MoE-моделями. ✏ Управление iDRAC 10 нового поколения — 4 ядра ARM, 2 ГБ памяти, аппаратный Root of Trust, шифрование AES-256, проверка заводского состава компонентов. 💬 Подробности читайте на itelon.ru 💙 Vkontakte | 📝 Дзен

