DeepSeek тоже хочет кремния💻 — 8 июля 2026 г. в 15:13:05.073
DeepSeek тоже хочет кремния💻 DeepSeek разрабатывает собственный чип для инференса. Работа началась около года назад, стадия ранняя: переговоры с партнерами по дизайну, контрактному производству и памяти, тихий найм инженеров-схемотехников без открытых вакансий. Мотив в снижении зависимости от чипов Nvidia и Huawei. Все, кто строит свой кремний, входят через инференс. Первый TPU работал в дата-центрах Google с 2015 года, считал в int8 (восьмибитных целочисленных вычислениях) и обучать не умел вовсе. Недавно OpenAI и Broadcom представили Jalapeño, ускоритель под инференс ChatGPT. Google впервые разделила линейку TPU надвое: инференс отдельно от обучения. Anthropic тоже изучает варианты сделать свой чип. Причина инженерная. ASIC-чипам нужна неподвижная цель, и обученная модель ее дает: известны размерности, числовые форматы, вычислительные ядра. Сбой на этапе инференса приводит к потере запроса, а не откату целых эпох обучения. То есть спроектировать чип проще, а рисков из-за сбоя компилятора или кремния меньше. У DeepSeek к общей логике добавляется своя. Экспортные ограничения закрывают китайским разработчикам доступ и к передовым фабрикам, и к высокоскоростной памяти. Главный китайский отечественный поставщик HBM, компания CXMT, целилась в серийное производство HBM3 к концу 2026 года. Но пока проект вроде как застрял на стадии образцов. В феврале 2025 года DeepSeek опубликовала на GitHub разбор своей инференс-системы. При аренде H800 по два доллара в час суточные затраты составили 87 072 доллара, теоретическая суточная выручка 562 027 долларов, и компания подсчитала, что это дает маржу больше 80%. Судя по сливу, работу над собственным чипом она начала всего лишь месяцем-двумя позже. @anti_agi

