Gemma-4 на Inferentia2: где ломается путь от модели до стабильного inference — 14 июля 2026 г. в 05:26:14.906
Gemma-4 на Inferentia2: где ломается путь от модели до стабильного inference Проверка зелёная — а вывод агента пустой? Соло с агентами: свой узел для LLM под агентов или IDE — сначала побайтная сверка на процессоре, потом чекпоинт и буферы. В полевом отчёте xbill разбирает Gemma на Inferentia: обход вендорного стека, смешанные головы и лимиты компилятора. Недорогий инстанс в облаке тянет все размеры — только после эталона. Чините чип по пустому тексту? Как у вас?

