Inception выпустила Mercury 2.5 в релиз, превью разбирал неделю назад. Цифры те же: диф... — 9 сентября 2026 г. в 13:26:14.417
Inception выпустила Mercury 2.5 в релиз, превью разбирал неделю назад. Цифры те же: диффузионная модель пишет текст блоками параллельно, 1107 токенов в секунду на обычных NVIDIA GPU, плюс 40% к интеллекту к Mercury 2, контекст 260K, уровень GPT-5.6 Luna на низком усилии и Haiku 4.5. По словам Inception, это самая большая диффузионная LLM из обученных. Из нового в анонсе только кейсы клиентов, которые уже гоняют модель в проде. Augment Code перевела на Mercury сжатие контекста, маршрутизацию и поиск MCP-инструментов: сжатие ускорилось со 150 секунд до 27, цена упала на 90%. У OpenCall с голосовыми агентами медиана ответа модели около 170 мс. Рядом превью Mercury Voice с первым токеном быстрее 170 мс и Mercury Router, который читает запрос и раскидывает по чужим моделям. Цена $0,20 за млн входных и $0,75 за выходные, на старте скидка 80%: $0,04 и $0,15. Есть в API Inception, на OpenRouter и Baseten, новым аккаунтам дают 100 млн токенов. Следующая модель уже обучается, обещают крупнее и в ближайшие месяцы. В ролике модель собирает веб-приложение по паре промптов. @neuro_channel

