GLM 5.3 Flash на AI Gateway: быстрая модель Z.ai для многошаговых агентов — 26 августа 2026 г. в 15:45:35.330
GLM 5.3 Flash на AI Gateway: быстрая модель Z.ai для многошаговых агентов Если агент у тебя ходит десятками шагов, счёт капает не за один промпт, а за каждый вызов — и тут важна не только скорость, но и цена шага. Z.ai выпустила облегчённую GLM 5.3 Flash: она заточена под coding и длинные многошаговые сессии, быстрее и дешевле полной GLM 5.3. В Cursor её можно завести через шлюз Vercel без ручной склейки эндпоинтов под каждого провайдера. В терминале — vercel ai-gateway coding-agents setup, в списке агентов выбери Cursor, внутри укажи модель zai/glm-5.3-flash. Попробуй на следующей задаче, где агент крутится полчаса и больше: инструменты и потоковая отдача уже встроены, а переплачивать за «полную» версию на каждом шаге смысла мало.

