✔ DeepSeek выпустила экспериментальную vision-модель — 22 августа 2026 г. в 10:26:05.236
✔ DeepSeek выпустила экспериментальную vision-модель V4-Flash-Vision-Exp (https://api-docs.deepseek.com/guides/vision/) построена на V4-Flash и умеет разбирать диаграммы, распознавать текст и вызывать инструменты. По собственным замерам DeepSeek, модель держится на уровне Claude Opus 4.8. Форматы JPEG, PNG, GIF и WebP модель определяет по фактическому содержимому файла, а не по расширению. Картинку можно передать в Base64, публичной ссылкой или через новый Files API (https://api-docs.deepseek.com/guides/files_api/) - туда грузится файл, и дальше к нему обращаются по идентификатору. Одно изображение обходится максимум в 384 токена. Картинки приводятся размеру к 800x800 пикселей, а параметром detail их можно принудительно ужать до 512x512. В один промпт влезает до 600 файлов. Максимальная длина стороны - 8192 пикселя, но если изображений от 15, потолок опускается до 4096.

