Комада Qwen представила 3 новые модели: — 23 сентября 2025 г. в 07:40:16.472
Комада Qwen представила 3 новые модели: Qwen-Image-Edit-2509: Поддержка редактирования нескольких изображений: для ввода нескольких изображений Qwen-Image-Edit-2509 основан на архитектуре Qwen-Image-Edit и дополнительно обучен с помощью конкатенации изображений, что позволяет редактировать несколько изображений. Он поддерживает различные комбинации, такие как «человек + человек», «человек + продукт» и «человек + сцена». В настоящее время оптимальная производительность достигается при вводе от 1 до 3 изображений. Улучшенная согласованность одиночных изображений: для одиночных изображений Qwen-Image-Edit-2509 значительно улучшает согласованность, в частности в следующих областях: Улучшенная согласованность редактирования людей: лучшее сохранение идентичности лица, поддержка различных стилей портретов и преобразований поз; Улучшенная согласованность редактирования продуктов: лучшее сохранение идентичности продукта, поддержка редактирования постеров продуктов; Улучшенная согласованность редактирования текста: помимо изменения текстового содержания, поддерживается также редактирование шрифтов, цветов и материалов текста; Встроенная поддержка ControlNet: включая карты глубины, карты краев, карты ключевых точек и многое другое. Модель доступна для загрузки на HuggingFace. Бесплатно можно протестировать в Qwen Chat, модель уже добавлена туда. Qwen3-Omni: Omni — это end-to-end мультимодальная линейка (текст/изображения/аудио/видео) со стримингом текста и речи. Есть две версии: Instruct = thinker + talker → понимает текст/картинки/видео/аудио и отвечает текстом и голосом. Thinking = только thinker → понимает мультимодальные входы, отвечает только текстом, зато сильнее в рассуждениях. Обе модели поддерживают русский язык, как на вход, так и для ответов (в том числе голосом). Модель тяжелая, по разным данным требуется от 80 до 160 Гб видеопамяти. Квант версий пока нет. Бесплатно модель доступа в том же Qwen Chat, точнее ее Flash версия.

