Нужен текст с картинки, а он не копируется?
Нужен текст с картинки, а он не копируется? Это частая проблема, и я нашла для себя рабочее решение. Поделюсь идеей, как экономить время при работе с иллюстрациями. Задача: перевести с английского на русский надписи на рисунке. Решение. Использую мультимодальность современных нейросетей. Это значит, что ввод можно осуществлять не только текстом, но и, например, изображением. Делаю скриншот рисунка, загружаю в DeepSeek, пишу промпт: «Я загружу рисунок. на нём надписи на английском языке. Тема — ИТ, тестирование. Нужно: 1. найти и выписать все надписи на английском языке. 2. перевести все эти надписи на русский язык. Формат вывода: английская фраза - русский перевод. Вопросы есть?» Обратите внимание, что промпт структурированный. Даны тема текста на иллюстрации, последовательность действий, формат вывода. Это повышает качество результата. Результат: нейросеть справляется процентов на 80. На некоторых рисунках распознаёт все надписи правильно, на некоторых половину не распознаёт вообще. Напоминаю: нейросети нередко ошибаются. Например, в моём случае DeepSeek неверно распознал слово triage как triangle. Но в целом, такой подход экономит время, если на рисунке текста много. Может ли DeepSeek дать описание картинки? Нет. Это текстовая модель. Он распознаёт только тексты на изображениях. А что делаете вы, если текст изображения не копируется, а он вам нужен? Делитесь идеями в комментариях!