🧠 Baidu Unlimited OCR: 40+ страниц за проход — 24 июня 2026 г. в 11:38:22.524
🧠 Baidu Unlimited OCR: 40+ страниц за проход Baidu выпустила Unlimited OCR — модель для распознавания длинных документов целиком, за один проход. У модели 3B параметров, но активируются только 500M благодаря разреженной архитектуре. При этом она показывает новые SOTA-результаты на бенчмарках OmniDocBench v1.5 и v1.6. Главная фишка — Reference Sliding Window Attention. Механизм держит в фокусе три элемента: исходный документ, недавний контекст и следующие слова. Всё лишнее постепенно «забывается», чтобы не раздувать вычисления. Благодаря постоянному размеру KV Cache и более дешёвому attention, Unlimited OCR может распознавать 40+ страниц за один forward pass, не теряя контекст и без замедления. GitHub: https://github.com/baidu/Unlimited-OCR Hugging Face: https://huggingface.co/baidu/Unlimited-OCR 🧠 Нейросети и Технологии. Подписаться

