🔍 Baidu выпустила Unlimited OCR для распознавания длинных документов — 24 июня 2026 г. в 04:00:01.461
🔍 Baidu выпустила Unlimited OCR для распознавания длинных документов Baidu анонсировала модель Unlimited OCR, оптимизированную для распознавания длинных документов за один проход. Эта модель содержит 3B параметров, из которых активируются только 500M, что позволяет достигать новых SOTA-результатов на OmniDocBench v1.5 и v1.6. Основной особенностью является механизм Reference Sliding Window Attention, который позволяет модели удерживать в фокусе исходный документ, недавний контекст и следующие слова, постепенно 'забывая' лишнюю информацию для оптимизации вычислений. Благодаря постоянному размеру KV Cache и эффективному attention модель в состоянии обрабатывать более 40 страниц текста за один forward pass, сохраняя контекст и скорость. 📊 Ключевые данные: • Размер KV Cache фиксированный • 40+ страниц за один проход без замедления • Доступ на GitHub и Hugging Face.

