Baidu Unlimited OCR
Есть боль, знакомая всем, кто хоть раз пытался прогнать через ИИ длинный PDF: сначала всё бодро, а потом модель начинает тормозить, жрать память и вести себя так, будто ей дали читать многотомник в один присест. Причина проста — по мере генерации текста растёт внутренний «кэш внимания» (KV‑cache), в котором модель хранит, что уже увидела и сказала. Чем длиннее документ, тем толще этот рюкзак, тем тяжелее его тащить. Baidu эту проблему атакует лоб в лоб и выпускает Unlimited OCR — модель на 3 миллиарда...