Jina AI представи jina-ocr-v1: парсер на документи с 3,4 млрд параметъра и MoE архитектура, с вградено спекулативно декодиране за бюджетни GPU
Jina AI представи jina-ocr-v1 — визуален парсер на документи, който преобразува PDF файлове, сканирани документи, таблици, диаграми и фактури в Markdown. Моделът има общо 3,4 млрд. параметъра, като около 570 млн. са активни за всеки токен, и е базиран на DeepSeek-OCR. Вграденото спекулативно декодиране FastMTP…