Jina AI выпустила jina-ocr-v1: парсер документов с 3,4 млрд параметров и архитектурой MoE, со встроенным спекулятивным декодированием для бюджетных GPU
Jina AI выпустила jina-ocr-v1 — визуальный парсер документов, преобразующий PDF-файлы, сканы, таблицы, диаграммы и счета в Markdown. Модель содержит 3,4 млрд параметров, из которых около 570 млн активны для каждого токена, и создана на основе DeepSeek-OCR. Встроенное спекулятивное декодирование FastMTP…