Веб-версияОткрыть в Telegram

Пост🚀 Jina-OCR-v1 разбирает целые страницы в Markdown со скоростью 2,57 страницы/с

28 сентября 2026
P
Python Community
Фотография
нажмите — покажем
🚀 Jina-OCR-v1 разбирает целые страницы в Markdown со скоростью 2,57 страницы/с Jina AI представила Jina-OCR-v1 - OCR-модель для преобразования документов в структурированный Markdown. Главное: - 91,14 на OmniDocBench v1.6; - 83,4 на olmOCR-Bench; - на 7,4 пункта выше DeepSeek-OCR на olmOCR-Bench; - до 2,57 страницы/с; - лучший throughput среди 14 протестированных систем при concurrency 32; - сохраняет текст, формулы, таблицы и порядок чтения за один проход. Архитектура тоже интересная: модель на 3,4B параметров использует MoE и активирует около 570M параметров на токен. Для ускорения декодирования применяется FastMTP. Подойдёт для PDF, научных статей, отчётов, таблиц и других сложных документов, где обычного OCR уже недостаточно. Лицензия: CC BY-NC 4.0. Для коммерческого использования нужно отдельное разрешение. ModelScope: https://modelscope.ai/models/jinaai/ Paper: https://modelscope.ai/papers/2609.03 @Python_Community_ru
8 · 477 ·

Рядом в ленте

PPython Community🐍 В Python 3.15 решили мягко «похоронить» re.match() re.match() никуда не удаляют, но для нового кода его теперь рекомендуют не использовать. Причина простая: нPPython CommunityФотография
это сообщение
PPython Community🖥 Примеры кода на Python 2026: лучшие практики, разбор и задачи с решениями Python примеры кода 2026 - практическое руководство на русском языке: разбор лучших PPython Community🖥 Cayu - open-source runtime для долгоживущих ИИ-агентов на Python Проект закрывает инфраструктурную часть работы агентов: управление состоянием, инструментами,

Открытая публичная лента из поискового индекса ChatCrawler — «Google по публичному Telegram»; обновляется по мере обхода площадки. Время — UTC.

Только публичный контент, официальный API Telegram. О проекте · Вопросы · Чего мы не делаем · Убрать страницу из выдачи · Каталог · Поиск · Как мы считаем