Извлечение текста из исторического документа
Транскрипция исторических документов раньше означала, что волонтер или исследователь вручную набирал текст со скана или фотографии старого письма, бухгалтерской книги или записи. Инструмент ScreenApp для работы с документами вместо этого считывает файл с помощью ИИ: загрузите файл, затем используйте поддерживаемые инструменты для преобразования форматов или извлечения текста, аудио, кадров или сводки, поэтому отсканированная страница, фотография документа или PDF-файл превращаются в текст, который вы можете читать, искать или копировать в другое место.
Загрузите файл, и извлеченный текст попадет в вашу библиотеку ScreenApp. Оттуда вы можете прочитать его целиком, найти имя или дату или задать ИИ вопросы о его содержании.
Что вы получаете:
- Текст, извлеченный из загруженного скана, фотографии или PDF с помощью ИИ
- Загрузка PDF или офисного документа PDF-файлы и офисные документы конвертируются, чтобы их можно было читать и обсуждать, так же как и запись
- Попросите ИИ суммировать документ, выделить имена и даты или перевести отрывок
- без водяного знака на любой записи или экспорте
- Бесплатный тариф: 3 загрузки для ознакомления
- Pro снимает ограничение на загрузку за $19 в месяц при ежегодной оплате
Как транскрибировать исторический документ
- Загрузите документ: инструмент на этой странице принимает видео и аудио; для скана, фотографии или PDF-файла откройте приложение ScreenApp и загрузите файл туда, или перетащите его в свою библиотеку с компьютера, телефона или планшета.
- ИИ считывает и извлекает текст: инструмент извлекает читаемый текст из изображения или файла и сохраняет его в вашей библиотеке вместе с оригиналом.
- Читайте, ищите или используйте дальше: откройте результат, чтобы прочитать его, найти слово или имя, скопировать текст или задать ИИ вопрос о документе.
Результаты сильно зависят от источника. Чистый, хорошо освещенный скан напечатанного или четко напечатанного текста дает ИИ больше всего материала для работы. Выцветшие чернила, мелкий почерк, повреждения водой, порванные страницы, а также старые или архаичные шрифты — все это снижает количество правильно распознанного текста, и результат следует проверять по оригиналу, а не принимать как готовый транскрипт. См. как мы измеряем точность.
Транскрипция исторических документов в сравнении с другими инструментами
| Функция | ScreenApp | Transkribus | Image to Text (imagetotext.io) | Image to Text (imagetotext.info) |
|---|---|---|---|---|
| Бесплатный тариф | 3 загрузки для ознакомления | 50 кредитов в месяц, до 10 МБ за изображение | Бесплатное базовое преобразование, ограничение размера файла не указано | Бесплатное базовое преобразование, ограничение размера файла не указано |
| Платный тариф | $19/месяц ежегодно, без ограничения загрузок | Не указано на странице продукта | $6/месяц, до 30 МБ | $8/месяц, до 20 МБ, 50 изображений за отправку |
| Создан для исторических или рукописных шрифтов | Не указано | 100+, включая исторические шрифты | Не указано | Не указано |
| Заявленное количество языков | Не указано | 100+ | Перечислено 20 языков | Не указано |
| Без водяных знаков | без водяного знака на любой записи или экспорте | Не указано | Не указано | Не указано |
Sources, checked 2026-09-12: ScreenApp pricing, transkribus.org/image-to-text, imagetotext.io, imagetotext.info
- vs Transkribus: Transkribus создан специально для распознавания рукописного и исторического текста, с 50 бесплатными кредитами в месяц для изображений до 10 МБ и поддержкой 100+. Бесплатный тариф ScreenApp включает 3 загрузок, предназначен для извлечения текста и его размещения в библиотеке, с которой вы можете общаться, а не для архивной каталогизации.
- vs Image to Text (imagetotext.io): его платные тарифы начинаются от $6 в месяц для файлов до 30 МБ. Тариф Pro от ScreenApp стоит $19 в месяц при ежегодной оплате и снимает ограничение на загрузку любого файла.
- vs Image to Text (imagetotext.info): его платный тариф составляет $8 в месяц для файлов до 20 МБ и 50 изображений за отправку. Бесплатный тариф ScreenApp включает 3 загрузок без отдельной платы за OCR.
Кто использует ИИ для транскрибирования исторических документов
Генеалоги загружают скан страницы переписи населения, судового манифеста или записи из семейной Библии и получают текст с возможностью поиска вместо того, чтобы щуриться на фотографию в поисках фамилии.
Историки и исследователи извлекают текст из письма, страницы дневника или архивной записи, чтобы они могли искать его, цитировать и хранить вместе со своими другими заметками.
Архивариусы и библиотекари пропускают партию отсканированных страниц через инструмент, чтобы получить черновой текстовый слой для коллекции, а затем проверяют его по оригиналу, прежде чем он попадет в каталог.
Общества краеведения и генеалогии оцифровывают пожертвованные письма, бухгалтерские книги и фотографии от членов, превращая коробку с бумагами в текст, который можно искать и делиться.
Студенты, транскрибирующие первоисточник для работы, получают исходный текст для работы, а затем сравнивают его построчно со сканом для своей цитаты.
Семьи со старым письмом, карточкой рецепта или рукописным завещанием получают читаемую версию, которой они могут поделиться, без необходимости перепечатывать ее вручную.


