Перейти к содержимому

Метка tesseract-ocr

Подборка 31 вопрос с тегом «tesseract-ocr» на WikiRoot: ответы IT-специалистов по Windows, Linux, Excel, сетям и программированию.

31 вопрос

0 голосов
0 ответов
372 просмотра

Тессеракт OCR: Как показать все возможные ответы для изображения?

Я работаю над использованием Tesseract для обнаружения некоторых старых древних скриптов. Тессеракт как инструмент показывает только один ответ (вывод) для любого изображения, а ин...

0 голосов
0 ответов
412 просмотров

Tesseract 4.0 не читает изображения только одним словом текста

Я использую Tesseract v4.0.0-beta.1-108-gf291 Изображение 5.jpg не читается (одно слово: символы хорошего размера) tesseract 5.jpg out.txt Я перепробовал все виды параметров --psm...

1 голос
0 ответов
633 просмотра

Можно ли преобразовать субтитры dvdsub в srt через командную строку?

Есть ли способ конвертировать субтитры dvdsub (на основе изображений) в srt? например с mencoder или ffmpeg в сочетании с тессерактом? Я ищу что-то на основе командной строки, и я...

1 голос
0 ответов
831 просмотр

Как автоматически определить язык текста на фотографии и перевести его

Мне удалось встроить приложение OCR для обнаружения текста по фотографии https://obserbot.com/, но оно только извлекает точный текст из фотографии и не конвертирует его на нескольк...

1 голос
0 ответов
574 просмотра

Как мне научить tesseract игнорировать волнистые линии, добавленные из орфографических и грамматических ошибок?

Я использую tesseract для обнаружения текста на различных типах изображений, в том числе на снимках экрана, его спутывают волнистые красные и синие подчеркивания для орфографически...

0 голосов
1 ответ
1 332 просмотра

Оптимальный шрифт для Tesseract? (в частности, оболочка .NET)

Ответ: Ваш лучший выбор - обучить его тому шрифту, который вы используете. Я не хочу притворяться, что это легкий процесс, это не так, но он должен работать лучше. Кроме того, большинство...

2 голоса
0 ответов
585 просмотров

Смешная OCR-ситуация

У меня есть отсканированный многостраничный PDF-файл с разрешением 300 точек на дюйм в системе Ubuntu 16.04. Когда я запускаю следующую команду: pdfocr -t -l swe -i *.pdf -o newfil...

2 голоса
0 ответов
1 340 просмотров

Как сжимать файлы PDF в кодировке Tesseract, сохраняя встроенный текст из OCR?

Я экспериментировал с использованием Tesseract для распознавания моих PDF-файлов, и он был в основном успешным, особенно с текстами немецкого языка Fraktur (готический шрифт старог...

1 голос
1 ответ
1 583 просмотра

Как заставить OCR распознавать это изображение

Ответ: Изображения слишком малы для правильной работы. Я взял ваши изображения и просто масштабировал их до высоты 50 пикселей (постоянное разрешение) и побежал tesseract input output -ps...

1 голос
0 ответов
407 просмотров

Tesseract на Windows: выходы всегда неточны

Поэтому я пытаюсь распознать это изображение: (на самом деле это имена пользователей) используя эту команду в командной строке Windows: tesseract screenshot.png out Однако out.txt...

1 голос
0 ответов
715 просмотров

Отключить словарь в Tess4J

Точность распознавания символов в моем приложении tess4j OCR очень низкая. Я слышал, что отключение словаря в tess4j повысит точность, позволяя распознавать отдельные символы. Но я...

1 голос
2 ответа
1 835 просмотров

Тессеракт на Linux

Ответ: Установите teseract, используя пакеты sudo apt install tesseract-ocr Сначала проверьте, установлен ли пакет dpkg -l | grep tesseract Поиск / установка доступных связанных пакетов a...

5 голосов
1 ответ
4 525 просмотров

Тессеракт OCR: неподдерживаемый тип изображения

Ответ: Я предполагаю, что вы читаете пост Михаэля Лисснера, чтобы добавить собственный шрифт в Tesseract. Я попробовал то же самое ( convertкоманду) и получил сломанный TIFF, который нель...

1 голос
1 ответ
1 542 просмотра

TesseractOCR специализированное обучение

Ответ: Вы можете использовать следующую ссылку, чтобы узнать больше о том, как тренировать тессеракт. Для исправления файлов ящиков вы можете использовать jTessBoxEditor . Не забывайте, ч...

2 голоса
0 ответов
543 просмотра

Tesseract не может сканировать `Ошибка: поддерживаются только 1,2,4,5,6,8 бит / с: 32`

Даже при том, что я сделал, convert canvas.png -depth 8 canvas.tifя все еще вижу это сообщение об ошибках: Tesseract Open Source OCR Engine check_legal_image_size:Error:Only 1,2,4,...

3 голоса
1 ответ
3 018 просмотров

Тренинг Tesseract-OCR для шрифтов английского языка

Ответ: Один из способов удалить результаты - это предварительно обработать их, например удалить любые перекосы и пороговые значения. Вы можете использовать открытое резюме. Позже вы может...