Вы здесьПроблемы и приемы OCR: dewarp
Опубликовано ср, 06/05/2009 - 04:06 пользователем Ulenspiegel
Если при сканировании книжка не прижата плотно к предметному стеклу, участки строк, находящиеся вблизи разворота, искривляются. При сильном искривлении (заползание на уровень соседней строки) программы распознавания приходят от таких червячков в недоумение. Не знает ли всемогущий All алгоритмов и (что еще лучше) готовых программ для борьбы с таким безобразием ?
|
Вход на сайтПоиск по блогам и форумамUser menuПоследние комментарии
Океана RE:Подайте бедному копеечку на книжку с литреса... 1 день
weis RE:Прошу переформатировать, распознать, etc... 1 день larin RE:Заплатила, а абонемента нет и скачать ничего не могу! 2 недели sibkron RE:Серия "Библиотека французской литературы" (Макбел) 2 недели akorish RE:Регистрация 1 месяц Tramell RE:Серия "Очень прикольная книга", издательство Азбука-классика 1 месяц Larisa_F RE:Серия "Я познаю мир" издательства "АСТ, Астрель, Олимп",... 1 месяц konst1 RE:Ух, как я не люблю спамеров! 1 месяц tvv RE:DNS 2 месяца sem14 RE:«Не забыть бы тогда, не простить бы и не потерять!»-2 ... 2 месяца larin RE:Заблокирован 2 месяца konst1 RE:Серия «Интеллектуальный детектив» изд-ва АСТ 2 месяца Larisa_F RE:Серия книг «Судьбы книг» издательства «Книга» 2 месяца fixel RE:Пропал абонемент 2 месяца sem14 RE:Книжная серия "Жизнь в искусстве" издательство "Искусство"... 3 месяца sibkron RE:"100 славянских романов", серия изд.-ва "Центр книги... 3 месяца Larisa_F RE:Серия "Новые сказочные повести" издательство "Самовар" ... 4 месяца sem14 RE:Серия "Символы времени" издательства "Аграф" 4 месяца Впечатления о книгах
Barbud про В третий час после Полудня
13 06 Я читал АБС, я читал "Факап", но все равно понять, о чем речь, сложно - как будто серию с середины читать взялся. Впрочем, написано неплохо.
mysevra про Крук: Силвервид-роуд [сборник litres] (Ужасы, Научная фантастика)
13 06 Истории неплохие, есть довольно оригинальные сюжеты. Но в целом осталось не то приятно-жуткое, холодящее впечатление, а ощущение какой-то гадливости, что ли. Нет, не мой автор. Оценка: неплохо
mysevra про Нетли: Черные перья (Ужасы, Исторический детектив, Триллер, Детективы: прочее)
13 06 Такой себе современный готический роман, не очень страшный, не очень динамичный, немного наивный, но уютный, ламповый. Читала с удовольствием. Оценка: отлично!
mysevra про Водовозова: На заре жизни (Биографии и Мемуары)
13 06 Да уж, меня, когда-то имевшую представление о быте дворянских семей из книг Толстого, Тургенева, Аксакова и тому подобных идеализированных произведений, в своё время изрядно шокировали мемуары современниц этого периода. Это ……… Оценка: отлично!
Олег Макаров. про Вадим Владимирович Чинцов
13 06 Автор фантастический совкодрочер, иначе не назовёшь. Если "любой ценой вернуть СССР" — не ваша мечта, лучше никакие его поделки не читать.
lorealke про Бушков: Крым и крымчане, или Тысячелетняя история раздора (История, Публицистика)
13 06 Очередной «великий историк»... Оценка: нечитаемо
ne_fanat про Еслер: Наследник $$$ уровня (Городское фэнтези, Попаданцы, Самиздат, сетевая литература)
12 06 Вроде ничего особонного, но зашло нормально. Оценка: хорошо
Олег Макаров. про Евтушенко: Чужак из ниоткуда (Попаданцы, Самиздат, сетевая литература)
12 06 Оооочень занудно пишет автор Оценка: нечитаемо
edik_m про Эренбург: Люди, годы, жизнь. Воспоминания в трех томах (Биографии и Мемуары, Документальная литература)
11 06 Правдивая история СССР глазами очевидца! Оценка: отлично!
DMcL про Уильямс: Драконы Обыкновенной фермы [The Dragons of Ordinary Farm ru] (Детская фантастика)
11 06 Приключения на Обыкновенной ферме / Ordinary Farm Adventures Соавтор: Дебора Бил роман Драконы Обыкновенной фермы / The Dragons of Ordinary Farm (2009) Соавтор: Дебора Бил роман The Secrets of Ordinary Farm ………
Niarbagem про Пехов: Птицелов (Фэнтези, Самиздат, сетевая литература)
11 06 На мой взгляд не хуже первой, сюжет, интрига - все присутствует. Однозначно стоит читать, если первая понравилась. Оценка: хорошо
Barbud про Шелест: Мельница (Альтернативная история, Попаданцы, Самиздат, сетевая литература)
10 06 Какое-то невнятное писево с картонными героями, совершенно не зацепило. Оценка: нечитаемо |
Комментарии
Отв: Проблемы и приемы OCR: dewarp
Насчет алгоритмов не знаю (хотя Файнридер вроде что то делает) но как вариант решения за $500 смотри тут: http://lib.rus.ec/node/131676
Отв: Проблемы и приемы OCR: dewarp
Э нет, кривой скан в данном случае - уже данность :( В смысле - готовый DJVU
Отв: Проблемы и приемы OCR: dewarp
В FineReader 8, которым я пользуюсь, в настройках "1. Сканировать/открыть" есть опция "Устранить искажение строк". Очень даже помогает.
В 9-й версии наверняка тоже есть.
Отв: Проблемы и приемы OCR: dewarp
Есть , "streighten lines" и "desкew" - кто из них кто уже не помню за ненадобностью.
можно на страницу провести операцию а можно применить ко всем , но я бы советовал постранично ибо некоторые страницы наоборот как раз портит.
Отв: Проблемы и приемы OCR: dewarp
Да вы чего, издеваетесь, панове ?! deskew - есть, это исправление перекоса (когда книжку положили непараллельно границам окна),
Отв: Проблемы и приемы OCR: dewarp
deskew - это совсем из другой оперы.
Возьмите ложку. Положите ее на стол под уголм 45градусов к краю. Исправьте положение ложки. А теперь СОГНИТЕ ложку поплам и попрубуйте исправить перекос относительно края тем же способом
Отв: Проблемы и приемы OCR: dewarp
В моем случае ложка выглядит примерно так: Я думал, что это именно warp
Отв: Проблемы и приемы OCR: dewarp
Я не издеваюсь , я же сказал что не помню, значит не deskew а второй - staighten text lines:
Отв: Проблемы и приемы OCR: dewarp
Теоретически в 8 и 9 Файнридерах имеется встроенный механизм коррекции:
На практике, выработанной на 4м ещё файнридере, лучшим удалителем искажений в зоне разворота служит левая рука, прижимающая книгу к сканеру в момент сканирования... :)
...Каких либо отдельных программ, позволяющих выпрямлять строки я никогда не встречал. Теоретически это можно проделать в фотошопе, но... страницу, пусть две. А сотню? Сомневаюсь.
Отв: Проблемы и приемы OCR: dewarp
АААА!!!! Спасибо, Jolly Roger - ака, и вправду есть! Они его спрятали неочевидным образом.
Если кто-нибудь еще на эти грабли наступит, тулза работает и выглядит вот так:
Отв: Проблемы и приемы OCR: dewarp
Дык а я о чем ?
Отв: Проблемы и приемы OCR: dewarp
Виноват, подумал, что она в опциях сканирования сидит.
Отв: Проблемы и приемы OCR: dewarp
Вроде бы именно такие искривления исправляет Book Restorer. Подробности на ru-board.
Отв: Спасибо!
Век живи - век учись... Действительно, есть и отдельная программа под задачу:
http://djvu-soft.narod.ru/scan/curved_text.htm
...как я понимаю, у неё настроек побогаче будет. Видимо, для сложных случаев может оказаться предпочтительней.
Отв: Проблемы и приемы OCR: dewarp
На сорсфорже была утилитка unpaper - она, кажется, умела автоматически делать обработку сканированных страниц, выравнивая картинки, зачищая поля и выравнивая интенсивность фона. Заодно резала на страницы, если сканировался разворот.
Отв: Проблемы и приемы OCR: dewarp
http://unpaper.berlios.de
А строки, AFAIK, не ровняет.
Но вобщем ничего, пользуюсь периодически.
Отв: Проблемы и приемы OCR: dewarp
Если нужно подготовить скан для создания дежавю, то лучше выпрямить строки программой BookRestorer. Там же можно сделать все остальное (чистка, обрезка и т. д.)
Отв: Проблемы и приемы OCR: dewarp
Покажите, плз, мне нормально выпрямленные букресторером строки
Я пробовал это делалать, у меня не получилось. У моих знакомых по ру-боарду тоже.
Отв: Проблемы и приемы OCR: dewarp
Показать в буквальном смысле не могу, т. к. не сохраняю исходники во-первых, и не помню какие именно строки были выпрямленыв во-вторых. Но этой функцией пользовался не раз и не два. Настройки дефолтные. Правда, изгиб касался максимум 3-4 строк внизу страницы. Обычно все же стараюсь прижимать книгу к сканеру :) Совсем уж бракованный скан проще переснять, чем маяться с ним.