Программа для сканирования в pdf м125. Сканирование документов в формат PDF

В данном документе описывается создание многостраничного файла PDF для использования в программе Adobe Acrobat Writer (или подобной) с использованием ПО обработки фотографий и изображений HP.

Сканирование нескольких страниц без использования устройства автоматической подачи документов (АПД)

    Поместите первую страницу документа на стекло сканера и откройте программу HP Director.

    Нажмите Сканировать документ

    Выберите , Текст как изображения , Редактируемый текст или .

    Сохранить в файл .

    Нажмите кнопку Сканирование . Нажмите Принять , если откроется окно предварительного просмотра.

    После сканирования первой страницы, как описано в пунктах 1-5 выше, появится запрос "Сканировать другую страницу в текущий документ?" Поместите следующую страницу на стекло сканера и нажмите Да .

    Для сканирования всех страниц повторите вышеуказанные действия. Нажмите Нет после сканирования последней страницы. Откроется окно "Сохранить как".

Сканирование нескольких страниц с использованием АПД

    Поместите сканируемые документы в АПД и откройте программу HP Director.

    Нажмите Сканировать документ . Откроется окно "Сканировать документ".

    Выберите Текст или изображения как изображения , Текст как изображения , Редактируемый текст или Редактируемый текст без изображений .

    В поле назначения в нижней части окна нажмите Сохранить в файл .

    Нажмите кнопку Сканирование . Если откроется окно предварительного просмотра, дождитесь окончания сканирования всех страниц и нажмите Принять . Если окно предварительного просмотра не откроется, после сканирования всех страниц откроется окно "Сохранить как".

Наверное, каждому знакома ситуация, когда скан документа, например, страницы книги, необходимо преобразовать в печатный текст. Для этого существуют специальные программы, но основная их масса очень мало кому известна. На слуху у всех, пожалуй, только ABBYY FineReader. Действительно, FineReader вне конкуренции. Это лучшая программа для сканирования и распознавания текста на русском языке, однако выпускается она исключительно в платных версиях и стоит весьма недешево. Многие ли готовы выложить за самую бюджетную лицензию почти 7 000 рублей, если собираются обрабатывать одну-две книги в год?

Если вы считаете покупку дорогостоящего коммерческого продукта неоправданной, почему бы не воспользоваться аналогами, среди которых есть бесплатные? Да, они не так богаты функциями, но со многими задачами, которые, как считают многие, «по зубам» только FineReader, справляются вполне успешно. Так давайте познакомимся с несколькими доступными альтернативами. И заодно посмотрим, чем они отличаются от общепризнанного эталона.

Чтобы сравнивать другие программы с ABBYY FineReader , выясним, чем же он так хорош. Вот перечень его основных функций:

  • Работа с фотографиями, сканами и бумажными документами.
  • Редактирование содержимого файлов pdf — текста, отдельных блоков, интерактивных элементов и прочего.
  • Конвертация pdf в формат Microsoft Word и обратно. Создание pdf-файлов из любых текстовых документов.
  • Сравнение содержимого документов на 35 языках, например, отсканированного бумажного и электронного (не во всех редакциях).
  • Распознавание и преобразование сканированных текстов, таблиц, математических формул.
  • Автоматическое выполнение рутинных операций (не во всех редакциях).
  • Поддержка 192 национальных алфавитов.
  • Проверка орфографии распознанного текста на русском, украинском и еще 46 языках.
  • Поддержка 10 графических и 10 текстовых форматов входных файлов, не считая pdf.
  • Сохранение файлов в графическом и текстовом форматах, а также в виде электронных книг EPUB и FB2.
  • Чтение штрих-кодов.
  • Интерфейс на 20 языках, включая русский и украинский.
  • Поддержка большинства существующих моделей сканеров.

Возможности программы великолепны, но для домашних пользователей, которые не обрабатывают документы в промышленных объемах, избыточны. Впрочем, тем, кому нужно распознать лишь несколько страниц, компания ABBYY предоставляет услуги бесплатно — через веб-сервис FineReaderOnline . После регистрации доступна обработка 10 страниц отсканированного или сфотографированного текста, в дальнейшем — по 5 страниц в месяц. Больше — за доплату.

Стоимость самой недорогой лицензии FineReader для установки на компьютер — 6990 рублей (версия Standard).

Крошечная и крайне простая бесплатная утилитка , конечно, не в состоянии конкурировать с монстром, но основную задачу — распознавание сканированного текста, решает как положено. Причем для этого она не требует даже установки на ПК (портабельная). И управляется всего тремя кнопками.

Для распознавания текста с помощью WinScan2PDF нажмите «Выбрать источник» и укажите подключенный сканер (с готовыми файлами программа, к сожалению, не работает). Поместите в сканер документ и нажмите «Сканировать». Если хотите отменить операцию, нажмите «Отмена». Вот и вся инструкция.

Утилита поддерживает 23 языка, включая русский, и работает с многостраничными файлами. Готовый результат сохраняется в формате pdf, скан документа — в jpg.

Веб-сервис Free-OCR.com

Free-OCR.com (OCR — Optical character recognition, оптическое распознавание символов) — бесплатный Интернет-сервис для распознавания отсканированных или сфотографированных текстов, сохраненных в формате графического изображения (jpg, gif, tiff, bmp) или pdf. Поддерживает 29 языков, включая русский и украинский, причем пользователь может выбрать не один, а несколько, если их содержит исходный текст.

Free-OCR не требует регистрации и не имеет каких-либо ограничений по количеству загруженных документов. Ограничивается только размер файла — до 6 Mb. Многостраничные документы сервис не обрабатывает, точнее, игнорирует всё, кроме первого листа.

Скорость распознавания сканированного текста довольно высока. Лист А4 с фрагментом книги на русском языке был обработан примерно за 5 секунд, но вот качество не порадовало. Крупные шрифты — как в детских книжках, он распознает на 100%, а средние и мелкие — примерно на 80%. С англоязычными документами дела обстоят несколько лучше — мелкий и неконтрастный шрифт распознался правильно примерно на 95%.

Веб-сервис Free Online OCR

— еще один бесплатный веб-сервис, очень похожий на предыдущий, но с расширенным функционалом. Он:

  • Поддерживает 106 языков.
  • Обрабатывает многостраничные документы, в том числе на нескольких языках.
  • Распознает тексты на сканах и фотодокументах множества типов. Помимо 10 форматов графических изображений, обрабатывает документы pdf, djvu, doxc, odt, архивы zip и сжатые файлы Unix.
  • Сохраняет выходные файлы в одном из 3 форматов: txt, doc и pdf.
  • Поддерживает распознавание математических уравнений.
  • Позволяет повернуть изображение на 90-180° в обе стороны.
  • Правильно распознает текст в нескольких столбцах на одной странице.
  • Может распознать один выбранный фрагмент.
  • После обработки предлагает скопировать файл в буфер обмена, скачать на компьютер, загрузить на сервис Google Docs или опубликовать в Интернете. Также доступна возможность сразу перевести текст на другой язык, используя Google Translate или Bing Translator.

Надо отдать должное Free Online OCR и за то, что он неплохо читает картинки низкого разрешения и малой контрастности. Результат распознавания всех скормленных ему русскоязычных текстов отказался стопроцентным или близким к этому.

Free Online OCR, по нашему мнению, одна из лучших альтернатив FineReader, но бесплатно он обрабатывает только 20 страниц (правда, не указано, за какой период). Дальнейшее использование сервиса стоит от $0,5 за страницу.

Microsoft OneNote

Программа для создания заметок Microsoft OneNote , исключая очень старые и последнюю — 17 версии, тоже содержит функционал OCR. Он не такой продвинутый как в специализированных приложениях, но тоже пригодный к использованию, если нет других вариантов.

Чтобы распознать текст с изображения с помощью OneNote, вставьте картинку в файл («Рисунок» — «Вставить»), нажмите на нее правой клавишей мышки и выберите «Копировать текст из рисунка».

После этого вставьте скопированный текст в любое место заметки.

По умолчанию языком распознавания назначен английский. Если вам нужен русский или какой-либо другой, измените настройку вручную.

Качество распознавания русскоязычного текста в Microsoft OneNote оставляет желать лучшего, поэтому его нельзя назвать полноценной заменой FineReader. Да и обрабатывать в нем большие многостраничные документы весьма неудобно.

SimpleOCR

Старенькая бесплатная программа SimpleOCR — тоже весьма достойный инструмент распознавания текстов с электронных изображений и сканов, но, к сожалению, без поддержки русского языка. Зато в ней есть уникальная функция считывания рукописных слов, а также редактор, позволяющий исправить ошибки перед сохранением готового результата.

Другие возможности SimpleOCR:

  • Проверка орфографии с возможностью пополнять словарь вручную.
  • Чтение документов в низком разрешении и с помарками (есть опция очистки «шума»).
  • Максимально близкая подборка шрифта и передача стилей написания (жирный, курсив). При желании функцию можно отключить.
  • Одновременная обработка нескольких листов или отдельного фрагмента.
  • Выделение возможных ошибок в готовом тексте для ручного редактирования.
  • Поддержка множества модификаций сканеров.
  • Входные форматы электронных документов: tif, jpg, bmp, ink, а также сканы.
  • Сохранение готового текста в форматах txt и doc.

Качество распознавания и печатных текстов, и рукописей довольно высокое.

Программу можно было бы назвать универсальной, если бы не ограничение языковой поддержки. Последняя версия поддерживает только английский, французский и датский языки, добавление других, скорее всего, не планируется. Интерфейс полностью на английском, но прост для понимания. Кроме того, в главном окне есть кнопка «Demo», которая запускает обучающий ролик по работе с SimpleOCR.

Программа бельгийской компании-разработчика I.R.I.S — вот это действительно настоящий конкурент российскому ABBYY FineReader. Мощная, быстрая, кроссплатформенная, основанная на фирменном OCR-движке, используемом производителями Adobe, HP и Canon, она великолепно распознает даже самые трудночитаемые тексты. Поддерживает 137 языков, среди которых есть русский и украинский.

Особенности и функции Readiris:

  • Самая высокая скорость обработки файлов среди приложений такого класса, рассчитано на большие объемы.
  • Сохранение форматирования исходного текста (шрифты, кегль, стиль написания).
  • Одиночная и пакетная обработка файлов, поддержка многостраничных документов.
  • Распознавание математических уравнений, специальных символов и штрих-кодов.
  • Очистка текста от «шумов» — линий, помарок и т. п.
  • Интеграция с различными облачными сервисами — Google Документы, Evernote, Dropbox, SharePoint и некоторыми другими.
  • Поддержка всех современных моделей сканеров.
  • Форматы входных данных: pdf, djvu, jpg, png и другие, в которых сохраняют графические изображения, а также полученное непосредственно со сканера.
  • Форматы выходных данных: doc, docx, xls, xlsx, txt, rtf, html, csv, pdf. Поддерживается конвертация в djvu.

Интерфейс программы русскоязычный, использование интуитивно понятно. Она не предоставляет пользователям возможности редактировать содержимое файлов pdf, как FineReader, но с главной задачей — распознаванием текстов, на наш взгляд, справляется отлично.

Readiris выпускается в двух платных версиях. Стоимость лицензии Pro составляет 99,00€, Corporate — 199€. Почти как у ABBYY.

Freemore OCR

Freemore OCR — (! сайт программы http://freemoresoft.com/freeocr/index.php может блокироваться антивирусами из-за встроенного в установщик рекламного «мусора») — еще одна простая, компактная и бесплатная утилитка, которая тоже неплохо распознает тексты, но по умолчанию только на английском. Пакеты других языков нужно загружать и устанавливать отдельно.

Прочие функции и возможности Freemore OCR:

  • Одновременная работа с несколькими сканерами.
  • Поддержка множества форматов графических данных, в том числе проприетарных, вроде psd (файл Adobe Photoshop). Стандартные форматы графики поддерживаются все.
  • Поддержка pdf.
  • Сохранение готового результата в формате pdf, txt или docx, причем для экспорта текста в Word достаточно нажать одну кнопку на панели инструментов.
  • Встроенный редактор (к сожалению, форматирование исходного документа программа не сохраняет).
  • Просмотр свойств документа.
  • Печать распознанного текста прямо из главного окна.
  • Защита паролем файлов в формате pdf.

На первый взгляд интерфейс программы может показаться сложным, но на самом деле пользоваться ею очень легко. Инструменты поделены на группы, как на ленте Microsoft Office. Если рассмотреть их повнимательнее, назначение той или иной кнопки быстро станет понятным.

Чтобы загрузить электронный документ в окно Freemore OCR, сначала выберем его тип — изображение или файл pdf, и следом нажмем соответствующую кнопку «Load». Чтобы начать процесс распознавания, нажимаем на кнопку «OCR» в одноименной группе инструментов рядом с изображением волшебной палочки (показана на скриншоте).

Результат сканирования англоязычных текстов как с хорошо-, так и с плохочитаемой картинки оказался вполне удовлетворительным. Не понравилось лишь одно — то, что вместе с программой на компьютер устанавливается всякий мусор — какие-то липовые антивирусные сканеры, оптимизаторы и прочие ненужные вещи, причем без возможности отказаться от них во время установки. Словом, если бы не этот недостаток, приложение можно было бы рекомендовать в качестве неплохой бесплатной альтернативы FineReader.

Было довольно хорошо и подробно описано про этот формат файла и операции с ним.
Он довольно хорош тем, что отсканированные документы и файлы в конечном счете имеют меньший размер по сравнению с отканированным изображением (примерно в 3-5 раз). Это один из его плюсов.
Второй плюс - это возможность объединить отсканированные файлы в один. Конечно, можно объединить их в Word`e , но посмотрев на первый плюс можно отказаться от этого. Тем более если файлы содержат не только текст, но и изображения.

Так или иначе, но в этой статье рассмотрим программы специально предназначенные для этой нужной задачи - сканировать и объединить файлы в один pdf документ.

Первая - это Scan2PDF , немецкий продукт.
Чудо, а не программа. Вот её достоинства:

  • бесплатная;
  • русский язык интерфейса;
  • малый размер установочного/исполняемого файла;
  • занимает мало места на при установке;
  • имеет портабельную (не требующую установки) версию.
  • позволяет создавать pdf файлы уже из имеющихся изображений.

    Из недостатков можно отметить что нет поддержки Windows 8 и то, что не обновлялась с 2005 года.

    Итак, переходим к руководству.

    После установки и запуски появится вот такое главное окно программы:

    Сразу жмем на меню Options и выбираем Options =)


    В поле Languages выбираем Russian и окно программы сразу преобразиться - будет переведено на русский язык. Осталось только его закрыть кнопкой Close :


    Теперь программа стала на русском и довольно понятная:


    Назначения кнопок думаю не стоит описывать, там и по изображению их понятно, да и подсказки всплывают.
    Окно программы в работе показано ниже:
  • В последнее время стали все чаще и чаще появляться сканеры, которые не только не имеют своего собственного программного обеспечения для сканирования (устанавливают только драйвер, а для работы необходимо использовать штатное программное обеспечение Windows), но и физической кнопки «Сканировать» на корпусе. Это может сильно затруднить работу со сканером, если необходимо отсканировать несколько документов сразу.

    Если вам необходимо отсканировать, например, договор или какой-либо иной документ, состоящий из нескольких страниц, то в этом случае сканирование превращается в сущий ад. Мало того, что надо каждый раз запускать сканирование через «Пуск» – «Устройства и принтеры», так еще и для каждой отдельной страницы выставлять одни и те же настройки, что особенно доставляет неудобства. Но все было бы настолько ужасно, если бы не бесплатное приложение Scan2PDF, которое делает сразу два полезных дела одновременно.

    Помимо удобного способа сканирования в один клик и без лишних запросов, Scan2PDF может сохранить все полученные изображения в один PDF документ. По сути, получится один файл-книга с нужным документом или несколькими документами, которые гораздо легче передать по электронной почте или выложить на сайте.

    При сохранении отсканированного изображения в JPG получается весьма внушительного размера файл, который без сжатия и обработки передать бывает проблематично или просто неудобного. А если таких файлов много, то задача еще сильнее усложняется. При создании же PDF все гораздо проще, так как формируется единый документ, который содержит в себе все материалы и занимает не очень много места. Его можно быстро передать по сети.

    Например, я недавно сканировал два документа, каждый из которых имеет одну страницу. В формате JPG у меня получилось два файла, каждый из которых занимает 2.5Мб. Да, можно было бы изменить настройки или обработать файлы в редакторе и получить примерно по 150Кб на файл. Но это сложно и зачастую неудобно. В случае, когда я сканировал с использованием программы Scan2PDF, я получил один PDF с общим объемом всего 340Кб.

    В целом программа Scan2PDF весьма полезная штука. В особенности для тех пользователей, кому приходится время от времени сканировать документы по несколько страниц. Из явных недостатков я бы отметил отсутствие русского языка в интерфейсе при установке, хотя сам по себе русский язык поддерживается. Его можно легко активировать: зайти в настройки (Options) и в блоке Language выбрать Russia.

    Еще один недостаток утилиты — невозможность работы сразу с несколькими документами в PDF. Можно отсканировать и сохранить только один документ. Если вам необходимо сохранить отсканированные копии в несколько файлов, то бумаги необходимо разбить на стопки и сканировать частями, последовательно сохраняя каждую.

    Скачать бесплатно программу для быстрого и легкого сканирования документов. Благодаря своей функциональности позволит вам с легкостью сканировать документы и составит конкуренцию платным продуктам.

    Если вы работаете секретарем, бухгалтером или просто, ваша работа связана с частым сканированием документов , то вам необходим правильный и быстрый инструмент, который бы помог легко производить монотонные манипуляции. Таким инструментом может быть PaperScanот компании ORPALIS .

    Описание программы ParepScan

    Интерфейс приложения не вызывает каких-то вопросов. Все легко воспринимается, и интуитивно понятно. Верхняя часть содержит в себе иконки панели управления, а правая - иконки визуального графического редактора. Основную же часть занимает блок, в котором размещается отсканированный документ.

    Для сканирования в ParepScan имеется система поддержки практически всех производителей сканеров, а также многофункциональных устройств (МФУ ). Поддержка включает устройства, которые работают на протоколах (или интерфейсах) TWAIN и WIA .

    Для сканирования документа вам необходимо нажать на кнопку «добавить», предварительно включив сканер или МФУ . После чего, появится окно выбора параметров. В данном окне вам предоставляется возможность задать настройки для текущего документа. Например: размеры, выбрать цветной или черно-белый скан документа , выбрать качество , с которым нужно отсканировать документ. Выбор качества зависит от возможностей вашего сканера и его разрешения. Чем больше разрешение, тем выше качество, размер и вес полученного файла.

    После того, как вы получили отсканированный файл, он подгружается в окно интерфейса программы, где его можно отредактировать, чтобы сохранить. Первым делом можно отрезать лишние части, которые не нужны, например, белые части страниц, или область, которая не была задействована в сканере. Затем, вам доступна панель для графического редактирования файла. С ее помощью вы сможете вставлять на полученный файл надписи, изображения, штамп, рисовать от руки, рисовать линии, фигуры, закрашивать их и т.д. То есть полный набор, по примеру Paint. Также, можно накладывать фильтры, изменять и корректировать баланс белого, яркость, контрастность, цветовой баланс и так далее, чтобы сделать документ максимально качественным и читаемым.

    Закончив с редактированием, файл можно сохранить в виде изображения. Скачать бесплатно ParepScan для сканирования документов вы можете по ссылке ниже с официального сайта . Также, ParepScan имеет и платные версии, которые отличаются лишь большим набором функций, большинство из которых вам не пригодится в повседневном использовании программы.