<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>OCR w dokumentach &#187; OCR w systemie</title>
	<atom:link href="/category/ocrsys/feed/" rel="self" type="application/rss+xml" />
	<link>http://ocrwdokumentach.pl</link>
	<description>Jedyny, polski blog o Optycznym Rozpoznawaniu Znaków</description>
	<lastBuildDate>Wed, 12 Aug 2015 10:43:17 +0000</lastBuildDate>
	<language>pl-PL</language>
	<sy:updatePeriod>hourly</sy:updatePeriod>
	<sy:updateFrequency>1</sy:updateFrequency>
	
	<item>
		<title>Szablon OCR &#8211; dedykowany czy uniwersalny?</title>
		<link>http://ocrwdokumentach.pl/szablon-ocr-dedykowany-czy-uniwersalny/</link>
		<comments>http://ocrwdokumentach.pl/szablon-ocr-dedykowany-czy-uniwersalny/#comments</comments>
		<pubDate>Fri, 06 Dec 2013 13:09:38 +0000</pubDate>
		<dc:creator><![CDATA[Michał Rykiert]]></dc:creator>
				<category><![CDATA[OCR w systemie]]></category>
		<category><![CDATA[Zastosowanie OCR]]></category>
		<category><![CDATA[dedykowany]]></category>
		<category><![CDATA[dokument]]></category>
		<category><![CDATA[faktura]]></category>
		<category><![CDATA[moduł]]></category>
		<category><![CDATA[obieg dokumentów]]></category>
		<category><![CDATA[Optical Character Recognition]]></category>
		<category><![CDATA[Optyczne Rozpoznawanie Znaków]]></category>
		<category><![CDATA[sieć neuronowa]]></category>
		<category><![CDATA[sieci neuronowe]]></category>
		<category><![CDATA[szablon]]></category>
		<category><![CDATA[uniwersalny]]></category>

		<guid isPermaLink="false">http://ocrwdokumentach.pl/?p=402</guid>
		<description><![CDATA[<p>Sporo pisałem ostatnio o wykorzystaniu OCR w kontekście CAPTCHY. Jednakże nie można zapominać o tym, iż technologia Optycznego Rozpoznawania Znaków jest coraz powszechniej wykorzystywana w firmach. Największy zwrot z inwestycji</p>
<p>Post <a rel="nofollow" href="/szablon-ocr-dedykowany-czy-uniwersalny/">Szablon OCR &#8211; dedykowany czy uniwersalny?</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></description>
				<content:encoded><![CDATA[<p>Sporo pisałem ostatnio o wykorzystaniu <a title="OCR i CAPTCHA" href="/captcha-kontra-spam/" target="_blank">OCR w kontekście CAPTCHY</a>. Jednakże nie można zapominać o tym, iż technologia Optycznego Rozpoznawania Znaków jest coraz powszechniej wykorzystywana w firmach. Największy zwrot z inwestycji (<strong>ROI</strong>) uzyskuje się dzięki zespoleniu OCR-a z systemem obiegu dokumentów. Dlatego też jednym z najpopularniejszych scenariuszy zastosowania Optical Character Recognition jest procesowanie za jego pomocą faktur kosztowych.</p>
<p>Dlaczego? Załóżmy, że firma Kowalski ma 100 kontrahentów, od których regularnie dostaje faktury. Każdy z nich ma inny wzór dokumentu, przez co manualne rejestrowanie tychże staje się dość uciążliwe, ponieważ większość czasu pracownicy spędzają na odszukiwaniu poszczególnych danych.</p>
<p>Dlatego też firma Kowalski decyduje się na wdrożenie systemu <strong>obiegu dokumentów ze</strong> <strong>zintegrowanym modułem OCR</strong>, aby proces ten przyspieszyć i zoptymalizować.</p>
<h2>OCR a obieg dokumentów</h2>
<p>Jak działa takie rozwiązanie? Mamy dwa podstawowe warianty. Pierwszy zakłada, że kontrahenci firmy Kowalski idą z duchem czasu i zamiast zasypywać siedzibę firmy zbędnym papierem, przysyłają na odpowiednią skrzynkę <strong>faktury drogą e-mailową</strong>. Wówczas są one przechwytywane, automatycznie poddawane skanowaniu przez OCR, poszczególne wartości (np. kwota netto/brutto, NIP, data wystawienia itd.) przenoszone są automatycznie do elektronicznego formularza, a skan faktury załączany do obiegu. W dalszej kolejności dokument przechodzi przez ścieżkę akceptacji i trafia do archiwum.</p>
<p><span id="more-402"></span></p>
<p>Drugie rozwiązanie opiera się na tradycyjnej metodzie przesyłania faktur papierowych. Wówczas te wymagają ręcznego ich zaniesienia do skanera, a następnie uruchomienia odpowiedniego obiegu. Dalej proces wygląda tak samo jak w poprzednim przykładzie.</p>
<p>W porządku. Jak zatem działa OCR „pod spodem” na przykładzie <a title="Procesowanie faktur w elektronicznym obiegu dokumentów" href="http://www.webcon.pl/workflow-obieg-faktury-kosztowej">faktur w elektronicznym obiegu dokumentów</a>? Zasadniczo mamy dwie możliwości konfiguracji: za pomocą szablonu dedykowanego i uniwersalnego.</p>
<h2>Szablon dedykowany OCR</h2>
<p>Szablony dedykowane tworzy się osobno dla każdego kontrahenta, zgodnie ze wzorem jego faktury. Wówczas wskazujemy jakie konkretne informacje znajdować będą się w poszczególnych miejscach na danej fakturze. Rozwiązanie to pozwala na osiągnięcie <strong>bardzo wysokiej skuteczności rozpoznawania znaków</strong>, dzięki czemu zredukowany do minimum zostaje czas, potrzebny na sprawdzenie poprawności działania mechanizmu OCR. Niestety rozwiązanie to ma także swoje wady. Zakładając, że firma Kowalski ma 100 kontrahentów, którzy przysyłają jej faktury, zajdzie konieczność stworzenia 100 osobnych szablonów dla każdego z nich. Przyjmijmy, że stworzenie jednego szablonu dedykowanego zajmuje średnio pół dnia roboczego. Wychodzi na to, że aby uruchomić <strong>OCR faktur</strong>, na samo tworzenie szablonów należy poświęcić prawie <strong>2 miesiące</strong>… A co jeśli po jakimś czasie wzór faktury kontrahentów się zmieni? A co jeśli będziemy chcieli wdrożyć OCR dla innych typów dokumentów?</p>
<h2>Szablon uniwersalny OCR</h2>
<p>Alternatywą jest wykorzystanie szablonu uniwersalnego OCR. Wówczas<strong> rozpoznawane są poszczególne nazwy</strong>, tj. NIP, nazwa kontrahenta, kwota netto itd. <strong>bez względu na ich położenie na formularzu</strong>. Dzięki temu implementowany jest tylko <strong>jeden szablon dla wszystkich faktur</strong>. Rozwiązanie to zapewnia zdecydowanie k<strong>rótszy czas wdrożenia</strong>, a także nie wymaga wprowadzania modyfikacji w przypadku zmian we wzorze faktur kontrahentów. Jedynym minusem uniwersalnego szablonu jest fakt, iż zapewnia on nieznacznie mniejszą skuteczność rozpoznawania znaków od szablonów dedykowanych. Jednakże ze względu na fakt, iż praktycznie zawsze efekty działania OCR weryfikowane są przez człowieka, nie powinno być to zbyt uciążliwe.</p>
<p style="text-align: center;"><a href="/wp-content/uploads/2013/12/neural_networking.jpg"><img class="aligncenter size-full wp-image-405" alt="Szablon czy sieci neuronowe w OCR?" src="/wp-content/uploads/2013/12/neural_networking.jpg" width="552" height="367" /></a></p>
<h2>Sieci neuronowe?</h2>
<p>Bardzo obiecującym rozwiązaniem wydaje się być zastosowanie <strong>sieci neuronowych w rozpoznawaniu znaków</strong>. Tego typu mechanizmy mają <strong>zdolność uczenia</strong> się wraz z kolejnym zeskanowanym dokumentem, podnosząc tym samym skuteczność działania OCR. Wkrótce postaram się napisać więcej o tego typu oprogramowaniu.</p>
<h2>Co wybrać?</h2>
<p>Szablony dedykowane są rozwiązaniem przestarzałym, czasochłonnym we wdrożeniu i drogim w utrzymaniu. Obecnie optymalnym wyborem będzie zastosowanie<strong> szablonów uniwersalnych</strong>, które są zdecydowanie <strong>bardziej elastyczne i wydajne kosztowo</strong>. Niemniej jednak przyszłość może należeć do sieci neuronowych, które stale rozwijane będą w stanie dostarczać nową jakość w pełnotekstowym skanowaniu dokumentów.</p>
<p>Post <a rel="nofollow" href="/szablon-ocr-dedykowany-czy-uniwersalny/">Szablon OCR &#8211; dedykowany czy uniwersalny?</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></content:encoded>
			<wfw:commentRss>http://ocrwdokumentach.pl/szablon-ocr-dedykowany-czy-uniwersalny/feed/</wfw:commentRss>
		<slash:comments>0</slash:comments>
		</item>
		<item>
		<title>Zastosowanie modułu OCR w praktyce</title>
		<link>http://ocrwdokumentach.pl/zastosowanie-ocr-w-praktyce/</link>
		<comments>http://ocrwdokumentach.pl/zastosowanie-ocr-w-praktyce/#comments</comments>
		<pubDate>Thu, 21 Feb 2013 08:16:17 +0000</pubDate>
		<dc:creator><![CDATA[Michał Rykiert]]></dc:creator>
				<category><![CDATA[OCR w systemie]]></category>
		<category><![CDATA[Zastosowanie OCR]]></category>
		<category><![CDATA[algorytmy rozmyte]]></category>
		<category><![CDATA[dokumenty]]></category>
		<category><![CDATA[faktury]]></category>
		<category><![CDATA[flexi capture]]></category>
		<category><![CDATA[korzyści]]></category>
		<category><![CDATA[Optical Character Recognition]]></category>
		<category><![CDATA[przewaga]]></category>
		<category><![CDATA[WEBCON]]></category>
		<category><![CDATA[WEBCON BPS]]></category>
		<category><![CDATA[WEBCON Business Process Suite]]></category>
		<category><![CDATA[workflow]]></category>
		<category><![CDATA[zastosowanie]]></category>

		<guid isPermaLink="false">http://ocrwdokumentach.pl/?p=25</guid>
		<description><![CDATA[<p>W poprzednich wpisach skupiałem się bardziej na teoretycznym opisie tego czym jest Optical Character Recognition (OCR). Tymczasem warto byłoby zobaczyć jak całe rozwiązanie jest w stanie funkcjonować jako część większej</p>
<p>Post <a rel="nofollow" href="/zastosowanie-ocr-w-praktyce/">Zastosowanie modułu OCR w praktyce</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></description>
				<content:encoded><![CDATA[<p>W poprzednich wpisach skupiałem się bardziej na teoretycznym opisie tego czym jest Optical Character Recognition (OCR). Tymczasem warto byłoby zobaczyć jak całe rozwiązanie jest w stanie funkcjonować jako część większej platformy.</p>
<p>Obecnie moduł <strong>OCR</strong> najczęściej wykorzystywany jest w przedsiębiorstwach przy zarządzaniu elektronicznymi dokumentami. Jeśli przyjąć za kryterium wyboru sprawność w digitalizacji tradycyjnych dokumentów, a także procesy zarządzające ich obiegiem, jednym z ciekawszych rozwiązań na rynku jest <strong>WEBCON Business Process Suite,</strong> którego integralną częścią jest wbudowany OCR.</p>
<h3>Charakterystyczne cechy OCR w <a title="OCR w WEBCON Business Process Suite" href="http://www.webcon.pl/webconbps/overview">WEBCON BPS</a>:</h3>
<p>&#8211; oparty jest na logice <strong>algorytmów rozmytych </strong>– wyszukuje i zaznacza słowa kluczowe (np. NIP, data płatności), przez co nie ma konieczności tworzenia dedykowanego szablonu dla każdego kontrahenta. Informacje są pobierane i uzupełniane samoczynnie, a następnie przekazywane w systemie obiegu dokumentów do akceptacji.</p>
<p><span id="more-25"></span></p>
<p>&#8211; posiada <strong>prosty i przejrzysty panel</strong> obsługi skanowanych dokumentów. Najważniejsze informacje przenoszone są automatycznie do elektronicznego formularza i za pomocą jednego kliknięcia myszy można sprawdzić, w którym miejscu znajdują się na oryginale. Znaki, co do których program nie ma pewności, są zaznaczane na czerwono i mogą być edytowane</p>
<p>&#8211; jest <strong>systemem weryfikacji dokumentów</strong> stworzonym na bazie Microsoft SharePoint, dzięki czemu nie potrzebne są ani programy zewnętrzne, ani dodatkowe szkolenia dla pracowników, gdyż program cechuje znany i przyjazny interfejs</p>
<p><a title="OCR w WEBCON BPS" href="http://www.webcon.pl/ocr-i-rejestracja-dokumentow-sharepoint" target="_blank"><img class="size-full wp-image-125 aligncenter" title="Moduł OCR w WEBCON BPS" src="/wp-content/uploads/2013/02/webcon-obieg-faktur-ocr.png" alt="Moduł OCR w WEBCON BPS" width="492" height="289" /></a></p>
<p><strong>&#8211; </strong>jest <strong>zintegrowany z workflow</strong>, co pozwala np. na OCR dokumentów trafiających na foldery Exchange, prostą integrację z zewnętrznymi systemami oraz łatwe zaprojektowanie kompletnego obiegu dokumentów wewnątrz firmy.</p>
<p>&#8211; daje możliwość <strong>automatyzacji procesu skanowania dokumentów</strong> dzięki systemowi odczytu kodów kreskowych</p>
<p>&#8211; daje możliwość<strong> automatycznej rejestracji faktur</strong> w systemie obiegu dokumentów</p>
<p>&#8211; daje możliwość <strong>automatycznej rejestracji dokumentów</strong> przychodzących pocztą e-mail, faksem lub za pomocą EDI (Electronic Document Interchange)</p>
<p>&#8211;  daje możliwość ręcznej rejestracji dokumentów</p>
<p>&#8211; zapewnia <strong>szybkie i wielowątkowe procesowanie</strong> przychodzących dokumentów, dzięki silnikowi ABBYY <strong>Flexi Capture</strong>, umożliwiającemu m.in. samoczynne rozpoznawanie, klasyfikowanie i sortowanie dokumentów</p>
<h3>Podsumowanie:</h3>
<p>Jak widać możliwości jest sporo i wiele elementów zostało zaprojektowanych w sposób, który ułatwiałby wykorzystanie OCR-a na co dzień. Co prawda duży zakres funkcjonalności oferuje także np. Kofax Capture, ale jego wykorzystanie z co najmniej kilku powodów jest problematyczne. Jest przede wszystkim drogi, a w dodatku Kofax przestał supportować swoje produkty w Polsce. Ponadto jest zewnętrzną aplikacją, co powoduje że trzeba go integrować z elektronicznym systemem obiegu dokumentów (jeśli firma takowy posiada). Wymaga także osobnych serwerów i osobnej obsługi.</p>
<p>Post <a rel="nofollow" href="/zastosowanie-ocr-w-praktyce/">Zastosowanie modułu OCR w praktyce</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></content:encoded>
			<wfw:commentRss>http://ocrwdokumentach.pl/zastosowanie-ocr-w-praktyce/feed/</wfw:commentRss>
		<slash:comments>2</slash:comments>
		</item>
	</channel>
</rss>
