<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>OCR w dokumentach &#187; Informacje ogólne</title>
	<atom:link href="/category/infog/feed/" rel="self" type="application/rss+xml" />
	<link>http://ocrwdokumentach.pl</link>
	<description>Jedyny, polski blog o Optycznym Rozpoznawaniu Znaków</description>
	<lastBuildDate>Wed, 12 Aug 2015 10:43:17 +0000</lastBuildDate>
	<language>pl-PL</language>
	<sy:updatePeriod>hourly</sy:updatePeriod>
	<sy:updateFrequency>1</sy:updateFrequency>
	
	<item>
		<title>OCR wzbogacony o sieci neuronowe = nowa jakość?</title>
		<link>http://ocrwdokumentach.pl/ocr-wzbogacony-o-sieci-neuronowe-nowa-jakosc/</link>
		<comments>http://ocrwdokumentach.pl/ocr-wzbogacony-o-sieci-neuronowe-nowa-jakosc/#comments</comments>
		<pubDate>Wed, 12 Aug 2015 10:41:21 +0000</pubDate>
		<dc:creator><![CDATA[Michał Rykiert]]></dc:creator>
				<category><![CDATA[Informacje ogólne]]></category>
		<category><![CDATA[Jak działa OCR?]]></category>
		<category><![CDATA[faktura]]></category>
		<category><![CDATA[faktury]]></category>
		<category><![CDATA[Optical Character Recognition]]></category>
		<category><![CDATA[searchable PDF]]></category>
		<category><![CDATA[sieć neuronowa]]></category>
		<category><![CDATA[sieci neuronowe]]></category>

		<guid isPermaLink="false">http://ocrwdokumentach.pl/?p=424</guid>
		<description><![CDATA[<p>Mechanizm Optycznego Rozpoznawania Znaków jest obecnie narzędziem o wysokiej skuteczności i różnorodnym zastosowaniu – od firmowych dokumentów do książek digitalizowanych przez (nie)świadomych użytkowników reCAPTCHY. A co gdyby dodać do OCR</p>
<p>Post <a rel="nofollow" href="/ocr-wzbogacony-o-sieci-neuronowe-nowa-jakosc/">OCR wzbogacony o sieci neuronowe = nowa jakość?</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></description>
				<content:encoded><![CDATA[<p>Mechanizm Optycznego Rozpoznawania Znaków jest obecnie narzędziem o wysokiej skuteczności i różnorodnym zastosowaniu – od firmowych dokumentów do książek digitalizowanych przez <a href="/jak-digitalizujemy-ksiazki-o-tym-nie-wiedzac/" target="_blank">(nie)świadomych użytkowników reCAPTCHY</a>. A co gdyby dodać do OCR także namiastkę inteligencji w postaci sieci neuronowych?</p>
<p>Zanim przejdę jednak do omówienia możliwości oferowanych przez sieci neuronowe, chciałbym zwrócić uwagę na fakt, iż obecnie możemy podzielić działanie <strong>OCR</strong> na dwie sfery:</p>
<p><span id="more-424"></span></p>
<h4>Rozpoznanie znaków</h4>
<p>Mechanizm rozpoznaje pojedyncze znaki, a poprzez analizowanie odstępów w skanowanym tekście dzieli je na wyrazy. Tego typu działanie służy np. do tworzenia tzw. „wyszukiwalnych plików PDF” (z ang. <strong>searchable PDF</strong>). W zależności od producenta, skuteczność rozpoznania zwiększana jest poprzez zastosowanie kolejnych warstw algorytmów, np. porównujących rozpoznaną frazę z wbudowanym słownikiem.</p>
<h4>Rozpoznanie treści</h4>
<p>Tutaj wykorzystywana jest pierwsza metoda w połączeniu z zaawansowanymi mechanizmami, które analizują rozpoznanie tekstu także w kontekście słów znajdujących się w jego bezpośredniej okolicy. OCR identyfikuje poszczególne wyrazy i sprawdza jak rozpoznanie wpasowuje się w całość skanowanego tekstu.</p>
<p>W tym drugim przypadku szczególnie przydatne okazują się <strong>sieci neuronowe</strong>, które zawierają zestaw reguł wg których rozpoznawane są poszczególne słowa i frazy. Weźmy za przykład faktury. OCR „wie”, że dane o wystawiającym fakturę powinny znajdować się w okolicach prawego górnego rogu. Nazwa ulicy poprzedzona jest wyrazem „ul.” po którym następuje numer domu, a następnie kod pocztowy i miasto. Natomiast numer konta bankowego ma 26 cyfr, zazwyczaj zapisany jest w określonym formacie i występuje obok słowa bank.</p>
<p><a href="/wp-content/uploads/2015/08/OCR-AI.png"><img class="aligncenter wp-image-427 size-large" title="OCR - sieci neuronowe" src="/wp-content/uploads/2015/08/OCR-AI-1024x474.png" alt="OCR sieci neuronowe" width="530" height="245" /></a></p>
<h2>Sieci neuronowe – z czym się to je</h2>
<p>Powyższe, to oczywiście prosty przykład, a tego typu reguł jest naprawdę dużo. To czym różni od siebie szablony rozpoznawania dokumentów od sieci neuronowych, to <strong>możliwość dynamicznej zmiany i „douczania”</strong> tych drugich, na podstawie rozpoznawanych dokumentów. Przy czym w przeciwieństwie do dedykowanych bądź uniwersalnych szablonów, nie jest to czynność wymagająca pracy programistycznej.</p>
<p>Odpowiednio przygotowany interfejs pozwoli każdemu użytkownikowi na wprowadzenie odpowiednich zmian i zmodyfikowanie sieci. Pomimo niebagatelnych zalet takiego rozwiązania (łatwość wykorzystania, elastyczność), <strong>istnieje też pewne ryzyko</strong>. Poprzez nieumiejętne „szkolenie” sieci neuronowych, można je „popsuć”. Prostym przykładem jest wskazywanie przez użytkownika błędnych danych jako poprawne. Idąc za przykładem faktur, byłoby to np. wskazanie numeru telefonu jako NIP-u sprzedawcy. Im więcej tego typu modyfikacji, tym gorsze będą wyniki rozpoznania.</p>
<p>Istnieją też przypadki pośrednie. W <a href="http://www.webcon.pl/" target="_blank">systemach obiegu dokumentów</a>, OCR jest rzeczą powszechnie wykorzystywaną. Zazwyczaj przygotowywana jest uniwersalna sieć neuronowa, działająca w odniesieniu do konkretnego typu dokumentu (np. wcześniej już wspomnianej faktury). Jednakże zdarzają się sytuacje, w których np. faktury od jednego z kontrahentów mają zupełnie inną strukturę niż w przypadku pozostałych. Co wtedy?</p>
<p>Uczenie uniwersalnej sieci na przykładzie wyjątków poskutkuje lepszym rozpoznaniem ich samych, jednocześnie negatywnie wpływając na identyfikacje całej reszty dokumentów. Dlatego też rozwiązania tej klasy oferują możliwość tworzenia <strong>dedykowanych sieci neuronowych</strong> ro skanowania dokumentów od wybranych kontrahentów. Wówczas wyróżnikiem, za pomocą którego system wybiera odpowiednią sieć neuronową, jest numer NIP, dlatego iż jest on unikalny i ściśle powiązanym z kontrahentem.</p>
<h2>Sieci neuronowe – co dalej?</h2>
<p>Bez wątpienia <strong>sieci neuronowe są przyszłością OCR</strong>. Wydaje się, iż jest to obecnie jedyny kierunek rozwoju, który może w przyszłości dostarczyć skuteczność rozpoznawania znaków i treści na poziomie 100%. W przypadku pisma maszynowego, nawet w kontekście słabej jakości skanów, nie jest to zbyt daleka przyszłość. Natomiast pismo odręczne to zupełnie inna bajka i na jakiekolwiek sensowne rezultaty (powyżej 80%, w warunkach „bojowych”, a nie laboratoryjnych) prawdopodobnie przyjdzie jeszcze nam trochę poczekać. Niemniej jednak &#8211; warto.</p>
<p>Post <a rel="nofollow" href="/ocr-wzbogacony-o-sieci-neuronowe-nowa-jakosc/">OCR wzbogacony o sieci neuronowe = nowa jakość?</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></content:encoded>
			<wfw:commentRss>http://ocrwdokumentach.pl/ocr-wzbogacony-o-sieci-neuronowe-nowa-jakosc/feed/</wfw:commentRss>
		<slash:comments>3</slash:comments>
		</item>
		<item>
		<title>Microsoft oferuje OCR w SkyDrive!</title>
		<link>http://ocrwdokumentach.pl/microsoft-oferuje-ocr-w-skydrive/</link>
		<comments>http://ocrwdokumentach.pl/microsoft-oferuje-ocr-w-skydrive/#comments</comments>
		<pubDate>Tue, 01 Oct 2013 12:49:11 +0000</pubDate>
		<dc:creator><![CDATA[Michał Rykiert]]></dc:creator>
				<category><![CDATA[Informacje ogólne]]></category>
		<category><![CDATA[bing]]></category>
		<category><![CDATA[chmura]]></category>
		<category><![CDATA[cloud]]></category>
		<category><![CDATA[Google]]></category>
		<category><![CDATA[microsoft]]></category>
		<category><![CDATA[Optical Character Recognition]]></category>
		<category><![CDATA[Optyczne Rozpoznawanie Znaków]]></category>
		<category><![CDATA[skydrive]]></category>

		<guid isPermaLink="false">http://ocrwdokumentach.pl/?p=346</guid>
		<description><![CDATA[<p>Software’owi giganci robią wszystko by nie pozostać w tyle i nie stracić pozycji rynkowej! Niedawno pisałem o OCR w usłudze Google Drive. Okazało się, że podobny patent zastosował Microsoft w</p>
<p>Post <a rel="nofollow" href="/microsoft-oferuje-ocr-w-skydrive/">Microsoft oferuje OCR w SkyDrive!</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></description>
				<content:encoded><![CDATA[<p>Software’owi giganci robią wszystko by nie pozostać w tyle i nie stracić pozycji rynkowej! Niedawno pisałem o OCR w usłudze <a title="OCR w Google Drive" href="/google-drive-darmowy-ocr/" target="_blank">Google Drive</a>. Okazało się, że podobny patent zastosował Microsoft w usłudze SkyDrive. Szykuje nam się OCR-owa wojna?</p>
<p>Od końca sierpnia tego roku, chmura Microsoftu ma możliwość <strong>optycznego rozpoznawania znaków</strong> z przesyłanych do niej zdjęć. W SkyDrive wykorzystano dokładnie ten sam engine, który obecny jest w wyszukiwarce Bing. Może być to przydatne w celu przechowania i możliwości szybkiego skopiowania informacji znajdujących się np. na ulotkach, wizytówkach, mapach i innych obiektach tego typu.<br />
<a href="/wp-content/uploads/2013/10/skydrive_0.jpg"><img class="aligncenter size-full wp-image-348" alt="OCR w SkyDrive" src="/wp-content/uploads/2013/10/skydrive_0.jpg" width="420" height="264" /></a><br />
Obecnie możliwe jest rozpoznawanie znaków w językach: angielskim, portugalskim, hiszpańskim, francuskim i niemieckim. Na tym polu Microsoft zdecydowanie <strong>przegrywa z Google</strong>, który oferuje skanowanie w 34 językach, w tym polskim.</p>
<p><span id="more-346"></span></p>
<p>Co ciekawe, usługa OCR zawita także do Windowsa 8.1, który będzie miał wbudowaną funkcjonalność o nazwie Smart Search.  Microsoft mocno stawia na <strong>chmurę</strong> i tajemnicą nie jest, że możliwe będzie przechowywanie wielu danych z jej pomocą. Znany jest już schemat działania tzw. smart files, czyli plików które przechowywane są w chmurze, a na fizycznych urządzeniach (PC, laptop, smartfon) odwzorowywana jest jedynie ich struktura. Pliki ściągane są tylko w razie konieczności. W przypadku folderu ze zdjęciami, który waży 5,6GB, na dysku zajmie on tylko 185mb na miniatury o niskiej rozdzielczości.</p>
<p>Co prawda w czasach gdy 1TB dysk kosztuje wręcz grosze, kwestia miejsca na dane nie jest ogromnym problemem, to może być jednak <strong>pożyteczna</strong> dla posiadaczy dysków SSD i urządzeń przenośnych, gdzie miejsce jest ograniczone.</p>
<p>Czy <strong>SkyDrive</strong> będzie w stanie skutecznie konkurować z Google Drive w kontekście OCR? Myślę, że tak, chociaż póki co liczba obsługiwanych języków jest zdecydowanie zbyt mała.</p>
<p>Post <a rel="nofollow" href="/microsoft-oferuje-ocr-w-skydrive/">Microsoft oferuje OCR w SkyDrive!</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></content:encoded>
			<wfw:commentRss>http://ocrwdokumentach.pl/microsoft-oferuje-ocr-w-skydrive/feed/</wfw:commentRss>
		<slash:comments>0</slash:comments>
		</item>
		<item>
		<title>Dokumenty papierowe a bezpieczeństwo danych</title>
		<link>http://ocrwdokumentach.pl/dokumenty-papierowe-a-bezpieczenstwo/</link>
		<comments>http://ocrwdokumentach.pl/dokumenty-papierowe-a-bezpieczenstwo/#comments</comments>
		<pubDate>Tue, 20 Aug 2013 10:07:08 +0000</pubDate>
		<dc:creator><![CDATA[Michał Rykiert]]></dc:creator>
				<category><![CDATA[Informacje ogólne]]></category>
		<category><![CDATA[Zastosowanie OCR]]></category>
		<category><![CDATA[bezpieczeństwo]]></category>
		<category><![CDATA[BPM]]></category>
		<category><![CDATA[BPMS]]></category>
		<category><![CDATA[DMS]]></category>
		<category><![CDATA[dokument]]></category>
		<category><![CDATA[elektroniczny dokument]]></category>
		<category><![CDATA[elektroniczny obieg dokumentów]]></category>
		<category><![CDATA[Kevin Mitnick]]></category>
		<category><![CDATA[korespondencja]]></category>
		<category><![CDATA[Optical Character Recognition]]></category>
		<category><![CDATA[papier]]></category>
		<category><![CDATA[papierowy dokument]]></category>
		<category><![CDATA[skan]]></category>
		<category><![CDATA[skanowanie]]></category>
		<category><![CDATA[system]]></category>

		<guid isPermaLink="false">http://ocrwdokumentach.pl/?p=299</guid>
		<description><![CDATA[<p>Znacie Kevina Mitnicka? To najsłynniejszy hacker na świecie, o którym Hollywood nakręcił film (Takedown, 2000). Zapewne słysząc słowo „hacker”, większość osób ma w wyobraźni obraz typowego „kujona” we flanelowej koszulki,</p>
<p>Post <a rel="nofollow" href="/dokumenty-papierowe-a-bezpieczenstwo/">Dokumenty papierowe a bezpieczeństwo danych</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></description>
				<content:encoded><![CDATA[<p>Znacie <strong>Kevina Mitnicka</strong>? To najsłynniejszy hacker na świecie, o którym Hollywood nakręcił film (Takedown, 2000). Zapewne słysząc słowo „hacker”, większość osób ma w wyobraźni obraz typowego „kujona” we flanelowej koszulki, który od komputera odchodzi tylko po to, aby zaspokoić swoje podstawowe potrzeby życiowe. Dużo mniej osób jednak wie, że Mitnick swój sukces zawdzięcza nie tylko znajomościom systemów komputerowych, ale także socjotechnice i tzw. <strong>dumpster divingowi</strong> (brzmi mądrze, lecz chodzi o pospolite grzebanie w śmieciach, w tym przypadku w poszukiwaniu przydatnych danych). Wszak najsłabszym ogniwem każdego systemu jest zawsze człowiek.</p>
<p>Mitnick, w książce „Sztuka Podstępu” udowadniał jak <strong>wiele ważnych informacji można znaleźć w pojemniku na odpady</strong> umieszczonym obok siedziby firmy. Dane pracowników, numery kont bankowych, korespondencję i wiele innych. Posiadając taką wiedzę, manipulowanie pracownikami okazywało się czynnością dziecinnie prostą.</p>
<p style="text-align: center;"><img class="aligncenter size-full wp-image-300" alt="Elektroniczne dokumenty vs papierowe dokumenty" src="/wp-content/uploads/2013/08/elektroniczny-dokument1.jpg" width="247" height="204" /></p>
<p>Jednakże wciąż w bardzo wielu organizacjach, kiedy przywołany zostaje temat zastąpienia papierowych dokumentów elektronicznymi, pracownicy obawiają się o bezpieczeństwo. Brak wiedzy, ignorancja czy zbytnie przyzwyczajenie do papieru? Przyjrzyjmy się <strong>jakie największe zagrożenia niesie ze sobą wykorzystywanie papierowych dokumentów</strong>.</p>
<p><span id="more-299"></span></p>
<h2>1. „Gdzieś się zapodział”.</h2>
<p>Około <strong>50%</strong> przypadków naruszenia bezpieczeństwa danych wynika z zagubienia dokumentu papierowego. I nic dziwnego. Często wędrują one po całej firmie, od działu do działu. Składane są na kupki, wkładane do segregatorów i szuflad. Przechodzą przez ręce kilkunastu(dziesięciu) pracowników i tylko kwestią czasu jest jak któryś z nich się zapodzieje. Nie ma jasnej ewidencji u kogo się aktualnie znajduje, kto i kiedy zmienił jego położenie. Pół biedy, jeśli został źle skatalogowany. Dużo gorzej w przypadku gdy trafia w niewłaściwe ręce. A konkurencja nie śpi&#8230;</p>
<h2>2. „Tego tu nie było”.</h2>
<p>Kolejnym zagrożeniem jakie stwarzają dokumenty papierowe jest manipulowanie danymi. O ile w <a title="System BPM z OCR i kodami kreskowymi" href="http://www.webcon.pl/workflow-sekretariat" target="_blank">systemie klasy BPM/DMS</a>, który pilnuje użytkowników w trakcie wprowadzania informacji, bardzo ciężko jest zawrzeć nieprawdziwe informacje (szczególnie jeśli system ten jest zintegrowany z <strong>OCR</strong> i na podstawie skanu uzupełnia pola). O tyle w przypadku dokumentu papierowego, zamienienie trójki na ósemkę czy sfałszowanie podpisu jest dużo łatwiejsze.</p>
<h2>3. „A te dokumenty to pana?”</h2>
<p>Dokumenty swobodnie leżące na biurku, zostawione w ogólnodostępnej drukarce, w koszu na śmieci, niezamknięte szafki, omyłkowo wysłane faksy itd. Potencjalnych zagrożeń jest wiele, a <strong>nieautoryzowany dostęp do poufnych informacji</strong> może być fatalny w skutkach. Tymczasem elektroniczny obieg dokumentów pozwala na zdefiniowanie kto będzie miał dostęp do których informacji. Ponadto dane mogą być szyfrowane i nawet w przypadku kiedy dostaną się w niepowołane ręce, mogą być chronione.</p>
<p><img class="aligncenter size-full wp-image-301" alt="Elektroniczny obieg dokumentów" src="/wp-content/uploads/2013/08/elektroniczny-dokument2.jpg" width="419" height="208" /></p>
<h2>Wnioski</h2>
<p>„<em>Jeżeli jesteśmy do czegoś przyzwyczajeni, sądzimy, że nam się to sprawiedliwie należy. Postęp nie ma większego wroga niż przyzwyczajenie</em>”. Przytoczone słowa José Martíego, perfekcyjnie wręcz odzwierciedlają największą przeszkodę, która stoi na drodze do pozbycia się papieru.<strong> Ludzkie nawyki bywają największą barierą</strong> w implementacji nowych rozwiązań. Należy jednak patrzeć na nie z punktu widzenia korzyści: większej produktywności, bezpieczeństwa, a w efekcie i wygody. Bo gdy przyzwyczaimy pracowników do nowego sposobu działania, nie będą już chcieli wracać do starych metod.</p>
<p>Post <a rel="nofollow" href="/dokumenty-papierowe-a-bezpieczenstwo/">Dokumenty papierowe a bezpieczeństwo danych</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></content:encoded>
			<wfw:commentRss>http://ocrwdokumentach.pl/dokumenty-papierowe-a-bezpieczenstwo/feed/</wfw:commentRss>
		<slash:comments>0</slash:comments>
		</item>
		<item>
		<title>Ngram Viewer – kolejny przykład wykorzystania OCR</title>
		<link>http://ocrwdokumentach.pl/ngram-viewer-przyklad-wykorzystania-ocr/</link>
		<comments>http://ocrwdokumentach.pl/ngram-viewer-przyklad-wykorzystania-ocr/#comments</comments>
		<pubDate>Wed, 05 Jun 2013 12:11:37 +0000</pubDate>
		<dc:creator><![CDATA[Michał Rykiert]]></dc:creator>
				<category><![CDATA[Informacje ogólne]]></category>
		<category><![CDATA[Zastosowanie OCR]]></category>
		<category><![CDATA[Google]]></category>
		<category><![CDATA[Google Labs]]></category>
		<category><![CDATA[historia]]></category>
		<category><![CDATA[językoznawstwo]]></category>
		<category><![CDATA[książki]]></category>
		<category><![CDATA[ngram viewer]]></category>
		<category><![CDATA[Optical Character Recognition]]></category>
		<category><![CDATA[skanowanie]]></category>
		<category><![CDATA[statystyki]]></category>

		<guid isPermaLink="false">http://ocrwdokumentach.pl/?p=243</guid>
		<description><![CDATA[<p>Pamiętacie wpis o reCAPTCHY*, który ujawniał jak na co dzień skanujemy książki? Teraz czas na system, który pozwala wykorzystać zeskanowane materiały. Ngram Viewer, bo o nim mowa, stworzony został przez</p>
<p>Post <a rel="nofollow" href="/ngram-viewer-przyklad-wykorzystania-ocr/">Ngram Viewer – kolejny przykład wykorzystania OCR</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></description>
				<content:encoded><![CDATA[<p><!--[if gte mso 9]><xml>
<o:OfficeDocumentSettings>
<o:RelyOnVML/>
<o:AllowPNG/>
</o:OfficeDocumentSettings>
</xml><![endif]--></p>
<p><!--[if gte mso 9]><xml>
<w:WordDocument>
<w:View>Normal</w:View>
<w:Zoom>0</w:Zoom>
<w:TrackMoves/>
<w:TrackFormatting/>
<w:HyphenationZone>21</w:HyphenationZone>
<w:PunctuationKerning/>
<w:ValidateAgainstSchemas/>
<w:SaveIfXMLInvalid>false</w:SaveIfXMLInvalid>
<w:IgnoreMixedContent>false</w:IgnoreMixedContent>
<w:AlwaysShowPlaceholderText>false</w:AlwaysShowPlaceholderText>
<w:DoNotPromoteQF/>
<w:LidThemeOther>EN-US</w:LidThemeOther>
<w:LidThemeAsian>X-NONE</w:LidThemeAsian>
<w:LidThemeComplexScript>X-NONE</w:LidThemeComplexScript>
<w:Compatibility>
<w:BreakWrappedTables/>
<w:SnapToGridInCell/>
<w:WrapTextWithPunct/>
<w:UseAsianBreakRules/>
<w:DontGrowAutofit/>
<w:SplitPgBreakAndParaMark/>
<w:EnableOpenTypeKerning/>
<w:DontFlipMirrorIndents/>
<w:OverrideTableStyleHps/>
</w:Compatibility>
<m:mathPr>
<m:mathFont m:val="Cambria Math"/>
<m:brkBin m:val="before"/>
<m:brkBinSub m:val="&#45;-"/>
<m:smallFrac m:val="off"/>
<m:dispDef/>
<m:lMargin m:val="0"/>
<m:rMargin m:val="0"/>
<m:defJc m:val="centerGroup"/>
<m:wrapIndent m:val="1440"/>
<m:intLim m:val="subSup"/>
<m:naryLim m:val="undOvr"/>
</m:mathPr></w:WordDocument>
</xml><![endif]--><!--[if gte mso 9]><xml>
<w:LatentStyles DefLockedState="false" DefUnhideWhenUsed="true"   DefSemiHidden="true" DefQFormat="false" DefPriority="99"   LatentStyleCount="267">
<w:LsdException Locked="false" Priority="0" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="Normal"/>
<w:LsdException Locked="false" Priority="9" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="heading 1"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 2"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 3"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 4"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 5"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 6"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 7"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 8"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 9"/>
<w:LsdException Locked="false" Priority="39" Name="toc 1"/>
<w:LsdException Locked="false" Priority="39" Name="toc 2"/>
<w:LsdException Locked="false" Priority="39" Name="toc 3"/>
<w:LsdException Locked="false" Priority="39" Name="toc 4"/>
<w:LsdException Locked="false" Priority="39" Name="toc 5"/>
<w:LsdException Locked="false" Priority="39" Name="toc 6"/>
<w:LsdException Locked="false" Priority="39" Name="toc 7"/>
<w:LsdException Locked="false" Priority="39" Name="toc 8"/>
<w:LsdException Locked="false" Priority="39" Name="toc 9"/>
<w:LsdException Locked="false" Priority="35" QFormat="true" Name="caption"/>
<w:LsdException Locked="false" Priority="10" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="Title"/>
<w:LsdException Locked="false" Priority="1" Name="Default Paragraph Font"/>
<w:LsdException Locked="false" Priority="11" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="Subtitle"/>
<w:LsdException Locked="false" Priority="22" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="Strong"/>
<w:LsdException Locked="false" Priority="20" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="Emphasis"/>
<w:LsdException Locked="false" Priority="59" SemiHidden="false"    UnhideWhenUsed="false" Name="Table Grid"/>
<w:LsdException Locked="false" UnhideWhenUsed="false" Name="Placeholder Text"/>
<w:LsdException Locked="false" Priority="1" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="No Spacing"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Shading"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false"    UnhideWhenUsed="false" Name="Light List"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Grid"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 1"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 2"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 1"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 2"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 1"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 2"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 3"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false"    UnhideWhenUsed="false" Name="Dark List"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Shading"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful List"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Grid"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Shading Accent 1"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false"    UnhideWhenUsed="false" Name="Light List Accent 1"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Grid Accent 1"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 1 Accent 1"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 2 Accent 1"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 1 Accent 1"/>
<w:LsdException Locked="false" UnhideWhenUsed="false" Name="Revision"/>
<w:LsdException Locked="false" Priority="34" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="List Paragraph"/>
<w:LsdException Locked="false" Priority="29" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="Quote"/>
<w:LsdException Locked="false" Priority="30" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="Intense Quote"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 2 Accent 1"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 1 Accent 1"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 2 Accent 1"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 3 Accent 1"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false"    UnhideWhenUsed="false" Name="Dark List Accent 1"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Shading Accent 1"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful List Accent 1"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Grid Accent 1"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Shading Accent 2"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false"    UnhideWhenUsed="false" Name="Light List Accent 2"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Grid Accent 2"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 1 Accent 2"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 2 Accent 2"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 1 Accent 2"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 2 Accent 2"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 1 Accent 2"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 2 Accent 2"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 3 Accent 2"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false"    UnhideWhenUsed="false" Name="Dark List Accent 2"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Shading Accent 2"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful List Accent 2"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Grid Accent 2"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Shading Accent 3"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false"    UnhideWhenUsed="false" Name="Light List Accent 3"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Grid Accent 3"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 1 Accent 3"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 2 Accent 3"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 1 Accent 3"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 2 Accent 3"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 1 Accent 3"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 2 Accent 3"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 3 Accent 3"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false"    UnhideWhenUsed="false" Name="Dark List Accent 3"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Shading Accent 3"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful List Accent 3"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Grid Accent 3"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Shading Accent 4"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false"    UnhideWhenUsed="false" Name="Light List Accent 4"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Grid Accent 4"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 1 Accent 4"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 2 Accent 4"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 1 Accent 4"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 2 Accent 4"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 1 Accent 4"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 2 Accent 4"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 3 Accent 4"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false"    UnhideWhenUsed="false" Name="Dark List Accent 4"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Shading Accent 4"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful List Accent 4"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Grid Accent 4"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Shading Accent 5"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false"    UnhideWhenUsed="false" Name="Light List Accent 5"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Grid Accent 5"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 1 Accent 5"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 2 Accent 5"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 1 Accent 5"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 2 Accent 5"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 1 Accent 5"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 2 Accent 5"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 3 Accent 5"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false"    UnhideWhenUsed="false" Name="Dark List Accent 5"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Shading Accent 5"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful List Accent 5"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Grid Accent 5"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Shading Accent 6"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false"    UnhideWhenUsed="false" Name="Light List Accent 6"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false"    UnhideWhenUsed="false" Name="Light Grid Accent 6"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 1 Accent 6"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Shading 2 Accent 6"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 1 Accent 6"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium List 2 Accent 6"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 1 Accent 6"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 2 Accent 6"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false"    UnhideWhenUsed="false" Name="Medium Grid 3 Accent 6"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false"    UnhideWhenUsed="false" Name="Dark List Accent 6"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Shading Accent 6"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful List Accent 6"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false"    UnhideWhenUsed="false" Name="Colorful Grid Accent 6"/>
<w:LsdException Locked="false" Priority="19" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="Subtle Emphasis"/>
<w:LsdException Locked="false" Priority="21" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="Intense Emphasis"/>
<w:LsdException Locked="false" Priority="31" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="Subtle Reference"/>
<w:LsdException Locked="false" Priority="32" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="Intense Reference"/>
<w:LsdException Locked="false" Priority="33" SemiHidden="false"    UnhideWhenUsed="false" QFormat="true" Name="Book Title"/>
<w:LsdException Locked="false" Priority="37" Name="Bibliography"/>
<w:LsdException Locked="false" Priority="39" QFormat="true" Name="TOC Heading"/>
</w:LatentStyles>
</xml><![endif]--><!--[if gte mso 10]>


<style>
 /* Style Definitions */
table.MsoNormalTable
{mso-style-name:Standardowy;
mso-tstyle-rowband-size:0;
mso-tstyle-colband-size:0;
mso-style-noshow:yes;
mso-style-priority:99;
mso-style-parent:"";
mso-padding-alt:0cm 5.4pt 0cm 5.4pt;
mso-para-margin-top:0cm;
mso-para-margin-right:0cm;
mso-para-margin-bottom:10.0pt;
mso-para-margin-left:0cm;
line-height:115%;
mso-pagination:widow-orphan;
font-size:11.0pt;
font-family:"Calibri","sans-serif";
mso-ascii-font-family:Calibri;
mso-ascii-theme-font:minor-latin;
mso-hansi-font-family:Calibri;
mso-hansi-theme-font:minor-latin;
mso-ansi-language:EN-US;
mso-fareast-language:EN-US;}
</style>

<![endif]--></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Pamiętacie <a title="Jak digitalizujemy książki nawet o tym nie wiedząc" href="/jak-digitalizujemy-ksiazki-o-tym-nie-wiedzac/" target="_blank">wpis o reCAPTCHY</a>*, który ujawniał jak na co dzień skanujemy książki? Teraz czas na system, który pozwala wykorzystać zeskanowane materiały. Ngram Viewer, bo o nim mowa, stworzony został przez Google Labs i zawiera bazę ponad 5 milionów książek (zawierający 500 miliardów słów!) z lat 1800-2008, które poddano OCR-owaniu w firmie Larry’ego Page’a.</span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Wszystkie mole książkowe, którym zaświeciły się w tym miejscu oczy, na myśl o dostępie do tych wszystkich zbiorów, muszę ostrzec: Ngram Viewer służy głównie do badań statystycznych i językoznawczych. Nie ma możliwości przeczytania danego dzieła od deski do deski, można co najwyżej podejrzeć pewne fragmenty.</span><span style="mso-ansi-language: PL;"> </span></p>
<h2>Jak to działa?</h2>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Ale po kolei. Narzędzie Google służy do wyszukiwania pożądanych fraz, w danym przedziale czasowym i języku zeskanowanych publikacji. Dane zwracane są w formie wykresu, który prezentuje poziom częstotliwości występowania danego słowa na przestrzeni czasu. Możliwe jest wyszukiwanie złożonych fraz (np. atak terrorystyczny) jak i zestawianie ich ze sobą (np. Bóg i nauka jak na obrazku poniżej).</span><span style="mso-ansi-language: PL;"> </span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span id="more-243"></span></p>
<p class="MsoNoSpacing" style="text-align: center;"><span style="mso-ansi-language: PL;"><img class="size-large wp-image-245 aligncenter" title="Ngram Viewer przykład wykorzystania" alt="Ngram Viewer przykład wykorzystania" src="/wp-content/uploads/2013/06/ngram_viewer1-1024x495.png" width="530" height="256" /></span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Ponadto możliwe jest podejrzenie 40 wybranych przez system publikacji, które przedstawiać będą znalezione słowa. Dlaczego tylko tyle? Ponieważ w przypadku większych ilości Ngram Viewer mógłby dostać czkawki. </span></p>
<h2>„Wszystko fajnie, tylko po co”?</h2>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Do czego można wykorzystać narzędzie Google Labs? Początkowy zamysł był taki, aby narzędzie służyło głównie historykom i językoznawcom. Ngram Viewer okazuje się bardzo przydatny w badaniach lingwistycznych i w prosty sposób pozwala na wychwycenie jak zmieniała się popularność poszczególnych słów, a co za tym idzie, jak zmieniał się sam język na przestrzeni lat. Co jeszcze można wycisnąć z tego narzędzia?</span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">W bardzo przejrzysty sposób można zaobserwować np. trendy w postępie technologicznym. Zestawienie fraz tj.: statek, kolej, samolot pokaże stopień i skalę przemian. Z drugiej strony można zestawiać także mężczyzn i kobiety, marketing i innowacje, otyłość i fast food itd. Warto samemu spróbować i zobaczyć co wyjdzie. Oczywiście wyniki należy traktować raczej orientacyjnie, a nie jako ścisły dowód naukowy.</span><span style="mso-ansi-language: PL;"> </span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Ngram Viewer na pewno przyda się także literaturoznawcom, którzy będą mieli możliwość np. zestawienia konkretnych wyrazów opisujących emocje z daną epoką. Możliwości jest sporo<b>.</b></span></p>
<h2>A błędy?</h2>
<p style="text-align: center;"><img class="size-full wp-image-254 aligncenter" title="Słowo &quot;Congress&quot; zapisane starą czcionką" alt="Słowo &quot;Congress&quot; zapisane starą czcionką" src="/wp-content/uploads/2013/06/congress.png" width="251" height="129" /></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">O tym, że OCR nie jest wolny od błędów wie na pewno każdy czytelnik niniejszego bloga</span><span style="mso-ansi-language: PL;">. Co prawda 99%, a nawet 99,5% to sporo, ale margines błędu zawsze jest. Nie inaczej jest i w tym przypadku. Polecam prześledzenie case study słowa fuck/suck z tego <a title="Artykuł o pomyłkach w OCR" href="http://searchengineland.com/when-ocr-goes-bad-googles-ngram-viewer-the-f-word-59181" target="_blank">linka</a>. W skrócie rzecz rozbija się o pisownie „suck” w starych pismach, którą OCR interpretuje jako „fuck”, dając tym samym fałszywe wyniki wykorzystania słowa np. w XIX wieku. Swoją drogą, to nieco ironiczna pomyłka, prawda?<br />
</span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Takich błędów jest pewnie więcej, dlatego zawsze należy podchodzić do wyników z rezerwą.</span><span style="mso-ansi-language: PL;"> </span></p>
<h2>Co dalej?</h2>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Póki co system od Google Labs nie zachwyca, wziąwszy pod uwagę np. możliwość przeglądania książek, dokładność czy interfejs graficzny. Z pewnością natomiast drzemie w programie ogromny potencjał i jestem pewien, że w przyszłości będzie miał do zaoferowania dużo więcej. Ponadto jest żywym dowodem na to, że <a title="OCR-owanie dokumentów w systemie workflow" href="http://www.webcon.pl/ocr-i-rejestracja-dokumentow-sharepoint" target="_blank">OCR to bardzo pożyteczna technologia</a>, która zwyczajnie służy ludziom i zachowaniu ich dziedzictwa kulturowego w postaci książek.</span><span style="mso-ansi-language: PL;"> </span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Na marginesie: Ngram Viewer nie jest dostępny niestety dla polskich zbiorów. Oferuje za to języki tj.: angielski, francuski, rosyjski, niemiecki, włoski, hiszpański, hebrajski i kilka innych. Może kiedyś się doczekamy się także i naszego ojczystego.</span></p>
<p class="MsoNoSpacing" style="text-align: justify;">
<p class="MsoNoSpacing" style="text-align: justify;">* Wpis o reCAPTCHY stał się zdecydowanym hitem tego bloga. Dzięki poleceniom, linkom i portalowi wykop.pl zobaczyło go ponad 10 000 osób. Dzięki!</p>
<p>Post <a rel="nofollow" href="/ngram-viewer-przyklad-wykorzystania-ocr/">Ngram Viewer – kolejny przykład wykorzystania OCR</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></content:encoded>
			<wfw:commentRss>http://ocrwdokumentach.pl/ngram-viewer-przyklad-wykorzystania-ocr/feed/</wfw:commentRss>
		<slash:comments>1</slash:comments>
		</item>
		<item>
		<title>Testy OCR &#8211; który najlepszy dla firmy? Cz. 1: ABBYY</title>
		<link>http://ocrwdokumentach.pl/testy-ocr-abbyy/</link>
		<comments>http://ocrwdokumentach.pl/testy-ocr-abbyy/#comments</comments>
		<pubDate>Wed, 15 May 2013 09:36:40 +0000</pubDate>
		<dc:creator><![CDATA[Michał Rykiert]]></dc:creator>
				<category><![CDATA[Informacje ogólne]]></category>
		<category><![CDATA[Jak kupić?]]></category>

		<guid isPermaLink="false">http://ocrwdokumentach.pl/?p=217</guid>
		<description><![CDATA[<p>Technologia Optycznego Rozpoznawania Znaków (OCR) wykorzystana w przedsiębiorstwie, jest w stanie zaoszczędzić wymierne sumy pieniędzy, które w innym przypadku musiałby zostać wydane np. na opłacenie odpowiednich pracowników. W poprzednim wpisie</p>
<p>Post <a rel="nofollow" href="/testy-ocr-abbyy/">Testy OCR &#8211; który najlepszy dla firmy? Cz. 1: ABBYY</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></description>
				<content:encoded><![CDATA[<p><!--[if gte mso 9]><xml>
<o:OfficeDocumentSettings>
<o:RelyOnVML/>
<o:AllowPNG/>
</o:OfficeDocumentSettings>
</xml><![endif]--></p>
<p><!--[if gte mso 9]><xml>
<w:WordDocument>
<w:View>Normal</w:View>
<w:Zoom>0</w:Zoom>
<w:TrackMoves/>
<w:TrackFormatting/>
<w:HyphenationZone>21</w:HyphenationZone>
<w:PunctuationKerning/>
<w:ValidateAgainstSchemas/>
<w:SaveIfXMLInvalid>false</w:SaveIfXMLInvalid>
<w:IgnoreMixedContent>false</w:IgnoreMixedContent>
<w:AlwaysShowPlaceholderText>false</w:AlwaysShowPlaceholderText>
<w:DoNotPromoteQF/>
<w:LidThemeOther>EN-US</w:LidThemeOther>
<w:LidThemeAsian>X-NONE</w:LidThemeAsian>
<w:LidThemeComplexScript>X-NONE</w:LidThemeComplexScript>
<w:Compatibility>
<w:BreakWrappedTables/>
<w:SnapToGridInCell/>
<w:WrapTextWithPunct/>
<w:UseAsianBreakRules/>
<w:DontGrowAutofit/>
<w:SplitPgBreakAndParaMark/>
<w:EnableOpenTypeKerning/>
<w:DontFlipMirrorIndents/>
<w:OverrideTableStyleHps/>
</w:Compatibility>
<m:mathPr>
<m:mathFont m:val="Cambria Math"/>
<m:brkBin m:val="before"/>
<m:brkBinSub m:val="&#45;-"/>
<m:smallFrac m:val="off"/>
<m:dispDef/>
<m:lMargin m:val="0"/>
<m:rMargin m:val="0"/>
<m:defJc m:val="centerGroup"/>
<m:wrapIndent m:val="1440"/>
<m:intLim m:val="subSup"/>
<m:naryLim m:val="undOvr"/>
</m:mathPr></w:WordDocument>
</xml><![endif]--><!--[if gte mso 9]><xml>
<w:LatentStyles DefLockedState="false" DefUnhideWhenUsed="true" DefSemiHidden="true" DefQFormat="false" DefPriority="99" LatentStyleCount="267">
<w:LsdException Locked="false" Priority="0" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Normal"/>
<w:LsdException Locked="false" Priority="9" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="heading 1"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 2"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 3"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 4"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 5"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 6"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 7"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 8"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 9"/>
<w:LsdException Locked="false" Priority="39" Name="toc 1"/>
<w:LsdException Locked="false" Priority="39" Name="toc 2"/>
<w:LsdException Locked="false" Priority="39" Name="toc 3"/>
<w:LsdException Locked="false" Priority="39" Name="toc 4"/>
<w:LsdException Locked="false" Priority="39" Name="toc 5"/>
<w:LsdException Locked="false" Priority="39" Name="toc 6"/>
<w:LsdException Locked="false" Priority="39" Name="toc 7"/>
<w:LsdException Locked="false" Priority="39" Name="toc 8"/>
<w:LsdException Locked="false" Priority="39" Name="toc 9"/>
<w:LsdException Locked="false" Priority="35" QFormat="true" Name="caption"/>
<w:LsdException Locked="false" Priority="10" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Title"/>
<w:LsdException Locked="false" Priority="1" Name="Default Paragraph Font"/>
<w:LsdException Locked="false" Priority="11" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Subtitle"/>
<w:LsdException Locked="false" Priority="22" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Strong"/>
<w:LsdException Locked="false" Priority="20" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Emphasis"/>
<w:LsdException Locked="false" Priority="59" SemiHidden="false" UnhideWhenUsed="false" Name="Table Grid"/>
<w:LsdException Locked="false" UnhideWhenUsed="false" Name="Placeholder Text"/>
<w:LsdException Locked="false" Priority="1" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="No Spacing"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading Accent 1"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List Accent 1"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid Accent 1"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1 Accent 1"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2 Accent 1"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1 Accent 1"/>
<w:LsdException Locked="false" UnhideWhenUsed="false" Name="Revision"/>
<w:LsdException Locked="false" Priority="34" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="List Paragraph"/>
<w:LsdException Locked="false" Priority="29" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Quote"/>
<w:LsdException Locked="false" Priority="30" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Intense Quote"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2 Accent 1"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1 Accent 1"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2 Accent 1"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3 Accent 1"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List Accent 1"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading Accent 1"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List Accent 1"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid Accent 1"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading Accent 2"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List Accent 2"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid Accent 2"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1 Accent 2"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2 Accent 2"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1 Accent 2"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2 Accent 2"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1 Accent 2"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2 Accent 2"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3 Accent 2"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List Accent 2"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading Accent 2"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List Accent 2"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid Accent 2"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading Accent 3"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List Accent 3"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid Accent 3"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1 Accent 3"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2 Accent 3"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1 Accent 3"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2 Accent 3"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1 Accent 3"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2 Accent 3"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3 Accent 3"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List Accent 3"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading Accent 3"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List Accent 3"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid Accent 3"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading Accent 4"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List Accent 4"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid Accent 4"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1 Accent 4"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2 Accent 4"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1 Accent 4"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2 Accent 4"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1 Accent 4"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2 Accent 4"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3 Accent 4"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List Accent 4"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading Accent 4"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List Accent 4"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid Accent 4"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading Accent 5"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List Accent 5"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid Accent 5"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1 Accent 5"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2 Accent 5"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1 Accent 5"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2 Accent 5"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1 Accent 5"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2 Accent 5"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3 Accent 5"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List Accent 5"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading Accent 5"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List Accent 5"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid Accent 5"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading Accent 6"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List Accent 6"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid Accent 6"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1 Accent 6"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2 Accent 6"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1 Accent 6"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2 Accent 6"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1 Accent 6"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2 Accent 6"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3 Accent 6"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List Accent 6"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading Accent 6"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List Accent 6"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid Accent 6"/>
<w:LsdException Locked="false" Priority="19" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Subtle Emphasis"/>
<w:LsdException Locked="false" Priority="21" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Intense Emphasis"/>
<w:LsdException Locked="false" Priority="31" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Subtle Reference"/>
<w:LsdException Locked="false" Priority="32" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Intense Reference"/>
<w:LsdException Locked="false" Priority="33" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Book Title"/>
<w:LsdException Locked="false" Priority="37" Name="Bibliography"/>
<w:LsdException Locked="false" Priority="39" QFormat="true" Name="TOC Heading"/>
</w:LatentStyles>
</xml><![endif]--><!--[if gte mso 10]>


<style>
 /* Style Definitions */
table.MsoNormalTable
{mso-style-name:Standardowy;
mso-tstyle-rowband-size:0;
mso-tstyle-colband-size:0;
mso-style-noshow:yes;
mso-style-priority:99;
mso-style-parent:"";
mso-padding-alt:0cm 5.4pt 0cm 5.4pt;
mso-para-margin-top:0cm;
mso-para-margin-right:0cm;
mso-para-margin-bottom:10.0pt;
mso-para-margin-left:0cm;
line-height:115%;
mso-pagination:widow-orphan;
font-size:11.0pt;
font-family:"Calibri","sans-serif";
mso-ascii-font-family:Calibri;
mso-ascii-theme-font:minor-latin;
mso-hansi-font-family:Calibri;
mso-hansi-theme-font:minor-latin;
mso-ansi-language:EN-US;
mso-fareast-language:EN-US;}
</style>

<![endif]--></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Technologia Optycznego Rozpoznawania Znaków (OCR) wykorzystana w przedsiębiorstwie, jest w stanie zaoszczędzić wymierne sumy pieniędzy, które w innym przypadku musiałby zostać wydane np. na opłacenie odpowiednich pracowników. W poprzednim wpisie wskazałem na co zwracać uwagę podczas wyboru konkretnego rozwiązania. Czas na przyjrzenie się konkretnym programom.</span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Każdy kto słyszał o OCR, z pewnością natknął się na jeden z produktów ABBYY. Nie bez powodu, gdyż oprogramowanie tej rosyjskiej firmy, obecne jest na rynku dość długo i znane jest z bardzo dobrej jakości.</span><span style="mso-ansi-language: PL;"> </span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Jak to wygląda w testach? Zależy od testu :). </span><span style="mso-ansi-language: PL;">Aczkolwiek w ogromnej ilości przypadków OCR od ABBYY radzi sobie całkiem nieźle. Przedstawiam zestaw kilku różnych testów, w które w rozmaity sposób wyciskają siódme poty z rosyjskiego OCR-a:<br />
</span></p>
<p><span id="more-217"></span></p>
<h2><strong>Test 1. <a href="http://www.komputerswiat.pl/testy/programy/programy-ocr/2011/03/szybki-test-abbyy-finereader-10-professional-edition,2.aspx#7978" target="_blank">Szybki test ABBY FineReader 10 Professional Edition &#8211; Komputer Świat </a></strong></h2>
<p class="MsoNoSpacing" style="text-align: justify;"><span lang="EN-US">Komputer Świat przetestował ABBYY Fine Reader 10 Pro. </span><span style="mso-ansi-language: PL;">Niestety nie zestawiono go z innymi programami. Wskazano na bardzo dobre rozpoznawanie w języku polskim, nawet w przypadku stron mocno obciążonych grafiką. Zauważono, że program kiepsko radzi sobie z tekstem odręcznym (skuteczność 10%), aczkolwiek nie jest to zaskoczeniem, gdyż do tego rodzaju tekstu używa się raczej software’u klasy ICR.</span></p>
<p class="MsoNoSpacing"><span style="mso-ansi-language: PL;"><a href="/wp-content/uploads/2013/05/1.png"><img class="size-full wp-image-221 aligncenter" alt="1 test OCR ABBYY" src="/wp-content/uploads/2013/05/1.png" width="337" height="324" /></a></span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;"> </span></p>
<h2><strong>Test 2. <a href="http://www.pcadvisor.co.uk/test-centre/software/3265647/group-test-whats-the-best-ocr-software/" target="_blank">Group test: what&#8217;s the best OCR software? &#8211; PC Advisor</a></strong></h2>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Niemal w tym samym czasie co Komputer Świat, za test oprogramowania OCR wziął się PC Advisor. </span><span lang="EN-US">Tutaj oprócz Fine Reader’a 10 Pro, wzięto pod uwagę także ABBYY FineReader 9.0, Readiris Pro 12, Readiris Pro 12, Nuance OmniPage Professional 18.</span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Pierwsze miejsce zdobył ostatni z wymienionych, którego chwalono za ilość opcji do wykorzystania oraz bardzo dobrą jakość rozpoznawania znaków. Dostało się nieco interfejsowi.</span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Podobny zarzut padł pod adresem trzeciego w zestawieniu Fine Readera 10 Pro. Jednakże w ogólnym rozrachunku okazał się wystarczająco prosty w użytku, z dobrą jakością rozpoznawania znaków i wsparciem dla wielu urządzeń.</span></p>
<p class="MsoNoSpacing"><span style="mso-ansi-language: PL;"><a href="/wp-content/uploads/2013/05/2.png"><img class="size-full wp-image-222 aligncenter" alt="Test 2 OCR" src="/wp-content/uploads/2013/05/2.png" width="443" height="187" /></a></span></p>
<h2><strong><span lang="EN-US">Test 3. <a href="http://ocr-software-review.toptenreviews.com/" target="_blank">2013 Best OCR Software Comparisons and Reviews -Top Ten Reviews</a></span></strong></h2>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">“Najświeższy” z prezentowanych testów autorstwa Top Ten Reviews, w którym porównano aż 9 różnych programów. Jeśli mu wierzyć, obecnie Omni Page Standard deklasuje (ocena 9.88/10) konkurencję pod niemal każdym względem. Fine Reader Pro znalazł się dopiero na szóstym miejscu z oceną 5.83. Niestety autorzy zestawienia nie podają które wersje oprogramowania testowali, ani jakiej metodologii użyli, co dość mocno rzutuje na wiarygodności testu. Ponadto szereg cech jakie wzięto pod uwagę, może wskazywać iż badanie ułożone było pod Omni Page, dlatego polecam traktować ten test raczej z rezerwą.</span></p>
<p class="MsoNoSpacing"><span style="mso-ansi-language: PL;"><a href="/wp-content/uploads/2013/05/3.png"><img class="size-full wp-image-223 aligncenter" alt="Test 3 OCR" src="/wp-content/uploads/2013/05/3.png" width="437" height="371" /></a></span></p>
<h2><strong>Test 4. <a href="http://www.benchmark.pl/mini-recenzje/Co_tam_jest_napisane._-_czyli_test_programow_OCR-3054.html" target="_blank">Co tam jest napisane czyli test programów OCR – benchmark.pl</a></strong></h2>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Test już nieco nieaktualny, bo sprzed prawie 3 lat. Warty jednak uwagi, ze względu na dokładnie pokazaną metodologię sprawdzania dokładności rozpoznawania znaków. Autor każdorazowo przedstawia bazowy tekst oraz rezultat po zeskanowaniu go każdym z programów. W tym zestawieniu ABBYY Fine Reader zdeklasował Cueiform, Puma.NET i Simple OCR.</span></p>
<p class="MsoNoSpacing"><span style="mso-ansi-language: PL;"><a href="/wp-content/uploads/2013/05/4.png"><img class="size-full wp-image-224 aligncenter" alt="Test 4 OCR" src="/wp-content/uploads/2013/05/4.png" width="345" height="350" /></a></span></p>
<h2><strong><span lang="EN-US">Test 5. <a href="http://www.simpleocr.com/OCR_Software_Guide.asp#compareocrsoftware" target="_blank">OCR software guide – simpleocr.com</a></span></strong></h2>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">W teście SimpleSoftware rozróżniono 3 kategorie oprogramowania: OCR do użytku prywatnego, konwertery do PDF oraz OCR korporacyjny. Dla przedstawienia wyników posłużono się dość funkcjonalną tabelką z zaznaczonymi poszczególnymi funkcjonalnościami. I tutaj ABBYY, według autorów testu, radziło sobie najlepiej. </span><span lang="EN-US">Testowano m.in. <span style="mso-spacerun: yes;"> </span>FineReader Pro 11, FineReader 11 Corporate, Nuance OmniPage Pro 18 czy IRIS ReadIRIS Pro 14. </span></p>
<p class="MsoNoSpacing"><span lang="EN-US"><a href="/wp-content/uploads/2013/05/5.png"><img class="size-full wp-image-225 aligncenter" alt="Test 5 OCR" src="/wp-content/uploads/2013/05/5.png" width="528" height="311" /></a></span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Jak wynika z powyższych testów oprogramowanie ABBYY należy do ścisłej czołówki. Czy jest najlepsze? To pytanie pozostawiam bez odpowiedzi. Aczkolwiek na pewno <strong>można w nie zainwestować bez zbytniego ryzyka</strong>, że będzie działać poniżej realnych oczekiwań. Firma ABBYY obecna jest na rynku od lat. Przez cały czas funkcjonowania ulepsza swój software, który w kolejnych wersjach uzyskuje coraz lepsze wyniki w rozpoznawaniu znaków. Z punktu widzenia firm, bardzo korzystnym rozwiązaniem jest<strong> sprzężenie OCR-a z workflow/obiegiem dokumentów</strong> w firmie. Dzięki temu możliwa jest np. automatyczna rejestracja, rejestracja mailem lub masowe skanowanie dokumentów. Problemem może być integracja, jednakże są już na rynku systemy tj. <a title="Platforma workflow z OCR" href="http://www.webcon.pl/webconbps/overview" target="_blank">WEBCON Business Process Suite</a>, które posiadają już zintegrowany moduł OCR (w tym przypadku ABBYY Flexi Capture).<br />
</span></p>
<p class="MsoNoSpacing" style="text-align: justify;">Swoją drogą, ABBYY udostępniło <a href="http://www.finereader.pl/kalkulator" target="_blank">kalkulator</a> służący wyliczaniu ROI (Return On Investment &#8211; zwrotu z inwestycji). Nawet jeśli jest nieco naciągany, to liczby robią wrażenie!</p>
<p>Post <a rel="nofollow" href="/testy-ocr-abbyy/">Testy OCR &#8211; który najlepszy dla firmy? Cz. 1: ABBYY</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></content:encoded>
			<wfw:commentRss>http://ocrwdokumentach.pl/testy-ocr-abbyy/feed/</wfw:commentRss>
		<slash:comments>17</slash:comments>
		</item>
		<item>
		<title>OCR &#8211; jak wybrać dobry software?</title>
		<link>http://ocrwdokumentach.pl/ocr-jak-wybrac-dobry-software/</link>
		<comments>http://ocrwdokumentach.pl/ocr-jak-wybrac-dobry-software/#comments</comments>
		<pubDate>Wed, 24 Apr 2013 09:47:24 +0000</pubDate>
		<dc:creator><![CDATA[Michał Rykiert]]></dc:creator>
				<category><![CDATA[Informacje ogólne]]></category>
		<category><![CDATA[Jak kupić?]]></category>
		<category><![CDATA[dokładność]]></category>
		<category><![CDATA[jakość]]></category>
		<category><![CDATA[języki]]></category>
		<category><![CDATA[kryteria]]></category>
		<category><![CDATA[oprogramowanie]]></category>
		<category><![CDATA[Optical Character Recognition]]></category>
		<category><![CDATA[przedsiębiorstwo]]></category>
		<category><![CDATA[software]]></category>
		<category><![CDATA[support]]></category>
		<category><![CDATA[wsparcie]]></category>
		<category><![CDATA[wybór]]></category>
		<category><![CDATA[wydajność]]></category>

		<guid isPermaLink="false">http://ocrwdokumentach.pl/?p=201</guid>
		<description><![CDATA[<p>Na początku lat 90. zaczęto organizować swego rodzaju zawody w dokładności rozpoznawania znaków przez oprogramowanie OCR. Nie były to jednak chałupnicze projekty, a dość poważne i kompleksowe badania przeprowadzane przez</p>
<p>Post <a rel="nofollow" href="/ocr-jak-wybrac-dobry-software/">OCR &#8211; jak wybrać dobry software?</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></description>
				<content:encoded><![CDATA[<p><!--[if gte mso 9]><xml>
<o:OfficeDocumentSettings>
<o:RelyOnVML/>
<o:AllowPNG/>
</o:OfficeDocumentSettings>
</xml><![endif]--></p>
<p><!--[if gte mso 9]><xml>
<w:WordDocument>
<w:View>Normal</w:View>
<w:Zoom>0</w:Zoom>
<w:TrackMoves/>
<w:TrackFormatting/>
<w:HyphenationZone>21</w:HyphenationZone>
<w:PunctuationKerning/>
<w:ValidateAgainstSchemas/>
<w:SaveIfXMLInvalid>false</w:SaveIfXMLInvalid>
<w:IgnoreMixedContent>false</w:IgnoreMixedContent>
<w:AlwaysShowPlaceholderText>false</w:AlwaysShowPlaceholderText>
<w:DoNotPromoteQF/>
<w:LidThemeOther>EN-US</w:LidThemeOther>
<w:LidThemeAsian>X-NONE</w:LidThemeAsian>
<w:LidThemeComplexScript>X-NONE</w:LidThemeComplexScript>
<w:Compatibility>
<w:BreakWrappedTables/>
<w:SnapToGridInCell/>
<w:WrapTextWithPunct/>
<w:UseAsianBreakRules/>
<w:DontGrowAutofit/>
<w:SplitPgBreakAndParaMark/>
<w:EnableOpenTypeKerning/>
<w:DontFlipMirrorIndents/>
<w:OverrideTableStyleHps/>
</w:Compatibility>
<m:mathPr>
<m:mathFont m:val="Cambria Math"/>
<m:brkBin m:val="before"/>
<m:brkBinSub m:val="&#45;-"/>
<m:smallFrac m:val="off"/>
<m:dispDef/>
<m:lMargin m:val="0"/>
<m:rMargin m:val="0"/>
<m:defJc m:val="centerGroup"/>
<m:wrapIndent m:val="1440"/>
<m:intLim m:val="subSup"/>
<m:naryLim m:val="undOvr"/>
</m:mathPr></w:WordDocument>
</xml><![endif]--><!--[if gte mso 9]><xml>
<w:LatentStyles DefLockedState="false" DefUnhideWhenUsed="true" DefSemiHidden="true" DefQFormat="false" DefPriority="99" LatentStyleCount="267">
<w:LsdException Locked="false" Priority="0" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Normal"/>
<w:LsdException Locked="false" Priority="9" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="heading 1"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 2"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 3"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 4"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 5"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 6"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 7"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 8"/>
<w:LsdException Locked="false" Priority="9" QFormat="true" Name="heading 9"/>
<w:LsdException Locked="false" Priority="39" Name="toc 1"/>
<w:LsdException Locked="false" Priority="39" Name="toc 2"/>
<w:LsdException Locked="false" Priority="39" Name="toc 3"/>
<w:LsdException Locked="false" Priority="39" Name="toc 4"/>
<w:LsdException Locked="false" Priority="39" Name="toc 5"/>
<w:LsdException Locked="false" Priority="39" Name="toc 6"/>
<w:LsdException Locked="false" Priority="39" Name="toc 7"/>
<w:LsdException Locked="false" Priority="39" Name="toc 8"/>
<w:LsdException Locked="false" Priority="39" Name="toc 9"/>
<w:LsdException Locked="false" Priority="35" QFormat="true" Name="caption"/>
<w:LsdException Locked="false" Priority="10" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Title"/>
<w:LsdException Locked="false" Priority="1" Name="Default Paragraph Font"/>
<w:LsdException Locked="false" Priority="11" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Subtitle"/>
<w:LsdException Locked="false" Priority="22" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Strong"/>
<w:LsdException Locked="false" Priority="20" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Emphasis"/>
<w:LsdException Locked="false" Priority="59" SemiHidden="false" UnhideWhenUsed="false" Name="Table Grid"/>
<w:LsdException Locked="false" UnhideWhenUsed="false" Name="Placeholder Text"/>
<w:LsdException Locked="false" Priority="1" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="No Spacing"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading Accent 1"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List Accent 1"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid Accent 1"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1 Accent 1"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2 Accent 1"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1 Accent 1"/>
<w:LsdException Locked="false" UnhideWhenUsed="false" Name="Revision"/>
<w:LsdException Locked="false" Priority="34" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="List Paragraph"/>
<w:LsdException Locked="false" Priority="29" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Quote"/>
<w:LsdException Locked="false" Priority="30" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Intense Quote"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2 Accent 1"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1 Accent 1"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2 Accent 1"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3 Accent 1"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List Accent 1"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading Accent 1"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List Accent 1"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid Accent 1"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading Accent 2"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List Accent 2"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid Accent 2"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1 Accent 2"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2 Accent 2"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1 Accent 2"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2 Accent 2"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1 Accent 2"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2 Accent 2"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3 Accent 2"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List Accent 2"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading Accent 2"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List Accent 2"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid Accent 2"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading Accent 3"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List Accent 3"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid Accent 3"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1 Accent 3"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2 Accent 3"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1 Accent 3"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2 Accent 3"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1 Accent 3"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2 Accent 3"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3 Accent 3"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List Accent 3"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading Accent 3"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List Accent 3"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid Accent 3"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading Accent 4"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List Accent 4"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid Accent 4"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1 Accent 4"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2 Accent 4"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1 Accent 4"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2 Accent 4"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1 Accent 4"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2 Accent 4"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3 Accent 4"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List Accent 4"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading Accent 4"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List Accent 4"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid Accent 4"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading Accent 5"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List Accent 5"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid Accent 5"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1 Accent 5"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2 Accent 5"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1 Accent 5"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2 Accent 5"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1 Accent 5"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2 Accent 5"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3 Accent 5"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List Accent 5"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading Accent 5"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List Accent 5"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid Accent 5"/>
<w:LsdException Locked="false" Priority="60" SemiHidden="false" UnhideWhenUsed="false" Name="Light Shading Accent 6"/>
<w:LsdException Locked="false" Priority="61" SemiHidden="false" UnhideWhenUsed="false" Name="Light List Accent 6"/>
<w:LsdException Locked="false" Priority="62" SemiHidden="false" UnhideWhenUsed="false" Name="Light Grid Accent 6"/>
<w:LsdException Locked="false" Priority="63" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 1 Accent 6"/>
<w:LsdException Locked="false" Priority="64" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Shading 2 Accent 6"/>
<w:LsdException Locked="false" Priority="65" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 1 Accent 6"/>
<w:LsdException Locked="false" Priority="66" SemiHidden="false" UnhideWhenUsed="false" Name="Medium List 2 Accent 6"/>
<w:LsdException Locked="false" Priority="67" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 1 Accent 6"/>
<w:LsdException Locked="false" Priority="68" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 2 Accent 6"/>
<w:LsdException Locked="false" Priority="69" SemiHidden="false" UnhideWhenUsed="false" Name="Medium Grid 3 Accent 6"/>
<w:LsdException Locked="false" Priority="70" SemiHidden="false" UnhideWhenUsed="false" Name="Dark List Accent 6"/>
<w:LsdException Locked="false" Priority="71" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Shading Accent 6"/>
<w:LsdException Locked="false" Priority="72" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful List Accent 6"/>
<w:LsdException Locked="false" Priority="73" SemiHidden="false" UnhideWhenUsed="false" Name="Colorful Grid Accent 6"/>
<w:LsdException Locked="false" Priority="19" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Subtle Emphasis"/>
<w:LsdException Locked="false" Priority="21" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Intense Emphasis"/>
<w:LsdException Locked="false" Priority="31" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Subtle Reference"/>
<w:LsdException Locked="false" Priority="32" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Intense Reference"/>
<w:LsdException Locked="false" Priority="33" SemiHidden="false" UnhideWhenUsed="false" QFormat="true" Name="Book Title"/>
<w:LsdException Locked="false" Priority="37" Name="Bibliography"/>
<w:LsdException Locked="false" Priority="39" QFormat="true" Name="TOC Heading"/>
</w:LatentStyles>
</xml><![endif]--><!--[if gte mso 10]>


<style>
 /* Style Definitions */
table.MsoNormalTable
{mso-style-name:Standardowy;
mso-tstyle-rowband-size:0;
mso-tstyle-colband-size:0;
mso-style-noshow:yes;
mso-style-priority:99;
mso-style-parent:"";
mso-padding-alt:0cm 5.4pt 0cm 5.4pt;
mso-para-margin-top:0cm;
mso-para-margin-right:0cm;
mso-para-margin-bottom:10.0pt;
mso-para-margin-left:0cm;
line-height:115%;
mso-pagination:widow-orphan;
font-size:11.0pt;
font-family:"Calibri","sans-serif";
mso-ascii-font-family:Calibri;
mso-ascii-theme-font:minor-latin;
mso-hansi-font-family:Calibri;
mso-hansi-theme-font:minor-latin;
mso-ansi-language:EN-US;
mso-fareast-language:EN-US;}
</style>

<![endif]--></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Na początku lat 90. zaczęto organizować swego rodzaju zawody w dokładności rozpoznawania znaków przez oprogramowanie OCR. Nie były to jednak chałupnicze projekty, a dość poważne i kompleksowe badania przeprowadzane przez amerykańskie <strong>Information Science Research Institute</strong> (ISRI) oraz <strong>University of Nevada Las Vegas</strong> (tak, nawet w światowej stolicy hazardu znajduje się szanowana uczelnia!). W 1995 roku odbyła się ostatnia edycja tego konkursu. </span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Od tego czasu sporo się jednak zmieniło. W końcu 18 lat w branży informatycznej to niemalże wieczność. Jak zatem stwierdzić który software obecnie jest najlepszy?</span><span style="mso-ansi-language: PL;"> </span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">Dużo zależy od tego jak przeprowadzone zostaną testy, jakie kryteria będą wzięte pod uwagę oraz czego tak naprawdę potrzeba osobie/firmie zainteresowanej kupnem oprogramowania <strong>OCR</strong>. Bowiem <a href="/ocr-branze/" target="_blank">inne wymagania</a> będzie mieć firma sprzedażowa, pracująca głównie na drukowanych fakturach, a inne biblioteka publiczna, starająca się digitalizować swoje wiekowe zbiory.</span></p>
<p><span style="mso-ansi-language: PL;">Podczas oceny i wyboru oprogramowania należy wziąć przynajmniej <strong>6 czynników</strong>, które mogą mieć wpływ na ostateczną decyzję:</span></p>
<p><span id="more-201"></span></p>
<p><b style="mso-bidi-font-weight: normal;"><span style="mso-ansi-language: PL;">1. Jakość skanowanych dokumentów </span></b><span style="mso-ansi-language: PL;">&#8211; zgodnie z wcześniej podanym przykładem należy określić na skanowaniu jakich dokumentów najbardziej nam zależy</span></p>
<p><b style="mso-bidi-font-weight: normal;"><span style="mso-ansi-language: PL;">2. Obsługa różnych języków</span></b><span style="mso-ansi-language: PL;"> – bardzo ważny czynnik dla firm mających oddziały w różnych krajach. Np. organizacja mająca siedzibę w Stanach Zjednoczonych i oddział w Izraelu najpewniej potrzebowała będzie OCR-a wspierającego język angielski i hebrajski.</span></p>
<p style="text-align: center;"><a href="/wp-content/uploads/2013/04/OCR-Chinese.gif"><img class="size-full wp-image-206 aligncenter" title="OCR-ować można nawet języki azjatyckie" alt="Chiński OCR" src="/wp-content/uploads/2013/04/OCR-Chinese.gif" width="156" height="161" /></a></p>
<p><b style="mso-bidi-font-weight: normal;"><span style="mso-ansi-language: PL;">3. Integracja z innymi systemami </span></b><span style="mso-ansi-language: PL;">– to kolejne pytanie o funkcje OCR. Jeśli celem jest tylko digitalizacja dokumentów (biblioteki) to nie trzeba sobie tym czynnikiem specjalnie zawracać głowy. Jeśli natomiast OCR ma funkcjonować w ramach np. <a title="OCR w elektronicznym obiegu dokumentów" href="http://www.webcon.pl/ocr-i-rejestracja-dokumentow-sharepoint" target="_blank">systemu elektronicznego obiegu dokumentów</a>, wówczas należy się zastanowić co będzie najłatwiej zintegrować</span></p>
<p><b style="mso-bidi-font-weight: normal;"><span style="mso-ansi-language: PL;">4. Łatwość użycia</span></b><span style="mso-ansi-language: PL;"> – obecnie nie istnieje oprogramowanie dające 100% skuteczność. Stąd prędzej czy później działanie OCR-a podlegać będzie ludzkiej weryfikacji. Dlatego warto zadbać, aby kupiony program był łatwy i intuicyjny w obsłudze</span></p>
<p><b style="mso-bidi-font-weight: normal;"><span style="mso-ansi-language: PL;">5. Wsparcie</span></b><span style="mso-ansi-language: PL;"> – żadna aplikacja nie jest pozbawiona błędów. Prędzej czy później doświadczymy działalności złych, programistycznych trolli. To zaś powinno skłaniać do wyboru producenta, który zapewni solidne wsparcie dla swojego produktu. Jest to niezwykle istotne w przypadku gdy skanowaniu podlegają krytyczne dla firmy dokumenty</span></p>
<p><b style="mso-bidi-font-weight: normal;"><span style="mso-ansi-language: PL;">6. Dokładność </span></b><span style="mso-ansi-language: PL;">– na koniec najważniejszy czynnik czyli trafność w rozpoznawaniu znaków. Mogłoby się wydawać, że między <strong>98% a 99%</strong> skutecznością nie ma wielkiej różnicy, lecz nic bardziej mylnego. <a title="Standardowa strona A4 według wiki" href="http://pl.wikipedia.org/wiki/Znormalizowany_maszynopis" target="_blank">Średnio na stronie A4</a> znajduje się 1800 znaków. Stąd przy 10-stronicowym dokumencie robi znaczną różnice czy trzeba będzie zweryfikować poprawność 360 słów czy tylko 180. <strong>Różnica</strong> jak widać <strong>jest dwukrotna!</strong></span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">To oczywiście ogólne wskazówki, niemniej jednak warto o nich pamiętać przy wyborze oprogramowania. A tym bardziej dobrze jest mieć je w głowie zanim zaczniemy analizować bardziej szczegółowe i techniczne aspekty. Pozwoli to na zachowanie <strong>szerszej perspektywy i lepsze dopasowanie OCR</strong>-a w stosunku do indywidualnych potrzeb. O ile w przypadku zakupu detalicznego można sobie pozwolić na pewną pobłażliwość, o tyle w sytuacji zakupu dla firmy warto zachować czujność, gdyż w grę z reguły wchodzą wymierne kwoty.<br />
</span></p>
<p class="MsoNoSpacing" style="text-align: justify;"><span style="mso-ansi-language: PL;">W następnym wpisie postaram się wskazać na jaki konkretnie soft warto zwrócić uwagę.</span></p>
<p>Post <a rel="nofollow" href="/ocr-jak-wybrac-dobry-software/">OCR &#8211; jak wybrać dobry software?</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></content:encoded>
			<wfw:commentRss>http://ocrwdokumentach.pl/ocr-jak-wybrac-dobry-software/feed/</wfw:commentRss>
		<slash:comments>2</slash:comments>
		</item>
		<item>
		<title>Wykorzystanie OCR &#8211; badania i statystyki</title>
		<link>http://ocrwdokumentach.pl/wykorzystanie-ocr-badania-i-statystyki/</link>
		<comments>http://ocrwdokumentach.pl/wykorzystanie-ocr-badania-i-statystyki/#comments</comments>
		<pubDate>Wed, 20 Mar 2013 11:19:04 +0000</pubDate>
		<dc:creator><![CDATA[Michał Rykiert]]></dc:creator>
				<category><![CDATA[Informacje ogólne]]></category>
		<category><![CDATA[Korzyści z OCR]]></category>
		<category><![CDATA[Zastosowanie OCR]]></category>
		<category><![CDATA[archiwizacja]]></category>
		<category><![CDATA[dokumenty]]></category>
		<category><![CDATA[formularze]]></category>
		<category><![CDATA[indeksowanie]]></category>
		<category><![CDATA[Intelligent Character Recognition]]></category>
		<category><![CDATA[Optical Character Recognition]]></category>
		<category><![CDATA[rozpoznawanie znaków]]></category>
		<category><![CDATA[skuteczność]]></category>
		<category><![CDATA[statystyki]]></category>
		<category><![CDATA[technologia]]></category>
		<category><![CDATA[wykorzystanie]]></category>

		<guid isPermaLink="false">http://ocrwdokumentach.pl/?p=153</guid>
		<description><![CDATA[<p>W niniejszym wpisie chciałbym spojrzeć na Optical Character Recognition (OCR) z nieco szerszej perspektywy. Dlatego też w oparciu o badania AIIM przedstawię kilka liczb opisujących m.in.: w jakim procencie przedsiębiorstw</p>
<p>Post <a rel="nofollow" href="/wykorzystanie-ocr-badania-i-statystyki/">Wykorzystanie OCR &#8211; badania i statystyki</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></description>
				<content:encoded><![CDATA[<p>W niniejszym wpisie chciałbym spojrzeć na Optical Character Recognition (OCR) z nieco szerszej perspektywy. Dlatego też w oparciu o badania AIIM przedstawię kilka liczb opisujących m.in.: w jakim procencie przedsiębiorstw używa się OCR-a, w ilu przypadkach pomimo skanowania, tekst musi być mimo wszystko ręcznie wprowadzany, o ile procent OCR/ICR jest w stanie <a title="OCR i workflow - podnieś wydajność firmy" href="http://www.webcon.pl/webconbps/overview" target="_blank">przyspieszyć pracę na dokumentami</a> i nie tylko.</p>
<p><a href="/wp-content/uploads/2013/03/info1.png"><img class="alignnone  wp-image-156" title="Wykorzystanie OCR" src="/wp-content/uploads/2013/03/info1.png" alt="Wykorzystanie OCR" width="554" height="328" /></a></p>
<h3>26% użytkowników OCR</h3>
<p>skanuje 100 lub mniej dokumentów na dzień.</p>
<h3>10% użytkowników OCR</h3>
<p>procesuje ponad 10 000 dokumentów na dzień!</p>
<h3>88%</h3>
<p>&#8211; taki odsetek respondentów korzysta ze skanowania w pracy. Jednakże tylko 32% z nich używa do tego OCR.</p>
<h3>55%</h3>
<p>&#8211; ponad połowa z przepytanych osób skanuje dokumenty, a następnie ręcznie przepisuje zawarte w nich dane, korzystając przy tym z systemu workflow<br />
<span id="more-153"></span></p>
<p><a href="/wp-content/uploads/2013/03/info2.png"><img class="alignnone  wp-image-157" title="Ilość skanowanych dokumentów" src="/wp-content/uploads/2013/03/info2.png" alt="Ilość skanowanych dokumentów" width="585" height="310" /></a></p>
<p>Powyżej<em> ilość dokumentów (formularzy) skanowana dziennie przy użyciu OCR i bez niego</em>.</p>
<p>Jak widać na  grafice, OCR najczęściej wykorzystywany jest do skanowania 100-500 dokumentów dziennie. W sumie <strong>29% respondentów z jego użyciem skanuje ponad tysiąc dokumentów na dzień</strong>. Daje to spore pole manewru do zaoszczędzenia czasu (i pieniędzy) w przedsiębiorstwach, w których wykorzystuje się takie ilości papierowych dokumentów.</p>
<p>&nbsp;</p>
<p><a href="/wp-content/uploads/2013/03/info3.png"><img class="alignnone  wp-image-158" title="Przyczyny niewykorzystania skanowania w firmach" src="/wp-content/uploads/2013/03/info3.png" alt="Przyczyny niewykorzystania skanowania w firmach" width="559" height="372" /></a></p>
<p><em>Główne przyczyny braku wykorzystania mechanizmów skanowania w trakcie procesowania dokumentów:</em></p>
<ul>
<li>Planujemy to zrobić</li>
<li>Każdy dział/process/lokalizacja podejmuje samodzielne decyzje</li>
<li>Nikt nie został przypisany do ewaluacji takiego rozwiązania</li>
<li>Nie procesujemy tak dużo dokumentów żeby to się opłacało</li>
<li>Sądzimy, że nie przyniesie to wystarczającego zwrotu z inwestycji</li>
<li>Mamy zbyt dużo typów dokumentów</li>
<li>W sumie procesujemy wystarczająco dużo dokumentów (żeby wdrożyć system skanowania), lecz przeszkodą jest decentralizacja</li>
<li>Management preferuje tradycyjne metody</li>
</ul>
<p>Powyższe dane wskazują, że głównym problemem jest <strong>niewiedza o możliwościach OCR</strong>/ICR, brak wykazania inicjatywy w uruchomieniu projektu mającego na celu wdrożenie tej technologii oraz zbyt mała skala procesowanych dokumentów.</p>
<p>&nbsp;</p>
<p><a href="/wp-content/uploads/2013/03/info4.png"><img class="alignnone  wp-image-160" title="Wykorzystanie OCR" src="/wp-content/uploads/2013/03/info4.png" alt="Wykorzystanie OCR" width="560" height="286" /></a></p>
<p><em>Jak wykorzystujesz zeskanowane dane ze swoich formularzy?</em></p>
<ul>
<li>Indeksowanie lub archiwum</li>
<li>Indeksowanie w celu zainicjowania dalszych procedur w workflow</li>
<li>Indeksowanie dla słów kluczowych oraz pełnotekstowe wyszukiwanie</li>
<li>Skanowanie i rozpoznawanie informacji dla procesów finansowych</li>
<li>Częściowe rozpoznawanie informacji dla innych procesów (np. adres, dane osobowe)</li>
<li>Pełnotekstowe skanowanie i rozpoznawanie do dalszego procesowania</li>
</ul>
<p>Jak widać, póki co w dużej mierze skanowanie za pomocą OCR służy do indeksowania i archiwizowania, ale widać wyraźny trend, który wskazuje, że <strong>coraz częściej optyczne rozpoznawanie znaków wykorzystywane jest do bardziej zaawansowanych czynności</strong>.</p>
<p>&nbsp;</p>
<p><a href="/wp-content/uploads/2013/03/info5.png"><img class="alignnone  wp-image-165" title="ICR a efektywność" src="/wp-content/uploads/2013/03/info5.png" alt="ICR a efektywność" width="550" height="318" /></a></p>
<p><em>Jak szacunkowo według Ciebie zwiększyłaby się efektywność twojego personelu administracyjnego, gdybyś mógł zautomatyzować rozpoznawanie pisma ręcznego?</em></p>
<p>Jak widać powyżej mediana wynosi ok. 22,5%, ale najwięcej respondentów wskazała na <strong>50%-owy wzrost wydajności</strong>. ICR (Intelligent Character Recognition) zapewnia możliwość skanowania odręcznego pisma, wraz z algorytmami uczącymi się i dostosowującymi do charakteru pisma użytkowników.</p>
<p>Zaprezentowane dane wskazują, iż <strong>technologia OCR jest coraz częściej wykorzystywana w przedsiębiorstwach</strong>, lecz wciąż w wielu przypadkach nie jest darzona odpowiednim zaufaniem lub brakuje rozpoznania potrzeby jej wdrożenia. Tymczasem pozwala ona na znaczne oszczędności czasowe i kosztowe. Z doświadczenia wiem, że <strong>jeśli firma zainwestuje w odpowiednio skuteczne oprogramowanie, wówczas w znakomitej większości przypadków jest z niego zadowolona i poddaje skanowaniu coraz więcej dokumentów.</strong></p>
<p>Dane zostały zaczerpnięte z raportu AIIM, znajdującego się<a title="Raport AIM o OCR i ICR" href="http://info.parascript.com/aiim-forms-processing-white-paper?hsCtaTracking=17ca0f97-2e02-4143-b871-b2229cd2fdbd|ce8f707d-e63e-4117-8945-1f3d120f0a77" target="_blank"> tutaj</a>.</p>
<p>&nbsp;</p>
<p>Post <a rel="nofollow" href="/wykorzystanie-ocr-badania-i-statystyki/">Wykorzystanie OCR &#8211; badania i statystyki</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></content:encoded>
			<wfw:commentRss>http://ocrwdokumentach.pl/wykorzystanie-ocr-badania-i-statystyki/feed/</wfw:commentRss>
		<slash:comments>2</slash:comments>
		</item>
		<item>
		<title>Czym jest OCR – optyczne rozpoznawanie znaków?</title>
		<link>http://ocrwdokumentach.pl/czym-jest-ocr/</link>
		<comments>http://ocrwdokumentach.pl/czym-jest-ocr/#comments</comments>
		<pubDate>Fri, 12 Oct 2012 10:55:56 +0000</pubDate>
		<dc:creator><![CDATA[Michał Rykiert]]></dc:creator>
				<category><![CDATA[Informacje ogólne]]></category>
		<category><![CDATA[definicja]]></category>
		<category><![CDATA[dokumenty]]></category>
		<category><![CDATA[działanie]]></category>
		<category><![CDATA[Google Docs]]></category>
		<category><![CDATA[Optical Character Recognition]]></category>
		<category><![CDATA[rozpoznawanie]]></category>
		<category><![CDATA[schemat]]></category>
		<category><![CDATA[skanowanie]]></category>
		<category><![CDATA[znaki]]></category>
		<category><![CDATA[znaków]]></category>

		<guid isPermaLink="false">http://ocrwdokumentach.pl/?p=11</guid>
		<description><![CDATA[<p>OCR (z ang. Optical Character Recognition) &#8211; Optyczne Rozpoznawanie Znaków. Oprogramowanie służące do analizy tekstu pisanego, drukowanego bądź odręcznego, a następnie jego konwersji do postaci elektronicznej (w formie plików .txt,</p>
<p>Post <a rel="nofollow" href="/czym-jest-ocr/">Czym jest OCR – optyczne rozpoznawanie znaków?</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></description>
				<content:encoded><![CDATA[<h4><strong>OCR</strong> (z ang. Optical Character Recognition) &#8211; Optyczne Rozpoznawanie Znaków.</h4>
<p>Oprogramowanie służące do analizy tekstu pisanego, drukowanego bądź odręcznego, a następnie jego konwersji do postaci elektronicznej (w formie plików .txt, .doc lub .pdf), umożliwiającej dalszą edycję. Technologia ta znajduje szerokie zastosowanie m.in. w przedsiębiorstwach (rejestrowanie dokumentów i wniosków) i bibliotekach (archiwizacja zbiorów).</p>
<h4>Prosty schemat działania systemu OCR:</h4>
<p><a href="/wp-content/uploads/2012/10/ocr.gif"><img class="alignleft  wp-image-49" title="ocr2" alt="Optical Character Recognition2" src="/wp-content/uploads/2012/10/ocr.gif" width="366" height="100" /></a></p>
<p>&nbsp;</p>
<p>&nbsp;</p>
<p>&nbsp;</p>
<p>&nbsp;</p>
<p>Najpierw dokument skanowany jest za pomocą skanera. Następnie przetwarzany przez komputer z odpowiednim oprogramowaniem. W efekcie końcowym wyświetlany jest edytowalny tekst. Metoda rozpoznawania różna jest w zależności od wykorzystanych algorytmów. Obecnie najlepsze programy OCR zapewniają skuteczność na poziomie 99%-99,5%, co oznacza że wciąż zachodzi konieczność manualnej weryfikacji rozpoznania niektórych słów.</p>
<p><span id="more-11"></span></p>
<h3>Przykład wykorzystania OCR przez Google Docs:<br />
<a href="/wp-content/uploads/2012/10/Google-Docs-OCR.png"><img class="alignleft size-full wp-image-54" title="Google Docs OCR" alt="Google Docs OCR" src="/wp-content/uploads/2012/10/Google-Docs-OCR.png" width="414" height="224" /></a></h3>
<p>&nbsp;</p>
<p>&nbsp;</p>
<p>&nbsp;</p>
<p>&nbsp;</p>
<p>&nbsp;</p>
<p>&nbsp;</p>
<p>&nbsp;</p>
<h4>Poniżej filmik przedstawiający w praktyce wykorzystanie OCR. W tym przypadku z wykorzystaniem systemu elektronicznego obiegu dokumentów.</h4>
<p><a href="http://www.youtube.com/watch?feature=player_embedded&amp;v=0P1pcM8Bd1o">Rejestracja faktury w systemie obiegu dokumentów</a></p>
<p>Post <a rel="nofollow" href="/czym-jest-ocr/">Czym jest OCR – optyczne rozpoznawanie znaków?</a> pojawił się poraz pierwszy w <a rel="nofollow" href="/">OCR w dokumentach</a>.</p>
]]></content:encoded>
			<wfw:commentRss>http://ocrwdokumentach.pl/czym-jest-ocr/feed/</wfw:commentRss>
		<slash:comments>3</slash:comments>
		</item>
	</channel>
</rss>
