{"id":18415,"date":"2025-08-07T11:00:00","date_gmt":"2025-08-07T09:00:00","guid":{"rendered":"https:\/\/office-samurai.com\/odcinek-7-szczere-spojrzenie-na-inteligentne-przetwarzanie-dokumentow-co-dziala-co-nie-i-dlaczego\/"},"modified":"2025-10-24T14:44:42","modified_gmt":"2025-10-24T12:44:42","slug":"odcinek-7-szczere-spojrzenie-na-inteligentne-przetwarzanie-dokumentow-co-dziala-co-nie-i-dlaczego","status":"publish","type":"post","link":"https:\/\/office-samurai.com\/pl\/odcinek-7-szczere-spojrzenie-na-inteligentne-przetwarzanie-dokumentow-co-dziala-co-nie-i-dlaczego\/","title":{"rendered":"Odcinek 7 | Szczere spojrzenie na inteligentne przetwarzanie dokument\u00f3w. Co dzia\u0142a, co zawodzi i dlaczego (wywiad)"},"content":{"rendered":"\n<div class=\"wp-block-buttons is-content-justification-center is-layout-flex wp-container-core-buttons-is-layout-3e41869c wp-block-buttons-is-layout-flex\">\n<div class=\"wp-block-button is-style-outline is-style-outline--1\"><a class=\"wp-block-button__link has-black-color has-text-color has-link-color has-medium-font-size has-custom-font-size wp-element-button\" href=\"https:\/\/youtu.be\/P0PGD6SO8-w?si=aQCBIsbTfBKsrf06\" style=\"border-radius:0px\" target=\"_blank\" rel=\"noreferrer noopener\">YouTube<\/a><\/div>\n\n\n\n<div class=\"wp-block-button is-style-outline is-style-outline--2\"><a class=\"wp-block-button__link has-black-color has-text-color has-link-color has-medium-font-size has-custom-font-size wp-element-button\" href=\"https:\/\/open.spotify.com\/episode\/3bdsY8yWpny1rPaOXJtAnp?si=79474fa798284267\" style=\"border-radius:0px\" target=\"_blank\" rel=\"noreferrer noopener\">Spotify<\/a><\/div>\n\n\n\n<div class=\"wp-block-button is-style-outline is-style-outline--3\"><a class=\"wp-block-button__link has-black-color has-text-color has-link-color has-medium-font-size has-custom-font-size wp-element-button\" href=\"https:\/\/podcasts.apple.com\/us\/podcast\/an-honest-look-at-intelligent-document-processing\/id1814320637?i=1000720919911\" style=\"border-radius:0px\" target=\"_blank\" rel=\"noreferrer noopener\">Apple Podcasts<\/a><\/div>\n<\/div>\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Kontekst_i_historia_przetwarzania_dokumentow\"><\/span><strong>Kontekst i historia przetwarzania dokument\u00f3w<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p class=\"wp-block-paragraph\"><strong>Andrzej Kinastowski (AK):<\/strong> Konnichiwa, witajcie w <a href=\"https:\/\/www.youtube.com\/playlist?list=PLhXE_-WUIvq0-qsJPqg509l6s7vLhEOPs\" target=\"_blank\" rel=\"noreferrer noopener\">podca\u015bcie Office Samurai<\/a>, gdzie uderzamy w nieefektywno\u015b\u0107 z precyzj\u0105 \u0142ucznika z epoki Edo. Tym razem b\u0119dziemy rozmawia\u0107 o Inteligentnym Przetwarzaniu Dokument\u00f3w (IDP), czyli o cyfrowym przetwarzaniu faktur, zam\u00f3wie\u0144, wyci\u0105g\u00f3w bankowych, dokument\u00f3w to\u017csamo\u015bci, celnych \u2013 ca\u0142ej tej papierowej i bezpapierowej papierologii, kt\u00f3r\u0105 mo\u017cecie mie\u0107. Nazywam si\u0119 Andrzej Kinastowski, jestem jednym z za\u0142o\u017cycieli <a href=\"https:\/\/office-samurai.com\/pl\/firma-zajmujaca-sie-automatyzacja-procesow-biznesowych\/\" target=\"_blank\" rel=\"noreferrer noopener\">Office Samurai<\/a> \u2013 firmy, kt\u00f3ra wierzy, \u017ce Wasz biznes nie powinien by\u0107 zak\u0142adnikiem \u017ale zeskanowanego dokumentu. A teraz chwy\u0107cie swoj\u0105 ulubion\u0105 katan\u0119 albo ten zaskakuj\u0105co ostry no\u017cyk do list\u00f3w, kt\u00f3ry \u201epo\u017cyczyli\u015bcie\u201d z dzia\u0142u ksi\u0119gowo\u015bci, i zaczynajmy.   <\/p>\n\n<figure class=\"wp-block-embed is-type-video is-provider-youtube wp-block-embed-youtube wp-embed-aspect-16-9 wp-has-aspect-ratio\"><div class=\"wp-block-embed__wrapper\">\n<iframe class=\"cky-consent-iframe\" data-consent=\"marketing\" data-cky-src=\"https:\/\/www.youtube.com\/embed\/P0PGD6SO8-w?feature=oembed\" data-cky-placeholder=\"1\" class=\"cky-consent-iframe\" data-consent=\"marketing\" data-cky- data-cky-placeholder=\"1\" title=\"An honest look at Intelligent Document Processing. What works, what fails, and why\" width=\"800\" height=\"450\" frameborder=\"0\" allow=\"accelerometer; autoplay; clipboard-write; encrypted-media; gyroscope; picture-in-picture; web-share\" referrerpolicy=\"strict-origin-when-cross-origin\" allowfullscreen><\/iframe>\n<\/div><\/figure>\n\n<p class=\"wp-block-paragraph\">Prawie 20 lat temu, kiedy zaczyna\u0142em swoj\u0105 karier\u0119 korporacyjn\u0105, zosta\u0142em zatrudniony w firmie BPO, a moim pierwszym zadaniem by\u0142o ksi\u0119gowanie faktur \u2014 typowa praca na poziomie pocz\u0105tkowym w tamtym czasie. Ka\u017cdego dnia dostawa\u0142em paczk\u0119 prawdziwych papierowych faktur i przepisywa\u0142em je do komputera. Pami\u0119tam, \u017ce wtedy my\u015bla\u0142em, i\u017c to do\u015b\u0107 szalone, \u017ce \u017cyjemy w XXI wieku, a du\u017ce mi\u0119dzynarodowe firmy wci\u0105\u017c wysy\u0142aj\u0105 sobie nawzajem kawa\u0142ki papieru \u2014 kawa\u0142ki papieru, kt\u00f3re potem cz\u0142owiek musi r\u0119cznie wprowadza\u0107 do komputera. To by\u0142o osobliwe. Niekt\u00f3rzy inni klienci tej firmy BPO u\u017cywali technologii OCR (Optical Character Recognition) i by\u0142em im tego ca\u0142kiem zazdrosny.    <\/p>\n\n<p class=\"wp-block-paragraph\">Kilka lat p\u00f3\u017aniej, kiedy zaj\u0105\u0142em si\u0119 doskonaleniem proces\u00f3w i realizowa\u0142em projekty z zakresu zarz\u0105dzania Lean, zauwa\u017cy\u0142em, \u017ce niekt\u00f3re z tych zespo\u0142\u00f3w po\u015bwi\u0119ca\u0142y wi\u0119cej czasu na poprawianie b\u0142\u0119d\u00f3w, kt\u00f3re pope\u0142ni\u0142 OCR, ni\u017c zaj\u0119\u0142oby im r\u0119czne zaksi\u0119gowanie tych faktur. To by\u0142y takie \u201estare szko\u0142y\u201d OCR-y, w kt\u00f3rych dla ka\u017cdej nowej faktury trzeba by\u0142o stworzy\u0107 tzw. mask\u0119. Je\u015bli zmieni\u0142 si\u0119 szablon faktury, nale\u017ca\u0142o zmieni\u0107 mask\u0119. Maska informowa\u0142a narz\u0119dzie, \u017ce w przypadku tego rodzaju faktury mo\u017cna spodziewa\u0107 si\u0119 numeru konta bankowego w tej cz\u0119\u015bci strony, a kwoty brutto w tamtej. Wymaga\u0142o to wi\u0119c du\u017co pracy utrzymaniowej i wcale nie by\u0142o takie \u015bwietne. Dzi\u015b porozmawiamy o tym, jak te rzeczy s\u0105 robione teraz.     <\/p>\n\n<p class=\"wp-block-paragraph\">Dzi\u015b moim go\u015bciem jest Tomasz Wierzbicki. Jest jednym z konsultant\u00f3w w Office Samurai. To ekspert w wielu dziedzinach \u2014 pracuje m.in. nad Intelligent Document Processing, <a href=\"https:\/\/office-samurai.com\/pl\/communications-mining-z-uipath-kazde-slowo-ma-znaczenie\/\" target=\"_blank\" rel=\"noreferrer noopener\">Communication Mining<\/a>, <a href=\"https:\/\/office-samurai.com\/pl\/otwieranie-przyszlosci-automatyzacji-dzieki-agentowej-sztucznej-inteligencji\/\" target=\"_blank\" rel=\"noreferrer noopener\">GenAI Agents<\/a> i wieloma innymi tematami. Tomaszu, witaj w podca\u015bcie.   <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>Tomasz Wierzbicki (TW): <\/strong>Cze\u015b\u0107, bardzo si\u0119 ciesz\u0119, \u017ce tu jestem.<\/p>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Powiedz mi, dlaczego to w\u0142a\u015bnie ty tu jeste\u015b (to znaczy, dlaczego rozmawiam w\u0142a\u015bnie z tob\u0105 o Intelligent Document Processing)?<\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Zajmuj\u0119 si\u0119 Intelligent Document Processing, a ostatnio coraz bardziej klasycznym machine learningiem oraz Communication Mining (czyli g\u0142\u00f3wnie NLP \u2013 Natural Language Processing). Historia zacz\u0119\u0142a si\u0119 oko\u0142o dw\u00f3ch lat temu. Pami\u0119tam, jak nasz tech lead, Konrad, robi\u0142 pewne eksperymenty z Document Understanding, i kiedy sam tego spr\u00f3bowa\u0142em, bardzo szybko mnie to wci\u0105gn\u0119\u0142o. To niesamowicie ciekawe m\u00f3c \u0142\u0105czy\u0107 rzeczy, kt\u00f3re robimy na co dzie\u0144 (RPA czy automatyzacj\u0119), z odrobin\u0105 Artificial Intelligence. Dzi\u015b, przy tak szybkim rozwoju technologii, to bardzo interesuj\u0105cy czas i obszar, w kt\u00f3rym warto by\u0107. Mam wra\u017cenie, \u017ce ucz\u0119 si\u0119 czego\u015b nowego ka\u017cdego dnia, a jednocze\u015bnie wiele rzeczy bardzo szybko si\u0119 dezaktualizuje.     <\/p>\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Ewolucja_od_klasycznego_OCR_do_niezaleznego_od_ukladu_IDP\"><\/span><strong>Ewolucja: od klasycznego OCR do niezale\u017cnego od uk\u0142adu IDP<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Je\u015bli chodzi o te stare OCR-y, kt\u00f3rych u\u017cywali\u015bmy 20 lat temu w firmie BPO \u2014 czym dzisiejsze narz\u0119dzia si\u0119 od nich r\u00f3\u017cni\u0105? Bo to, co widzia\u0142em 20 lat temu, nie robi\u0142o zbyt du\u017cego wra\u017cenia.<\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW:<\/strong> Kr\u00f3tkie zastrze\u017cenie: dla mnie to raczej by\u0142o 10\u201315 lat temu (20 lat temu by\u0142em raczej uczniem szko\u0142y \u015bredniej). Mia\u0142em jednak do czynienia z tymi klasycznymi rozwi\u0105zaniami. Z tego, co pami\u0119tam, wtedy pojawia\u0142o si\u0119 pytanie, czy to si\u0119 w og\u00f3le op\u0142aca, bo korzystanie z takich OCR-\u00f3w by\u0142o koszmarnie drogie, a sama technologia nie by\u0142a jeszcze tak dojrza\u0142a jak dzi\u015b. Nasz tech lead, Konrad, powiedzia\u0142 kiedy\u015b, \u017ce obecnie OCR-y w\u0142a\u015bciwie osi\u0105gn\u0119\u0142y g\u00f3rny pu\u0142ap swojej efektywno\u015bci \u2014 technologia jest naprawd\u0119 dojrza\u0142a i obecnie jest rozwijana poprzez wykorzystanie deep learningu, a prawdopodobnie tak\u017ce du\u017cych modeli j\u0119zykowych.   <\/p>\n\n<p class=\"wp-block-paragraph\">Wci\u0105\u017c by\u0142o tam mn\u00f3stwo b\u0142\u0119d\u00f3w, wi\u0119c wolumeny, kt\u00f3re chcia\u0142o si\u0119 przetwarza\u0107 za pomoc\u0105 OCR, musia\u0142y by\u0107 naprawd\u0119 ogromne, \u017ceby rozwi\u0105zanie op\u0142aca\u0142o si\u0119 w d\u0142u\u017cszej perspektywie. I tak trzeba by\u0142o poprawia\u0107 liter\u00f3wki \u2014 typowym przypadkiem by\u0142o mylenie \u201e1\u201d z \u201eL\u201d albo \u201e0\u201d z \u201eO\u201d i tym podobne rzeczy. Tekst uzyskany z OCR wymaga\u0142 wi\u0119c sporo postprocessingu. <\/p>\n\n<p class=\"wp-block-paragraph\">Klasyczne podej\u015bcie polega\u0142o na tym, \u017ce mimo istnienia OCR, technologia ta nie potrafi\u0142a zrobi\u0107 wiele wi\u0119cej poza samym odczytaniem i rozpoznaniem tekstu. Obecnie, dzi\u0119ki IDP (Intelligent Document Processing), stosujemy tak\u017ce rozpoznawanie wzorc\u00f3w, dzi\u0119ki czemu narz\u0119dzie jest niezale\u017cne od uk\u0142adu dokumentu. <\/p>\n\n<figure class=\"wp-block-image size-large\"><img fetchpriority=\"high\" decoding=\"async\" width=\"1024\" height=\"575\" src=\"https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-11-111108_00002_-1024x575.png\" alt=\"\" class=\"wp-image-19895\" srcset=\"https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-11-111108_00002_-1024x575.png 1024w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-11-111108_00002_-300x169.png 300w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-11-111108_00002_-768x432.png 768w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-11-111108_00002_-1536x863.png 1536w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-11-111108_00002_.png 1936w\" sizes=\"(max-width: 1024px) 100vw, 1024px\" \/><\/figure>\n\n<h3 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Kategoryzacja_struktury_dokumentu\"><\/span>Kategoryzacja struktury dokumentu<span class=\"ez-toc-section-end\"><\/span><\/h3>\n\n<p class=\"wp-block-paragraph\"><strong>TW:<\/strong> Kiedy masz dokument, prawdopodobnie b\u0119dzie on mia\u0142 pewn\u0105 struktur\u0119. Mo\u017cemy podzieli\u0107 takie dokumenty na kategorie: <\/p>\n\n<ol class=\"wp-block-list\">\n<li><strong>Brak jakiejkolwiek struktury: <\/strong>je\u015bli we\u017amiesz jeden kontrakt lub jaki\u015b certyfikat, mo\u017ce on wygl\u0105da\u0107 zupe\u0142nie inaczej ni\u017c inny.<\/li>\n\n\n\n<li><strong>P\u00f3\u0142ustrukturyzowane: <\/strong>Typowe dokumenty, takie jak faktury czy zam\u00f3wienia, w kt\u00f3rych mo\u017cna si\u0119 spodziewa\u0107 okre\u015blonych element\u00f3w. W polskim prawodawstwie jeste\u015b prawnie zobowi\u0105zany do umieszczenia na fakturze okre\u015blonych informacji. Mo\u017cna wi\u0119c oczekiwa\u0107 nie tylko obecno\u015bci konkretnych danych, ale te\u017c pewnej struktury (na przyk\u0142ad nag\u0142\u00f3wka powtarzaj\u0105cego si\u0119 na kilku stronach).  <\/li>\n\n\n\n<li><strong>Pe\u0142na struktura: <\/strong>Nasz s\u0142ynny formularz podatkowy PIT albo dawny spos\u00f3b realizacji przelew\u00f3w bankowych na poczcie.<\/li>\n<\/ol>\n\n<p class=\"wp-block-paragraph\">Obecnie skupiamy si\u0119 nie tylko na samym pozyskaniu tekstu, ale tak\u017ce na okre\u015bleniu po\u0142o\u017cenia element\u00f3w, prawdopodobnie k\u0105ta, pod jakim dokument jest przekrzywiony, oraz wielu innych parametr\u00f3w. Kr\u00f3tko m\u00f3wi\u0105c \u2014 nie chodzi ju\u017c tylko o odczyt tekstu, lecz tak\u017ce o rozpoznanie struktury, czyli bardziej sytuacj\u0119 przypominaj\u0105c\u0105 rozpoznawanie obrazu, a nie wy\u0142\u0105cznie tekst. <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>To jest co\u015b, co dla cz\u0142owieka jest bardzo proste. Pami\u0119tam, jak uczono mnie odczytywa\u0107 faktury \u2014 pokazano mi kilka przyk\u0142ad\u00f3w, wyja\u015bniono, jakich informacji mam szuka\u0107 \u2014 i dla cz\u0142owieka rozpoznawanie takich wzorc\u00f3w jest naprawd\u0119 \u0142atwe. Ale dla komputera zawsze by\u0142o to bardzo trudne zadanie.  <\/p>\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Przeplyw_pracy_IDP_klasyfikacja_ekstrakcja_cech_i_eksport_danych\"><\/span><strong>Przep\u0142yw pracy IDP: klasyfikacja, ekstrakcja cech i eksport danych<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Jak to dzia\u0142a, \u017ce wrzucamy zeskanowan\u0105 faktur\u0119, a na wyj\u015bciu dostajemy wszystkie informacje \u0142adnie uporz\u0105dkowane w tabeli Excela?<\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Na podstawie projekt\u00f3w, kt\u00f3re realizowa\u0142em, typowy proces obejmuje kilka kluczowych krok\u00f3w, kt\u00f3re zawsze si\u0119 wykonuje.<\/p>\n\n<h3 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Krok_1_Digitalizacja_i_ekstrakcja_cech\"><\/span>Krok 1: Digitalizacja i ekstrakcja cech<span class=\"ez-toc-section-end\"><\/span><\/h3>\n\n<p class=\"wp-block-paragraph\"><strong>TW:<\/strong> Nie ka\u017cdy dokument, kt\u00f3ry masz, b\u0119dzie natywny (czyli w formacie PDF, w kt\u00f3rym mo\u017cna zaznaczy\u0107 tekst). Czasami jest to plik p\u0142aski albo nawet zeskanowany, wi\u0119c wtedy narz\u0119dzia musz\u0105 u\u017cy\u0107 OCR lub w inny spos\u00f3b wyodr\u0119bni\u0107 tekst. Pierwszym krokiem jest wi\u0119c digitalizacja \u2014 i tutaj otwiera si\u0119 ca\u0142y obszar bada\u0144 zwi\u0105zany z technologiami OCR.  <\/p>\n\n<p class=\"wp-block-paragraph\">Zasadniczo musimy pozyska\u0107 tekst, ale opr\u00f3cz samego tekstu wyodr\u0119bniamy r\u00f3wnie\u017c cechy. Przyjmuje to form\u0119 du\u017cego obiektu (w sensie programistycznym, w kodzie), kt\u00f3ry zawiera r\u00f3\u017cnego rodzaju parametry. Mog\u0105 to by\u0107 s\u0142owa, ich po\u0142o\u017cenie, najbli\u017csze otoczenie, informacje o nachyleniu dokumentu oraz r\u00f3\u017cne wagi i wsp\u00f3\u0142czynniki, kt\u00f3re mo\u017cna uwzgl\u0119dni\u0107. Ten model obiektu dokumentu jest nast\u0119pnie przekazywany do algorytmu uczenia maszynowego.   <\/p>\n\n<p class=\"wp-block-paragraph\">W bardziej klasycznym podej\u015bciu by\u0142oby to prawdopodobnie po\u0142\u0105czenie g\u0142\u0119bokich sieci neuronowych do analizy obrazu (czyli cz\u0119\u015bci strukturalnej) oraz konwolucyjnych sieci neuronowych. Dla cz\u0119\u015bci tekstowej stosuje si\u0119 zazwyczaj embeddingi. Modele te mog\u0105 by\u0107 wst\u0119pnie wytrenowane (dostawca mo\u017ce oferowa\u0107 gotowe modele przeznaczone np. do faktur lub innych typ\u00f3w dokument\u00f3w) albo trzeba je wytrenowa\u0107 samodzielnie.  <\/p>\n\n<h3 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Krok_2_Klasyfikacja_dokumentu\"><\/span>Krok 2: Klasyfikacja dokumentu<span class=\"ez-toc-section-end\"><\/span><\/h3>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Pierwsz\u0105 rzecz\u0105, kt\u00f3r\u0105 chcesz zrobi\u0107, jest klasyfikacja. Je\u015bli nie masz pewno\u015bci, \u017ce otrzymujesz tylko jeden konkretny typ dokumentu, musisz przeprowadzi\u0107 klasyfikacj\u0119. Algorytm okre\u015bla, jaki to typ dokumentu (np. faktura albo nota kredytowa) \u2014 bez udzia\u0142u cz\u0142owieka. Nie jest to prosta klasyfikacja oparta na s\u0142owach kluczowych, lecz ponownie podej\u015bcie oparte na uczeniu maszynowym.   <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>AK:<\/strong> Czyli je\u015bli algorytm nie jest pewien, \u017ce ma do czynienia z danym typem dokumentu, to zwraca si\u0119 o pomoc do cz\u0142owieka, a nast\u0119pnie te dane mo\u017cemy wykorzysta\u0107 do ponownego trenowania modelu, \u017ceby go wzmocni\u0107 i sprawi\u0107, by by\u0142 bardziej pewny swoich decyzji?<\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Tak, dok\u0142adnie. Mo\u017cna zbudowa\u0107 tak\u0105 p\u0119tl\u0119 zwrotn\u0105 \u2014 skoro i tak trzeba zaanga\u017cowa\u0107 cz\u0142owieka do walidacji, to czemu tego nie wykorzysta\u0107 i nie wzmocni\u0107 modelu, dostarczaj\u0105c mu dodatkowych przyk\u0142ad\u00f3w treningowych. Kiedy ju\u017c wiemy, z jakim typem dokumentu mamy do czynienia, mo\u017cemy przekaza\u0107 go do wyspecjalizowanych modeli (np. jednego tylko do faktur, innego do zam\u00f3wie\u0144), czyli kierowa\u0107 dokument dok\u0142adnie do odpowiedniego modelu.  <\/p>\n\n<h3 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Krok_3_Ekstrakcja_danych\"><\/span>Krok 3: Ekstrakcja danych<span class=\"ez-toc-section-end\"><\/span><\/h3>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Druga cz\u0119\u015b\u0107, kt\u00f3ra jest cz\u0119\u015bciej oczekiwana, to ekstrakcja \u2014 czyli wyci\u0105gni\u0119cie z dokumentu najwa\u017cniejszych informacji. Na fakturach b\u0119d\u0105 to na przyk\u0142ad numer faktury, data oraz produkty lub us\u0142ugi, za kt\u00f3re p\u0142acisz. Celem jest, aby algorytm potrafi\u0142 samodzielnie wychwyci\u0107 te konkretne warto\u015bci, dzi\u0119ki czemu uzyskujemy ustrukturyzowany format danych, z kt\u00f3rym mo\u017cna dalej pracowa\u0107. W ten spos\u00f3b nie ma potrzeby, by cz\u0142owiek przepisywa\u0142 te dane r\u0119cznie albo nawet kopiowa\u0142 i wkleja\u0142 \u2014 co r\u00f3wnie\u017c jest \u017cmudnym i powtarzalnym zaj\u0119ciem.   <\/p>\n\n<figure class=\"wp-block-image size-large\"><img decoding=\"async\" width=\"1024\" height=\"575\" src=\"https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-11-143623_00004_-1024x575.png\" alt=\"\" class=\"wp-image-19900\" srcset=\"https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-11-143623_00004_-1024x575.png 1024w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-11-143623_00004_-300x169.png 300w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-11-143623_00004_-768x432.png 768w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-11-143623_00004_-1536x863.png 1536w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-11-143623_00004_.png 1936w\" sizes=\"(max-width: 1024px) 100vw, 1024px\" \/><\/figure>\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Wdrozenie_i_koniecznosc_udzialu_czlowieka_w_procesie_Human_in_the_Loop_HITL\"><\/span><strong>Wdro\u017cenie i konieczno\u015b\u0107 udzia\u0142u cz\u0142owieka w procesie (Human in the Loop, HITL)<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Czyli narz\u0119dzie rozumie, jaki to typ dokumentu, wie, jakie dane musi z niego pobra\u0107, i faktycznie je pozyskuje. Co dzieje si\u0119 dalej? W jaki spos\u00f3b to \u0142\u0105czy si\u0119 z naszymi procesami biznesowymi?  <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Skoro mamy ju\u017c dane w formacie ustrukturyzowanym, to zasadniczo mo\u017cna z nimi zrobi\u0107 wszystko, co da si\u0119 zaprogramowa\u0107 lub zautomatyzowa\u0107 za pomoc\u0105 RPA. To, w jaki spos\u00f3b nast\u0119puje po\u0142\u0105czenie z procesami, zale\u017cy od dostawcy rozwi\u0105zania IDP. <\/p>\n\n<p class=\"wp-block-paragraph\">\ud83d\udd38 Mo\u017ce to by\u0107 cokolwiek \u2014 od podstawowego API (dzia\u0142aj\u0105cego w dowolnym j\u0119zyku programowania).<br\/>\ud83d\udd38 W przypadku bardziej zaawansowanych platform (takich jak UiPath) dost\u0119pne s\u0105 gotowe interfejsy, a czasem tak\u017ce biblioteki RPA, kt\u00f3re zawieraj\u0105 gotowe aktywno\u015bci \u2014 wystarczy wybra\u0107 model i \u015bcie\u017ck\u0119 do dokumentu.<\/p>\n\n<p class=\"wp-block-paragraph\">Je\u015bli nie masz zasob\u00f3w do twardego kodowania (nie w stylu RPA ani low-code, lecz klasycznego programowania), musisz zbada\u0107 dost\u0119pne integracje, poniewa\u017c mo\u017ce to znacz\u0105co podnie\u015b\u0107 pr\u00f3g wej\u015bcia. Rozwi\u0105zania takie jak <a href=\"https:\/\/office-samurai.com\/pl\/sappi-usprawnia-operacje-dzieki-inteligentnej-automatyzacji\/\" target=\"_blank\" rel=\"noreferrer noopener\">Document Understanding<\/a> oferuj\u0105 wszystko w pakiecie, a do\u015bwiadczenie u\u017cytkownika jest naprawd\u0119 bardzo przyjemne, nawet dla os\u00f3b nietechnicznych. Cz\u0119sto nazywam interfejs treningowy \u201ekolorowank\u0105\u201d, poniewa\u017c u\u017cytkownik biznesowy po prostu zaznacza fragmenty tekstu i dane w przyjaznym graficznym interfejsie.  <\/p>\n\n<h3 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Rola_HITL_i_wskaznika_pewnosci_confidence_score\"><\/span>Rola HITL i wska\u017anika pewno\u015bci (confidence score)<span class=\"ez-toc-section-end\"><\/span><\/h3>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>W przypadku tych starych OCR-\u00f3w wygl\u0105da\u0142o to tak, \u017ce je\u015bli model nie potrafi\u0142 obs\u0142u\u017cy\u0107 danego dokumentu, przekazywa\u0142 go do r\u0119cznego przetworzenia przez cz\u0142owieka. A je\u015bli nie po\u015bwi\u0119ca\u0142o si\u0119 wystarczaj\u0105co du\u017co uwagi utrzymaniu systemu, model rozumia\u0142 coraz mniej faktur. Jak to dzia\u0142a w przypadku Intelligent Document Processing?  <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW:<\/strong> Warto szuka\u0107 rozwi\u0105zania, kt\u00f3re uwzgl\u0119dnia tzw. Human in the Loop (HITL). W takim podej\u015bciu nie przerywasz ca\u0142ego procesu, ale wprowadzasz cz\u0142owieka w jego \u015brodek (zamiast robota czy AI), aby zweryfikowa\u0142, czy dane s\u0105 poprawne. Mo\u017cna te\u017c uruchamia\u0107 poszczeg\u00f3lne elementy r\u00f3wnolegle, dzi\u0119ki czemu nie zatrzymujesz ca\u0142ego procesu tylko po to, by zwalidowa\u0107 jeden dokument.  <\/p>\n\n<p class=\"wp-block-paragraph\">Stacja walidacyjna to graficzny interfejs u\u017cytkownika, w kt\u00f3rym wy\u015bwietlany jest dokument oraz warto\u015bci rozpoznane dla danego typu dokumentu i poszczeg\u00f3lnych p\u00f3l. W tym miejscu mo\u017cna sprawdzi\u0107, czy model poradzi\u0142 sobie poprawnie, czy nie. I tu pojawia si\u0119 kluczowy element \u2014 wska\u017anik pewno\u015bci (confidence score). Trzeba zaakceptowa\u0107, \u017ce to nie jest klasyczne RPA. Sie\u0107 neuronowa zwraca pewne warto\u015bci (zazwyczaj w zakresie od 0 do 100%), kt\u00f3re reprezentuj\u0105 stopie\u0144 pewno\u015bci modelu, \u017ce dana warto\u015b\u0107 faktycznie jest t\u0105, kt\u00f3rej szukamy. Nast\u0119pnie decydujemy, czy jeste\u015bmy gotowi zaakceptowa\u0107 (na przyk\u0142ad) 85% pewno\u015bci, by uruchomi\u0107 kolejn\u0105 automatyzacj\u0119. Nasze typowe podej\u015bcie polega na tym, by nie ba\u0107 si\u0119 heurystyk. AI jest \u015bwietne, ale nie nale\u017cy obawia\u0107 si\u0119 uzupe\u0142niania danych czy budowania tabel mapuj\u0105cych (na przyk\u0142ad najpierw odszukania numeru faktury gdzie\u015b w systemie), a dopiero potem zdecydowania o wy\u015bwietleniu stacji walidacyjnej u\u017cytkownikowi.       <\/p>\n\n<h3 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Paradoks_dokladnosci_czlowieka_i_maszyny\"><\/span>Paradoks dok\u0142adno\u015bci cz\u0142owieka i maszyny<span class=\"ez-toc-section-end\"><\/span><\/h3>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Narz\u0119dzie prawdopodobnie wykona oko\u0142o 80% pracy, ale jeszcze nie jeste\u015bmy na etapie (mo\u017ce poza bardzo prostymi przypadkami), gdzie mo\u017cna by osi\u0105gn\u0105\u0107 100% przetwarzania bez udzia\u0142u cz\u0142owieka. Nadal ma\u0142o kto w przypadku istotnych proces\u00f3w pozostawia wszystko w r\u0119kach AI. <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Musimy te\u017c pami\u0119ta\u0107, \u017ce AI nie ma by\u0107 doskona\u0142a \u2014 ale ludzie r\u00f3wnie\u017c nie s\u0105. Nasze wska\u017aniki poprawno\u015bci (KPI) przy ksi\u0119gowaniu faktur wynosi\u0142y zwykle oko\u0142o 96%. Oznacza to, \u017ce w 4% faktur mo\u017cna by\u0142o znale\u017a\u0107 jaki\u015b b\u0142\u0105d, je\u015bli by\u0142y przetwarzane przez cz\u0142owieka. To zadanie jest bardzo powtarzalne, wi\u0119c \u0142atwo si\u0119 rozproszy\u0107, co\u015b przeoczy\u0107. Rozumiem, dlaczego firmy podchodz\u0105 ostro\u017cnie do modeli niedeterministycznych, ale to nie jest tak, \u017ce ludzie radz\u0105 sobie w tym du\u017co lepiej.    <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Ludzie nie weryfikuj\u0105 tak dok\u0142adnie. Poka\u017c mi osob\u0119, kt\u00f3ra mia\u0142aby na tyle cierpliwo\u015bci, \u017ceby sprawdza\u0107 linijka po linijce 30-stronicowy plik PDF i por\u00f3wnywa\u0107 go z systemem MRP. Je\u015bli jeste\u015b du\u017c\u0105 firm\u0105, otrzymujesz codziennie tysi\u0105ce, a nawet dziesi\u0105tki tysi\u0119cy faktur. To po prostu nieludzkie wymaga\u0107 od kogo\u015b, \u017ceby por\u00f3wnywa\u0142 10 000 stron z jak\u0105\u015b baz\u0105 danych. Trzeba zrozumie\u0107, \u017ce zar\u00f3wno ludzie, jak i maszyny b\u0119d\u0105 pope\u0142nia\u0107 b\u0142\u0119dy \u2014 i dlatego procesy musz\u0105 by\u0107 zaprojektowane tak, aby potrafi\u0142y sobie z tym poradzi\u0107.    <\/p>\n\n<figure class=\"wp-block-image size-large\"><img decoding=\"async\" width=\"1024\" height=\"580\" src=\"https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/OS-agent-newsletter_00120_-1024x580.png\" alt=\"\" class=\"wp-image-19913\" srcset=\"https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/OS-agent-newsletter_00120_-1024x580.png 1024w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/OS-agent-newsletter_00120_-300x170.png 300w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/OS-agent-newsletter_00120_-768x435.png 768w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/OS-agent-newsletter_00120_-1536x870.png 1536w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/OS-agent-newsletter_00120_.png 1920w\" sizes=\"(max-width: 1024px) 100vw, 1024px\" \/><\/figure>\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Przypadki_uzycia_poza_fakturami_i_dokumentami_o_duzych_wolumenach\"><\/span><strong>Przypadki u\u017cycia: poza fakturami i dokumentami o du\u017cych wolumenach<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Zacz\u0119li\u015bmy od faktur \u2014 to co\u015b, od czego wi\u0119kszo\u015b\u0107 firm rozpoczyna swoj\u0105 przygod\u0119 z <a href=\"https:\/\/office-samurai.com\/pl\/speedrun-bot-challenge-jak-inpost-i-office-samurai-opanowali-automatyzacje-w-24-godziny-z-wykorzystaniem-uipath\/\" target=\"_blank\" rel=\"noreferrer noopener\">Intelligent Document Processing<\/a>, bo faktury dostaje ka\u017cdy, a im wi\u0119ksza firma, tym wi\u0119cej ich otrzymuje. Ale jakie inne typy dokument\u00f3w mo\u017cna przetwarza\u0107 za pomoc\u0105 IDP, gdzie zastosowanie tej technologii nadal ma sens? <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW:<\/strong> Sugerowa\u0142bym, \u017ceby wzi\u0105\u0107 te dwie podstawowe funkcjonalno\u015bci \u2014 klasyfikacj\u0119 i ekstrakcj\u0119 (czyli rozpoznanie typu dokumentu oraz wyci\u0105gni\u0119cie z niego danych) \u2014 a nast\u0119pnie zastanowi\u0107 si\u0119, co mo\u017cna z nimi zrobi\u0107 w r\u00f3\u017cnych procesach. Inne, ciekawsze przyk\u0142ady, kt\u00f3re realizowali\u015bmy (bo sama klasyfikacja, ekstrakcja i wprowadzanie danych gdzie\u015b dalej to najbardziej typowy przypadek), to na przyk\u0142ad rozpoznawanie, czy na dokumencie znajduje si\u0119 podpis. <\/p>\n\n<h3 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Przypadek_uzycia_1_Rozpoznawanie_obecnosci_podpisu\"><\/span>Przypadek u\u017cycia 1: Rozpoznawanie obecno\u015bci podpisu<span class=\"ez-toc-section-end\"><\/span><\/h3>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Jeden z naszych klient\u00f3w w og\u00f3le nie by\u0142 zainteresowany \u017cadnym tekstem ani danymi \u2014 chodzi\u0142o tylko o to, \u017ce na pewnych dokumentach dostawy znajdowa\u0142y si\u0119 trzy pola i zale\u017ca\u0142o im wy\u0142\u0105cznie na tym, \u017ceby okre\u015bli\u0107, czy w ka\u017cdym z nich jest \u201etak\u201d. By\u0142y tam piecz\u0105tki i odr\u0119czne podpisy. W takich przypadkach warto raczej sk\u0142ania\u0107 si\u0119 ku systemom rozpoznawania obrazu, bo s\u0105 do tego lepiej przystosowane. Na szcz\u0119\u015bcie rozwi\u0105zanie, kt\u00f3rego u\u017cywamy, obs\u0142uguje specjalne pole przeznaczone do wykrywania podpis\u00f3w i mo\u017ce ono przyjmowa\u0107 warto\u015bci logiczne (tak\/nie). Wykorzystali\u015bmy t\u0119 funkcj\u0119 \u2014 i dzia\u0142a\u0142o to ca\u0142kiem dobrze, bo oko\u0142o 80\u201390% przypadk\u00f3w by\u0142o rozpoznawanych poprawnie.    <\/p>\n\n<h3 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Przypadek_uzycia_2_Maskowanie_danych_Anonimizacja\"><\/span>Przypadek u\u017cycia 2: Maskowanie danych (Anonimizacja)<span class=\"ez-toc-section-end\"><\/span><\/h3>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Innym przyk\u0142adem by\u0142a wsp\u00f3\u0142praca z litewsk\u0105 firm\u0105, gdzie niekt\u00f3re organy pa\u0144stwowe za\u017c\u0105da\u0142y od firmy pewnych dokument\u00f3w i mia\u0142y do tego prawo. Z drugiej strony nale\u017ca\u0142o by\u0107 zgodnym z RODO, wi\u0119c nie mogli po prostu przekaza\u0107 tych dokument\u00f3w. Musieli zaciemni\u0107 (anonimizowa\u0107) dane osobowe pracownik\u00f3w, poniewa\u017c prawdopodobnie by\u0142y to dokumenty HR lub jakie\u015b umowy. Rozwi\u0105zaniem by\u0142o u\u017cycie ekstrakcji, ale nie po to, by rzeczywi\u015bcie wyci\u0105ga\u0107 dane, lecz by ustali\u0107, gdzie te dane osobowe si\u0119 znajduj\u0105, a nast\u0119pnie wykorzystanie bibliotek third-party (u\u017cyli\u015bmy Pythona), kt\u00f3re po prostu rysowa\u0142y czarne prostok\u0105ty na tych miejscach i nast\u0119pnie sp\u0142aszcza\u0142y ca\u0142y dokument do pliku, kt\u00f3rego nie da si\u0119 odtworzy\u0107.   <\/p>\n\n<h3 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Przypadek_uzycia_3_Zarzadzanie_i_rozdzielanie_dokumentow_HR\"><\/span>Przypadek u\u017cycia 3: Zarz\u0105dzanie i rozdzielanie dokument\u00f3w HR<span class=\"ez-toc-section-end\"><\/span><\/h3>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>I jeszcze jeden ciekawy przypadek \u2014 zn\u00f3w du\u017ce wolumeny i spore wyzwanie: dokumenty HR. Firma mia\u0142a ogromn\u0105 liczb\u0119 dokument\u00f3w kadrowych (umowy, karty cz\u0142onkowskie si\u0142owni, umowy dotycz\u0105ce opieki zdrowotnej). Chcieli je zdigitalizowa\u0107, ale wrzucili ca\u0142e stosy papier\u00f3w prosto do skanera, w wyniku czego powsta\u0142y po\u0142\u0105czone pliki PDF licz\u0105ce po 100 lub 150 stron. A skoro dokumenty zosta\u0142y scalone, pojawi\u0142 si\u0119 problem \u2014 gdzie ko\u0144czy si\u0119 dokument A, a zaczyna dokument B. Te narz\u0119dzia mog\u0105 r\u00f3wnie\u017c w tym pom\u00f3c, analizuj\u0105c, \u017ce dany dokument obejmuje strony od tego do tego miejsca i automatycznie dziel\u0105c je na cz\u0119\u015bci. Og\u00f3lnym celem by\u0142o p\u00f3\u017aniejsze sprawdzenie, czy dany pracownik (np. John Smith) posiada podpisane okre\u015blone dokumenty (np. t\u0119 umow\u0119 i t\u0119, ale by\u0107 mo\u017ce nie ma jeszcze podpisanej umowy o opiek\u0119 medyczn\u0105).     <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Czyli rozumiem, \u017ce chodzi o to, \u017ce czasami zaczynamy od prostych dokument\u00f3w \u2014 bardziej ustrukturyzowanych, w du\u017cych wolumenach, takich jak faktury, zam\u00f3wienia czy wyci\u0105gi bankowe. Nast\u0119pnie, w przypadku administracji HR, pojawia si\u0119 du\u017co papieru. Wiele firm wci\u0105\u017c jest w trakcie digitalizacji ca\u0142ych archiw\u00f3w. A potem mamy t\u0119 kategori\u0119 bardziej nietypowych rzeczy \u2014 tak jak wspomnia\u0142e\u015b: wyszukiwanie podpis\u00f3w czy maskowanie danych. To ju\u017c bardziej kreatywny spos\u00f3b wykorzystania narz\u0119dzia do obs\u0142ugi wszelkich dokument\u00f3w, jakie mo\u017cemy mie\u0107.    <\/p>\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Wyzwania_techniczne_i_paradoks_%E2%80%9Ecyfrowego_papieru%E2%80%9D\"><\/span><strong>Wyzwania techniczne i paradoks \u201ecyfrowego papieru\u201d<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Jedna rzecz, kt\u00f3ra mnie zadziwia, to fakt, \u017ce u\u017cywamy plik\u00f3w PDF, mimo \u017ce PDF wcale nie jest dobrym formatem do przetwarzania danych. PDF to wci\u0105\u017c dane nieustrukturyzowane (chyba \u017ce maj\u0105 jakie\u015b ukryte warstwy ze struktur\u0105). Przez te 20 lat (odk\u0105d zaczyna\u0142em r\u0119czne ksi\u0119gowanie faktur) przeszli\u015bmy z papieru na co\u015b, co w\u0142a\u015bciwie jest cyfrowym papierem \u2014 ale to wci\u0105\u017c papier, bo to nadal nie s\u0105 dane ustrukturyzowane. Nie przeszli\u015bmy na pliki CSV czy tabele SQL, tylko z jednego rodzaju papieru na inny.   <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW:<\/strong> Ludzie cz\u0119sto zapominaj\u0105, \u017ce PDF zosta\u0142 pierwotnie zaprojektowany do druku (na potrzeby marketingu, ulotek cyfrowych i tym podobnych), ale bardzo szybko sta\u0142 si\u0119 najpopularniejszym formatem praktycznie do wszystkiego. To by\u0142 troch\u0119 strza\u0142 w kolano, \u017ce nie poszli\u015bmy o krok dalej, \u017ceby opracowa\u0107 lepiej ustandaryzowane formaty. Obecnie te narz\u0119dzia w gruncie rzeczy pomagaj\u0105 nam rozwi\u0105zywa\u0107 problem, kt\u00f3ry sami stworzyli\u015bmy w przesz\u0142o\u015bci. Gdyby wszystko dzia\u0142a\u0142o przez API albo w jakim\u015b systemie EDI, nie potrzebowaliby\u015bmy ju\u017c narz\u0119dzi AI do rozpoznawania danych.   <\/p>\n\n<figure class=\"wp-block-image size-large\"><img loading=\"lazy\" decoding=\"async\" width=\"1024\" height=\"575\" src=\"https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-10-211858_00011_-1-1024x575.png\" alt=\"\" class=\"wp-image-19909\" srcset=\"https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-10-211858_00011_-1-1024x575.png 1024w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-10-211858_00011_-1-300x169.png 300w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-10-211858_00011_-1-768x432.png 768w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-10-211858_00011_-1-1536x863.png 1536w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/2024-09-10-211858_00011_-1.png 1936w\" sizes=\"(max-width: 1024px) 100vw, 1024px\" \/><\/figure>\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Centralne_e-fakturowanie_i_przyszlosc_IDP\"><\/span><strong>Centralne e-fakturowanie i przysz\u0142o\u015b\u0107 IDP<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p class=\"wp-block-paragraph\"><strong>AK:<\/strong> I to w\u0142a\u015bnie prowadzi mnie do kolejnego pytania, poniewa\u017c s\u0105 ju\u017c kraje w Europie, kt\u00f3re wprowadzi\u0142y scentralizowany system fakturowania. W Polsce wci\u0105\u017c z tym walczymy \u2014 wdro\u017cenie by\u0142o ju\u017c kilkukrotnie odk\u0142adane, ale mo\u017ce kiedy\u015b w ko\u0144cu nast\u0105pi. Jak my\u015blisz, jaki wp\u0142yw b\u0119dzie to mia\u0142o na potrzeb\u0119 stosowania technologii IDP?  <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Trudno jednoznacznie powiedzie\u0107, patrz\u0105c na obecn\u0105 sytuacj\u0119. Poniewa\u017c faktury s\u0105 najpopularniejszym typem dokument\u00f3w, przynajmniej rozwa\u017cy\u0142bym temat i zrobi\u0142 rozeznanie w inicjatywach Unii Europejskiej lub lokalnych dzia\u0142a\u0144 rz\u0105dowych. Wida\u0107 post\u0119p w cyfryzacji administracji publicznej, wi\u0119c warto si\u0119 temu przyjrze\u0107 \u2014 \u017ceby nie okaza\u0142o si\u0119, \u017ce wdro\u017cy\u0142e\u015b rozwi\u0105zanie w p\u00f3\u0142 roku, a po kolejnych sze\u015bciu miesi\u0105cach wszyscy przechodz\u0105 na e-fakturowanie i s\u0105 do tego prawnie zobowi\u0105zani.   <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Ale badania musz\u0105 by\u0107 dok\u0142adne, bo z tego, co rozumiem, wiele z tych system\u00f3w fakturowania zawiera tylko podstawowe dane z faktury i nie maj\u0105 tabel ze szczeg\u00f3\u0142ami. Wi\u0119c nadal trzeba znale\u017a\u0107 spos\u00f3b, \u017ceby je odczyta\u0107, a poza tym to wci\u0105\u017c tylko faktury \u2014 a my nadal przetwarzamy wiele innych typ\u00f3w dokument\u00f3w. <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Tempo rozwoju technologii a tempo jej wdra\u017cania to zupe\u0142nie dwie r\u00f3\u017cne rzeczy. Obserwujemy, \u017ce rozwi\u0105zania IDP pojawi\u0142y si\u0119 3\u20134 lata temu, a mimo to wci\u0105\u017c zg\u0142aszaj\u0105 si\u0119 do nas firmy z tymi samymi problemami, z tymi samymi starymi rozwi\u0105zaniami, z tymi samymi plikami PDF. My\u015bl\u0119 wi\u0119c, \u017ce ta technologia z nami zostanie. Co\u015b, co ju\u017c dzia\u0142a i przynosi realne korzy\u015bci, zawsze b\u0119dzie lepsze ni\u017c gonienie za idea\u0142em, kt\u00f3ry nigdy nie zostanie zrealizowany.   <\/p>\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Wybor_dostawcy_dlaczego_UiPath_Document_Understanding\"><\/span><strong>Wyb\u00f3r dostawcy: dlaczego UiPath Document Understanding<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Na rynku jest kilku g\u0142\u00f3wnych graczy, a w Office Samurai najcz\u0119\u015bciej korzystamy z <a href=\"https:\/\/office-samurai.com\/pl\/zrozumienie-dokumentow-rewolucjonizuje-procesy-e-d-e\/\" target=\"_blank\" rel=\"noreferrer noopener\">Document Understanding<\/a> od UiPath. Czy mo\u017cesz powiedzie\u0107, dlaczego w\u0142a\u015bnie to rozwi\u0105zanie, a nie wi\u0119kszo\u015b\u0107 innych dost\u0119pnych na rynku? <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>My\u015bl\u0119, \u017ce du\u017c\u0105 rol\u0119 odgrywaj\u0105 tu nasze przyzwyczajenia \u2014 dobrze znamy t\u0119 technologi\u0119. Dostawca s\u0142ynie z tego, \u017ce potrafi \u015bwietnie integrowa\u0107 swoje rozwi\u0105zania z reszt\u0105 swojego portfolio produkt\u00f3w. Kolejn\u0105 zalet\u0105 jest spos\u00f3b wdro\u017cenia dla u\u017cytkownik\u00f3w biznesowych. Cz\u0119sto nazywam proces treningowy \u201ekolorowank\u0105\u201d \u2014 u\u017cytkownik biznesowy po prostu zaznacza fragmenty tekstu i dane. UiPath oferuje te\u017c modele wst\u0119pnie wytrenowane, kt\u00f3re ju\u017c na starcie maj\u0105 pewien poziom skuteczno\u015bci. W przypadku najcz\u0119\u015bciej wyst\u0119puj\u0105cych p\u00f3l na fakturach mo\u017cna oczekiwa\u0107 \u015bredniego wska\u017anika pewno\u015bci na poziomie 60\u201370%. Je\u015bli ju\u017c korzystasz z tego oprogramowania do RPA, wdro\u017cenie kolejnego narz\u0119dzia w ramach tej samej platformy jest bardzo proste. Poza tym UiPath jest cz\u0119sto wskazywany jako lider tej technologii.       <\/p>\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Podejscie_hybrydowe_IDP_i_duze_modele_jezykowe_LLM\"><\/span><strong>Podej\u015bcie hybrydowe: IDP i du\u017ce modele j\u0119zykowe (LLM)<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Cz\u0119sto dostajemy pytania o du\u017ce modele j\u0119zykowe (LLM). Wiele firm my\u015bli w ten spos\u00f3b: \u201eDlaczego zamiast korzysta\u0107 z Intelligent Document Processing, po prostu nie wrzucimy tego do ChatGPT?\u201d. Jakie jest twoje zdanie na ten temat?  <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW:<\/strong> Pierwsz\u0105 rzecz\u0105, o kt\u00f3rej zawsze wspominam, jest powtarzalno\u015b\u0107. Przetwarzanie du\u017cych wolumen\u00f3w wymaga zbudowania odpowiedniego przep\u0142ywu pracy. Po drugie, dokumenty o charakterze transakcyjnym, takie jak faktury, same w sobie nie zawieraj\u0105 zbyt du\u017co tekstu. LLM-y s\u0142u\u017c\u0105 do rozumienia j\u0119zyka, a nie do rozumienia struktur \u2014 i w\u0142a\u015bnie dlatego dedykowane rozwi\u0105zania IDP wci\u0105\u017c sprawdzaj\u0105 si\u0119 w tym lepiej.    <\/p>\n\n<p class=\"wp-block-paragraph\">Bardzo ciekawym obszarem jest budowanie rozwi\u0105za\u0144 hybrydowych. Mo\u017cna wzi\u0105\u0107 dane wyj\u015bciowe z rozwi\u0105zania IDP i poprosi\u0107 LLM o ich walidacj\u0119. Mo\u017cna te\u017c stworzy\u0107 agenta, kt\u00f3ry ma dost\u0119p do systemu ERP i potrafi sprawdza\u0107 oraz weryfikowa\u0107 dane. Du\u017cym obszarem zastosowa\u0144 jest tzw. fuzzy matching \u2014 mo\u017cna poprosi\u0107 agenta, by sprawdzi\u0142, czy r\u00f3\u017cne sformu\u0142owania nazwy produktu faktycznie oznaczaj\u0105 to samo, tylko s\u0105 zapisane w inny spos\u00f3b. Innym obszarem, w kt\u00f3rym mo\u017cna wykorzysta\u0107 LLM, jest rozpoznawanie pisma odr\u0119cznego. Conrad, nasz tech lead, przekaza\u0142 LLM-owi tekst z OCR wraz z obrazem, na kt\u00f3rym by\u0142o du\u017co pisma odr\u0119cznego, prosz\u0105c o poprawienie b\u0142\u0119d\u00f3w wynikaj\u0105cych z trudno\u015bci w odczycie. Dzi\u0119ki temu uda\u0142o si\u0119 po\u0142\u0105czy\u0107 najlepsze cechy obu \u015bwiat\u00f3w.       <\/p>\n\n<p class=\"wp-block-paragraph\">Trzecim czynnikiem jest poziom pewno\u015bci. LLM-y nie zwracaj\u0105 \u017cadnego wska\u017anika prawdopodobie\u0144stwa. Korzystaj\u0105c z nich, ka\u017cdy s\u0142ysza\u0142 o tzw. halucynacjach \u2014 gdy model si\u0119 myli, potrafi poda\u0107 b\u0142\u0119dn\u0105 odpowied\u017a z absolutnym przekonaniem, jakby by\u0142 pewien na 100%. Trudno sobie wyobrazi\u0107, by jakikolwiek mened\u017cer zdecydowa\u0142 si\u0119 obecnie powierzy\u0107 wszystko AI bez nadzoru cz\u0142owieka. Dlatego na razie dzia\u0142amy w modelu hybrydowym.     <\/p>\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Gdy_automatyzacja_napotyka_mur_problematyczne_dokumenty\"><\/span><strong>Gdy automatyzacja napotyka mur: problematyczne dokumenty<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p class=\"wp-block-paragraph\"><strong>AK:<\/strong> Czy spotka\u0142e\u015b si\u0119 z projektami lub typami dokument\u00f3w, w kt\u00f3rych ta technologia zawiod\u0142a albo nie dzia\u0142a\u0142a tak, jak tego oczekiwali\u015bmy?<\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Pismo odr\u0119czne wci\u0105\u017c stanowi problem, wi\u0119c lepiej go unika\u0107. Trzeba si\u0119 liczy\u0107 z tym, \u017ce technologia zadzia\u0142a dobrze tylko wtedy, gdy pismo odr\u0119czne jest naprawd\u0119 czytelne. S\u0142abej jako\u015bci skany zdarzaj\u0105 si\u0119 dzi\u015b rzadko \u2014 w takim przypadku zastanowi\u0142bym si\u0119 raczej, czy nie taniej by\u0142oby po prostu wymieni\u0107 sprz\u0119t. Podpisy te\u017c bywaj\u0105 problematyczne, zw\u0142aszcza je\u015bli s\u0105 nieczytelne. W naszym przypadku chodzi\u0142o tylko o sprawdzenie, czy podpis w og\u00f3le jest, czy go nie ma.    <\/p>\n\n<p class=\"wp-block-paragraph\">Ale tym, co faktycznie sprawia\u0142o najwi\u0119cej problem\u00f3w, by\u0142y zagnie\u017cd\u017cone tabele. Narz\u0119dzie potrafi definiowa\u0107 dwuwymiarowe struktury w osiach X i Y, ale dokumenty cz\u0119sto maj\u0105 tendencj\u0119 do tworzenia jednej du\u017cej tabeli, wewn\u0105trz kt\u00f3rej w kolumnach znajduj\u0105 si\u0119 kolejne tabele. Nauczenie modelu poprawnego rozpoznawania takich przypadk\u00f3w jest trudne. Trzeba by\u0142o stosowa\u0107 obej\u015bcia i dodatkowo przetwarza\u0107 dane po rozpoznaniu.   <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>To nasz apel do wszystkich os\u00f3b projektuj\u0105cych faktury i inne typy dokument\u00f3w: je\u015bli naprawd\u0119 chcemy zast\u0105pi\u0107 ludzi, kt\u00f3rzy tylko przepisuj\u0105 i kopiuj\u0105 dane z tych dokument\u00f3w\u2026<\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>przesta\u0144my tworzy\u0107 te wymy\u015blne uk\u0142ady graficzne. Naprawd\u0119 \u2014 z punktu widzenia automatyzacji zwyk\u0142y plik tekstowy, w kt\u00f3rym wszystko jest po prostu wypisane, sprawdzi si\u0119 znacznie lepiej.  <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Prosimy \u2014 \u017cadnych zagnie\u017cd\u017conych tabel.<\/p>\n\n<figure class=\"wp-block-image size-full\"><img loading=\"lazy\" decoding=\"async\" width=\"1024\" height=\"1024\" src=\"https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/ComfyUI_00145_.png\" alt=\"\" class=\"wp-image-19917\" srcset=\"https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/ComfyUI_00145_.png 1024w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/ComfyUI_00145_-300x300.png 300w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/ComfyUI_00145_-150x150.png 150w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/ComfyUI_00145_-768x768.png 768w, https:\/\/office-samurai.com\/wp-content\/uploads\/2025\/08\/ComfyUI_00145_-700x700.png 700w\" sizes=\"(max-width: 1024px) 100vw, 1024px\" \/><\/figure>\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Ostatnie_refleksje_IDP_albo_apokalipsa\"><\/span><strong>Ostatnie refleksje: IDP albo apokalipsa<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>By\u0107 mo\u017ce kiedy\u015b dojdziemy do momentu, w kt\u00f3rym inteligentne przetwarzanie dokument\u00f3w nie b\u0119dzie ju\u017c potrzebne, bo zaczniemy wymienia\u0107 si\u0119 danymi w spos\u00f3b odpowiedni dla XXI wieku, a nie dla XX. Ale minie jeszcze du\u017co czasu, zanim to nast\u0105pi. <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW:<\/strong> Je\u015bli zaczynasz od zera \u2014 jako nowa firma czy startup \u2014 ju\u017c teraz pomy\u015bl o tym, jak dobrze poradzisz sobie z tym obszarem. Je\u015bli uda ci si\u0119 wdro\u017cy\u0107 jaki\u015b zdigitalizowany proces, w kt\u00f3rym komputery komunikuj\u0105 si\u0119 ze sob\u0105 przez API lub w ustandaryzowanych formatach, takich jak XML czy JSON, to i tak b\u0119dzie to lepsze rozwi\u0105zanie ni\u017c po prostu zast\u0119powanie papieru jego cyfrow\u0105 wersj\u0105 w formacie PDF. <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>My\u015bl\u0119, \u017ce wyra\u017anie wida\u0107, \u017ce istnieje mn\u00f3stwo mo\u017cliwo\u015bci wykorzystania inteligentnego przetwarzania dokument\u00f3w. I nie chodzi tu tylko o oszcz\u0119dno\u015bci. <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW: <\/strong>Chodzi te\u017c o to, \u017ce coraz trudniej znale\u017a\u0107 ludzi, kt\u00f3rzy b\u0119d\u0105 chcieli wykonywa\u0107 tego typu prac\u0119. Znalezienie os\u00f3b, kt\u00f3re b\u0119d\u0105 robi\u0142y to wystarczaj\u0105co d\u0142ugo, \u017ceby mia\u0142o sens ich tego nauczy\u0107, staje si\u0119 naprawd\u0119 trudne. Te wolumeny nie b\u0119d\u0105 male\u0107; ka\u017cda firma musi rosn\u0105\u0107. Dlatego widzimy dwie opcje: albo wdra\u017camy inteligentne przetwarzanie dokument\u00f3w, albo po prostu czekamy na apokalips\u0119.   <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>AK: <\/strong>Na tej optymistycznej nucie, Tomaszu, bardzo dzi\u0119kuj\u0119 za podzielenie si\u0119 swoim do\u015bwiadczeniem.<\/p>\n\n<p class=\"wp-block-paragraph\"><strong>TW:<\/strong> Najpierw zobaczmy, dok\u0105d zaprowadzi nas ten apel o niewymy\u015blne pliki PDF. Do wszystkich, kt\u00f3rzy je projektuj\u0105 \u2014 pami\u0119tajcie, za pi\u0119\u0107 lat sprawdzimy, jak wam posz\u0142o. Prostota jest pi\u0119kna. Dzi\u0119kuj\u0119 wszystkim.   <\/p>\n\n<p class=\"wp-block-paragraph\"><strong>AK:<\/strong> Dobrze, moi drodzy, to by by\u0142o na tyle \u2014 kolejny odcinek podcastu Office Samurai zosta\u0142 posiekany, pokrojony i podany niczym wasz ulubiony talerz sashimi. Ten odcinek przygotowali\u015bmy we wsp\u00f3\u0142pracy z UiPath \u2014 naszym pierwszym wyborem w\u015br\u00f3d platform do automatyzacji proces\u00f3w. Ogromne podzi\u0119kowania dla was, naszych s\u0142uchaczy, \u017ce jeste\u015bcie z nami \u2014 niezale\u017cnie od tego, czy s\u0142uchacie w drodze do pracy, siedzicie na spotkaniu udaj\u0105c, \u017ce robicie notatki, czy po prostu ukrywacie si\u0119 przed swoj\u0105 skrzynk\u0105 mailow\u0105. Doceniamy was i obiecujemy, \u017ce jeszcze was nie zautomatyzujemy. Wielkie podzi\u0119kowania dla naszego go\u015bcia, Tomasza Wierzbickiego, za pokazanie nam drogi do zwyci\u0119stwa nad papierologi\u0105. I jak zawsze, brawa dla Anny Cubal, naszej producentki, kt\u00f3ra ogarnia te odcinki z wi\u0119ksz\u0105 precyzj\u0105 ni\u017c model IDP odczytuj\u0105cy idealnie sformatowan\u0105 faktur\u0119. Ca\u0142o\u015b\u0107 zosta\u0142a nagrana w legendarnym Wodzu Beats Studio, gdzie kawa jest mocna, ale nasza niech\u0119\u0107 do r\u0119cznego wprowadzania danych \u2014 jeszcze mocniejsza. Je\u015bli spodoba\u0142o wam si\u0119 to, co us\u0142yszeli\u015bcie \u2014 powiedzcie o tym znajomym. A je\u015bli wam si\u0119 nie podoba\u0142o \u2014 koniecznie powiedzcie o tym swoim wrogom. Pami\u0119tajcie, \u017ceby zasubskrybowa\u0107 nas tam, gdzie aktualnie odk\u0142adacie obowi\u0105zki \u2014 na Spotify, Apple albo w tej dziwnej aplikacji podcastowej, kt\u00f3r\u0105 poleci\u0142 wam kuzyn. A je\u015bli wam si\u0119 podoba\u0142o, nie podoba\u0142o, macie pomys\u0142y na przysz\u0142e odcinki albo po prostu chcecie podyskutowa\u0107 o skr\u00f3tach, \u015bmia\u0142o si\u0119 odezwijcie. Przysy\u0142ajcie swoje opinie, pytania, a nawet haiku o automatyzacji. W Samurai jeste\u015bmy otwarci na wszystko. Do nast\u0119pnego razu \u2014 niech wasze katany b\u0119d\u0105 ostre, a wasze procesy jeszcze ostrzejsze.            <\/p>\n\n<style>a.wp-block-button__link,\n  a.wp-block-button__link * {\n    text-decoration: none !important;\n    -webkit-text-decoration: none !important;\n  }\n<\/style>\n","protected":false},"excerpt":{"rendered":"<p>Czy Inteligentne Przetwarzanie Dokument\u00f3w (IDP) to realne rozwi\u0105zanie, czy tylko kolejna przereklamowana technologia?<br \/>\nW tym odcinku przygl\u0105damy si\u0119 w praktyczny i szczery spos\u00f3b, gdzie IDP faktycznie przynosi rezultaty, gdzie napotyka trudno\u015bci oraz co warto rozwa\u017cy\u0107 przed jego wdro\u017ceniem.<\/p>\n","protected":false},"author":1,"featured_media":18390,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"_acf_changed":false,"inline_featured_image":false,"footnotes":""},"categories":[126,127],"tags":[178],"class_list":["post-18415","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-narzedzia-ai","category-automatyzacja-procesow-robotycznych","tag-podcast-pl"],"acf":[],"_links":{"self":[{"href":"https:\/\/office-samurai.com\/pl\/wp-json\/wp\/v2\/posts\/18415","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/office-samurai.com\/pl\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/office-samurai.com\/pl\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/office-samurai.com\/pl\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/office-samurai.com\/pl\/wp-json\/wp\/v2\/comments?post=18415"}],"version-history":[{"count":0,"href":"https:\/\/office-samurai.com\/pl\/wp-json\/wp\/v2\/posts\/18415\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/office-samurai.com\/pl\/wp-json\/wp\/v2\/media\/18390"}],"wp:attachment":[{"href":"https:\/\/office-samurai.com\/pl\/wp-json\/wp\/v2\/media?parent=18415"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/office-samurai.com\/pl\/wp-json\/wp\/v2\/categories?post=18415"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/office-samurai.com\/pl\/wp-json\/wp\/v2\/tags?post=18415"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}