Czym jest OCR?
OCR, czyli optyczne rozpoznawanie znaków, to technologia umożliwiająca odczytywanie tekstu z obrazu lub zeskanowanego dokumentu. Program analizuje plik, rozpoznaje litery, cyfry i układ treści, a następnie zamienia je na dane możliwe do wyszukiwania i edycji.
W księgowości OCR znajduje zastosowanie przede wszystkim przy pracy z fakturami, rachunkami, notami księgowymi, potwierdzeniami płatności i innymi dokumentami zawierającymi powtarzalne informacje. Zamiast ręcznie przepisywać dane, można wykorzystać system do wstępnego odczytu i przekazać dokument do sprawdzenia przez pracownika.
OCR nie powinien być traktowany jako całkowicie bezobsługowe rozwiązanie. Jego skuteczność zależy od jakości dokumentu, rodzaju czcionki, układu informacji oraz ustawień programu. Najlepsze rezultaty daje połączenie automatycznego rozpoznawania z kontrolą człowieka.
Jakie dane można odczytywać z dokumentów księgowych?
Nowoczesne narzędzia OCR potrafią rozpoznawać wiele informacji znajdujących się na fakturach i innych dokumentach. Najczęściej są to:
– nazwa i adres wystawcy,
– numer dokumentu,
– data wystawienia,
– data sprzedaży lub wykonania usługi,
– termin płatności,
– numer identyfikacji podatkowej,
– kwoty netto, podatku i brutto,
– stawki podatku,
– dane nabywcy,
– numer rachunku bankowego,
– opis towaru lub usługi,
– pozycje znajdujące się w tabeli.
W zależności od programu system może również rozpoznawać kategorie kosztów, waluty, jednostki miary oraz informacje z kodów kreskowych. Warto jednak wcześniej sprawdzić, jakie pola obsługuje wybrane rozwiązanie i czy można je dopasować do używanego programu księgowego.
Jak wygląda proces odczytywania dokumentu?
Wdrożenie OCR można podzielić na kilka etapów. Dzięki temu łatwiej zaplanować pracę i znaleźć miejsce, w którym mogą pojawić się błędy.
1. Dostarczenie dokumentu
Dokument może trafić do systemu jako skan, zdjęcie, plik PDF lub załącznik wiadomości elektronicznej. W niektórych firmach dokumenty są także pobierane z wyznaczonego folderu albo przekazywane przez formularz internetowy.
Najlepiej ustalić jednolity sposób przesyłania plików. Ogranicza to ryzyko zagubienia dokumentu i ułatwia późniejsze wyszukiwanie.
2. Analiza obrazu
Program poprawia jakość obrazu, rozpoznaje orientację strony i dzieli dokument na poszczególne obszary. Następnie identyfikuje tekst, cyfry oraz tabele.
Na tym etapie duże znaczenie ma jakość pliku. Rozmazane zdjęcie, krzywo ustawiona kartka, cienie i odręczne dopiski mogą obniżyć dokładność rozpoznawania.
3. Odczyt danych
System przypisuje rozpoznane informacje do odpowiednich pól. Na przykład ciąg cyfr opisany jako „NIP” może zostać zapisany w polu identyfikatora wystawcy, a kwota znajdująca się obok słowa „Razem” może trafić do pola kwoty brutto.
Niektóre narzędzia korzystają z gotowych wzorów dokumentów, a inne analizują układ treści bez względu na położenie konkretnych pól.
4. Weryfikacja i eksport
Po zakończeniu analizy użytkownik otrzymuje podgląd dokumentu oraz odczytanych danych. Może poprawić błędne wartości, zatwierdzić dokument i przesłać informacje do programu księgowego, systemu obiegu dokumentów lub arkusza.
Jak przygotować dokumenty do pracy z OCR?
Przed uruchomieniem automatycznego odczytu warto zadbać o kilka podstawowych elementów:
– skanuj dokumenty w odpowiedniej rozdzielczości,
– unikaj cieni, odbić światła i obciętych krawędzi,
– zapisuj pliki w popularnych formatach, takich jak PDF lub JPEG,
– ustawiaj dokument prosto i bez zagięć,
– nie łącz wielu dokumentów w jeden plik, jeśli system wymaga pojedynczych stron,
– stosuj czytelne nazwy plików,
– przechowuj oryginały zgodnie z zasadami obowiązującymi w firmie.
Jeżeli dokumenty są fotografowane telefonem, pomocne mogą być funkcje automatycznego przycinania i wyrównywania obrazu. W przypadku większej liczby dokumentów lepszym rozwiązaniem bywa skaner z podajnikiem.
Kontrola jakości odczytu
Najważniejszym elementem procesu jest weryfikacja. Nawet dobrze działający OCR może pomylić podobne znaki, na przykład cyfrę „0” z literą „O” albo cyfrę „1” z literą „I”. Błędy mogą wystąpić również przy przecinkach dziesiętnych, numerach rachunków i pozycjach tabeli.
Warto ustawić kontrolę szczególnie dla:
– kwot netto, podatku i brutto,
– numerów identyfikacyjnych,
– numerów dokumentów,
– terminów płatności,
– danych nabywcy i wystawcy,
– numerów rachunków,
– zgodności sum pozycji z kwotą końcową.
Dobrym rozwiązaniem jest oznaczanie pól, co do których system ma mniejszą pewność. Pracownik może wtedy skupić uwagę na informacjach wymagających sprawdzenia, zamiast ponownie analizować cały dokument.
Integracja z obiegiem dokumentów
OCR przynosi największe korzyści, gdy jest częścią większego procesu. Samo rozpoznanie tekstu nie wystarczy, jeśli dane nadal trzeba ręcznie przepisywać do kilku różnych programów.
Przykładowy obieg może wyglądać następująco:
- Dokument trafia do wyznaczonej skrzynki lub folderu.
- System automatycznie rozpoznaje jego zawartość.
- Dane są porównywane z informacjami zapisanymi w bazie kontrahentów.
- Dokument otrzymuje status do weryfikacji.
- Pracownik sprawdza oznaczone pola.
- Zatwierdzone dane są eksportowane do programu księgowego.
- Plik zostaje zapisany w uporządkowanym archiwum.
Przed wdrożeniem warto sprawdzić, czy narzędzie oferuje integrację z używanymi programami. Może ona działać za pomocą gotowego dodatku, wymiany plików albo interfejsu programistycznego.
Bezpieczeństwo i organizacja danych
Dokumenty księgowe zawierają dane firmowe, dlatego wybór narzędzia powinien uwzględniać sposób przechowywania i przetwarzania plików. Należy sprawdzić, czy dokumenty są przesyłane do zewnętrznej usługi, jak długo pozostają na serwerze oraz kto może mieć do nich dostęp.
W praktyce warto:
– ograniczyć dostęp do dokumentów tylko do upoważnionych osób,
– korzystać z indywidualnych kont użytkowników,
– stosować silne hasła i dodatkowe zabezpieczenia logowania,
– regularnie wykonywać kopie zapasowe,
– ustalić zasady usuwania plików tymczasowych,
– prowadzić historię zmian i zatwierdzeń,
– sprawdzić warunki przechowywania danych u dostawcy usługi.
Przed rozpoczęciem pracy dobrze jest również ustalić, które dokumenty można przetwarzać automatycznie, a które wymagają dodatkowej kontroli.
Jak rozpocząć wdrożenie OCR?
Najbezpieczniej rozpocząć od małego testu. Wybierz kilkadziesiąt dokumentów różnego typu: czytelne skany, zdjęcia, faktury z tabelami oraz dokumenty od kilku wystawców. Następnie porównaj wyniki z ręcznie sprawdzonymi danymi.
Podczas testu zwróć uwagę na:
– dokładność odczytu najważniejszych pól,
– czas potrzebny na weryfikację,
– liczbę dokumentów wymagających ręcznej poprawy,
– możliwość eksportu danych,
– łatwość obsługi przez pracowników,
– koszty wdrożenia i utrzymania rozwiązania.
Dopiero po takim sprawdzianie warto ustalić zasady dla całego zespołu. Należy opisać, kto dodaje dokumenty, kto je weryfikuje, jak oznacza się błędy i gdzie przechowuje zatwierdzone pliki.
Najważniejsze korzyści
Prawidłowo wdrożony OCR może ograniczyć ręczne przepisywanie danych, przyspieszyć rejestrację dokumentów i ułatwić ich wyszukiwanie. Pomaga również uporządkować obieg pracy, ponieważ każdy dokument może mieć określony status i historię obsługi.
Najlepsze rezultaty zapewnia jednak nie sama technologia, lecz dobrze zaplanowany proces. Czytelne dokumenty, regularna kontrola, integracja z używanymi systemami i przeszkolony zespół sprawiają, że OCR staje się praktycznym wsparciem codziennej pracy księgowej.