Opracowanie materiałów cyfrowych

Z przygotowanego skanu do tekstu, który można znaleźć.

LibraSystem wspiera opracowanie plików cyfrowych: przyjęcie materiału, opis, rozpoznanie tekstu i korektę przed udostępnieniem. OCR pomaga czytelnikowi dotrzeć do treści wewnątrz dokumentu.

Tekst z przygotowanego skanu

Rozpoznanie pozwala wykorzystać treść obrazu w wyszukiwaniu.

Korekta przy oryginale

Bibliotekarz porównuje wynik OCR z widokiem strony.

Historia opracowania tekstu

Zachowane wersje pomagają sprawdzić poprawki i ponowne rozpoznanie.

Przygotuj plik, opis i sposób udostępnienia

Praca zaczyna się od istniejącego skanu lub innego pliku. Bibliotekarz dodaje go do obiektu cyfrowego, określa rolę, metadane, folder i prawa dostępu. Duże materiały można przesyłać w częściach, a pliki przechodzą kontrolę przed publikacją.

Oryginał i pliki pochodne są rozdzielone. Miniatury oraz wersje do odczytu ułatwiają korzystanie z dokumentu bez zmiany materiału źródłowego. Opis można powiązać z katalogiem, aby wersja cyfrowa była odkrywalna przy odpowiedniej publikacji.

Śledź rozpoznawanie i poprawiaj wynik

OCR działa w tle, z informacją o stanie poszczególnych stron. Bibliotekarz wybiera język i może ponowić zadanie zakończone błędem. Zakres obejmuje również podłączenie osobnego serwera rozpoznawania.

Warsztat korekty pokazuje tekst obok obrazu. Zachowywany jest wynik surowy oraz wersja poprawiona, a historia pozwala prześledzić zmiany. Korekty mogą trafić do zatwierdzenia przez drugą osobę. Jakość rozpoznania zależy także od czytelności skanu, układu strony i pisma.

  • Status stron i ponawianie zadań.
  • Korekta tekstu z porównaniem do obrazu.
  • Wersje poprawek i ponowne rozpoznanie wybranego zakresu.

Udostępnij efekt w czytniku i wyszukiwarce

Indeks korzysta z tekstu po korekcie. Wynik wyszukiwania może wskazać stronę i fragment, a współrzędne rozpoznanych słów pomagają podświetlić trafienie na obrazie. Czytelnik nie musi przeglądać całego rocznika, aby znaleźć interesujące hasło.

Widok tekstowy wspiera korzystanie z materiału przy użyciu czytnika ekranu. Sama obecność OCR nie rozstrzyga dostępności całego dokumentu: znaczenie mają również struktura i przygotowanie treści. Publikacja zachowuje ustalone prawa dostępu.

Przykład: wyszukiwanie nazwiska w dawnym czasopiśmie

Po rozpoznaniu tekstu czytelnik może wyszukać nazwisko w roczniku zamiast przeglądać każdą stronę. Nietypowy krój pisma albo słaby skan może jednak zniekształcić wynik. Warsztat korekty pozwala porównać zapis z obrazem i poprawić fragment wykorzystywany przez wyszukiwarkę.

Do ustalenia pozostają języki, jakość materiałów, kolejność opracowania i sposób zatwierdzania korekt. Warto rozpocząć od reprezentatywnej próbki. Pomaga to zaplanować pracę zespołu bez zakładania, że sam automatyczny przebieg zapewni poprawny tekst każdej publikacji.

Krok po kroku

Od pliku do przeszukiwalnej publikacji

  1. Przyjmij i opisz materiał

    Sprawdź kompletność pliku, kolejność stron i informacje o publikacji.

  2. Rozpoznaj i popraw tekst

    Wybierz język, przejrzyj wynik oraz wyjaśnij strony wymagające korekty.

  3. Sprawdź wyszukiwanie

    Odszukaj przykładową frazę i zweryfikuj stronę oraz fragment w czytniku.

Pytania i odpowiedzi

Warto wiedzieć

Czy oferta obejmuje fizyczne skanowanie zbiorów?

Ta strona opisuje oprogramowanie do przyjęcia i opracowania przygotowanych plików. Nie jest ofertą fizycznej usługi skanowania książek lub dokumentów.

Czy OCR rozpozna każdy skan bez błędów?

Nie należy tego zakładać. Jakość źródła i układ dokumentu wpływają na wynik. Dlatego zakres obejmuje podgląd, ręczną korektę oraz historię zmian.

Czy można ponowić OCR tylko dla wybranych stron?

Tak. Zadania można uruchamiać dla wskazanej strony, obiektu lub większego zakresu, np. po zmianie języka albo ustawień silnika.

Porozmawiajmy o Twojej bibliotece

Pokaż nam potrzeby.
My pokażemy możliwości.

Przejdziemy przez scenariusze ważne dla Twojej placówki i ustalimy zakres dalszej rozmowy.

Omówmy opracowanie Twoich materiałów