Jak działa Porównanie PDF
Przeglądarka wyodrębnia zaznaczalny tekst strona po stronie i porównuje go wierszami. Zeskanowane strony wymagają OCR i są zgłaszane jako pozbawione tekstu do wyodrębnienia.
Porównanie jest deterministyczne: te same pliki i ustawienia dają tę samą klasyfikację. Zawartość plików pozostaje w bieżącej sesji przeglądarki.