So funktioniert PDF vergleichen
Der Browser extrahiert auswählbaren Text seitenweise und führt einen Zeilenvergleich durch. Gescannte Bildseiten benötigen OCR und werden als Seiten ohne extrahierbaren Text gemeldet.
Der Vergleich ist deterministisch: Dieselben Dateien und Einstellungen führen zur selben Klassifizierung. Die Dateiinhalte bleiben in der aktuellen Browser-Sitzung.