Inżynieria stojąca za kompresją PDF w przeglądarce
Tradycyjne kompresory online przesyłają wielomegabajtowe dokumenty PDF do zdalnych farm serwerów w chmurze, wprowadzają opóźnienia w kolejkowaniu i często polegają na stratnych skryptach serwerowych, takich jak Ghostscript, które rastrują tekst wektorowy na rozmyte, spikselowane bitmapy. Ten starszy przepływ pracy stwarza poważne ryzyko naruszenia prywatności w przypadku poufnych raportów finansowych, umów i dokumentacji medycznej.
Nasz dwuprzebiegowy silnik kompresji działa w całości w odizolowanym środowisku wykonawczym WebAssembly Twojej przeglądarki. W pierwszym przebiegu silnik sprawdza tabelę odwołań krzyżowych (xref) pliku PDF, usuwa niezreferowane martwe wersje, usuwa nieistotne tabele podpowiedzi TrueType (takie jak hdmx, VDMX, LTSH i PCLT) oraz deflatuje surowe strumienie obiektów (/ObjStm) bez dotykania wektorów glifów tekstowych.
Gdy wymagana jest głębsza redukcja, drugi przebieg ocenia osadzone obrazy rastrowe. Korzystając z kwantyzacji dyskretnej transformaty kosinusowej (DCT) klasy MozJPEG, osadzone fotografie są poddawane próbkowaniu do skalibrowanych wartości docelowych DPI (od 96 do 150 DPI) i ponownie osadzane w dokładnych granicach fizycznej strony. Ponieważ wszystkie obliczenia są wykonywane w pamięci RAM Twojego urządzenia za pomocą wątków Web Workers, Twoje dokumenty pozostają w 100% prywatne przy prędkościach wykonywania poniżej sekundy.

