Inženjering iza PDF kompresije u pretraživaču
Tradicionalni mrežni kompresori otpremaju PDF dokumente od više megabajta na udaljene farme serverskih oblaka, uvode kašnjenje u redu čekanja i često se oslanjaju na serverske skripte sa gubicima kao što je Ghostscript koje rasterizuju vektorski tekst u zamućene, pikselizovane bitmape. Ovaj stariji radni tok stvara ozbiljne rizike po privatnost za povjerljive finansijske izvještaje, ugovore i medicinske kartone.
Naš mehanizam za kompresiju sa dvostrukim prolazom radi u potpunosti unutar izolovanog WebAssembly okruženja vašeg pretraživača. U prolazu 1, mehanizam pregleda tabelu unakrsnih referenci (xref) PDF-a, uklanja nereferencirane mrtve revizije, uklanja nebitne TrueType tabele nagovještaja (kao što su hdmx, VDMX, LTSH i PCLT) i ispušta sirove tokove objekata (/ObjStm) bez dodirivanja vektora glifova teksta.
Kada je potrebno dublje smanjenje, prolaz 2 procjenjuje ugrađene rasterske slike. Koristeći kvantizaciju diskretne kosinusne transformacije (DCT) ranga MozJPEG, ugrađene fotografije se smanjuju na kalibrisane ciljne DPI vrijednosti (96 do 150 DPI) i ponovo ugrađuju u tačne granice fizičke stranice. Pošto se sva izračunavanja odvijaju u RAM-u vašeg uređaja preko Web Worker-a, vaši dokumenti ostaju 100% privatni uz brzine izvršavanja manje od jedne sekunde.

