La ingeniería detrás de la compresión de PDF en el navegador
Los compresores en línea tradicionales suben documentos PDF de varios megabytes a granjas de servidores remotos en la nube, introducen latencia de cola y a menudo dependen de scripts de servidor con pérdidas como Ghostscript, que rasterizan el texto vectorial en mapas de bits borrosos y pixelados. Este flujo de trabajo heredado crea graves riesgos de privacidad para informes financieros confidenciales, contratos y historiales médicos.
Nuestro motor de compresión de doble pasada opera íntegramente dentro del entorno de ejecución de WebAssembly aislado de tu navegador. En la pasada 1, el motor inspecciona la tabla de referencia cruzada (xref) del PDF, elimina las revisiones obsoletas sin referenciar, retira las tablas de hinting de TrueType no esenciales (como hdmx, VDMX, LTSH y PCLT) y comprime los flujos de objetos sin procesar (/ObjStm) sin tocar los vectores de los glifos de texto.
Cuando se requiere una reducción más profunda, la pasada 2 evalúa las imágenes ráster incrustadas. Mediante la cuantización de la transformada discreta del coseno (DCT) de calidad MozJPEG, las fotografías incrustadas se redimensionan a objetivos de DPI calibrados (de 96 a 150 DPI) y se vuelven a incrustar en los límites exactos de la página física. Dado que todos los cálculos se ejecutan en la RAM de tu dispositivo mediante Web Workers, tus documentos se mantienen 100% privados con velocidades de ejecución inferiores a un segundo.

