L'ingénierie derrière la compression PDF dans le navigateur
Les compresseurs en ligne traditionnels téléchargent des documents PDF de plusieurs mégaoctets vers des fermes de serveurs cloud distantes, introduisent une latence de mise en file d'attente et s'appuient souvent sur des scripts de serveur avec perte tels que Ghostscript qui convertissent le texte vectoriel en images bitmap pixellisées et floues. Ce flux de travail hérité crée de graves risques pour la confidentialité des rapports financiers confidentiels, des contrats et des dossiers médicaux.
Notre moteur de compression à double passe fonctionne entièrement dans l'environnement d'exécution WebAssembly isolé de votre navigateur. Lors de la passe 1, le moteur inspecte la table de référence croisée (xref) du PDF, élimine les révisions obsolètes non référencées, supprime les tables de sous-indication TrueType non essentielles (telles que hdmx, VDMX, LTSH et PCLT) et dégonfle les flux d'objets bruts (/ObjStm) sans toucher aux vecteurs de glyphes de texte.
Lorsqu'une réduction plus importante est requise, la passe 2 évalue les images matricielles intégrées. À l'aide d'une quantification par transformée en cosinus discrète (DCT) de niveau MozJPEG, les photographies intégrées sont rééchantillonnées vers des cibles DPI étalonnées (96 à 150 DPI) et réinsérées dans les limites physiques exactes de la page. Étant donné que tous les calculs s'exécutent dans la RAM de votre appareil via des Web Workers, vos documents restent 100 % confidentiels avec des vitesses d'exécution inférieures à la seconde.

