Français

La compression PDF expliquée

La boîte à outils ToolAcre PDF ne compresse pas les fichiers PDF. Il s'agit d'une omission délibérée, et non d'une fonctionnalité manquante : la technique dont dispose un navigateur pixellise chaque page, ce qui détruit le texte sélectionnable et agrandit fréquemment un document texte au lieu de le réduire.

Presque toute la taille excédentaire d’un PDF est constituée d’images intégrées. Les réduire avant la création du PDF, ou reconstruire le document à partir d'une source plus petite, permet de réaliser de réelles économies sans endommager le fichier. Cette page explique comment trouver le poids et ce qui aide réellement.

Qu'est-ce qui rend un PDF volumineux

Un PDF est un conteneur. Son texte est stocké sous forme d'instructions et de sous-ensembles de polices intégrés et est remarquablement compact : une centaine de pages de prose font souvent moins d'un mégaoctet. Ses images sont stockées sous forme de flux codés et sont presque toujours là où se trouve la taille.

Le coupable habituel est un scan ou une photographie déposée en pleine résolution de l’appareil photo. Une photo de téléphone peut avoir une largeur de quatre mille pixels ; imprimé sur une page A4, il est affiché à une fraction de cela, et les pixels supplémentaires sont conservés pour toujours dans le fichier, sans rien faire.

Les polices intégrées comptent à la marge. Un document intégrant plusieurs familles de polices complètes plutôt que des sous-ensembles peut contenir quelques centaines de kilo-octets de polices. Agaçant, rarement décisif.

Les trois choses que « compresser PDF » peut signifier

La rastérisation est ce que font de nombreux « compresseurs PDF » basés sur un navigateur, car un navigateur peut déjà restituer une page sur un canevas et écrire des images dans un nouveau document. Il produit de manière fiable un fichier plus petit pour un document numérisé. Pour un document texte, cela détruit le calque de texte – pas de sélection, pas de recherche, pas d'accès par lecteur d'écran – et les images de page résultantes sont souvent plus grandes que les instructions vectorielles qu'elles ont remplacées.

Un outil qui échange silencieusement votre contrat consultable contre une pile de photos vous a pris quelque chose que vous n'aviez pas accepté de perdre. Plutôt que de l'expédier derrière un bouton convivial "Compresser", cette boîte à outils ne le propose pas et explique pourquoi.

  • Sous-échantillonnage d'images : réencodage des images intégrées avec une résolution ou une qualité inférieure. C’est de là que proviennent presque toutes les économies honnêtes, et cela entraîne des pertes pour les images mais est inoffensif pour le texte.
  • Compression de flux : application ou amélioration de la compression de dégonflage sur les flux de contenu. La plupart des écrivains le font déjà, donc les économies sont généralement faibles.
  • Rastérisation : rendre chaque page sous forme d'image et reconstruire le PDF à partir de ces images. C’est la technique facilement disponible dans un navigateur, et c’est la technique destructrice.

Que faire à la place

Déterminez où se trouve le poids avant de faire quoi que ce soit. Si le nombre de pages est élevé et que le fichier est petit par page, il n'y a rien à gagner. Si un document de dix pages est 40 MB, il contient des images, et ces images sont tout le problème.

Réduisez les images avant que le PDF n’existe. Si vous créez le document à partir de photographies ou de numérisations, redimensionnez-les et réencodez-les d'abord : un fichier JPEG de 1600 pixels de largeur en qualité 80 est suffisant pour une image pleine largeur sur une page A4 et ne représente qu'une petite fraction du fichier original de l'appareil photo. Assemblez ensuite le PDF à partir de ceux-ci.

Si le PDF existe déjà et que vous n'avez pas les sources, la réponse honnête est que vous avez besoin d'un outil capable de réécrire les flux d'images sur place : un éditeur PDF de bureau ou un outil de ligne de commande tel que Ghostscript ou qpdf. Cela ne correspond pas à ce qu'un navigateur peut faire sans pixellisation, c'est pourquoi ce site vous y indique plutôt que de le simuler.

Deux gains bon marché valent la peine d’être vérifiés en premier. Exportez à nouveau depuis l'application d'origine avec son préréglage « taille de fichier plus petite » ou « Web », qui sous-échantillonne généralement correctement les images. Et si le document est une numérisation que vous n'avez besoin que de lire, sa conversion une fois à une résolution raisonnable surpasse toute compression post-hoc.

Exemple concret : une "brochure" 46 MB qui devrait être 3 MB

Une brochure de six pages s'exporte à 46 MB. Six pages de mise en page ne peuvent pas expliquer cela, donc le poids est constitué d'images. Le fichier source contient six photographies en pleine résolution, chacune d'environ 4000 par 3000 pixels directement sorties d'un appareil photo.

Sur une page A4, une photographie à fond perdu mesure environ 8,3 pouces de large. À 150 dpi – suffisant pour tout ce qui n’est pas une impression d’art – cela représente environ 1250 pixels. Les photographies ont une résolution linéaire plus de trois fois supérieure à celle que la page peut afficher, soit environ dix fois le nombre de pixels.

  1. Redimensionnez chaque photo à 1500 pixels sur le bord long.
  2. Exportez chacun au format JPEG en qualité 80.
  3. Reconstruisez la brochure à partir des images redimensionnées.

Résultat : Six images d'environ 300-450 KB chacune au lieu de 6-9 MB chacune, et un PDF dans les mégaoctets à un chiffre. Le calque de texte est intact et toujours sélectionnable, car rien n'a été rastérisé.

Ouvrez l'outil

Réduisez les images avant de créer le PDF

L'Image Converter redimensionne et réencode les fichiers JPEG, PNG et WebP dans votre navigateur. Il n'ouvre pas les fichiers PDF.

Ce que cela ne couvre pas

  • Cette page explique le problème ; le ToolAcre PDF Toolkit n'a pas de fonction de compression et n'en gagnera pas en rastérisant.
  • ToolAcre Image Converter peut réduire les images que vous introduisez dans un PDF, mais il ne peut pas accéder à l'intérieur d'un PDF existant pour les remplacer.
  • Ghostscript et qpdf sont nommés ici comme des réponses précises, et non comme des produits de ce site. Personne ici ne les entretient et aucune relation n'existe.
  • Il n'y a aucune OCR dans cette boîte à outils, donc une page numérisée ne peut pas être reconvertie en texte consultable.