Aller au contenu
PDFlora

Comment fonctionne la compression d'un PDF, sans jargon

Mis à jour le 23 septembre 2026

Un PDF est un conteneur qui renferme du texte, des polices, des images, des dessins vectoriels et une table indiquant où se trouve chaque élément. La compression agit différemment sur chacun ; savoir ce qui peut rétrécir sans risque explique pourquoi un fichier perd 80 % de son poids et un autre presque rien.

De quoi est fait un PDF

Le fichier contient des objets : descriptions de pages, instructions de texte, données de polices, images et tracés vectoriels, plus une table de références croisées qui indique au lecteur où commence chaque objet. La plupart de ces objets sont stockés sous forme de flux, des blocs de données qui peuvent être compressés.

Le poids n'est pas réparti de façon égale. Dans un document courant, les images en constituent l'essentiel, les polices viennent en second, et les instructions de texte et de dessin sont légères. Ce déséquilibre détermine où la compression peut avoir un effet.

Compression sans perte et avec perte

Les méthodes sans perte réduisent les données d'une manière parfaitement réversible. La plus courante dans un PDF est Flate, de la même famille d'algorithmes que ZIP, utilisée pour les instructions de texte, la structure et de nombreuses images. Rien n'est perdu, mais le gain est limité quand les données sont déjà compactes.

Les méthodes avec perte éliminent des détails jugés peu importants, sans retour possible. Dans un PDF, cela concerne presque toujours les images. Comme la perte est définitive, c'est là que qualité et poids s'arbitrent, et c'est pourquoi recompresser un fichier déjà compressé tend à aggraver le résultat.

Les images : résolution et qualité JPEG

Deux réglages dominent le poids d'une image. Le premier est la résolution, le nombre de pixels par pouce de la page imprimée. Des photos à 300 DPI conviennent à une impression de qualité, tandis que 150 DPI est en général confortable à l'écran et pour l'impression de bureau. Le rééchantillonnage réduit le nombre de pixels, et comme celui-ci croît avec le carré de la résolution, diviser les DPI par deux réduit les pixels bruts au quart.

Le second est la qualité JPEG. Le JPEG découpe l'image en petits blocs et en stocke des versions simplifiées. Une qualité plus basse simplifie davantage : le fichier est plus petit et, à terme, des artefacts en blocs apparaissent autour des contours et dans les dégradés. Ré-encoder un JPEG déjà enregistré en basse qualité ajoute une deuxième perte à la première.

C'est ce que fait Compresser PDF aux images JPEG intégrées : il les ré-encode à une résolution et une qualité plus basses, selon le préréglage. Le texte et les éléments vectoriels ne sont pas ré-encodés et restent nets.

Les polices

Les PDF intègrent les polices qu'ils utilisent pour que le document s'affiche partout de la même façon. Beaucoup de générateurs n'intègrent que les caractères réellement employés, ce qu'on appelle le sous-ensemble, et cela garde les données de police légères. Les fichiers assemblés à partir de plusieurs sources peuvent en revanche contenir plusieurs copies, voire des versions complètes, d'une même famille.

Les polices sont plus délicates que les images. Retirer des glyphes dont le texte a encore besoin casse l'affichage : une compression prudente laisse donc surtout les polices en l'état et s'appuie sur la compression des flux plutôt que sur la suppression. C'est l'une des raisons pour lesquelles un PDF très textuel rétrécit parfois si peu.

La structure : flux d'objets et réécriture

Depuis PDF 1.5, de nombreux petits objets peuvent être regroupés dans un flux d'objets et compressés ensemble, et la table de références croisées elle-même peut être stockée de façon compacte. Les fichiers anciens ou mal produits peuvent disséminer des milliers de petits objets non compressés, ce qui gaspille une place qu'une réécriture récupère.

Les fichiers modifiés puis enregistrés de façon incrémentale peuvent aussi conserver d'anciennes versions d'objets devenus inutiles. La réécriture n'écrit que ce dont le document a encore besoin. Ce nettoyage de structure est sans perte, ce qui explique qu'il aide un peu même quand il n'y a aucune image à réduire.

Pourquoi certains fichiers rétrécissent à peine

Un document essentiellement composé de texte et de vectoriel était déjà léger, et son contenu est déjà stocké efficacement. Des images exportées à résolution et qualité modestes laissent peu de marge. Dans ces cas, le résultat honnête est un gain de quelques pour cent, voire nul.

Compresser PDF le gère ouvertement : quand le résultat n'est pas plus petit que l'original, l'outil garde l'original et indique que le fichier était déjà bien optimisé. Son mode facultatif de conversion des pages en images peut réduire davantage certains scans très textuels, mais il remplace le texte par une image, ce qui rend le texte non sélectionnable ; il n'est proposé que comme choix explicite, avec un avertissement.

Compression et optimisation web : deux choses différentes

Optimiser PDF pour le web repose sur une autre idée. L'outil linéarise le fichier (on parle d'affichage web rapide) et compresse sa structure pour que la première page puisse s'afficher avant la fin du téléchargement. Il ne ré-encode pas les images : il améliore la rapidité d'ouverture en ligne, pas le poids des images.

Pour voir ce que contient votre propre fichier, ouvrez-le dans Informations PDF. L'outil liste le nombre de pages, le poids, les polices et le nombre d'images intégrées, ce qui indique lesquelles des notions ci-dessus s'appliqueront.

Questions fréquentes

La compression d'un PDF se fait-elle sans perte ou avec perte ?

Les deux, selon la partie concernée. La réécriture de la structure et la compression des flux de texte se font sans perte. La baisse de résolution et de qualité JPEG des images se fait avec perte : le détail retiré ne peut pas être restauré.

Pourquoi recompresser un PDF déjà compressé l'abîme-t-il ?

Chaque passage avec perte sur une image supprime du détail et ajoute des artefacts par-dessus les précédents, alors que le gain de taille diminue. Mieux vaut repartir de l'original et choisir une seule fois un préréglage plus fort.

Pourquoi un PDF composé uniquement de texte est-il difficile à alléger ?

Le texte et les instructions de dessin sont légers et déjà stockés de façon compacte, et les polices intégrées ne peuvent pas être retirées sans casser l'affichage. Sans grosses images, il reste peu à supprimer.

Quelle différence entre compresser et optimiser un PDF pour le web ?

Compresser réduit le poids du fichier, surtout en ré-encodant les images. Optimiser pour le web réorganise le fichier pour que la première page s'affiche vite pendant que le reste se télécharge, sans recompresser les images.

Outils cités dans ce guide

Autres guides