guideDecember 4, 202512 min read

Polices PDF : intégration, sous-ensemble et substitution

La gestion des polices détermine si votre PDF a la bonne apparence partout ou se casse sur différents systèmes. Découvrez comment fonctionnent les polices PDF, pourquoi l'intégration compte, et comment éviter les problèmes liés aux polices.

#fonts#embedding#typography#technical

Un PDF créé sur votre ordinateur pourrait s'afficher complètement différemment sur le système de quelqu'un d'autre. Le texte se décale. Les caractères deviennent illisibles. La typographie soigneusement choisie se dégrade en substituts génériques. Le coupable est presque toujours la gestion des polices — comment le document spécifie les polices, s'il inclut les données de police nécessaires, et ce qui se passe quand les polices attendues ne sont pas disponibles.

La gestion des polices est la source la plus courante de problèmes d'affichage PDF. Comprendre comment fonctionnent les polices PDF vous aide à créer des documents qui s'affichent correctement partout et à diagnostiquer les problèmes quand les documents d'autres personnes ne se rendent pas comme prévu.

Comment le PDF représente le texte

Le PDF ne stocke pas le texte comme une simple séquence de caractères. Au lieu de cela, il stocke des descriptions de glyphes — des références à des formes spécifiques dans les programmes de police — avec des informations de positionnement précises. La distinction compte : les fichiers texte réguliers contiennent des codes de caractères que les renderers convertissent en formes visuelles en utilisant les polices disponibles. Les PDF contiennent des références à des formes visuelles spécifiques qui nécessitent la police exacte pour un rendu correct.

Un flux de contenu pourrait spécifier : utiliser la police /F1 à 12 points, positionner aux coordonnées (72, 720), afficher les glyphes avec les indices 43, 65, 72, 72, 79. Le renderer doit avoir accès aux définitions de glyphes de /F1 pour savoir quelles formes représentent les indices 43, 65, 72, 72, 79. Sans ces définitions, le renderer ne peut que deviner.

Cette approche basée sur les glyphes permet le contrôle précis de l'apparence du PDF. Contrairement aux traitements de texte qui font couler le texte dynamiquement, le PDF spécifie des positions de glyphes exactes. Les sauts de ligne, l'espacement des lettres, l'espacement des mots — tout est explicitement encodé. La police fournit les formes ; le flux de contenu fournit les positions.

Les trois stratégies de gestion des polices

Les documents PDF gèrent les polices de trois manières fondamentalement différentes, chacune avec des compromis distincts.

Les polices référencées supposent que le lecteur a accès à des polices spécifiques par nom. Le document dit « utiliser Helvetica » sans inclure les définitions de glyphes d'Helvetica. Si le lecteur a Helvetica, le rendu réussit. Sinon, le lecteur doit substituer autre chose. Cette approche produit de petits fichiers mais un affichage peu fiable.

Les polices intégrées incluent des programmes de police complets dans le document. Tout ce qui est nécessaire pour rendre la police voyage avec le PDF. La taille des fichiers augmente, mais l'affichage est cohérent quelle que soit les polices que le lecteur a installées. C'est l'approche recommandée pour des documents fiables.

Les polices en sous-ensemble n'intègrent que les glyphes réellement utilisés dans le document. Si votre document n'utilise que des lettres majuscules et des chiffres d'une police, le sous-ensemble n'inclut que ces caractères, pas les milliers de glyphes inutilisés dans la police complète. Cela équilibre la taille du fichier et la fiabilité du rendu.

Intégration des polices : les détails

Intégrer une police signifie inclure ses contours de glyphes (ou instructions de rendu équivalentes) dans le PDF. Différentes technologies de police s'intègrent différemment.

Les polices Type 1, le format de contour original d'Adobe, s'intègrent comme des programmes PostScript décrivant les formes de glyphes. Chaque glyphe est une série de commandes de dessin — déplacer vers, ligne vers, courbe vers — qui produisent la forme du caractère. L'intégration Type 1 est bien comprise et fiable mais limitée à 256 glyphes par police, nécessitant plusieurs sous-ensembles de police pour les grands jeux de caractères.

Les polices TrueType s'intègrent comme des programmes TrueType avec des courbes de Bézier quadratiques décrivant les glyphes. La police intégrée est essentiellement un fichier TrueType complet dans le PDF. TrueType supporte les grands jeux de caractères et inclut des instructions de hinting pour l'optimisation du rendu à l'écran.

Les polices OpenType peuvent utiliser soit des contours PostScript (CFF) soit TrueType. L'intégration OpenType dans le PDF extrait typiquement les données de contour tout en écartant les fonctionnalités de mise en page spécifiques à OpenType. La police intégrée rend les glyphes correctement mais peut ne pas préserver les fonctionnalités typographiques avancées comme les alternatives contextuelles ou les sets stylistiques à moins que l'application créatrice n'ait explicitement encodé leurs effets.

Les polices CID gèrent les grands jeux de caractères comme le chinois, le japonais et le coréen. Plutôt que les limites de 256 glyphes, les polices CID peuvent contenir des dizaines de milliers de glyphes accessibles par numéros d'ID de caractère. Intégrer ces polices peut augmenter substantiellement la taille des fichiers.

Sous-ensemble : équilibrer taille et exhaustivité

Le sous-ensemble de police réduit la taille de la police intégrée en n'incluant que les glyphes que le document utilise réellement. Un document utilisant seulement les caractères « Hello World » d'une police pourrait n'intégrer que ces 8 formes de glyphes uniques plutôt qu'une police entière.

Le sous-ensemble réduit dramatiquement la taille des fichiers pour les documents utilisant peu de caractères de grandes polices. Une police de titre décorative utilisée pour un seul mot pourrait contribuer 50 Ko en sous-ensemble versus 2 Mo en complet. Pour les documents distribués largement, cette différence compte.

Cependant, le sous-ensemble a des limitations. Une police en sous-ensemble ne peut pas être utilisée pour ajouter du texte qui n'est pas dans le document original — les glyphes n'existent pas. Si quelqu'un essaie d'ajouter des commentaires en utilisant les polices du document, les caractères qu'il tape peuvent ne pas se rendre. Pour les documents destinés à une édition ultérieure, l'intégration complète peut être préférable.

Le sous-ensemble affecte également l'identification des polices. Les polices en sous-ensemble reçoivent typiquement des noms modifiés (comme « ABCDEF+Helvetica ») pour les distinguer des polices complètes et prévenir une réutilisation inappropriée. Ces noms modifiés peuvent compliquer la gestion et l'identification des polices.

Les quatorze polices standard

Le PDF définit quatorze polices standard que les lecteurs devraient avoir disponibles : quatre variantes chacune de Times, Helvetica et Courier (régulier, gras, italique, gras-italique), plus Symbol et Zapf Dingbats. Les documents n'utilisant que ces polices peuvent les référencer sans intégration, en supposant que tous les lecteurs ont des versions compatibles.

En pratique, « compatible » est problématique. Différentes implémentations des polices standard ont des métriques différentes — les largeurs de caractères, l'espacement et le positionnement varient. Un document formaté avec une implémentation d'Helvetica peut enrouler les lignes différemment avec une autre. L'apparence visuelle peut être similaire, mais les mises en page précises peuvent se décaler.

Pour les documents critiques, même les polices standard devraient être intégrées. Le coût en taille de fichier est modeste, et la garantie d'une reproduction exacte est précieuse. Nos outils intègrent les polices lors de la conversion ou du traitement des documents pour assurer un rendu fiable.

Substitution de police : quand les choses tournent mal

Quand un document référence des polices qui ne sont pas intégrées et que le lecteur ne les a pas, la substitution de police se produit. Le lecteur sélectionne des polices de substitution basées sur diverses stratégies, qui toutes compromettent l'apparence.

La substitution basée sur le nom cherche des polices avec des noms similaires. « Helvetica » pourrait être substituée par « Arial » ou « Liberation Sans ». Les substituts ont des métriques différentes, causant le décalage du texte, le débordement ou le manque dans ses limites prévues.

La substitution basée sur la classification considère les caractéristiques des polices : serif versus sans-serif, proportionnelle versus monospace, graisse et style. Une police serif manquante se substitue avec une police serif disponible. Le résultat peut être lisible mais diffère visiblement de l'apparence prévue.

La substitution de secours générique utilise une police par défaut quand rien de mieux ne correspond. Certains systèmes utilisent un seul secours pour toutes les polices manquantes, produisant des résultats dramatiquement faux quand des polices décoratives ou spécialisées sont remplacées par des alternatives génériques.

La gestion des glyphes manquants varie quand des caractères spécifiques ne sont pas disponibles dans les polices de substitution. Certains renderers montrent des espaces vides. D'autres montrent des boîtes de substitution ou des points d'interrogation. Les documents utilisant des jeux de caractères étendus — symboles mathématiques, emoji, écritures non latines — sont particulièrement vulnérables aux problèmes de disponibilité de glyphes.

Problèmes liés aux polices et solutions

Le texte manquant indique généralement des problèmes de police. Si le texte existe dans la structure du document mais ne s'affiche pas, la police peut être manquante, corrompue ou incompatible avec le renderer. Intégrer les polices lors de la création des documents prévient ce problème.

Les mauvais caractères apparaissent quand l'encodage de police ne correspond pas aux suppositions. Un document pourrait spécifier le code de caractère 65 en attendant le glyphe « A », mais une police encodée de manière incompatible pourrait rendre autre chose à la position 65. Les problèmes d'encodage sont particulièrement courants avec les documents anciens et les polices symboliques.

Les mises en page décalées résultent des décalages de métriques entre les polices prévues et substituées. Le texte qui devrait tenir sur une ligne s'enroule sur deux. Les colonnes ne s'alignent pas. Les tableaux débordent des cellules. Même quand le texte est lisible, le formatage soigneux du document est détruit.

La mauvaise qualité d'impression découle parfois de problèmes de police. Les polices optimisées pour l'affichage à l'écran peuvent mal s'imprimer. Les polices sans hinting se rendent grossièrement à basses résolutions. Notre outil d'optimisation pour l'impression traite les problèmes de qualité d'impression liés aux polices.

Créer des documents sûrs pour les polices

Intégrez les polices de manière cohérente. La plupart des outils de création PDF offrent des options d'intégration — activez-les. L'augmentation de la taille du fichier vaut la peine pour un rendu fiable.

Utilisez les polices standard avec parcimonie et consciemment. Elles sont appropriées quand l'apparence exacte n'a pas d'importance et que la taille du fichier est critique. Pour tout le reste, intégrez.

Envisagez le sous-ensemble pour les documents distribués. Quand les documents vont à des destinataires inconnus qui ne les éditeront pas, le sous-ensemble fournit des fichiers compacts avec une capacité de rendu complète.

Testez sur des systèmes autres que celui où vous avez créé les documents. Un document qui a l'air parfait sur votre système peut échouer sur d'autres si les polices ne sont pas correctement intégrées. Tester révèle les problèmes pendant qu'ils sont corrigeables.

Notre outil d'aplatissement PDF convertit le texte en contours quand la portabilité des polices est absolument critique. Le texte aplati ne dépend plus du tout des polices — ce ne sont que des formes. Cela élimine entièrement les problèmes de police mais sacrifie la recherchabilité et l'éditabilité.

Vérifier le statut d'intégration des polices

Les propriétés du document montrent typiquement quelles polices un PDF utilise et si elles sont intégrées, en sous-ensemble ou référencées. Vérifiez ces informations lors du dépannage des problèmes d'affichage.

Les polices entièrement intégrées montrent un statut d'intégration complet. Ces polices se rendront correctement quelle que soit les polices installées du lecteur.

Les polices en sous-ensemble montrent un statut de sous-ensemble avec des noms modifiés. Elles se rendront correctement pour le contenu existant du document mais ne peuvent pas supporter du texte supplémentaire utilisant des caractères non inclus dans le sous-ensemble.

Les polices référencées ne montrent aucun statut d'intégration. Ces polices dépendent du fait que le lecteur ait des polices compatibles installées. Les documents avec des polices référencées devraient être testés sur des systèmes sans ces polices pour vérifier un comportement de substitution acceptable.

Unicode et gestion moderne des polices

La gestion moderne des polices PDF repose de plus en plus sur les mappages Unicode — les connexions entre les glyphes de police et les codes de caractères Unicode standard. Ces mappages permettent l'extraction de texte, la recherche et les fonctionnalités d'accessibilité.

Un PDF correctement construit inclut des mappages ToUnicode qui spécifient quels caractères Unicode chaque glyphe représente. Sans ces mappages, l'indice de glyphe 65 pourrait se rendre correctement mais le copier-coller en tant que mauvais caractère, ou la recherche pourrait échouer à trouver du texte qui est visiblement présent.

Notre outil OCR ajoute des couches de texte avec des mappages Unicode appropriés aux documents numérisés, les rendant recherchables tout en préservant l'apparence visuelle.

Les standards d'archivage PDF/A exigent une intégration de police et un mappage Unicode spécifiques. Les documents sans gestion appropriée des polices échouent à la validation PDF/A. Notre convertisseur PDF/A garantit que les polices répondent aux exigences d'archivage.

Considérations de licence des polices

L'intégration des polices soulève des questions de licence. Certaines licences de police interdisent ou restreignent l'intégration. D'autres exigent des modes d'intégration spécifiques — permettant les polices intégrées pour la visualisation mais pas l'édition.

Le PDF supporte les restrictions d'intégration par des drapeaux que les lecteurs conformes devraient respecter. Une police marquée comme « pas d'intégration » ne devrait pas être intégrée du tout. Une police marquée comme « aperçu et impression » devrait s'intégrer de manières qui empêchent l'extraction pour d'autres usages.

En pratique, l'application est imparfaite, et les restrictions d'intégration créent des problèmes pratiques pour l'échange de documents. Lors du choix des polices pour les documents que vous distribuerez, considérez les permissions d'intégration aux côtés des préférences esthétiques. Les polices explicitement licenciées pour l'intégration évitent l'ambiguïté légale.

De nombreuses polices open source de haute qualité ont des licences permissives permettant une intégration sans restriction. Utiliser ces polices simplifie la distribution de documents tout en fournissant une qualité typographique comparable aux alternatives commerciales.

Comprendre la gestion des polices PDF transforme les échecs de rendu mystérieux en problèmes diagnostiquables et corrigeables. Plus important encore, cela vous permet de créer des documents qui fonctionnent de manière fiable à travers les divers systèmes qui les rendront finalement. Intégrez vos polices, testez sur plusieurs systèmes, et vos documents soigneusement conçus apparaîtront comme prévu où qu'ils aillent.

PDF Pony Team

Équipe PDF Pony

Articles connexes

troubleshooting

Pourquoi votre PDF s'imprime incorrectement (et comment le corriger)

Les problèmes d'impression PDF sont frustrants mais généralement résolubles. Découvrez pourquoi votre PDF a mauvaise apparence quand il est imprimé et découvrez des solutions pratiques pour les polices manquantes, les décalages de couleur, les marges coupées et les pages blanches.

guide

Comprendre la compression PDF : comment ça marche et quand l'utiliser

Un plongeon en profondeur dans le fonctionnement de la compression PDF, les différentes méthodes de compression et comment choisir les bons paramètres pour vos documents.

guide

Stratégies d'annotation PDF pour la recherche

La recherche académique croule sous les PDF. Découvrez des stratégies d'annotation systématiques qui transforment la lecture passive en engagement actif, rendant les revues de littérature gérables et les insights récupérables.