Vérification d’accessibilité PDF
Sélectionnez un PDF et votre navigateur l’ouvre localement pour inspecter ce dont dépend un lecteur d’écran : l’arbre des balises, la couche de texte, les propriétés du document. Chaque lacune vient avec l’endroit où la corriger.
Votre navigateur ouvre le fichier sur votre propre appareil. Il n’est pas envoyé et nous ne le voyons jamais : vous pouvez donc vérifier des documents privés sans risque.
Un PDF est un dessin avec un plan facultatif
Une page web part de la structure. Le HTML dit « ceci est un titre, ceci est une liste » et le navigateur décide comment le dessiner. Un PDF fonctionne à l’envers. À la base, c’est un ensemble d’instructions de dessin : placer ce glyphe à ces coordonnées, peindre cette image là. Une imprimante ou une paire d’yeux n’a besoin de rien de plus. Mais rien là-dedans ne dit quels glyphes forment un paragraphe, quelle colonne vient en premier ni ce que montre une image.
Pour cela, le format a une seconde couche facultative appelée arbre de structure, ou simplement balises. Elle ressemble beaucoup au HTML : H1, P, L pour les listes, Table, Figure avec un texte alternatif. Chaque balise pointe vers le contenu dessiné qu’elle décrit. Les lecteurs d’écran, le mode d’affichage adaptatif des visionneuses de téléphone et les outils de synthèse vocale suivent les balises. Quand il n’y en a pas, ils se rabattent sur l’ordre de dessin et dans une brochure à deux colonnes cela veut souvent dire des sauts entre colonnes, légendes et pieds de page.
Ce qui est inspecté dans votre fichier
| Vérification | Problème signalé quand |
|---|---|
| Protection | Le chiffrement interdit à la fois la copie et l’extraction de texte pour l’accessibilité |
| Balises | Aucun arbre de structure, un arbre de moins de trois éléments, ou des noms de balises hors du jeu standard sans correspondance de rôle |
| Vrai texte | Des pages contiennent moins de trois caractères : des pages d’images seules évoquent une numérisation, des pages faites de nombreux tracés vectoriels évoquent du texte converti en contours |
| Encodage du texte | Plus de 5 % des caractères extraits sont des symboles non associés, signe de polices sans table Unicode |
| Titre | Vide, ou ressemblant à un nom de fichier (« Rapport_v3.docx »), ou présent alors que la visionneuse n’a pas pour consigne de l’afficher |
| Langue | Aucune langue de document déclarée |
| Figures | Des figures balisées n’ont pas de texte alternatif, ou leur texte est un nom de fichier ou un mot comme « image » |
| Titres et tableaux | Aucune balise de titre, pas de H1, niveaux sautés ; tableaux sans cellules d’en-tête TH ; liens cliquables absents des balises |
| Formulaires | Champs sans infobulle, qui est le nom que prononce un lecteur d’écran ; formulaires XFA |
| Polices | Polices référencées mais non incorporées |
Le texte et les champs de formulaire sont lus sur les 500 premières pages, l’arbre de structure sur les 300 premières, les images et les polices sur les 60 premières.
Quels constats traiter en premier
Un constat rouge empêche complètement la lecture. Une numérisation n’a aucun texte à prononcer, un fichier sans balises n’a aucun ordre, un fichier verrouillé peut refuser de livrer son texte aux logiciels d’assistance et une langue absente fait prononcer chaque mot avec de mauvaises règles par le moteur vocal. Corrigez ceux-là avant tout le reste.
Les constats ambre dégradent la lecture sans la bloquer. Sans titre, la fenêtre et le lecteur d’écran annoncent un nom de fichier. Des titres sans H1, ou avec des trous, rendent la navigation par titres peu fiable. Un tableau sans cellules d’en-tête est lu comme un flot de nombres.
Si le résumé nomme le programme d’où vient le fichier, commencez par là. Réparer le document source puis l’exporter de nouveau est presque toujours plus rapide que réparer le PDF.
Corrigez à la source
- Microsoft Word, PowerPoint
- Utilisez les styles de titre intégrés et de vraies listes. Ajoutez le texte alternatif depuis le menu contextuel de l’image. Définissez le titre sous Fichier › Informations. Lancez Révision › Vérifier l’accessibilité. Exportez ensuite avec Fichier › Enregistrer sous › PDF › Options en gardant coché « Balises de structure du document pour l’accessibilité ». N’utilisez jamais Imprimer › Enregistrer en PDF, qui jette les balises.
- Google Docs
- Appliquez les styles de titre et le texte alternatif, puis Fichier › Télécharger › Document PDF. Vérifiez le résultat ici, car le titre et la langue manquent souvent encore et demandent un éditeur PDF.
- LibreOffice Writer
- Fichier › Exporter au format PDF, puis cochez « PDF universellement accessible (PDF/UA) », ce qui active aussi le balisage. Définissez le titre sous Fichier › Propriétés › Description.
- Adobe InDesign
- Associez les styles de paragraphe aux balises d’exportation, définissez le texte alternatif dans les options d’exportation de l’objet, ordonnez le contenu dans le panneau Articles et exportez avec « Créer un PDF balisé » et l’affichage du titre réglé sur le titre du document.
- Canva
- Ajoutez un texte alternatif aux images et téléchargez en PDF standard sans aplatir. Pour tout ce qui dépasse une page ou deux, comptez terminer la structure dans un éditeur PDF.
- Pas de fichier source, ou une numérisation
- Dans Adobe Acrobat Pro : Numériser et OCR › Reconnaître le texte pour les numérisations, puis Accessibilité › Baliser automatiquement le PDF, puis corrigez à la main les balises et l’ordre de lecture. Le titre, le réglage d’affichage et la langue se trouvent sous Fichier › Propriétés.
Ce qui reste un travail humain
La vérification confirme que les éléments sont là. Elle ne peut pas dire s’ils sont bons. Un texte alternatif qui dit « graphique » compte comme présent. Des balises dans le mauvais ordre restent des balises et une balise de titre sur une ligne décorative reste un titre. Le contraste des couleurs dans les pages n’est pas mesuré, ni l’ordre logique de tabulation des champs de formulaire.
Réussir ici n’est pas un certificat de conformité PDF/UA ou WCAG. Pour des documents qui ont un poids juridique, lancez le vérificateur complet d’Acrobat Pro ou l’outil gratuit PAC, puis écoutez quelques pages avec un lecteur d’écran.
Questions fréquentes
Mon PDF est-il envoyé à un serveur ?
Non. Un script qui s’exécute dans l’onglet de votre navigateur ouvre le fichier et l’analyse sur votre propre appareil. Rien à son sujet ne nous est envoyé : vous pouvez donc vérifier des documents confidentiels sans risque. Pour le constater, coupez le réseau après le chargement de la page. La vérification fonctionne toujours.
Comment savoir si un PDF est balisé ?
Déposez-le ici et lisez la ligne Balises. Dans Adobe Acrobat Reader, vous pouvez aussi ouvrir Fichier › Propriétés et chercher « PDF balisé : Oui » en bas de l’onglet Description. Cette ligne dit seulement que des balises existent, pas qu’elles sont correctes.
Pourquoi « Imprimer en PDF » produit-il un fichier inaccessible ?
L’impression n’envoie que des instructions de dessin au pilote d’imprimante PDF, les mêmes qu’une imprimante papier recevrait. Les titres, le texte alternatif, la langue et les liens ne font pas partie d’un travail d’impression, ils sont donc perdus. Utilisez plutôt la commande Exporter ou Enregistrer au format PDF du programme.
Puis-je rendre accessible un PDF numérisé ?
En partie. La reconnaissance optique de caractères (OCR) ajoute une couche de texte pour que le contenu puisse être lu à voix haute et recherché, puis le balisage automatique peut deviner une structure. Le texte reconnu demande une relecture et les titres, les tableaux et l’ordre de lecture doivent généralement être corrigés à la main.
Quelle différence entre PDF/UA et un PDF accessible ?
PDF/UA (ISO 14289) est la norme technique qui précise ce qu’un PDF accessible doit contenir : un balisage complet, des polices incorporées, un titre affiché, une langue, un texte alternatif sur les figures. « PDF accessible » est le terme courant et en pratique il désigne un fichier conforme à PDF/UA et aux critères WCAG pertinents.