Ce qu’un scan de site web révèle du fonds de PDF d’une ville moyenne : 19 points sur 100 en moyenne, une structure absente dans 92 documents – et comment transformer un tel constat en un ordre de traitement réaliste.
Exemple anonymisé tiré d’un traitement réel ; le nom de l’organisation et le titre du document ont été modifiés.
Lors du Pre-Check d’une ville moyenne, 100 documents PDF issus du site web ont obtenu en moyenne 19 points sur 100 ; 89 d’entre eux étaient critiques. Cela paraît dramatique, mais c’est un tableau typique – et en grande partie soluble automatiquement : 90 des 100 documents ont pu être améliorés automatiquement, et les documents sélectionnés ont atteint en moyenne 100 points après optimisation. Le vrai travail était ailleurs : décider par quoi commencer, et mettre effectivement les fichiers améliorés en ligne.
Situation de départ
Le point de départ était la question que se posent de nombreuses administrations : où en sont les PDF de notre site web ? C’est à cela que sert le Pre-Check : un portail, accessible via un lien personnel, qui présente et améliore le fonds de PDF d’un site web en cinq étapes.
- Scan du site web : un robot d’exploration suit les liens du site et recense chaque fichier PDF lié, avec la page sur laquelle il a été trouvé.
- Contrôle : chaque PDF est contrôlé et reçoit un score ainsi qu’un classement : critique, moyen ou bon.
- Sélection : l’administration voit les résultats, classés si elle le souhaite selon la structure du site, et choisit ce qui doit être amélioré.
- Optimisation : les documents sélectionnés sont traités automatiquement, avec l’IA uniquement si nécessaire. Les originaux restent inchangés.
- Reprise : les versions améliorées sont disponibles sous forme de fichier ZIP à télécharger pour les remplacer dans le système de gestion de contenu – ou, lorsqu’une connexion existe, directement par échange sur le site web.
Ce que le contrôle a révélé
Résultat global du Pre-Check| Indicateur | Valeur |
|---|
| Documents contrôlés | 100 PDF totalisant 1 951 pages |
|---|
| Score moyen | 19 sur 100 |
|---|
| Classement | 89 critiques, 3 moyens, 7 bons |
|---|
| Améliorables automatiquement | 90 documents |
|---|
Les constats les plus fréquents, comptés par document concerné :
Constats les plus fréquents du Pre-Check| Constat | Nombre | Ce que cela signifie pour les utilisateurs |
|---|
| Structure (balises) absente ou incomplète | 92 | Les titres, listes et tableaux ne sont pas reconnaissables par les lecteurs d’écran. |
|---|
| Titre du document absent | 89 | C’est le nom du fichier qui est affiché et lu. |
|---|
| Langue du document absente | 71 | Le lecteur d’écran doit deviner la prononciation. |
|---|
| Pas de signets | 40 | Les documents longs n’offrent pas de navigation. |
|---|
| Polices non incorporées | 26 | L’affichage et l’extraction du texte dépendent de l’ordinateur. |
|---|
| Pages numérisées sans texte | 16 | Pour les lecteurs d’écran, la page est vide. |
|---|
| Ordre de tabulation absent | 5 | Les liens et les champs sont atteints au clavier dans le mauvais ordre. |
|---|
| Images sans texte alternatif | 4 | Seul « graphique » est annoncé. |
|---|
| Titres non balisés | 4 | Pas de navigation par les titres. |
|---|
Important pour la lecture : les faibles nombres concernant les textes alternatifs et les titres ne signifient pas que tout était en ordre de ce côté. Là où la structure manque entièrement, il n’existe pas non plus de balises d’illustration ou de titre auxquelles un outil de contrôle pourrait rattacher ces erreurs. Ces problèmes n’apparaissent qu’une fois la structure construite.
Ce que DokAudit a fait automatiquement
Pour les documents sélectionnés, l’optimisation a appliqué les corrections sûres dont chaque document avait besoin : construire la structure, après reconnaissance de texte préalable pour les pages numérisées ; définir le titre et la langue ; générer les signets à partir des titres ; incorporer les polices ; aligner l’ordre de tabulation sur la structure ; reprendre les légendes comme textes alternatifs et générer des propositions pour les autres images. DokAudit a ensuite recontrôlé chaque document avec veraPDF et ses propres contrôles de la structure logique. Les documents sélectionnés ont ensuite atteint en moyenne 100 points.
Ce qu’un humain a encore dû faire
- Sélectionner et prioriser : d’abord les formulaires, demandes, règlements et barèmes de redevances en vigueur – ils sont nécessaires aux procédures administratives. Puis le bulletin officiel en cours (Amtsblatt) et les avis relatifs aux procédures en cours. Puis ce qui est le plus consulté selon les statistiques web. Les documents auxquels il ne manque que le titre et la langue sont des gains rapides.
- Prudence avec l’exception d’archive : de nombreux fichiers sont antérieurs au 23 septembre 2018. Ils ne sont exemptés que s’ils ne sont pas nécessaires à des procédures administratives en cours ; un ancien règlement toujours en vigueur n’en fait donc généralement pas partie. Déclarer en bloc l’ensemble du fonds ancien comme archive ne résiste à aucun contrôle. Comment bien distinguer : Garder durablement la maîtrise des PDF de votre site web.
- Vérifier les propositions : valider ou améliorer les propositions de textes alternatifs de l’IA, écouter par sondage l’ordre de lecture des documents à plusieurs colonnes.
- Remplacer : remplacer les fichiers améliorés si possible à la même adresse, afin que les liens et les résultats de recherche restent valables.
- Mettre à jour la déclaration : actualiser la déclaration d’accessibilité avec le nouvel état et les documents délibérément reportés.
Résultat
D’une moyenne de 19 points, on est passé à une moyenne de 100 pour les documents sélectionnés. Le Pre-Check a en outre fourni une base solide pour la planification : la ville sait quels fichiers existent, où ils sont liés, ce qui leur manque et ce qui peut être corrigé automatiquement.
Les enseignements à en tirer
- Une moyenne basse est normale. Elle résulte surtout de l’absence des fondamentaux – structure, titre, langue –, et ce sont précisément ceux-là qui peuvent être rattrapés automatiquement.
- L’absence de structure masque d’autres problèmes. Ce n’est qu’une fois la structure construite que les textes alternatifs et les titres arrivent vraiment sur la table.
- Prioriser d’abord, optimiser ensuite. L’importance pour les procédures et les consultations sont de meilleurs critères que l’âge d’un fichier.
- Le remplacement est l’étape la plus souvent laissée en suspens. Un fichier corrigé qui n’arrive pas sur le site web n’aide personne.
- Une fois ne suffit pas. De nouveaux PDF s’ajoutent chaque semaine. Sans surveillance continue, on se retrouve au point de départ un an plus tard – c’est à cela que sert Continuous Accessibility, le contrôle automatique régulier du site web.
Vous pouvez lancer le scan de site web gratuit pour votre propre site.
Sources:
État : 10/2026. Cet article donne une vue d’ensemble générale et ne constitue pas un conseil juridique. Font foi les textes de loi et de normes en vigueur ; dans certains cas, le droit d’un Land allemand peut différer.