Verificación de accesibilidad de PDF

Selecciona un PDF y tu navegador lo abre localmente para inspeccionar de qué depende un lector de pantalla: el árbol de etiquetas, la capa de texto, las propiedades del documento. Cada carencia viene con el lugar donde corregirla.

Tu navegador abre el archivo en tu propio dispositivo. No se sube y nunca lo vemos, así que puedes comprobar documentos privados sin riesgo.

Un PDF es un dibujo con un esquema opcional

Una página web parte de la estructura. El HTML dice “esto es un encabezado, esto es una lista” y el navegador decide cómo dibujarlo. Un PDF funciona al revés. En el fondo es un conjunto de instrucciones de dibujo: coloca este glifo en estas coordenadas, pinta esta imagen ahí. Una impresora o un par de ojos no necesitan más. Pero nada de eso dice qué glifos forman un párrafo, qué columna va primero ni qué muestra una imagen.

Para eso, el formato tiene una segunda capa opcional llamada árbol de estructura, o simplemente etiquetas. Se parece mucho a HTML: H1, P, L para las listas, Table, Figure con texto alternativo. Cada etiqueta apunta al contenido dibujado que describe. Los lectores de pantalla, el modo de reflujo de los visores de móvil y las herramientas de texto a voz siguen las etiquetas. Cuando no las hay, recurren al orden de dibujo, y en un folleto de dos columnas eso suele significar saltar entre columnas, pies de foto y pies de página.

Qué se inspecciona en tu archivo

ComprobaciónSe informa de un problema cuando
ProtecciónEl cifrado prohíbe tanto copiar como extraer el texto para accesibilidad
EtiquetasNo hay árbol de estructura, hay un árbol con menos de tres elementos, o nombres de etiqueta fuera del conjunto estándar sin asignación de rol
Texto realLas páginas tienen menos de tres caracteres: las páginas con solo imágenes apuntan a un escaneo, las páginas hechas de muchos trazados vectoriales apuntan a texto convertido en contornos
Codificación del textoMás del 5 % de los caracteres extraídos son símbolos sin asignar, señal de fuentes sin tabla Unicode
TítuloEstá vacío, parece un nombre de archivo (“Report_v3.docx”), o existe pero no se le indica al visor que lo muestre
IdiomaNo se declara ningún idioma del documento
FigurasLas figuras etiquetadas no tienen texto alternativo, o su texto es un nombre de archivo o una palabra como “image”
Encabezados y tablasNo hay etiquetas de encabezado, no hay H1, hay niveles saltados; tablas sin celdas de encabezado TH; enlaces en los que se puede hacer clic que no están en las etiquetas
FormulariosCampos sin descripción emergente, que es el nombre que dice un lector de pantalla; formularios XFA
FuentesFuentes referenciadas pero no incrustadas

El texto y los campos de formulario se leen en las primeras 500 páginas, el árbol de estructura en las primeras 300 y las imágenes y las fuentes en las primeras 60.

Qué hallazgos tratar primero

Un hallazgo rojo detiene por completo a un lector. Un escaneo no tiene texto que decir, un archivo sin etiquetas no tiene orden, un archivo bloqueado puede negarse a entregar su texto al software de asistencia, y la falta de idioma hace que el motor de voz pronuncie cada palabra con las reglas equivocadas. Corrige eso antes que nada.

Los hallazgos ámbar empeoran la lectura sin bloquearla. Sin título, la ventana y el lector de pantalla anuncian un nombre de archivo. Unos encabezados sin H1, o con huecos, vuelven poco fiable la navegación por encabezados. Una tabla sin celdas de encabezado se lee como un chorro de números.

Si el resumen nombra el programa del que salió el archivo, empieza por ahí. Reparar el documento de origen y exportar de nuevo es casi siempre más rápido que reparar el PDF.

Corrígelo en el origen

Microsoft Word, PowerPoint
Usa los estilos de encabezado integrados y listas reales. Añade el texto alternativo desde el menú contextual de la imagen. Define el título en Archivo › Información. Ejecuta Revisar › Comprobar accesibilidad. Luego exporta con Archivo › Guardar como › PDF › Opciones y deja marcada la casilla “Etiquetas de estructura del documento para accesibilidad”. No uses nunca Imprimir › Guardar como PDF, que descarta las etiquetas.
Google Docs
Aplica estilos de encabezado y texto alternativo, y después Archivo › Descargar › Documento PDF. Revisa el resultado aquí, porque el título y el idioma suelen seguir faltando y hay que ponerlos con un editor de PDF.
LibreOffice Writer
Archivo › Exportar como PDF, y marca “Accesibilidad universal (PDF/UA)”, que también activa el etiquetado. Define el título en Archivo › Propiedades › Descripción.
Adobe InDesign
Asigna los estilos de párrafo a etiquetas de exportación, define el texto alternativo en Opciones de exportación de objeto, ordena el contenido en el panel Artículos y exporta con “Crear PDF etiquetado” y Mostrar título definido como Título del documento.
Canva
Añade texto alternativo a las imágenes y descarga como PDF estándar sin aplanar. Para cualquier cosa de más de una o dos páginas, cuenta con terminar la estructura en un editor de PDF.
Sin archivo de origen, o un escaneo
En Adobe Acrobat Pro: Escanear y OCR › Reconocer texto para los escaneos, luego Accesibilidad › Etiquetar PDF automáticamente, y después corrige a mano las etiquetas y el orden de lectura. El título, el ajuste de visualización y el idioma están en Archivo › Propiedades.

Lo que sigue siendo trabajo humano

La verificación confirma que las piezas están. No puede decirte si son buenas. Un texto alternativo que dice “chart” cuenta como presente. Unas etiquetas en el orden equivocado siguen siendo etiquetas, y una etiqueta de encabezado en una línea decorativa sigue siendo un encabezado. El contraste de color dentro de las páginas no se mide, y tampoco el orden lógico de tabulación de los campos de formulario.

Pasar esta prueba no es un certificado de conformidad con PDF/UA ni con WCAG. Para documentos con peso legal, ejecuta el verificador completo de Acrobat Pro o la herramienta gratuita PAC, y escucha después unas cuantas páginas con un lector de pantalla.

Preguntas frecuentes

¿Mi PDF se sube a un servidor?

No. Un script que se ejecuta en la pestaña de tu navegador abre el archivo y lo analiza en tu propio dispositivo. No se nos envía nada, así que puedes revisar documentos confidenciales sin riesgo. Para comprobarlo tú mismo, desconéctate de la red cuando la página ya haya cargado. La verificación sigue funcionando.

¿Cómo sé si un PDF está etiquetado?

Suéltalo aquí y lee la línea Tags. En Adobe Acrobat Reader también puedes abrir Archivo › Propiedades y buscar “PDF etiquetado: Sí” al final de la pestaña Descripción. Esa línea solo dice que existen etiquetas, no que sean correctas.

¿Por qué Imprimir como PDF produce un archivo inaccesible?

Imprimir solo envía instrucciones de dibujo al controlador de la impresora PDF, las mismas que recibiría una impresora de papel. Los encabezados, el texto alternativo, el idioma y los enlaces no forman parte de un trabajo de impresión, así que se pierden. Usa en su lugar el comando Exportar o Guardar como PDF del programa.

¿Se puede hacer accesible un PDF escaneado?

En parte. El reconocimiento óptico de caracteres (OCR) añade una capa de texto para que el contenido pueda leerse en voz alta y buscarse, y el etiquetado automático puede entonces deducir una estructura. El texto reconocido necesita revisión, y los encabezados, las tablas y el orden de lectura suelen tener que corregirse a mano.

¿Cuál es la diferencia entre PDF/UA y un PDF accesible?

PDF/UA (ISO 14289) es la norma técnica que detalla qué debe contener un PDF accesible: etiquetado completo, fuentes incrustadas, un título visible, un idioma, texto alternativo en las figuras. “PDF accesible” es el término cotidiano y, en la práctica, significa un archivo que cumple PDF/UA y los criterios de WCAG pertinentes.