Más allá del botón mágico: por qué la IA necesita criterio experto para alcanzar el estándar PDF/UA.
Llevo una temporada en la que a diario me pego (de manera figurada, no tendría nada que hacer en una pelea contra una ISO), con el estándar PDF/UA (ISO 14289). Para la gran mayoría un documento PDF es eso que guardamos en una carpeta que se llama «Para leer luego» o cualquiera de sus variantes y que nunca llegamos a usar, para otros es la forma en la que podemos crear un documento estático que enviamos para que nadie toque nada, pero, para un usuario de tecnologías de asistencia, un PDF sin etiquetas es un muro de hormigón digital.
Hacer documentos accesibles ha sido, históricamente, (y en muchas ocasiones sigue siendo), una tarea artesanal., pero con la Inteligencia Artificial (IA) prometiendo automatizarlo todo, estamos en un punto de inflexión. Pero, ¿Es oro todo lo que reluce? voy a intentar diseccionar lo que dice la técnica frente a la realidad del mercado, (y así presumo un poco de las cosas que voy aprendiendo en mi doctorado)
El árbol de etiquetas: El ADN que la IA intenta descifrar
Si necesitamos saber algo que es de primero de accesibilidad en documentos PDF, es esto, el núcleo del PDF/UA es la estructura semántica, sin etiquetas (tags), no hay accesibilidad. (y esto va para una cita)
El núcleo del PDF/UA es la estructura semántica, sin etiquetas (tags), no hay accesibilidad.
Hasta hace poco, si tenías un repositorio de 50.000 facturas o informes técnicos, tenías un problema de proporciones épicas, la remediación manual no escala, a menos que tengas un ejército de becarios con una paciencia infinita o cobres los PDF a precio de oro, que casi nadie puede permitirse.
Aquí es donde la Visión Artificial (Computer Vision) está haciendo magia. Ya no solo se trata de leer texto, sino de entender que «este bloque visual es un encabezado H1» o que «este conjunto de celdas es una tabla compleja y no una lista de la compra». La IA permite pasar de procesos costosos a flujos de trabajo escalables. Es un avance fantástico, sobre todo porque nos evita tener que explicarle a un cliente por décima vez que una tabla hecha a base de tabulaciones y espacios es un pecado capital en términos de accesibilidad. (un ejemplo de como funciona esto lo podéis ver en las últimas versiones de PAC y que os enseño en uno de mis vídeos de YouTube: ¿Tu PDF es accesible? Descúbrelo gratis con PAC
PDF/UA-2 y MathML: Las matemáticas dejan de ser jeroglíficos
Uno de los hitos que menciono a menudo en mis últimas conversaciones es la llegada del PDF/UA-2, durante décadas, insertar una fórmula matemática en un PDF era como recibir un mueble de IKEA sin instrucciones y con las piezas pegadas con pegamento de contacto, muy bonito para la foto, pero absolutamente imposible de entender cómo encaja cada parte o cómo se supone que debes usarlo.
Gracias al soporte de MathML, las ecuaciones ya no son «dibujos con un texto alternativo pobre», ahora son estructuras navegables. E incluso herramientas como TeX Live 2025 ya están permitiendo que la accesibilidad nazca desde el código fuente del documento. Es un salto de gigante para el sector educativo y científico, aunque sospecho que a algunos desarrolladores les va a costar soltar sus viejas costumbres de «exportar como imagen y rezar».
El peligro de las «Alucinaciones» en la auditoría
Aquí es donde entra mi toque de escepticismo profesional, y soy consciente de que hablo mucho de alucinaciones de IA, (hace unos días os hablaba del peligro de las alucinaciones de la IA), estamos viendo una oleada de herramientas que prometen «cumplimiento total» usando LLMs (Modelos de Lenguaje), pero ojo cuidao, la IA tiene una tendencia fascinante a la alucinación:
- Te puede decir que un documento es «100% conforme» basándose en métricas que se acaba de inventar.
- Puede generar textos alternativos para imágenes que son puramente decorativos, o peor, que no tienen nada que ver con el contexto real.
- Te puede asegurar que el orden de lectura es correcto simplemente porque el texto «fluye bien», ignorando la arquitectura interna del archivo.
Como siempre digo: la IA es una herramienta de eficiencia, no un juez de conformidad. El modelo «Human-in-the-Loop» (humanos supervisando el proceso) no es una opción, es una necesidad ética y técnica. (de momento los humanos molan más que la IA)
Lo que la IA hace hoy (mientras nosotros dormimos)
No hablo de ciencia ficción, las herramientas actuales ya han pasado de la simple lectura de caracteres (OCR) a una comprensión profunda de la arquitectura del documento. Gracias a modelos de Deep Learning, el software puede ahora distinguir entre un elemento decorativo y uno informativo con una precisión asombrosa.
Por ejemplo, insertar una fórmula matemática en un PDF antes de la llegada del PDF/UA-2 era el equivalente a tratar de entender una partitura musical mirando solo una foto de la orquesta: podías intuir que allí había una sinfonía, pero era absolutamente imposible descifrar las notas, el ritmo o la intención para poder interpretarla de forma funcional.
Gracias a modelos de Deep Learning, el software puede ahora distinguir entre un elemento decorativo y uno informativo con una precisión asombrosa.
Ahora, la IA actúa como el director de orquesta que pone orden al caos, es capaz de reconstruir el flujo lógico de lectura, incluso en esos diseños de varias columnas que antes hacían que los lectores de pantalla parecieran estar intentando descifrar un enigma encriptado.
Aquí tienes un resumen de las capacidades técnicas que ya se están implementando en los flujos de trabajo de consultoría para que la accesibilidad deje de ser una utopía:
| Capacidad de la IA | Impacto en Accesibilidad | Nivel de Automatización |
| Detección de Estructura | Identifica encabezados (H1-H6), listas y párrafos automáticamente. | Alto (70-80%) |
| Remediación de Tablas | Desglosa tablas complejas, vinculando celdas de datos con sus encabezados. | Medio (Requiere validación) |
| Generación de Alt-Text | Describe imágenes basándose en el contexto del documento, no solo en la foto. | Alto |
| Soporte MathML | Convierte ecuaciones visuales en estructuras semánticas navegables (PDF/UA-2). | En expansión |
| Verificación de Contraste | Ajusta automáticamente los niveles de color para cumplir con las WCAG. | Casi total pero aún no me fio |
Esta tabla no es solo para fardar de tecnología; es la hoja de ruta para cualquier empresa que quiera dejar de producir documentos «mudos», el uso de estas herramientas permite alcanzar niveles de cumplimiento que antes eran prohibitivos por coste y tiempo, permitiendo que la inclusión sea, por fin, escalable.
Hablando de herramientas
He seleccionado las más potentes del mercado actual, cada una con su «superpoder» específico para que sepas por dónde empezar a limpiar tu desorden documental:
| Herramienta | Su mejor virtud (El «Superpoder») | Función Principal |
| PDFix | La reina de la automatización lógica. Su IA es capaz de derivar estructuras complejas y convertir PDFs estáticos en HTML5 accesible casi sin despeinarse. | Remediación masiva y conversión de formatos. |
| Equidox | Velocidad de crucero. Destaca por su capacidad para identificar tablas y listas mediante aprendizaje automático, reduciendo el tiempo de etiquetado en un 75%. | Software de remediación basado en la nube. |
| CommonLook | Rigor militar. Es la herramienta de referencia para quienes no se la juegan; garantiza que el PDF cumple al 100% con los estándares ISO y las WCAG. | Auditoría y remediación de alta precisión. |
| Adobe Acrobat Pro | La vieja confiable (con esteroides). Su nueva función «Auto-Tag» potenciada por IA ha mejorado drásticamente la detección de la jerarquía de lectura. | Edición y etiquetado básico de documentos. |
| Abbyy FineReader | Ojo cuidao. Probablemente el mejor motor de OCR del mundo; convierte escaneos infames en texto limpio y etiquetado para que la IA pueda trabajar. | Reconocimiento óptico y digitalización estructural. |
Como ves, opciones hay de sobra, el problema no es la falta de tecnología, sino saber cuál encaja en tu flujo de trabajo sin que te cueste un ojo de la cara o te genere más errores de los que arregla.
Si estás dudando entre invertir en licencias o en formar a tu equipo para que domine estas herramientas, escríbeme. (analizo tu volumen de documentos y vemos qué es lo que realmente te va a ahorrar dinero y dolores de cabeza legales.)
Fuera de plazo: El Acta Europea de Accesibilidad ya es Ley (y no perdona)
Se acabó el tiempo de las prórrogas y las buenas intenciones. El 28 de junio de 2025 ya es historia, y con él, la «amnistía» para los documentos digitales inaccesibles. Si trabajas en banca, seguros o comercio electrónico, ya no estás avisado, estás en riesgo.
Publicar hoy un PDF que no sea PDF/UA es, literalmente, dejar una puerta abierta a sanciones administrativas y demandas colectivas. Lo irónico es que muchas empresas siguen confiando en que «nadie se dará cuenta» o en que «la IA lo arregla sola», mientras sus repositorios de documentos se convierten en un polvorín legal.
La accesibilidad ya no es un proyecto de Responsabilidad Social Corporativa para quedar bien en la memoria anual; es un requisito de mercado tan obligatorio como pagar impuestos, si tu estrategia sigue siendo «lo miraremos el trimestre que viene», llegas nueve meses tarde.
¿Hacia dónde vamos?
La IA es el motor que nos permite escalar, pero el criterio sigue siendo humano, en mi investigación actual, el enfoque es claro: IA para la eficiencia, humanos para la validación.
Si tu organización se ha dado cuenta tarde de que sus PDFs son un agujero negro de cumplimiento legal, puedo ayudarte de dos formas:
- Consultoría Estratégica y Auditoría: Analizamos tu situación actual (que a estas alturas suele ser urgente) y seleccionamos las herramientas de IA que realmente funcionan para limpiar tu histórico de documentos.
- Formación de Choque: Capacito a tus equipos para que dejen de generar contenido que incumple la ley. La mejor forma de no tener que arreglar PDFs es aprender a no romperlos desde el principio.
¿Vas a seguir cruzando los dedos para que no llegue la primera inspección, o prefieres que formemos a tu equipo y auditemos tus procesos antes de que el problema sea irreversible? Cuéntame tu caso; el tiempo corre, y esta vez de verdad.

