Alcance
Qué no mide
Ponerlo por delante, en su propia página y con el mismo detalle que las métricas, es parte del método. Un informe que no declara sus límites no es un informe, es publicidad.
- No estima con qué frecuencia se equivoca tu IA
- Mide el estado de los documentos, no el comportamiento del modelo. Cualquiera que te ofrezca una «tasa de error» de tu asistente a partir de una muestra de documentos te está dando un número que no ha medido.
- No hace OCR
- Detecta las páginas sin texto extraíble y te dice cuántas son y en qué tipo de fichero están. No las convierte. Convertirlas es un trabajo distinto, y bastante más caro.
- No arregla nada
- El informe diagnostica. Limpiar, deduplicar y estructurar el archivo es un trabajo aparte, y lo sensato es decidirlo con el diagnóstico ya en la mano.
- Las menciones de personas y organizaciones hay que revisarlas a mano
- Las propone un modelo por parecido, no por formato. El informe las separa siempre de los identificadores verificables y no las suma con ellos.
- El reconocimiento de entidades funciona en castellano
- Los identificadores con formato verificable —DNI, NIE, IBAN, tarjeta, NSS— son independientes del idioma. El resto, no. Si vuestro corpus está mayoritariamente en otra lengua, este análisis os dará menos de lo que necesitáis y os lo diré antes de empezar.
Y una cosa que hoy no se ofrece
El Reglamento europeo de IA aplica su régimen general desde el 2 de agosto de 2026, y las obligaciones de los sistemas de alto riesgo del anexo III entran el 2 de diciembre de 2027. Preparar un archivo documental para responder a esas obligaciones es la dirección natural de este trabajo.
Hoy no lo ofrezco: no lo mido todavía, y aquí solo se ofrece lo que se mide. Cuando exista, tendrá su propia página y sus propias cifras.
Si después de leer esto sigue encajando
Es justo el punto en el que merece la pena una conversación de quince minutos.