El setup: arreglar lo que el análisis encontró
El análisis dice qué está mal. El setup lo arregla, y termina con un segundo informe que mide el antes y el después con la misma herramienta y los mismos parámetros. La mejora no se afirma: se mide.
6.500 €5.550 € netos descontando el análisis · hasta 5.000 páginas · 4-6 semanasLas seis operaciones
Se aplican en este orden, y cada una deja constancia de qué tocó.
-
OCR de las páginas sin texto
Es la que más rinde. Un PDF escaneado es invisible para un sistema de recuperación; después del OCR deja de serlo. Es la métrica que más veces explica «la IA no encuentra lo que le pido».
-
Deduplicación
Los fragmentos repetidos contaminan la recuperación y encarecen cada consulta que haga el asistente.
-
Normalización a texto limpio
Un fichero por documento, con identificador estable y su origen anotado, para que siempre se pueda volver del resultado al documento de partida.
-
Seudonimización de datos personales
Solo donde vosotros decidís que procede. Seudonimizar de más destruye información que necesitáis; de menos, no resuelve el problema. Se acuerda por escrito antes de tocar nada.
-
Troceado con parámetros declarados
El corpus sale listo para ingerir, con sus parámetros por escrito, para que quien monte el asistente use los mismos y no vuelva a prepararlo desde cero.
-
Informe de cierre: antes y después
Las cinco métricas del análisis inicial, ejecutadas de nuevo sobre el corpus ya tratado y puestas al lado de las primeras.
El informe de cierre es lo que de verdad compras
La mejora se mide con la misma herramienta con la que se diagnosticó y con los mismos parámetros. No es un resumen de lo que hice: es la medición repetida.
Un proveedor que se lleva vuestros documentos a la nube no puede ofrecer esto con la misma garantía, porque no puede demostrar dónde estuvieron mientras tanto.
Y por eso mismo no prometo un porcentaje de mejora por adelantado. Un escaneo malo sigue siendo malo después del OCR. El informe de cierre enseñará lo que salga, y si sale tibio lo dirá igual: es preferible a vender una cifra que no llega.
Qué recibes
- El corpus tratado
- En vuestra máquina. Un fichero por documento, con identificador estable.
- El manifiesto
- Qué documento vino de qué original, qué operaciones se le aplicaron y cuáles fallaron. La trazabilidad completa, incluidos los fallos.
- El informe de cierre
- Las cinco métricas antes y después.
- Los datos en bruto de ambas mediciones
- Para que cualquier cifra se pueda rehacer sin fiarse de mi palabra.
- Los parámetros de troceado por escrito
- Para que quien monte el asistente no tenga que adivinarlos.
Qué no es el setup
Con el mismo rango que lo anterior, igual que en el informe.
- No es montar el asistente de IA. Se prepara el corpus; no se entrega un RAG funcionando. Si lo pedís, es otro proyecto y lleva otro número: 9.000-12.000 €.
- No es una migración documental. No se toca vuestro gestor documental ni se reorganizan las carpetas de origen. Se trabaja sobre una copia.
- No es clasificación ni etiquetado semántico. Extraer materias, vencimientos o partes de un contrato es otro trabajo.
- No es revisión jurídica de nada.
- No garantiza una cifra de mejora concreta. La mide.
Volumen, plazo y condiciones
| Precio | 6.500 €, menos el análisis ya pagado → 5.550 € netos |
|---|---|
| Volumen incluido | Hasta 5.000 páginas de corpus real |
| Exceso | +750 € por cada 2.500 páginas adicionales |
| Plazo | 4-6 semanas desde el alcance firmado |
| Pago | 50 % al firmar el alcance, 50 % con el informe de cierre |
| Requisito | Análisis hecho: sin diagnóstico no se puede acotar el alcance |
Por qué el plazo es de semanas y no de días. El trabajo de máquina es desatendido, pero hay dos puntos de decisión humana —el alcance de la seudonimización y la verificación por muestreo—. Prometer dos semanas sería prometer algo que no se cumple, y cumplir el plazo es justo lo que hace que tenga sentido el paso 3.
Disponible desde enero de 2027
El análisis está terminado y se puede encargar hoy. El setup está definido en su método, alcance y precio, y se construye en diciembre — después de los primeros análisis reales, para no diseñarlo a ciegas. Aquí solo se ofrece lo que se mide, y por eso su fecha está escrita en vez de insinuada.