Antes de que un estadístico pueda tocar tus datos necesita saber qué es cada columna. Este diccionario mínimo son cuatro columnas en una hoja llamada Databook del mismo archivo que los datos: el nombre que tiene la variable, el nombre que debería tener, su papel en la investigación y los valores que puede tomar. Con eso el control de calidad se automatiza y dejáis de perder semanas en correos de ida y vuelta.
Este es el camino normal y el recomendado. Acepta .xlsx, .csv y .tsv. Se leen los encabezados y los datos de la hoja para poder describir cada variable; el archivo se queda en tu navegador y no se envía a ningún sitio.
Se asume que la primera fila con contenido son los encabezados. Si tu Excel tiene varias hojas, podrás elegir cuál.
Copia el rango con encabezados en Excel y pégalo aquí (se detecta el separador solo).
Captura solo la FILA DE ENCABEZADOS, no los datos. Es la mitigación más eficaz que existe aquí y la que se te pide: si recortas antes de subir, las filas de pacientes no salen de tu dispositivo. Ejemplo de qué entra y qué no:
| id_paciente | edad | sexo | fecha_ingreso | éxitus |
| P001 | 54 | Hombre | 03/02/2026 | No |
| P002 | 71 | Mujer | 11/02/2026 | Sí |
Verde: lo que hay que capturar. Tachado: lo que hay que dejar fuera del recorte.
askAi del Área (región europe-west1) y de ahí al
proveedor de IA de visión. Antes de salir, un OCR que corre en tu navegador revisa la
imagen: si encuentra identificadores (DNI, NIE, NHC, nombre completo) bloquea el envío,
y lo que quede sospechoso lo tacha en negro sobre la propia imagen — verás las
tachaduras en la vista previa. La imagen no se guarda en ningún sitio.
Hombre/Mujer,
Sí/No). Los valores permitidos los sigues declarando tú.
Solo imagen. Si lo que tienes es un PDF, ábrelo y hazle una captura de pantalla de la fila de encabezados: esta página no rasteriza PDF y no vamos a añadir una dependencia nueva para hacerlo.
La máquina propone; tú decides. Todo es editable y nada de lo propuesto es definitivo hasta que lo marcas como revisado.
| [18, 100] | Numérica: rango cerrado, mínimo y máximo incluidos. También vale 18-100 o 18 a 100. |
| Hombre | Mujer | Categórica: lista de categorías separadas por | (también acepta ; o ,). La comparación es exacta: «mujer» no es «Mujer». |
| [2020-01-01, 2026-12-31] | Fecha: rango en formato ISO (año-mes-día). |
| texto libre | Sin regla comprobable: el validador no revisa el contenido (sí las celdas vacías). |
Un rol de identificador añade una comprobación extra: los valores no pueden repetirse.
| A · Nombres_RAWel nombre tal cual está en los datos | B · Nombres_ARREGLADOSel nombre que debería tener: sin jerga ni abreviaturas privadas | C · Rolsu papel en la investigación | D · Valores_permitidosrango si es numérica, lista de categorías si es categórica |
|---|
No bloquean nada: son las cosas por las que el estadístico te va a escribir. Se recalculan mientras editas.
Recorre fila a fila y lista lo que no cumple lo que has declarado: numéricos fuera de rango, categorías no declaradas, celdas vacías e identificadores repetidos. Siempre sin IA y sin red, también cuando el databook venga de una captura: mismo archivo y mismo databook, mismo resultado.
.xlsx o el .csv, cárgalo arriba: se reconcilia con lo que ya has
escrito a mano y entonces sí podrás validar.
El destino es una hoja llamada Databook dentro del mismo archivo que los datos. Lo normal es lo primero: te devolvemos tu propio libro con la hoja ya dentro.
Añadir la hoja a mi libro devuelve el .xlsx que subiste con una hoja
Databook al final; si ya la traía, la actualiza en su sitio en vez de duplicarla.
El resto del libro —estilos, fórmulas, gráficos, tablas— no se toca. Lo único que se pierde
frente a la descarga suelta es el encabezado en negrita: dar formato exigiría escribir
en los estilos de tu libro, y no merece la pena arriesgar tu archivo por eso. Solo funciona con
.xlsx: en un CSV no hay libro donde meter la hoja.
La descarga suelta trae una única hoja ya llamada Databook: clic derecho en
la pestaña → Mover o copiar → elige tu libro. El .csv va con separador
; y BOM UTF-8 para que Excel en español no se pelee con los acentos. La
copia es TSV: pégala en una hoja nueva y renómbrala Databook.