Databook Área II Cartagena

Databook · diccionario de datos

Antes de que un estadístico pueda tocar tus datos necesita saber qué es cada columna. Este diccionario mínimo son cuatro columnas en una hoja llamada Databook del mismo archivo que los datos: el nombre que tiene la variable, el nombre que debería tener, su papel en la investigación y los valores que puede tomar. Con eso el control de calidad se automatiza y dejáis de perder semanas en correos de ida y vuelta.

Tu archivo no sale de este dispositivo. Se lee en el navegador y no se sube a ningún servidor, ni a la nube de la plataforma ni a ninguna IA. Aquí no hay IA: los tipos y los rangos salen de estadística descriptiva simple (mínimo, máximo, valores distintos, frecuencias) y la validación es 100 % determinista — misma entrada, misma salida, siempre, y auditable línea a línea. Para no perder el trabajo a medias se guardan en tu navegador solo los metadatos del diccionario —nombres de columna, roles y valores permitidos—, nunca celdas de datos ni filas. Ojo a un matiz: el rango que se propone es el mínimo y el máximo observados, así que sus dos extremos coinciden con dos valores reales de esa columna. Es información que va a ir en el databook de todas formas, pero si te incomoda, corrige el rango al del protocolo y usa «Borrar lo guardado en este navegador» al terminar.

Paso 1Cargar el archivo de datos

Acepta .xlsx, .csv y .tsv. Se leen los encabezados y los datos de la hoja para poder describir cada variable; nada se envía a ningún sitio.

Elegir archivo (.xlsx, .csv, .tsv) o arrástralo hasta aquí

Se asume que la primera fila con contenido son los encabezados. Si tu Excel tiene varias hojas, podrás elegir cuál.

…o pegar desde el portapapeles

Copia el rango con encabezados en Excel y pégalo aquí (se detecta el separador solo).

filas de datos
variables
celdas vacías
origen

Paso 2Editar el databook

La máquina propone; tú decides. Todo es editable y nada de lo propuesto es definitivo hasta que lo marcas como revisado.

El rango observado NO es el rango permitido. Si en tus datos la edad va de 20 a 80, eso no significa que 150 sea un valor válido: significa que en esta muestra no ha aparecido. Lo propuesto es la foto de lo que hay; los valores permitidos los fija el protocolo del estudio. Revisa variable por variable y marca la casilla «revisado» cuando el rango o la lista sean los correctos.
Cómo escribir «Valores_permitidos» (y qué entiende el validador)
[18, 100]Numérica: rango cerrado, mínimo y máximo incluidos. También vale 18-100 o 18 a 100.
Hombre | MujerCategórica: lista de categorías separadas por | (también acepta ; o ,). La comparación es exacta: «mujer» no es «Mujer».
[2020-01-01, 2026-12-31]Fecha: rango en formato ISO (año-mes-día).
texto libreSin regla comprobable: el validador no revisa el contenido (sí las celdas vacías).

Un rol de identificador añade una comprobación extra: los valores no pueden repetirse.

Databook de las variables detectadas. Cuatro columnas: nombre en los datos, nombre final, rol y valores permitidos.
A · Nombres_RAWel nombre tal cual está en los datos B · Nombres_ARREGLADOSel nombre que debería tener: sin jerga ni abreviaturas privadas C · Rolsu papel en la investigación D · Valores_permitidosrango si es numérica, lista de categorías si es categórica

Paso 2bAvisos de calidad

No bloquean nada: son las cosas por las que el estadístico te va a escribir. Se recalculan mientras editas.

Paso 3Validar los datos contra el databook

Recorre fila a fila y lista lo que no cumple lo que has declarado: numéricos fuera de rango, categorías no declaradas, celdas vacías e identificadores repetidos. Sin IA y sin red: mismo archivo y mismo databook, mismo resultado.

Paso 4Entregar el databook

El destino es una hoja llamada Databook dentro del mismo archivo que los datos. Lo normal es lo primero: te devolvemos tu propio libro con la hoja ya dentro.

Añadir la hoja a mi libro devuelve el .xlsx que subiste con una hoja Databook al final; si ya la traía, la actualiza en su sitio en vez de duplicarla. El resto del libro —estilos, fórmulas, gráficos, tablas— no se toca. Lo único que se pierde frente a la descarga suelta es el encabezado en negrita: dar formato exigiría escribir en los estilos de tu libro, y no merece la pena arriesgar tu archivo por eso. Solo funciona con .xlsx: en un CSV no hay libro donde meter la hoja.
La descarga suelta trae una única hoja ya llamada Databook: clic derecho en la pestaña → Mover o copiar → elige tu libro. El .csv va con separador ; y BOM UTF-8 para que Excel en español no se pelee con los acentos. La copia es TSV: pégala en una hoja nueva y renómbrala Databook.

Plataforma formativa. No diagnóstica. No sustituye juicio clínico. Esta herramienta no interpreta datos clínicos ni valora resultados: solo describe la estructura del archivo (qué columnas hay, de qué tipo y con qué valores) y comprueba que los datos encajan con lo que has declarado. Las decisiones metodológicas —qué es respuesta, qué es confusora, qué rango es admisible— son tuyas y de tu estadístico. Y recuerda que un archivo de investigación no debe contener nombres completos, DNI/NIE ni NHC.