enaho_calidad
Checks if a prepared ENAHO dataset is suitable for estimation by detecting duplicate keys, unlabeled codes, invalid factors, and empty columns, preventing misleading survey results.
Instructions
Responde si un dataset sirve para lo que se va a hacer con el.
Es distinto de enaho_perfil, que describe. Esto DIAGNOSTICA cinco cosas que, si fallan, producen resultados creibles y equivocados:
Llaves duplicadas o con nulos: un merge posterior multiplicaria filas, o las perderia sin avisar. Es el fallo mas caro y el mas dificil de ver a ojo.
Cobertura por variable: distingue entre "universo restringido" y "merge que no emparejo", que se parecen mucho en una tabla.
Codigos sin etiqueta: un 9 en una variable definida 1-3 suele ser un "no responde" que nadie convirtio a faltante y que entra en los promedios como un dato.
Factor invalido: filas con factor nulo, cero o negativo que el estimador descarta en silencio.
Columnas constantes o vacias: la senal habitual de haber unido el archivo equivocado.
Devuelve apto_para_estimar y los problemas separados entre los que
impiden estimar y los que solo hay que mirar. Llamala despues de
enaho_unir_modulos y antes de publicar cualquier cifra.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| salida | No | Nombre del archivo generado. | |
| dataset | Yes | Nombre corto del dataset preparado. | |
| formato | No | Si se indica, ademas escribe el informe en disco: 'html', 'md', 'docx', 'xlsx' o 'pdf'. |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
No arguments | |||