enaho_unir_modulos
Merge ENAHO modules at the desired level (household, person, or dwelling). Normalizes ID keys, reports row losses, and saves a parquet dataset with warnings for analysis.
Instructions
Une modulos aplicando las llaves del nivel pedido y guarda un parquet.
Es la herramienta central. Hace tres cosas que un merge a mano suele equivocar: elige la base correcta (el modulo mas desagregado manda), normaliza el tipo de las llaves (conglome puede venir como texto en un modulo y como entero en otro) y cuenta las filas perdidas en cada paso.
Lee el bloque pasos_union de la respuesta: una tasa de emparejamiento
baja puede ser legitima (el modulo 05 solo cubre personas de 14 anios a
mas) o puede ser un merge roto, y la diferencia importa.
Devuelve el nombre del dataset, su forma y sus advertencias. NO devuelve microdatos: para analisis libre abre el parquet con pandas.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| anio | Yes | ||
| nivel | No | Unidad de analisis del resultado. 'persona' usa conglome+vivienda+hogar+codperso; 'hogar' omite codperso. | hogar |
| cortes | No | Departamentos a apilar, en las encuestas que publican un archivo por departamento (cenagro, mapa-pobreza). Sin filtro se apilan todos, que es el dataset nacional. | |
| salida | No | Nombre del dataset resultante. Por defecto se autogenera. | |
| modulos | Yes | Modulos del MISMO anio. Combinaciones tipicas: ['01','34'] a nivel hogar, ['02','05','34'] a nivel persona. | |
| encuesta | No | Encuesta del INEI sobre la que operar. Por defecto 'enaho'. Valores: enaho, enaho-panel, endes, enapres, enut, enares, ena, epen-departamentos, epen-ciudades, epen-lima, epe-lima, enapref, enco, cenagro, mapa-pobreza. Cada encuesta tiene sus propias llaves de union y su propio factor de expansion; no se pueden mezclar entre si. | |
| descargar_si_falta | No | Descarga los modulos que no esten en el cache. |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
No arguments | |||