enaho_estimar
Compute design-based estimates from ENAHO survey data with correct standard errors and confidence intervals, handling stratification, clustering, and sampling weights to avoid biased results.
Instructions
Estimacion ponderada con error estandar e IC que respetan el diseno.
Esta herramienta existe para evitar el error clasico de tesis: sacar el promedio simple de una encuesta estratificada por conglomerados y reportarlo como si describiera al pais. El factor de expansion no es opcional y el error estandar ingenuo subestima la varianza real.
Metodo: linealizacion de Taylor con estimador de conglomerado ultimo (estratos x UPM), t de Student con gl = n_conglomerados - n_estratos, e IC en escala logit para proporciones.
IMPORTANTE sobre el universo. Para indicadores de POBLACION que deban
reproducir cifras oficiales (pobreza, ingreso per capita), usa un
dataset a nivel HOGAR con peso_adicional="mieperho". Ponderar las
filas del roster de personas solo con factor07 expande a un universo
mayor -- incluye trabajadores del hogar y pensionistas-- y da una cifra
parecida pero distinta de la del INEI. La herramienta lo detecta y lo
advierte, pero es mejor pedirlo bien de entrada.
Cada celda trae su coeficiente de variacion y un campo confiable: por
encima de CV 15 % el INEI considera la estimacion no publicable, porque
el dominio tiene muestra insuficiente.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| por | No | Variables de desagregacion, por ejemplo ['departamento'] o ['dominio','area']. El diseno completo se mantiene: no se filtra la muestra, se usa un indicador de dominio. | |
| valor | No | Categoria de interes cuando estadistico='proporcion'. | |
| factor | No | Columna del factor. Si se omite se detecta (factor07, factor...). | |
| dataset | Yes | Dataset preparado con enaho_unir_modulos. | |
| encuesta | No | Encuesta del INEI sobre la que operar. Por defecto 'enaho'. Valores: enaho, enaho-panel, endes, enapres, enut, enares, ena, epen-departamentos, epen-ciudades, epen-lima, epe-lima, enapref, enco, cenagro, mapa-pobreza. Cada encuesta tiene sus propias llaves de union y su propio factor de expansion; no se pueden mezclar entre si. | |
| estratos | No | Columna de estratos (por defecto 'estrato'). | |
| variable | Yes | Variable a estimar, por ejemplo 'inghog1d'. | |
| estadistico | No | 'proporcion' requiere una variable 0/1 o que indiques `valor` con la categoria de interes (ej. valor=1 sobre `pobreza`). | media |
| conglomerados | No | Columna de UPM (por defecto 'conglome'). | |
| peso_adicional | No | Columna que multiplica al factor. Usa 'mieperho' para expandir un archivo a nivel HOGAR a poblacion: es el metodo con el que el INEI calcula la pobreza que publica. | |
| nivel_confianza | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
No arguments | |||