Skip to main content
Glama

Server Configuration

Describes the environment variables required to run the server.

NameRequiredDescriptionDefault
ENAHO_MCP_HOMENoRoot directory for the cache (ENAHO_MCP_HOME)
ENAHO_MCP_DEBUGNoEnable debug mode
ENAHO_MCP_LIMITE_GBNoCache size limit in gigabytes
ENAHO_MCP_MAX_MODULOSNoMaximum number of modules to process

Instructions

Guidance the server publishes about itself, which clients place ahead of the tool catalog so the model reads it before choosing anything.

This server publishes no instructions, or was last inspected before Glama recorded them.

Capabilities

Features and capabilities supported by this server

Protocol revision2025-11-25

CapabilityDetails
tools
{
  "listChanged": false
}
prompts
{
  "listChanged": false
}
resources
{
  "subscribe": false,
  "listChanged": false
}
experimental
{}

Tools

Functions exposed to the LLM to take actions

NameDescription
enaho_buscar_variableA

Encuentra en que modulo y con que nombre esta una variable.

Es la herramienta que mas se usa y la mas barata: consulta el indice pre-construido, sin descargar ni un byte de microdatos. Empieza SIEMPRE por aqui cuando no sepas el nombre exacto de una variable.

Busca en la ENAHO salvo que pases encuesta. El indice cubre 16 de las 67 encuestas del portal; si pides una que no esta indexada, el error lo dice en vez de devolver un "no encontrado" que se leeria como "esa variable no existe".

Devuelve los resultados agrupados por modulo, con el total de coincidencias y si hay mas paginas.

enaho_rastrear_variableA

Sigue una variable ola por ola y avisa si cambio de significado.

Usala ANTES de construir cualquier serie de tiempo. El INEI recicla codigos de variable entre anios, y ese es el error silencioso mas caro que se comete con la ENAHO: la serie sale, se ve razonable y esta mal.

Devuelve los anios en que aparece, las etiquetas distintas que tuvo, los huecos intermedios y alertas explicitas cuando la etiqueta cambia.

enaho_listar_modulosA

Modulos publicados ese anio, con su unidad de analisis y sus llaves.

Combina el catalogo del INEI (codigo, nombre, formatos) con la tabla de dominio (nivel hogar/persona/item y llaves de union). Los modulos con curado=false llevan un nivel inferido que conviene verificar.

enaho_describir_moduloA

Ficha de un modulo: nivel, llaves, factor esperado, tamano y trampas.

Consultala antes de unir o estimar. Incluye el numero de variables y de filas segun el indice (sin descargar), si el modulo trae factor de expansion propio, y las notas de dominio que explican por que ese modulo pierde filas al unirse con otro.

enaho_listar_encuestasA

Que encuestas del INEI sabe manejar este servidor, ademas de la ENAHO.

Consultala cuando el usuario pregunte por algo que la ENAHO no mide: salud materno-infantil, anemia y desnutricion (ENDES), seguridad ciudadana y acceso a servicios (ENAPRES), uso del tiempo (ENUT), violencia (ENARES), produccion agropecuaria (ENA) o empleo trimestral (EPEN).

Cada encuesta tiene sus propias llaves de union y su propio factor de expansion, declarados en su perfil. Las que salen con verificado=false funcionan, pero con llaves inferidas que conviene confirmar con enaho_perfil antes de publicar resultados. La respuesta incluye tambien las encuestas del catalogo que NO tienen perfil: se pueden descargar, pero el servidor no sabe como se unen.

enaho_descargarA

Descarga modulos al cache local. NO devuelve microdatos, devuelve rutas.

El cache es idempotente: lo ya descargado e integro se salta. Los ZIP se verifican y los truncados se vuelven a bajar solos, cosa habitual porque el portal del INEI corta conexiones.

Hay un tope de descargas por llamada para no bloquear la sesion con un anio completo. Si pides mas, el error te dice como dividirlo.

enaho_descargar_documentacionA

Baja ficha tecnica, diccionario de variables y cuestionarios del anio.

Devuelve las rutas de los ZIP para que los leas despues con tus herramientas de archivos. El diccionario es lo que resuelve las dudas de definicion que ni el catalogo ni el indice pueden contestar.

enaho_estado_cacheA

Que hay descargado, cuanto ocupa y que datasets derivados existen.

Consultala antes de descargar en masa: la ENAHO completa de varios anios son varios GB, y muchas veces el modulo que hace falta ya esta bajado de una sesion anterior. Devuelve el desglose por anio, el espacio en disco y la lista de datasets preparados con su nombre corto, que es el que aceptan enaho_perfil, enaho_estimar y enaho_exportar.

enaho_estado_catalogoA

De donde sale el catalogo del INEI que usa el servidor y que edad tiene.

Consultala cuando una herramienta diga que un anio no existe y el usuario insista en que si. El catalogo empaquetado es una foto fija del dia en que se publico la dependencia: si el INEI saco una ola despues, el servidor no la ve. La respuesta trae la fecha del crawl y avisa cuando conviene refrescarlo con enaho_actualizar_catalogo.

enaho_actualizar_catalogoA

Recorre el portal del INEI y reescribe el catalogo local.

Es la operacion mas lenta del servidor: acota SIEMPRE con encuestas salvo que el usuario pida explicitamente el catalogo completo.

Devuelve el diff, que es lo que hay que mirar: anios y modulos nuevos, y sobre todo los que desaparecieron. El catalogo empaquetado se conserva como respaldo, asi que un crawl fallido no deja al servidor sin catalogo.

enaho_documentacion_convertirA

Pasa a Markdown los PDF de documentacion del INEI para poder buscarlos.

El diccionario de variables, la ficha tecnica y el manual del encuestador son lo unico que responde "que mide exactamente esta variable" y "que universo cubre este modulo". Vienen como PDF dentro de ZIP: un documento de 493 paginas que no se puede buscar ni citar.

Convierte tambien lo que ya es texto, y ahi esta el material mas valioso que nadie mira: los ZIP de rutinas traen los .do de Stata con los que el INEI calcula la pobreza oficial.

ACOTA SIEMPRE con documentos salvo que el usuario pida la ola entera. Convertir solo el diccionario tarda un minuto; los 27 documentos, varios.

Despues de convertir, usa enaho_documentacion_buscar en vez de leer los archivos: devuelve el fragmento con su numero de pagina.

enaho_documentacion_buscarA

Responde dudas de definicion citando el documento y la pagina.

Es la herramienta que cierra el hueco entre "el indice dice que la variable existe" y "se que significa". El indice de variables da el nombre y la etiqueta; esto da lo que dice el diccionario y el manual: universo, codigos, como se construyo.

Usala ANTES de dar por buena la interpretacion de una variable rara, y siempre antes de curar el perfil de una encuesta: es la unica fuente que permite pasar unas llaves de verificado: false a true.

Devuelve fragmentos con documento y pagina, nunca documentos enteros, y requiere haber convertido antes con enaho_documentacion_convertir.

enaho_unir_modulosA

Une modulos aplicando las llaves del nivel pedido y guarda un parquet.

Es la herramienta central. Hace tres cosas que un merge a mano suele equivocar: elige la base correcta (el modulo mas desagregado manda), normaliza el tipo de las llaves (conglome puede venir como texto en un modulo y como entero en otro) y cuenta las filas perdidas en cada paso.

Lee el bloque pasos_union de la respuesta: una tasa de emparejamiento baja puede ser legitima (el modulo 05 solo cubre personas de 14 anios a mas) o puede ser un merge roto, y la diferencia importa.

Devuelve el nombre del dataset, su forma y sus advertencias. NO devuelve microdatos: para analisis libre abre el parquet con pandas.

enaho_perfilA

Tipo, faltantes, cuartiles y etiquetas de valor de cada variable.

Compacto a proposito: existe para decidir que hacer sin traer los microdatos al contexto. Tambien reporta el factor de expansion detectado y la unidad de analisis inferida por las llaves.

enaho_agregar_moduloA

Colapsa un modulo de gastos o produccion al nivel hogar.

Los modulos 07 a 28 tienen una fila por PRODUCTO, no por hogar. Unirlos crudos multiplica las filas del hogar por el numero de productos y todo lo que estimes despues sale inflado. Esta herramienta los agrega antes.

Hay que decir explicitamente que variables agregar y con que funcion: no existe un "agrega todo lo numerico" porque sumar un codigo de producto produce un numero que parece un dato. Usa enaho_buscar_variable con el modulo para ver que hay dentro.

Aviso importante que la herramienta tambien reporta: con funcion 'suma', un hogar cuyas filas eran todas faltantes queda como faltante, NO como cero. Tratarlo como cero sesga el gasto hacia abajo.

enaho_listar_datasetsA

Datasets ya preparados, con su anio, modulos de origen, nivel y tamano.

Empieza por aqui cuando retomes una sesion: puede que el parquet que necesitas ya exista y te ahorres la descarga y la union. El campo nombre es el identificador corto que aceptan enaho_perfil, enaho_estimar, enaho_geografia y enaho_exportar.

enaho_exportarA

Convierte un dataset preparado al formato que use tu equipo.

Con etiquetas=True el .dta sale con etiquetas de variable y de valor, que es lo que lo hace usable en Stata. Si el dataset supera el limite de filas de Excel, la herramienta se niega en vez de generar un archivo truncado sin avisar.

enaho_calidadA

Responde si un dataset sirve para lo que se va a hacer con el.

Es distinto de enaho_perfil, que describe. Esto DIAGNOSTICA cinco cosas que, si fallan, producen resultados creibles y equivocados:

  • Llaves duplicadas o con nulos: un merge posterior multiplicaria filas, o las perderia sin avisar. Es el fallo mas caro y el mas dificil de ver a ojo.

  • Cobertura por variable: distingue entre "universo restringido" y "merge que no emparejo", que se parecen mucho en una tabla.

  • Codigos sin etiqueta: un 9 en una variable definida 1-3 suele ser un "no responde" que nadie convirtio a faltante y que entra en los promedios como un dato.

  • Factor invalido: filas con factor nulo, cero o negativo que el estimador descarta en silencio.

  • Columnas constantes o vacias: la senal habitual de haber unido el archivo equivocado.

Devuelve apto_para_estimar y los problemas separados entre los que impiden estimar y los que solo hay que mirar. Llamala despues de enaho_unir_modulos y antes de publicar cualquier cifra.

enaho_sondear_llavesA

Descubre como unir dos modulos de una encuesta que nadie ha curado.

Usala cuando enaho_unir_modulos falle porque la encuesta no tiene llaves declaradas. El catalogo del INEI tiene 67 encuestas y solo 15 tienen perfil; para el resto, esto es lo que convierte "no se puede" en "estas son las candidatas y esta es la evidencia".

Descarga los modulos si hace falta y mira los datos reales: cardinalidad de cada columna, unicidad de cada combinacion y, sobre todo, el SOLAPAMIENTO de valores entre los dos archivos, que es la unica prueba de que la union va a emparejar algo.

El resultado sale SIEMPRE con inferido: true. Es inferencia: antes de publicar cifras construidas sobre una llave sondeada hay que contrastarla con el diccionario de la encuesta. Para las encuestas que SI tienen perfil, no uses esto: el conocimiento curado le gana a cualquier heuristica y la respuesta te lo recordara.

enaho_estimarA

Estimacion ponderada con error estandar e IC que respetan el diseno.

Esta herramienta existe para evitar el error clasico de tesis: sacar el promedio simple de una encuesta estratificada por conglomerados y reportarlo como si describiera al pais. El factor de expansion no es opcional y el error estandar ingenuo subestima la varianza real.

Metodo: linealizacion de Taylor con estimador de conglomerado ultimo (estratos x UPM), t de Student con gl = n_conglomerados - n_estratos, e IC en escala logit para proporciones.

IMPORTANTE sobre el universo. Para indicadores de POBLACION que deban reproducir cifras oficiales (pobreza, ingreso per capita), usa un dataset a nivel HOGAR con peso_adicional="mieperho". Ponderar las filas del roster de personas solo con factor07 expande a un universo mayor -- incluye trabajadores del hogar y pensionistas-- y da una cifra parecida pero distinta de la del INEI. La herramienta lo detecta y lo advierte, pero es mejor pedirlo bien de entrada.

Cada celda trae su coeficiente de variacion y un campo confiable: por encima de CV 15 % el INEI considera la estimacion no publicable, porque el dominio tiene muestra insuficiente.

enaho_tabla_cruzadaA

Cruce ponderado con prueba de independencia corregida por diseno.

El chi-cuadrado de Pearson asume muestreo aleatorio simple: bajo conglomerados infla el estadistico y sale significativo lo que no lo es. Aqui se aplica la correccion de Rao-Scott por la traza de la matriz de efectos de diseno generalizados, con ajuste de segundo orden de los grados de libertad.

Se devuelven ambos estadisticos para que se vea la diferencia, mas el efecto de diseno promedio y cuantas celdas quedan bajo frecuencia esperada 5.

enaho_compararA

¿La diferencia entre dos grupos es real o es ruido muestral?

Devuelve la diferencia, su error estandar, el intervalo de confianza, el estadistico t y el p-valor.

Usa esto en vez de mirar si los intervalos de confianza individuales se solapan. Ese atajo falla en las dos direcciones: dos intervalos que se solapan pueden corresponder a una diferencia significativa, y como ambos dominios comparten conglomerados hay una covarianza que cambia el error estandar de la diferencia. Aqui se construye el linealizado de la diferencia sobre el diseno completo, asi que esa covarianza entra sola.

enaho_desigualdadA

Desigualdad con error estandar que respeta el diseno muestral.

El Gini y los percentiles no son funciones suaves de totales, asi que la linealizacion de Taylor no aplica. El error estandar sale por bootstrap rescalado de Rao-Wu-Yue, que remuestrea CONGLOMERADOS dentro de estrato: remuestrear filas ignoraria la correlacion intraclase y daria un error estandar tan optimista como el de un muestreo aleatorio simple.

Cuidado con los ingresos negativos: el Gini los admite pero puede salir fuera de [0,1], y el Theil los descarta. La herramienta avisa si los hay.

enaho_geografiaA

Descompone el ubigeo y anade nombres, dominio geografico y area.

Anade cod_<nivel>, el nombre del nivel, dominio_nombre (los ocho dominios del INEI) y area urbano/rural derivada del estrato. Guarda un dataset nuevo y deja el original intacto.

La tabla empaquetada cubre los 25 departamentos. Para provincia o distrito hay que importar una tabla oficial una vez con el comando de CLI enaho ubigeo importar; si no, esos nombres salen vacios y la herramienta lo dice.

enaho_ubigeo_buscarA

Busqueda inversa: nombre de lugar a codigo de ubigeo.

Util para filtrar una region sin salir a buscar el codigo a mano. El ubigeo son seis digitos (DD departamento, PP provincia, DD distrito) y la respuesta indica a que nivel corresponde cada acierto. La tabla base cubre los 25 departamentos; provincias y distritos aparecen solo si se importo una tabla oficial con enaho ubigeo importar.

enaho_panel_inspeccionarA

Mira que hay de verdad dentro de un modulo del panel, sin suponer nada.

ENAHO Panel NO es la ENAHO anual apilada: viene en formato ancho, con variables sufijadas por anio, llaves de seguimiento propias y factores calibrados para la submuestra seguida. Usar factor07 de la anual sobre datos de panel da resultados que parecen razonables y estan mal.

Esta herramienta reporta las columnas reales: olas detectadas, variables sufijadas, llaves candidatas y las columnas que parecen factor. Usala antes de armar nada, con el manual del panel al lado.

enaho_panel_armarA

Reestructura el panel de ancho a largo y cuantifica la atricion.

Devuelve unidades por ola, cuantas sobreviven a todas y la tasa de balanceo. NO asigna factor de expansion: el del panel hay que identificarlo con enaho_panel_inspeccionar y el manual, porque no coincide con el de la ENAHO anual.

enaho_regresionA

Regresion ponderada con errores estandar corregidos por el diseno.

Es el equivalente de svy: regress y svy: logit de Stata, y es lo que hay que usar en vez de correr statsmodels sobre el parquet: sin el factor los coeficientes describen a la muestra y no al pais, y sin el conglomerado los errores estandar se quedan tipicamente entre un 30 y un 60 % por debajo del real, lo que vuelve significativo lo que no lo es.

Devuelve coeficientes con error estandar, t, p-valor e IC; los grados de libertad son los del DISENO (conglomerados - estratos), no n - k. Para el logit los coeficientes van en escala log-odds: exponencialos para leerlos como razon de momios.

enaho_pobreza_fgtA

Los tres indices FGT con error estandar bajo diseno complejo.

La incidencia (FGT0) cuenta cuantos estan bajo la linea; la brecha (FGT1) mide cuan lejos estan, y la severidad (FGT2) pondera mas a los que estan mas abajo. Una politica que saca de la pobreza a quien estaba justo debajo de la linea mueve FGT0 sin mover FGT2: por eso los tres se reportan juntos.

Avisa cuando el bienestar y la linea no parecen estar en la misma unidad, que es el error mas facil de cometer aqui y produce una incidencia cercana a cero que parece un hallazgo.

enaho_distribucionA

Reparto por deciles con participacion en el total y curva de Lorenz.

Los cortes son cuantiles PONDERADOS, asi que cada grupo contiene la misma poblacion y no el mismo numero de filas de la muestra. Es la lectura que acompana al Gini: dos distribuciones con el mismo Gini pueden repartirse de forma muy distinta entre el decil de abajo y el de arriba.

Las cifras son descriptivas y no llevan error estandar; para el Gini con intervalo de confianza usa enaho_desigualdad, que lo estima por bootstrap de conglomerados.

enaho_serieA

Repite la misma estimacion en cada anio del rango y devuelve la serie.

Descarga y une lo que falte reutilizando el cache, estima con el diseno complejo de CADA anio, y calcula la variacion respecto del anio previo.

Antes de estimar nada, comprueba en el indice si la variable existe en todo el rango y si su etiqueta cambio entre olas. Ese chequeo es el motivo principal de usar esta herramienta en vez de llamar a enaho_estimar en bucle: construir una serie sobre un codigo que el INEI reciclo con otro significado produce un grafico plausible y falso.

Ojo con los valores monetarios: salen a precios corrientes de cada anio. Para comparar en el tiempo hay que deflactarlos con el IPC, que no esta en la ENAHO.

enaho_informeA

Redacta un informe ejecutando las estimaciones, no copiando numeros.

Le pasas la NARRATIVA y una especificacion de que calcular; el servidor corre las estimaciones con el diseno muestral completo y pinta los cuadros. Los numeros del documento no pasan por tu contexto, asi que no se degradan al recopiarlos.

Cada cuadro sale con sus notas al pie automaticas: la nota metodologica, las advertencias del calculo y el aviso de que celdas tienen CV por encima del 15 % y no son publicables.

Ejemplo de seccion de estimacion: {"tipo": "estimacion", "titulo": "Pobreza por region", "texto": "El cuadro 1 presenta la incidencia por departamento.", "dataset": "hogares2023", "variable": "pobreza", "estadistico": "proporcion", "valor": 1, "por": ["departamento"], "peso_adicional": "mieperho"}

Si una seccion falla, el resto del informe se genera igual y la seccion rota queda marcada dentro del documento con su sugerencia de arreglo.

Prompts

Interactive templates invoked by user choice

NameDescription
enaho-pobrezaArma Sumaria + hogar y estima la incidencia de pobreza ponderada.
enaho-empleoModulo 05 a nivel persona, con PEA e indicadores de informalidad.
enaho-explorarDado un tema, busca variables, dice en que modulos estan y propone un plan.
enaho-otra-encuestaDado un tema que la ENAHO puede no medir bien, decide que encuesta del INEI usar y prepara el terreno.
enaho-verificarChequeo de sanidad de un dataset antes de publicar resultados.

Resources

Contextual data attached and managed by the client

NameDescription
Tabla de dominio de modulos ENAHOUnidad de analisis, llaves de union y trampas de cada modulo curado, mas las reglas generales de union y ponderacion.
Encuestas del INEI con perfilEncuestas que el servidor sabe manejar (ENAHO, ENDES, ENAPRES, ENA, EPEN...), con su factor de expansion y si su perfil esta verificado, mas las que existen en el catalogo sin perfil.
Estado del cache localModulos descargados, datasets derivados y espacio ocupado.

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/AnderMC66/enaho-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server