missing_report
Identify missing values in tabular datasets, generating per-column counts, rates, and co-occurrence patterns to support data quality assessment and cleaning.
Instructions
missing_report —— 数据探查组 · 缺失报告(工具 3,核心实现)。
docstring = agent 使用说明书,与 statlab_mcp/docs/design/01_data_exploration_batch1.md 同步维护。
参数: file_path (str): 本地数据文件(csv/tsv/xlsx/json),仅接受本地路径(拒绝 UNC)
返回: 成功 {"status":"ok","result":{...},"summary":"一句话中文结论"} 失败 {"status":"error","message":"中文原因"} result: {n_rows, n_columns, total_missing, overall_missing_rate, columns: {<列名>: {n_missing, missing_rate}}, complete_rows, rows_with_missing, patterns: [{columns, rows, note}]}
缺失定义: 空单元格与空串在读表层统一为 NaN(read_csv 默认),一律计入缺失; 全缺失列 rate=1.0 并注记;成对模式 = 两列同时缺失的行数(同源故障信号); patterns 最多 10 条,按缺失行数降序;无缺失时 patterns=[]。
示例: missing_report("samples/dirty.csv") inline 数据: 本工具支持可选 inline_data 参数(v1.2.0 起):与 file_path 二选一, 支持 records 数组或 {"header": [...], "rows": [[...], ...]} 对象两种形态; 规模上限/类型域/data_source 来源标注见 statlab_mcp/docs/SPEC.md 第 12 节。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| file_path | No | ||
| inline_data | No |