check_duplicates
Detect exact duplicate rows in a dataset and group duplicates by specified keys. Use to uncover data quality issues and prepare clean data for analysis.
Instructions
Exact duplicate detection (Level 2).
Reports row-level exact duplicates and (if keys=[...] given) duplicate
groups under those keys. near=True is a placeholder for Phase 3 fuzzy
matching. Output size: small.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| keys | No | ||
| near | No | ||
| source_id | Yes |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
No arguments | |||