find_jaccard_duplicate_observations
Identifies and groups near-duplicate observation strings across entities using token-Jaccard similarity, improving recall beyond exact matching.
Instructions
v2.1.0 — Find near-duplicate observation strings across distinct entities via token-Jaccard similarity with union-find grouping. More expensive than the exact tier (O(o²)); opt-in for higher recall.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| maxGroups | No | ||
| projectId | No | ||
| sessionId | No | ||
| entityType | No | ||
| minOccurrences | No |