corpus_stats
Retrieve the schema and row count for a specific African speech corpus configuration, enabling dataset inspection and planning for de-duplicated training sets.
Instructions
Return rows and schema for exactly one declared dataset configuration.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| corpus | Yes | Variant key. |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| splits | Yes | ||
| columns | Yes | ||
| warnings | No | ||
| provenance | Yes | ||
| total_rows | Yes | ||
| declared_splits | Yes | ||
| observed_configs | No | ||
| undeclared_splits | No |