evaluate_skill
Full skill evaluation lab. Static analysis (23 patterns: sensitive file reads, remote exec, reverse shells, obfuscation) Docker sandbox execution (install skill, run with strace, monitor syscalls, file access, network) AI evaluation (strengths, weaknesses, risks, quality grade, verified capabilities) Returns: safety_score, risk_level, execution_report, evaluation (summary + verified_capabilities + strengths + weaknesses + risks + quality_grade + recommendation)
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| slug | Yes | ClawHub skill slug to evaluate. Example: "shell", "invoice-pdf". Required. | |
| test_input | No | Test input to pass to the skill. Default: "hello world". |