nymrel_crawler_mesh
Crawl web pages or raw HTML to extract clean, token-optimized Markdown, removing boilerplate, ads, scripts, and navigation for LLM-ready input.
Instructions
High-throughput clean web crawler & Markdown AST extractor. Strips boilerplate, ads, scripts, and navigation to produce token-optimized Markdown for LLMs.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| url | No | Target URL to crawl and scrape | |
| html | No | Direct HTML string payload to convert to Markdown AST | |
| extractMetadata | No | Whether to extract OpenGraph, Twitter, and JSON-LD metadata |