py-mcp-full
py-mcp-full
Conjunto completo de herramientas para el desarrollo de spiders PY — Análisis de sitios de cine MacCMS + Generación inteligente de código fuente + Depuración de selectores + Depuración de enlaces de reproducción + Pruebas de interfaz + Evaluación de estándares de código + Operaciones completas de archivos
Basado en el protocolo MCP (Model Context Protocol), proporciona 18 herramientas profesionales para asistentes de programación de IA, cubriendo todo el flujo de trabajo del desarrollo de spiders de cine.
✨ Características
🔍 Análisis profundo de la estructura del sitio web — Identificación automática de MacCMS v8/v10/API de recolección/arquitecturas no estándar
🤖 Generación inteligente de código fuente — Generación con un clic de spiders T3/T4 basada en los resultados del análisis
🎯 Depuración de selectores — Verificación en tiempo real de los resultados de coincidencia de selectores XPath/CSS
🎬 Depuración de enlaces de reproducción — Resolución recursiva de enlaces directos m3u8/mp4, soporte para extracción de variables JS en v8/v10
🧪 Pruebas de interfaz — Pruebas automatizadas de las cinco interfaces principales (home/category/detail/search/play)
📋 Evaluación de estándares — 12 comprobaciones ponderadas de los estándares del código fuente del spider
📁 Operaciones completas de archivos — read/write/delete/mkdir/move/copy/info/cwd
🚀 Inicio rápido
Instalación
git clone https://github.com/sunniu-hjdhnx/py-mcp-full.git
cd py-mcp-full
npm installConfigurar el cliente MCP
Agregue lo siguiente a la configuración de clientes MCP como Claude Desktop / Cursor / Cherry Studio:
{
"mcpServers": {
"py_mcp_full": {
"command": "node",
"args": ["/path/to/py-mcp-full/index.js"],
"env": {
"ROOT": "/path/to/your/spider/project"
}
}
}
}La variable de entorno
ROOTespecifica el directorio raíz del proyecto de código fuente del spider; las herramientas de operación de archivos se basan en esta ruta.
Despliegue simplificado (opcional)
Use esbuild para empaquetar en un solo archivo, sin necesidad de node_modules:
npm install -g esbuild
esbuild index.js --bundle --platform=node --format=cjs --target=node22 --outfile=dist/index.cjsConfiguración después del empaquetado:
{
"mcpServers": {
"py_mcp_full": {
"command": "node",
"args": ["dist/index.cjs"],
"env": { "ROOT": "/path/to/your/spider/project" }
}
}
}🛠 Lista de herramientas (18)
Herramientas de desarrollo de spiders (10)
Herramienta | Función | Parámetros necesarios |
| Análisis profundo de la estructura del sitio, identifica el tipo de CMS |
|
| Generación inteligente de código fuente del spider |
|
| Verificación de resultados de coincidencia de selectores CSS |
|
| Depuración recursiva de extracción de enlaces de reproducción |
|
| Prueba de las cinco interfaces principales |
|
| Evaluación del cumplimiento de estándares de código |
|
| Obtención del contenido de la página |
|
| Reemplazo de contenido de archivo |
|
| Búsqueda de contenido en archivos |
|
| Listado de contenido de directorios |
|
Herramientas de operación de archivos (8)
Herramienta | Función | Parámetros necesarios |
| Lectura de archivos (soporta segmentación) |
|
| Escritura de archivos (sobrescribir/añadir) |
|
| Eliminación de archivos o directorios |
|
| Creación de directorios (soporta recursividad) |
|
| Mover/renombrar |
|
| Copia de archivos |
|
| Obtención de información detallada del archivo |
|
| Obtención del directorio de trabajo | — |
📖 Flujo de uso
① analyze_website(url="https://example.com")
→ 识别CMS类型,获取HTML结构参数
② debug_selector(url="...", selector="//div[contains(@class,'item')]")
→ 验证选择器是否正确
③ create_spider_source(url="...", mode="T4")
→ 生成完整爬虫源代码
④ test_interface(source_code="...", interface="all")
→ 测试五大接口是否正常
⑤ evaluate_source(source_code="...")
→ 检查规范符合度🏗 Estructura del proyecto
py-mcp-full/
├── index.js # 主程序(1409行)
├── package.json # 依赖配置
├── manifest.json # 工具 Schema 定义
└── 使用说明.md # 中文详细文档Notas del repositorio
Este README se utiliza únicamente para explicar la información básica del proyecto y los límites del repositorio. Es solo para aprendizaje técnico e intercambio, y no contiene guías de uso, guías de integración o descripciones de recursos.
Agradecimientos
📄 Licencia
MIT
Related MCP Connectors
Web search, page extraction, visual tools and developer utilities through Baizhi Cloud.
Extract data from any website with this web scraper tool.
19 free website QA and AI-visibility tools. Remote HTTP MCP, no account, no API key.
Hosted MCP: 1873 structured web-data tools for search, maps, commerce, social, gaming & finance.