cn-scraper-mcp
Server Configuration
Describes the environment variables required to run the server.
| Name | Required | Description | Default |
|---|---|---|---|
No arguments | |||
Instructions
Guidance the server publishes about itself, which clients place ahead of the tool catalog so the model reads it before choosing anything.
This server publishes no instructions, or was last inspected before Glama recorded them.
Capabilities
Features and capabilities supported by this server
Protocol revision2025-11-25
| Capability | Details |
|---|---|
| tools | {
"listChanged": true
} |
| logging | {} |
| prompts | {
"listChanged": false
} |
| resources | {
"subscribe": false,
"listChanged": false
} |
| extensions | {
"io.modelcontextprotocol/ui": {}
} |
| experimental | {} |
Tools
Functions exposed to the LLM to take actions
| Name | Description |
|---|---|
| taobao_searchA | 搜索淘宝/天猫商品。纯脚本,无需浏览器,不限流。 原理: curl_cffi 伪造 Chrome TLS 指纹 + MTOP HMAC-MD5 签名。 需要 TAOBAO_COOKIES_FILE 环境变量或 ~/.cn-scraper-cookies/taobao.json。 并发安全: ✅ 纯 HTTP/REST API,无共享状态,任意并发调用安全。 |
| jd_searchA | 搜索京东商品。需要已登录的有头 Chrome(会自动启动)。 京东 headless 返回 0 结果 → 必须 headful。 需要持久登录 profile (~/.jd_login_profile)。 首次使用需在弹窗 Chrome 中手动登录 jd.com 一次。 并发: ⚠️ 使用 BrowserLock 保护 CDP 端口,同端口调用自动串行化。 |
| jd_productA | 获取京东商品详情(名称、价格、店铺、规格)。需要本地 Chrome。 sku 来自 jd_search 结果中 item 的 sku 字段。 并发: ⚠️ 使用 BrowserLock 保护 CDP 端口。 |
| pdd_searchA | 搜索拼多多商品。需要 Chrome + PDD cookie(PDDAccessToken + pdd_user_id)。 ⚠️ 严重限制:拼多多手机搜索每个浏览器会话仅允许一次搜索。 第一次搜索后,所有后续搜索返回「系统繁忙」。 如需再次搜索,必须重启 MCP server 以创建新的浏览器会话。 原理: Chrome CDP + iPhone UA 模拟手机浏览器搜索。 Cookie 文件: ~/.cn-scraper-cookies/pdd.json Token 有效期约 1 小时,需定期从手机浏览器重新导出。 并发: ⚠️ 使用 BrowserLock 保护 CDP 端口,同端口调用自动串行化。 |
| pdd_product_detailA | 获取拼多多商品详情(名称、价格、原价、销量、规格)。 商品详情独立于搜索限制 — 不限次数。 |
| xiaohongshu_searchA | 搜索小红书笔记。需要本地 Chrome + XHS 登录 cookie。 小红书只允许住宅 IP(本地 Chrome)——云浏览器/数据中心 IP 直接封。 需要 XHS cookies: web_session, a1, webId, gid 等。 Cookie 文件: ~/.cn-scraper-cookies/xiaohongshu.json 并发: ⚠️ 使用 BrowserLock 保护 CDP 端口,同端口调用自动串行化。 |
| xiaohongshu_noteA | 获取小红书笔记详情(标题、正文、点赞、标签、评论)。 note_id 和 xsec_token 都来自同一条 xiaohongshu_search 结果。 |
| xiaohongshu_commentsA | 获取小红书笔记的评论(首屏,约 10-20 条)。 需要本地 Chrome + XHS 登录 cookie。 note_id 和 xsec_token 都来自同一条 xiaohongshu_search 结果。 |
| zhihu_searchA | 搜索知乎内容(问题/文章)。知乎已关闭游客搜索,需要有效登录 Cookie。 无需浏览器——直接调知乎 v4 search API。 需要 cookie: ~/.cn-scraper-cookies/zhihu.json(z_c0 + d_c0) 并发安全: ✅ 纯 HTTP/REST API,无共享状态,任意并发调用安全。 |
| zhihu_hot_listA | 获取知乎实时热榜。无需登录。 Returns: {items: [{title, url, excerpt, hot_metric}]} |
| zhihu_commentsA | 获取知乎回答的评论(支持分页)。需要登录 cookie。 answer_id 来自 zhihu_search 结果中 type 为 "answer" 的 item 的 id 字段。 |
| zhihu_answerA | 获取知乎回答的完整正文。 answer_id 来自 zhihu_search 结果中 type 为 "answer" 的 item 的 id 字段。 |
| zhihu_question_answersA | 获取知乎问题下的回答列表。 question_id 来自 zhihu_search 结果中 type 为 "question" 的 item 的 id 字段。 |
| weibo_searchA | 搜索微博帖子。需要登录 cookies(SUB token)。 ⚠️ 微博搜索 API 需要登录 — 游客模式不可用。 热搜(weibo_hot_list)无需登录即可使用。 原理: 调用 m.weibo.cn 移动端 API,解析 cards[].mblog。 Cookie 文件: ~/.cn-scraper-cookies/weibo.json(需要 SUB cookie) 并发安全: ✅ 纯 HTTP/REST API,无共享状态,任意并发调用安全。 |
| weibo_hot_listA | 获取微博实时热搜榜。无需登录! 原理: 调用 weibo.com/ajax/side/hotSearch(游客可访问)。 返回实时热搜 50 条 + 置顶政务话题。 并发安全: ✅ 纯 HTTP/REST API,无共享状态,任意并发调用安全。 Returns: {count, items: [{rank, word, num, url, label}], hotgov: {name, url}|null} |
| weibo_user_timelineA | 获取微博用户时间线(最近发言)。 需要登录 cookie(SUB token)。 可通过 weibo_search 找到目标用户获取其 UID。 |
| weibo_commentsA | 获取微博帖子的评论(支持分页)。需要登录 cookie(SUB token)。 mid 来自 weibo_search 或 weibo_user_timeline 结果中 item 的 id 字段。 |
| taobao_productA | 获取淘宝商品详情(标题、价格、店铺)。 item_id 来自 taobao_search 结果中 item 的 id 字段。 并发安全: ✅ 纯 HTTP/MTOP API。 |
| weibo_postA | 获取微博帖子的完整详情(含长文本)。 mid 来自 weibo_search 或 weibo_user_timeline 结果中的 item.id。 |
| douyin_searchA | 搜索抖音视频 — CDP 浏览器自动轮询,验证码自动等待。 需要 Chrome 已登录抖音(用 guided_login 先登录)。 弹出验证码时持续等待你手动过,通过后自动抓取结果。 |
| douyin_hot_listA | 抖音实时热搜榜。需要登录 cookie(首次用 guided_login 收割)。 Returns: {count, items: [{word, hot_value, position, label}]} |
| douyin_videoA | 获取抖音视频详情(标题、作者、点赞、描述)。需要 Chrome。 video_id 来自 douyin_search 结果中 item 的 video_id 字段。 |
| douyin_commentsA | 获取抖音视频评论(首屏)。需要登录 cookie。 video_id 来自 douyin_search 结果中 item 的 video_id 字段。 |
| bilibili_searchA | 搜索 B 站视频。公开 HTTP API,无需登录或浏览器。 |
| bilibili_popularA | 获取 B 站当前热门视频榜。公开 HTTP API,无需登录或浏览器。 |
| bilibili_videoA | 获取 B 站视频详情及互动统计。无需登录或浏览器。 bvid 来自 bilibili_search 或 bilibili_popular 结果。 |
| bilibili_commentsA | 获取 B 站视频一级评论,支持游标分页。无需登录或浏览器。 bvid 来自 bilibili_search 或 bilibili_popular;下一页传回上次结果中的 next_cursor。评论按 B 站热门评论模式返回。 |
| douban_searchC | 搜索豆瓣书籍、电影、音乐等条目。 |
| douban_subjectA | 获取豆瓣条目详情。subject_id 来自 douban_search。 |
| douban_reviewsC | 获取豆瓣条目的短评/影评。支持 start 分页。 |
| dianping_searchC | 搜索大众点评商户。city 用于给 Agent 记录搜索城市。 |
| dianping_shopA | 获取大众点评商户详情。shop_id 来自 dianping_search。 |
| dianping_reviewsC | 获取大众点评商户评价。 |
| zsxq_topicsB | 获取知识星球 (ZSXQ) 付费社群最新帖子。 纯 REST API,无需浏览器,只需 cookie。 Cookie 文件: ~/.cn-scraper-cookies/zsxq.json (需要 zsxq_access_token) 并发安全: ✅ 纯 HTTP/REST API,无共享状态,任意并发调用安全。 |
| zsxq_articleA | 获取知识星球文章全文。 article_url 来自 zsxq_topics 结果中的 topic 对象, 仅当 topic 类型为文章时可用(talk.article.inline_article_url)。 |
| harvest_cookiesA | 从用户自己的浏览器会话中自动提取 cookie(包括 HttpOnly cookie)。 通过 Chrome DevTools Protocol (CDP) 的 Network.getAllCookies 提取 浏览器 cookie jar 中的所有 cookie(含 HttpOnly,这是 JS 无法获取的)。 仅提取用户自己的浏览器会话——浏览器须已在指定端口运行且已登录。 非 profile 平台的 Cookie 保存到认证注册表指定的 JSON 文件。 京东使用持久化 Chrome profile,请改用 guided_login。 |
| guided_loginA | 打开浏览器让你登录平台,自动检测登录态并收割 Cookie。 自动打开 Chrome → 导航到平台登录页 → 你扫码/输入密码 → 检测到你登录成功后自动收割 Cookie 并保存。 无需手动操作 CDP 端口——全程自动化。 |
| check_cookiesA | 检查所有平台的 cookie 文件是否存在、有效字段及新鲜度。 Cookie 文件查找路径 (按优先级):
Returns: {taobao, xiaohongshu, zhihu, zsxq, jd, pdd: {exists, valid, missing_fields, path, age_hours, stale}} |
| verify_loginA | 远端验证缓存登录态是否仍被平台接受。 这与 check_cookies 的本地文件检查不同:本工具会发起只读在线请求。 当前可远端验证:知乎、微博、知识星球、抖音。 淘宝等没有稳定只读验证接口的平台会明确返回 unsupported。 |
| diagnoseA | 诊断平台环境 — 检查 Python、依赖、Chrome、CDP 端口、Cookie、最近错误。 不做任何实际抓取,纯本地诊断。每项检查超时 5 秒。 Returns: sections: platform: {package_version, python_version} dependencies: {fastmcp: {installed, version}, curl_cffi: {...}, ...} browsers: {chrome: {found, path, version}, obscura: {found, path}} cdp_ports: {9222: {in_use}, 9247: {...}, 9251: {...}} cookies: 来自 check_all_cookies() 的结果 diagnostics: {recent_errors: [...]} |
Prompts
Interactive templates invoked by user choice
| Name | Description |
|---|---|
No prompts | |
Resources
Contextual data attached and managed by the client
| Name | Description |
|---|---|
No resources | |
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/goesByhc/cn-scraper-mcp'
If you have feedback or need assistance with the MCP directory API, please join our Discord server