Skip to main content
Glama
goesByhc
by goesByhc

Server Configuration

Describes the environment variables required to run the server.

NameRequiredDescriptionDefault

No arguments

Capabilities

Features and capabilities supported by this server

CapabilityDetails
tools
{
  "listChanged": true
}
logging
{}
prompts
{
  "listChanged": false
}
resources
{
  "subscribe": false,
  "listChanged": false
}
extensions
{
  "io.modelcontextprotocol/ui": {}
}
experimental
{}

Tools

Functions exposed to the LLM to take actions

NameDescription
taobao_search

搜索淘宝/天猫商品。纯脚本,无需浏览器,不限流。

原理: curl_cffi 伪造 Chrome TLS 指纹 + MTOP HMAC-MD5 签名。 需要 TAOBAO_COOKIES_FILE 环境变量或 ~/.cn-scraper-cookies/taobao.json。

并发安全: ✅ 纯 HTTP/REST API,无共享状态,任意并发调用安全。

jd_searchA

搜索京东商品。需要已登录的有头 Chrome(会自动启动)。

京东 headless 返回 0 结果 → 必须 headful。 需要持久登录 profile (~/.jd_login_profile)。 首次使用需在弹窗 Chrome 中手动登录 jd.com 一次。

并发: ⚠️ 使用 BrowserLock 保护 CDP 端口,同端口调用自动串行化。

jd_productA

获取京东商品详情(名称、价格、店铺、规格)。需要本地 Chrome。

sku 来自 jd_search 结果中 item 的 sku 字段。

并发: ⚠️ 使用 BrowserLock 保护 CDP 端口。

pdd_searchA

搜索拼多多商品。需要 Chrome + PDD cookie(PDDAccessToken + pdd_user_id)。

⚠️ 严重限制:拼多多手机搜索每个浏览器会话仅允许一次搜索。 第一次搜索后,所有后续搜索返回「系统繁忙」。 如需再次搜索,必须重启 MCP server 以创建新的浏览器会话。

原理: Chrome CDP + iPhone UA 模拟手机浏览器搜索。 Cookie 文件: ~/.cn-scraper-cookies/pdd.json Token 有效期约 1 小时,需定期从手机浏览器重新导出。

并发: ⚠️ 使用 BrowserLock 保护 CDP 端口,同端口调用自动串行化。

pdd_product_detail

获取拼多多商品详情(名称、价格、原价、销量、规格)。

商品详情独立于搜索限制 — 不限次数。

xiaohongshu_search

搜索小红书笔记。需要本地 Chrome + XHS 登录 cookie。

小红书只允许住宅 IP(本地 Chrome)——云浏览器/数据中心 IP 直接封。 需要 XHS cookies: web_session, a1, webId, gid 等。 Cookie 文件: ~/.cn-scraper-cookies/xiaohongshu.json

并发: ⚠️ 使用 BrowserLock 保护 CDP 端口,同端口调用自动串行化。

xiaohongshu_noteA

获取小红书笔记详情(标题、正文、点赞、标签、评论)。

note_id 和 xsec_token 都来自同一条 xiaohongshu_search 结果。

xiaohongshu_comments

获取小红书笔记的评论(首屏,约 10-20 条)。

需要本地 Chrome + XHS 登录 cookie。 note_id 和 xsec_token 都来自同一条 xiaohongshu_search 结果。

zhihu_searchA

搜索知乎内容(问题/文章)。知乎已关闭游客搜索,需要有效登录 Cookie。

无需浏览器——直接调知乎 v4 search API。 需要 cookie: ~/.cn-scraper-cookies/zhihu.json(z_c0 + d_c0)

并发安全: ✅ 纯 HTTP/REST API,无共享状态,任意并发调用安全。

zhihu_hot_list

获取知乎实时热榜。无需登录。

Returns: {items: [{title, url, excerpt, hot_metric}]}

zhihu_comments

获取知乎回答的评论(支持分页)。需要登录 cookie。

answer_id 来自 zhihu_search 结果中 type 为 "answer" 的 item 的 id 字段。

zhihu_answerA

获取知乎回答的完整正文。

answer_id 来自 zhihu_search 结果中 type 为 "answer" 的 item 的 id 字段。

zhihu_question_answersA

获取知乎问题下的回答列表。

question_id 来自 zhihu_search 结果中 type 为 "question" 的 item 的 id 字段。

weibo_searchA

搜索微博帖子。需要登录 cookies(SUB token)。

⚠️ 微博搜索 API 需要登录 — 游客模式不可用。 热搜(weibo_hot_list)无需登录即可使用。

原理: 调用 m.weibo.cn 移动端 API,解析 cards[].mblog。 Cookie 文件: ~/.cn-scraper-cookies/weibo.json(需要 SUB cookie)

并发安全: ✅ 纯 HTTP/REST API,无共享状态,任意并发调用安全。

weibo_hot_listA

获取微博实时热搜榜。无需登录!

原理: 调用 weibo.com/ajax/side/hotSearch(游客可访问)。 返回实时热搜 50 条 + 置顶政务话题。

并发安全: ✅ 纯 HTTP/REST API,无共享状态,任意并发调用安全。

Returns: {count, items: [{rank, word, num, url, label}], hotgov: {name, url}|null}

weibo_user_timelineA

获取微博用户时间线(最近发言)。

需要登录 cookie(SUB token)。 可通过 weibo_search 找到目标用户获取其 UID。

weibo_comments

获取微博帖子的评论(支持分页)。需要登录 cookie(SUB token)。

mid 来自 weibo_search 或 weibo_user_timeline 结果中 item 的 id 字段。

taobao_productA

获取淘宝商品详情(标题、价格、店铺)。

item_id 来自 taobao_search 结果中 item 的 id 字段。

并发安全: ✅ 纯 HTTP/MTOP API。

weibo_postA

获取微博帖子的完整详情(含长文本)。

mid 来自 weibo_search 或 weibo_user_timeline 结果中的 item.id。

douyin_searchA

搜索抖音视频 — CDP 浏览器自动轮询,验证码自动等待。

需要 Chrome 已登录抖音(用 guided_login 先登录)。 弹出验证码时持续等待你手动过,通过后自动抓取结果。

douyin_hot_list

抖音实时热搜榜。需要登录 cookie(首次用 guided_login 收割)。

Returns: {count, items: [{word, hot_value, position, label}]}

douyin_videoA

获取抖音视频详情(标题、作者、点赞、描述)。需要 Chrome。

video_id 来自 douyin_search 结果中 item 的 video_id 字段。

douyin_comments

获取抖音视频评论(首屏)。需要登录 cookie。

video_id 来自 douyin_search 结果中 item 的 video_id 字段。

bilibili_search

搜索 B 站视频。公开 HTTP API,无需登录或浏览器。

bilibili_popularA

获取 B 站当前热门视频榜。公开 HTTP API,无需登录或浏览器。

bilibili_videoA

获取 B 站视频详情及互动统计。无需登录或浏览器。

bvid 来自 bilibili_search 或 bilibili_popular 结果。

bilibili_commentsA

获取 B 站视频一级评论,支持游标分页。无需登录或浏览器。

bvid 来自 bilibili_search 或 bilibili_popular;下一页传回上次结果中的 next_cursor。评论按 B 站热门评论模式返回。

douban_searchC

搜索豆瓣书籍、电影、音乐等条目。

douban_subjectA

获取豆瓣条目详情。subject_id 来自 douban_search。

douban_reviewsC

获取豆瓣条目的短评/影评。支持 start 分页。

dianping_searchC

搜索大众点评商户。city 用于给 Agent 记录搜索城市。

dianping_shop

获取大众点评商户详情。shop_id 来自 dianping_search。

dianping_reviewsC

获取大众点评商户评价。

zsxq_topicsB

获取知识星球 (ZSXQ) 付费社群最新帖子。

纯 REST API,无需浏览器,只需 cookie。 Cookie 文件: ~/.cn-scraper-cookies/zsxq.json (需要 zsxq_access_token)

并发安全: ✅ 纯 HTTP/REST API,无共享状态,任意并发调用安全。

zsxq_articleA

获取知识星球文章全文。

article_url 来自 zsxq_topics 结果中的 topic 对象, 仅当 topic 类型为文章时可用(talk.article.inline_article_url)。

harvest_cookies

从用户自己的浏览器会话中自动提取 cookie(包括 HttpOnly cookie)。

通过 Chrome DevTools Protocol (CDP) 的 Network.getAllCookies 提取 浏览器 cookie jar 中的所有 cookie(含 HttpOnly,这是 JS 无法获取的)。 仅提取用户自己的浏览器会话——浏览器须已在指定端口运行且已登录。

非 profile 平台的 Cookie 保存到认证注册表指定的 JSON 文件。 京东使用持久化 Chrome profile,请改用 guided_login。

guided_loginA

打开浏览器让你登录平台,自动检测登录态并收割 Cookie。

自动打开 Chrome → 导航到平台登录页 → 你扫码/输入密码 → 检测到你登录成功后自动收割 Cookie 并保存。

无需手动操作 CDP 端口——全程自动化。

check_cookiesA

检查所有平台的 cookie 文件是否存在、有效字段及新鲜度。

Cookie 文件查找路径 (按优先级):

  1. 平台专用环境变量 (如 TAOBAO_COOKIES_FILE)

  2. ~/.cn-scraper-cookies/.json (推荐) JD 特殊: 检查 Chrome profile 目录 ~/.jd_login_profile

Returns: {taobao, xiaohongshu, zhihu, zsxq, jd, pdd: {exists, valid, missing_fields, path, age_hours, stale}}

verify_loginA

远端验证缓存登录态是否仍被平台接受。

这与 check_cookies 的本地文件检查不同:本工具会发起只读在线请求。 当前可远端验证:知乎、微博、知识星球、抖音。 淘宝等没有稳定只读验证接口的平台会明确返回 unsupported。

diagnoseA

诊断平台环境 — 检查 Python、依赖、Chrome、CDP 端口、Cookie、最近错误。

不做任何实际抓取,纯本地诊断。每项检查超时 5 秒。

Returns: sections: platform: {package_version, python_version} dependencies: {fastmcp: {installed, version}, curl_cffi: {...}, ...} browsers: {chrome: {found, path, version}, obscura: {found, path}} cdp_ports: {9222: {in_use}, 9247: {...}, 9251: {...}} cookies: 来自 check_all_cookies() 的结果 diagnostics: {recent_errors: [...]}

Prompts

Interactive templates invoked by user choice

NameDescription

No prompts

Resources

Contextual data attached and managed by the client

NameDescription

No resources

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/goesByhc/cn-scraper-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server