{"repo":"goesByhc/cn-scraper-mcp","free":true,"listed":false,"github":"https://github.com/goesByhc/cn-scraper-mcp","clone":"git clone https://github.com/goesByhc/cn-scraper-mcp.git","description":"Let AI agents search the Chinese internet via MCP — Taobao, JD, Xiaohongshu, Zhihu, Weibo, Bilibili, ZSXQ, Douban, Dianping, and more.","language":"Python","stars":24,"topics":["ai-agent","bilibili","claude","cursor","jingdong","mcp","mcp-server","python","taobao","web-scraping"],"license":"MIT","category":"mcp-servers","readme_excerpt":"CN Scraper MCP 让 AI Agent 直接搜索中国互联网——淘宝、京东、小红书、知乎、微博、B站、知识星球……不再被反爬墙挡住。 --- 这是什么 每个 AI Agent（Codex、Claude Code、Cursor、Trae）都能搜网页，但中文平台通常需要登录态、浏览器环境或平台专用参数： - 淘宝 ：需要浏览器一致的网络指纹和登录 Cookie - 京东 ：依赖已登录的本地浏览器环境 - 小红书 ：需要住宅 IP、本地浏览器和搜索结果中的访问参数 - 知乎 ：游客搜索已关闭，全部 API 需要登录态 - 拼多多 ：平台限制严格，目前不推荐使用 - 微博 ：搜索 API 需要登录态（SUB token），热搜游客即可访问 - 抖音 ：需要浏览器登录并可能人工处理验证码 - B站 ：搜索、热门、视频详情和评论可直接使用公开 API - 豆瓣 ：条目搜索、条目详情和短评/影评 - 大众点评 ：商户搜索、商户详情和用户评价 - 知识星球 ：付费社群，内容藏在 cookie 认证的 REST API 后面 这个项目就是把踩了好几个月的坑打包成一个 MCP Server ——你的 Agent 一句话就能搜： taobao search(\"儿童学习桌\") 。 安全与隐私 cn-scraper-mcp 在你的电脑上本地运行，不需要把 Cookie、账号密码或浏览器 Profile 上传到任何中转服务器： - Cookie 默认保存在 /.cn-scraper-cookies/ ，京东登录态保存在本地 Chrome Profile。 - 登录过程直接发生在平台官方页面，软件不会读取或保存你的账号密码。 - Cookie 值不会写入日志，也不会通过 MCP 工具结果返回给 Agent；工具只返回状态、字段名和本地路径等非敏感信息。 - 发起抓取或在线登录验证时，凭证只会发送给对应平台域名。 - 代码完全开源，所有凭证处理流程都可以审查。 建议仍像保护浏览器登录态一样保护本机账号：不要分享 Cookie 文件，不要把凭证提交到 Git，并限制本地文件的访问权限。 --- 平台支持 电商 平台 方式 无需浏览器 限制 稳定性 ------ ------ ----------- ------ -------- 淘宝/Tmall curl cffi + MTOP 签名 ✅ 宽松¹ ✅ 稳定 京东/JD Chrome CDP headful 需 Chrome 中等 ✅ 稳定² 拼多多/PDD Chrome CDP + iPhone UA 需 Chrome 单次搜索限制³ ⚠️ 不推荐 ¹ 淘宝无硬性限流，但平台可能随时收紧，不建议高频批量抓取。 ² 京东由本地 Chrome 生成登录态和动态签名，工具读取结构化 API 响应；通过 guided login(\"jd\") 可自动初始化持久化 Profile。 ³ 拼多多每个浏览器会话仅放行第一次搜索，之后永久\"系统繁忙\"。单次搜索结果零实用价值，引擎代码保留但不推荐使用。 内容社区 平台 方式 无需浏览器 限制 稳定性 ------ ------ ----------- ------ -------- 小红书/XHS 本地 Chrome CDP + cookie 需 Chrome 中等⁴ ✅ 稳定 知乎/Zhihu REST API v4 ✅ 正常 ✅ 稳定 知识星球/ZSXQ REST API v2 ✅ 正常 ✅ 稳定 微博/Weibo REST API ✅ 正常 ✅ 稳定 抖音/Douyin ⚠️ Ch","default_branch":null,"files":null,"tree":[],"storefront":"/r/goesByhc","claimed":false,"request_supported":{"post":"https://gitbuyer.com/r/goesByhc/cn-scraper-mcp/request-supported","requests":0},"note":"indexed from public GitHub; nothing is for sale on this page. Clone it from GitHub. Paid listings live at /search."}