{"repo":"wukan1986/mcp_query_table","free":true,"listed":false,"github":"https://github.com/wukan1986/mcp_query_table","clone":"git clone https://github.com/wukan1986/mcp_query_table.git","description":"query table from some websites, support MCP","language":"Python","stars":55,"topics":["eastmoney","playwright","tdx","iwencai","mcp"],"license":"MIT","category":"mcp-servers","readme_excerpt":"mcp query table 1. 基于 playwright 实现的财经网页表格爬虫，支持 Model Context Protocol (MCP) 。目前可查询来源为 - 同花顺问财 - 通达信问小达 - 东方财富条件选股 实盘时，如果某网站宕机或改版，可以立即切换到其他网站。(注意：不同网站的表格结构不同，需要提前做适配) 2. 基于 playwright 实现的大语言模型调用爬虫。目前可用来源为 - 纳米搜索 - 腾讯元宝 - 百度AI搜索 RooCode 提供了 Human Reply 功能。但发现 纳米搜索 网页版复制时格式破坏，所以研发了此功能 安装 使用 注意事项 1. 浏览器最好是 Chrome 。如一定要使用 Edge ,除了关闭 Edge 所有窗口外，还要在任务管理器关闭 Microsoft Edge 的所有进程，即 taskkill /f /im msedge.exe 2. 浏览器要保证窗口宽度，防止部分网站自动适配成手机版，导致表格查询失败 3. 如有网站账号，请提前登录。此工具无自动登录功能 4. 不同网站的表格结构不同，同条件返回股票数量也不同。需要查询后做适配 工作原理 不同于 requests ， playwright 是基于浏览器的，模拟用户在浏览器中的操作。 1. 不需要解决登录问题 2. 不需要解决请求构造、响应解析 3. 可以直接获取表格数据，所见即所得 4. 运行速度慢于 requests ，但开发效率高 数据的获取有： 1. 直接解析HTML表格 1. 数字文本化了，不利于后期研究 2. 适用性最强 2. 截获请求，获取返回的 json 数据 1. 类似于 requests ，需要做响应解析 2. 灵活性差点，网站改版后，需要重新做适配 此项目采用的是模拟点击浏览器来发送请求，使用截获响应并解析的方法来获取数据。 后期会根据不同的网站改版情况，使用更适合的方法。 无头模式 无头模式运行速度更快，但部分网站需要提前登录，所以，无头模式一定要指定 user data dir ，否则会出现需要登录的情况。 - endpoint=None 时， headless=True 可无头启动新浏览器实例。指定 executable path 和 user data dir ，才能确保无头模式下正常运行。 - endpoint 以 http:// 开头，连接 CDP 模式启动的有头浏览器，参数必有 --remote-debugging-port 。 executable path 为本地浏览器路径。 - endpoint 以 ws:// 开头，连接远程 Playwright Server 。也是无头模式，但无法指定 user data dir ，所以使用受限 - 参考：https://playwright.dev/python/docs/docker#running-the-playwright-server Chrome 新版的安全策略使用默认 user data dir 时将无法创建 CDP 服务，建议重新复制配置目录到其他地方 MCP支持 确保可以在控制台中执行 python -m mcp query table -h 。如果不能，可能要先 pip install mcp query table 在 Cline 中可以配置如下。其中 command 是 python 的绝对路径， timeout 是超时时间，单位为秒。 在各 AI 平台中由于返回时间常需1分钟以上，所以需要设置大的超时时间。 STDIO方式 S","default_branch":null,"files":null,"tree":[],"storefront":"/r/wukan1986","claimed":false,"request_supported":{"post":"https://gitbuyer.com/r/wukan1986/mcp_query_table/request-supported","requests":0},"note":"indexed from public GitHub; nothing is for sale on this page. Clone it from GitHub. Paid listings live at /search."}