{"repo":"LeoMooreCST/crawler321","free":true,"listed":false,"github":"https://github.com/LeoMooreCST/crawler321","clone":"git clone https://github.com/LeoMooreCST/crawler321.git","description":"智能爬虫工具(Crawler321: An intelligent and automatic crawler)","language":"Python","stars":16,"topics":["automation","crawl","crawler","data","python","sqlite3","study","website"],"license":null,"category":"scrapers-browser-automation","readme_excerpt":"crawler321 crawler321 预览版 一定程度上简化了爬虫过程，引入精细化的页面内容提取策略和个性化自定义提取策略，同时引入大语言模型，让网页信息获取更加方便便捷，希望通过像数数\"1,2,3\"一样即可获取你想要的信息 💎 功能和特性 ✏️支持精细化和个性化的提取策略，满足丰富多样的场景需求：如结构化数据、目录型、内容型等 🎯简单而高效的操作，能够自动识别各种各样的网页类型，甚至不用自己指定策略！ 🗒️灵活稳定的结果输出：自动提取网页元数据，以json缩进形式输出 ⚒️友好的用户交互方式：简单的命令让机器像人一般操控网页，如点击、输入、刷新等操作 👼触手可及的人工智能：引入大语言模型，一句话就轻松获取自己最想要的内容 🪄强大的数据备份机制：可提供数据本地存储机制，即使发生中断也能快速获取历史数据 📊丰富充实的数据报告：让你快速定位未成功的请求，多样化的统计数据分析整个crawl过程 📌一键使用的代理策略：能让你迅速摆脱同一机器请求次数过多的问题 🔧 安装使用 coming soon 【代码架构全新升级，敬请期待】","default_branch":null,"files":null,"tree":[],"storefront":"/r/LeoMooreCST","claimed":false,"request_supported":{"post":"https://gitbuyer.com/r/LeoMooreCST/crawler321/request-supported","requests":0},"note":"indexed from public GitHub; nothing is for sale on this page. Clone it from GitHub. Paid listings live at /search."}