browser-collector浏览器自动化+数据采集框架。支持Playwright控制、DdddOcr验证码识别、东方财富/雪球/AKShare金融数据采集。反爬对抗、UA池、代理。
Install via ClawdBot CLI:
clawdbot install wjl1004/browser-collectorGrade Fair — based on market validation, documentation quality, package completeness, maintenance status, and authenticity signals.
Calls external URL not in known-safe list
https://xueqiu.com/Audited Apr 18, 2026 · audit v1.0
Generated May 23, 2026
量化分析师使用Browser Collector自动化采集东方财富的个股行情、涨跌停数据,结合AKShare指数行情,构建并回测交易策略。通过浏览器模式绕过反爬机制,确保数据实时性,支持策略自动化执行。
投资研究员通过EastMoneyCollector获取行业资金流数据,实时监控市场热钱动向。利用浏览器模式采集雪球社区舆论信息,结合涨跌停数据判断市场情绪,辅助投资决策。
数据工程师在采集东方财富受限数据时,利用DdddOcr验证码识别模块自动处理图形验证码。配合Playwright的浏览器自动化,实现无人值守的持续数据采集,降低人工干预成本。
企业在爬取竞品公开金融数据时,通过UA池和代理IP轮换技术规避反爬策略。Playwright浏览器引擎模拟真实用户行为,确保数据采集的稳定性和完整性。
分析师通过命令行工具快速查询涨跌停列表或个股行情,无需编写代码。例如执行`python collectors/cli.py collect eastmoney limit-up --limit 10`,结果可直接用于Excel报表生成。
提供金融数据API订阅,用户按月付费获取清洗后的结构化数据。Browser Collector作为后端引擎,自动采集多源数据并标准化输出。
为客户(如基金公司、研究机构)定制特定数据采集任务,包括反爬策略、验证码识别和定时调度。按项目收费,附加维护费。
提供基础功能开源版本吸引用户,企业版(含高级反爬、代理池、优先支持)按年订阅付费。
💬 Integration Tip
集成时建议优先使用CLI快速验证数据采集流程,待稳定后再嵌入Python脚本。注意配置代理池和UA轮换以应对反爬,对敏感操作使用浏览器模式。
Scored Jul 6, 2026
A fast Rust-based headless browser automation CLI with Node.js fallback that enables AI agents to navigate, click, type, and snapshot pages via structured commands.
Uses a headless browser to navigate web pages, interact with elements, and extract clean, readable text content from URLs.
Headless browser automation CLI optimized for AI agents with accessibility tree snapshots and ref-based element selection
通过已登录的Edge或Chrome浏览器,利用Chrome DevTools Protocol执行JS渲染页面的导航、点击、截图及数据提取等自动化操作。
Send and receive SMS/RCS via Google Messages web interface (messages.google.com). Use when asked to "send a text", "check texts", "SMS", "text message", "Google Messages", or forward incoming texts to other channels.
High-performance browser automation for heavy scraping, multi-tab management, and precise DOM extraction. Use this when you need speed, reliability, or advanced state management (cookies/local storage) beyond standard web fetching.