中国金融机构数据爬取工具。全量金融机构名单(1330家,27大类)、A股报告爬取(年报+券商研报+公告)、 产品解析(基金/ETF/FOF/股票/债券)、新闻资讯、反爬+双语展示、金融文档分析整理。 v4.0 反爬增强:UA轮换池(12种真实浏览器)、多策略自动重试、六级降级链、自适应限流、 域名健康熔断、请求指纹随机化、编码智能检测、JSON-LD结构化数据提取、代理支持。 触发词:爬取机构、机构名单、网页爬取、产品解析、公告下载、券商研报、批量爬取、公司批量、文档分析、整理文档、文档对比、基金分析、净值查询
cn-financial-scraper 金融数据爬虫
功能概述
cn-financial-scraper 金融数据爬虫是一项面向实际任务的技能,主要用于全量机构名单(1330家/27大类) | A股报告爬取 | 券商研报 | 公告下载 | 产品解析 | v4.0 增强反爬 | 金融文档分析 | 实时行情 | 可转债;标准安装 : python setup_env.py 自动安装依赖,或 pip install -r requirements.txt;
核心要点
- 可选增强: scrapl。
- 它将相关步骤、工具调用和结果整理方式集中到统一流程中,帮助使用者更快完成目标并减少重复操作。
- 从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。
使用与执行
实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;
结果检查与注意事项
涉及批量任务时,还应保存进度,避免中断后重复操作。该技能适合用于一次性任务,也可以接入自动化工作流,与其他技能或上层代理配合完成更完整的业务链路;在组合使用时,应明确每一步的输入输出关系,并避免不同步骤之间出现参数冲突。
目录
