SpiderFlow智能高效的在线爬虫
Spider Flow 是一个高度灵活可配置的爬虫平台,用户无需编写代码,以流程图的方式,即可实现爬虫。该工具支持多数据源、自动保存至数据库、任务监控、抓取 JS 动态渲染页面、插件扩展(OCR 识别、邮件发送)等功能。
介绍
spider-flow 是一个基于springboot+layui开发的前后端不分离的爬虫平台,以图形化方式定义爬虫流程,无需代码即可实现一个爬虫。
特性
插件
搭建运行
spider-flow 是java开发的根据他的项目结构我很容易的就用idea快速的下载项目并搭建和运行起来
点击Clone后再用idea打开
这样他的项目我们就用idea下载好了,接下来我们用一下他给的数据库sql文件生成一下表这里我用的是navcat。
最后生成数据库和表
修改下他的web程序启动配置 application.properties
好了运行一下项目并访问一下
项目截图
-
SpiderFlow 新一代开源爬虫平台
SpiderFlow:新一代爬虫平台,以图形化方式定义爬虫流程,不写代码即可完成爬虫。概览Spider-Flow是一个开源的、面向所有用户的Web端爬虫构建平台,它使用Java语言编写。该平台的核心优
关注公众号:拾黑(shiheibook)了解更多
赞助链接:
关注数据与安全,洞悉企业级服务市场:https://www.ijiandao.com/
四季很好,只要有你,文娱排行榜:https://www.yaopaiming.com/
让资讯触达的更精准有趣:https://www.0xu.cn/
随时掌握互联网精彩
- RisingWave“奇点无限”开发的云原生流式数据库
- 【有料视频】预算8K选iPhone13 Pro还是iPhone14?
- 芯智慧、共飞腾 | 统信智能终端操作系统适配飞腾E2000平台
- 统信软件携手英特尔打造超能云终端解决方案
- 百度独家获得中国首批自动驾驶全无人商业运营牌照
- Meta公布四款VR原型机,提出“视觉图灵测试”概念
- Win11又升级,经典Windows组件大翻新!
- 《2021战略调查》全球战略趋势:2022年国家安全五大挑战!
- 翻看雷军近10年演讲、采访,我们整理出70条干货
- 为何有厂商后期不给手机DC调光?一加说出真相
- 【大公司创新情报】吉利汽车智能驾驶全球研发中心落户苏州高铁新城
- 你对国产操作系统UOS有何期望?