SpiderFlow智能高效的在线爬虫
Spider Flow 是一个高度灵活可配置的爬虫平台,用户无需编写代码,以流程图的方式,即可实现爬虫。该工具支持多数据源、自动保存至数据库、任务监控、抓取 JS 动态渲染页面、插件扩展(OCR 识别、邮件发送)等功能。
介绍
spider-flow 是一个基于springboot+layui开发的前后端不分离的爬虫平台,以图形化方式定义爬虫流程,无需代码即可实现一个爬虫。
特性

插件

搭建运行
spider-flow 是java开发的根据他的项目结构我很容易的就用idea快速的下载项目并搭建和运行起来

点击Clone后再用idea打开

这样他的项目我们就用idea下载好了,接下来我们用一下他给的数据库sql文件生成一下表这里我用的是navcat。


最后生成数据库和表

修改下他的web程序启动配置 application.properties

好了运行一下项目并访问一下

项目截图

-
SpiderFlow 新一代开源爬虫平台
SpiderFlow:新一代爬虫平台,以图形化方式定义爬虫流程,不写代码即可完成爬虫。概览Spider-Flow是一个开源的、面向所有用户的Web端爬虫构建平台,它使用Java语言编写。该平台的核心优
关注公众号:拾黑(shiheibook)了解更多
赞助链接:
关注数据与安全,洞悉企业级服务市场:https://www.ijiandao.com/
四季很好,只要有你,文娱排行榜:https://www.yaopaiming.com/
让资讯触达的更精准有趣:https://www.0xu.cn/
关注网络尖刀微信公众号随时掌握互联网精彩
- granimjs:给网页背景 元素 文字添加交互式的渐变效果
- Claude 美国Anthropic发布的大型语言模型
- 【杂谈快报】三星或面临有史以来首次罢工,因涨薪幅度未达工会要求;腾讯联通官宣!新公司成立
- 结束十年VR工作,John Carmack从Meta离职
- Windows真难用!试试国产系统?
- 秉承初心使命,微软搭建通往零信任的数字安全桥梁
- 张一鸣离任左晖离世;腾讯回应“金融监管”影响;赛格大厦进出管理处:检测完成后有序开放 | Do早报
- 如何正经的测网速?
- 【周末荐书】销声匿迹: 数字化工作的真正未来
- 北京网约车暂停拼车业务;联想发布新款ThinkPad X1 Titanium Yoga笔记本;腾讯启动碳中和规划【Do说】
- Microsoft 365 Online CIE 系列课程
- 员工称不接受降薪被高管打伤



微信扫码关注公众号