🕷️ 通用爬虫系统
🔍
运行中任务: 0
☀️
🗑️ 回收站
0
⟳ 刷新
+ 新建任务
0
📋 任务总数
0
🔄 正在运行
0
📊 累计运行次数
0
✅ 成功页面
0
❌ 失败页面
0
🖼️ 已爬图片
0
💾 磁盘占用
🕸️
还没有爬取任务
+ 创建第一个任务
新建爬取任务
✕
📄 批量爬取
⏰ 定时爬取
🤖 自动爬取
项目名称 *
输出目录
爬取间隔(秒) 最小
最大
单页超时(秒)
失败重试次数
重试间隔(秒)
爬取图片
完成后邮件通知
通知邮箱
网址列表(每行一个,# 开头为注释)
首次执行时间(可留空;留空 = 尽快执行;已过的时间将立即执行)
调度类型
间隔调度(每 N 时间)
cron 表达式
启用调度
每隔
单位
分钟
小时
天
cron 表达式(分 时 日 月 周,周 0/7=周日)
起始网址 *(系统将自动发现符合规则的链接并爬取)
🧪 试爬取
包含规则(每行一个,子串或正则)
排除规则
仅爬同域名
规则按正则匹配
最大页数
最大爬取深度
取消
保存
任务详情
✕
🔍 搜索结果
✕
🗑️ 回收站(删除的任务统一在这里,可恢复或彻底删除)
✕
🧪 试爬取结果(规则筛选预览)
✕
📋 资源操作信息(元数据)
✕
预览
✕