软件介绍/功能
软件特色
模板采集
模板采集模式内置上百种主流网站数据源,如京东、天猫、大众点评等热门采集网站,只需参照模板简单设置参数,就可以快速获取网站公开数据。
智能采集
八爪鱼采集可根据不同网站,提供多种网页采集策略与配套资源,可自定义配置,组合运用,自动化处理。从而帮助整个采集过程实现数据的完整性与稳定性。
云采集
由5000多台云服务器支撑的云采集,7*24小时不间断运行,可实现定时采集,无需人员值守,灵活契合业务场景,帮你提升采集效率,保障数据时效性。
API接口
通过八爪鱼API,可以轻松获取八爪鱼任务信息和采集到的数据,灵活调度任务,比如远程控制任务启动与停止,高效实现数据采集与归档。基于强大的API体系,还可以无缝对接公司内部各类管理平台,实现各类业务自动化。
自定义采集
针对不同用户的采集需求,八爪鱼可提供自动生成爬虫的自定义模式,可准确批量识别各种网页元素,还有翻页、下拉、ajax、页面滚动、条件判断等多种功能,支持不同网页结构的复杂网站采集,满足多种采集应用场景。
便捷定时功能
简单几步点击设置,即可实现采集任务的定时控制,不论是单次采集的定时设置,还是预设某一天或是每周每月的定时采集,都可以同时对多个任务自由进行设置,根据需要对选择时间进行多重组合,灵活调配自己的采集任务。
全自动数据格式化
八爪鱼内置了强大的数据格式化引擎,支持字符串替换、正则表达式替换或匹配、去除空格、添加前缀或后缀、日期时间格式化、HTML转码等多项功能,采集过程中全自动处理,无需人工干预,即可得到所需格式数据。
多层级采集
很多主流新闻、电商类的网站,里面包含一级商品列表页,也包含二级商品详情页,还有三级评论详情页面;不论网站有多少层级,八爪鱼都可以不限制层级的采集数据,满足各类业务采集需求。
更新日志
八爪鱼采集器 最新版
采集与数据导出
新增“自动导出到本地文件”功能。本地或云采集完成后,自动导出已采集的数据文件(Excel、Csv、Html、Json、Xml)到本地电脑
新增本地采集“等待运行”状态。批量设置本地定时自动采集的时候,超出同时启动任务数限制时自动进入排队等待采集
新增查看本地采集历史采集信息。点击任务列表的“电脑图标”可以查看最近一次的采集历史信息
优化手动导出到数据库配置流程和交互
自动入库工具
新增入库计划批量操作(启/停、删除、设置)
新增入库信息字段内容(任务名称、数据库类型、执行周期)
新增支持直接修改入库计划配置信息
新增错误日志提醒小红标
优化入库工具操作交互界面
企业版本协作
企业版主账号通过任务列表“筛选器”查看企业成员账号任务状态
企业版主账号支持管理企业成员账号的任务:启/停止、复制、定时、导出数据等
其它
新增触发器条件“为空”的判断
修复部分任务无法采集、列表无数据的故障
修复本地采集日志信息重复和顺序错乱的问题
优化修复其它已知bug问题
历史版本
- 八爪鱼采集器8.7.2 正式版 简体中文 win7或更高版本 2024-08-16
- 八爪鱼采集器8.7.0 正式版 简体中文 win7或更高版本 2024-05-16
- 八爪鱼采集器8.6.8 正式版 简体中文 win7或更高版本 2024-04-18
- 八爪鱼采集器8.6.7 正式版 简体中文 win7或更高版本 2023-11-16
- 八爪鱼采集器8.6.4 正式版 简体中文 win7或更高版本 2023-08-17