全部评论(1条)
-
- yzz1223 2017-12-20 00:00:00
- 步骤1 打开网页登陆八爪鱼7.0采集器→点击左上角的“+”图标→选择自定义采集(也可以点击主页中自定义采集下方的“立即使用”),进入到任务配置页面。然后输入网址→保存网址,系统会进入到流程设计页面并自动打开前面输入的网址。 网页打开后,我们可以对任务名进行修改,不修改则默认以网页标题命名。在运行采集前可随时修改任务名。步骤2 提取数据在网页中,直接选中需要提取的数据即可,窗口右上角会有对应的提示。本教程中我们以提取新闻标题、日期、正文为例,请各位灵活运用,各取所需。提取数据设置好,即可点击保存并开始运行采集。但是此时的字段名为系统自动生成的。为了更加符合自己需求,可点击右上角“流程”进入流程页面对字段名进行修改。首先选中要修改中字段名,此时下拉框中会有备选字段名,可直接选取使用。如果没自己想要的,就输入新的字段名。修改好字段名后,点击“确定”进行保存。保存后即可运行采集。 所有版本均可运行本地采集,旗舰版及以上版本可运行云采集和设置定时云采集,但运行云采集前先运行本地采集进行测试。任务运行完采集后,可选Excel、CSV、HTML等格式进行导出或导入数据库。数据导出后可点击链接进入数据存放文件夹内查看数据,文件默认以任务名命名。1.八爪鱼采集原理八爪鱼网页数据采集客户端使用的开发语言是C#,运行在Windows系统。客户端主程序负责任务配置及管理,任务的云采集控制,云集成数据的管理(导出,清理,发布)。数据导出程序负责数据的导出Excel,SQL,TXT,MYSQL等,支持一次导出别数据。本地采集程序负责根据工作流对网页进行打开,抓取,采集数据,通过正则表达式与Xpath原理,快速获取网页数据。整个采集流程基于Firefox内核浏览器,通过模拟人的思维操作方式(如打开网页,点击网页中的某个按钮),对网页内容进行全自动提取。系统完全可视化流程操作,无需专业知识,轻松实现数据采集。通过对网页源码中各个数据XPath路径的精确定位,八爪鱼可以批量化jing准采集出用户所需数据。2.八爪鱼实现的功能 八爪鱼网页数据采集系统以完全自主研发的分布式云计算平台为核心,可以在很短的时间内,轻松从各种不同的网站或者网页获取大量的规范化数据,帮助任何需要从网页获取信息的客户实现数据自动化采集、编辑、规范化,摆脱对人工搜索及收集数据的依赖,从而降低获取信息的成本、提GX率。涉及到政府、高校、企业、银行、电商、科研、汽车、房产、媒体等众多行业及领域。八爪鱼作为一款通用的网页数据采集器,其并不针对于某一网站某一行业的数据进行采集,而是网页上所能看到或网页源码中有的文本信息几乎都能采集,市面上98%的网页都可以用八爪鱼进行采集。使用本地采集(单机采集),除了可以实现绝大多数网页数据的爬取,还可以采集过程中对数据进行初步的清洗。如使用程序自带的正则工具,利用正则表达式将数据格式化。在数据源头即可实现去除空格、筛选日期等多种操作。其次八爪鱼还有提供分支判断功能,可对网页中信息进行是与否的逻辑判断,实现用户筛选需求。云采集除具有本地采集(单机采集)的全部功能之外,还可以实现定时采集,实时监控,数据自动去重并入库,增量采集,自动识别验证码,API接口多元化导出数据以及修改参数。同时利用云端多节点并发运行,采集速度将远超于本地采集(单机采集),多IP在任务启动时自动切换还可避免网站的IP封锁,实现采集数据的Z大化。
-
赞(10)
回复(0)
热门问答
- 八角鱼采集器怎么使用?
2017-12-19 18:07:03
321
1
- 有人会用八角鱼采集器的吗?
2014-10-28 12:47:15
283
2
- 八爪鱼采集器 采集的数据有什么用
2017-12-14 18:18:09
377
1
- 采集器怎么接法?
2017-01-12 03:13:07
243
1
- 八爪鱼采集器:循环列表采集,其中有数据丢失
- 按照顺序下来,1612个数据Z后只有672了。。。为啥啊。。。... 按照顺序下来,1612个数据Z后只有672了。。。为啥啊。。。 展开
2014-12-22 18:48:46
488
1
- 大数据可以靠八爪鱼采集器采集吗
2016-05-04 10:52:00
407
1
- 八爪鱼采集器怎么把数据发布到网站?我不懂!求教啊!!!!!
- 怎么填图片中的栏目,填什么?我是seo,想把采集到的文章直接发布到自己网站上去!... 怎么填图片中的栏目,填什么?我是seo,想把采集到的文章直接发布到自己网站上去! 展开
2015-11-02 06:32:05
493
1
- 八爪鱼采集器如何写AJAX网页数据的采集规则
- 现在用AJAX技术的网站很多啊,我想用八爪鱼来采集微博的有关爸爸去哪儿2和世界杯这两个主题相关的Z新的话题,他规则市场里面的微博话题采集规则我要怎么修改啊,谁来告诉我一下啊... 现在用AJAX技术的网站很多啊,我想用八爪鱼来采集微博的有关爸爸去哪儿2和世界杯这两个主题相关的Z新的话题,他规则市场里面的微博话题采集规则我要怎么修改啊,谁来告诉我一下啊 展开
2014-07-07 09:21:50
270
2
- 八爪鱼采集器导出数据需要积分,积分必须购买吗?
2018-12-01 15:36:05
324
0
- 用八爪鱼采集器采集出来的信息为什么会重复
2015-11-02 03:05:42
707
2
- 为什么说八爪鱼采集器是Z好用的网页数据采集器
2017-02-11 14:00:31
300
3
- 电力采集器怎么连接电度表
2014-09-24 03:27:14
401
4
- 幸运鱼投影灯如何使用
2018-12-03 07:16:47
354
0
- 鱼食料怎么制作?
2018-03-18 14:41:16
244
1
- 鱼食料怎么制作
- 鱼食料怎么制作? 具体的制作方法? 草鱼的食料,鲫鱼的食料等等的具体方法? 钓鱼用的哦 我试了管用另加分
2017-11-24 21:11:33
269
1
- 可以用八爪鱼采集器采集到这些数据内容和图片吗?
- 求火车采集器大神帮忙:如图1,我需要把很多如下的网址链接的地址、货号、批发价、标题、尺码、颜色分别采集到EXCEL各个字段去,并且下载当面的所有主图(如图2)及描述内容的所有图片... 求火车采集器大神帮忙:如图1,我需要把很多如下的网址链接的地址、货号、批发价、标题、尺码、颜色分别采集到EXCEL各个字段去,并且下载当面的所有主图(如图2)及描述内容的所有图片(如图3)到指定的文件夹去。我要怎么样才可以做到呢vvic.com/item/4843151vvic.com/item/4559377vvic.com/item/4491789vvic.com/item/4673045vvic.com/item/4559232vvic.com/item/4672897 展开
2017-05-17 16:39:53
476
1
- 八爪鱼采集器3.2版本是免费的吗?新增了什么功能?
- 我用的八爪鱼采集器3.1版本的,想升级到3.2版本,不知道功能上这次新增了哪些?... 我用的八爪鱼采集器3.1版本的,想升级到3.2版本,不知道功能上这次新增了哪些? 展开
2014-07-16 03:50:03
410
1
10月突出贡献榜
推荐主页
最新话题
参与评论
登录后参与评论