大数据交换汇集平台解决方案_第1页
大数据交换汇集平台解决方案_第2页
大数据交换汇集平台解决方案_第3页
大数据交换汇集平台解决方案_第4页
大数据交换汇集平台解决方案_第5页
已阅读5页,还剩7页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、大数据交换汇集平台解决方案技术创新,变革未来大数据交换汇集平台ETL、ESB、爬虫、Kafka、消息中间件原始数据源数据采集交换区大数据存储分散、种类多样化,时效性差异大多种技术手段,平台化系统,快速部署,统一监控管理为大数据应用提供全兼容数据存储任务流程调度操作控制流程控制转换流程数据抽取数据加载数据转换调度操作控制子任务Pyspider(互联网爬虫)Spark Streaming + kafka(流数据)大数据交换汇集ETL丰富的ETL构件库ETL界面及效果提高开发效率缩短周期 图形化界面创建数据采集转换、抽取、清洗作业; 支持智能采集; 丰富的数据交换功能 支持多种数据库、实时接口及库表

2、交换、文件交换; 支持全量、增量方式的数据捕捉方式; 实现复杂数据处理 零编码的数据处理产品;零编码图形化拖拽方式,完成数据抽取、转化、清洗设计; 支持多种存储架构 支持hadoop、Mpp、传统数仓多层次安全机制保障 支持分级分域授权、三员分离;支持通道安全,支持SSL传输通道加密功能;支持数据加密,支持国密算法;支持交换全过程监控、审计,并提供邮件、短信预警功能;ETL的监控管理单一业务的任务详情图形化展示任务执行日志任务运行情况变化曲线全方位洞察一项任务执行定义指定任务的报警规则定制指定任务的报警渠道指定报警信息的接收者根据需要控制告警规则的启用与关闭告警帮你随时把握任务异常可视化手段多

3、角度作业监控作业执行状态与成功率监控对作业进行多角度排序ETL任务执行一览无余 四方伟业互联网爬虫工具是一个集成在数据模块下的自动下载网页的程序,它根据既定的抓取目标,有选择的访问网页与相关的链接,获取所需要的信息,无需安装任何软件,挖掘互联网数据、配置规则简单(支持循环翻页、集合、点击事件、模拟账号登录)支持分布式采集、定时循环采集、有效的防范IP被封,支持采集数据导出,并且能够对接各种主流存储结构的面向主题爬虫。用户应用爬虫引擎运行管理监控平台配置管理统计查询解析器任务调度中心应用支撑定制化模块任务管理数据处理监控日志管理互联网分页数据多层网页复杂网页事件网页互联网爬虫工具互联网爬虫工具-

4、界面展示案例-工商局大数据服务项目案例-工商局大数据服务项目一周内完成近20000户网店信息采集及比对数据本身价值超过10万元4天完成18725户企业官网信息合法性检测一月内完成全成都市220万户企业主体信息的采集,并实现每半月滚动更新一次一个月完成40万户企业ICP备案信息采集企业主体信息: 220万户 (近亿条数据) 企业ICP备案信息:40万户 (200多万条数据)企业官网信息: 3W户 (8.6万条数据)企业店铺信息: 2W户 (6.5万条数据)沉淀的数据:宁夏工业大数据平台成都市市工商局网络交易监管大数据服务云南烟草网络营销大数据分析广东环境监测大数据平台商洛精准扶贫大数据项目宜宾珙县精准扶贫大数据项目自贡市政务大数据平台衡水监控大数据分析平台软件开发项目广元市农村基础

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论