题名:
数据清洗   / 李法平主编 ,
ISBN:
978-7-302-49327-3 价格: CNY58.00
语种:
chi
载体形态:
xii, 238页 图 26cm
出版发行:
出版地: 北京 出版社: 清华大学出版社 出版日期: 2018
内容提要:
本书共分为8章:第1章主要介绍数据清洗的概念、任务和流程,数据标准化概念及数据仓库技术等;第2章主要介绍Windows和类UNIX操作系统下的数据常规格式、数据编码及数据类型转换等;第3章介绍ETL概念、数据清洗的技术路线、ETL工具及ETL子系统等;第4章介绍Excel、Kettle、OpenRefine、DataWrangler和Hawk的安装及使用等;第5章介绍Kettle下文本文件抽取、Web数据抽取、数据库数据抽取及增量数据抽取等;第6章介绍数据清洗步骤、数据检验、数据错误处理、数据质量评估及数据加载;第7章介绍网页结构,利用网络爬虫技术进行数据采集,利用JavaScript技术进行行为日志数据采集等;第8章介绍RDBMS的数据清洗方法和数据脱敏处理技术等。 
主题词:
数据处理   技术培训
中图分类法:
TP274 版次: 5
主要责任者:
李法平 主编
索书号:
3
索书号:
3