机读格式显示(MARC)
- 000 01641nam0 2200265 450
- 010 __ |a 978-7-301-30765-6 |d CNY89.00
- 100 __ |a 20191111d2019 em y0chiy50 ea
- 200 1_ |a Python数据分析与大数据处理从入门到精通 |A Python shu ju fen xi yu da shu ju chu li cong ru men dao jing tong |f 朱春旭编著
- 210 __ |a 北京 |c 北京大学出版社 |d 2019
- 330 __ |a 本书主要讲解数据分析与大数据处理所需的技术、基础设施、核心概念、实施流程。从编程语言准备、数据采集与清洗、数据分析与可视化,到大型数据的分布式存储与分布式计算,贯穿了整个大数据项目开发流程。本书轻理论、重实践,目的是让读者快速上手。第1篇首先介绍了Python的基本语法、面向对象开发、模块化设计等,掌握Python的编程方式。第2篇介绍了网络数据采集、数据清洗、数据存储等技术。第3篇介绍了Python常用的数据分析工具,扩展了更多的数据清洗、插值方法,为最终的数据可视化奠定基础。第4篇是大数据分析的重点。首先介绍了Hadoop的框架原理、调度原理,MapReduce原理与编程模型、环境搭建,接着介绍了Spark框架原理、环境搭建方式,以及如何与Hive等第三方工具进行交互,还介绍了最新的结构化流式处理技术。第5篇通过三个项目实例,综合介绍了如何分析网页、如何搭建分布式爬虫、如何应对常见的反爬虫、如何设计数据模型、如何设计架构模型、如何在实践中综合运用前四篇涉及的技术。
- 606 0_ |a 面向对象语言,Python |A mian xiang dui xiang yu yan,Python |x 软件工具 |x 程序设计
- 610 0_ |a Python |A Python
- 701 _0 |a 朱春旭 |A zhu chun xu |4 编著
- 801 _0 |a CN |b HDUL |c 20191203
- 905 __ |a HDUL |d TP311.561/2541