简介
Spark SQL是 Spark大数据框架的一部分,支持使用标准SQL查询和HiveQL来读写数据,可用于结构化数据处理,并可以执行类似SQL的Spark数据查询,有助于开发人员更快地创建和运行Spark程序。 全书分为4篇,共9章,第一篇讲解了Spark SQL 发展历史和开发环境搭建。第二篇讲解了Spark SQL 实例,使得读者掌握Spark SQL的入门操作,了解Spark RDD、DataFrame和DataSet,并熟悉 DataFrame 各种操作。第三篇讲解了基于WiFi探针的商业大数据分析项目,实例中包含数据采集、预处理、存储、利用Spark SQL 挖掘数据,一步一步带领读者学习Spark SQL强大的数据挖掘功能。第四篇讲解了Spark SQL 优化的知识。 本书适合Spark初学者、Spark数据分析人员以及Spark程序开发人员,也适合高校和培训学校相关专业的师生教学参考。
编辑推荐
适读人群 :Spark初学者、Spark数据分析人员以及Spark程序开发人员 (1)讲解Spark SQL背景知识、编程基础 (2)通过一个工程实例让读者领略Spark SQL强大简便的分析能力 (3)学习构建一个大数据实际应用的方法,加强工程思维 (4)洞悉Spark的调优方式及其思想,让Spark SQL程序高效运行
更多出版物信息
- 版权: 清华大学出版社
- 出版: 2018-04-01
- 更新: 2023-07-10
- 书号:9787302496700
- 中图:TP274
- 学科:工学控制科学与工程工学计算机科学与技术