本书以项目实践作为主线,结合必需的理论知识,以任务的形式进行内容设计,每个任务都包含任务描述及任务实施的步骤,读者按照实施步骤进行操作就可以完成相应的学习任务,从而不断提升项目实践能力。本书主要内容涉及Spark基本原理、基于IDEA搭建Spark开发环境、RDD基本原理、Spark SQL基本操作流程、电商业务系统的基本流程、电商用户行为分析的基本指标以及分析过程、通过不同的维度对销售数据进行分析、通过不同的维度对订单数据进行分析以及常用的可视化分析图表的应用场景等。 本书适合需要使用Spar
数据是人类共同的财富数据是现代科学研究的基石。在当今这个大数据的时代,如何强调数据的重要性似乎都不为过。随着互联网及其应用的普及,传统关系数据库越来越难以满足计算机应用对数据存储、访问和安全的需要,非关系数据库和新兴数据库应运而生。本书主要面向新一代数据库系统,详细介绍数据库发展史、数据库设计原则、NoSQL和NewSQL的基本原理与设计思想。本书选取了新一代数据库发展历程中具有代表性的数据库展开讲解,如键值数据库实例的Redis与DynamoDB、列族数据库的HBase与Cassandr
本书采用项目形式编写,内容紧密联系相关专业的工程实际,将知识点贯穿于项目中,遵循从简单到复杂循序渐进的教学规律,注重工程实践能力的提高,重点突出对学生职业技能及职业素质的培养,力求全面、翔实、通俗,主要针对高等院校机电类相关专业编写。全书按照项目描述、项目分解、学习目标、项目展现、项目小结、知识扩展、习题与思考七个方面的内容来设计,将知识点的学习直接嵌入项目中,以项目为载体,实现教学目标,做到理论与实际无缝对接。按照由简单到复杂,由理论到实践,依照学生的认知规律安排教材内容,教学内容贴
本书首先简要介绍了最先进的人机交互控制和强化学习, 然后再描述典型的环境模型, 以及一些最著名的参数估计识别技术及先进和前沿的主题。本书假设读者熟悉使用经典和高级控制器的人机交互控制和一些应用, 进一步开发系统识别、基于模型和无模型人机交互控制器的系统分析。
本书以智能控制技术应用为核心,从工业机器人的典型行业应用——搬运、码垛、弧焊、点焊、喷涂、上下料与自动化生产线等应用系统出发,涉及多品牌机器人包括安川、ABB、国产品牌新松等。全书共7章,章节内容中包含知识目标、能力目标和素质目标,通过项目式教学,介绍每一种机器人的特点,以及工作站的工作任务、组成、工作过程、设计(包括选型、外围系统的构建、接口技术)、参数配置等。本书既可作为高等院校工业机器人技术、电气自动化技术等相关专业的教材或企业培训用书,也可供从事工业机器人系统开发的工程技术人员参
本书系统讲述Apache Spark/PySpark大数据计算平台的原理,以及如果将Apache PySpark应用于大数据的实时流处理、批处理等各个场景。通过原理深入学习和实践示例、案例的学习应用,使读者了解并掌握Apache Spark/PySpark的基本原理和技能,接近理论与实践的距离。全书共分为8章,主要内容包括:Spark架构原理与集群搭建、开发和部署PySpark应用程序、PySpark核心编程、PySpark SQL、PySpark SQL高级分析、PySpark结构化流
"数据科学项目日益增多,每个项目在提出原型到生产的过程中都需要可靠的基础设施。使用《Effective数据科学基础设施》介绍的一些新技术和新工具,你将能建立一个适用于各类组织(无论是初创企业还是大型企业)的基础设施堆栈。 《Effective数据科学基础设施》可帮助你建立数据流程和项目工作流,为你开发项目带来强大动力。《Effective数据科学基础设施》呈现Netflix数据操作的**进工具和概念,并在此基础上介绍一种可定制的基于云的模型开发和MLOps方法,可轻松适应公司的特定需求。当
本书围绕数据正义理论展开。数据化并非仅是技术,实为一种政治经济体制,应优先考虑数据化带来的社会正义问题。数据正义要求找到应对资本主义危害的方式;数据化嵌入政府治理导致社会成员权力弱化,数据正义要求政府机构优先考虑以人为本、团结建设;数据正义概念必须是连接全球社会学,绝非仅是西方的;数据正义要解决数据化带来剥削、歧视、隐私侵害、监视、操纵、不公正等危害;数据化限制了公民的主体性,数据正义要求确保公民在政治参与方面的积极与自主;鉴于以知情同意为中心的监管框架存在缺陷,应从保障个人权利到承认集体
本书是“格致方法·商科研究方法译丛”中的一种,商科研究方法主要是帮助相关专业的研究生进行理论研究的教学参考书。数字方法在商科方法研究中经过许不断发展,形成了完备的体系。本书主要教学的是使用数字方法收集定性数据,即在定性研究中使用数字方法(包括跟踪和追踪),帮助相关专业的硕士研究生完成其毕业论文。全书分六章,手把手地帮助学生找到该方法的关注点和使用技巧,突出步骤,并展示相关案例。
本书分为7个章节。第一章介绍大数据归约在数据预处理中的作用以及面临的技术挑战;第二章介绍多维大数据归约知识体系、业务领域本体和归约任务本体;第三章介绍大数据特征选择策略和评价准则,以及两阶段混合特征选择方法;第四章介绍大数据元组相似度度量和快速归约方法;第五章介绍了大数据数值归约基本方法和基于约束转变的数据立方体计算技术;第六章介绍了大数据归约效果评估指标及基于用户兴趣度的评估方法;第七章介绍了基于本体的大数据归约系统体系架构,以及归约工作流模式挖掘和优化等关键技术。