Spark是基于内存计算的大数据并行计算框架,比MapReduce计算框架具有更高的实时性,同时具有高效容错性和可伸缩性,在学习Spark操作之前,首先介绍Spark运行架构...查看全文>>
数据解读是数据分析师的基本功,如果不能充分理解数据分析中出现的各类指标及术语,数据分析工作将很难展开。对于数据分析师来说,了解常用的分析指标和术语是做好数据解读的前提。本节将对数据分析常用指标及术语进行讲解。查看全文>>
在网络上对运营有各式各样的定义,有人说运营是为产品传递价值、打造生态和创造使用方法。也有人说一切围绕着网站产品进行的人工干预都是运营。作者对运营的定义是:通过一系列穿针引线式的行为和资源投入,让一件事能够持续良性运转,这就是运营。查看全文>>
执行查询操作时,集合中的文档存在适当的索引,MongoDB就可以使用该索引限制必须检查的文档数量。MongoDB的索引可以分为六种,即单字段索引、复合索引、多键索引、地理空间索引、全文本索引以及哈希索引,六种索引的详细介绍,具体如下:查看全文>>
数组是JavaScript中最常用的数据类型之一,为此Array对象中提供了许多内置方法,如栈方法、检索方法、数组转字符串的方法等。本节将针对数组的常用方法进行详细讲解。查看全文>>
插入排序是冒泡排序的优化,是一种直观的简单排序算法。它的实现原理是,通过构建有序数组元素的存储,对于未排序的数组元素,在已排序的数组中从最后一个元素向第一个元素遍历,找到相应位置并插入。其中,待排序数组的第1个元素会被看作是一个有序的数组,从第2个至最后一个元素会被看作是一个无序数组。如按照从小到大的顺序完成插入排序...查看全文>>