第二章 Spark RDD以及编程接口 目录 Spark程序”Hello World” Spark RDD 创建操作 转换操作 控制操作 行动操作 注:学习《Spark大数据处理技术》笔记 1. Spark程序”Hello World” 1. 概述 计算存储在HDFS的Log文件中出现字符串”Hello World”的行数 2. 代码实现 3. 行解 第一行 对于所有的Spark程序而言,要进行任何操作,首先要创建一个Spark上下文,在创建上下文的过程中,程序会向集群申请资源以及构建相应的运行环境 需要传入四个变量 1. Spark程序运行的集群地址,如”spark://localho