1.Pig是基于hadoop的一个数据处理的框架。 MapReduce是使用java进行开发的,Pig有一套自己的数据处理语言,Pig的数据处理过程要转化为MR来运行。 2.Pig的数据处理语言是数据流方式的,类似于初中做的数学题。 3.Pig基本数据类型:int、long、float、double、chararry、bytearray 复合数据类型:Map、Tuple、Bag Bag的类型如{('age',31),('name','张三')} 4.如何安装Pig 4.1 把pig-0.11.1.tar.gz复制到/usr/local下 4.2 使用命令tar -zxvf