编译Spack源码

眉间皱痕 提交于 2020-02-03 01:40:34

版本说明

Hadoop:2.6.0-cdh5.15.1
JDK:1.8.0
Spark:2.4.4
Maven:Spark源码内置,路径:spark-2.4.4/build/mvn
以上软件都需要提前设置好环境变量,但是Maven, Scala和Zinc在编译的时候会自动下载对应版本到build/目录下,所以不需要提前安装。

修改pom.xml

spark-2.4.4/pom.xml

  1. 增加cloudera的repository

    <repository>
     	<id>cloudera</id>
        <url>https://repository.cloudera.com/artifactory/cloudera-repos/</url>
    </repository>
    
  2. 关闭zinc

    <useZincServer>false</useZincServer>
    

Spark默认版本说明

spark-2.4.4/pom.xml文件中我们可以看到,默认使用的是Hadoop2.6.5,这个小版本和我们当前的2.6.0-cdh5.15.1还是存在差异的,所以需要用-Dhadoop.version=2.6.0-cdh5.15.1指定版本号
在这里插入图片描述
执行命令:./build/mvn -Pyarn -Phive -Phive-thriftserver -Dhadoop.version=2.6.0-cdh5.15.1 -DskipTests clean package
说明:使用Yarn、Hive和ThriftServer,重设Hadoop版本为2.6.0-cdh5.15.1
第一次执行会比较慢,大概要1~2个小时。

还有另一种方式可以生成一个可以执行的包,执行命令:./dev/make-distribution.sh --name 2.6.0-cdh5.15.1 --tgz -Pyarn -Phive -Phive-thriftserver -Dhadoop.version=2.6.0-cdh5.15.1,其实就是对上面的命令进行了一个封装,推荐使用这种方式。

标签
易学教程内所有资源均来自网络或用户发布的内容,如有违反法律规定的内容欢迎反馈
该文章没有解决你所遇到的问题?点击提问,说说你的问题,让更多的人一起探讨吧!