Apache Tez on hive

———————————————————— 調配 Hadoop  ————————————————————html

1 將 編譯好的 TEZ .tar.gz 文件上傳到 HDFS 中。
 
hdfs fs -put complete-tez-0.7.0.tar.gz /tez
 

2 建立 tez-site.xml

須要在 hadoop 的 master 節點上面的 ${HADOOP_HOME}/etc/hadoop 目錄下面建立一個 tez-site.xml 文件,裏面填寫以下內容linux

<?xml version="1.0" encoding="UTF-8"?>
<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>
<configuration>
<property>
<name>tez.lib.uris</name>
<value>/tez/tez-0.7.0</value>
<name>tez.lib.uris</name>
<value>hdfs://t1:9000/tez/tez-0.8.2.tar.gz</value>
</property>
</configuration>
 
3 修改 hadoop-2.6.0/etc/hadoop/hadoop-env.sh 
 
export TEZ_HOME= /usr/local/opt/tez-0.7.0
          for jar in `ls $TEZ_HOME |grep jar`; do
export HADOOP_CLASSPATH=$HADOOP_CLASSPATH:$TEZ_HOME/$jar
 done
           for jar in `ls $TEZ_HOME/lib`; do
export HADOOP_CLASSPATH=$HADOOP_CLASSPATH:$TEZ_HOME/lib/$jar
 done
 
 

以上完成了tez的基本配置,接下來有 2 中方法使咱們的任務運行在tez上,一種修改oop

 mapreduce-site.xml 設置 yarn  改成 yarn-tez性能

第二種,修改 hive 直接運行在 tez 上測試

 

第三種  hive set tezspa

 
———————————————————— hive on tez (單個 job 運行 Tez) ————————————————————
1 將編譯好的 tez(編譯成功的包會放在tez-dist/target )全部jar 包放入 hive下。
     find . -name "*jar" -print | cp -a `xargs` tezlib/ 
上面命令獲得 tez 全部jar 包。
2  hive on tez 的使用方式 配置好之後 進入 hive
  1. hive (default)>set hive.execution.engine=tez;
  2. set hive.execution.engine=mr 或 退出 hive 便可
   3 若是 hive set tez 後運行異常能夠啓用調試模式啓動hive (linux 下進入 hive 啓動模式)
 
              hive -hiveconf hive.root.logger=DEBUG,console 
—————————————————— Hive on tez 性能測試——————————————————
性能測試:
select a.sex ,b.age , c.* from a join b on a.sex = b.sex join c on a.id ;
 
3表 各1萬 / 169kb  
Hive on MapReduce
39分鐘 = =!
 

 

hive on tez
25分鐘  (未發揮最佳性能,由於數據量大量的 IO 都是拉取。並沒有多 MR)
set hive.execution.engine=tez;

 

 

實驗 a 164M b 164M c 1.7G d 164M, e 164M
————————————————   hive on MR 3 分 9 秒  ————————————————

————————————————  hive on tez 22.5 秒  ————————————————

 

———————————————————— hive on tez (全部 job 運行 Tez) ————————————————————

Tez部署完畢後,下載hive0.14.0的二進制文件,解壓便可。而後在hive的conf目錄下新建hive-site.xml進行常規的配置,若是要是此hive運行在tez上,能夠在配置文件中加上:命令行

<property>調試

    <name>mapreduce.framework.name</name>code

    <value>yarn-tez</value>xml

  </property>

固然這個配置也能加在mapsite.xml裏,建議加在須要hive-site.xml以不影響集羣其餘hive。

     而後打開命令行,首先執行set hive.execution.engine=tez; 這裏說下這個配置的含義,

 

Setting execution engine to mr and framework name to yarn = Hive compiles to MR and runs on MR.

Setting execution engine to mr and framework name to yarn-tez = Hive compiles to MR and runs on Tez.

Setting execution engine to tez = Hive compiles to Tez and runs on Tez.

 

 

 

 

 
相關文章
相關標籤/搜索