1. hive 表及數據準備apache
建表,並插入初始數據。向表中插入ssh
hive> use test; hive> create table kwang_test (id int, name string); hive> insert into kwang_test values(1,'kwang'); hive> insert into kwang_test values(2,'rzheng'); hive> select * from kwang_test; OK 1 kwang 2 rzheng
2. insert into 操做spa
insert into 語法:.net
INSERT INTO TABLE tablename [PARTITION (partcol1[=val1], partcol2[=val2] ...)] VALUES values_row [, values_row ...]
經過 insert into 語句向 kwang_test 表中插入一條數據,並查詢結果。code
hive> insert into table kwang_test values(3,'kk'); hive> select * from kwang_test; OK 1 kwang 2 rzheng 3 kk
3. insert overwrite 操做blog
insert overwrite 語法:get
INSERT OVERWRITE TABLE tablename1 [PARTITION (partcol1=val1, partcol2=val2 ...) [IF NOT EXISTS]] select_statement1 FROM from_statement;
insert overwrite 標準語法的數據來源是經過 select 語法來插入,但爲了方便,直接插入 values。經過 insert overwrite 語句向 kwang_test 表中插入一條數據,並查詢結果。string
hive> insert overwrite table kwang_test values(4,'zz'); hive> select * from kwang_test; OK 4 zz
4. 二者異同it
看到上面的現象與結果,基本可以明白 insert into 與insert overwrite 之間的異同,二者均可以向 hive 表中插入數據,但 insert into 操做是以追加的方式向 hive 表尾部追加數據,而 insert overwrite 操做則是直接重寫數據,即先刪除 hive 表的數據,再執行寫入操做。注意,若是 hive 表是分區表的話,insert overwrite 操做只會重寫當前分區的數據,不會重寫其餘分區數據。table
【參考資料】
[1]. https://cwiki.apache.org/confluence/display/Hive/LanguageManual+DML