
- Hive 教程
- Hive - 首頁
- Hive - 簡介
- Hive - 安裝
- Hive - 資料型別
- Hive - 建立資料庫
- Hive - 刪除資料庫
- Hive - 建立表
- Hive - 修改表
- Hive - 刪除表
- Hive - 分割槽
- Hive - 內建運算子
- Hive - 內建函式
- Hive - 檢視和索引
- Hive 有用資源
- Hive - 問題與解答
- Hive - 快速指南
- Hive - 有用資源
HiveQL - 選擇連線
JOIN 是一個用於透過使用每個表共有的值組合兩個表的特定欄位的子句。它用於組合資料庫中兩個或多個表中的記錄。
語法
join_table: table_reference JOIN table_factor [join_condition] | table_reference {LEFT|RIGHT|FULL} [OUTER] JOIN table_reference join_condition | table_reference LEFT SEMI JOIN table_reference join_condition | table_reference CROSS JOIN table_reference [join_condition]
示例
我們將在本章中使用以下兩個表。考慮以下名為 CUSTOMERS 的表。
+----+----------+-----+-----------+----------+ | ID | NAME | AGE | ADDRESS | SALARY | +----+----------+-----+-----------+----------+ | 1 | Ramesh | 32 | Ahmedabad | 2000.00 | | 2 | Khilan | 25 | Delhi | 1500.00 | | 3 | kaushik | 23 | Kota | 2000.00 | | 4 | Chaitali | 25 | Mumbai | 6500.00 | | 5 | Hardik | 27 | Bhopal | 8500.00 | | 6 | Komal | 22 | MP | 4500.00 | | 7 | Muffy | 24 | Indore | 10000.00 | +----+----------+-----+-----------+----------+
考慮另一個名為 ORDERS 的表,如下所示
+-----+---------------------+-------------+--------+ |OID | DATE | CUSTOMER_ID | AMOUNT | +-----+---------------------+-------------+--------+ | 102 | 2009-10-08 00:00:00 | 3 | 3000 | | 100 | 2009-10-08 00:00:00 | 3 | 1500 | | 101 | 2009-11-20 00:00:00 | 2 | 1560 | | 103 | 2008-05-20 00:00:00 | 4 | 2060 | +-----+---------------------+-------------+--------+
連線型別如下所示
- JOIN
- 左外連線 (LEFT OUTER JOIN)
- 右外連線 (RIGHT OUTER JOIN)
- 全外連線 (FULL OUTER JOIN)
JOIN
JOIN 子句用於組合和檢索來自多個表的記錄。JOIN 在 SQL 中與 OUTER JOIN 相同。JOIN 條件需要使用表的主鍵和外部索引鍵來提出。
以下查詢在 CUSTOMER 和 ORDER 表上執行 JOIN,並檢索記錄
hive> SELECT c.ID, c.NAME, c.AGE, o.AMOUNT FROM CUSTOMERS c JOIN ORDERS o ON (c.ID = o.CUSTOMER_ID);
查詢成功執行後,您將看到以下響應
+----+----------+-----+--------+ | ID | NAME | AGE | AMOUNT | +----+----------+-----+--------+ | 3 | kaushik | 23 | 3000 | | 3 | kaushik | 23 | 1500 | | 2 | Khilan | 25 | 1560 | | 4 | Chaitali | 25 | 2060 | +----+----------+-----+--------+
左外連線 (LEFT OUTER JOIN)
HiveQL 左外連線 (LEFT OUTER JOIN) 返回左表中的所有行,即使右表中沒有匹配項。這意味著,如果 ON 子句在右表中匹配 0(零)條記錄,則 JOIN 仍然在結果中返回一行,但在右表中的每一列中都為 NULL。
左連線 (LEFT JOIN) 返回左表中的所有值,加上右表中匹配的值,或者在沒有匹配的 JOIN 條件的情況下為 NULL。
以下查詢演示了 CUSTOMER 和 ORDER 表之間的左外連線 (LEFT OUTER JOIN)
hive> SELECT c.ID, c.NAME, o.AMOUNT, o.DATE FROM CUSTOMERS c LEFT OUTER JOIN ORDERS o ON (c.ID = o.CUSTOMER_ID);
查詢成功執行後,您將看到以下響應
+----+----------+--------+---------------------+ | ID | NAME | AMOUNT | DATE | +----+----------+--------+---------------------+ | 1 | Ramesh | NULL | NULL | | 2 | Khilan | 1560 | 2009-11-20 00:00:00 | | 3 | kaushik | 3000 | 2009-10-08 00:00:00 | | 3 | kaushik | 1500 | 2009-10-08 00:00:00 | | 4 | Chaitali | 2060 | 2008-05-20 00:00:00 | | 5 | Hardik | NULL | NULL | | 6 | Komal | NULL | NULL | | 7 | Muffy | NULL | NULL | +----+----------+--------+---------------------+
右外連線 (RIGHT OUTER JOIN)
HiveQL 右外連線 (RIGHT OUTER JOIN) 返回右表中的所有行,即使左表中沒有匹配項。如果 ON 子句在左表中匹配 0(零)條記錄,則 JOIN 仍然在結果中返回一行,但在左表中的每一列中都為 NULL。
右連線 (RIGHT JOIN) 返回右表中的所有值,加上左表中匹配的值,或者在沒有匹配的連線條件的情況下為 NULL。
以下查詢演示了 CUSTOMER 和 ORDER 表之間的右外連線 (RIGHT OUTER JOIN)。
notranslate"> hive> SELECT c.ID, c.NAME, o.AMOUNT, o.DATE FROM CUSTOMERS c RIGHT OUTER JOIN ORDERS o ON (c.ID = o.CUSTOMER_ID);查詢成功執行後,您將看到以下響應
+------+----------+--------+---------------------+ | ID | NAME | AMOUNT | DATE | +------+----------+--------+---------------------+ | 3 | kaushik | 3000 | 2009-10-08 00:00:00 | | 3 | kaushik | 1500 | 2009-10-08 00:00:00 | | 2 | Khilan | 1560 | 2009-11-20 00:00:00 | | 4 | Chaitali | 2060 | 2008-05-20 00:00:00 | +------+----------+--------+---------------------+
全外連線 (FULL OUTER JOIN)
HiveQL 全外連線 (FULL OUTER JOIN) 組合滿足 JOIN 條件的左右兩個外表的記錄。連線後的表包含兩個表的所有記錄,或者在任一側缺少匹配項時填充 NULL 值。
以下查詢演示了 CUSTOMER 和 ORDER 表之間的全外連線 (FULL OUTER JOIN)
hive> SELECT c.ID, c.NAME, o.AMOUNT, o.DATE FROM CUSTOMERS c FULL OUTER JOIN ORDERS o ON (c.ID = o.CUSTOMER_ID);
查詢成功執行後,您將看到以下響應
+------+----------+--------+---------------------+ | ID | NAME | AMOUNT | DATE | +------+----------+--------+---------------------+ | 1 | Ramesh | NULL | NULL | | 2 | Khilan | 1560 | 2009-11-20 00:00:00 | | 3 | kaushik | 3000 | 2009-10-08 00:00:00 | | 3 | kaushik | 1500 | 2009-10-08 00:00:00 | | 4 | Chaitali | 2060 | 2008-05-20 00:00:00 | | 5 | Hardik | NULL | NULL | | 6 | Komal | NULL | NULL | | 7 | Muffy | NULL | NULL | | 3 | kaushik | 3000 | 2009-10-08 00:00:00 | | 3 | kaushik | 1500 | 2009-10-08 00:00:00 | | 2 | Khilan | 1560 | 2009-11-20 00:00:00 | | 4 | Chaitali | 2060 | 2008-05-20 00:00:00 | +------+----------+--------+---------------------+