HiveQL - Select-Joins
JOIN é uma cláusula usada para combinar campos específicos de duas tabelas usando valores comuns a cada uma. É usado para combinar registros de duas ou mais tabelas no banco de dados.
Sintaxe
join_table:
table_reference JOIN table_factor [join_condition]
| table_reference {LEFT|RIGHT|FULL} [OUTER] JOIN table_reference
join_condition
| table_reference LEFT SEMI JOIN table_reference join_condition
| table_reference CROSS JOIN table_reference [join_condition]
Exemplo
Usaremos as duas tabelas a seguir neste capítulo. Considere a seguinte tabela chamada CLIENTES.
+----+----------+-----+-----------+----------+
| ID | NAME | AGE | ADDRESS | SALARY |
+----+----------+-----+-----------+----------+
| 1 | Ramesh | 32 | Ahmedabad | 2000.00 |
| 2 | Khilan | 25 | Delhi | 1500.00 |
| 3 | kaushik | 23 | Kota | 2000.00 |
| 4 | Chaitali | 25 | Mumbai | 6500.00 |
| 5 | Hardik | 27 | Bhopal | 8500.00 |
| 6 | Komal | 22 | MP | 4500.00 |
| 7 | Muffy | 24 | Indore | 10000.00 |
+----+----------+-----+-----------+----------+
Considere outra tabela ORDERS da seguinte forma:
+-----+---------------------+-------------+--------+
|OID | DATE | CUSTOMER_ID | AMOUNT |
+-----+---------------------+-------------+--------+
| 102 | 2009-10-08 00:00:00 | 3 | 3000 |
| 100 | 2009-10-08 00:00:00 | 3 | 1500 |
| 101 | 2009-11-20 00:00:00 | 2 | 1560 |
| 103 | 2008-05-20 00:00:00 | 4 | 2060 |
+-----+---------------------+-------------+--------+
Existem diferentes tipos de junções fornecidas a seguir:
- JOIN
- LEFT OUTER JOIN
- DIREITO OUTER JOIN
- FULL OUTER JOIN
JUNTE-SE
A cláusula JOIN é usada para combinar e recuperar os registros de várias tabelas. JOIN é igual a OUTER JOIN no SQL. Uma condição JOIN deve ser gerada usando as chaves primárias e as chaves estrangeiras das tabelas.
A consulta a seguir executa JOIN nas tabelas CUSTOMER e ORDER e recupera os registros:
hive> SELECT c.ID, c.NAME, c.AGE, o.AMOUNT
FROM CUSTOMERS c JOIN ORDERS o
ON (c.ID = o.CUSTOMER_ID);
Na execução bem-sucedida da consulta, você verá a seguinte resposta:
+----+----------+-----+--------+
| ID | NAME | AGE | AMOUNT |
+----+----------+-----+--------+
| 3 | kaushik | 23 | 3000 |
| 3 | kaushik | 23 | 1500 |
| 2 | Khilan | 25 | 1560 |
| 4 | Chaitali | 25 | 2060 |
+----+----------+-----+--------+
LEFT OUTER JOIN
O HiveQL LEFT OUTER JOIN retorna todas as linhas da tabela da esquerda, mesmo se não houver correspondências na tabela da direita. Isso significa que, se a cláusula ON corresponder a 0 (zero) registros na tabela certa, o JOIN ainda retornará uma linha no resultado, mas com NULL em cada coluna da tabela certa.
Um LEFT JOIN retorna todos os valores da tabela à esquerda, mais os valores correspondentes da tabela à direita, ou NULL no caso de nenhum predicado JOIN correspondente.
A consulta a seguir demonstra LEFT OUTER JOIN entre as tabelas CUSTOMER e ORDER:
hive> SELECT c.ID, c.NAME, o.AMOUNT, o.DATE
FROM CUSTOMERS c
LEFT OUTER JOIN ORDERS o
ON (c.ID = o.CUSTOMER_ID);
Na execução bem-sucedida da consulta, você verá a seguinte resposta:
+----+----------+--------+---------------------+
| ID | NAME | AMOUNT | DATE |
+----+----------+--------+---------------------+
| 1 | Ramesh | NULL | NULL |
| 2 | Khilan | 1560 | 2009-11-20 00:00:00 |
| 3 | kaushik | 3000 | 2009-10-08 00:00:00 |
| 3 | kaushik | 1500 | 2009-10-08 00:00:00 |
| 4 | Chaitali | 2060 | 2008-05-20 00:00:00 |
| 5 | Hardik | NULL | NULL |
| 6 | Komal | NULL | NULL |
| 7 | Muffy | NULL | NULL |
+----+----------+--------+---------------------+
DIREITO OUTER JOIN
O HiveQL RIGHT OUTER JOIN retorna todas as linhas da tabela da direita, mesmo se não houver correspondências na tabela da esquerda. Se a cláusula ON corresponder a 0 (zero) registros na tabela à esquerda, o JOIN ainda retornará uma linha no resultado, mas com NULL em cada coluna da tabela à esquerda.
Um RIGHT JOIN retorna todos os valores da tabela da direita, mais os valores correspondentes da tabela da esquerda, ou NULL no caso de nenhum predicado de junção correspondente.
A consulta a seguir demonstra RIGHT OUTER JOIN entre as tabelas CUSTOMER e ORDER.
notranslate "> hive> SELECT c.ID, c.NAME, o.AMOUNT, o.DATE FROM CUSTOMERS c RIGHT OUTER JOIN ORDERS o ON (c.ID = o.CUSTOMER_ID);Na execução bem-sucedida da consulta, você verá a seguinte resposta:
+------+----------+--------+---------------------+
| ID | NAME | AMOUNT | DATE |
+------+----------+--------+---------------------+
| 3 | kaushik | 3000 | 2009-10-08 00:00:00 |
| 3 | kaushik | 1500 | 2009-10-08 00:00:00 |
| 2 | Khilan | 1560 | 2009-11-20 00:00:00 |
| 4 | Chaitali | 2060 | 2008-05-20 00:00:00 |
+------+----------+--------+---------------------+
FULL OUTER JOIN
O HiveQL FULL OUTER JOIN combina os registros das tabelas externas esquerda e direita que atendem à condição JOIN. A tabela associada contém todos os registros de ambas as tabelas ou preenche valores NULL para correspondências ausentes em ambos os lados.
A consulta a seguir demonstra FULL OUTER JOIN entre as tabelas CUSTOMER e ORDER:
hive> SELECT c.ID, c.NAME, o.AMOUNT, o.DATE
FROM CUSTOMERS c
FULL OUTER JOIN ORDERS o
ON (c.ID = o.CUSTOMER_ID);
Na execução bem-sucedida da consulta, você verá a seguinte resposta:
+------+----------+--------+---------------------+
| ID | NAME | AMOUNT | DATE |
+------+----------+--------+---------------------+
| 1 | Ramesh | NULL | NULL |
| 2 | Khilan | 1560 | 2009-11-20 00:00:00 |
| 3 | kaushik | 3000 | 2009-10-08 00:00:00 |
| 3 | kaushik | 1500 | 2009-10-08 00:00:00 |
| 4 | Chaitali | 2060 | 2008-05-20 00:00:00 |
| 5 | Hardik | NULL | NULL |
| 6 | Komal | NULL | NULL |
| 7 | Muffy | NULL | NULL |
| 3 | kaushik | 3000 | 2009-10-08 00:00:00 |
| 3 | kaushik | 1500 | 2009-10-08 00:00:00 |
| 2 | Khilan | 1560 | 2009-11-20 00:00:00 |
| 4 | Chaitali | 2060 | 2008-05-20 00:00:00 |
+------+----------+--------+---------------------+