CDH

Apache Impala(四) Impala sql 语法

2020-07-03  本文已影响0人  做个合格的大厂程序员

创建数据库

CREATE DATABASE 语句用于在 Impala 中创建新数据库。

CREATE DATABASE IF NOT EXISTS database_name;
image

impala 默认使用 impala 用户执行操作,会报权限不足问题,解决办法:

一:给 HDFS 指定文件夹授予权限

hadoop fs -chmod -R 777 hdfs://node-1:9000/user/hive

二:haoop 配置文件中hdfs-site.xml 中设置权限为 false

image image

默认就会在 hive 的数仓路径下创建新的数据库名文件夹

/user/hive/warehouse/ittest.db

也可以在创建数据库的时候指定 hdfs 路径。需要注意该路径的权限。

hadoop fs -mkdir -p /input/impala

hadoop fs -chmod -R 777 /input/impala

删除数据库

Impala 的 DROP DATABASE 语句用于从 Impala 中删除数据库。 在删除数据库 之前,建议从中删除所有表。 如果使用级联删除,Impala 会在删除指定数据库中的表之前删除它。 DROP database sample cascade;

创建表

create table语句用于在 Impala 中的所需数据库中创建新表。 需要指定表 名字并定义其列和每列的数据类型。 impala 支持的数据类型和 hive 类似,除了 sql 类型外,还支持 java 类型。

create table IF NOT EXISTS database_name.table_name ( column1 data_type, 
column2 data_type, 
column3 data_type, 
………
columnN data_type
);

创建表模拟语句

CREATE TABLE IF NOT EXISTS  my_db.student(name STRING,age INT, contact INT );

插入数据

Impala 的 INSERT 语句有两个子句:into 和 overwriteinto 用于插入新记录数据,overwrite 用于覆盖已有的记录。

insert:

Insert into table_name values (value1, value2, value2);

overwrite:

Insert overwrite employee values (1, 'Ram', 26, 'Vishakhapatnam', 37000 );

查询

Impala SELECT 语句用于从数据库中的一个或多个表中提取数据。 此查询以 表的形式返回数据。

select * from tablename

describe

Impala 中的 describe 语句用于提供表的描述。 此语句的结果包含有关表的 信息,例如列名称及其数据类型。

Describe table_name;

此外,还可以使用 hive 的查询表元数据信息语句。

desc formatted table_name;

alter table

Impala 中的 Alter table 语句用于对给定表执行更改。使用此语句,我们可以 添加,删除或修改现有表中的列,也可以重命名它们。

表重命名

ALTER TABLE [old_db_name.]old_table_name RENAME TO [new_db_name.]new_table_name

向表中添加列:

ALTER TABLE name ADD COLUMNS (col_spec[, col_spec ...])

从表中删除列:

ALTER TABLE name DROP [COLUMN] column_name

更改列的名称和类型:

ALTER TABLE name CHANGE column_name new_name new_type

delete、truncate table

Impala drop table 语句用于删除 Impala 中的现有表。此语句还会删除内部表 的底层 HDFS 文件。

注意:使用此命令时必须小心,因为删除表后,表中可用的所有信息也将永远丢失

DROP table database_name.table_name;

Impala 的 Truncate Table 语句用于从现有表中删除所有记录。保留表结构。 您也可以使用 DROP TABLE 命令删除一个完整的表,但它会从数据库中删除 完整的表结构,如果您希望存储一些数据,您将需要重新创建此表。

truncate table_name;

order by

Impala ORDER BY 子句用于根据一个或多个列以升序或降序对数据进行排序。 默认情况下,一些数据库按升序对查询结果进行排序。

select * from table_name ORDER BY col_name [ASC|DESC] [NULLS FIRST|NULLS LAST]

可以使用关键字 ASCDESC 分别按升序或降序排列表中的数据。

如果我们使用 NULLS FIRST,表中的所有空值都排列在顶行; 如果我们使用NULLS LAST,包含空值的行将最后排列。

group by

Impala GROUP BY 子句与 SELECT 语句协作使用,以将相同的数据排列到组中。

select data from table_name Group BY col_name;

having

Impala 中的 Having 子句允许您指定过滤哪些组结果显示在最终结果中的条件。
一般来说,Having 子句与 group by 子句一起使用; 它将条件放置在由 GROUP BY 子句创建的组上。

select data from table_name Group BY col_name having score > 100;

limit、offset

Impala 中的 limit 子句用于将结果集的行数限制为所需的数,即查询的结果 集不包含超过指定限制的记录。

一般来说,select 查询的 resultset 中的行从 0 开始。使用 offset 子句,我们 可以决定从哪里考虑输出。

select * from student limit 3

with

如果查询太复杂,我们可以为复杂部分定义别名,并使用 Impala 的 with 子 句将它们包含在查询中。

with x as (select 1), y as (select 2) (select * from x union y);
上一篇下一篇

猜你喜欢

热点阅读