当前位置:首页 » 数据仓库 » hive切换数据库
扩展阅读
webinf下怎么引入js 2023-08-31 21:54:13
堡垒机怎么打开web 2023-08-31 21:54:11

hive切换数据库

发布时间: 2023-07-04 03:17:44

⑴ Hive 数据库表的基本操作,必须掌握的基本功

说明:hive 的表存放位置模式是由 hive-site.xml 当中的一个属性指定的,默认是存放在该配置文件设置的路径下,也可在创建数据库时单独指定存储路径。

数据库有一些描述性的属性信息,可以在创建时添加:

查看数据库的键值对信息

修改数据库的键值对信息

与mysql查询语句是一样的语法

删除一个空数据库,如果数据库下面有数据表,那么就会报错

强制删除数据库,包含数据库下面的表一起删除(请谨慎操作)


[]里的属性为可选属性,不是必须的,但是如果有可选属性,会使 sql 语句的易读性更好,更标准与规范。

例如:[comment '字段注释信息'][comment '表的描述信息']等,[external]属性除外


1. CREATE TABLE
创建一个指定名字的表,如果相同名字的表已存在,则抛出异常提示:表已存在,使用时可以使用IF NOT EXISTS语句来忽略这个异常。

如果创建的表名已存在,则不会再创建,也不会抛出异常提示:表已存在。否则则自动创建该表。


2. EXTERNAL
顾名思义是外部的意思,此关键字在建表语句中让使用者可以创建一个外部表,如果不加该关键字,则默认创建内部表。

外部表在创建时必须同时指定一个指向实际数据的路径(LOCATION),Hive在创建内部表时,会将数据移动到数据仓库指向的路径;

若创建外部表,仅记录数据所在的路径,不对数据的位置作任何改变。

内部表在删除后,其元数据和数据都会被一起删除。
外部表在删除后,只删除其元数据,数据不会被删除。


3. COMMENT
用于给表的各个字段或整张表的内容作解释说明的,便于他人理解其含义。


4. PARTITIONED BY
区分表是否是分区表的关键字段,依据具体字段名和类型来决定表的分区字段。


5. CLUSTERED BY
依据column_name对表进行分桶,在 Hive 中对于每一张表或分区,Hive 可以通过分桶的方式将数据以更细粒度进行数据范围划分。Hive采用对列值哈希,然后除以桶的个数求余的方式决定该条记录存放在哪个桶当中。


6. SORTED BY
指定表数据的排序字段和排序规则,是正序还是倒序排列。


7. ROW FORMAT DELIMITED FIELDS TERMINATED BY ' '
指定表存储中列的分隔符,这里指定的是' ',也可以是其他分隔符。


8. STORED AS SEQUENCEFILE|TEXTFILE|RCFILE
指定表的存储格式,如果文件数据是纯文本格式,可以使用STORED AS TEXTFILE,如果数据需要压缩,则可以使用STORED AS SEQUENCEFILE。


9. LOCATION
指定 Hive 表在 hdfs 里的存储路径,一般内部表(Managed Table)不需要自定义,使用配置文件中设置的路径即可。
如果创建的是一张外部表,则需要单独指定一个路径。


1. 使用create table语句创建表
例子:


2. 使用create table ... as select...语句创建表
例子:

使用 create table ... as select ...语句来创建新表sub_student,此时sub_student 表的结构及表数据与 t_student 表一模一样, 相当于直接将 t_student 的表结构和表数据复制一份到 sub_student 表。


注意:
(1). select 中选取的列名(如果是 * 则表示选取所有列名)会作为新表 sub_student 的列名。

(2). 该种创建表的方式会改变表的属性以及结构,例如不能是外部表,只能是内部表,也不支持分区、分桶。

如果as select后的表是分区表,并且使用select *,则分区字段在新表里只是作为字段存在,而不是作为分区字段存在。

在使用该种方式创建时,create 与 table 之间不能加 external 关键字,即不能通过该种方式创建外部目标表,默认只支持创建内部目标表。

(3). 该种创建表的方式所创建的目标表存储格式会变成默认的格式textfile。


3.使用like语句创建表
例子:


注意:
(1). 只是将 t_student 的表结构复制给 sub1_student 表。

(2). 并不复制 t_student 表的数据给 sub1_student 表。

(3). 目标表可以创建为外部表,即:

⑵ spark、hive、impala、hdfs的常用命令

对spark、hive、impala、hdfs的常用命令作了如下总结,欢迎大家补充! 1. Spark的使用: 以通过SecureCRT访问IP地址:10.10.234.198 为例进行说明: 先输入:ll //查询集群是否装有spark >su - mr >/home/mr/spark/bin/beeline -u "jdbc:hive2:/bigdata198:18000/" -n mr -p "" >.show databases; //显示其中数据库,例如 >use bigmax; //使用数据库bigmax >show tables; //查询目录中所有的表 >desc formatted TableName; //显示表的详细信息,包括分区、字段、地址等信息 >desc TableName; //显示表中的字段和分区信息 >select count(*) from TableName; //显示表中数据数量,可以用来判断表是否为空 >drop table TableName; //删除表的信息 >drop bigmax //删除数据库bigmax >describe database zxvmax //查询数据库zxvmax信息 创建一个表 第一步: >create external table if not exists lte_Amaze //创建一个叫lte_Amaze的表 ( //括号中每一行为表中的各个字段的名称和其所属的数据类型,并用空格隔开 DateTime String, MilliSec int, Network int, eNodeBID int, CID int, IMSI String, DataType int, AoA int, ServerRsrp int, ServerRsrq int, TA int, Cqi0 Tinyint, Cqi1 Tinyint //注意,最后一个字段结束后,没有逗号 ) partitioned by (p_date string, p_hour INT) //以p_date和p_hour作为分区 row format delimited fields terminated by ',' /*/*表中行结构是以逗号作为分隔符,与上边的表中字段以逗号结尾相一致*/ stored as textfile; //以文本格式进行保存 第二步:添加分区,指定分区的位置 >alter table lte_Amaze add partition (p_date='2015-01-27',p_hour=0) location'/lte/nds/mr/lte_nds_cdt_uedetail/p_date=2015-01-27/p_hour=0'; //添加lte_Amaze表中分区信息,进行赋值。 //并制定分区对应目录/lte/nds/mr下表lte_nds_cdt_uedetail中对应分区信息 第三步:察看添加的结果 >show partitions lte_Amaze; //显示表的分区信息 2. hdfs使用: #su - hdfs //切换到hdfs用户下 、 #hadoop fs –ls ///查看进程 # cd /hdfs/bin //进入hdfs安装bin目录 >hadoop fs -ls /umtsd/cdt/ //查询/umtsd/cdt/文件目录 >hadoop fs -mkdir /umtsd/test //在/umtsd目录下创建test目录 >hadoop fs -put /home/data/u1002.csv /impala/data/u5002 //将home/data/u1002.csv这个文件put到hdfs文件目录上。put到hdfs上的数据文件以逗号“,”分隔符文件(csv),数据不论类型,直接是数据,没有双引号和单引号 >hadoop fs -rm /umtsd/test/test.txt //删除umtsd/test目录下的test.txt文件 >hadoop fs -cat /umtsd/test/test.txt //查看umtsd/test目录下的test.txt文件内容3hive操作使用: #su - mr //切换到mr用户下 #hive //进入hive查询操作界面 hive>show tables; //查询当前创建的所有表 hive>show databases; //查询当前创建的数据库 hive>describe table_name; {或者desc table_name}//查看表的字段的定义和分区信息,有明确区分(impala下该命令把分区信息以字段的形式显示出来,不怎么好区分) hive> show partitions table_name; //查看表对应数据现有的分区信息,impala下没有该命令 hive> quit;//退出hive操作界面 hive>desc formatted table_name; 查看表结构,分隔符等信息 hive> alter table ceshi change id id int; 修改表的列数据类型 //将id数据类型修改为int 注意是两个id hive> SHOW TABLES '.*s'; 按正条件(正则表达式)显示表, [mr@aico ~]$ exit; 退出mr用户操作界面,到[root@aico]界面impala操作使用: #su - mr //切换到mr用户下 #cd impala/bin //进入impala安装bin目录 #/impala/bin> impala-shell.sh -i 10.10.234.166/localhost //进入impala查询操作界面 [10.10.234.166:21000] >show databases; //查询当前创建的数据库 [10.10.234.166:21000] >use database_name; //选择使用数据库,默认情况下是使用default数据库 [10.10.234.166:21000] > show tables; //查询当前数据库下创建的所有表 [10.10.234.166:21000] >describe table_name; //查看表的字段的定义,包括分区信息,没有明确区分 [10.10.234.166:21000] > describe formatted table_name; //查看表对应格式化信息,包括分区,所属数据库,创建用户,创建时间等详细信息。 [10.10.234.166:21000] >refresh table_name; //刷新一下,保证元数据是最新的 [10.10.234.166:21000] > alter TABLE U107 ADD PARTITION(reportDate="2013-09-27",rncid=487)LOCATION '/umts/cdt/ MREMITABLE/20130927/rncid=487' //添加分区信息,具体的表和数据的对应关系 [10.10.234.166:21000] > alter TABLE U100 drop PARTITION(reportDate="2013-09-25",rncid=487); //删除现有的分区,数据与表的关联 [10.10.234.166:21000] >quit; //退出impala操作界面[mr@aicod bin]$ impala-shell; 得到welcome impala的信息,进入impala 查询操作界面 [aicod:21000] > 按两次tab键,查看可以用的命令 alter describe help profile shell values connect drop history quit show version create exit insert select unset with desc explain load set use

⑶ hive中怎么退出所连接的数据库

1、hive 命令行模式,直接输入/hive/bin/hive的执行程序,或者输入 hive --service cli
用于linux平台命令行查询,查询语句基本跟mysql查询语句类似
2、 hive web界面的 (端口号9999) 启动方式
hive –service hwi &
用于通过浏览器来访问hive,感觉没多大用途

⑷ 在hive数据库中怎么查看表结构

查看表结构信息如下

1、descformattedtable_name;

2、desctable_name。