1.Hive基本数据类型
Hive数据类型 | Java数据类型 | 长度 | 例子 |
---|
TINYINT | byte | 1byte有符号整数 | 20 |
SMALLINT | short | 2byte有符号整数 | 20 |
INT | int | 4byte有符号整数 | 20 |
BIGINT | long | 8byte有符号整数 | 20 |
BOOLEAN | boolean | 布尔类型,true或者false | TRUE FALSE |
FLOAT | float | 单精度浮点数 | 3.14159 |
DOUBLE | double | 双精度浮点数 | 3.14159 |
STRING | string | 字符系列。可以指定字符集。可以使用单引号或者双引号。 | ‘now is the time’ “for all good men” |
TIMESTAMP | | 时间类型 | |
BINARY | | 字节数组 | |
- 对于Hive的String类型相当于数据库的varchar类型,该类型是一个可变的字符串,但是它不能声明其中最多能存储多少个字符,理论上它可以存储2GB的字符数。
2.Hive集合数据类型
数据类型 | 描述 | 语法示例 |
---|
STRUCT | 和c语言中的struct类似,都可以通过“点”符号访问元素内容。例如: 如果某个列的数据类型是STRUCT{first STRING, last STRING},那么第1个元素可以通过 字段.first 来引用。 | struct()例如:struct<street:string, city:string> |
MAP | MAP是一组键-值对元组集合,使用数组表示法可以访问数据。<br>例如:如果某个列的数据类型是MAP,其中键->值对是’first’->’John’和’last’->’Doe’,那么可以通过 字段名[‘last’] 获取最后一个元素 | map()例如:map<string, int> |
ARRAY | 数组是一组具有相同类型和名称的变量的集合。这些变量称为数组的元素,每个数组元素都有一个编号,编号从零开始。 例如:数组值为[‘John’, ‘Doe’],那么第2个元素可以通过 数组名[1] 进行引用。 | Array()例如:array |
{"name": "songsong","friends": ["bingbing" , "lili"] , "children": { "xiao song": 19 ,"xiaoxiao song": 18}"address": { "street": "hui long guan" ,"city": "beijing" }
}
create external table person(
name,string,
friends array<string>,
children map<string, int>,
address struct<street:string, city:string>)
row format delimited fileds terminated by ','
collection items terminated by '_'
map keys terminated by ':'
lines terminated by '\n';
3.Hive类型转换
- Hive的基本数据类型是可以进行隐式转换,类似Java的隐式转换。
- CAST操作显示进行数据类型转换。
4.总结
- Hive的基本数据类型:TINYINT、SMALLINT、INT、BIGINT、BOOLEAN、STRING、TIMESTAMP、BINARY。
- Hive的集合数据类型:STRUCT、MAP、ARRAY。