Hive 是一个构建在 Hadoop 之上的数据仓库,它可以将结构化的数据文件映射成表,并提供类 SQL 查询功能,用于查询的 SQL 语句会被转化为 MapReduce 作业,然后提交到 Hadoop 上运行。Hive的表对应HDFS的目录(或文件夹);Hive表中的数据对应HDFS的文件。特点: 简单、容易上手 (提供了类似 sql 的查询语言 hql),使得...
[stored as textfile]关键字,是用来设置加载数据的数据类型,默认是TEXTFILE,如果文件数据是纯文本,就是使用 [stored as textfile],然后从本地直接拷贝到HDFS上,Hive直接可以识别数据。 然后,将Linux本地/data/hivetest目录下的cat_group文件导入到Hive中的cat_group表中。 load data local inpath'/data/hivetest...