Hive简介及核心概念
本专栏案例数据集链接:
https://download.csdn.net/download/shangjg03/88478038
1.简介
Hive 是一个构建在 Hadoop 之上的数据仓库,它可以将结构化的数据文件映射成表,并提供类 SQL 查询功能,用于查询的 SQL 语句会被转化为 MapReduce 作业,然后提交到 Hadoop 上运行。
特点:
1. 简单、容易上手 (提供了类似 sql 的查询语言 hql),使得精通 sql 但是不了解 Java 编程的人也能很好地进行大数据分析;
3. 灵活性高,可以自定义用户函数 (UDF) 和存储格式;