hive入门到魔改-阶段一(hive概念&安装&初步使用)

发布时间：2023-11-06 09:00

Hive简介

官网:

Apache Hive

Hive 是一个构建在 Hadoop 之上的数据仓库，它可以将结构化的数据文件映射成表，并提供类 SQL 查询功能，用于查询的 SQL 语句会被转化为 MapReduce 作业，然后提交到 Hadoop 上运行。

特点：

简单、容易上手 (提供了类似 sql 的查询语言 hql)，使得精通 sql 但是不了解 Java 编程的人也能很好地进行大数据分析；
灵活性高，可以自定义用户函数 (UDF) 和存储格式；
为超大的数据集设计的计算和存储能力，集群扩展容易;
统一的元数据管理，可与 presto／impala／sparksql 等共享数据；
执行延迟高，不适合做数据的实时处理，但适合做海量数据的离线处理。

Hive的体系架构

command-line shell & thrift/jdbc

可以用 command-line shell 和 thrift／jdbc 两种方式来操作数据：

command-line shell：通过 hive 命令行的的方式来操作数据；
thrift／jdbc：通过 thrift 协议按照标准的 JDBC 的方式操作数据。

相关推荐

用HTQ实现http任务队列

mysql主库用户密码登陆失败从库正常

领域命名实体NER实现：Bert+BiLSTM+CRF

阈值同态加密在隐私计算中的应用：解读

玩转Linux与运维岗（14）

python教程jupyternotebook_Jupyter Notebook入门

uni-app实现手写签名

opencv处理函数记录_转自opencv中文网站

什么是Eureka？Eureka能干什么？Eureka怎么用？

pytroch基础用法

SpringBoot 异步任务-使用@Async注解

2022 Developer Nation全球调查第23版问卷已开启

阿里一面： Spring 有哪些扩展点？

#今日论文推荐#文本生成图像新“天花板”？谷歌研究人员研发图像生成器Imagen，评分超OpenAI同类模型

注解和反射

gcd和lcm(最大公约数，最小公倍数)

技术分享 | Javaer 如何做单元测试？

CentOS7虚拟机docker部署ruoyi微服务(下-docker部署)

python中matplotlib库的作用_python数据分析之matplotlib库

ItVuer - 免责声明 - 关于我们 - 联系我们

本网站信息来源于互联网，如有侵权请联系：561261067@qq.com

桂ICP备16001015号