搜索关键字：hive hbase，搜索到9273个结果！码迷,mamicode.com！

数据预处理与转存（Hive--Mysql）

一、数据预处理 1.1、在hdfs上新建目录 java程序启动前先在hdfs上建立相应文件夹，用于上传本地数据和处理后的数据 [root@hadoop102 ~]# hdfs dfs -mkdir -p /USAdatas/geodatas/inputs [root@hadoop102 ~]# hd ...

分类：数据库时间：2021-06-18 19:17:01 阅读次数：0

Spark初始换HiveContext空指针异常

spark程序初始化HiveContext报错：空指针异常版本说明： spark: 1.6.1 scala: 2.10.8 hive: 1.2.1 报错信息 java.lang.RuntimeException: java.lang.NullPointerException at org.apac ...

分类：其他好文时间：2021-06-17 16:37:17 阅读次数：0

如何避免hbase条件查询全表扫描问题（hbase二级索引解决方案）

在自己5年的开发生涯中时常在想crud对开发水平的提升真的有用吗？答案当然是没用的。通过自身的经历告诉大家唯有提高架构思想，完善问题解决方案才有提升的可能。在此就不再啰嗦了直接上干货。场景描述：有这样一张关系型数据表包括身份证，姓名，年龄，手机号，家庭住址（数据量太大普通关系型数据库已无法支撑）。 ...

分类：其他好文时间：2021-06-13 10:32:35 阅读次数：0

Hive基础(四十)：Hive 实战（一）准备

1 需求描述统计硅谷影音视频网站的常规指标，各种 TopN 指标： -- 统计视频观看数 Top10 -- 统计视频类别热度 Top10 -- 统计出视频观看数最高的 20 个视频的所属类别以及类别包含 Top20 视频的个数 -- 统计视频观看数 Top50 所关联视频的所属类别排序 -- 统计 ...

分类：其他好文时间：2021-06-13 10:04:44 阅读次数：0

Hive基础(四十一)：Hive 实战（二）业务分析

4.1 统计视频观看数 Top10 思路：使用 order by 按照 views 字段做一个全局排序即可，同时我们设置只显示前 10 条。最终代码： SELECT videoId, views FROM gulivideo_orc ORDER BY views DESC LIMIT 10; 4. ...

分类：其他好文时间：2021-06-13 10:04:23 阅读次数：0

Hive基础(三十八)：Hive DML (二) JOIN/排序

4 Join 语句 4.1 等值 Join Hive 支持通常的 SQL JOIN 语句，但是只支持等值连接，不支持非等值连接。案例实操（1）根据员工表和部门表中的部门编号相等，查询员工编号、员工名称和部门名称； hive (default)> select e.empno, e.ename, ...

分类：编程语言时间：2021-06-13 10:00:11 阅读次数：0

HBase表的热点以及rowkey的设计

HBase表热点 1 什么是热点检索habse的记录首先要通过row key来定位数据行。当大量的client访问hbase集群的一个或少数几个节点，造成少数region server的读/写请求过多、负载过大，而其他region server负载却很小，就造成了“热点”现象。 2 热点的解决方 ...

分类：其他好文时间：2021-06-13 09:58:55 阅读次数：0

Hive基础(三十九)：Hive DML (三) 分桶及抽样查询/其他常用查询函数

6 分桶及抽样查询 6.1 分桶表数据存储分区提供一个隔离数据和优化查询的便利方式。不过，并非所有的数据集都可形成合理的分区。对于一张表或者分区，Hive 可以进一步组织成桶，也就是更为细粒度的数据范围划分。分桶是将数据集分解成更容易管理的若干部分的另一个技术。分区针对的是数据的存储路径；分桶针 ...

分类：其他好文时间：2021-06-13 09:57:59 阅读次数：0

hive cli转hive beeline的几个例子

#COMMAND="hive -i settings/load-${SCHEMA_TYPE}.sql -f ddl-tpch/bin_${SCHEMA_TYPE}/${t}.sql \ # -d DB=${DATABASE} \ # -d SOURCE=tpch_text_${SCALE} -d B ...

分类：其他好文时间：2021-06-10 18:25:11 阅读次数：0

[数据仓库]分层概念,ODS,DM,DWD,DWS,DIM的概念

转自：https://blog.csdn.net/pmdream/article/details/113601956 一. 各种名词解释 1.1 ODS是什么？ ODS层最好理解，基本上就是数据从源表拉过来，进行etl，比如mysql 映射到hive，那么到了hive里面就是ods层。 ODS 全称 ...

分类：其他好文时间：2021-06-10 17:32:45 阅读次数：0

共9273条上一页 1 2 3 4 5 ... 928 下一页

分享档案

更多>

2021年07月29日 (22)
2021年07月28日 (40)
2021年07月27日 (32)
2021年07月26日 (79)
2021年07月23日 (29)
2021年07月22日 (30)
2021年07月21日 (42)
2021年07月20日 (16)
2021年07月19日 (90)
2021年07月16日 (35)