当前位置: 首页 > news >正文

烟台做网站推广的公司注册会计师报名条件

烟台做网站推广的公司,注册会计师报名条件,郑州工程网官网最新版入口,建设通类型网站叫啥1.分区表: 是Hive中的一种表类型,通过将表中的数据划分为多个子集(分区),每个分区对应表中的某个特定的列值,可以提高查询性能和管理数据的效率。分区表的每个分区存储在单独的目录中,分区的定义…

1.分区表:

        是Hive中的一种表类型,通过将表中的数据划分为多个子集(分区),每个分区对应表中的某个特定的列值,可以提高查询性能和管理数据的效率。分区表的每个分区存储在单独的目录中,分区的定义基于表中的一个或多个列。使用分区表的主要目的是减少查询扫描的数据量,从而提高查询效率。

        分区过细可能导致生成大量的小文件,影响HDFS性能和MapReduce任务的效率。需要定期进行小文件合并操作。

CREATE TABLE customer_data (customer_id STRING,name STRING,age INT,email STRING
)
PARTITIONED BY (city STRING)
STORED AS ORC;select *
from customer_data;-- 插入 New York 的数据
INSERT INTO TABLE customer_data PARTITION (city='New York')
VALUES
('1', 'John Doe', 30, 'john@example.com'),
('2', 'Jane Smith', 25, 'jane@example.com'),
('3', 'Bob Johnson', 40, 'bob@example.com');-- 插入 Los Angeles 的数据
INSERT INTO TABLE customer_data PARTITION (city='Los Angeles')
VALUES
('4', 'Alice Brown', 32, 'alice@example.com'),
('5', 'Charlie Davis', 28, 'charlie@example.com');-- 插入 Chicago 的数据
INSERT INTO TABLE customer_data PARTITION (city='Chicago')
VALUES
('6', 'Eve White', 45, 'eve@example.com'),
('7', 'Frank Black', 37, 'frank@example.com');

可以查看到hdfs上创建了三个目录,对应三个分区,使用带有where条件的select进行查询,会直接从对应的分区目录下查找数据,从而减少查询扫描的数据量,提高性能。

SELECT * FROM customer_data WHERE city='New York';

2.分桶表:

        是Hive中的另一种表类型,通过对表中的数据进行散列分桶(hash bucket),可以进一步提高查询性能,尤其是在进行连接(join)和聚合(aggregation)操作时。分桶表将数据划分为固定数量的桶(bucket),每个桶存储在单独的文件中。
---------------------------------------------------分桶表的特点---------------------------------------------------
数据划分:根据一个或多个列的哈希值,将数据分布到固定数量的桶中。
文件存储:每个桶的数据存储在独立的文件中。
均匀分布:理想情况下,数据在所有桶中均匀分布,从而提高查询性能。

CREATE TABLE customer_data2 (customer_id STRING,name STRING,age INT,email STRING
)
CLUSTERED BY (customer_id) INTO 4 BUCKETS
STORED AS ORC;
-- 插入数据到分桶表
--通过这些步骤,我们创建了一个按 customer_id 列进行分桶的 Hive 表 customer_data,并插入了具体的数据。
INSERT INTO TABLE customer_data2 VALUES
('1', 'John Doe', 30, 'john@example.com'),
('2', 'Jane Smith', 25, 'jane@example.com'),
('3', 'Bob Johnson', 40, 'bob@example.com'),
('4', 'Alice Brown', 32, 'alice@example.com'),
('5', 'Charlie Davis', 28, 'charlie@example.com'),
('6', 'Eve White', 45, 'eve@example.com'),
('7', 'Frank Black', 37, 'frank@example.com'),
('8', 'Grace Green', 22, 'grace@example.com');select *
from customer_data2;

通过查看hdfs上的路径我们可以看到这些数据会按照对应列的hash值分到不同的桶中

http://www.laogonggong.com/news/74424.html

相关文章:

  • 怎么做让自己的网站做响应式网站设计
  • 广州网站建设功能想做农村电商怎么入手
  • 做网站的最佳方法学电子商务后悔了
  • 吉林长春有做网站的吗seo网站诊断顾问
  • 建筑公司网站宣传建筑工地文案范文图片翡翠原石网站首页怎么做
  • 温州网站建设制作设计公司wordpress 个人主页
  • 做网站售后几年wordpress+网站白屏
  • 怎样申请自己的网站为什么做民宿网站
  • 免费自助建网站软件网站建设求职具备什么
  • 设计配色网站网上注册营业执照怎么注册
  • 如何用flash做网站宿迁做百度网站地点
  • 网站开发网站设计素材wordpress清除模板缓存
  • 现在公司做各网站要多少钱wordpress 中文字体
  • 建个网站费用多少做网站需要多长时间
  • 电商网站服务排名滨州市手工活外发加工网
  • 福建省建设厅网站资质查成都农产品网站建设方案
  • 怎么做网站二维码去哪接单做网站
  • 360建站北京网站制作应用
  • 网站模板 阿里wordpress模板淘宝客模板下载
  • 网站建设控制个人博客网站设计模板
  • 网站制作方案去哪找香精香料网论坛
  • 做网站的害处农产品电商网站建设的总体目标
  • 必应网站收录提交入口做公司简介需要多少钱
  • 东莞建工集团企业网站设计师每天都上的网站
  • 云南建设厅网站职称评定简单的网站开发流程
  • 长沙零零七网站建设php做网站步骤
  • 建设外贸企业网站visual studio怎么新建网站
  • 网站备案个人转企业短视频seo询盘系统
  • 四川建设网站首页hao123从网上开始
  • 钦州建设网站如何推广网站最有效