【Hive】【Hadoop】工作中常操作的笔记-随时添加

文章目录

- - 1、Hive 复制一个表:
  - 2、字段级操作
  - 3、hdfs 文件统计

1、Hive 复制一个表:

直接Copy文件

create table new_table  like table_name;hdfs dfs -get /apps/hive/warehouse/ods.db/table_nameload data local inpath '/路径' into table new_table;

修复表：

msck repair table table_name;

分析表

analyze table table_name compute statistics;

2、字段级操作

--新增字段
alter table add columns (filed1 data_type,filed2 data_type) cascade;--修改字段
alter table change column filed_name new_filed_name data_type--删除字段
--如果想删除最后一个字段column_2
create table table_name (
column_1 string,
column_2 int);--删除column_2
alter table table_name replace columns(
column_1 string) cascade;    --column_2不写，即删除column_2，保留column_1

NOTE :

CASCADE会刷历史分区字段。

说明：

因为hive表大部分是分区表，而加上cascade【注：中文翻译为“级联”】关键字，不仅会变更新分区的表结构（metadata），同时也会变更旧分区的表结构。
当使用级联删除表中信息时，如果A表中的字段引用了B表中的字段，删除B表中字段信息，相应的A表也会删除。（当父表的信息删除，子表的信息也自动删除）
对于分区表，在增删改时，一定要加上cascade，否则其历史分区的元数据（metadata）信息将无法正常更新，可能会出现访问历史分区时数据为NULL等问题。

3、hdfs 文件统计

hdfs dfs -ls /apps/hive/warehouse/edw.db/table_name/ | wc -l

hdfs dfs -count /apps/hive/warehouse/edw.db/table_name

在这里插入图片描述
第一个数值表示目录下的文件夹的个数，

第二个数值表是当前文件夹下文件的个数，

第三个数值表示该文件夹下文件所占的空间大小，这个大小是不计算副本的个数的。

本文来自互联网用户投稿，该文观点仅代表作者本人，不代表本站立场。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如若转载，请注明出处：http://www.mzph.cn/news/226236.shtml

如若内容造成侵权/违法违规/事实不符，请联系多彩编程网进行投诉反馈email:809451989@qq.com，一经查实，立即删除！

【Hive】【Hadoop】工作中常操作的笔记-随时添加

文章目录

1、Hive 复制一个表:

2、字段级操作

3、hdfs 文件统计

相关文章

25.Java程序设计-基于SSM框架的微信小程序校园求职系统的设计与实现

数据结构-链表习题（C++）

什么是Ajax，Ajax的优点和用处有什么

翻译: LLM工具使用和代理Tool use and agents

【C 剑指offer】有序整型矩阵元素查找 {杨氏矩阵}

遥感论文 | Scientific Reports | 一种显著提升遥感影像小目标检测的网络！

安卓免Root做klipper上位机教程

connect: Network is unreachable问题解决

Mysql 的ROW_NUMBER() 和分区函数的使用 PARTITION BY的使用

分布式事务--初识Seata和TC部署

LoRA（Low-Rank Adaptation）

一文读懂算法中的时间复杂度和空间复杂度，O(1)、O(logn)、O(n)、O(n^2)、O(2^n) 附举例说明，常见的时间复杂度，空间复杂度

Python读写arxml文件

Mysql查询条件为大于时，不走索引失效场景

WGAN 优势小结

ubuntu18.04 安装yolov5环境及推理环境

心理测试网站源码，知己心理React心理健康测试

数据分析为何要学统计学（9）——总体不服从正态分布时使用什么假设检验方法？

千梦网创：逮住一闪而过的机会疯狂摩擦

【C++11特性篇】盘点C++11中三种简化声明的方式【auto】【decltype】【nullptr】（3）