当HDFS (HDP v3.1.0) 耗尽存储空间时出现问题,(这也会导致火花作业挂在可接受的模式中)。我假设有一些配置,我可以让HDFS使用节点主机上已经存在的更多存储空间,但是快速搜索到底是什么还不清楚。有更多经验的人能帮上忙吗?
在安巴里UI,我看到了..。

(来自安巴里UI)

(来自NameNode UI)。
然而,当通过ambari查看整个主机时,似乎仍然有很大的空间留给集群主机(列表中的最后4个节点是数据节点,每个节点总共有140 in的存储空间)。

不确定什么设置是相关的,但这里是ambari中的一般设置:

我对“HDFS预留空间”设置的解释是,它表明应该为非DFS保留13 ie(即。本地FS(本地FS)存储,因此似乎没有理由认为HDFS已经耗尽空间。我是不是误解了这一点?还有其他HDFS应该在这个问题中显示的内容吗?
看看HDFS的磁盘使用情况,我看到了.
[hdfs@HW001 root]$ hdfs dfs -du -h /
1.3 G 4.0 G /app-logs
3.7 M 2.3 G /apps
0 0 /ats
899.1 M 2.6 G /atsv2
0 0 /datalake
39.9 G 119.6 G /etl
1.7 G 5.2 G /hdp
0 0 /mapred
92.8 M 278.5 M /mr-history
19.5 G 60.4 G /ranger
4.4 K 13.1 K /services
11.3 G 34.0 G /spark2-history
1.8 M 5.4 M /tmp
4.3 G 42.2 G /user
0 0 /warehouse对于总共269 as的消耗掉 (也许设置一个较短的时间间隔来触发历史清理也会有帮助?)。看看HDFS上的自由空间我看到了..。
[hdfs@HW001 root]$ hdfs dfs -df -h /
Filesystem Size Used Available Use%
hdfs://hw001.ucera.local:8020 353.3 G 244.1 G 31.5 G 69%然而,安巴里报告了91%的产能,所以这在我看来很奇怪(除非我误解了一些东西(LMK))。这也与我在查看本地FS上的磁盘空间时所看到的内容相冲突,而hdfs datanode dirs位于.
[root@HW001 ~]# clush -ab -x airflowet df -h /hadoop/hdfs/data
HW001: df: ‘/hadoop/hdfs/data’: No such file or directory
airflowetl: df: ‘/hadoop/hdfs/data’: No such file or directory
---------------
HW002
---------------
Filesystem Size Used Avail Use% Mounted on
/dev/mapper/centos_mapr001-root 101G 93G 8.0G 93% /
---------------
HW003
---------------
Filesystem Size Used Avail Use% Mounted on
/dev/mapper/centos_mapr001-root 101G 94G 7.6G 93% /
---------------
HW004
---------------
Filesystem Size Used Avail Use% Mounted on
/dev/mapper/centos_mapr001-root 101G 92G 9.2G 91% /
---------------
HW005
---------------
Filesystem Size Used Avail Use% Mounted on
/dev/mapper/centos_mapr001-root 101G 92G 9.8G 91% /查看hdfs根的分块报告 ..。
[hdfs@HW001 root]$ hdfs fsck / -files -blocks
.
.
.
Status: HEALTHY
Number of data-nodes: 4
Number of racks: 1
Total dirs: 8734
Total symlinks: 0
Replicated Blocks:
Total size: 84897192381 B (Total open files size: 10582 B)
Total files: 43820 (Files currently being written: 10)
Total blocks (validated): 42990 (avg. block size 1974812 B) (Total open file blocks (not validated): 8)
Minimally replicated blocks: 42990 (100.0 %)
Over-replicated blocks: 0 (0.0 %)
Under-replicated blocks: 1937 (4.505699 %)
Mis-replicated blocks: 0 (0.0 %)
Default replication factor: 3
Average block replication: 3.045057
Missing blocks: 0
Corrupt blocks: 0
Missing replicas: 11597 (8.138018 %)
Erasure Coded Block Groups:
Total size: 0 B
Total files: 0
Total block groups (validated): 0
Minimally erasure-coded block groups: 0
Over-erasure-coded block groups: 0
Under-erasure-coded block groups: 0
Unsatisfactory placement block groups: 0
Average block group size: 0.0
Missing block groups: 0
Corrupt block groups: 0
Missing internal blocks: 0
FSCK ended at Tue May 26 12:10:43 HST 2020 in 1717 milliseconds
The filesystem under path '/' is HEALTHY我假设有一些配置,我可以让HDFS使用节点主机上已经存在的更多存储空间,但是快速搜索到底是什么还不清楚。有更多经验的人能帮上忙吗?另外,如果有人可以LMK,如果这可能是由于其他问题,我没有看到?
发布于 2020-05-26 21:28:52
例如,您还没有提到在/tmp中是否有糟糕的数据可以清理。
每个datanode有88.33GB的存储空间?
如果是这样的话,您就不能仅仅创建新的HDD来连接到集群中,然后突然创建空间。
dfs.data.dir in hdfs-site是每个datanode上挂载卷的逗号分隔列表。
要获得更多存储,您需要格式化和挂载更多磁盘,然后编辑该属性。
https://stackoverflow.com/questions/62031318
复制相似问题