HDFS作为分布式文件系统,提供创建、读取、写入、删除、移动、重命名、权限管理、查询、复制等操作,对应touchz、mkdir、put、cat、get、appendToFile、rm、mv、chmod、chown、ls、du、cp等常用命令,这些命令全面覆盖文件从创建到删除的完整生命周期,并支持目录管理、权限控制和批量操作,便于高效管理。
HDFS(Hadoop Distributed File System)作为一款分布式文件系统,提供了涵盖文件从创建到删除完整生命周期的操作命令与API。无论是文件创建、读取、写入,还是删除、移动、权限管理,HDFS都具备对应的处理手段。以下将系统梳理这些文件操作类型。

长期稳定更新的攒劲资源: >>>点此立即查看<<<
hadoop fs -touchz 可在HDFS中生成一个长度为0的空文件。若文件已存在,该命令仅更新修改时间,不会覆盖原有内容。hadoop fs -mkdir 用于创建单级目录。若需一次性创建多级目录(如/a/b/c),必须添加-p参数,否则父目录不存在时会报错。hadoop fs -put <本地路径> 是最常用的方式,可将本地文件上传至HDFS,目标路径自动生成文件。需注意:若目标路径已存在同名文件,put会直接覆盖。hadoop fs -cat 将文件内容输出至命令行,适用于小文件。大文件建议配合less或more分页查看,避免输出过长。hadoop fs -get <本地目标路径> 将HDFS文件复制回本地。若本地目标路径已有同名文件,命令会直接报错,不会自动覆盖。hadoop fs -getmerge <本地输出文件> 可将目录下多个文件按原始顺序合并为一个本地文件,适用于日志归并等场景。hadoop fs -tail 仅查看文件最后1KB,非常适合实时日志监控,无需下载整个文件。hadoop fs -put(前文已提及)是最常见的写入手段,支持指定覆盖或跳过已存在文件。hadoop fs -appendToFile <本地文件路径> 可将本地文件内容追加到HDFS已有文件末尾。在日志追加场景中,此命令比重新上传整个文件更高效。FileSystem.create()获取输出流,然后类似普通IO操作,使用FSDataOutputStream.write()写入数据。大文件分块写入即依靠此方法实现,是程序化写入的标准做法。hadoop fs -rm 直接删除指定文件。默认情况下文件被彻底删除,除非事先配置了回收站功能。-r参数(例如hadoop fs -rm -r ),否则会提示“Directory is not empty”错误。-f参数强制删除,不再额外确认;-skipTrash参数则直接绕过回收站永久删除。使用此参数需格外谨慎,误删后无法恢复。使用hadoop fs -mv <源路径> <目标路径>即可完成移动或重命名:
hadoop fs -mv /dir1/file.txt /dir2/,文件从/dir1移动至/dir2。hadoop fs -mv /dir/file.txt /dir/newfile.txt。hadoop fs -chmod <权限模式> ,例如hadoop fs -chmod 755 /file.txt表示所有者拥有读写执行权限,组和其他用户仅有读和执行权限。hadoop fs -chown <所有者>:<组> ,例如hadoop fs -chown hadoop:hadoop /file.txt可同时更改所有者和所属组。hadoop fs -stat <格式> 可获取详细元数据。例如hadoop fs -stat "%F %u %g %y" /file.txt依次显示文件类型、所有者、组、修改时间,灵活实用。hadoop fs -ls 列出目录下的文件和子目录。添加-h参数后,文件大小以KB、MB等可读格式显示;添加-R参数可递归显示所有子目录内容。hadoop fs -du 显示目录下所有文件的总大小。配合-s仅显示总计,配合-h以可读格式输出,例如hadoop fs -du -sh /dir。hadoop fs -cp <源路径> <目标路径>可在HDFS内部复制文件或目录:
hadoop fs -cp /dir1/file.txt /dir2/file.txt。-r参数(例如hadoop fs -cp -r /dir1 /dir2),递归复制整个目录及其所有内容。侠游戏发布此文仅为了传递信息,不代表侠游戏网站认同其观点或证实其描述