任务描述

本关任务:使用HDFSAPI上传文件至集群。

相关知识

为了完成本关任务,你需要掌握:FSDataInputStream对象如何使用。

FSDataOutputStream对象

我们知道在Java中要将数据输出到终端,需要文件输出流,HDFSJavaAPI中也有类似的对象。
FileSystem类有一系列新建文件的方法,最简单的方法是给准备新建的文件制定一个path对象,然后返回一个用于写入数据的输出流:


  1. public FSDataOutputStream create(Path p)throws IOException

该方法有很多重载方法,允许我们指定是否需要强制覆盖现有文件,文件备份数量,写入文件时所用缓冲区大小,文件块大小以及文件权限。

注意:create()方法能够为需要写入且当前不存在的目录创建父目录,即就算传入的路径是不存在的,该方法也会为你创建一个目录,而不会报错。如果有时候我们并不希望它这么做,可以先用exists()方法先判断目录是否存在。

我们在写入数据的时候经常想要知道当前的进度,API也提供了一个Progressable用于传递回调接口,这样我们就可以很方便的将写入datanode的进度通知给应用了。


  1. package org.apache.hadoop.util;
  2. public interface Progressable{
  3. public void progress();
  4. }

接下来我们通过一个例子来体验FSDataOutputStream的用法:

还是一样我们先在本地创建一个文件,以供测试。

接下来编写代码:(可以直接在平台测试)

运行得到如下结果:

可以看到文件已经成功上传了。

编程要求

在右侧代码编辑区和命令行中,编写代码与脚本实现如下功能:

  • /develop/input/目录下创建hello.txt文件,并输入如下数据:
    迢迢牵牛星,皎皎河汉女。
    纤纤擢素手,札札弄机杼。
    终日不成章,泣涕零如雨。
    河汉清且浅,相去复几许?
    盈盈一水间,脉脉不得语。
    《迢迢牵牛星》

  • 使用FSDataOutputStream对象将文件上传至HDFS/user/tmp/目录下,并打印进度。

package step3;import java.io.BufferedInputStream;
import java.io.FileInputStream;
import java.io.FileNotFoundException;
import java.io.IOException;
import java.io.InputStream;
import java.net.URI;
import java.io.File;import org.apache.hadoop.conf.Configuration;
import org.apache.hadoop.fs.FSDataOutputStream;
import org.apache.hadoop.fs.FileSystem;
import org.apache.hadoop.fs.Path;
import org.apache.hadoop.io.IOUtils;
import org.apache.hadoop.util.Progressable;public class FileSystemUpload {
public static void main(String[] args) throws IOException {//请在 Begin-End 之间添加代码,完成任务要求。/********* Begin *********/File localPath = new File("/develop/input/hello.txt");String hdfsPath = "hdfs://localhost:9000/user/tmp/hello.txt";InputStream in = new BufferedInputStream(new FileInputStream(localPath));Configuration config = new Configuration();FileSystem fs = FileSystem.get(URI.create(hdfsPath), config);long fileSize = localPath.length() > 65536 ? localPath.length() / 65536 : 1;FSDataOutputStream out = fs.create(new Path(hdfsPath), new Progressable() {long fileCount = 0;public void progress() {System.out.println("总进度" + (fileCount / fileSize) * 100 + "%");fileCount++;}});IOUtils.copyBytes(in, out, 2048, true);/********* End *********/
}
}

测试说明

平台会运行你的java程序,并查看集群的文件将文件信息输出到控制台,第一行属于警告信息可以忽略。

预期输出:


开始你的任务吧,祝你成功!

第3关:HDFS-JAVA接口之上传文件相关推荐

  1. 大数据从入门到实战-HDFS-JAVA接口之上传文件

    FSDataOutputStream对象 我们知道在Java中要将数据输出到终端,需要文件输出流,HDFS的JavaAPI中也有类似的对象. FileSystem类有一系列新建文件的方法,最简单的方法 ...

  2. 爬虫之上传文件,request如何上传文件

    爬虫之上传文件,request如何上传文件,当我们遇到需要上传文件的接口时,如何破解上传文件的密码呢? 如图,文件的参数名files[],传输多张图片,那如何用python实现呢? 1.方法1:使用r ...

  3. java 如何上传文件_java如何上传文件 | 快速入门

    关键词:路径 上传文件 表单 文件 上传 存放 后台 定义 代码 数据 详细内容 相关文章 中文网 控制台 字段 一:准备好前台页面Upload.html 表单 action=上传文件后台接口 met ...

  4. 阿里云服务器Hadoop java api 上传文件报错 could only be written to 0 of the 1 minReplication nodes.

    问题描述 阿里云服务器命令行使用命令可以上传文件,但HDFS java API上传失败,上传后只有文件名没有数据 报错: could only be written to 0 of the 1 min ...

  5. java flex 上传文件_使用Flex和java servlet上传文件

    资源都是来自网上.本实例将展示使用Flex和java servlet上传文件. 事前准备就是到http://commons.apache.org 下载common-fileupload-1.1.1.j ...

  6. python上传图片到服务器_Flask入门之上传文件到服务器的方法示例

    今天要做一个简单的页面,可以实现将文件 上传到服务器(保存在指定文件夹) #Sample.py # coding:utf-8 from flask import Flask,render_templa ...

  7. Flask入门之上传文件到服务器

    https://www.cnblogs.com/wongbingming/p/6802660.html flask 文件的上传下载和excel操作 Flask入门之上传文件到服务器 今天要做一个简单的 ...

  8. Flask入门之上传文件到本地服务器

    Flask入门之上传文件到服务器 今天要做一个简单的页面,可以实现将文件 上传到服务器(保存在指定文件夹) #Sample.py 1 # coding:utf-8 2 3 from flask imp ...

  9. 【vue开发问题-解决方法】(九)使用element upload自定义接口上传文件,input多文件上传

    [vue开发问题-解决方法](九)使用element upload自定义接口上传文件,input多文件上传 参考文章: (1)[vue开发问题-解决方法](九)使用element upload自定义接 ...

最新文章

  1. 题目1154:Jungle Roads
  2. 什么是百度竞价创意断句符
  3. 做iOS开发的这2年:30而立投身iOS开发嫌晚?
  4. Leetcode-5846.周赛 找到数组的中间位置
  5. 计算机IO系列(二)BIO/NIO/多路复用实现
  6. IBM收购以色列应用发现公司EZSource
  7. NET问答: 重写了 Equals,还有必要重写 GetHashCode 吗?
  8. c语言基本数据类型常量,C语言基础学习基本数据类型-变量和常量
  9. debian安装java jdk_Linux(Centos、Debian)之安装Java JDK及注意事项(转)
  10. 网络 一篇博文搞懂五种常见的IO模型
  11. 计算机网络数据链路层之使用点对点信道
  12. 在php定界符中,PHP中的定界符 - ho俊的个人空间 - OSCHINA - 中文开源技术交流社区...
  13. property attribute: assign, strong, weak, unsafe_unretain and copy
  14. SBUS协议:SBUS解析与合成
  15. android 定位 指南针,Android 实现指南针效果
  16. linux 清除bios 密码吗,如何设置/清除 BIOS 硬盘密码
  17. 米家APP获取小米、绿米网关key的方法(5.6.81版本)(2020_05_15)
  18. ajax心得体会论文,AJAX重点知识的心得体会
  19. js添加到桌面快捷方式(实现功能)
  20. TREC的ad hoc、routing、filtering、topic等术语的解释

热门文章

  1. 给DNS划重点:分析ISC BIND必知必会
  2. Python学习入门1:Python 新手入门引导
  3. Oracle从零开始5——数据库定义操作
  4. 将button变成圆形(有弧度)
  5. 小汤学编程之JAVA基础day09——常用类(一):比较器、内部类和包装类
  6. 「雕爷学编程」Arduino动手做(30)——光敏二极管模块
  7. ubuntu 18.04下安装Java
  8. Elasticsearch-搜索推荐
  9. 轻松逃脱某防火墙对ss的探测
  10. 关于Servlet中filter过滤器的小问题