任务描述

本关任务:使用HDFSAPI上传文件至集群。

相关知识

为了完成本关任务,你需要掌握:FSDataInputStream对象如何使用。

FSDataOutputStream对象

我们知道在Java中要将数据输出到终端,需要文件输出流,HDFSJavaAPI中也有类似的对象。
FileSystem类有一系列新建文件的方法,最简单的方法是给准备新建的文件制定一个path对象,然后返回一个用于写入数据的输出流:


  1. public FSDataOutputStream create(Path p)throws IOException

该方法有很多重载方法,允许我们指定是否需要强制覆盖现有文件,文件备份数量,写入文件时所用缓冲区大小,文件块大小以及文件权限。

注意:create()方法能够为需要写入且当前不存在的目录创建父目录,即就算传入的路径是不存在的,该方法也会为你创建一个目录,而不会报错。如果有时候我们并不希望它这么做,可以先用exists()方法先判断目录是否存在。

我们在写入数据的时候经常想要知道当前的进度,API也提供了一个Progressable用于传递回调接口,这样我们就可以很方便的将写入datanode的进度通知给应用了。


  1. package org.apache.hadoop.util;
  2. public interface Progressable{
  3. public void progress();
  4. }

接下来我们通过一个例子来体验FSDataOutputStream的用法:

还是一样我们先在本地创建一个文件,以供测试。

接下来编写代码:(可以直接在平台测试)

运行得到如下结果:

可以看到文件已经成功上传了。

编程要求

在右侧代码编辑区和命令行中,编写代码与脚本实现如下功能:

  • /develop/input/目录下创建hello.txt文件,并输入如下数据:
    迢迢牵牛星,皎皎河汉女。
    纤纤擢素手,札札弄机杼。
    终日不成章,泣涕零如雨。
    河汉清且浅,相去复几许?
    盈盈一水间,脉脉不得语。
    《迢迢牵牛星》

  • 使用FSDataOutputStream对象将文件上传至HDFS/user/tmp/目录下,并打印进度。

package step3;import java.io.BufferedInputStream;
import java.io.FileInputStream;
import java.io.FileNotFoundException;
import java.io.IOException;
import java.io.InputStream;
import java.net.URI;
import java.io.File;import org.apache.hadoop.conf.Configuration;
import org.apache.hadoop.fs.FSDataOutputStream;
import org.apache.hadoop.fs.FileSystem;
import org.apache.hadoop.fs.Path;
import org.apache.hadoop.io.IOUtils;
import org.apache.hadoop.util.Progressable;public class FileSystemUpload {
public static void main(String[] args) throws IOException {//请在 Begin-End 之间添加代码,完成任务要求。/********* Begin *********/File localPath = new File("/develop/input/hello.txt");String hdfsPath = "hdfs://localhost:9000/user/tmp/hello.txt";InputStream in = new BufferedInputStream(new FileInputStream(localPath));Configuration config = new Configuration();FileSystem fs = FileSystem.get(URI.create(hdfsPath), config);long fileSize = localPath.length() > 65536 ? localPath.length() / 65536 : 1;FSDataOutputStream out = fs.create(new Path(hdfsPath), new Progressable() {long fileCount = 0;public void progress() {System.out.println("总进度" + (fileCount / fileSize) * 100 + "%");fileCount++;}});IOUtils.copyBytes(in, out, 2048, true);/********* End *********/
}
}

测试说明

平台会运行你的java程序,并查看集群的文件将文件信息输出到控制台,第一行属于警告信息可以忽略。

预期输出:


开始你的任务吧,祝你成功!

第3关:HDFS-JAVA接口之上传文件相关推荐

  1. 大数据从入门到实战-HDFS-JAVA接口之上传文件

    FSDataOutputStream对象 我们知道在Java中要将数据输出到终端,需要文件输出流,HDFS的JavaAPI中也有类似的对象. FileSystem类有一系列新建文件的方法,最简单的方法 ...

  2. 爬虫之上传文件,request如何上传文件

    爬虫之上传文件,request如何上传文件,当我们遇到需要上传文件的接口时,如何破解上传文件的密码呢? 如图,文件的参数名files[],传输多张图片,那如何用python实现呢? 1.方法1:使用r ...

  3. java 如何上传文件_java如何上传文件 | 快速入门

    关键词:路径 上传文件 表单 文件 上传 存放 后台 定义 代码 数据 详细内容 相关文章 中文网 控制台 字段 一:准备好前台页面Upload.html 表单 action=上传文件后台接口 met ...

  4. 阿里云服务器Hadoop java api 上传文件报错 could only be written to 0 of the 1 minReplication nodes.

    问题描述 阿里云服务器命令行使用命令可以上传文件,但HDFS java API上传失败,上传后只有文件名没有数据 报错: could only be written to 0 of the 1 min ...

  5. java flex 上传文件_使用Flex和java servlet上传文件

    资源都是来自网上.本实例将展示使用Flex和java servlet上传文件. 事前准备就是到http://commons.apache.org 下载common-fileupload-1.1.1.j ...

  6. python上传图片到服务器_Flask入门之上传文件到服务器的方法示例

    今天要做一个简单的页面,可以实现将文件 上传到服务器(保存在指定文件夹) #Sample.py # coding:utf-8 from flask import Flask,render_templa ...

  7. Flask入门之上传文件到服务器

    https://www.cnblogs.com/wongbingming/p/6802660.html flask 文件的上传下载和excel操作 Flask入门之上传文件到服务器 今天要做一个简单的 ...

  8. Flask入门之上传文件到本地服务器

    Flask入门之上传文件到服务器 今天要做一个简单的页面,可以实现将文件 上传到服务器(保存在指定文件夹) #Sample.py 1 # coding:utf-8 2 3 from flask imp ...

  9. 【vue开发问题-解决方法】(九)使用element upload自定义接口上传文件,input多文件上传

    [vue开发问题-解决方法](九)使用element upload自定义接口上传文件,input多文件上传 参考文章: (1)[vue开发问题-解决方法](九)使用element upload自定义接 ...

最新文章

  1. Execution failed for task ':app:transformResourcesWithMergeJavaResForDebug'.
  2. java 数据结构实例_数据结构(Java)——栈的实例
  3. arc下内存泄漏的解决小技巧
  4. Qt学习笔记之常用控件QlistWidget
  5. 理解Flex itemRenderer(3)--通信
  6. c++ list 修改_Cpython源码阅读17-list自动扩容原理
  7. Cloud for Customer ApplicationStarter.js和fQuickLogin
  8. python下载微信公众号文章_python如何导出微信公众号文章方法详解
  9. matlab将struct和cell转换成matrices
  10. luoguP3185 [HNOI2007]分裂游戏 枚举 + 博弈论
  11. 关于Config.ARGB_8888、Config.ALPHA_8、Config.ARGB_4444、Config.RGB_565的理解
  12. linux 文本 编辑 软件下载,文本编辑软件 Atom 1.5.0 已经发布下载
  13. 数据:DOGE近24小时交易额约为107.91亿美元
  14. 17、手势(Gesture)
  15. 对外汉语偏误语料库_BCC语料库
  16. 第13届景驰-埃森哲杯广东工业大学ACM程序设计大赛.J强迫症的序列
  17. 小白学python#Day5#笔耕不辍#每日一句,提高认知
  18. 连载《阿里巴巴·马云》4 : 他就像一个鬼鬼祟祟的坏人
  19. vue2和vue3关闭语法检查
  20. 用函数调用编写程序,函数的功能是:根据以下公式计算s,计算结果作为函数值返回;n通过形参传入。s=1+1/(1+2)+...+1/(1+2+3+...+n).)

热门文章

  1. springboot整合jwt_springBoot整合JWT使用
  2. ie的window.open 未指明的错误_快递问题公告中错误使用“黑恶势力”等言辞 青岛工学院致歉...
  3. 微信小程序中处理 获取用户地址的回调
  4. 小汤学编程之JavaEE学习day02——Servlet使用步骤、生命周期、接收与返回数据、GET与POST、转发与重定向
  5. 初使用 ReportViewer 控件时遇到的一点小麻烦
  6. @EqualsAndHashCode
  7. Javascript组成--ECMAScript,DOM,BOM
  8. 【BZOJ3566】—概率充电器(树形+概率dp)
  9. 从字符串数组中寻找数字的元素
  10. premiere安装失败解决办法