第3关:HDFS-JAVA接口之上传文件
任务描述
本关任务:使用HDFSAPI
上传文件至集群。
相关知识
为了完成本关任务,你需要掌握:FSDataInputStream
对象如何使用。
FSDataOutputStream对象
我们知道在Java
中要将数据输出到终端,需要文件输出流,HDFS
的JavaAPI
中也有类似的对象。
FileSystem
类有一系列新建文件的方法,最简单的方法是给准备新建的文件制定一个path
对象,然后返回一个用于写入数据的输出流:
public FSDataOutputStream create(Path p)throws IOException
该方法有很多重载方法,允许我们指定是否需要强制覆盖现有文件,文件备份数量,写入文件时所用缓冲区大小,文件块大小以及文件权限。
注意:
create()
方法能够为需要写入且当前不存在的目录创建父目录,即就算传入的路径是不存在的,该方法也会为你创建一个目录,而不会报错。如果有时候我们并不希望它这么做,可以先用exists()
方法先判断目录是否存在。
我们在写入数据的时候经常想要知道当前的进度,API
也提供了一个Progressable
用于传递回调接口,这样我们就可以很方便的将写入datanode
的进度通知给应用了。
package org.apache.hadoop.util;
public interface Progressable{
public void progress();
}
接下来我们通过一个例子来体验FSDataOutputStream
的用法:
还是一样我们先在本地创建一个文件,以供测试。
接下来编写代码:(可以直接在平台测试)
运行得到如下结果:
可以看到文件已经成功上传了。
编程要求
在右侧代码编辑区和命令行中,编写代码与脚本实现如下功能:
在
/develop/input/
目录下创建hello.txt
文件,并输入如下数据:
迢迢牵牛星,皎皎河汉女。
纤纤擢素手,札札弄机杼。
终日不成章,泣涕零如雨。
河汉清且浅,相去复几许?
盈盈一水间,脉脉不得语。
《迢迢牵牛星》
使用
FSDataOutputStream
对象将文件上传至HDFS
的/user/tmp/
目录下,并打印进度。
package step3;import java.io.BufferedInputStream;
import java.io.FileInputStream;
import java.io.FileNotFoundException;
import java.io.IOException;
import java.io.InputStream;
import java.net.URI;
import java.io.File;import org.apache.hadoop.conf.Configuration;
import org.apache.hadoop.fs.FSDataOutputStream;
import org.apache.hadoop.fs.FileSystem;
import org.apache.hadoop.fs.Path;
import org.apache.hadoop.io.IOUtils;
import org.apache.hadoop.util.Progressable;public class FileSystemUpload {
public static void main(String[] args) throws IOException {//请在 Begin-End 之间添加代码,完成任务要求。/********* Begin *********/File localPath = new File("/develop/input/hello.txt");String hdfsPath = "hdfs://localhost:9000/user/tmp/hello.txt";InputStream in = new BufferedInputStream(new FileInputStream(localPath));Configuration config = new Configuration();FileSystem fs = FileSystem.get(URI.create(hdfsPath), config);long fileSize = localPath.length() > 65536 ? localPath.length() / 65536 : 1;FSDataOutputStream out = fs.create(new Path(hdfsPath), new Progressable() {long fileCount = 0;public void progress() {System.out.println("总进度" + (fileCount / fileSize) * 100 + "%");fileCount++;}});IOUtils.copyBytes(in, out, 2048, true);/********* End *********/
}
}
测试说明
平台会运行你的java
程序,并查看集群的文件将文件信息输出到控制台,第一行属于警告信息可以忽略。
预期输出:
开始你的任务吧,祝你成功!
第3关:HDFS-JAVA接口之上传文件相关推荐
- 大数据从入门到实战-HDFS-JAVA接口之上传文件
FSDataOutputStream对象 我们知道在Java中要将数据输出到终端,需要文件输出流,HDFS的JavaAPI中也有类似的对象. FileSystem类有一系列新建文件的方法,最简单的方法 ...
- 爬虫之上传文件,request如何上传文件
爬虫之上传文件,request如何上传文件,当我们遇到需要上传文件的接口时,如何破解上传文件的密码呢? 如图,文件的参数名files[],传输多张图片,那如何用python实现呢? 1.方法1:使用r ...
- java 如何上传文件_java如何上传文件 | 快速入门
关键词:路径 上传文件 表单 文件 上传 存放 后台 定义 代码 数据 详细内容 相关文章 中文网 控制台 字段 一:准备好前台页面Upload.html 表单 action=上传文件后台接口 met ...
- 阿里云服务器Hadoop java api 上传文件报错 could only be written to 0 of the 1 minReplication nodes.
问题描述 阿里云服务器命令行使用命令可以上传文件,但HDFS java API上传失败,上传后只有文件名没有数据 报错: could only be written to 0 of the 1 min ...
- java flex 上传文件_使用Flex和java servlet上传文件
资源都是来自网上.本实例将展示使用Flex和java servlet上传文件. 事前准备就是到http://commons.apache.org 下载common-fileupload-1.1.1.j ...
- python上传图片到服务器_Flask入门之上传文件到服务器的方法示例
今天要做一个简单的页面,可以实现将文件 上传到服务器(保存在指定文件夹) #Sample.py # coding:utf-8 from flask import Flask,render_templa ...
- Flask入门之上传文件到服务器
https://www.cnblogs.com/wongbingming/p/6802660.html flask 文件的上传下载和excel操作 Flask入门之上传文件到服务器 今天要做一个简单的 ...
- Flask入门之上传文件到本地服务器
Flask入门之上传文件到服务器 今天要做一个简单的页面,可以实现将文件 上传到服务器(保存在指定文件夹) #Sample.py 1 # coding:utf-8 2 3 from flask imp ...
- 【vue开发问题-解决方法】(九)使用element upload自定义接口上传文件,input多文件上传
[vue开发问题-解决方法](九)使用element upload自定义接口上传文件,input多文件上传 参考文章: (1)[vue开发问题-解决方法](九)使用element upload自定义接 ...
最新文章
- Execution failed for task ':app:transformResourcesWithMergeJavaResForDebug'.
- java 数据结构实例_数据结构(Java)——栈的实例
- arc下内存泄漏的解决小技巧
- Qt学习笔记之常用控件QlistWidget
- 理解Flex itemRenderer(3)--通信
- c++ list 修改_Cpython源码阅读17-list自动扩容原理
- Cloud for Customer ApplicationStarter.js和fQuickLogin
- python下载微信公众号文章_python如何导出微信公众号文章方法详解
- matlab将struct和cell转换成matrices
- luoguP3185 [HNOI2007]分裂游戏 枚举 + 博弈论
- 关于Config.ARGB_8888、Config.ALPHA_8、Config.ARGB_4444、Config.RGB_565的理解
- linux 文本 编辑 软件下载,文本编辑软件 Atom 1.5.0 已经发布下载
- 数据:DOGE近24小时交易额约为107.91亿美元
- 17、手势(Gesture)
- 对外汉语偏误语料库_BCC语料库
- 第13届景驰-埃森哲杯广东工业大学ACM程序设计大赛.J强迫症的序列
- 小白学python#Day5#笔耕不辍#每日一句,提高认知
- 连载《阿里巴巴·马云》4 : 他就像一个鬼鬼祟祟的坏人
- vue2和vue3关闭语法检查
- 用函数调用编写程序,函数的功能是:根据以下公式计算s,计算结果作为函数值返回;n通过形参传入。s=1+1/(1+2)+...+1/(1+2+3+...+n).)
热门文章
- springboot整合jwt_springBoot整合JWT使用
- ie的window.open 未指明的错误_快递问题公告中错误使用“黑恶势力”等言辞 青岛工学院致歉...
- 微信小程序中处理 获取用户地址的回调
- 小汤学编程之JavaEE学习day02——Servlet使用步骤、生命周期、接收与返回数据、GET与POST、转发与重定向
- 初使用 ReportViewer 控件时遇到的一点小麻烦
- @EqualsAndHashCode
- Javascript组成--ECMAScript,DOM,BOM
- 【BZOJ3566】—概率充电器(树形+概率dp)
- 从字符串数组中寻找数字的元素
- premiere安装失败解决办法