java寫hdfs程序

阿新 • • 發佈：2018-10-09

格式化 generated tfs () pid 需要 false ati end

1、hadoop默認臨時數據文件是存儲於Unix的tmp目錄下（cd /tmp 包含hadoop-root等文件），如果不進行修改，linux系統重啟後hadoop有可能出現不正常現象；故需要修改hadoop的臨時文件存放目錄
2、vim core-site.xml 配置如下，然後重啟hadoop集群，不要對namenode重新進行格式化操作
修改datanode /var/hadoop/dfs/data/current 目錄下VERSION文件的clusterid與namenode一致；然後啟動集群正常
<property>
<name>hadoop.tmp.dir</name>

<value>/var/hadoop</value>
</property>
在namenode執行格式化操作後，會導致namenode重新生成clusterid，而datanode的clusterID值沒變，
namenode與datanode clusterid不一致導致datanode啟動異常；需要手動改成與namenode一致
3、測試時，可以關閉權限檢查(否則沒有權限訪問)，在namenode節點添加如下配置
vim hdfs-site.xml
<property>
<name>dfs.permissions.enabled</name>

<value>false</value>
</property>

<groupId>com.skcc</groupId>
<artifactId>wordcount</artifactId>
<version>0.0.1-SNAPSHOT</version>
<name>wordcount</name>
<description>count the word</description>

<properties>
    <project.build.sourceencoding>UTF-8</project.build.sourceencoding>
    <hadoop.version>2.7.3</hadoop.version>
</properties>
<dependencies>
    <dependency>
        <groupId>junit</groupId>
        <artifactId>junit</artifactId>
        <version>4.12</version>
    </dependency>
    <dependency>
        <groupId>org.apache.hadoop</groupId>
        <artifactId>hadoop-client</artifactId>
        <version>${hadoop.version}</version>
    </dependency>
    <dependency>
        <groupId>org.apache.hadoop</groupId>
        <artifactId>hadoop-common</artifactId>
        <version>${hadoop.version}</version>
    </dependency>
    <dependency>
        <groupId>org.apache.hadoop</groupId>
        <artifactId>hadoop-hdfs</artifactId>
        <version>${hadoop.version}</version>
    </dependency>
</dependencies>

</project>

package com.skcc.hadoop;

import java.io.FileInputStream;
import java.io.IOException;
import java.io.InputStream;
import java.net.URL;
import java.text.NumberFormat;

import org.apache.hadoop.conf.Configuration;
import org.apache.hadoop.fs.FSDataOutputStream;
import org.apache.hadoop.fs.FileSystem;
import org.apache.hadoop.fs.FsUrlStreamHandlerFactory;
import org.apache.hadoop.fs.Path;
import org.apache.hadoop.io.IOUtils;

public class HelloHDFS {

public HelloHDFS() {
    // TODO Auto-generated constructor stub
}

public static FileSystem getFileSystemInstance() {
    Configuration conf = new Configuration();
    conf.set("fs.defaultFS", "hdfs://172.26.19.40:9000");
    FileSystem fileSystem = null;
    try {
        fileSystem = FileSystem.get(conf);
    } catch (IOException e) {
        // TODO Auto-generated catch block
        e.printStackTrace();
    }
    return fileSystem;
}

public static void getFileFromHDFS() throws Exception {
    //URL 默認處理http協議， FsUrlStreamHandlerFactory 處理hdfs協議
    URL.setURLStreamHandlerFactory(new FsUrlStreamHandlerFactory());
    URL url=new URL("hdfs://172.26.19.40:9000/10803060234.txt");
    InputStream inputStream= url.openStream();
    IOUtils.copyBytes(inputStream, System.out, 4096,true);
}

public static void getFileFromBaiDu() throws IOException {

    URL url=new URL("http://skynet.skhynix-cq.com.cn/plusWare/Main.aspx");
    InputStream inputStream= url.openStream();
    IOUtils.copyBytes(inputStream, System.out, 4096,true);
}

public static void testHadoop() throws Exception {
    FileSystem fileSystem = getFileSystemInstance();

    Boolean success = fileSystem.mkdirs(new Path("/skcc"));
    System.out.println("mkdirs is " + success);

    success = fileSystem.exists(new Path("/10803060234.txt"));
    System.out.println("file exists is " + success);

    success = fileSystem.delete(new Path("/test2.data"),true);
    System.out.println("delete dirs is " + success);

    success = fileSystem.exists(new Path("/skcc"));
    System.out.println("dirs exists is "+ success);

}

public static void uploadFileToHDFS() throws Exception {
    FileSystem fileSystem = getFileSystemInstance();
    String filename = "/test2.data";
    // overwrite ==true
    FSDataOutputStream outputStream = fileSystem.create(new Path(filename), true);
    FileInputStream fis = new FileInputStream("D:\\2018\\u001.zip");

// IOUtils.copyBytes(fis, outputStream, 4096, true);

    long totalLen = fis.getChannel().size();
    long tmpSize = 0;
    double readPercent = 0;
    NumberFormat numberFormat = NumberFormat.getInstance();
    numberFormat.setMaximumFractionDigits(0);
    System.out.println("totalLen : " + totalLen + " available : " + fis.available());
    byte[] buf = new byte[4096];
    int len = fis.read(buf);
    while (len != -1) {
        tmpSize = tmpSize + len;
        String result = numberFormat.format((float)tmpSize / (float)totalLen * 100 );

        outputStream.write(buf,0,len);
        System.out.println("Upload Percent : " + result + "%");
        len = fis.read(buf);

    }

}

}

java寫hdfs程序

格式化 generated tfs () pid 需要 false ati end 1、hadoop默認臨時數據文件是存儲於Unix的tmp目錄下（cd /tmp 包含hadoop-root等文件），如果不進行修改，linux系統重啟後hadoop有可能出現不正常現象；故需

java寫hdfs程序

java寫hdfs程序

五：用JAVA寫一個阿裏雲VPC Open API調用程序

Java操作HDFS開發環境搭建以及HDFS的讀寫流程

代寫COMP3331/9331作業、代做C/Java/Python編程作業、代寫Java/Python語言程序作業

Java 讀寫 hdfs檔案或者目錄

java hadoop hdfs 上寫檔案

(6)Java 讀寫 hdfs檔案或者目錄

MVC模式在Java Web應用程序中的實例分析

MVC模式在Java Web應用程序中的實例

設計四個線程，當中共兩個線程每次對j添加1，另外兩個線程每次對j降低1。循環100次，寫出程序。

沒時間看。先記下。跟之前已經寫好程序比對下。

【.net 深呼吸】自己動手來寫應用程序設置類

Java高級程序員面試題

設計 4 個線程，其中兩個線程每次對 j 增加 1，另外兩個線程對 j 每次減少 1。寫出程序。

Java並發程序設計（三） Java內存模型和線程安全

win10下通過Anaconda安裝TensorFlow-GPU1.3版本，並配置pycharm運行Mnist手寫識別程序

Java後端程序員1年工作經驗總結

隱藏你寫的程序代碼

寫一個程序，判斷運行程序的系統的是大字節序還是小字節序

Java的基本程序設計結構【3】

java寫hdfs程序

相關推薦