使用Java API進行tar.gz文件及文件夾壓縮解壓縮

在java(JDK)中我們可以使用ZipOutputStream去創(chuàng)建zip壓縮文件掏父,(參考我之前寫的文章 使用java API進行zip遞歸壓縮文件夾以及解壓 ),也可以使用GZIPOutputStream去創(chuàng)建gzip(gz)壓縮文件兼都,但是java中沒有一種官方的API可以去創(chuàng)建tar.gz文件旨涝。所以我們需要使用到第三方庫Apache Commons Compress去創(chuàng)建.tar.gz文件漂羊。

在pom.xml中驾锰,我們可以通過如下的maven坐標引入commons-compress。

<dependency>
    <groupId>org.apache.commons</groupId>
    <artifactId>commons-compress</artifactId>
    <version>1.20</version>
</dependency>

解釋說明

  1. tar文件準確的說是打包文件走越,將文件打包到一個tar文件中椭豫,文件名后綴是.tar
  2. Gzip是將文件的存儲空間壓縮保存,文件名后綴是.gz
  3. tar.gz.tgz通常是指將文件打包到一個tar文件中旨指,并將它使用Gzip進行壓縮赏酥。

如果您閱讀完本文覺得對您有幫助的話,請給我一個贊谆构,您的支持是我不竭的創(chuàng)作動力裸扶!

一、將兩個文件打包到tar.gz

下面的這個例子是將2個文件打包為tar.gz壓縮文件搬素。下文代碼中的流操作使用了try-with-resources語法姓言,所以不用寫代碼手動的close流瞬项。

import org.apache.commons.compress.archivers.tar.TarArchiveEntry;
import org.apache.commons.compress.archivers.tar.TarArchiveOutputStream;
import org.apache.commons.compress.compressors.gzip.GzipCompressorOutputStream;
import org.junit.jupiter.api.Test;

import java.io.BufferedOutputStream;
import java.io.IOException;
import java.io.OutputStream;
import java.nio.file.Files;
import java.nio.file.Path;
import java.nio.file.Paths;
import java.util.Arrays;
import java.util.List;

public class TarGzTest {

  @Test
  void testFilesTarGzip() throws IOException {
    //輸入文件蔗蹋,被壓縮文件
    Path path1 = Paths.get("/home/test/file-a.xml");
    Path path2 = Paths.get("/home/test/file-b.txt");
    List<Path> paths = Arrays.asList(path1, path2);

    //輸出文件壓縮結(jié)果
    Path output = Paths.get("/home/test/output.tar.gz");

    //OutputStream輸出流何荚、BufferedOutputStream緩沖輸出流
    //GzipCompressorOutputStream是gzip壓縮輸出流
    //TarArchiveOutputStream打tar包輸出流(包含gzip壓縮輸出流)
    try (OutputStream fOut = Files.newOutputStream(output);
         BufferedOutputStream buffOut = new BufferedOutputStream(fOut);
         GzipCompressorOutputStream gzOut = new GzipCompressorOutputStream(buffOut);
         TarArchiveOutputStream tOut = new TarArchiveOutputStream(gzOut)) {

      //遍歷文件list
      for (Path path : paths) {
        //該文件不是目錄或者符號鏈接
        if (!Files.isRegularFile(path)) {
          throw new IOException("Support only file!");
        }
        //將該文件放入tar包,并執(zhí)行g(shù)zip壓縮
        TarArchiveEntry tarEntry = new TarArchiveEntry(
                path.toFile(),
                path.getFileName().toString());

        tOut.putArchiveEntry(tarEntry);
        Files.copy(path, tOut);

        tOut.closeArchiveEntry();
      }
      //for循環(huán)完成之后猪杭,finish-tar包輸出流
      tOut.finish();
    }
  }
}

file-a.xmlfile-b.txt打包到output.tar文件中餐塘,并使用gzip對這個tar包進行壓縮≡硭保可以使用如下命令查看tar包里面包含的文件戒傻。

$ tar -tvf /home/test/output.tar.gz
-rw-r--r-- 0/0          23546 2020-08-17 12:07 file-a.xml
-rw-r--r-- 0/0              34  2020-08-17 12:36 file-b.txt

二、將一個文件夾壓縮為tar.gz

下面的例子將一個文件夾蜂筹,包含其子文件夾的文件或子目錄需纳,打包為tar,并使用gzip進行壓縮艺挪。最終成為一個tar.gz打包壓縮文件不翩。
其核心原理是:使用到Files.walkFileTree依次遍歷文件目錄樹中的文件,將其一個一個的添加到TarArchiveOutputStream.輸出流麻裳。

@Test
void testDirTarGzip() throws IOException {
  // 被壓縮打包的文件夾
  Path source = Paths.get("/home/test");
  //如果不是文件夾拋出異常
  if (!Files.isDirectory(source)) {
    throw new IOException("請指定一個文件夾");
  }

  //壓縮之后的輸出文件名稱
  String tarFileName = "/home/" + source.getFileName().toString() + ".tar.gz";

  //OutputStream輸出流口蝠、BufferedOutputStream緩沖輸出流
  //GzipCompressorOutputStream是gzip壓縮輸出流
  //TarArchiveOutputStream打tar包輸出流(包含gzip壓縮輸出流)
  try (OutputStream fOut = Files.newOutputStream(Paths.get(tarFileName));
       BufferedOutputStream buffOut = new BufferedOutputStream(fOut);
       GzipCompressorOutputStream gzOut = new GzipCompressorOutputStream(buffOut);
       TarArchiveOutputStream tOut = new TarArchiveOutputStream(gzOut)) {
    //遍歷文件目錄樹
    Files.walkFileTree(source, new SimpleFileVisitor<Path>() {

      //當成功訪問到一個文件
      @Override
      public FileVisitResult visitFile(Path file,
                                       BasicFileAttributes attributes) throws IOException {

        // 判斷當前遍歷文件是不是符號鏈接(快捷方式),不做打包壓縮處理
        if (attributes.isSymbolicLink()) {
          return FileVisitResult.CONTINUE;
        }

        //獲取當前遍歷文件名稱
        Path targetFile = source.relativize(file);

        //將該文件打包壓縮
        TarArchiveEntry tarEntry = new TarArchiveEntry(
                file.toFile(), targetFile.toString());
        tOut.putArchiveEntry(tarEntry);
        Files.copy(file, tOut);
        tOut.closeArchiveEntry();
        //繼續(xù)下一個遍歷文件處理
        return FileVisitResult.CONTINUE;
      }

      //當前遍歷文件訪問失敗
      @Override
      public FileVisitResult visitFileFailed(Path file, IOException exc) {
        System.err.printf("無法對該文件壓縮打包為tar.gz : %s%n%s%n", file, exc);
        return FileVisitResult.CONTINUE;
      }

    });
    //for循環(huán)完成之后津坑,finish-tar包輸出流
    tOut.finish();
  }
}

三妙蔗、解壓tar.gz壓縮文件

下面一個例子說明如何解壓一個tar.gz文件,具體內(nèi)容請看代碼注釋疆瑰。

@Test
void testDeCompressTarGzip() throws IOException {
  //解壓文件
  Path source = Paths.get("/home/test/output.tar.gz");
  //解壓到哪
  Path target = Paths.get("/home/test2");
  
  if (Files.notExists(source)) {
    throw new IOException("您要解壓的文件不存在");
  }

  //InputStream輸入流眉反,以下四個流將tar.gz讀取到內(nèi)存并操作
  //BufferedInputStream緩沖輸入流
  //GzipCompressorInputStream解壓輸入流
  //TarArchiveInputStream解tar包輸入流
  try (InputStream fi = Files.newInputStream(source);
       BufferedInputStream bi = new BufferedInputStream(fi);
       GzipCompressorInputStream gzi = new GzipCompressorInputStream(bi);
       TarArchiveInputStream ti = new TarArchiveInputStream(gzi)) {

    ArchiveEntry entry;
    while ((entry = ti.getNextEntry()) != null) {

      //獲取解壓文件目錄,并判斷文件是否損壞
      Path newPath = zipSlipProtect(entry, target);
      
      if (entry.isDirectory()) {
        //創(chuàng)建解壓文件目錄
        Files.createDirectories(newPath);
      } else {
        //再次校驗解壓文件目錄是否存在
        Path parent = newPath.getParent();
        if (parent != null) {
          if (Files.notExists(parent)) {
            Files.createDirectories(parent);
          }
        }
        // 將解壓文件輸入到TarArchiveInputStream穆役,輸出到磁盤newPath目錄
        Files.copy(ti, newPath, StandardCopyOption.REPLACE_EXISTING);

      }
    }
  }
  
}

//判斷壓縮文件是否被損壞寸五,并返回該文件的解壓目錄
private  Path zipSlipProtect(ArchiveEntry entry,Path targetDir)
        throws IOException {

  Path targetDirResolved = targetDir.resolve(entry.getName());
  Path normalizePath = targetDirResolved.normalize();

  if (!normalizePath.startsWith(targetDir)) {
    throw new IOException("壓縮文件已被損壞: " + entry.getName());
  }

  return normalizePath;
}

歡迎關(guān)注我的博客,里面有很多精品合集

  • 本文轉(zhuǎn)載注明出處(必須帶連接孵睬,不能只轉(zhuǎn)文字):字母哥博客播歼。

覺得對您有幫助的話,幫我點贊掰读、分享秘狞!您的支持是我不竭的創(chuàng)作動力! 蹈集。另外烁试,筆者最近一段時間輸出了如下的精品內(nèi)容,期待您的關(guān)注拢肆。

?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請聯(lián)系作者
  • 序言:七十年代末减响,一起剝皮案震驚了整個濱河市靖诗,隨后出現(xiàn)的幾起案子,更是在濱河造成了極大的恐慌支示,老刑警劉巖刊橘,帶你破解...
    沈念sama閱讀 217,185評論 6 503
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件,死亡現(xiàn)場離奇詭異颂鸿,居然都是意外死亡促绵,警方通過查閱死者的電腦和手機,發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 92,652評論 3 393
  • 文/潘曉璐 我一進店門嘴纺,熙熙樓的掌柜王于貴愁眉苦臉地迎上來败晴,“玉大人,你說我怎么就攤上這事栽渴〖饫ぃ” “怎么了?”我有些...
    開封第一講書人閱讀 163,524評論 0 353
  • 文/不壞的土叔 我叫張陵闲擦,是天一觀的道長慢味。 經(jīng)常有香客問我,道長佛致,這世上最難降的妖魔是什么贮缕? 我笑而不...
    開封第一講書人閱讀 58,339評論 1 293
  • 正文 為了忘掉前任,我火速辦了婚禮俺榆,結(jié)果婚禮上感昼,老公的妹妹穿的比我還像新娘。我一直安慰自己罐脊,他們只是感情好定嗓,可當我...
    茶點故事閱讀 67,387評論 6 391
  • 文/花漫 我一把揭開白布。 她就那樣靜靜地躺著萍桌,像睡著了一般宵溅。 火紅的嫁衣襯著肌膚如雪。 梳的紋絲不亂的頭發(fā)上上炎,一...
    開封第一講書人閱讀 51,287評論 1 301
  • 那天恃逻,我揣著相機與錄音,去河邊找鬼藕施。 笑死寇损,一個胖子當著我的面吹牛,可吹牛的內(nèi)容都是我干的裳食。 我是一名探鬼主播矛市,決...
    沈念sama閱讀 40,130評論 3 418
  • 文/蒼蘭香墨 我猛地睜開眼,長吁一口氣:“原來是場噩夢啊……” “哼诲祸!你這毒婦竟也來了浊吏?” 一聲冷哼從身側(cè)響起而昨,我...
    開封第一講書人閱讀 38,985評論 0 275
  • 序言:老撾萬榮一對情侶失蹤,失蹤者是張志新(化名)和其女友劉穎找田,沒想到半個月后歌憨,有當?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體,經(jīng)...
    沈念sama閱讀 45,420評論 1 313
  • 正文 獨居荒郊野嶺守林人離奇死亡午阵,尸身上長有42處帶血的膿包…… 初始之章·張勛 以下內(nèi)容為張勛視角 年9月15日...
    茶點故事閱讀 37,617評論 3 334
  • 正文 我和宋清朗相戀三年躺孝,在試婚紗的時候發(fā)現(xiàn)自己被綠了。 大學(xué)時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片底桂。...
    茶點故事閱讀 39,779評論 1 348
  • 序言:一個原本活蹦亂跳的男人離奇死亡,死狀恐怖惧眠,靈堂內(nèi)的尸體忽然破棺而出籽懦,到底是詐尸還是另有隱情,我是刑警寧澤氛魁,帶...
    沈念sama閱讀 35,477評論 5 345
  • 正文 年R本政府宣布暮顺,位于F島的核電站,受9級特大地震影響秀存,放射性物質(zhì)發(fā)生泄漏捶码。R本人自食惡果不足惜,卻給世界環(huán)境...
    茶點故事閱讀 41,088評論 3 328
  • 文/蒙蒙 一或链、第九天 我趴在偏房一處隱蔽的房頂上張望惫恼。 院中可真熱鬧,春花似錦澳盐、人聲如沸祈纯。這莊子的主人今日做“春日...
    開封第一講書人閱讀 31,716評論 0 22
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽腕窥。三九已至,卻和暖如春筛婉,著一層夾襖步出監(jiān)牢的瞬間簇爆,已是汗流浹背。 一陣腳步聲響...
    開封第一講書人閱讀 32,857評論 1 269
  • 我被黑心中介騙來泰國打工爽撒, 沒想到剛下飛機就差點兒被人妖公主榨干…… 1. 我叫王不留入蛆,地道東北人。 一個月前我還...
    沈念sama閱讀 47,876評論 2 370
  • 正文 我出身青樓匆浙,卻偏偏與公主長得像安寺,于是被迫代替她去往敵國和親。 傳聞我的和親對象是個殘疾皇子首尼,可洞房花燭夜當晚...
    茶點故事閱讀 44,700評論 2 354

推薦閱讀更多精彩內(nèi)容