linux系统下分割大文件的方法

 
linux系统下分割大文件的方法
2016-09-26 18:11:42 /故事大全

在linux中分割大文件,比如一个5gb日志文件,需要把它分成多个小文件,分割后以利于普通的文本编辑器读取。

有时,需要传输20gb的大文件到另一台服务器,也需要把它分割成多个文件,这样便于传输数据。

以下通过五个不同的例子,来讲解Linux下分割大文件的方法,供大家参考。

例1、以每个文件1000行分割

split命令分割文件成每个文件1000行,并且文件名依次为 [前缀]aa, [前缀]ab, [前缀]ac等,默认的前缀是X,每个文件的行数为1000行。

命令:

代码如下:

$ split mylog -l 1000

$ wc -l *

4450 mylog

1000 xaa

1000 xab

1000 xac

1000 xad

450 xae

例2、以每个文件20MB分割

分割文件为多个20MB的文件,附带-b选项。

命令:

代码如下:

$ split -b 20M logdata

$ ls -lh | tail -n +2

-rw------- 1 sathiya sathiya 102M Jul 25 18:47 logdata

-rw------- 1 sathiya sathiya 20M Jul 25 19:20 xaa

-rw------- 1 sathiya sathiya 20M Jul 25 19:20 xab

-rw------- 1 sathiya sathiya 20M Jul 25 19:20 xac

-rw------- 1 sathiya sathiya 20M Jul 25 19:20 xad

-rw------- 1 sathiya sathiya 20M Jul 25 19:20 xae

-rw------- 1 sathiya sathiya 1.6M Jul 25 19:20 xaf

例3、以每个文件50MB指定前缀分割

使用–bytes选项把文件分割成多个50MB的文件,–bytes类似-b选项,在第二个参数指定前缀。

命令:

代码如下:

$ split --bytes=50M logdata mydatafile

$ ls -lh

total 204M

-rw------- 1 sathiya sathiya 102M Jul 25 18:47 logdata

-rw------- 1 sathiya sathiya 50M Jul 25 19:23 mydatafileaa

-rw------- 1 sathiya sathiya 50M Jul 25 19:23 mydatafileab

-rw------- 1 sathiya sathiya 1.6M Jul 25 19:23 mydatafileac

例4、基于行数分割文件

使用-l选项指定行数来把文件分割成多个行数相同的文件。

命令:

代码如下:

$ wc -l testfile

2591 testfile

$ split -l 1500 testfile importantlog

$ wc -l *

1500 importantlogaa

1091 importantlogab

2591 testfile

例5、以数字后缀命名分割文件

使用-d选项可以指定后缀为数字,如00,01,02..,而不是aa,ab,ac。

命令:

代码如下:

$ split -d testfile

$ ls

testfile x00 x01 x02

可用选项

代码如下:

短选项 长选项 选项描述

-b –bytes=SIZE SIZE 值为每一输出档案的大小,单位为 byte。

-C –line-bytes=SIZE 每一输出档中,单行的最大 byte 数。

-d –numeric-suffixes 使用数字作为后缀。

-l –lines=NUMBER NUMBER 值为每一输出档的列数大小。

短选项 长选项 选项描述

-b –bytes=SIZE SIZE 值为每一输出档案的大小,单位为 byte。

-C –line-bytes=SIZE 每一输出档中,单行的最大 byte 数。

-d –numeric-suffixes 使用数字作为后缀。

-l –lines=NUMBER NUMBER 值为每一输出档的列数大小。

所属专题:
如果您觉得本文或图片不错,请把它分享给您的朋友吧!

 
搜索
 
 
广告
 
 
广告
 
故事大全
 
版权所有- © 2012-2025 · 故事大全 SITEMAP站点地图-Foton Auman手机看故事 站点地图-Foton Auman