分布式文件系统FastDFS详解

本文转载自:Ubuntu下FastDFS分布式文件系统配置与部署

Ubuntu下FastDFS分布式文件系统配置与部署

白宁超html

2017年4月15日09:11:52linux

摘要: FastDFS是一个开源的轻量级分布式文件系统,功能包括:文件存储、文件同步、文件访问(文件上传、文件下载)等,解决了大容量存储和负载均衡的问题。特别适合中小文件(建议范围:4KB < file_size <500MB),对以文件为载体的在线服务,如相册网站、视频网站等。本文经过两次单机环境配置均没有错误,第1-4章节主要是对FastDFS背景发展原理及linux基本介绍,若是读者只是安装分布式文件系统,只是想简单关注其原理,建议阅读第二节与第五节。若是读者仅仅就是安装为目的建议直接阅读弟五节5节。本人邮箱:datathinks@qq.com,主页:http://www.cnblogs.com/baiboy/nginx

1 分布式文件系统介绍


分布式文件系统:Distributed file system, DFS,又叫作网络文件系统:Network File System。一种容许文件经过网络在多台主机上分享的文件系统,可以让多机器上的多用户分享文件和存储空间。git

特色:在一个分享的磁盘文件系统中,全部节点对数据存储区块都有相同的访问权,在这样的系统中,访问权限就必须由客户端程序来控制。分布式文件系统可能包含的功能有:透通的数据复制与容错。github

分布式文件系统是被设计用在局域网。而分布式数据存储,则是泛指应用分布式运算技术的文件和数据库等提供数据存储服务的系统。数据库

决定因素:数据的存储方式、数据的读取速率、数据的安全机制。ubuntu

发展历史:大体分为三个发展阶段,网络文件系统(1980s)、共享SAN文件系统(1990s)、面向对象的并行文件系统(2000s)安全

概述:FastDFS是一个开源的轻量级分布式文件系统,功能包括:文件存储、文件同步、文件访问(文件上传、文件下载)等,解决了大容量存储和负载均衡的问题。特别适合中小文件(建议范围:4KB < file_size <500MB),对以文件为载体的在线服务,如相册网站、视频网站等。服务器

2 系统架构介绍


FastDFS由跟踪服务器(Tracker Server)、存储服务器(Storage Server)和客户端(Client)构成。网络

跟踪服务器Tracker Server

主要作调度工做,起到均衡的做用;负责管理全部的 storage server和 group,每一个 storage 在启动后会链接 Tracker,告知本身所属 group 等信息,并保持周期性心跳。tracker根据storage的心跳信息,创建group==>[storage serverlist]的映射表。

Tracker须要管理的元信息不多,会所有存储在内存中;另外tracker上的元信息都是由storage汇报的信息生成的,自己不须要持久化任何数据,这样使得tracker很是容易扩展,直接增长tracker机器便可扩展为tracker cluster来服务,cluster里每一个tracker之间是彻底对等的,全部的tracker都接受stroage的心跳信息,生成元数据信息来提供读写服务。

存储服务器Storage Server

主要提供容量和备份服务;以 group 为单位,每一个 group 内能够有多台 storage server,数据互为备份。以group为单位组织存储能方便的进行应用隔离、负载均衡、副本数定制(group内storage server数量即为该group的副本数),好比将不一样应用数据存到不一样的group就能隔离应用数据,同时还可根据应用的访问特性来将应用分配到不一样的group来作负载均衡;缺点是group的容量受单机存储容量的限制,同时当group内有机器坏掉时,数据恢复只能依赖group内地其余机器,使得恢复时间会很长。

group内每一个storage的存储依赖于本地文件系统,storage可配置多个数据存储目录,好比有10块磁盘,分别挂载在/data/disk1-/data/disk10,则可将这10个目录都配置为storage的数据存储目录。storage接受到写文件请求时,会根据配置好的规则选择其中一个存储目录来存储文件。为了不单个目录下的文件数太多,在storage第一次启动时,会在每一个数据存储目录里建立2级子目录,每级256个,总共65536个文件,新写的文件会以hash的方式被路由到其中某个子目录下,而后将文件数据做为本地文件存储到该目录中。

客户端Client

主要是上传下载数据的服务器,也就是咱们本身的项目所部署在的服务器。每一个客户端服务器都须要安装Nginx

基本架构以下图所示。

 

FastDFS的存储策略

为了支持大容量,存储节点(服务器)采用了分卷(或分组)的组织方式。存储系统由一个或多个卷组成,卷与卷之间的文件是相互独立的,全部卷的文件容量累加就是整个存储系统中的文件容量。一个卷能够由一台或多台存储服务器组成,一个卷下的存储服务器中的文件都是相同的,卷中的多台存储服务器起到了冗余备份和负载均衡的做用。

在卷中增长服务器时,同步已有的文件由系统自动完成,同步完成后,系统自动将新增服务器切换到线上提供服务。当存储空间不足或即将耗尽时,能够动态添加卷。只须要增长一台或多台服务器,并将它们配置为一个新的卷,这样就扩大了存储系统的容量。

FastDFS的上传过程

FastDFS向使用者提供基本文件访问接口,好比upload、download、append、delete等,以客户端库的方式提供给用户使用。

咱们知道Storage Server会按期的向Tracker Server发送本身的存储信息。当Tracker Server Cluster中的Tracker Server不止一个时,各个Tracker之间的关系是对等的,因此客户端上传时能够选择任意一个Tracker。

当Tracker收到客户端上传文件的请求时,会为该文件分配一个能够存储文件的group,当选定了group后就要决定给客户端分配group中的哪个storage server。当分配好storage server后,客户端向storage发送写文件请求,storage将会为文件分配一个数据存储目录。而后为文件分配一个fileid,最后根据以上的信息生成文件名存储文件。文件名的格式以下:

FastDFS的文件同步

写文件时,客户端将文件写至group内一个storage server即认为写文件成功,storage server写完文件后,会由后台线程将文件同步至同group内其余的storage server。

每一个storage写文件后,同时会写一份binlog,binlog里不包含文件数据,只包含文件名等元信息,这份binlog用于后台同步,storage会记录向group内其余storage同步的进度,以便重启后能接上次的进度继续同步;进度以时间戳的方式进行记录,因此最好能保证集群内全部server的时钟保持同步。

storage的同步进度会做为元数据的一部分汇报到tracker上,tracke在选择读storage的时候会以同步进度做为参考。

FastDFS的文件下载

客户端uploadfile成功后,会拿到一个storage生成的文件名,接下来客户端根据这个文件名便可访问到该文件。

跟upload file同样,在downloadfile时客户端能够选择任意tracker server。tracker发送download请求给某个tracker,必须带上文件名信息,tracke从文件名中解析出文件的group、大小、建立时间等信息,而后为该请求选择一个storage用来服务读请求。

3 FastDFS性能方案

4 Linux基本命令操做


 

系统的基本操做

Ctrl+Alt+shift+Fn 切换终端

ls –l 查看

su - username 切换登陆

Reboot 重启

pwd 当前路径

shutdown -r now 关机

whereis filename 文件路径

rm –rf 删除

touch 文件名 建立文件

cp path1 path2 复制文件

mkdir 建立目录

mv 移动更名

Vi环境

vi filename 打开文件

i 插入

Esc 退出

dd 删除行

x Esc下删除

wq 保存

a 插入光标后面

o 插入下一行

hjkl 左下上右

Ctrl+b 向后翻页

Ctrl+f 向前翻页

/ Esc下查找

r 替换光标处文字

u 撤销

压缩与解压

gzip 压缩gz文件

unzip 解压zip

tar -czvf file1 file2 压缩

tar -zxvf file 解压.tar.gz

linux系统修改编码

#vi /etc/sysconfig/i18n 将原内容

1
2
LANG= "en_US.UTF-8"
SYSFONT= "latarcyrheb-sun16"

修改成

1
2
3
4
5
6
7
LANG= "zh_CN.GB18030"
 
LANGUAGE= "zh_CN.GB18030:zh_CN.GB2312:zh_CN"
 
SUPPORTED= "zh_CN.UTF-8:zh_CN:zh:en_US.UTF-8:en_US:en"
 
SYSFONT= "lat0-sun16"

Ubuntu初始化root密码:

1
sudo passwd

Ubuntu配置VmwareTools工具:先下载而后找到文件拷贝桌面并解压,随后找到文件一路安装。

5 安装VirtualBox虚拟机并配置Ubuntu


 

6 Ubuntu环境下安装并配置FastDFS


 

虚拟机

Oracle VM VirtualBox

操做系统

Ubuntu16.04

Fastdfs必备软件(本文软件下载均采用wget方式)

fastdfs-5.05 、 fastdfs-nginx-module-v1.16 、 libfastcommon-v1.0.7

Nginx

nginx-1.10.1 

Fastdfs主页

https://github.com/happyfish100/fastdfs

联网模式

NAT自动转换模式

IP地址

自动生成,ifconfig查看,本文是10.0.2.15

6.1 基本操做与配置

切换到root角色操做:sudo passwd #修改root权限密码

建立必要文件夹

1
2
3
4
5
6
mkdir /software #下载tar.zp软件包并安装
mkdir /software/testfile #上载文件测试文件夹
mkdir /data #fastdfs根文件
mkdir /data/fastdfs/track #tracker文件配置路径
mkdir /data/fastdfs/storage #storage配置路径
mkdir /data/fastdfs/cli    ntlog #client配置路径

6.2 安装libfastcommon与FastDFS

(1) 下载安装libfastcommon

1
2
cd /software
wget https: //github.com/happyfish100/libfastcommon/archive/V1.0.7.tar.gz

解压 libfastcommon:

tar -zxvf V1.0.7.tar.gz

进入libfastcommon-1.0.7里面,进行编译和安装:

1
2
3
cd libfastcommon-1.0.7
./make.sh
./make.sh install

(2) 下载安装 FastDFS,这里也是经过wget下载。

1
2
cd /software
wget https: //github.com/happyfish100/fastdfs/archive/V5.05.tar.gz

1
2
3
4
tar -zxvf V5.05.tar.gz
cd fastdfs-5.05
./make.sh
./make.sh install

6.3 配置Tracker、Storage、Clent、HTTP服务

(1) 配置Tracker服务

1.6.2操做成功后,进入/etc/fdfs目录。会看到三个.sample后缀的文件,均是做者给咱们的示例文件,咱们须要将其中的tracker.conf.sample文件改成tracker.conf配置文件并修改它。

1
2
3
4
cd /etc/fdfs
ls
cp tracker.conf.sample tracker.conf # 配置跟踪文件
vi tracker.conf # 进入conf文件

进入conf文件后完成如下参数的修改:

# the base path to store data and log files

base_path=/data/fastdfs/track # 修改跟踪路径

# HTTP port on this tracker server

http.server_port=80 # 修改端口号

完成以上操做以后即配置好tracker服务,采用如下方式启动服务,查看监听:

1
2
3
export LD_LIBRARY_PATH=/usr/lib64/
/usr/bin/fdfs_trackerd /etc/fdfs/tracker.conf
netstat -unltp|grep fdfs #查看服务

(2) 配置Storage服务

本文采用单机器测试,你把 Storage 服务放在多台服务器也是能够的,它有 Group(组)的概念,同一组内服务器互备同步。

1
2
3
cd /etc/fdfs
cp storage.conf.sample storage.conf # 修改存储路径
vi storage.conf # 修改存储文件

进入conf文件后完成如下参数的修改:

group_name=group1 # 修改组名

# the base path to store data and log files

base_path=/data/fastdfs/storage # 修改存储路径

# store_path#, based 0, if store_path0 not exists, it's value is base_path

# the paths must be exist

store_path0=/data/fastdfs/storage #这里能够设置多个存储服务器

#store_path1=/home/yuqing/fastdfs2

# tracker_server can ocur more than once, and tracker_server format is

# "host:port", host can be hostname or ip address

tracker_server=10.0.2.15:22122 # 改成本地ip,查看本地ip:ifconfig

http.server_port=8888 # 设置端口号,若是没有冲突尽可能默认

完成以上操做以后即配置好storage服务,采用如下方式启动服务,查看监听:

1
2
/usr/bin/fdfs_storaged /etc/fdfs/storage.conf
netstat -unltp|grep fdfs #查看服务

(3) 配置Clint服务

1
2
3
cd /etc/fdfs
cp clint.conf.sample clint.conf #修改客户端路径文件
vi clint.conf

进入conf文件后完成如下参数的修改:

base_path=/data/fastdfs/clintlog #设置客户端存储路径

tracker_server=10.0.2.15:22122 #改成本地ip

http.tracker_server_port=80

#include http.conf 注意,#include http.conf 这句,原配置文件中有2个#,删掉一个。

(4) 配置HTTP服务

1
2
3
cp /software/fastdfs-5.05/conf/http.conf /etc/fdfs/http.conf # 配置http服务文件
cd /etc/fdfs
vi http.conf

进入conf文件后完成如下参数的修改:

http.anti_steal.token_check_fail=/data/fastdfs/httppic/anti-steal.jpg

6.4 设置环境变量和软连接

在32位ubuntu中,libfastcommon会安装在/usr/lib 中,64位系统则安装在 /usr/lib64 中。依次执行如下命令:(根据本身的操做系统选择路径)

1
export LD_LIBRARY_PATH=/usr/lib64/

或者手动修改

1
2
vi /etc/ld.so.conf下配置/usr/lib64
ldconfig

软连接:

1
ln -s /usr/lib64/libfastcommon.so /usr/local/lib/libfastcommon.so

6.5 查看tracker和storage服务运行状况

1
netstat -unltp|grep fdfs #查看服务

若是没有正常运行,启动服务命令以下:

1
2
/usr/bin/fdfs_trackerd /etc/fdfs/tracker.conf
/usr/bin/fdfs_storaged /etc/fdfs/storage.conf

测试Tracker 和 Storage 服务通讯

1
/usr/bin/fdfs_monitor /etc/fdfs/storage.conf

相关文章
相关标签/搜索