做者:13
GitHub:https://github.com/ZHENFENG13
版权声明:本文为原创文章,未经容许不得转载。
此篇已收录至《大型网站技术架构:核心原理与案例分析》读书笔记系列,点击访问该目录获取完整内容。html
大型网站系统特色:git
ps:符合这些要求的所谓大型网站真的不多,可遇而不可求也。github
说到大型网站,就要先理一下大型网站的特色:高并发,大流量,高可用,海量数据等,本文根据《大型网站技术架构》一书整理以下:redis
初始阶段都比较简单,一般一台服务器就能够搞定一个网站了,ssm-demo系列既是如此,一台服务器搞定全部演示站点,后期逐渐优化,向更优的方向进化!
sql
随着网站业务的发展,一台服务器逐渐不能知足需求,这时候就须要将应用和数据分离:
mongodb
如今的80%的业务访问都会集中在20%的数据上,网站基本上都会使用缓存,前文中也有关于缓存的相关教程,咱们的perfect-ssm项目目前处于这个阶段中,经过缓存层的接入,减小部分对数据库的直接压力,提高网站的响应性能。
数据库
由于单一应用服务器可以处理的请求链接有限,在网站访问高峰时期,应用服务器会成为整个网站的瓶颈,所以使用负载均衡处理器势在必然,经过负载均衡调度服务器,可未来自浏览器的访问请求分发到应用的集群中的任何一台服务器上,进一步将压力分担掉。
浏览器
当用户达到必定规模后,数据库由于负载压力太高而成为网站的瓶颈,而目前主流的数据库都提供主从热备功能,经过配置两台数据库主从关系,能够将一台数据库的数据更新同步到另外一台服务器上,网站利用数据库这一功能实现数据库读写分离,从而改善数据库负载压力。
目前不少云服务商都有相似的产品提供,固然,也能够本身搭建数据库集群并在业务代码中进行读写分离的实现(有时间会整理相关教程)。缓存
提升网站的访问速度,主要手段有使用CDN和反向代理。
CDN和反向代理的基本原理都是缓存,区别在于CDN部署在网络提供商的机房,而反向代理是部署在网站的中心机房,当用户请求到达中心机房后,首先访问的反向代理,若是反向代理缓存着用户请求的资源,则直接返回给用户。服务器
任何强大的单一服务器都知足不了大型网站持续增加的业务需求。
分布式数据库时网站数据库拆分的最后手段,只用在单表数据规模很是大的时候才使用。不到不得已时,网站更经常使用的数据库拆分手段是业务拆分,将不一样业务的数据部署在不一样的物理服务器上。
搜素引擎也基本已经造成如今大型网站必须提供的功能了,网站须要采用一些非关系数据库技术如NoSQL和非数据库查询技术如搜索引擎。各类开源产品不断涌现,遍地开花:redis、mongodb、solr、elastic stack、hadoop、spark......
关于搜索引擎的接入,目前考虑在My-Blog项目中接入elastic search,优化文章搜索模块。
大型网站为了应对日益复杂的业务场景,经过使用分而治之的手段将真个网站业务拆分红不一样的产品线。
具体到技术上,也会根据产品线话费,将一个网站拆分红许多不一样的应用,每一个应用独立部署维护。应用之间能够经过超连接创建管理,也能够经过消息队列进行数据分发,固然最多的仍是经过访问同一个数据存储系统来构成一个关联的完整系统。
因为每个应用系统都须要执行许多相同的业务操做,好比用户管理,session管理,那么能够将这些公用的业务提取出来,独立部署。
偷懒一下,直接用了前一篇文章的图:
整理图片整理的要吐血了。
首发于个人我的博客.