最新动态
【转载】图解大型互联网网站系统架构的演进过程
2024-11-07 19:35

今天看到一篇网站架构的文章,阅读后感觉不错,在这里转载用于记录和分享。

原文地址:https://blog.csdn.net/javaxuexi123/article/details/79028020

前言

一个成熟的大型网站(如淘宝,京东等)的系统架构并不是开始设计就具备完整的高性能,高可用,安全等特性,它总是随着用户量的增加,业务功能的扩展逐渐演变完善的,在这个过程中,开发模式,技术架构,设计思想也发生了很大的变化,就连技术人员也从几个人发展到一个部门甚至一条产品线。所以成熟的系统架构是随业务扩展而完善出来的,并不是一蹴而就;不同业务特征的系统,会有各自的侧重点,例如淘宝,要解决海量的商品信息的搜索,下单,支付,例如腾讯,要解决数亿的用户实时消息传输,百度它要处理海量的搜索请求,他们都有各自的业务特性,系统架构也有所不同。尽管如此我们也可以从这些不同的网站背景下,找出其中共用的技术,这些技术和手段可以广泛运行在大型网站系统的架构中,就下面介绍通过网站大型系统- 过程,来认识这些技术和手段。

,最开始的网站架构

最初的架构,应用程序,数据库,文件都部署在一台服务器上,如图

,应用,数据,文件分离

随着业务的扩展,一台服务器已经不能满足性能需求,故将应用程序,数据库,文件各自部署在独立的服务器上,并且根据服务器的用途配置不同的硬件,达到最佳的性能效果。

,利用缓存改善网站性能

在硬件优化性能的同时,同时也通过软件进行性能优化,在大部分的网站系统中,都会利用缓存技术改善系统的性能,使用缓存主要源于热点数据的存在,大部分网站访问都遵循28原则(即80%的访问请求,最终落在20%的数据上,所以我们可以对热点数据进行缓存,减少这些数据的访问路径,提高用户体验。

缓存实现常见的方式是本地缓存,分布式缓存。当然还有CDN,反向代理等,这个后面再讲。本地缓存,顾名思义是将数据缓存在应用服务器本地,可以存在内存中,也可以存在文件,OSCache的的的的就是常用的本地缓存组件。本地缓存的特点是速度快,但因为本地空间有限所以缓存数据量也有限。分布式缓存的特点是,可以缓存海量的数据,并且扩展非常容易,在门户类网站中常常被使用,速度按理没有本地缓存​​快,常用的分布式缓存是Memcached的的的的,Redis的的的的。

,使用集群改善应用服务器性能

应用服务器作为网站的入口,会承担大量的请求,我们往往通过应用服务器集群来分担请求数。应用服务器前面部署负载均衡服务器调度用户请求,根据分发策略将请求分发到多个应用服务器节点。

常用的负载均衡技术硬件的有F5,价格比较贵,软件的有LVS,Nginx的的的的,HAProxy.LVS是四层负载均衡,根据目标地址和端口选择内部服务器,Nginx的的的的是七层负载均衡和HAProxy的的的的支持四层,七层负载均衡,可以根据报文内容选择内部服务器,因此LVS分发路径优于Nginx的的的的和HAProxy的的的的,性能要高些,而Nginx的的的的和HAProxy的的的的则更具配置性,如可以用来做动静分离(根据请求报文特征,选择静态资源服务器还是应用服务器)。

,数据库读写分离和分库分表

随着用户量的增加,数据库成为最大的瓶颈,改善数据库性能常用的手段是进行读写分离以及分表,读写分离顾名思义就是将数据库分为读库和写库,通过主备功能实现数据同步。分库分表则分为水平切分和垂直切分,水平切换则是对一个数据库特大的表进行拆分,例如用户表。垂直切分则是根据业务不同来切换,如用户业务,商品业务相关的表放在不同的数据库中。

,使用CDN和反向代理提高网站性能

假如我们的服务器都部署在成都的机房,对于四川的用户来说访问是较快的,而对于北京的用户访问是较慢的,这是由于四川和北京分别属于电信和联通的不同发达地区,北京用户访问需要通过互联路由器经过较长的路径才能访问到成都的服务器,返回路径也一样,所以数据传输时间比较长。对于这种情况,常常使用CDN解决,CDN将数据内容缓存到运营商的机房,用户访问时先从最近的运营商获取数据,这样大大减少了网络访问的路径。比较专业的CDN运营商有蓝汛,网宿。

而反向代理,则是部署在网站的机房,当用户请求达到时首先访问反向代理服务器,反向代理服务器将缓存的数据返回给用户,如果没有没有缓存数据才会继续走应用服务器获取,也减少了获取数据的成本。反向代理有鱿鱼,Nginx的的的。

,使用分布式文件系统

用户一天天增加,业务量越来越大,产生的文件越来越多,单台的文件服务器已经不能满足需求。需要分布式的文件系统支撑。常用的分布式文件系统有NFS。

,使用的的的NoSql和搜索引擎

对于海量数据的查询,我们使用的的的NoSQL数据库加上搜索引擎可以达到更好的性能。并不是所有的数据都要放在关系型数据中。常用的NOSQL有MongoDB的中的和Redis的的的,搜索引擎有Lucene的的的。

,将应用服务器进行业务拆分

随着业务进一步扩展,应用程序变得非常臃肿,这时我们需要将应用程序进行业务拆分,如百度分为新闻,网页,图片等业务。每个业务应用负责相对独立的业务运作。业务之间通过消息进行通信或者同享数据库来实现。

 

,搭建分布式服务

这时我们发现各个业务应用都会使用到一些基本的业务服务,例如用户服务,订单服务,支付服务,安全服务,这些服务是支撑各业务应用的基本要素。我们将这些服务抽取出来利用分部式服务框架搭建分布式服务。淘宝的达博是一个不错的选择。

    以上就是本篇文章【【转载】图解大型互联网网站系统架构的演进过程】的全部内容了,欢迎阅览 ! 文章地址:http://zleialh.tongchengxian.cn/news/13.html 
     资讯      企业新闻      行情      企业黄页      同类资讯      首页      网站地图      返回首页 通成线资讯移动站 http://zleialh.tongchengxian.cn/mobile/ , 查看更多   
最新新闻
学生暑假计划
  【实用】学生暑假计划  时间就如同白驹过隙般的流逝,我们的工作又迈入新的阶段,是时候开始写计划了。计划到底怎么拟定才
“火” 2018年度百度最具有影响力的女演员出榜啦!
大家看看是不是心里期待的榜单!第一名赵丽颖赵丽颖,1987年10月16日生于河北省廊坊市,国内影视女演员。2006年,因获得雅虎搜星
【强国青年说·2024】全国青年岗位能手怎样炼成?
(点击图片观看视频)全国青年岗位能手如何炼成?怎样从“世界冠军”成长为最年轻的“上海工匠”?靠技术吃饭也能成才吗?如何不
你关心的内容,这个 App 都知道:今日热榜
许多人都尝试过制定一套基于自己标准的信息筛选机制,从即刻 App 到自定规则的 RSS 订阅,我们可以找到无数种筛选信息的方法
「知乎运营攻略」品牌方如何正确运营知乎
不久前,我写了一篇文章,提到了一些关于知乎运营的知识。今天,我将谈谈我对知乎运营的一些想法。未来,每个公司和品牌都需要做
一文读懂儿童青少年体适能周期性训练计划制定方法
  周期化训练计划的制订是基于几个不同层级的计划。这些计划的设定必须符合运动员发展的总体目标,并考虑青少年运动员在不同阶
小学生跨学科项目主题方案
  小学生跨学科项目主题方案范文(精选12篇)  为了确保工作或事情顺利进行,通常需要预先制定一份完整的方案,方案的内容和
常用的方法:最常用的几个SEO工具
  常用的方法:最常用的几个SEO工具  作为站长,了解和熟悉seo优化和推广工作中需要的seo工具更有利于seo工作,通过关键词数
怎么管理网站的友情链接?增加外链的途径和注意事项总结
  这两天与大家分享的都是关于网站外链的一些优化策略,对于外链的优化很多人都说其价值已经远远不如以前了,甚至有的人说外链
抖音粉丝黑科技软件(抖音粉丝黑科技软件下载安装)
什么是抖音黑科技(支点科技)?抖音黑科技(支点科技)真的有那么神奇吗?今天一文带大家来揭秘,神秘的抖音黑科技(支点科技)
本企业新闻