全部科目 > 信息系统运行管理员 >
2019年下半年 上午试卷 综合知识
第 57 题
知识点 大型网站   大型网站架构的演化  
章/节 大型网站概述  
 
 
大型网站架构演化过程中,应用到的技术和手段不包括:(57)。
 
  A.  利用缓存改善网站性能
 
  B.  使用集群改善应用服务器性能
 
  C.  使用非关系型数据库全面替换关系型数据库
 
  D.  使用分布式文件系统
 
 




 
 
相关试题     大型网站架构的演化 

  第57题    2020年下半年  
(57)是一种分布式缓存数据库。

  第58题    2020年下半年  
某电商网站准备开展全国性大规模的促销活动,北京总部机房进行了可支撑百万用户并发的扩容。测试过程中发现,上海用户在打开网站时图片加载缓慢,建议优先通过(58)进行优化,

  第59题    2019年下半年  
在常用的软件负载均衡技术中,(59)分发路径最优,性能更高。

 
知识点讲解
· 大型网站
· 大型网站架构的演化
 
        大型网站
        大型网站是指基于互联网,以信息交换为主要目的,满足某类需求的信息系统,如电子商务网站、社会网络(Social Network Site,SNS)、游戏网站、视频点播网站、资讯网站、搜索类网站等。
        (1)线上稳定、业务连续。这是大型网站基本运维要求,因为大型网站无一例外是基于互联网运作的,由于互联网是7天×24小时运行,同时,由于大多数网站都是边开发边运维的应用模式,在不影响原有线上应用的同时,修改原有架构、部署新的应用,都成为对网站业务稳定性和连续性的考验及挑战。
        (2)客户体验优先。所谓客户体验,是指用户访问一个网站或者使用一项应用、一个产品时的全部体验,如印象、感觉、操作、黏性等。任何一个网站都从未停止满足不断变化的多元需求的应用创新脚步,并通过后期运维服务的管理创新为客户创造良好的体验,吸引网站用户成为忠诚客户,很多大型网站的成败即在于此。
        (3)迫切要求解决峰值运维问题。大型网站面向全球越来越多的互联用户,高并发、高流量、高访问量、高负载已是常规现象。当用户上线集中于某一特定时间或特殊时间时,如节日期间的网络商城、游戏网站,重大政治、社会或自然灾害事件后的SNS网站,此时网站的各项性能指标达到了运营过程中从未出现过的“峰值”,在此情况下,仍要实现高实时、低延迟、高速度、高可靠等高性能使得网站运维“难上加难”,因此,相应的应急运维、预防性运维必须做到未雨绸缪。
        (4)自动化要求高。网站业务应用变更频繁。无论哪种类型的网站,每天关于各种业务应用的变更或创新开发、部署上线、升级的维护请求间隔不断,每一次请求的安装、部署、发布、升级或监控都成了相似度极高的重复劳动,加大了运维任务的强度和密度,对运维的效率提出了很高的要求,因此,自动化运维是大型网站的必然要求。
 
        大型网站架构的演化
        一个成熟的大型网站(如淘宝、京东等)的系统架构并不是开始设计就具备完整的高性能、高可用、安全等特性,它总是随着用户量的增加,业务功能的扩展逐渐演变完善的,在这个过程中,开发模式、技术架构、设计思想也发生了很大的变化,就连技术人员也从几个人发展到一个部门甚至一条产品线。所以成熟的系统架构是随业务扩展而完善出来的,并不是一蹴而就;不同业务特征的系统,会有各自的侧重点,例如淘宝,要解决海量的商品信息的搜索、下单、支付,例如腾讯,要解决数亿的用户实时消息传输,百度要处理海量的搜索请求,它们都有各自的业务特性,系统架构也有所不同。尽管如此我们也可以从这些不同的网站背景下,找出其中共用的技术,这些技术和手段可以广泛运行在大型网站系统的架构中,下面就通过介绍大型网站系统的演化过程,来认识这些技术和手段。
               最开始的网站架构
               最初的架构,应用程序、数据库、文件都部署在一台服务器上,如下图所示。
               
               网站简单架构
               应用、数据、文件分离
               随着业务的扩展,一台服务器已经不能满足性能需求,故将应用程序、数据库、文件各自部署在独立的服务器上,并且根据服务器的用途配置不同的硬件,达到最佳的性能效果,如下图所示。
               
               应用与数据库、文件分离后的结构
               利用缓存改善网站性能
               在硬件优化性能的同时,也通过软件进行性能优化,在大部分的网站系统中,都会利用缓存技术改善系统的性能,使用缓存主要源于热点数据的存在,大部分网站访问都遵循28原则(即80%的访问请求,最终落在20%的数据上),所以我们可以对热点数据进行缓存,减少这些数据的访问路径,提高用户体验,如下图所示。
               
               具备缓存服务器的网站结构
               缓存实现常见的方式是本地缓存、分布式缓存。当然还有CDN(Content Delivery Network,内容分发网络)、反向代理等。本地缓存,顾名思义是将数据缓存在应用服务器本地,可以存在内存中,也可以存在文件,OS Cache就是常用的本地缓存组件。本地缓存的特点是速度快,但因为本地空间有限所以缓存数据量也有限。分布式缓存的特点是,可以缓存海量的数据,并且扩展非常容易,在门户类网站中常常被使用,速度按理没有本地缓存快,常用的分布式缓存是Memcached、Redis。
               使用集群改善应用服务器性能
               应用服务器作为网站的入口,会承担大量的请求,我们往往通过应用服务器集群来分担请求数。应用服务器前面部署负载均衡服务器调度用户请求,根据分发策略将请求分发到多个应用服务器节点,如下图所示。
               
               集群方式的服务器
               常用的负载均衡技术硬件的有F5,价格比较贵,软件的有LVS、Nginx、HAProxy。LVS是四层负载均衡,根据目标地址和端口选择内部服务器,Nginx是七层负载均衡和HAProxy支持四层、七层负载均衡,可以根据报文内容选择内部服务器,因此LVS分发路径优于Nginx和HAProxy,性能要高些,而Nginx和HAProxy则更具配置性,如可以用来做动静分离(根据请求报文特征,选择静态资源服务器还是应用服务器)。
               数据库读写分离和分库分表
               随着用户量的增加,数据库成为最大的瓶颈,改善数据库性能常用的手段是进行读写分离以及分表,读写分离顾名思义就是将数据库分为读库和写库,通过主备功能实现数据同步。分库分表则分为水平切分和垂直切分,水平切分是对一个数据库特大的表进行拆分,例如用户表。垂直切分则是根据业务不同来切分,如用户业务、商品业务相关的表放在不同的数据库中,如下图所示。
               
               数据库读写分离
               使用CDN和反向代理提高网站性能
               假如我们的服务器都部署在成都的机房,那么对于四川的用户来说访问是较快的,对于北京的用户访问则是较慢的,这是由于北京用户访问需要通过互联路由器经过较长的路径才能访问到成都的服务器,返回路径也一样,所以数据传输时间比较长。对于这种情况,常常使用CDN解决,CDN将数据内容缓存到运营商的机房,用户访问时先从最近的运营商获取数据,这样大大减少了网络访问的路径,如下图所示。
               
               使用CDN优化
               而反向代理,则是部署在网站的机房,当用户请求到达时首先访问反向代理服务器,反向代理服务器将缓存的数据返回给用户,如果没有缓存数据才会继续通过应用服务器获取,也减少了获取数据的成本。反向代理有Squid,Nginx。
               使用分布式文件系统
               用户一天天增加,业务量越来越大,产生的文件越来越多,单台的文件服务器已经不能满足需求。需要分布式的文件系统支撑。常用的分布式文件系统有NFS,如下图所示。
               
               使用分布式文件系统
               使用NoSQL和搜索引擎
               NoSQL,泛指非关系型的数据库。随着互联网Web 2.0网站的兴起,传统的关系数据库在应付Web 2.0网站,特别是超大规模和高并发的SNS类型的Web 2.0纯动态网站已经显得力不从心,暴露了很多难以克服的问题,而非关系型的数据库则由于其本身的特点得到了非常迅速的发展。NoSQL数据库的产生就是为了解决大规模数据集合多重数据种类带来的挑战,尤其是大数据应用难题,如下图所示。
               
               使用NoSQL
               对于海量数据的查询,我们使用NoSQL数据库加上搜索引擎可以达到更好的性能。并不是所有的数据都要放在关系型数据中。常用的NoSQL有Mongodb和Redis,搜索引擎有Lucene。
               将应用服务器进行业务拆分
               随着业务进一步扩展,应用程序变得非常臃肿,这时我们需要将应用程序进行业务拆分,如百度分为新闻、网页、图片等业务。每个业务应用负责相对独立的业务运作。业务之间通过消息进行通信或者同享数据库来实现,如下图所示。
               
               拆分业务
               搭建分布式服务
               各个业务应用都会使用到一些基本的业务服务,例如用户服务、订单服务、支付服务、安全服务,这些服务是支撑各业务应用的基本要素。我们将这些服务抽取出来利用分布式服务框架搭建分布式服务。淘宝的Dubbo是一个不错的选择,如下图所示。
               
               搭建分布式服务
               大型网站的架构是根据业务需求不断完善的,根据不同的业务特征会做特定的设计和考虑。



更多复习资料
请登录电脑版软考在线 www.rkpass.cn

京B2-20210865 | 京ICP备2020040059号-5
京公网安备 11010502032051号 | 营业执照
 Copyright ©2000-2023 All Rights Reserved
软考在线版权所有