智能摘要文章源自JAVA秀-https://www.javaxiu.com/33085.html
随着网站的上线,访问量逐步上升,服务器的负载慢慢提高,在服务器还没有超载的时候,我们应该就要做好准备,提升网站的负载能力。随着网站的继续发展,的系统中可能出现不同语言开发的子模块和部署在不同平台的子系统。负载均衡透明化,能在调用过程中收集并分析调用数据,推测出网站的访问增长率等等一系列需求,对于网站应该如何成长做出预测。以上的演变过程只是一个例子,并不适合所有的网站,实际中网站演进过程与自身业务和不同遇到的问题有密切的关系,没有固定的模式。文章源自JAVA秀-https://www.javaxiu.com/33085.html
原文约 1.1 万 字 | 图片 18 张 | 建议阅读 22 分钟 | 评价反馈文章源自JAVA秀-https://www.javaxiu.com/33085.html
大型分布式 Web 系统的架构演进
点击关注 ? 芋道源码 文章源自JAVA秀-https://www.javaxiu.com/33085.html
收录于话题文章源自JAVA秀-https://www.javaxiu.com/33085.html
#芋道源码文章源自JAVA秀-https://www.javaxiu.com/33085.html
135个文章源自JAVA秀-https://www.javaxiu.com/33085.html
点击上方“芋道源码”,选择“设为星标”文章源自JAVA秀-https://www.javaxiu.com/33085.html
管她前浪,还是后浪?文章源自JAVA秀-https://www.javaxiu.com/33085.html
能浪的浪,才是好浪!文章源自JAVA秀-https://www.javaxiu.com/33085.html
每天 8:55 更新文章,每天掉亿点点头发...文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html 源码精品专栏文章源自JAVA秀-https://www.javaxiu.com/33085.html
原创 | Java 2020 超神之路,很肝~文章源自JAVA秀-https://www.javaxiu.com/33085.html
中文详细注释的开源项目文章源自JAVA秀-https://www.javaxiu.com/33085.html
RPC 框架 Dubbo 源码解析文章源自JAVA秀-https://www.javaxiu.com/33085.html
网络应用框架 Netty 源码解析文章源自JAVA秀-https://www.javaxiu.com/33085.html
消息中间件 RocketMQ 源码解析文章源自JAVA秀-https://www.javaxiu.com/33085.html
数据库中间件 Sharding-JDBC 和 MyCAT 源码解析文章源自JAVA秀-https://www.javaxiu.com/33085.html
作业调度中间件 Elastic-Job 源码解析文章源自JAVA秀-https://www.javaxiu.com/33085.html
分布式事务中间件 TCC-Transaction 源码解析文章源自JAVA秀-https://www.javaxiu.com/33085.html
Eureka 和 Hystrix 源码解析文章源自JAVA秀-https://www.javaxiu.com/33085.html
Java 并发源码文章源自JAVA秀-https://www.javaxiu.com/33085.html
来源:juejin.cn/post/6844903639123771406文章源自JAVA秀-https://www.javaxiu.com/33085.html
前言文章源自JAVA秀-https://www.javaxiu.com/33085.html
正文文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段一、单机构建网站文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段二、应用服务器与数据库分离文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段三、应用服务器集群文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段四、数据库读写分离化文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段五、用搜索引擎缓解读库的压力文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段六、用缓存缓解读库的压力文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段七、数据库水平拆分与垂直拆分文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段八、应用的拆分文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段九、引入消息中间件文章源自JAVA秀-https://www.javaxiu.com/33085.html
总结
文章源自JAVA秀-https://www.javaxiu.com/33085.html
前言
我们以 Java Web
为例,来搭建一个简单的电商系统,看看这个系统可以如何一步步演变。文章源自JAVA秀-https://www.javaxiu.com/33085.html
该系统具备的功能:文章源自JAVA秀-https://www.javaxiu.com/33085.html
用户模块:用户注册和管理文章源自JAVA秀-https://www.javaxiu.com/33085.html
商品模块:商品展示和管理文章源自JAVA秀-https://www.javaxiu.com/33085.html
交易模块:创建交易和管理文章源自JAVA秀-https://www.javaxiu.com/33085.html
正文
阶段一、单机构建网站
网站的初期,我们经常会在单机上跑我们所有的程序和软件。此时我们使用一个容器,如Tomcat
、Jetty
、Jboss
,然后直接使用JSP/Servlet技术,或者使用一些开源的框架如Maven + Spring + Struts + Hibernate
、Maven + Spring + Spring MVC + Mybatis
。最后再选择一个数据库管理系统来存储数据,如MySQL
、SqlServer
、Oracle
,然后通过JDBC
进行数据库的连接和操作。文章源自JAVA秀-https://www.javaxiu.com/33085.html
把以上的所有软件包括数据库、应用程序都装载同一台机器上,应用跑起来了,也算是一个小系统了。此时系统结果如下:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段二、应用服务器与数据库分离
随着网站的上线,访问量逐步上升,服务器的负载慢慢提高,在服务器还没有超载的时候,我们应该就要做好准备,提升网站的负载能力。假如我们代码层面 已难以优化,在不提高单台机器的性能的情况下,采用增加机器 是一个不错的方式,不仅可以有效地提高系统的负载能力,而且性价比高。文章源自JAVA秀-https://www.javaxiu.com/33085.html
增加的机器用来做什么呢?此时我们可以把数据库服务器 和Web服务器 拆分开来,这样不仅提高了单台机器的负载能力,也提高了容灾能力。文章源自JAVA秀-https://www.javaxiu.com/33085.html
应用服务器与数据库分开后的架构如下图所示:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段三、应用服务器集群
随着访问量继续增加,单台应用服务器已经无法满足需求了。在假设数据库服务器没有压力的情况下,我们可以把应用服务器从一台 变成了两台甚至多台 ,把用户的请求分散到不同的服务器中,从而提高负载能力。而多台应用服务器 之间没有直接的交互,他们都是依赖数据库各自对外提供服务。著名的做故障切换 的软件有KeepAlived
,KeepAlived
是一个类似于Layer3、4、7交换机制的软件,他不是某个具体软件故障切换的专属品,而是可以适用于各种软件的一款产品。KeepAlived
配合上ipvsadm
又可以做负载均衡 ,可谓是神器。文章源自JAVA秀-https://www.javaxiu.com/33085.html
我们以增加了一台应用服务器为例,增加后的系统结构图如下:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
系统演变到这里,将会出现下面四个问题 :文章源自JAVA秀-https://www.javaxiu.com/33085.html
用户的请求由谁来转发到到具体的应用服务器?文章源自JAVA秀-https://www.javaxiu.com/33085.html
有那些转发的算法和策略可以使用?文章源自JAVA秀-https://www.javaxiu.com/33085.html
应用服务器如何返回用户的请求?文章源自JAVA秀-https://www.javaxiu.com/33085.html
用户如果每次访问到的服务器不一样,那么如何维护session的一致性?文章源自JAVA秀-https://www.javaxiu.com/33085.html
针对以上问题,常用的解决方案 如下:文章源自JAVA秀-https://www.javaxiu.com/33085.html
1、负载均衡的问题
一般以下有5种解决方案:文章源自JAVA秀-https://www.javaxiu.com/33085.html
1、HTTP重定向文章源自JAVA秀-https://www.javaxiu.com/33085.html
HTTP
重定向就是应用层的请求转发。用户的请求其实已经到了HTTP
重定向负载均衡服务器,服务器根据算法要求用户重定向,用户收到重定向请求后,再次请求真正的集群文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:简单易用;文章源自JAVA秀-https://www.javaxiu.com/33085.html
缺点:性能较差。文章源自JAVA秀-https://www.javaxiu.com/33085.html
2、DNS域名解析负载均衡文章源自JAVA秀-https://www.javaxiu.com/33085.html
DNS
域名解析负载均衡就是在用户请求DNS服务器,获取域名对应的IP地址时,DNS服务器直接给出负载均衡后的服务器IP。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:交给
DNS
,不用我们去维护负载均衡服务器;文章源自JAVA秀-https://www.javaxiu.com/33085.html缺点:当一个应用服务器挂了,不能及时通知
DNS
,而且DNS
负载均衡的控制权在域名服务商那里,网站无法做更多的改善和更强大的管理。文章源自JAVA秀-https://www.javaxiu.com/33085.html
3、反向代理服务器文章源自JAVA秀-https://www.javaxiu.com/33085.html
在用户的请求到达反向代理服务器时(已经到达网站机房),由反向代理服务器根据算法转发到具体的服务器。常用的
Apache
,Nginx
都可以充当反向代理服务器。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:部署简单;文章源自JAVA秀-https://www.javaxiu.com/33085.html
缺点:代理服务器可能成为性能的瓶颈,特别是一次上传大文件。文章源自JAVA秀-https://www.javaxiu.com/33085.html
4、IP层负载均衡文章源自JAVA秀-https://www.javaxiu.com/33085.html
在请求到达负载均衡器后,负载均衡器通过修改请求的目的
IP
地址,从而实现请求的转发,做到负载均衡。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:性能更好;文章源自JAVA秀-https://www.javaxiu.com/33085.html
缺点:负载均衡器的宽带成为瓶颈。文章源自JAVA秀-https://www.javaxiu.com/33085.html
5、数据链路层负载均衡文章源自JAVA秀-https://www.javaxiu.com/33085.html
在请求到达负载均衡器后,负载均衡器通过修改请求的
MAC
地址,从而做到负载均衡,与IP
负载均衡不一样的是,当请求访问完服务器之后,直接返回客户。而无需再经过负载均衡器。文章源自JAVA秀-https://www.javaxiu.com/33085.html
2、集群调度转发算法
1、rr轮询调度算法文章源自JAVA秀-https://www.javaxiu.com/33085.html
顾名思义,轮询分发请求。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:实现简单文章源自JAVA秀-https://www.javaxiu.com/33085.html
缺点:不考虑每台服务器的处理能力文章源自JAVA秀-https://www.javaxiu.com/33085.html
2、wrr加权调度算法文章源自JAVA秀-https://www.javaxiu.com/33085.html
我们给每个服务器设置权值
Weight
,负载均衡调度器根据权值调度服务器,服务器被调用的次数跟权值成正比。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:考虑了服务器处理能力的不同文章源自JAVA秀-https://www.javaxiu.com/33085.html
3、sh原地址散列算法文章源自JAVA秀-https://www.javaxiu.com/33085.html
提取用户
IP
,根据散列函数得出一个key
,再根据静态映射表,查处对应的value
,即目标服务器IP
。过目标机器超负荷,则返回空。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:实现同一个用户访问同一个服务器。文章源自JAVA秀-https://www.javaxiu.com/33085.html
4、dh目标地址散列算法文章源自JAVA秀-https://www.javaxiu.com/33085.html
原理同上,只是现在提取的是目标地址的
IP
来做哈希。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:实现同一个用户访问同一个服务器。文章源自JAVA秀-https://www.javaxiu.com/33085.html
5、lc最少连接算法文章源自JAVA秀-https://www.javaxiu.com/33085.html
优先把请求转发给连接数少的服务器。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:使得集群中各个服务器的负载更加均匀。文章源自JAVA秀-https://www.javaxiu.com/33085.html
6、wlc加权最少连接算法文章源自JAVA秀-https://www.javaxiu.com/33085.html
在
lc
的基础上,为每台服务器加上权值。算法为:(活动连接数 * 256 + 非活动连接数) ÷ 权重
,计算出来的值小的服务器优先被选择。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:可以根据服务器的能力分配请求。文章源自JAVA秀-https://www.javaxiu.com/33085.html
7、sed最短期望延迟算法文章源自JAVA秀-https://www.javaxiu.com/33085.html
其实sed跟wlc类似,区别是不考虑非活动连接数。算法为:
(活动连接数 +1 ) * 256 ÷ 权重
,同样计算出来的值小的服务器优先被选择。文章源自JAVA秀-https://www.javaxiu.com/33085.html
8、nq永不排队算法文章源自JAVA秀-https://www.javaxiu.com/33085.html
改进的
sed
算法。我们想一下什么情况下才能“永不排队”,那就是服务器的连接数为0的时候,那么假如有服务器连接数为0,均衡器直接把请求转发给它,无需经过sed的计算。文章源自JAVA秀-https://www.javaxiu.com/33085.html
9、LBLC基于局部性最少连接算法文章源自JAVA秀-https://www.javaxiu.com/33085.html
负载均衡器根据请求的目的
IP
地址,找出该IP
地址最近被使用的服务器,把请求转发之。若该服务器超载,最采用最少连接数算法。文章源自JAVA秀-https://www.javaxiu.com/33085.html
10、LBLCR带复制的基于局部性最少连接算法文章源自JAVA秀-https://www.javaxiu.com/33085.html
负载均衡器根据请求的目的IP地址,找出该IP地址最近使用的“服务器组”,注意,并不是具体某个服务器,然后采用最少连接数从该组中挑出具体的某台服务器出来,把请求转发之。若该服务器超载,那么根据最少连接数算法,在集群的非本服务器组的服务器中,找出一台服务器出来,加入本服务器组,然后把请求转发。文章源自JAVA秀-https://www.javaxiu.com/33085.html
3、集群请求返回模式问题
1、NAT文章源自JAVA秀-https://www.javaxiu.com/33085.html
负载均衡器接收用户的请求,转发给具体服务器,服务器处理完请求返回给均衡器,均衡器再重新返回给用户。文章源自JAVA秀-https://www.javaxiu.com/33085.html
2、DR文章源自JAVA秀-https://www.javaxiu.com/33085.html
负载均衡器接收用户的请求,转发给具体服务器,服务器出来玩请求后直接返回给用户。需要系统支持
IP Tunneling
协议,难以跨平台 。文章源自JAVA秀-https://www.javaxiu.com/33085.html
3、TUN文章源自JAVA秀-https://www.javaxiu.com/33085.html
同上,但无需
IP Tunneling
协议,跨平台性好 ,大部分系统都可以支持。文章源自JAVA秀-https://www.javaxiu.com/33085.html
4、集群Session一致性问题
1、Session Sticky文章源自JAVA秀-https://www.javaxiu.com/33085.html
Session sticky
就是把同一个用户在某一个会话中的请求,都分配到固定的某一台服务器中,这样我们就不需要解决跨服务器的session
问题了,常见的算法有ip_hash
算法,即上面提到的两种散列算法。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:实现简单;文章源自JAVA秀-https://www.javaxiu.com/33085.html
缺点:应用服务器重启则session消失。文章源自JAVA秀-https://www.javaxiu.com/33085.html
2、Session Replication文章源自JAVA秀-https://www.javaxiu.com/33085.html
Session replication
就是在集群中复制session
,使得每个服务器都保存有全部用户的session
数据。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:减轻负载均衡服务器的压力,不需要要实现ip_hasp算法来转发请求;文章源自JAVA秀-https://www.javaxiu.com/33085.html
缺点:复制时网络带宽开销大,访问量大的话
Session
占用内存大且浪费。文章源自JAVA秀-https://www.javaxiu.com/33085.html
3、Session数据集中存储文章源自JAVA秀-https://www.javaxiu.com/33085.html
Session
数据集中存储就是利用数据库来存储session
数据,实现了session
和应用服务器的解耦。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:相比
Session replication
的方案,集群间对于宽带和内存的压力大幅减少;文章源自JAVA秀-https://www.javaxiu.com/33085.html缺点:需要维护存储
Session
的数据库。文章源自JAVA秀-https://www.javaxiu.com/33085.html
4、Cookie Base文章源自JAVA秀-https://www.javaxiu.com/33085.html
Cookie base
就是把Session
存在Cookie
中,由浏览器来告诉应用服务器我的session
是什么,同样实现了session
和应用服务器的解耦。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:实现简单,基本免维护。文章源自JAVA秀-https://www.javaxiu.com/33085.html
缺点:cookie长度限制,安全性低,带宽消耗。文章源自JAVA秀-https://www.javaxiu.com/33085.html
值得一提的是:文章源自JAVA秀-https://www.javaxiu.com/33085.html
Nginx
目前支持的负载均衡算法有wrr
、sh
(支持一致性哈希)、fair
(lc)。但Nginx
作为均衡器的话,还可以一同作为静态资源服务器 。文章源自JAVA秀-https://www.javaxiu.com/33085.htmlKeepalived + ipvsadm
比较强大,目前支持的算法有:rr
、wrr
、lc
、wlc
、lblc
、sh
、dh
文章源自JAVA秀-https://www.javaxiu.com/33085.htmlKeepalived
支持集群模式有:NAT
、DR
、TUN
文章源自JAVA秀-https://www.javaxiu.com/33085.htmlNginx
本身并没有提供session
同步的解决方案,而Apache
则提供了session
共享的支持。文章源自JAVA秀-https://www.javaxiu.com/33085.html
解决了以上的问题之后,系统的结构如下:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段四、数据库读写分离化
上面我们总是假设数据库负载正常,但随着访问量的的提高,数据库的负载也在慢慢增大。那么可能有人马上就想到跟应用服务器一样,把数据库一份为二再负载均衡即可。文章源自JAVA秀-https://www.javaxiu.com/33085.html
但对于数据库来说,并没有那么简单。假如我们简单的把数据库一分为二,然后对于数据库的请求,分别负载到A机器和B机器,那么显而易见会造成两台数据库数据不统一的问题。那么对于这种情况,我们可以先考虑使用读写分离 和主从复制 的方式。文章源自JAVA秀-https://www.javaxiu.com/33085.html
读写分离后的系统结构如下:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
这个结构变化后也会带来两个问题:文章源自JAVA秀-https://www.javaxiu.com/33085.html
主从数据库之间数据同步问题。文章源自JAVA秀-https://www.javaxiu.com/33085.html
应用对于数据源的选择问题。文章源自JAVA秀-https://www.javaxiu.com/33085.html
解决方案:文章源自JAVA秀-https://www.javaxiu.com/33085.html
使用
MySQL
自带的Master + Slave
的方式实现主从复制 。文章源自JAVA秀-https://www.javaxiu.com/33085.html采用第三方数据库中间件 ,例如
MyCat
。MyCat
是从Cobar
发展而来的,而Cobar
是阿里开源的数据库中间件,后来停止开发。MyCat
是国内比较好的MySql
开源数据库分库分表中间件。文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段五、用搜索引擎缓解读库的压力
数据库做读库的话,常常对模糊查找 力不从心,即使做了读写分离,这个问题还未能解决。以我们所举的交易网站为例,发布的商品存储在数据库中,用户最常使用的功能就是查找商品,尤其是根据商品的标题来查找对应的商品。对于这种需求,一般我们都是通过like
功能来实现的,但是这种方式的代价非常大,而且结果非常不准确。此时我们可以使用搜索引擎 的倒排索引 来完成。文章源自JAVA秀-https://www.javaxiu.com/33085.html
搜索引擎具有的优点:它能够大大提高查询速度和搜索准确性。文章源自JAVA秀-https://www.javaxiu.com/33085.html
引入搜索引擎的开销
带来大量的维护工作,我们需要自己实现索引的构建过程,设计全量/增加的构建方式来应对非实时与实时的查询需求。文章源自JAVA秀-https://www.javaxiu.com/33085.html
需要维护搜索引擎集群文章源自JAVA秀-https://www.javaxiu.com/33085.html
搜索引擎并不能替代数据库,它解决了某些场景下的精准、快速、高效的“读”操作,是否引入搜索引擎,需要综合考虑整个系统的需求。文章源自JAVA秀-https://www.javaxiu.com/33085.html
引入搜索引擎后的系统结构如下:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段六、用缓存缓解读库的压力
常用的缓存机制包括页面级缓存、应用数据缓存和数据库缓存。文章源自JAVA秀-https://www.javaxiu.com/33085.html
随着访问量的增加,逐渐出现了许多用户访问同一部分热门内容 的情况,对于这些比较热门的内容,没必要每次都从数据库读取。我们可以使用缓存技术 ,例如可以使用Google的开源缓存技术Guava
或者使用Memecahed
作为应用层 的缓存,也可以使用Redis
作为数据库层 的缓存。文章源自JAVA秀-https://www.javaxiu.com/33085.html
另外,在某些场景下,关系型数据库并不是很适合,例如我想做一个“每日输入密码错误次数限制”的功能,思路大概是在用户登录时,如果登录错误,则记录下该用户的
IP
和错误次数,那么这个数据要放在哪里呢?假如放在内存中,那么显然会占用太大的内容;假如放在关系型数据库中,那么既要建立数据库表,还要简历对应的Java bean
,还要写SQL
等等。而分析一下我们要存储的数据,无非就是类似{ip:errorNumber}
这样的key:value
数据。对于这种数据,我们可以用NOSQL
数据库来代替传统的关系型数据库。文章源自JAVA秀-https://www.javaxiu.com/33085.html
除了数据缓存,还有页面缓存。比如使用HTML5
的localstroage
或者Cookie
。除了页面缓存带来的性能提升外,对于并发访问且页面置换频率小的页面,应尽量使用页面静态化技术。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:减轻数据库的压力, 大幅度提高访问速度;文章源自JAVA秀-https://www.javaxiu.com/33085.html
缺点:需要维护缓存服务器,提高了编码的复杂性。文章源自JAVA秀-https://www.javaxiu.com/33085.html
值得一提的是:文章源自JAVA秀-https://www.javaxiu.com/33085.html
缓存集群的调度算法不同与上面提到的应用服务器和数据库。最好采用一致性哈希算 ,这样才能提高命中率 。文章源自JAVA秀-https://www.javaxiu.com/33085.html
加入缓存后的系统结构如下:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段七、数据库水平拆分与垂直拆分
我们的网站演进到现在,交易、商品、用户的数据都还在同一个数据库中。尽管采取了增加缓存 和读写分离 的方式,但随着数据库的压力继续增加,数据库数据量的瓶颈 越来越突出,此时,我们可以有数据垂直拆分 和水平拆分 两种选择。文章源自JAVA秀-https://www.javaxiu.com/33085.html
垂直拆分的意思是把数据库中不同的业务数据拆分到不同的数据库中,结合现在的例子,就是把交易、商品、用户的数据分开。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:文章源自JAVA秀-https://www.javaxiu.com/33085.html
解决了原来把所有业务放在一个数据库中的压力问题;文章源自JAVA秀-https://www.javaxiu.com/33085.html
可以根据业务的特点进行更多的优化。文章源自JAVA秀-https://www.javaxiu.com/33085.html
缺点:文章源自JAVA秀-https://www.javaxiu.com/33085.html
需要维护多个数据库的状态一致性和数据同步。文章源自JAVA秀-https://www.javaxiu.com/33085.html
问题:文章源自JAVA秀-https://www.javaxiu.com/33085.html
需要考虑原来跨业务的事务;文章源自JAVA秀-https://www.javaxiu.com/33085.html
跨数据库的
Join
。文章源自JAVA秀-https://www.javaxiu.com/33085.html
解决问题方案:文章源自JAVA秀-https://www.javaxiu.com/33085.html
应该在应用层尽量避免跨数据库的分布式事务 ,如果非要跨数据库,尽量在代码 中控制。文章源自JAVA秀-https://www.javaxiu.com/33085.html
通过第三方中间件 来解决,如上面提到的
MyCat
,MyCat
提供了丰富的跨库Join
方案,详情可参考MyCat
官方文档。文章源自JAVA秀-https://www.javaxiu.com/33085.html
数据垂直拆分后的结构如下:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
数据水平拆分 就是把同一个表中的数据拆分到两个 甚至多个 数据库中。产生数据水平拆分的原因是某个业务的数据量 或者更新量到达了单个数据库 的瓶颈,这时就可以把这个表拆分到两个或更多个数据库中。文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:文章源自JAVA秀-https://www.javaxiu.com/33085.html
如果能克服以上问题,那么我们将能够很好地对数据量及写入量增长的情况。文章源自JAVA秀-https://www.javaxiu.com/33085.html
问题:文章源自JAVA秀-https://www.javaxiu.com/33085.html
访问用户信息的应用系统需要解决
SQL路由
的问题,因为现在用户信息分在了两个数据库中,需要在进行数据操作时了解需要操作的数据在哪里。文章源自JAVA秀-https://www.javaxiu.com/33085.html主键 的处理也变得不同,例如原来自增字段 ,现在不能简单地继续使用。文章源自JAVA秀-https://www.javaxiu.com/33085.html
如果需要分页 查询,那就更加麻烦。文章源自JAVA秀-https://www.javaxiu.com/33085.html
解决问题方案:文章源自JAVA秀-https://www.javaxiu.com/33085.html
我们还是可以通过可以解决第三方中间件,如
MyCat
。MyCat
可以通过SQL
解析模块对我们的SQL
进行解析,再根据我们的配置,把请求转发到具体的某个数据库。 我们可以通过UUID
保证唯一或自定义ID方案来解决。文章源自JAVA秀-https://www.javaxiu.com/33085.htmlMyCat
也提供了丰富的分页查询方案 ,比如先从每个数据库做分页查询,再合并数据做一次分页查询等等。文章源自JAVA秀-https://www.javaxiu.com/33085.html
数据水平拆分后的结构如下:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段八、应用的拆分
随着业务的发展,业务越来越多,应用越来越大。我们需要考虑如何避免让应用越来越臃肿 。这就需要把应用拆开,从一个应用变为俩个甚至更多。还是以我们上面的例子,我们可以把用户、商品、交易拆分开。变成“用户、商品”和“用户,交易”两个子系统。文章源自JAVA秀-https://www.javaxiu.com/33085.html
拆分后的结构:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
问题:文章源自JAVA秀-https://www.javaxiu.com/33085.html
这样拆分后,可能会有一些相同的代码,如用户相关的代码,商品和交易都需要用户信息,所以在两个系统中都保留差不多的操作用户信息的代码。如何保证这些代码可以复用是一个需要解决的问题。文章源自JAVA秀-https://www.javaxiu.com/33085.html
解决问题:文章源自JAVA秀-https://www.javaxiu.com/33085.html
通过走服务化SOA的路线来解决频繁公共的服务。文章源自JAVA秀-https://www.javaxiu.com/33085.html
为了解决上面拆分应用后所出现的问题,我们把公共 的服务拆分出来,形成一种服务化 的模式,简称SOA
。文章源自JAVA秀-https://www.javaxiu.com/33085.html
采用服务化之后的系统结构:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
优点:文章源自JAVA秀-https://www.javaxiu.com/33085.html
相同的代码不会散落在不同的应用中了,这些实现放在了各个服务中心 ,使代码得到更好的维护。文章源自JAVA秀-https://www.javaxiu.com/33085.html
我们把对数据库的交互业务放在了各个服务中心,让前端的Web应用更注重与浏览器交互的工作。文章源自JAVA秀-https://www.javaxiu.com/33085.html
问题:文章源自JAVA秀-https://www.javaxiu.com/33085.html
如何进行远程的服务调用?文章源自JAVA秀-https://www.javaxiu.com/33085.html
解决方法:文章源自JAVA秀-https://www.javaxiu.com/33085.html
可以通过下面的引入消息中间件来解决。文章源自JAVA秀-https://www.javaxiu.com/33085.html
阶段九、引入消息中间件
随着网站的继续发展,的系统中可能出现不同语言 开发的子模块和部署在不同平台的子系统。此时我们需要一个平台来传递可靠的,与平台和语言无关的数据,并且能够把负载均衡透明化 ,能在调用过程中收集 并分析 调用数据,推测出网站的访问增长率 等等一系列需求,对于网站应该如何成长做出预测。开源消息中间件有阿里的Dubbo
,可以搭配Google开源的分布式程序协调服务Zookeeper
实现服务器的注册 与发现 。文章源自JAVA秀-https://www.javaxiu.com/33085.html
引入消息中间件后的结构:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
总结
以上的演变过程只是一个例子,并不适合所有的网站,实际中网站演进过程与自身业务和不同遇到的问题有密切的关系,没有固定的模式。只有认真的分析和不断地探究,才能发现适合自己网站的架构。文章源自JAVA秀-https://www.javaxiu.com/33085.html
- END -文章源自JAVA秀-https://www.javaxiu.com/33085.html
欢迎加入我的知识星球,一起探讨架构,交流源码。加入方式,长按下方二维码噢:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
已在知识星球更新源码解析如下:文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
最近更新《芋道 SpringBoot 2.X 入门》系列,已经 20 余篇,覆盖了 MyBatis、Redis、MongoDB、ES、分库分表、读写分离、SpringMVC、Webflux、权限、WebSocket、Dubbo、RabbitMQ、RocketMQ、Kafka、性能测试等等内容。文章源自JAVA秀-https://www.javaxiu.com/33085.html
提供近 3W 行代码的 SpringBoot 示例,以及超 4W 行代码的电商微服务项目。文章源自JAVA秀-https://www.javaxiu.com/33085.html
获取方式:点“在看”,关注公众号并回复 666 领取,更多内容陆续奉上。文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章源自JAVA秀-https://www.javaxiu.com/33085.html
文章有帮助的话,在看,转发吧。谢谢支持哟 (*^__^*)文章源自JAVA秀-https://www.javaxiu.com/33085.html
阅读原文文章源自JAVA秀-https://www.javaxiu.com/33085.html

评论