分布式的一些思考? 分布式问题
yuyutoo 2024-10-28 20:21 3 浏览 0 评论
一、前言
最近系统上遇到一些问题,我又仔细去思考了一下CAP相关方面的东西,有点感悟想写篇文章,来好好思索下CAP这个东西;
二、先聊聊一聊我遇到的问题?
简单的说说我的场景,MQ推送消息过来以后写入redis,然后多个进程去消费redis中的数据,最后处理完成进入ES。最近更改一些需求,要求必须是只能生成一条明细,我们系统可能推送多次,我们通过缓存是可以判断出最早的一条,但是系统上线以后还是会出现多条,后来经过排查发现原来是MQ时序问题,导致最终生成2条明细,后来我采用使用唯一ID处理这个问题,中间还思考通过ES版本号处理的这种方式,最终还是采用唯一Id处理,这里我们不比较这两种方式好坏。还是要关注我们说主题分布式的思考,我只想通过我这例子来说说CAP到底是处理什么问题的?
上图基本就是我们处理数据的流程,我省去了很多东西,比如分布式锁、缓存呀等等这些东西。我们单纯就借助这个模型来说说分布式的问题,A、B、C代表进程,我们都是分开部署多个节点在不同的机器上,类似于很多单体Web程序部署多台机器上通过Nginx分发处理请求,我们这些也都可以算是分布式系统,我们只是单纯自己玩,不相互联系而已,以一个不恰当的比喻来说最熟悉的陌生人。那CAP是处理什么问题的,大家可以看下这篇文章,看不懂可以翻译下,当然我就是属于看不懂的,哈哈。摘录下其中比较重要的话,翻译过来以后是:
在一个分布式系统(指互相连接并共享数据的节点的集合)中,在读/写操作的时候,一致性(Consistence)、可用性(Availability)、分区容错性(Partition Tolerance)只能同时保证其中两者,比如我们上面说两种情况,虽然分布式有读写操作,但是系统之间没有共享数据和相互连接,所以我们可以保证这3者同时存在。这里我们思考一个场景来解释下什么是共享数据和相互连接,就拿我们经常使用的淘宝买东西来说吧,当你买一件东西的时候,需要查看你的余额,然后发生扣款,打入到第三方账户种,这里你的钱就是共享数据和相互连接,明白这两个概念我们就来解释解释CAP的概念。
一致性(Consistence):其实就是类似于事务的隔离性,客户端不会读取到正在提交的事务,只有提交成功以后才客户端才可以查询到变更的信息,举个形象一点的例子来说,淘宝在你下单成功以后才会扣你的钱,不会下单失败了扣你的钱,在你下单的过程中你的账户里面的钱是不会动的,这就是一致性;
可用性(Availability):非故障的节点在合理的时间内返回合理的响应(不是错误和超时的响应),这个我感觉不需要举例子吧,就是系统的每个功能都能正常的返回结果;
分区容错性(Partition Tolerance):当发生网络分区后,系统依然能够发挥原来的作用,举个例子就是当ES某个节点挂掉的时候我们依然可以正常使用,这个例子可能不是恰当,但是能说明分区容错性的重要性,后面我们再来讨论下ES的CAP设计,这还是一件蛮有意思的事情;
在了解这3者之间的关系时候,我们就来思考下为什么只能三选二?在分布式系统中,必须要多台机器部署才能叫做分布式,多台机器相互联系的时候可能会发生网络或者其他一些故障,我们在设计的时候必须考虑到P,这个时候我们就该考虑C和A为什么不能共存,这二者本就是矛和盾的存在,当发生分区故障的时候,为了保证C,系统必须禁止写入,当有写入的请求的时候,系统就会返回错误,这个时候就和A冲突掉了,A要求的是不能是错误和超时响应,所以这就分布式系统理论上不能够选着CA,只能够选择CP和AP;
三、分析一波
前几篇博客一直都是在分析ES,那我们就来分析分析ES中CAP应用,大家可以提出不同的意见,支持辩驳。之前ES系列文章中也讲过ES会有脑裂的现象,这就是ES在P上的设计,这个不是我们讨论的重点,我们重点是ES到底是CP还是AP?可以在这几方面的进行讨论,读,写去解释下ES对于A和C的设计。
读
在ES读取数据的时候有preference这个类型,默认情况下操作在可用的分片中随机读取,我们可以通过设置参数来控制只读主,不懂这个大家可以参考下官方文档,做一点深层次思考preference的设计就是A和C的权衡,当我们系统要求很高的一致性性的时候我们就可以只读主分片,当要求不高的时候我们就可以随机读取,具体大家使用可以根据自己系统进行选择;
写
在之前的系列中也讲过ES的translog(事务日志)机制和flush机制,其实这里面的设计也是ES对C和A的选择,只是权力交给了我们,大家具体可以参考官方文档,这里我们也做下介绍,
TransLog
index.translog.durability:如果设为 async,默认情况下,ES 会每隔五秒对 TransLog 执行一次 fsync 和 commit 的操作;如果设为 request(default),则在每次真正执行index、delete、update 或者 bulk index 操作前立刻将 TransLog fsync 到每一个主分片和副本分片中,并返回成功;
index.translog.sync_interval:设置为async时,每次持久化间隔的时间;
还有上面我们讲述的ES锁的控制,有乐观和悲观锁,乐观锁是通过版本控制也就是我们常用的最终一致,悲观锁是强一致,设计方面的东西就理解到这里,其实我认为ES跟偏向于AP的设计,毕竟如果对这些不是很了解的话,他都是默认高可用,其实某些情况下还是不要过多执着于这个系统到底是CP还是AP,毕竟有些特殊情况嘛。
相关推荐
- Java开发中如何优雅地避免OOM(OutOfMemoryError)
-
Java开发中如何优雅地避免OOM(OutOfMemoryError)在这个信息化高速发展的时代,内存就像程序员手中的笔,缺了它就什么都写不出来。而OOM(OutOfMemoryError)就像是横在...
- 常见的JVM调优方法和步骤
-
1、内存调优堆内存设置:通过-Xms和-Xmx参数调整初始和最大堆内存大小-Xms:初始堆大小(如-Xms512M)-Xmx:最大堆大小(如-Xmx2048M)调整新生代和老年代的比例...
- Java中9种常见的CMS GC问题分析与解决(一)
-
目前,互联网上Java的...
- JDK21新特性:Prepare to Disallow the Dynamic Loading of Agents
-
PreparetoDisallowtheDynamicLoadingofAgentsJEP451:准备禁止动态加载代理摘要...
- Java程序GC垃圾回收机制优化指南
-
Java程序GC垃圾回收机制优化指南作为一个Java开发者,我们经常会在任务管理器里看到Java进程占用内存不断增长,然后突然下降的现象。这其实就是在Java虚拟机中运行的垃圾回收(GC)机制在起作用...
- Java Java命令学习系列(一)——Jps
-
jps位于jdk的bin目录下,其作用是显示当前系统的java进程情况,及其id号。jps相当于Solaris进程工具ps。不象”pgrepjava”或”ps-efgrepjava”,jps...
- 面试题专题:头条一面参考答案(003)
-
前两篇文章也都是介绍头条一面的内容及参考答案...
- Java JVM原理与性能调优:从基础到高级应用
-
一、JVM基础架构与内存模型1.1JVM整体架构概览Java虚拟机(JVM)是Java程序运行的基石,它由以下几个核心子系统组成:...
- 死锁攻防战:阿里架构师教你用3种核武器杜绝程序僵死
-
从线程转储分析到银行家算法,彻底掌握大厂必考的死锁解决方案以下是为Java死锁问题设计的结构化技术解析方案,包含代码级解决方案与高频追问应对策略:...
- Java 1.8 虚拟机内存分布详解
-
Java1.8虚拟机内存分布详解Java1.8的JVM内存布局相比早期版本有显著变化(如永久代被元空间取代)。以下是其核心内存区域的划分、作用及配置参数:一、JVM内存整体结构...
- Java 多线程开发难题?这篇文章给你答案!
-
作为互联网大厂的后端开发人员,在Java多线程开发过程中,必然会面临诸多复杂且具有挑战性的问题。在高并发场景下,各类潜在问题对系统的稳定性与性能产生严重影响,本文将深入探讨这些问题,并提供全面且有...
- 软件性能调优全攻略:从瓶颈定位到工具应用
-
性能调优是软件测试中的重要环节,旨在提高系统的响应时间、吞吐量、并发能力、资源利用率,并降低系统崩溃或卡顿的风险。通常,性能调优涉及发现性能瓶颈、分析问题根因、优化代码和系统配置等步骤,调优之前需要先...
- JVM性能优化实战技巧
-
JVM性能优化实战技巧在现代企业级应用开发中,JavaVirtualMachine(JVM)作为承载Java应用程序的核心引擎,其性能直接决定了系统的响应速度、吞吐量以及资源利用率。因此,掌握一些...
- JVM 深度解析:运行时数据区域、分代回收与垃圾回收机制全攻略
-
共同学习,有错欢迎指出。JVM运行时数据区域1.程序计数器程序计数器是一块较小的内存空间,可看作当前线程所执行的字节码的行号指示器。在虚拟机概念模型里,字节码解释器通过改变这个计数器的值选取下一条...
- JVM内存管理详解与调优实战
-
JVM内存管理详解与调优实战Java虚拟机(JVM)作为Java程序运行的核心组件,其内存管理机制直接影响着应用程序的性能表现。今天,咱们就来一场既严肃又有趣的JVM内存管理之旅,看看这个“幕后英雄”...
你 发表评论:
欢迎- 一周热门
-
-
前端面试:iframe 的优缺点? iframe有那些缺点
-
带斜线的表头制作好了,如何填充内容?这几种方法你更喜欢哪个?
-
漫学笔记之PHP.ini常用的配置信息
-
其实模版网站在开发工作中很重要,推荐几个参考站给大家
-
推荐7个模板代码和其他游戏源码下载的网址
-
[干货] JAVA - JVM - 2 内存两分 [干货]+java+-+jvm+-+2+内存两分吗
-
正在学习使用python搭建自动化测试框架?这个系统包你可能会用到
-
织梦(Dedecms)建站教程 织梦建站详细步骤
-
【开源分享】2024PHP在线客服系统源码(搭建教程+终身使用)
-
2024PHP在线客服系统源码+完全开源 带详细搭建教程
-
- 最近发表
- 标签列表
-
- mybatis plus (70)
- scheduledtask (71)
- css滚动条 (60)
- java学生成绩管理系统 (59)
- 结构体数组 (69)
- databasemetadata (64)
- javastatic (68)
- jsp实用教程 (53)
- fontawesome (57)
- widget开发 (57)
- vb net教程 (62)
- hibernate 教程 (63)
- case语句 (57)
- svn连接 (74)
- directoryindex (69)
- session timeout (58)
- textbox换行 (67)
- extension_dir (64)
- linearlayout (58)
- vba高级教程 (75)
- iframe用法 (58)
- sqlparameter (59)
- trim函数 (59)
- flex布局 (63)
- contextloaderlistener (56)