【金融业分布式数据库选型及HTAP场景实践】作为数据基础设施的重要组成部分,数据库在其中扮演着重要的角色。近些年来,数据库整体发展也呈现出较之以往很大的不同。其一、是开源数据库受到更为广泛的关注,从多家机构的最新报告来看,开源数据库无论从产品数量还是受关注程度都超过商业数据库。开源这一新模式,正成为未来数据库发展的主流。其二、是云计算成为未来主要资源供给方式得到普遍共识。已经有越来越多的企业选择在云上构建基础环境,包括云上数据库的发展速度也远高于非云环境。据乐观估计,在未来5~10年云数据库将占据整体数据库市场的七成以上。此外,对迁移到公有云、使用多云环境等问题,也普遍被企业所接受。其三、是数据融合趋势,针对数据多场景应用,使用融合技术简化访问,提升效率。作为数据使用高地,金融行业一方面对数据库有着极高的要求,一方面又面临很多来自数据新的挑战,诸如海量规模、高并发、数据安全、实时分析等诉求亟待解决。分布式数据库的出现,迎合这一发展趋势,对于金融企业解决上述问题带来新的解决思路。本文从金融用户角度入手,对如何选择分布式数据库及选型后的最优实践进行阐述。

1. 金融业数据库选型背景
随着企业数字化转型深入,对于数据使用场景也呈现多元化趋势,正有越来越多数据被企业利用起来。金融行业作为数据库应用“高地”,这一趋势表现更为明显。同时我们也看到,近些年来数据库领域也发展迅速,有分布式数据库、多模数据库、云数据库为代表的产品不断涌现。这些新兴数据库在特定场景有很好的使用前景。基于上面两种趋势,金融行业很多企业都在面临选择数据库的问题。
1).选型技术层面要素分析
从技术角度来看,在数据库选型中有哪些要素需要考虑呢?下面以近期比较关注的分布式数据库的选型为例,说明下重点考量的技术要素。
分布式事务
分布式架构,自然会带来分布式事务的问题。由于需要跨节点的网络交互,因此较单机事务会有很多损耗。随之带来的是事务处理时间较长、事务期间的锁持有时间也会增加,数据库的并发性和扩展性也会受到影响。针对单笔事务来说,分布式事务执行效率是肯定会有降低的,分布式带来的更多是整体处理能力的提升。
性能
由于分布式数据库通常使用的二阶段提交和各节点之间的网络交互会有性能损耗,分布式数据库优势不是单个简单SQL的性能,而是大数据量的SQL查询,每个节点会将过滤之后的数据集进行返回,会提升性能,并且分布式数据库的优势是并发,大量的SQL并发也会比单机数据库强大,应用需要做分布式架构的适配,将串行执行机制尽量都改造成并发处理。对于含有需要节点间数据流动的SQL语句的事务,OLTP类的分布式数据库处理效率一般较差,事务处理时间会较长,事务期间的锁持有时间也会增加,数据库的并发性和扩展性也会受到影响。建议尽量改造存在跨节点数据流动的SQL语句(主要是多表关联)的事务。
数据备份
分布式数据库的一致性保证通过内部时钟机制所提供的全局时间戳,所有节点都会遵循该机制,所以备份恢复的增量也是基于全局时间戳,但是分布式数据库的备份解决方案最重要的标志为是否支持物理级的备份,物理级的备份会比逻辑的备份性能吞吐大很多,还有就是是否支持一些分布式备份方案,比如S3协议接口,是否支持压缩等功能。分布式数据库基本都具备备份和恢复方案,通常从备节点进行连续备份(全量+日志),恢复的时候指定节点进行恢复到指定时间点,整个过程可配置自动任务、自动执行。
高可用
分布式数据库大多都是基于多数派协议,同城双中心不适合多数派的要求,同城数据级多活建议采用三中心部署。如果同城主备可以采用集群级的异步复制,异地建议采用集群级的binlog异步复制,建议实例的主备节点设置在同城两个双活数据中心,仲裁节点三机房部署;异地灾备单独启实例与本地实例进行数据库间同步,也可以将本地备份文件T+1恢复到异地灾备。
数据一致性
分布式数据库大多都是通过获取全局时钟时间戳,采用二阶段提交,可以实现一致性的保证,分库分表架构对于事务的一致性,需要应用层考虑,比如通过合理的分区键设计来规避。部分分布式数据库对于跨节点事务目前还是实现的最终一致,对于全局一致性读,一般通过引入类似全局时间戳的组件统一管理全局事务,在数据库选型时可以重点关注厂商对这一块的实现。如果目前暂时无法提供全局一致性读的分布式数据库,对于要依赖分布式事务“中间状态”的业务,优先进行业务改造进行规避,其次通过合理的数据分片设计让其在单节点内完成。
数据分析
分布式数据库,多采用存算分离架构。针对数据分析场景,需要对数据从下层存储节点上移到计算节点,这对分布式数据库提出了更高的要求。一方面可通过算子下推等技术,减少需传输到计算节点的数量;一方面针对汇聚后的结果需要通过流式处理等方式,规避诸如OOM的问题;此外也可采用如MPP等并行处理技术,加速数据分析过程。
2).选型过程问题痛点分析
在选型过程中,会遇到来自以下几方面的痛点。
一是由于分布式数据库整体架构还比较新,也是近十年来逐步发展完善的。针对新型架构的诸多特点,包括厂商和用户还都在不断摸索积累之中,还需要有个长期实践的过程。此外,新架构也需要有个逐步成熟完善的过程。
二是大量产品来自国内数据库厂商,其发展周期相对较短,还需要在产品成熟度、稳定性、周边生态等方面不断完善。对于用户来说,一方面需面临产品多、技术栈多的现状;另一方面还需面对成熟度不足等问题,存在较多痛点。
三是近些年金融行业发展迅速,各种新的业态产品不断涌现,这些对作为底层数据基础的数据库也提出了更高的要求。
四是随着内外部环境的变化,自主可控等问题受到更多的关注。金融行业首当其冲,针对上述问题也需要引起足够的重视。在数据库选型问题上,也需要考虑这一因素。这无疑对用户选择带来一定困难。

2. 数据库选型技术架构
1).分布式路线分析
针对分布式数据库的发展路线,大体可分为两种:
分布式中间件
这种架构是从中间件路线演进而来。其采用存储与计算分离架构,底层采用标准单机数据库,副本间基于数据库主从复制机制。上层承担计算,并可将部分计算下推到存储节点执行。这种架构在分布式事务、全局MVCC等方面,往往存在一定难点,各厂商也有各自解决之道。
原生分布式
这种架构正是受到Google论文影响演进而来。其采用存储与计算分离架构,底层采用单机库(不一定是关系型),副本间采用分布式一致性协议完成复制,支持多数派提交。上层承担计算,并可将部分计算下推到存储节点执行。
2).重点需求满足情况
针对上述遇到的痛点,两类产品实现逻辑也所有不同。

3). 路线场景分析
从数据使用场景来讲,可大致按下面进行划分:

针对不同的场景,不同分布式数据库路线产品各有所长。
针对事务类场景下,强调高并发联机交易、对分析能力要求不高的场景比较适合分布式中间件路线产品。
针对事务类及事务/分析混合类场景,既要满足常规联机交易场景的同时,还需满足分析类的一部分能力,这种情况比较适合原生分布式产品。基于原生分布式的 HTAP 数据库,用一个数据平台应对规模化交易和实时分析,提升业务决策的时效性,降低数据技术栈的复杂性,越来越多的混合负载需求推动了 HTAP 在金融场景的落地。
3. 金融业 HTAP 应用场景实践
1). 金融场景下 HTAP 的分析
在金融企业数字化转型的过程中,各类业务对“海量、实时、在线”的数据需求变得愈发迫切。在金融企业运营场景中,实时推荐、精准营销是企业提升竞争力的一大因素。在企业风险控制场景中,实时风控、反欺诈等业务开展可以更早地识别和阻断风险可以让企业减少损失,HTAP正是基于上述背景诞生出的需求,为各类实时数据处理需求提供了解决方案。
2).某金融用户 HTAP 的架构设计和实践
随着金融市场同业业务的蓬勃发展,业务部门对于交易数据的实时统计分析和展现有了急切的需求。基于大数据技术栈的 T+1 报表模式,已无法满足业务部门通过实时分析交易发生情况来防范风险以及提供决策的需求,迫切的需要找到一种能让数据实时变现的解决方案。结合金融行业特点,在技术选型过程中,重点考察待选产品如下能力:包括承载业务复杂查询处理、海量数据容量存储、应用透明无侵入、开发协议可适配及混合负载下的表现等。经过测试,选择 TiDB 作为基础数据库平台。通过一段时间上线使用,满足业务场景,基于其 HTAP 的特性,打造金融市场实时数据平台,目前已投产了灵活报表和交易对手分析等功能。整个处理流程包括:
Flink 消费交易系统产生的实时增量数据,对部分事实表进行拉宽处理并写入TiDB
维表和其他明细表直接写入 TiDB
BI 工具直接连接 TiDB,提供秒级的实时计算和分析能力

这一案例中,构建千万及以上数据规模、超过五张表的复杂关联实时查询能力,让业务人员在极短的时间内(大部分报表执行时间为几十到几百毫秒、个别报表秒级别)获得实时交易的详情。
3).未来 HTAP 的场景发展
实时数据处理技术还以某些具体的应用场景为主,从现状来看以事件驱动类、流式管道数据计算类为代表的场景,已经开始使用 HTAP 场景的。未来随着 HTAP 计算能力进一步的提升,实时全量数据的计算将带来更多场景。

4. 面向未来的架构趋势
1).云原生
从未来的发展趋势来看,云方向是一个大的趋势。

从上图可见,云数据库的发展经历了几个阶段,从云托管、云服务、云原生之路。
云托管,是最接近传统数据库系统的部署模式。本质是将原本部署于IDC机房内物理服务器上的传统数据库软件部署在了云主机上。这种模式下,云平台提供诸如高可用、异地灾备、备份恢复、数据安全、SQL审计、性能优化和状态监测等企业级数据库管理能力,用户可减少运维投入即可享受之前同等的服务水平。
云服务,之前的托管架构中,受限于传统数据库架构的局限,未能完全发挥云计算的优势。在诸如弹性扩展、高性能、高可用等方面,均有不足。到了云服务时代,充分利用云基础设施的底层能力,提供定制化的数据库产品。
云原生,与之前的云服务架构不同,这一阶段产品将更为充分地利用云基础设施的能力,通过多层资源解耦,可享受云带来的弹性扩展、按需供给、超大规模能力。真正做到了数据库与云的深度结合。从长期来看,金融机构逐渐把业务和技术向云原生演进,实现传统应用迁移上云和云原生改造是重要的方向。在这个过程中需要考虑分布式数据库对 K8s、微服务应用的支持,提供高效、弹性调度能力,同时需要兼顾开发运维和敏捷度。
2).多云方向
云作为未来主流的资源供给方式,多云必然是企业不得不考虑的问题。多云通常指金融机构同时采用多种不同的云环境组合来满足业务需求的多样性和金融业监管的要求。如何围绕数据打造面向未来的多云 IT 架构,满足在多云之间提供数据服务能力,摆脱单一供应商的弊端,是必须考虑的问题。多云架构对分布式数据库的考察重点聚焦于跨地域、跨公有私有云、跨本地 IDC 和 K8S 的部署、服务提供与统一运维能力等。

三观超正的文案

1:父母能顶着寒风五点钟干活,你六七点钟的书并不冻手

2:就算公交上空无一人,司机也会把车开到终点站
我的意思是:你不要因为任何人的离开,而停止原本的生活。

3:可是爸爸并没有说因为钱难赚就不赚了,妈妈并没有觉得孩子不听话就不要了,所以我也没有资格说累就不努力

4:你就做好你的事,不要去管角落里的事,比起角落里的事,阳光下的爱来的更重要。

5:你要知道这个世界上全是别人,只有一个自己,所以你要找到自己才是最重要的!

6:看见优秀的人欣赏,看到落魄的人也不轻视,没人爱时专注自己,有人爱时,有能力拥抱彼此

7:成熟的意义在于:你可以试着理解原来不理解的事,尝试原谅你以前从不曾接受的人,在难过和委屈面前还依旧可以保持乐观的态度,独立的人格和勇敢善良的心。

三观超正的文案

1:父母能顶着寒风五点钟干活,你六七点钟的书并不冻手

2:就算公交上空无一人,司机也会把车开到终点站
我的意思是:你不要因为任何人的离开,而停止原本的生活。

3:可是爸爸并没有说因为钱难赚就不赚了,妈妈并没有觉得孩子不听话就不要了,所以我也没有资格说累就不努力

4:你就做好你的事,不要去管角落里的事,比起角落里的事,阳光下的爱来的更重要。

5:你要知道这个世界上全是别人,只有一个自己,所以你要找到自己才是最重要的!

6:看见优秀的人欣赏,看到落魄的人也不轻视,没人爱时专注自己,有人爱时,有能力拥抱彼此

7:成熟的意义在于:你可以试着理解原来不理解的事,尝试原谅你以前从不曾接受的人,在难过和委屈面前还依旧可以保持乐观的态度,独立的人格和勇敢善良的心。


发布     👍 0 举报 写留言 🖊   
✋热门推荐
  • 漂亮是漂亮,不知道为什么总有一种风尘味,眼神好像在告诉人“我会很拿捏男人哦”她应该会在台湾呢边发展吧,资源什么的都在台湾,如果内地的话她路人缘可能不太好,而且长
  • 黑灰色和黑色提花面料Oblique印花 黑色粒面牛皮革 正面金属覆层黄铜“DIOR”标志 内部饰以“DIOR”压花标志 翻盖和抽绳开合 可调节的衬垫尼龙肩带
  • 如果真的爱两个孩子,就多为她们考虑,专注自家孩子,械斗也要找准敌人,该声讨的是大家族,否则大家族射出的回旋镖终究会扎到自己身上。一直以来,两个孩子都是自带玄学
  • 对共和党人来说有一个好消息,那就是民主党的众议员布莱恩·希金斯(纽约州)预计将于2月从众议院辞职。众议院共和党多数席位已减至2席2023年01月03日众议院共和
  • #luxiem[超话]# 退坑回血超低价出谷,收谷超大福利22新年吧唧 22樱花 23樱花 agf联动 白情 半周年 jazz挂件 一周年 大正 retro r
  • Guillaume Berceau, Étienne Boussard, Florent Louman, Joakim Ciesla Quatuor Zahir
  • #刘宇宁又见逍遥主题曲# | #刘宇宁燕子京# | #摩登兄弟[超话]#刘宇宁燕子京|刘宇宁珠帘玉幕天气预报说今天的雨是甜的,分不清是因为奶糖味道的云朵,还是因
  • #冯绍峰谈到儿子眼圈红了#剖腹产选日子有哪些需要注意生辰八字理论告诉我们,人在出生的时刻即得天地之气,与天地合为一体,并从即刻起,人就与天地万物一样,都有自己的
  • 老范说,女校长跟他谈心时反复说的一句“社会多一所这样的学校就少建一座监狱”打动了他,不忍学校为难,而且吧,那七百块钱都还是人家七个领导自己掏自己腰包凑出来的。表
  • 千年前她没守住琉羽,如今连她女儿也失去了·灵尊这边也挺刀·沈璃是她那温顺的师妹拼命生下的孩子,也是她一手带大的孩子啊·当初,她是反对六冥的那一派,并且也劝阻过琉
  • #非人哉[超话]# 【非人哉拼拼】急了我彻底急了当你不想进团吃谷的时候就像我推讨厌了我你37的体温讲出0℃一下的话让我痛不欲生,万剑穿心我一下子就汗流浃背了 我
  • #热玛吉[超话]# 舒适热玛吉 体验过就爱上!近hen火的Thermage FLX-UP舒适热玛吉我来do了这个应该是新升级的了升级以后的操作方案可以根据每个人
  • #2024清明泉州行# D5 今天吃了啥: 图1: 爬清源山后本计划在南台岩喝个早茶,结果贵得吓了我们一大跳。 最后一人点了一碗汤,花生汤15元,牛肉丸汤20
  • ライブやイベントなどで人工知能や仮想空間を活用していく展開も考えられます」(前出のワイドショー関係者) 剛の個人事務所を妻・百田の親族がサポートする可能性もある
  • 不太给博主点关注 这是我为数不多关注的一位 无论他说什么 每条评论下面都在求复合 挺戏剧的 但是他输出的内容 说话的语气语调都非常的沁人心脾 温暖力量的具像化
  • ☎️我们的办公室!和朋友们(外加两只捣乱的小狗员工以非正式雇佣关系成立OUO办公室 时钟善意 总留下珍贵的朋友马马虎虎 潦潦草草的我们结伴走在成长路上想把故事
  • 毕竟散户的特性是追涨杀跌,跌时无人问津,但涨起来会有人追的,这样看蓝筹股的行情有望延续,重点现在是季报年报公布时期,有业绩支撑的蓝筹股还将继续吸引资金,比如昨晚
  • —来自一位圈外人的漫展参后感是啦是啦 我们kid sama是做过一段期间的古早顶流啦……但真的求求,这波营销真的让我害怕,毕竟对于现在的73老贼来说,糊真的是最
  • 尽管有传闻称,如果皇马成功签下姆巴佩,可能会需要牺牲罗德里戈来平衡球队的阵容,然而目前曼城、曼联、阿森纳和利物浦等豪门球队都在密切关注这位巴西国脚,希望能将他纳
  • ”宫梅罢手,“你对宫沉的想法永远都停留在了过去,这样你对付不了他的,你了解宫沉身边的人吗?“照你这么说,我就该躲着宫沉,最好是他身边一个小助理都屈膝哈腰,难道这