【金融业分布式数据库选型及HTAP场景实践】作为数据基础设施的重要组成部分,数据库在其中扮演着重要的角色。近些年来,数据库整体发展也呈现出较之以往很大的不同。其一、是开源数据库受到更为广泛的关注,从多家机构的最新报告来看,开源数据库无论从产品数量还是受关注程度都超过商业数据库。开源这一新模式,正成为未来数据库发展的主流。其二、是云计算成为未来主要资源供给方式得到普遍共识。已经有越来越多的企业选择在云上构建基础环境,包括云上数据库的发展速度也远高于非云环境。据乐观估计,在未来5~10年云数据库将占据整体数据库市场的七成以上。此外,对迁移到公有云、使用多云环境等问题,也普遍被企业所接受。其三、是数据融合趋势,针对数据多场景应用,使用融合技术简化访问,提升效率。作为数据使用高地,金融行业一方面对数据库有着极高的要求,一方面又面临很多来自数据新的挑战,诸如海量规模、高并发、数据安全、实时分析等诉求亟待解决。分布式数据库的出现,迎合这一发展趋势,对于金融企业解决上述问题带来新的解决思路。本文从金融用户角度入手,对如何选择分布式数据库及选型后的最优实践进行阐述。

1. 金融业数据库选型背景
随着企业数字化转型深入,对于数据使用场景也呈现多元化趋势,正有越来越多数据被企业利用起来。金融行业作为数据库应用“高地”,这一趋势表现更为明显。同时我们也看到,近些年来数据库领域也发展迅速,有分布式数据库、多模数据库、云数据库为代表的产品不断涌现。这些新兴数据库在特定场景有很好的使用前景。基于上面两种趋势,金融行业很多企业都在面临选择数据库的问题。
1).选型技术层面要素分析
从技术角度来看,在数据库选型中有哪些要素需要考虑呢?下面以近期比较关注的分布式数据库的选型为例,说明下重点考量的技术要素。
分布式事务
分布式架构,自然会带来分布式事务的问题。由于需要跨节点的网络交互,因此较单机事务会有很多损耗。随之带来的是事务处理时间较长、事务期间的锁持有时间也会增加,数据库的并发性和扩展性也会受到影响。针对单笔事务来说,分布式事务执行效率是肯定会有降低的,分布式带来的更多是整体处理能力的提升。
性能
由于分布式数据库通常使用的二阶段提交和各节点之间的网络交互会有性能损耗,分布式数据库优势不是单个简单SQL的性能,而是大数据量的SQL查询,每个节点会将过滤之后的数据集进行返回,会提升性能,并且分布式数据库的优势是并发,大量的SQL并发也会比单机数据库强大,应用需要做分布式架构的适配,将串行执行机制尽量都改造成并发处理。对于含有需要节点间数据流动的SQL语句的事务,OLTP类的分布式数据库处理效率一般较差,事务处理时间会较长,事务期间的锁持有时间也会增加,数据库的并发性和扩展性也会受到影响。建议尽量改造存在跨节点数据流动的SQL语句(主要是多表关联)的事务。
数据备份
分布式数据库的一致性保证通过内部时钟机制所提供的全局时间戳,所有节点都会遵循该机制,所以备份恢复的增量也是基于全局时间戳,但是分布式数据库的备份解决方案最重要的标志为是否支持物理级的备份,物理级的备份会比逻辑的备份性能吞吐大很多,还有就是是否支持一些分布式备份方案,比如S3协议接口,是否支持压缩等功能。分布式数据库基本都具备备份和恢复方案,通常从备节点进行连续备份(全量+日志),恢复的时候指定节点进行恢复到指定时间点,整个过程可配置自动任务、自动执行。
高可用
分布式数据库大多都是基于多数派协议,同城双中心不适合多数派的要求,同城数据级多活建议采用三中心部署。如果同城主备可以采用集群级的异步复制,异地建议采用集群级的binlog异步复制,建议实例的主备节点设置在同城两个双活数据中心,仲裁节点三机房部署;异地灾备单独启实例与本地实例进行数据库间同步,也可以将本地备份文件T+1恢复到异地灾备。
数据一致性
分布式数据库大多都是通过获取全局时钟时间戳,采用二阶段提交,可以实现一致性的保证,分库分表架构对于事务的一致性,需要应用层考虑,比如通过合理的分区键设计来规避。部分分布式数据库对于跨节点事务目前还是实现的最终一致,对于全局一致性读,一般通过引入类似全局时间戳的组件统一管理全局事务,在数据库选型时可以重点关注厂商对这一块的实现。如果目前暂时无法提供全局一致性读的分布式数据库,对于要依赖分布式事务“中间状态”的业务,优先进行业务改造进行规避,其次通过合理的数据分片设计让其在单节点内完成。
数据分析
分布式数据库,多采用存算分离架构。针对数据分析场景,需要对数据从下层存储节点上移到计算节点,这对分布式数据库提出了更高的要求。一方面可通过算子下推等技术,减少需传输到计算节点的数量;一方面针对汇聚后的结果需要通过流式处理等方式,规避诸如OOM的问题;此外也可采用如MPP等并行处理技术,加速数据分析过程。
2).选型过程问题痛点分析
在选型过程中,会遇到来自以下几方面的痛点。
一是由于分布式数据库整体架构还比较新,也是近十年来逐步发展完善的。针对新型架构的诸多特点,包括厂商和用户还都在不断摸索积累之中,还需要有个长期实践的过程。此外,新架构也需要有个逐步成熟完善的过程。
二是大量产品来自国内数据库厂商,其发展周期相对较短,还需要在产品成熟度、稳定性、周边生态等方面不断完善。对于用户来说,一方面需面临产品多、技术栈多的现状;另一方面还需面对成熟度不足等问题,存在较多痛点。
三是近些年金融行业发展迅速,各种新的业态产品不断涌现,这些对作为底层数据基础的数据库也提出了更高的要求。
四是随着内外部环境的变化,自主可控等问题受到更多的关注。金融行业首当其冲,针对上述问题也需要引起足够的重视。在数据库选型问题上,也需要考虑这一因素。这无疑对用户选择带来一定困难。

2. 数据库选型技术架构
1).分布式路线分析
针对分布式数据库的发展路线,大体可分为两种:
分布式中间件
这种架构是从中间件路线演进而来。其采用存储与计算分离架构,底层采用标准单机数据库,副本间基于数据库主从复制机制。上层承担计算,并可将部分计算下推到存储节点执行。这种架构在分布式事务、全局MVCC等方面,往往存在一定难点,各厂商也有各自解决之道。
原生分布式
这种架构正是受到Google论文影响演进而来。其采用存储与计算分离架构,底层采用单机库(不一定是关系型),副本间采用分布式一致性协议完成复制,支持多数派提交。上层承担计算,并可将部分计算下推到存储节点执行。
2).重点需求满足情况
针对上述遇到的痛点,两类产品实现逻辑也所有不同。

3). 路线场景分析
从数据使用场景来讲,可大致按下面进行划分:

针对不同的场景,不同分布式数据库路线产品各有所长。
针对事务类场景下,强调高并发联机交易、对分析能力要求不高的场景比较适合分布式中间件路线产品。
针对事务类及事务/分析混合类场景,既要满足常规联机交易场景的同时,还需满足分析类的一部分能力,这种情况比较适合原生分布式产品。基于原生分布式的 HTAP 数据库,用一个数据平台应对规模化交易和实时分析,提升业务决策的时效性,降低数据技术栈的复杂性,越来越多的混合负载需求推动了 HTAP 在金融场景的落地。
3. 金融业 HTAP 应用场景实践
1). 金融场景下 HTAP 的分析
在金融企业数字化转型的过程中,各类业务对“海量、实时、在线”的数据需求变得愈发迫切。在金融企业运营场景中,实时推荐、精准营销是企业提升竞争力的一大因素。在企业风险控制场景中,实时风控、反欺诈等业务开展可以更早地识别和阻断风险可以让企业减少损失,HTAP正是基于上述背景诞生出的需求,为各类实时数据处理需求提供了解决方案。
2).某金融用户 HTAP 的架构设计和实践
随着金融市场同业业务的蓬勃发展,业务部门对于交易数据的实时统计分析和展现有了急切的需求。基于大数据技术栈的 T+1 报表模式,已无法满足业务部门通过实时分析交易发生情况来防范风险以及提供决策的需求,迫切的需要找到一种能让数据实时变现的解决方案。结合金融行业特点,在技术选型过程中,重点考察待选产品如下能力:包括承载业务复杂查询处理、海量数据容量存储、应用透明无侵入、开发协议可适配及混合负载下的表现等。经过测试,选择 TiDB 作为基础数据库平台。通过一段时间上线使用,满足业务场景,基于其 HTAP 的特性,打造金融市场实时数据平台,目前已投产了灵活报表和交易对手分析等功能。整个处理流程包括:
Flink 消费交易系统产生的实时增量数据,对部分事实表进行拉宽处理并写入TiDB
维表和其他明细表直接写入 TiDB
BI 工具直接连接 TiDB,提供秒级的实时计算和分析能力

这一案例中,构建千万及以上数据规模、超过五张表的复杂关联实时查询能力,让业务人员在极短的时间内(大部分报表执行时间为几十到几百毫秒、个别报表秒级别)获得实时交易的详情。
3).未来 HTAP 的场景发展
实时数据处理技术还以某些具体的应用场景为主,从现状来看以事件驱动类、流式管道数据计算类为代表的场景,已经开始使用 HTAP 场景的。未来随着 HTAP 计算能力进一步的提升,实时全量数据的计算将带来更多场景。

4. 面向未来的架构趋势
1).云原生
从未来的发展趋势来看,云方向是一个大的趋势。

从上图可见,云数据库的发展经历了几个阶段,从云托管、云服务、云原生之路。
云托管,是最接近传统数据库系统的部署模式。本质是将原本部署于IDC机房内物理服务器上的传统数据库软件部署在了云主机上。这种模式下,云平台提供诸如高可用、异地灾备、备份恢复、数据安全、SQL审计、性能优化和状态监测等企业级数据库管理能力,用户可减少运维投入即可享受之前同等的服务水平。
云服务,之前的托管架构中,受限于传统数据库架构的局限,未能完全发挥云计算的优势。在诸如弹性扩展、高性能、高可用等方面,均有不足。到了云服务时代,充分利用云基础设施的底层能力,提供定制化的数据库产品。
云原生,与之前的云服务架构不同,这一阶段产品将更为充分地利用云基础设施的能力,通过多层资源解耦,可享受云带来的弹性扩展、按需供给、超大规模能力。真正做到了数据库与云的深度结合。从长期来看,金融机构逐渐把业务和技术向云原生演进,实现传统应用迁移上云和云原生改造是重要的方向。在这个过程中需要考虑分布式数据库对 K8s、微服务应用的支持,提供高效、弹性调度能力,同时需要兼顾开发运维和敏捷度。
2).多云方向
云作为未来主流的资源供给方式,多云必然是企业不得不考虑的问题。多云通常指金融机构同时采用多种不同的云环境组合来满足业务需求的多样性和金融业监管的要求。如何围绕数据打造面向未来的多云 IT 架构,满足在多云之间提供数据服务能力,摆脱单一供应商的弊端,是必须考虑的问题。多云架构对分布式数据库的考察重点聚焦于跨地域、跨公有私有云、跨本地 IDC 和 K8S 的部署、服务提供与统一运维能力等。

#特别关注#【四川省一般工商业用电已全部恢复】据国网四川省电力公司消息,随着气温下降,省内多地降雨,四川省用电紧张的局面得到缓解。截至28日中午12时,四川省一般工商业用电已经全部恢复,除高载能企业外,大工业用电正在逐步恢复,后续水电来水持续好转后,大工业将全部恢复正常用电。详情请戳https://t.cn/A6SolJb3

#特别关注#【四川省一般工商业用电已全部恢复】据国网四川省电力公司消息,随着气温下降,省内多地降雨,四川省用电紧张的局面得到缓解。截至28日中午12时,四川省一般工商业用电已经全部恢复,除高载能企业外,大工业用电正在逐步恢复,后续水电来水持续好转后,大工业将全部恢复正常用电。详情请戳https://t.cn/A6SolJb3


发布     👍 0 举报 写留言 🖊   
✋热门推荐
  • (笑)」な忍者写真や(忍者とは!? 誌面でご確認ください)各々の空気感が溢れる組み撮影など、現場の雰囲気が伝わる特集になりました。(p1)スタミナをつけるスタミ
  • :1. 请读者翻开这部小说,穿过历史隧道,重回那个成就了范仲淹的时代,一览彼时中国人的风采,在与真实的范仲淹相伴而行的过程中,领略他的七情六欲,同慨他的百感交集
  • 武庚啊,你是被选中能击垮天的人, 你拥有神族才有的神力, 降大任于你,必先苦其心志,劳其筋骨,饿其体肤,只有经历磨难才会使自己的人生更加的多姿多彩,不拼一把,你
  • [泪][泪]北京土话丫——骂人的话,也叫丫挺,原本是丫头养的意思。 方言很多南城人最为正宗前些日子海边的宿醉后 病去如抽丝抽丝的日子里 吃食清淡得意外 除了工
  • 《有哪些适合表白的古诗句?》 1.愿我如星君如月,夜夜流光相皎洁。 2.晓看天色暮看云,行也思君,坐也思君。 3.此时相望不相闻,愿逐月华流照君。 4.
  • 节目所呈现的,并不是一味打鸡血、喊口号,而是敢于直面现实世界的难,不逃避生活与工作中的窘,用幽默的段子解构世情,以乐观向上的态度笑对人生。幽默搞笑的表演技巧包裹
  • 每日穿行田间村头,着你衣,戴你帽,走我们的路,看我们的朝霞与落日,望你指给我的北斗七星,吹熟悉的风,还有朗朗的月、皎皎的花 、万千的云 …… 我还会吃那些你爱的
  • 小学到大学毕业,真情实感追过的可能只有龙族和lovelive(且只有第一季,对星团水团不感冒)看的遍数没有十遍也有八遍,或许更多。在特殊的格局中,那些杀从官的,
  • 是他!尤其是看到森林里的巴士,小动物们像是要去春游一样排排坐,那么快乐和放松,看的人也想去大自然里撒欢儿了~作者个站:台台!
  • 就这样,从容行走在尘间,一袭风,一身静,听花开的声音,听脚下的足音,心暖,风雨不寒,心若不离,爱亦不远。就这样,从容行走在尘间,一袭风,一身静,听花开的声音,听
  • #韩国留学[超话]##卢正义[超话]# 经过正义小粉丝的提醒我也去调查了一下准确信息,经过调查咱们再来科普一下正义最基本的相关信息吧,在给大家科普的同时也给大家
  • 大抵是我长得太瓷实了,只在一次爬楼梯时滚下去,磕出点鼻血,还没等我站起来冲去找到奶奶,它已经干了;呕吐就更是少有,只在一天午睡前吃多了奶奶种的黄瓜,躺下去打了个
  • #艾芙花园[超话]# 之前收到的卡稀烂的问题我终于联系到卖家了,卖家上给了解释,我是愿意相信的,但是她让我自己去问快递?(刚刚忘记把卖家电话打码 重发一下)到
  • ☯️Creative: miasssong sabinavitter chenxizhaooPhotography: miasssongStyling: sab
  • 普拉提的老师可温柔了,每次都发微信问我几点过去上课,今天都到楼下了我妈打电话说家里漏水了让我回家,昨天就没有去练今天又没有练成,明天一定一定过去! 现在这个
  • Barry之所以改弦易调,可能是因为中风影响到了他的左脑,不仅提升了他爱的能力,还有表达和感受积极情绪的整体能力。令人惊奇的是,未曾恋爱的人、热恋的人和近期分
  • 《广东一男子被一片树叶砸晕 倒在地上不省人事》【广东一男子被一片树叶砸晕在地】5月5日,在广东佛山禅城区南庄解放路第一人民医院禅城医院门前,一棵种植在人行道边的
  • 同样地,他们如果能有意识地承认自已不喜欢什么,然后作出一些改变,生活就会比较容易一些,而不是无意识地挑衅外在的力量,打乱自己的一切。这些人通常很难在别人的管理下
  •   发布会上,中共安阳市委书记袁家健介绍,守好擦亮河南北大门的十年,是锚定“两个确保”、实施“十大战略”围绕建设现代化区域中心强市,知难而进、迎难而上、向难求成
  • 高逼格城市滑雪场空降绍城,一秒穿越雪乡同款浪漫冬季】#金帝商业置业# 如果你对冰雪运动有着浓厚兴趣,却遗憾自己身处少雪的南方,那么YOLOSKI室内滑雪馆,就是