【金融业分布式数据库选型及HTAP场景实践】作为数据基础设施的重要组成部分,数据库在其中扮演着重要的角色。近些年来,数据库整体发展也呈现出较之以往很大的不同。其一、是开源数据库受到更为广泛的关注,从多家机构的最新报告来看,开源数据库无论从产品数量还是受关注程度都超过商业数据库。开源这一新模式,正成为未来数据库发展的主流。其二、是云计算成为未来主要资源供给方式得到普遍共识。已经有越来越多的企业选择在云上构建基础环境,包括云上数据库的发展速度也远高于非云环境。据乐观估计,在未来5~10年云数据库将占据整体数据库市场的七成以上。此外,对迁移到公有云、使用多云环境等问题,也普遍被企业所接受。其三、是数据融合趋势,针对数据多场景应用,使用融合技术简化访问,提升效率。作为数据使用高地,金融行业一方面对数据库有着极高的要求,一方面又面临很多来自数据新的挑战,诸如海量规模、高并发、数据安全、实时分析等诉求亟待解决。分布式数据库的出现,迎合这一发展趋势,对于金融企业解决上述问题带来新的解决思路。本文从金融用户角度入手,对如何选择分布式数据库及选型后的最优实践进行阐述。

1. 金融业数据库选型背景
随着企业数字化转型深入,对于数据使用场景也呈现多元化趋势,正有越来越多数据被企业利用起来。金融行业作为数据库应用“高地”,这一趋势表现更为明显。同时我们也看到,近些年来数据库领域也发展迅速,有分布式数据库、多模数据库、云数据库为代表的产品不断涌现。这些新兴数据库在特定场景有很好的使用前景。基于上面两种趋势,金融行业很多企业都在面临选择数据库的问题。
1).选型技术层面要素分析
从技术角度来看,在数据库选型中有哪些要素需要考虑呢?下面以近期比较关注的分布式数据库的选型为例,说明下重点考量的技术要素。
分布式事务
分布式架构,自然会带来分布式事务的问题。由于需要跨节点的网络交互,因此较单机事务会有很多损耗。随之带来的是事务处理时间较长、事务期间的锁持有时间也会增加,数据库的并发性和扩展性也会受到影响。针对单笔事务来说,分布式事务执行效率是肯定会有降低的,分布式带来的更多是整体处理能力的提升。
性能
由于分布式数据库通常使用的二阶段提交和各节点之间的网络交互会有性能损耗,分布式数据库优势不是单个简单SQL的性能,而是大数据量的SQL查询,每个节点会将过滤之后的数据集进行返回,会提升性能,并且分布式数据库的优势是并发,大量的SQL并发也会比单机数据库强大,应用需要做分布式架构的适配,将串行执行机制尽量都改造成并发处理。对于含有需要节点间数据流动的SQL语句的事务,OLTP类的分布式数据库处理效率一般较差,事务处理时间会较长,事务期间的锁持有时间也会增加,数据库的并发性和扩展性也会受到影响。建议尽量改造存在跨节点数据流动的SQL语句(主要是多表关联)的事务。
数据备份
分布式数据库的一致性保证通过内部时钟机制所提供的全局时间戳,所有节点都会遵循该机制,所以备份恢复的增量也是基于全局时间戳,但是分布式数据库的备份解决方案最重要的标志为是否支持物理级的备份,物理级的备份会比逻辑的备份性能吞吐大很多,还有就是是否支持一些分布式备份方案,比如S3协议接口,是否支持压缩等功能。分布式数据库基本都具备备份和恢复方案,通常从备节点进行连续备份(全量+日志),恢复的时候指定节点进行恢复到指定时间点,整个过程可配置自动任务、自动执行。
高可用
分布式数据库大多都是基于多数派协议,同城双中心不适合多数派的要求,同城数据级多活建议采用三中心部署。如果同城主备可以采用集群级的异步复制,异地建议采用集群级的binlog异步复制,建议实例的主备节点设置在同城两个双活数据中心,仲裁节点三机房部署;异地灾备单独启实例与本地实例进行数据库间同步,也可以将本地备份文件T+1恢复到异地灾备。
数据一致性
分布式数据库大多都是通过获取全局时钟时间戳,采用二阶段提交,可以实现一致性的保证,分库分表架构对于事务的一致性,需要应用层考虑,比如通过合理的分区键设计来规避。部分分布式数据库对于跨节点事务目前还是实现的最终一致,对于全局一致性读,一般通过引入类似全局时间戳的组件统一管理全局事务,在数据库选型时可以重点关注厂商对这一块的实现。如果目前暂时无法提供全局一致性读的分布式数据库,对于要依赖分布式事务“中间状态”的业务,优先进行业务改造进行规避,其次通过合理的数据分片设计让其在单节点内完成。
数据分析
分布式数据库,多采用存算分离架构。针对数据分析场景,需要对数据从下层存储节点上移到计算节点,这对分布式数据库提出了更高的要求。一方面可通过算子下推等技术,减少需传输到计算节点的数量;一方面针对汇聚后的结果需要通过流式处理等方式,规避诸如OOM的问题;此外也可采用如MPP等并行处理技术,加速数据分析过程。
2).选型过程问题痛点分析
在选型过程中,会遇到来自以下几方面的痛点。
一是由于分布式数据库整体架构还比较新,也是近十年来逐步发展完善的。针对新型架构的诸多特点,包括厂商和用户还都在不断摸索积累之中,还需要有个长期实践的过程。此外,新架构也需要有个逐步成熟完善的过程。
二是大量产品来自国内数据库厂商,其发展周期相对较短,还需要在产品成熟度、稳定性、周边生态等方面不断完善。对于用户来说,一方面需面临产品多、技术栈多的现状;另一方面还需面对成熟度不足等问题,存在较多痛点。
三是近些年金融行业发展迅速,各种新的业态产品不断涌现,这些对作为底层数据基础的数据库也提出了更高的要求。
四是随着内外部环境的变化,自主可控等问题受到更多的关注。金融行业首当其冲,针对上述问题也需要引起足够的重视。在数据库选型问题上,也需要考虑这一因素。这无疑对用户选择带来一定困难。

2. 数据库选型技术架构
1).分布式路线分析
针对分布式数据库的发展路线,大体可分为两种:
分布式中间件
这种架构是从中间件路线演进而来。其采用存储与计算分离架构,底层采用标准单机数据库,副本间基于数据库主从复制机制。上层承担计算,并可将部分计算下推到存储节点执行。这种架构在分布式事务、全局MVCC等方面,往往存在一定难点,各厂商也有各自解决之道。
原生分布式
这种架构正是受到Google论文影响演进而来。其采用存储与计算分离架构,底层采用单机库(不一定是关系型),副本间采用分布式一致性协议完成复制,支持多数派提交。上层承担计算,并可将部分计算下推到存储节点执行。
2).重点需求满足情况
针对上述遇到的痛点,两类产品实现逻辑也所有不同。

3). 路线场景分析
从数据使用场景来讲,可大致按下面进行划分:

针对不同的场景,不同分布式数据库路线产品各有所长。
针对事务类场景下,强调高并发联机交易、对分析能力要求不高的场景比较适合分布式中间件路线产品。
针对事务类及事务/分析混合类场景,既要满足常规联机交易场景的同时,还需满足分析类的一部分能力,这种情况比较适合原生分布式产品。基于原生分布式的 HTAP 数据库,用一个数据平台应对规模化交易和实时分析,提升业务决策的时效性,降低数据技术栈的复杂性,越来越多的混合负载需求推动了 HTAP 在金融场景的落地。
3. 金融业 HTAP 应用场景实践
1). 金融场景下 HTAP 的分析
在金融企业数字化转型的过程中,各类业务对“海量、实时、在线”的数据需求变得愈发迫切。在金融企业运营场景中,实时推荐、精准营销是企业提升竞争力的一大因素。在企业风险控制场景中,实时风控、反欺诈等业务开展可以更早地识别和阻断风险可以让企业减少损失,HTAP正是基于上述背景诞生出的需求,为各类实时数据处理需求提供了解决方案。
2).某金融用户 HTAP 的架构设计和实践
随着金融市场同业业务的蓬勃发展,业务部门对于交易数据的实时统计分析和展现有了急切的需求。基于大数据技术栈的 T+1 报表模式,已无法满足业务部门通过实时分析交易发生情况来防范风险以及提供决策的需求,迫切的需要找到一种能让数据实时变现的解决方案。结合金融行业特点,在技术选型过程中,重点考察待选产品如下能力:包括承载业务复杂查询处理、海量数据容量存储、应用透明无侵入、开发协议可适配及混合负载下的表现等。经过测试,选择 TiDB 作为基础数据库平台。通过一段时间上线使用,满足业务场景,基于其 HTAP 的特性,打造金融市场实时数据平台,目前已投产了灵活报表和交易对手分析等功能。整个处理流程包括:
Flink 消费交易系统产生的实时增量数据,对部分事实表进行拉宽处理并写入TiDB
维表和其他明细表直接写入 TiDB
BI 工具直接连接 TiDB,提供秒级的实时计算和分析能力

这一案例中,构建千万及以上数据规模、超过五张表的复杂关联实时查询能力,让业务人员在极短的时间内(大部分报表执行时间为几十到几百毫秒、个别报表秒级别)获得实时交易的详情。
3).未来 HTAP 的场景发展
实时数据处理技术还以某些具体的应用场景为主,从现状来看以事件驱动类、流式管道数据计算类为代表的场景,已经开始使用 HTAP 场景的。未来随着 HTAP 计算能力进一步的提升,实时全量数据的计算将带来更多场景。

4. 面向未来的架构趋势
1).云原生
从未来的发展趋势来看,云方向是一个大的趋势。

从上图可见,云数据库的发展经历了几个阶段,从云托管、云服务、云原生之路。
云托管,是最接近传统数据库系统的部署模式。本质是将原本部署于IDC机房内物理服务器上的传统数据库软件部署在了云主机上。这种模式下,云平台提供诸如高可用、异地灾备、备份恢复、数据安全、SQL审计、性能优化和状态监测等企业级数据库管理能力,用户可减少运维投入即可享受之前同等的服务水平。
云服务,之前的托管架构中,受限于传统数据库架构的局限,未能完全发挥云计算的优势。在诸如弹性扩展、高性能、高可用等方面,均有不足。到了云服务时代,充分利用云基础设施的底层能力,提供定制化的数据库产品。
云原生,与之前的云服务架构不同,这一阶段产品将更为充分地利用云基础设施的能力,通过多层资源解耦,可享受云带来的弹性扩展、按需供给、超大规模能力。真正做到了数据库与云的深度结合。从长期来看,金融机构逐渐把业务和技术向云原生演进,实现传统应用迁移上云和云原生改造是重要的方向。在这个过程中需要考虑分布式数据库对 K8s、微服务应用的支持,提供高效、弹性调度能力,同时需要兼顾开发运维和敏捷度。
2).多云方向
云作为未来主流的资源供给方式,多云必然是企业不得不考虑的问题。多云通常指金融机构同时采用多种不同的云环境组合来满足业务需求的多样性和金融业监管的要求。如何围绕数据打造面向未来的多云 IT 架构,满足在多云之间提供数据服务能力,摆脱单一供应商的弊端,是必须考虑的问题。多云架构对分布式数据库的考察重点聚焦于跨地域、跨公有私有云、跨本地 IDC 和 K8S 的部署、服务提供与统一运维能力等。

危涛:旅行者
https://t.cn/A6Sq9vxP

在受疫情影响的这三年里,对于很多人来说旅行似乎已变得有些陌生了,好在我们有摄影,每当我重新翻看或者重新处理之前旅拍图片的时候,我的手指似乎还可以感受到当时按动快门的那种触觉以及由于这种触觉所引发的对影像里的景、人、物的生动回忆。

《旅行者》这组照片是我2017年秋天在斯里兰卡科伦坡拍摄的,大多数来斯里兰卡旅行的人都不会选择在首都科伦坡过多地逗留,大抵是因为这是个工业化城市,没有太多值得观赏及游玩的地方。但当我在科伦坡火车站候车的时候却发现这里有着独特的风景:站台上经停的一列列粉红车身的火车就好像充满异域风情的女郎让人无法移目。或许是因为身处旅行环境更容易让人卸下平日里的种种装扮,车厢里的旅行者面对镜头或忧或喜、或沉静或热情,而车窗就是绝好的画框,将这一幅幅人间万象呈现出来,再无需任何多余的拍摄技巧和复杂后期,这不正是我期望中的旅行拍摄素材吗?于是我将他们拍摄下来。

有人说旅行就是从自己呆腻的地方去到别人呆腻的地方,如果你也对眼前的景色厌倦了,那么请多留意身边的旅行者吧,他(她)们会让你体会到一种独特且无法复制的美。

危涛

工程硕士,IT从业者,中国摄影著作权协会会员。摄影作品入选第16届、18届中国国际摄影艺术展。

#世界在望#

开学新电脑到手需要做什么?磁盘分区教程[毕业帽]

新电脑买回来以后磁盘分区是非常必要设置,对电脑以后的使用和维护特别重要,手把手教你如何操作,包你学会[交税]。
-
比如这台新电脑只有系统盘(199G)和D盘(275G),如果你需要划分出E盘、F盘等,就得按照下面的流程进行分区。
-
[上课了]第一步:鼠标右击桌面上的“此电脑”图标,选择“管理”,进入系统管理界面。
[上课了]第二步:点击左边的磁盘管理;
[上课了]第三步:在D盘处右击“压缩卷”;
[上课了]第四步:从原来的D盘压缩出105G空间为例;
[上课了]第五步:把压缩出的空间新建为“E盘”;
[上课了]第六步:返回“此电脑”电脑已经成功多出一个“E盘”;
-
我们就以512G的硬盘空间为例,通常C盘可以留100G,其他的400G按自己的需求分配成2~3个盘就可以啦[掌宝爱心]!


发布     👍 0 举报 写留言 🖊   
✋热门推荐
  • #县在出发# ​​​#西安外事学院[超话]##鲜小外的分享# 【#最常读错的地名#,你能读对几个?【#最常读错的地名#,你能读对几个?
  • 一看tv动画我那电影版刚get到的一点流花又全面倒戈仙流了!提到金泰熙,就是美丽的代名词。
  • [并不简单][玉兔捣药] ​​​东芝 Z750 电视 4 月 20 日开售:iCare 眼舒适 + 音画双芯,8999 元起东芝 Z750 电视将于 4 月 2
  • 希捷首席执行官莫斯利在一份声明中说,“虽然我们相信,在销售硬盘驱动时,我们遵守了所有相关的出口管制法律,但我们认为……解决这个问题(达成和解)是最好的做希捷首席
  • 有的感觉到正能量的感染力,有的回去神清气爽,更有的偏财连连,感觉就像开挂,你们看,参加完沙龙后频频收钱,两天收6000元,开心的不得了。(涉及剧透慎入)虽然策划
  • 歪果网红人手一个的保冷1.18L大水壶子…有一个大把手好握持 外加瓶身的设计可以放进车上的水杯架所以我有点心动 打算去健身的时候用 可是买来以后发现不是密封的
  • 众所周知何超莲是赌王的女儿,家境优越,出生时就被赌王何鸿燊看重并赐名何超莲,希望她能像一朵莲花一样“出权欲世家而不染”继续为家族带来好运,起初窦骁也被各种质疑是
  • 他开始追问,我却不知道该怎么说了,只能先各种的给他做心理建设,各种确定他的心意……到了下午的时候,我觉得也差不多了,也确实不想再那么纠结,给他发了段自己喜欢的文
  • 日本設計之所以能夠登上國際舞台,美感固然重要,但畢竟不同文化,對美的定義有不同演繹,能夠被國際認可,更重要是他設計背後的idea。例如Pleats Please
  • 并且,新车离地间隙较全新福特探险者提高30mm,接近角、离去角分别提升至23°、24°,匹配65%高扁平比的普利司通“动力侠”系列全地形REVO3轮胎、高强度金
  • P5小窗户里的落日P6嘿嘿,有个小朋友走路害怕,突然拉住我的手P7吃饭遇到了几年没见的高中同学,偷偷给俺们结了账P8呜呜呜刮刮乐没中P9我永远喜欢夜骑希望王女士
  • 福利:转发抽5个幸运鹅,送新品任意两杯中杯哟[爱你][酷][太开心][坏笑][坏笑][坏笑][坏笑]✨茶百道点单攻略✨终于打卡了这家在成都很火的奶茶店 把他家热
  • #mbti测试链接# #mbti超话# #荣格八维#荣格八维详解:内倾思维 Ti独立自主性和高度集中性当别人试图胁迫或要求他们的时间和自由度时,他们会变得沮丧或
  • 【打扰啦整理了pdd好价合集小伙伴们快去逛逛鸭】————【爆款推荐】————【11.9】渣渣灰 南昌拌粉2盒【14.9】正宗8424麒麟西瓜 3-4斤*1个【8
  • 郭勇告诉记者,为了进一步打造文化阵地,近期又多方联系募集了10个种类150套演出服,初步建成了双泉村歌舞队服装库。争取多方资金项目等对两眼水泉进行维修保护,泉前
  • KOSDAQ指数中被做空最多的股票是Ecopro BM和Ecopro,也与电动汽车电池相关,同样备受日内交易员的喜爱。#韩国综合股价指数今年已上涨15%以上#【
  • #国考[超话]#【考公打卡】Day9,类比推理-反对关系:除了A和B之外还有其他题干除了端午和中秋,还有其他节日,属于反对关系本题选择A,除了红色和绿色,还有其
  • 他擅长描绘人物,尤其是女性人物,并擅用阴郁的色彩和含蓄的表情来表达主题思想,这幅《罪过》也是他这方面技巧的很好例证。这个事件的细节可能会让读这个新闻的读者感到愤
  • 但比較麻煩的問題在一段歲月之後…圖中來求診患者便是精典案例,凸眼造成眼下脂肪外顯,如果移除,眼球保護力減弱,容易亁澀…李醫師診斷後,手術完全保留珍貴脂肪,並且增
  • 새벽에 깨기전의 그 꿈..정말 말로 형용하기 어려워.꿈속에서 난 초등학교 동창 몇과 함께 큰 집으로 들어갔어.사실 우리는 그 집에 악령이 있다는