【金融业分布式数据库选型及HTAP场景实践】作为数据基础设施的重要组成部分,数据库在其中扮演着重要的角色。近些年来,数据库整体发展也呈现出较之以往很大的不同。其一、是开源数据库受到更为广泛的关注,从多家机构的最新报告来看,开源数据库无论从产品数量还是受关注程度都超过商业数据库。开源这一新模式,正成为未来数据库发展的主流。其二、是云计算成为未来主要资源供给方式得到普遍共识。已经有越来越多的企业选择在云上构建基础环境,包括云上数据库的发展速度也远高于非云环境。据乐观估计,在未来5~10年云数据库将占据整体数据库市场的七成以上。此外,对迁移到公有云、使用多云环境等问题,也普遍被企业所接受。其三、是数据融合趋势,针对数据多场景应用,使用融合技术简化访问,提升效率。作为数据使用高地,金融行业一方面对数据库有着极高的要求,一方面又面临很多来自数据新的挑战,诸如海量规模、高并发、数据安全、实时分析等诉求亟待解决。分布式数据库的出现,迎合这一发展趋势,对于金融企业解决上述问题带来新的解决思路。本文从金融用户角度入手,对如何选择分布式数据库及选型后的最优实践进行阐述。

1. 金融业数据库选型背景
随着企业数字化转型深入,对于数据使用场景也呈现多元化趋势,正有越来越多数据被企业利用起来。金融行业作为数据库应用“高地”,这一趋势表现更为明显。同时我们也看到,近些年来数据库领域也发展迅速,有分布式数据库、多模数据库、云数据库为代表的产品不断涌现。这些新兴数据库在特定场景有很好的使用前景。基于上面两种趋势,金融行业很多企业都在面临选择数据库的问题。
1).选型技术层面要素分析
从技术角度来看,在数据库选型中有哪些要素需要考虑呢?下面以近期比较关注的分布式数据库的选型为例,说明下重点考量的技术要素。
分布式事务
分布式架构,自然会带来分布式事务的问题。由于需要跨节点的网络交互,因此较单机事务会有很多损耗。随之带来的是事务处理时间较长、事务期间的锁持有时间也会增加,数据库的并发性和扩展性也会受到影响。针对单笔事务来说,分布式事务执行效率是肯定会有降低的,分布式带来的更多是整体处理能力的提升。
性能
由于分布式数据库通常使用的二阶段提交和各节点之间的网络交互会有性能损耗,分布式数据库优势不是单个简单SQL的性能,而是大数据量的SQL查询,每个节点会将过滤之后的数据集进行返回,会提升性能,并且分布式数据库的优势是并发,大量的SQL并发也会比单机数据库强大,应用需要做分布式架构的适配,将串行执行机制尽量都改造成并发处理。对于含有需要节点间数据流动的SQL语句的事务,OLTP类的分布式数据库处理效率一般较差,事务处理时间会较长,事务期间的锁持有时间也会增加,数据库的并发性和扩展性也会受到影响。建议尽量改造存在跨节点数据流动的SQL语句(主要是多表关联)的事务。
数据备份
分布式数据库的一致性保证通过内部时钟机制所提供的全局时间戳,所有节点都会遵循该机制,所以备份恢复的增量也是基于全局时间戳,但是分布式数据库的备份解决方案最重要的标志为是否支持物理级的备份,物理级的备份会比逻辑的备份性能吞吐大很多,还有就是是否支持一些分布式备份方案,比如S3协议接口,是否支持压缩等功能。分布式数据库基本都具备备份和恢复方案,通常从备节点进行连续备份(全量+日志),恢复的时候指定节点进行恢复到指定时间点,整个过程可配置自动任务、自动执行。
高可用
分布式数据库大多都是基于多数派协议,同城双中心不适合多数派的要求,同城数据级多活建议采用三中心部署。如果同城主备可以采用集群级的异步复制,异地建议采用集群级的binlog异步复制,建议实例的主备节点设置在同城两个双活数据中心,仲裁节点三机房部署;异地灾备单独启实例与本地实例进行数据库间同步,也可以将本地备份文件T+1恢复到异地灾备。
数据一致性
分布式数据库大多都是通过获取全局时钟时间戳,采用二阶段提交,可以实现一致性的保证,分库分表架构对于事务的一致性,需要应用层考虑,比如通过合理的分区键设计来规避。部分分布式数据库对于跨节点事务目前还是实现的最终一致,对于全局一致性读,一般通过引入类似全局时间戳的组件统一管理全局事务,在数据库选型时可以重点关注厂商对这一块的实现。如果目前暂时无法提供全局一致性读的分布式数据库,对于要依赖分布式事务“中间状态”的业务,优先进行业务改造进行规避,其次通过合理的数据分片设计让其在单节点内完成。
数据分析
分布式数据库,多采用存算分离架构。针对数据分析场景,需要对数据从下层存储节点上移到计算节点,这对分布式数据库提出了更高的要求。一方面可通过算子下推等技术,减少需传输到计算节点的数量;一方面针对汇聚后的结果需要通过流式处理等方式,规避诸如OOM的问题;此外也可采用如MPP等并行处理技术,加速数据分析过程。
2).选型过程问题痛点分析
在选型过程中,会遇到来自以下几方面的痛点。
一是由于分布式数据库整体架构还比较新,也是近十年来逐步发展完善的。针对新型架构的诸多特点,包括厂商和用户还都在不断摸索积累之中,还需要有个长期实践的过程。此外,新架构也需要有个逐步成熟完善的过程。
二是大量产品来自国内数据库厂商,其发展周期相对较短,还需要在产品成熟度、稳定性、周边生态等方面不断完善。对于用户来说,一方面需面临产品多、技术栈多的现状;另一方面还需面对成熟度不足等问题,存在较多痛点。
三是近些年金融行业发展迅速,各种新的业态产品不断涌现,这些对作为底层数据基础的数据库也提出了更高的要求。
四是随着内外部环境的变化,自主可控等问题受到更多的关注。金融行业首当其冲,针对上述问题也需要引起足够的重视。在数据库选型问题上,也需要考虑这一因素。这无疑对用户选择带来一定困难。

2. 数据库选型技术架构
1).分布式路线分析
针对分布式数据库的发展路线,大体可分为两种:
分布式中间件
这种架构是从中间件路线演进而来。其采用存储与计算分离架构,底层采用标准单机数据库,副本间基于数据库主从复制机制。上层承担计算,并可将部分计算下推到存储节点执行。这种架构在分布式事务、全局MVCC等方面,往往存在一定难点,各厂商也有各自解决之道。
原生分布式
这种架构正是受到Google论文影响演进而来。其采用存储与计算分离架构,底层采用单机库(不一定是关系型),副本间采用分布式一致性协议完成复制,支持多数派提交。上层承担计算,并可将部分计算下推到存储节点执行。
2).重点需求满足情况
针对上述遇到的痛点,两类产品实现逻辑也所有不同。

3). 路线场景分析
从数据使用场景来讲,可大致按下面进行划分:

针对不同的场景,不同分布式数据库路线产品各有所长。
针对事务类场景下,强调高并发联机交易、对分析能力要求不高的场景比较适合分布式中间件路线产品。
针对事务类及事务/分析混合类场景,既要满足常规联机交易场景的同时,还需满足分析类的一部分能力,这种情况比较适合原生分布式产品。基于原生分布式的 HTAP 数据库,用一个数据平台应对规模化交易和实时分析,提升业务决策的时效性,降低数据技术栈的复杂性,越来越多的混合负载需求推动了 HTAP 在金融场景的落地。
3. 金融业 HTAP 应用场景实践
1). 金融场景下 HTAP 的分析
在金融企业数字化转型的过程中,各类业务对“海量、实时、在线”的数据需求变得愈发迫切。在金融企业运营场景中,实时推荐、精准营销是企业提升竞争力的一大因素。在企业风险控制场景中,实时风控、反欺诈等业务开展可以更早地识别和阻断风险可以让企业减少损失,HTAP正是基于上述背景诞生出的需求,为各类实时数据处理需求提供了解决方案。
2).某金融用户 HTAP 的架构设计和实践
随着金融市场同业业务的蓬勃发展,业务部门对于交易数据的实时统计分析和展现有了急切的需求。基于大数据技术栈的 T+1 报表模式,已无法满足业务部门通过实时分析交易发生情况来防范风险以及提供决策的需求,迫切的需要找到一种能让数据实时变现的解决方案。结合金融行业特点,在技术选型过程中,重点考察待选产品如下能力:包括承载业务复杂查询处理、海量数据容量存储、应用透明无侵入、开发协议可适配及混合负载下的表现等。经过测试,选择 TiDB 作为基础数据库平台。通过一段时间上线使用,满足业务场景,基于其 HTAP 的特性,打造金融市场实时数据平台,目前已投产了灵活报表和交易对手分析等功能。整个处理流程包括:
Flink 消费交易系统产生的实时增量数据,对部分事实表进行拉宽处理并写入TiDB
维表和其他明细表直接写入 TiDB
BI 工具直接连接 TiDB,提供秒级的实时计算和分析能力

这一案例中,构建千万及以上数据规模、超过五张表的复杂关联实时查询能力,让业务人员在极短的时间内(大部分报表执行时间为几十到几百毫秒、个别报表秒级别)获得实时交易的详情。
3).未来 HTAP 的场景发展
实时数据处理技术还以某些具体的应用场景为主,从现状来看以事件驱动类、流式管道数据计算类为代表的场景,已经开始使用 HTAP 场景的。未来随着 HTAP 计算能力进一步的提升,实时全量数据的计算将带来更多场景。

4. 面向未来的架构趋势
1).云原生
从未来的发展趋势来看,云方向是一个大的趋势。

从上图可见,云数据库的发展经历了几个阶段,从云托管、云服务、云原生之路。
云托管,是最接近传统数据库系统的部署模式。本质是将原本部署于IDC机房内物理服务器上的传统数据库软件部署在了云主机上。这种模式下,云平台提供诸如高可用、异地灾备、备份恢复、数据安全、SQL审计、性能优化和状态监测等企业级数据库管理能力,用户可减少运维投入即可享受之前同等的服务水平。
云服务,之前的托管架构中,受限于传统数据库架构的局限,未能完全发挥云计算的优势。在诸如弹性扩展、高性能、高可用等方面,均有不足。到了云服务时代,充分利用云基础设施的底层能力,提供定制化的数据库产品。
云原生,与之前的云服务架构不同,这一阶段产品将更为充分地利用云基础设施的能力,通过多层资源解耦,可享受云带来的弹性扩展、按需供给、超大规模能力。真正做到了数据库与云的深度结合。从长期来看,金融机构逐渐把业务和技术向云原生演进,实现传统应用迁移上云和云原生改造是重要的方向。在这个过程中需要考虑分布式数据库对 K8s、微服务应用的支持,提供高效、弹性调度能力,同时需要兼顾开发运维和敏捷度。
2).多云方向
云作为未来主流的资源供给方式,多云必然是企业不得不考虑的问题。多云通常指金融机构同时采用多种不同的云环境组合来满足业务需求的多样性和金融业监管的要求。如何围绕数据打造面向未来的多云 IT 架构,满足在多云之间提供数据服务能力,摆脱单一供应商的弊端,是必须考虑的问题。多云架构对分布式数据库的考察重点聚焦于跨地域、跨公有私有云、跨本地 IDC 和 K8S 的部署、服务提供与统一运维能力等。

我认为,在我与布莱恩·吉尔伯的访谈中,“双重交易”以及“日本对美国长期国债期货的影响”是最有意思的两个部分,然而这两个话题并没有提供交易技能上的真知灼见。访谈中还有一个发现,这个发现更为实用,那就是吉尔伯提出的主要告诫之一是,不要错用经纪公司的研究报告。吉尔伯发现,经纪人及其客户都可能把经纪公司长期的研究报告用于他们短线的交易。即便研究报告本身是正确的,但是对信息的误用也会导致交易的亏损。

显然,吉尔伯取得交易成功的关键因素在于,在交易中具有灵活性,抑制太强的自尊心和过强的自我意识,能够坦然认错。谈到成功交易者的观点,他这么说:“我会追随成功的交易者。当然,我会有自己的观点,并不会盲从,别人的观点不能决定我的交易行为。有时,我认为自己的观点是正确的,我就会始终坚持。

我对赚钱采用何种方式并不挑剔。我观点的对错并不重要,能否赚到钱才是重要的。”

最后,吉尔伯对于交易遭受连续亏损的应对方法是被许多交易者借鉴、引用的。他建议“忘记过去所有的不好,一切重新开始,从此越做越好”。全部清仓能让交易者头脑更为清楚。如果清掉的头寸对交易者仍然具有吸引力,那么当交易者恢复信心后,总有再次进场建仓的机会。

宋辽金的货币和“生辰纲”的“纲”是啥

看《并存继逝的王朝》,看到两个挺有趣的经济史细节:

一是这段时间里宋朝铸钱数量很大,而辽金西夏铸钱规模都不行,所以这三朝境内也主要流通宋钱。但回鹘大理不用宋钱,回鹘有自己的银币,也有帛;大理用马和宋朝交易。

二是“纲”是唐宋通用的交通运输单位。官制米一万石一纲,铜钱两万贯一纲,金两万两一纲,银十万两一纲。所以梁中书给蔡京宋的生辰纲是制式礼物,用官府公开的方法运输或许反而更安全。杨志在这个问题上的自作聪明,可能说明他之前打翻花石纲也不是偶然的。。。。。。

#读书##冷知识##经济史#


发布     👍 0 举报 写留言 🖊   
✋热门推荐
  • 智己L7 SP性能版搭载Öhlins 高性能赛用级悬挂系统,悬架高低软硬可调,阻尼提升20-50%,在激烈驾驶过程中游刃有余。 #星推官计划# #好物推选官#
  • 】但也是像李东说的那样,看电影的时候,任何思考都显得陌生而奇怪,只是在感受弗鲁米嫩塞队中场梅洛(Felipe Melo,83.06.26):我相信卢卡库会回到自
  • 顶礼是应缘于三宝的心专心专一并三门万分虔诚的前提下如理行持。故顶礼是一种净业障、增诸善之具殊胜善巧的无比修持。
  • 有本事是一回事,能否成功是另外一回事,得看你选择什么样的环境,跟哪些人在一起,能否很好地应对周围的冲突,如何赢得足够的支持,要多和成功的人交友,借鉴他们的方法;
  • 其实,很多蒙古兵都对郭宝玉不服,不知他是否是纸上谈兵,直到成吉思汗亲征撒马尔干(今天的乌兹别克斯坦)时,郭宝玉才用实力征服了战友。腹罨疗法 #历史云讲堂# 12
  • 或许,这绝美的遇见,只能靠一线网络维系,或许你能给我的也只是回忆,但于我而言,这些就够了,那些萦绕在心头的温暖,那些刻骨铭心的惦念,都可以用一生去回忆, ​时
  • 爸爸为了养家和给你挣尿裤,在特殊时期更加忙碌,但也在努力争取多一些时间回家看我们,与你有更多的亲子陪伴时间,他一回来就笑呵呵抱着你、给你喂水、带着你在屋子里溜达
  • ➍、稳心颗粒【作用】:益气养阴,定悸复脉,活血化瘀。➏、心灵丸【作用】:活血化瘀,益气通脉,宁心安神。
  • 2.那随着我对饭圈的了解和内娱的认知,我觉得她反而是最真实的,尤其是当我看到有人把吃说成闻,我一切的印象都变了,我反而觉得迪丽热巴才是最真实的,她本人到底如何我
  • #爱用物分享##2023趁早效率手册##疯狂动物城##盲盒##lulu猪#真的lui了,过敏性鼻炎犯了,又被封校不能回家还紧急通知做核酸,我的婴儿柔肤纸和药不能
  • #芜湖江水平装修[超话]##芜湖[超话]##芜湖[超话]#186㎡欧方式风+轻奢风混搭,时尚奢华有品味客厅整个空间以高级灰为主基调,搭配乳白色布艺沙发以及橘红
  • #蘑菇街双十一直播购物节##蘑菇街免单1分钟# 双十一钱包告急?【20点开抢汇总】啊菌给你们整理出来了,快看看有没有想要的[哇]——点zan·揪30个宝子平分5
  • #每日一善[超话]##阳光信用[超话]# 本人极好[鼓掌]勿〔快 车专〕[作揖][作揖]较好[抱一抱]极好[抱一抱]极好以上[抱一抱]公益[hu],其它不[惠
  • #阳光信用[超话]##阳光信用# [太阳]#每日一善# [太阳]【互动必hui】我们因梦想而伟大,所有的成功者都是大梦想家:在冬夜的火堆旁,在阴天的雨雾中,梦想
  • 在《阴骘文》中,“阴骘”具有天人感应的含义,要求人们自已多积阴德阴功,就是说行善做好事不要到处张扬,只是悄悄的去做。即使个人独处而别人不知晓的情况下,也不做坏事
  • 第四位是海底捞的当家人张勇,说到海底捞这个餐饮品牌相信很多人都不陌生,现在海底捞的门店开遍了祖国各大一二线城市,虽然海底捞的定价并不便宜,但仍然备受消费者欢迎,
  • 这样的人可以称为温暖和天使了吧,文字的力量还是强大的,短短几语,隔着纸张都能触到那种温暖,缱绻几天,还要再拿出来读的温暖,我想我是遇到的,只是这样的人,活在书里
  • 每次在给他写信的时候 就是有一大堆话想说 但总想留一些给下一次 和自己说一定还会有下一次的 想念和爱意叠加[悲伤][悲伤][悲伤]回想从喜欢他到现在 好像就是
  • 我不知道你还要继续让他失去什么,是他如火一般热烈的心脏吗,我不知道。我不知道你还要继续让他失去什么,是他如火一般热烈的心脏吗,我不知道。
  • #第五人格共号[超话]# 重新找个能打排位的共号 ios44金多联动多限定 有精修地堡 二字id 特殊头像框 大情号 (图里少宇宙女巫 太宰治 茶话会)目前人五