期刊分享~
出版社:Hindawi
检索情况:SCI(E)检索
是否OA:OA期刊
影响因子:2.2+
期刊分区:中科院4区,JCR3区
审稿周期:1-2个月左右
截稿日期:2021/12/31
收稿方向:电子医疗服务;健康监测;个性化医疗的智能代理和系统;医疗保健服务中的大数据管理系统和数据分析;个性化健康本体和模型
#学术期刊论文发表[超话]##毕业论文##职称论文#

#BBD即时资讯# 6月12日,清华大学五道口金融学院清华—康奈尔双学位金融MBA 2020级师生到访参观BBD,围绕大数据在资本市场的创新应用展开交流。

BBD董事长曾途介绍了公司基于丰富的数据资源、完善的分析技术、独立的数据动态本体平台和多维量化分析能力,精准发现和解决各行业痛点问题,用大数据支撑决策。

BBD资本市场业务负责人分享,资本市场作为直接融资的支撑体系,是经济高质量发展的“助推器”。国家推出一系列政策促进资本市场不断开放与发展,同时,也面临市场乱象频发等监管痛点。

BBD资本市场业务团队依托大数据、人工智能技术,对企业的全生命周期进行全面刻画和精准分析,以“五位一体”产品体系对接资本市场需求,产品场景全覆盖多空双向业务,实现风险的快速有效识别,助力资本市场数字化转型。目前,团队已长期服务于证监会、深交所等监管机构,并可助力资管机构挖掘优质企业、甄别问题企业,用新兴技术赋能传统资管业务,提高资管效率。

论法律大数据“领域”的构建
法治日报 2020-08-19
  □ 王禄生

  一、问题的提出:法律大数据“领域理论”的现状与不足

  (一)法律大数据领域本体论有待构建

  由于对法律大数据的领域本体论反思还较为缺乏,因此学界一般认为,法律大数据就是在法律领域中使用的具备“4V特征”的数据集。在实践中,出现了片面强调大体量、全样本、高速度、实时性、多种类的观点,甚至人为设定标准来固化地区分“大数据”与“小数据”,如PB量级才是法律大数据、没有全样本不是法律大数据等。实际上,“4V特征”并不完全适用于法律领域。因此,要推动法律大数据的研究与应用,必须构建法律大数据领域本体论,挖掘属于法律的“领域特征”。

  (二)法律大数据领域认识论有待更新

  由于缺乏对领域认识论的充分反思,当前法律大数据应用较多采取基于大数据分析的知识发现范式。具体而言,就是借助数据挖掘技术从大量判决书、案件卷宗等非结构化、半结构化数据中发现法律规律并加以应用的过程。此种认识论在大数据与大算力的支撑之下取得了一定的成效,但却与法律领域的特殊需求不完全匹配。这体现在:其一,演绎思维冲突;其二,因果思维冲突;其三,说理思维冲突。可见,为了避免在法律大数据应用中方法论与法律思维的冲突,就势必需要更新法律大数据领域认识论。

  (三)法律大数据领域方法论有待优化

  由于在本体论与认识论上套用了大数据的一般分析框架,当前法律大数据在方法论上表现为“通用技术+通用流程”的特点,也就是在数据获取、预处理、训练、解释、应用等的常见步骤中使用通用的大数据分析技术、算法与模型,没有考虑技术在法律领域的兼容性,更没有针对法律“领域知识壁垒”而进行专门的技术与流程优化。

  二、领域本体论的构建:法律大数据的“3A特征”

  (一)本体论视角下法律大数据概念的厘清

  “法律大数据”本体论的构建首先需要实现“法律领域中大数据”(big data in law)向“法律领域的大数据”(legal big data)转变。换言之,在本体论的视角下,“法律大数据”是指在立法、执法、司法等法律过程中形成或依法获取的,既在一定程度上具备大数据的通用特征,又满足适配性、正确性和易变性的领域需求,必须结合法律领域的特定算法与模型来实现辅助法律决策、优化法律过程目标的数据集。上述概念有三个关键点:其一,法律大数据是“领域大数据”而非“领域中的大数据”;其二,除了通用领域的部分特征之外,法律的特殊性使得法律大数据具有特定的领域特征;其三,法律大数据的领域特征决定了通用大数据分析工具也需要结合法律领域进行优化。

  (二)本体论视角下法律大数据的领域特征

  法律领域的特殊性决定了法律大数据除了部分具有通用大数据的“4V特征”之外,还具备从属于法律领域“3A特征”。

  第一,法律大数据的适配性(Adaptability)。与其他领域强调样本的“大与全”相比,法律大数据特别强调样本的适配性,而并不必然要求大量的全样本。第二,法律大数据的正确性(Accuracy)。在通用领域中,样本大数据质量的高低判断标准通常是纯技术的形式判断,比如数据缺失、数据重复、数据格式不统一等。一般而言,研发者并不需要对样本数据进行“对”与“错”的实质价值判断。与之形成鲜明对比的是,在法律领域中,作为各种算法训练基础的法院判决则很可能存在对错之分,法律大数据训练样本质量的高低判断除了借助技术逻辑进行形式审查之外,还需要依托专业逻辑——基于法学知识的专业判断。第三,法律大数据的易变性(Astability)。对于通用领域而言,数据的价值是相对稳定的,可以通过多次挖掘进行深度的运用,而对于法律领域而言,部分数据具有易变性,情境一经调整,原有数据将失去挖掘价值。

  三、领域认识论的更新:法律大数据的知识发现逻辑

  (一)“轻量级理论驱动”的法律大数据认识论

  大数据认识论排除理论预设、以数据分析为前置,相信只要拥有足够数据,数据本身就能够说明问题。然而,数据产生于更广泛的知识生产操作,每个学科都有自己数据想象的规范和标准,就像每个领域都有自己被接受的方法和实践的演进结构一样。完全脱离理论的大数据挖掘势必会在数据到结构化知识再到因果推断之间形成鸿沟。作为对原有大数据认识论的反思,科学界提出了“轻量级理论驱动”(lightweight theory-driven)的认识论,优化单纯以数据驱动的认识论。

  法学是社会科学的重要领域,具有鲜明的领域特殊性。考虑到通用大数据认识论与法律领域因果思维、演绎思维等方面的不相兼容性所造成的负面影响,结合法律领域特殊性的法律大数据认识论反思就显得至关重要。这就需要更新通用大数据数据驱动的经验主义认识论,构建结合法律领域特殊性的“轻量级理论驱动”法律大数据认识论,将法学理论结构映射到法律大数据的知识发现过程中。具体而言,可以从三个方面展开:首先,通过法学理论构建法学领域知识本体,明确法律大数据挖掘的结构、关系和边界;其次,通过法学理论确定适合特定目标的法律大数据子集;最后,将法学理论作为法律大数据挖掘结果的解释性框架。

  (二)新认识论驱动下的法律大数据知识发现逻辑

  在“轻量级理论驱动”的法律大数据认识论的指导下,法律大数据知识发现的逻辑也会产生相应的调整。“轻量级理论驱动”认识论指导下的法律大数据知识发现就是结合法学理论,对符合“3A特征”需求的法律大数据进行知识表示、知识抽取和知识输出的过程。具体而言,就是针对不同的主题(如类案推荐、办案证据辅助)进行知识本体构建,在知识本体构建的基础之上从各类大数据集抽取信息、训练模型、形成法律知识、装载到法律大数据仓库中并根据用户需求输出的过程。因此,法律大数据应用通常就是一个从某种法律数据中获取实质性的、有意义的知识(见解)的文本、数据挖掘过程。

  四、领域方法论的优化:法律大数据的知识壁垒及其应对

  法律大数据的“3A特征”以及“轻量级理论驱动”的知识发现方式相结合,形成了法律大数据在方法论上面临的“领域知识壁垒”。因此,在法律大数据“领域理论”的构建过程中,就必须充分了解“领域知识壁垒”的成因,进而有针对性地提出应对之策。

  (一)法律大数据“领域知识壁垒”的表现

  在技术进步话语所凸显的技术瓶颈之外,法律大数据分析的每个环节还面临明显的“领域知识壁垒”。

  首先,在法律知识表示中法律领域本体的构建需要大量法律专业知识的支撑。对此,我们可以从三个方面展开:其一,法律大数据的知识表示通常是在法律专家的知识之上建立的专家规则;其二,不同主题的知识本体有着不同程度的差异;其三,法律的领域本体还具有维度多、属性多、要素多的复杂性特点。

  其次,在法律知识发现的数据获取和数据标注环节也离不开专业知识。通用大数据领域,常人使用常识就可以实现高质量、高效率的样本标注。而在法律场景中,标注者不仅要有扎实的专业知识积累,还需要了解案件的整体事实和法律背景,从而做出准确的标注。更为重要的在于法律领域的标注还面临标准统一性的难题。不同标注人员,即使都具备深厚的法学专业知识,其对同一标注对象也可能会形成不同的判断。可见,法律领域的特殊性使得数据的获取难度和成本要大大高于通用场景。

  最后,在法律知识应用环节也存在着专业知识障碍。一方面,法律人,尤其是实务部门一线工作人员由于技术知识背景的缺乏,对技术逻辑十分陌生,不清楚技术能够解决哪些业务问题,也就无法向研发主体提出准确的大数据需求;另一方面,法律人提出的同案同判、财产保全风险预警等诸多业务需求对于技术人员而言也往往具有一定的理解障碍。横亘在法律大数据技术研发人员面前的鸿沟往往并非技术的瓶颈而恰恰可能是法律人的“常识”。

  (二)法律大数据“领域知识壁垒”的应对

  面对法律大数据的“领域知识壁垒”,需要在领域方法论上予以应对,通过推动法学与技术的有机融合,提升法律人在法律大数据研发中的地位。与此同时,结合法律大数据的领域特征,开展专有的法律大数据技术创新,而不是把法律大数据视作通用大数据技术在法律领域的平移运用。更为重要的还在于,要转变法学人才培养的模式,打造法律知识工程师的培养体系,以形成破除法律大数据“领域知识壁垒”的有生力量。


发布     👍 0 举报 写留言 🖊   
✋热门推荐
  • 分享一下2021最后的美照和2022新年的感悟: 1.以为隔壁BM领导真的将奖金一文不收的分给员工,形象顿时高大了许多,真像来的措手不及[微笑] 2.和我说“
  • 迷失在回家路上 杜益茂 谁不热爱故乡,谁不对故乡的村落和道路了如指掌。我的故乡在灞桥务庄,村南一二里就是香湖湾,一条大路穿过务庄和香湖湾直通灞桥新筑,周围一
  • 今天给大家讲解一下关于莆田鞋的一些套路,如果不知道请认真看完!!!! 1、产地:目前国内生产高仿鞋的地方 福建莆田、福建晋江、广东、青岛。其他地方基本都是
  • 刚得知普通话可能在19号考 19号早上有课 下午还有zzb的送旧迎新总不能不去吧 晚上有随舞有好几首我会的划曲不想错过[泪][泪] 20号有俊的线下肯定要去的
  • 我的朋友阿明刚谈恋爱的时候,我劝他学会装聋作哑扮傻充愣,不然就会吵不完的架。他毫不犹豫的告诉我,他不会跟她吵的,而且他女朋友脾气也很好。他说这话时表情对我是三分
  • 【深圳所有封管控区求助暖心热线都在这,家有老人小孩必看![思考]】近日,深圳多区接连发布通告,多个区域被划定为封控区、管控区、防范区,区域内管控措施按相关防疫规
  • 10小时睡眠带来满心疲惫 背后原因竟是它
  • 【一直走一直梦一直疯一直没停留】 很多人说我们高科技离生活太遥远了! 你们军事工业制造技术非常不接地气! 好的呢!我们量子面膜就研发结束了! 北京掌海环保科技联
  • “#33岁男子发朋友圈炫耀娶两个媳妇#。”震惊!近日,江苏江阴。一男子在微信连续发了两次朋友圈,称自己将在本月2月22日22点和2位“爱妻”举行结婚典礼,以后就
  • 张庭,节目自爆上升巨蟹 ,卯时至辰时, 感觉辰时更靠谱#张庭[超话]# 命主月亮互溶7r土星,月火以对分姿态互溶 月火土『大团结』绑定 火星5R/10R,
  • 二月份过去了,有收获也有遗憾,不过又开始一个新的选择和生活,渐渐地,我也成了原来未曾想过的人,虽然路一直在变,但我还是依然是那个想要变得更好的我,我还是有很多想
  • 全剧最爱沈眉庄 “宁可枝头抱香死,不曾吹落北风中” 她是真正的大家闺秀 是对甄嬛全心全意爱护的眉姐姐 也是对皇上死心后最清醒的惠贵人 更是将爱意浸酒递于温实初的
  • 《人世间》这个大结局,有点过于完美了。 吕川重归六小君子,德宝和春燕也被大家原谅。周秉义没有因胃癌去世,郝冬梅也没有改嫁,两人到了70岁还恩爱如初。   有人
  • #阳光信用##每日一善# 只hui本超较好以上 不要去做一个唠叨的抱怨者,从现在起,要学会自己去化解、去承受。特别烦躁的时候,先保持冷静,看一部开心的电影,喝
  • 一切都变了又好像都没变的样子 路宽了还分了自行车道和机动车道 也平坦了不再是垫着铁板一下雨就有积水的路 两边的小区都还在 一直拆不动的钉子楼还是没拆掉 但那栋盖
  • 可能是巨讨厌现在手头的活 那么大晚上干就很怨念 走之前我还给花换水剪枝就完全不累= =投标真是对身心的双重折磨,我又不当领导 又不求着涨工资,为啥就想正常下班的
  • 别看 看就是在摸鱼 瘦的时候还是很瘦的 咱就是说一个下头的大动作 我连夜清空了我对柚子那些心思 对他的爱说不出口了 听说三分之一的人都有这种病 我从小就头疼 吃
  • 汪小菲不断实锤自己…于是有人评论:女人有了孩子还坚持离婚…可见经历了多么绝望的事…于是大家站在了大S这边…同理李靓蕾生了3个…还是被一些人在网暴着…还有人还希望
  • 不见故人弥有情,一见故人心眼明。 忘却问君船住处,夜来清梦绕西城。 —(宋)徐积《赠黄鲁直》 徐积的年龄略长于黄庭坚,但对黄的才学很推重,这首诗就是他写赠给黄庭
  • 致那些藏起乳房的女孩 这几天看到一个热搜话题“女生会因为自己的汗毛多而自卑吗?” 让我极想推荐这部纪录片给大家——《寻找乳房》 “女性从小就会碰到美丑、形