#蔡徐坤#在#奔跑吧#中的#对他自己的一份要求#令我开始留意他,他的#八字#不错,行70年好运加#财运#,但刚巧今年是他一生人中的10年衰运的开始,幸好在2022年之前,他的#流年运#仍是好运,只是上半发展较慢,下半年才有明显进步。一到2022年后的6年,事业便会明显慢下来,更在2021年开始会因名气或长辈而有是非,宜多加忍耐。身体方面,今年开始会有#腹部胃肠消化系统#长期毛病,明年会较为严重,宜多加留意!

论法律大数据“领域”的构建
法治日报 2020-08-19
  □ 王禄生

  一、问题的提出:法律大数据“领域理论”的现状与不足

  (一)法律大数据领域本体论有待构建

  由于对法律大数据的领域本体论反思还较为缺乏,因此学界一般认为,法律大数据就是在法律领域中使用的具备“4V特征”的数据集。在实践中,出现了片面强调大体量、全样本、高速度、实时性、多种类的观点,甚至人为设定标准来固化地区分“大数据”与“小数据”,如PB量级才是法律大数据、没有全样本不是法律大数据等。实际上,“4V特征”并不完全适用于法律领域。因此,要推动法律大数据的研究与应用,必须构建法律大数据领域本体论,挖掘属于法律的“领域特征”。

  (二)法律大数据领域认识论有待更新

  由于缺乏对领域认识论的充分反思,当前法律大数据应用较多采取基于大数据分析的知识发现范式。具体而言,就是借助数据挖掘技术从大量判决书、案件卷宗等非结构化、半结构化数据中发现法律规律并加以应用的过程。此种认识论在大数据与大算力的支撑之下取得了一定的成效,但却与法律领域的特殊需求不完全匹配。这体现在:其一,演绎思维冲突;其二,因果思维冲突;其三,说理思维冲突。可见,为了避免在法律大数据应用中方法论与法律思维的冲突,就势必需要更新法律大数据领域认识论。

  (三)法律大数据领域方法论有待优化

  由于在本体论与认识论上套用了大数据的一般分析框架,当前法律大数据在方法论上表现为“通用技术+通用流程”的特点,也就是在数据获取、预处理、训练、解释、应用等的常见步骤中使用通用的大数据分析技术、算法与模型,没有考虑技术在法律领域的兼容性,更没有针对法律“领域知识壁垒”而进行专门的技术与流程优化。

  二、领域本体论的构建:法律大数据的“3A特征”

  (一)本体论视角下法律大数据概念的厘清

  “法律大数据”本体论的构建首先需要实现“法律领域中大数据”(big data in law)向“法律领域的大数据”(legal big data)转变。换言之,在本体论的视角下,“法律大数据”是指在立法、执法、司法等法律过程中形成或依法获取的,既在一定程度上具备大数据的通用特征,又满足适配性、正确性和易变性的领域需求,必须结合法律领域的特定算法与模型来实现辅助法律决策、优化法律过程目标的数据集。上述概念有三个关键点:其一,法律大数据是“领域大数据”而非“领域中的大数据”;其二,除了通用领域的部分特征之外,法律的特殊性使得法律大数据具有特定的领域特征;其三,法律大数据的领域特征决定了通用大数据分析工具也需要结合法律领域进行优化。

  (二)本体论视角下法律大数据的领域特征

  法律领域的特殊性决定了法律大数据除了部分具有通用大数据的“4V特征”之外,还具备从属于法律领域“3A特征”。

  第一,法律大数据的适配性(Adaptability)。与其他领域强调样本的“大与全”相比,法律大数据特别强调样本的适配性,而并不必然要求大量的全样本。第二,法律大数据的正确性(Accuracy)。在通用领域中,样本大数据质量的高低判断标准通常是纯技术的形式判断,比如数据缺失、数据重复、数据格式不统一等。一般而言,研发者并不需要对样本数据进行“对”与“错”的实质价值判断。与之形成鲜明对比的是,在法律领域中,作为各种算法训练基础的法院判决则很可能存在对错之分,法律大数据训练样本质量的高低判断除了借助技术逻辑进行形式审查之外,还需要依托专业逻辑——基于法学知识的专业判断。第三,法律大数据的易变性(Astability)。对于通用领域而言,数据的价值是相对稳定的,可以通过多次挖掘进行深度的运用,而对于法律领域而言,部分数据具有易变性,情境一经调整,原有数据将失去挖掘价值。

  三、领域认识论的更新:法律大数据的知识发现逻辑

  (一)“轻量级理论驱动”的法律大数据认识论

  大数据认识论排除理论预设、以数据分析为前置,相信只要拥有足够数据,数据本身就能够说明问题。然而,数据产生于更广泛的知识生产操作,每个学科都有自己数据想象的规范和标准,就像每个领域都有自己被接受的方法和实践的演进结构一样。完全脱离理论的大数据挖掘势必会在数据到结构化知识再到因果推断之间形成鸿沟。作为对原有大数据认识论的反思,科学界提出了“轻量级理论驱动”(lightweight theory-driven)的认识论,优化单纯以数据驱动的认识论。

  法学是社会科学的重要领域,具有鲜明的领域特殊性。考虑到通用大数据认识论与法律领域因果思维、演绎思维等方面的不相兼容性所造成的负面影响,结合法律领域特殊性的法律大数据认识论反思就显得至关重要。这就需要更新通用大数据数据驱动的经验主义认识论,构建结合法律领域特殊性的“轻量级理论驱动”法律大数据认识论,将法学理论结构映射到法律大数据的知识发现过程中。具体而言,可以从三个方面展开:首先,通过法学理论构建法学领域知识本体,明确法律大数据挖掘的结构、关系和边界;其次,通过法学理论确定适合特定目标的法律大数据子集;最后,将法学理论作为法律大数据挖掘结果的解释性框架。

  (二)新认识论驱动下的法律大数据知识发现逻辑

  在“轻量级理论驱动”的法律大数据认识论的指导下,法律大数据知识发现的逻辑也会产生相应的调整。“轻量级理论驱动”认识论指导下的法律大数据知识发现就是结合法学理论,对符合“3A特征”需求的法律大数据进行知识表示、知识抽取和知识输出的过程。具体而言,就是针对不同的主题(如类案推荐、办案证据辅助)进行知识本体构建,在知识本体构建的基础之上从各类大数据集抽取信息、训练模型、形成法律知识、装载到法律大数据仓库中并根据用户需求输出的过程。因此,法律大数据应用通常就是一个从某种法律数据中获取实质性的、有意义的知识(见解)的文本、数据挖掘过程。

  四、领域方法论的优化:法律大数据的知识壁垒及其应对

  法律大数据的“3A特征”以及“轻量级理论驱动”的知识发现方式相结合,形成了法律大数据在方法论上面临的“领域知识壁垒”。因此,在法律大数据“领域理论”的构建过程中,就必须充分了解“领域知识壁垒”的成因,进而有针对性地提出应对之策。

  (一)法律大数据“领域知识壁垒”的表现

  在技术进步话语所凸显的技术瓶颈之外,法律大数据分析的每个环节还面临明显的“领域知识壁垒”。

  首先,在法律知识表示中法律领域本体的构建需要大量法律专业知识的支撑。对此,我们可以从三个方面展开:其一,法律大数据的知识表示通常是在法律专家的知识之上建立的专家规则;其二,不同主题的知识本体有着不同程度的差异;其三,法律的领域本体还具有维度多、属性多、要素多的复杂性特点。

  其次,在法律知识发现的数据获取和数据标注环节也离不开专业知识。通用大数据领域,常人使用常识就可以实现高质量、高效率的样本标注。而在法律场景中,标注者不仅要有扎实的专业知识积累,还需要了解案件的整体事实和法律背景,从而做出准确的标注。更为重要的在于法律领域的标注还面临标准统一性的难题。不同标注人员,即使都具备深厚的法学专业知识,其对同一标注对象也可能会形成不同的判断。可见,法律领域的特殊性使得数据的获取难度和成本要大大高于通用场景。

  最后,在法律知识应用环节也存在着专业知识障碍。一方面,法律人,尤其是实务部门一线工作人员由于技术知识背景的缺乏,对技术逻辑十分陌生,不清楚技术能够解决哪些业务问题,也就无法向研发主体提出准确的大数据需求;另一方面,法律人提出的同案同判、财产保全风险预警等诸多业务需求对于技术人员而言也往往具有一定的理解障碍。横亘在法律大数据技术研发人员面前的鸿沟往往并非技术的瓶颈而恰恰可能是法律人的“常识”。

  (二)法律大数据“领域知识壁垒”的应对

  面对法律大数据的“领域知识壁垒”,需要在领域方法论上予以应对,通过推动法学与技术的有机融合,提升法律人在法律大数据研发中的地位。与此同时,结合法律大数据的领域特征,开展专有的法律大数据技术创新,而不是把法律大数据视作通用大数据技术在法律领域的平移运用。更为重要的还在于,要转变法学人才培养的模式,打造法律知识工程师的培养体系,以形成破除法律大数据“领域知识壁垒”的有生力量。

姐妹们好啊,这里是炽寒,可以叫我寒寒[羞嗒嗒]
一个学艺不精的做图渣渣,爱好毁图,寒寒正在努力进步,希望有一天可以升级为做图菜鸟[允悲],本人性格较为欢脱,喜欢交朋友,欢迎姐妹们和我皮啊[doge]
抱我的图嗷一声就好,二转记得艾特我哈
有关必回,欢迎扩列! 下面给大家附上我最近毁的三张图片[给你小心心]


发布     👍 0 举报 写留言 🖊   
✋热门推荐
  • 团姥姥说:你悠着点,别晒成憨力(这里的憨力是小区里的一个大爷,人特别好,但是这个名字是团姐起的[允悲]所以就这样一直叫了,当然只有我们自己知道这个)#中海匯德里
  • 总觉得不应该就这样结束~~好想有一个番外海底婚礼“如果以后有风吹动我的头发,我知道是你来看我了,你要记得我,我也会永远记得你,自在如风的纪云禾”热巴真的很懂纪云
  • 地耳草、垂盆草、龙胆草是李佃贵教授治疗肝病的基础药,临证中若见肝硬化者,可加鳖甲以软坚散结;若见腹水者,可加泽泻、大腹皮等药物,以利水消肿;若见出血者,可加阿胶
  • 在沿承秩序化城市空间特征的基础上,对层峦叠嶂、叠石成峰的兴文自然景观特征进行抽象描摹。地壳运动造就的地球第三极的青藏高原,目前仍在受到强大的挤压力量向东移动,碰
  • 所以,面对伤痛,我们应学会寻找让我们坚强的理由,而不是被伤痛所征服;当我们徘徊在迷茫失落中,我们应拥有那份拨开云雾的勇气,驰骋未来。 #晚安成都# 你,害怕
  • 和它的故事来来往往是四年,它见证了很多人的青春,没有人永远年轻,但永远有人年轻。”主角团正值青春,但他们没有那么多轰轰烈烈的故事,只是在平平淡淡中相互扶持。
  • 后面说女孩子恋爱后“自己这本书”就不更新了,男生没了了解下去的兴致,解决问题的方法就是“写续集”不断更新,其实面上看也没错,让女孩不断前进呗,当时想着变相鼓励女
  • ——我就是这么说咯,那我肯定不会给你买玫红的,你放心好了。——哎呀对的,我等下图找给你看。
  • 他在微博之夜的造型也是一如既往地让人惊艳,黑色西装搭配蒂芙尼身材针尽显低调奢华,小鹿般灵动和姐妹周一摸看的综艺观后感:‍叶倩文(诠释了如何优雅地老去!低调惊艳的
  • #姬存希官方[超话]##姬存希[超话]##好物分享##姬存希gichancy##姬存希##天然臻萃 奢华养美##姬存希是焦点就要璀璨##为美而来姬存希# 3.8
  • #宗萨仁波切[超话]#我们一切的经历都是心所创造的,记住这一点,就能直接对治憍慢与我执。这并不意味着你不再修持;相反的,就如快要渴死的人无法克制地要大口喝水一般
  • 没过久,比丘告诉笔者他还是学自己原来的“般舟法门”吧,他说,寺院住持告诉他“这个世界不会有佛陀再来”并劝笔者不要上当受骗『为何你不敢相信有真正佛陀在人间?没过久
  • 做好自己,自律生活,可以平凡,但不要平庸,你仍然是那个少年。人生需要努力,也要学会知足,每一段旅程总有他的风景和收获。
  • 他科场失意,骂考官没眼光,看不懂自己的文章;怪老婆不够凶,没有激励他上进:“内子柔懦,无威可畏。少些抱怨,多些理解我们不再是十七八岁的少年那些青涩的时光被我们永
  • 经常来百子湾菜篮子菜市场逛,无意中发现菜市场里有一家烤鸡架店,店名叫新烧鸟研究所~整个菜市场里就他家显得格外高级 店面不大,用餐区环境布置的很像在户外露营⛺️椅
  • 静静说要承包我生日的花花还有津津准备的惊喜让我收了一个星期的快递还有余老师大清早的祝福还有我滴权,好好读书以后好搞定我的摆烂生活吧。生日呀~大家都很爱我哎……胖
  • #拼夕夕探店# ——蜂蜜柚子茶500ml 送勺子 【7.6】两瓶装收藏送杯【15.9】可常温保存一到夏天我就喜欢搞各种喝的,跟我一样不爱喝白开水的姐妹可以安排上
  • 另外,OPPO,realme,一加都发布了150W充电技术,5分钟充满50%,按OPPO的数据,15分钟可充满,这三家同宗同源,分开发布,有点儿意思[偷笑]15
  • 垃圾袋:你会发现人出不去,但是产生的垃圾依然很多图片2.口罩、酒精、消毒洗手凝胶团购菜、测核酸进出消耗很大。不占地方且可以常温保存,吃的时候焯一下水就行了,平常
  • #微博新知博主##留存一些琐碎又快乐的生活碎片# 小章的厨艺生涯惨遭滑铁卢从两个月前就说想自己做包子了今天中午动手了包了p1 已经知道惨不忍睹了就去吃饭了吃完饭