首页 | 本学科首页   官方微博 | 高级检索  
相似文献
 共查询到20条相似文献,搜索用时 62 毫秒
1.
从海量生物医学文献中挖掘变异信息对生物医学复杂疾病研究具有重要意义。在当前的变异实体识别方法中,基于条件随机场模型的方法取得了不错效果并成为主流方法,但存在需要大量特征工程来提升模型性能的缺点。针对此问题,该文提出一种基于字符卷积神经网络的变异实体识别方法CharCNN-CNN-CRF。该方法首先利用一个多窗口大小的卷积神经网络获取字符级别的词表示,然后使用多层卷积神经网络编码上下文信息,最后通过CRF层解码得到整个句子的标签序列。实验结果表明,该方法仅使用随机初始化的字符向量作为输入就能快速、有效地识别变异实体,无需复杂的特征工程。同时也在tmVar和MutationFinder两个数据集上都取得了目前最好的结果(F值分别为88.34%和93.57%)。  相似文献   

2.
人工智能技术的发展推动了医疗领域的智能化,为提升医疗效率、改善医疗水平提供了新的助力。同时,这一新的趋势也催生了海量的电子病历文本,其所蕴含的丰富信息具有巨大的潜在挖掘与应用价值。然而,当前中文电子病历的命名实体识别研究工作并没有全面考虑中文及中文医疗领域的特殊性,而是将面向通用数据集的模型迁移到医疗领域的实体类型中,分析效果较为有限。针对这一问题,该文设计了长短期记忆网络与条件随机场的联合模型并引入BERT模型;在此基础之上,考虑到医疗领域命名实体鲜明的部首特征,通过将部首信息编码到字向量中,并且结合部首信息修改条件随机场层得分函数的计算方式,有效地提升了医疗领域命名实体的抽取能力。通过两项电子病历数据集的实验结果表明,该文提出的模型整体效果略高于通用的实体识别模型,并对疾病诊断等特定类型的实体词的识别效果具有较为明显的提升。  相似文献   

3.
简要案情是公安机关为提高"协同办案系统"录入信息质量,确保信息检索与案件串并工作高效开展而对案情记载的简要描述,其中各类实体间包含了大量与受害者和作案人相关的案情信息.因此,对简要案情文本的深度挖掘是掌握案件始末和分析案情的有效手段之一.简要案情文本中的实体稠密分布、实体间相互嵌套以及实体简称,给准确捕捉案件实体带来了...  相似文献   

4.
旅游领域命名实体识别是旅游知识图谱构建过程中的关键步骤,与通用领域的实体相比,旅游文本的实体具有长度长、一词多义、嵌套严重的特点,导致命名实体识别准确率低。提出一种融合词典信息的有向图神经网络(L-CGNN)模型,用于旅游领域中的命名实体识别。将预训练词向量通过卷积神经网络提取丰富的字特征,利用词典构造句子的有向图,以生成邻接矩阵并融合字词信息,通过将包含局部特征的词向量和邻接矩阵输入图神经网络(GNN)中,提取全局语义信息,并引入条件随机场(CRF)得到最优的标签序列。实验结果表明,相比Lattice LSTM、ID-CNN+CRF、CRF等模型,L-CGNN模型在旅游和简历数据集上具有较高的识别准确率,其F1值分别达到86.86%和95.02%。  相似文献   

5.
知识图谱技术是人工智能技术的重要组成部分,针对政策文件的知识图谱构建和知识提取应用于智慧城市或智慧政策领域。为探索有效的政务公文实体识别方法,标注政务公文里的4类实体,进而采用双向长短时记忆网络和条件随机场的组合方法,对标注的政务公文进行了中文实体识别实验。实验结果表明,文中采用的BiLSTM-CRF方法可以更加准确有效地识别政务公文中的实体。  相似文献   

6.
在生物医学文本挖掘领域,生物医学的命名实体和关系抽取具有重要意义.然而目前中文生物医学实体关系标注语料十分稀缺,这给中文生物医学领域的信息抽取任务带来许多挑战.该文基于深度学习技术搭建了中文生物医学实体关系抽取系统.首先利用公开的英文生物医学标注语料,结合翻译技术和人工标注方法构建了中文生物医学实体关系语料.然后在结合...  相似文献   

7.
植物属性文本的命名实体识别对林业领域的信息抽取和知识图谱的构建起着重要的作用,针对该问题,提出了一种基于双向长短时记忆网络(BiLSTM)、卷积神经网络(CNN)和条件随机场(CRF)模型的植物属性文本命名实体识别方法 BCC-P。分析了植物属性文本的特点,并进行预处理和标注,完成数据集的构建。BCC-P方法通过BiLSTM模型对植物属性文本进行建模,有效捕捉植物属性文本中的上下文语义特征。将获得的特征传递到CNN模型,进一步提取深度特征。最后使用了CRF模型进行植物属性文本的标注,输出在句子序列上最优的标注结果。在植物属性文本语料上的实验表明,该方法的准确率达到了91.8%,因此能够有效应用于植物属性文本的命名实体识别任务。  相似文献   

8.
此文研究涉恐类刑事案件法律文本的中文命名实体识别任务,对涉恐类案件的实体识别对后续的公安对于涉恐类刑事案件信息提取、案情辅助研判、构建公安领域犯罪侦查知识图谱等一系列应用具有重要意义。此文提出了一种基于深度学习的模型来自动识别涉恐刑事案件法律文书中的实体。此文使用从互联网获取的涉恐类刑事案件的裁判文书作为数据集对该模型进行训练,验证,测试。在文中还加入了对比实验,将该模型的实验结果与CRF模型的实验结果进行对比。实验表明,BiLSTM-CRF模型在数据集上能够取得最优的结果,准确率为0.9541,召回率为0.9550,F1值为0.9543。实验结果证明BiLSTM-CRF模型在涉恐类案件法律文书实体识别上的可行性。  相似文献   

9.
10.
冯兴杰  彭洲  张成豪  冯小荣 《计算机应用研究》2023,40(4):1052-1058+1064
实体链接的相关研究主要集中于医疗、生物和新闻领域,但在民航领域的研究较少。因此针对民航领域实体链接任务进行了研究,发现在实体链接中存在实体变体多、歧义少等问题。为解决上述问题,提出了一种基于语义推断的实体链接框架以及一种用于增强框架鲁棒性的负采样策略。在民航领域数据集上进行了对比实验,结果表明所提框架链接效果优于现有基准框架,并通过消融实验,验证了负采样策略的有效性。在负采样策略的作用下,该实体链接框架的Acc@top1高达0.875。  相似文献   

11.
基于CRF和规则相结合的地理命名实体识别方法   总被引:1,自引:0,他引:1  
为了识别文本中海量的地理命名信息,以CRF(条件随机场)模型识别为基础,加入制定的规则,来提高CRF模型识别的召回率,从而提高整体的地理命名实体识别效果。通过选取适合的地理命名实体识别的特征模板,验证特征的有效性以及分析CRF模型识别结果中的未识别实体样本,设计针对未识别实体的规则用以修正识别结果。实验表明,对地名和组织名结合规则进行修正后的F值达到了91.61%和85.74%,有了显著提高。  相似文献   

12.
民航主题Hidden-Web爬虫的设计与实现   总被引:1,自引:0,他引:1  
分析了现今搜索引擎技术在民航主题Hidden-Web获取方面的缺陷,以此为鉴设计并实现了一个民航主题Hidden-Web爬虫.此爬虫使用主题分类等相关技术发现并抓取民航主题Hidden-Web所对应的前台Form,生成相应的Form库,然后利用启发式规则对Form库中的Form进行填写并搜集含有匹配结果的页面集.实验证明此爬虫的性能令人满意且对其它Hidden-Web的应用研究具有借鉴意义.  相似文献   

13.
将命名实体识别技术运用于临床业务系统中,实现对临床医嘱的实体识别,提高临床医疗的工作效率。以上海市胸科医院为研究背景,提出嵌入于临床业务信息系统的临床医嘱实体识别方法。基于历年医嘱数据建立专项语料词库,运用CRF模型进行实时实体识别。随着识别系统上线使用,共处理了8362条医嘱,实验结果表明其准确率较好,在信息支撑度方面提升了医护人员的满意度。医嘱实体识别技术能够有效提高执行效率和医疗质量,也为医疗领域的知识挖掘工作提供了参考依据。  相似文献   

14.
民航空管系统运行质量监督是对空管系统实施风险管理、安全绩效监控和安全管理决策的基础。在分析国内外民航监督检查系统现状和质量监督管理职责基础上,通过对业务流程中的业务逻辑关系和接口信息数据路由的深入分析,研究和设计了系统的部署结构和主要的功能模块。该系统由监督检查工作准备,监督检查实施,监督检查结果跟踪,监督检查结果统计、法规标准查询和数据库管理6大功能模块组成,被分解成32个子板块。自2013年1月该系统在民航局空管局、7个地区空管局和37个空管分局(站)推广试用,极大地提高了监管效率和运行质量监督组织实施的规范化,降低了监管成本和工作量。  相似文献   

15.
随着电子病历在医疗领域的推广应用,越来越多的研究者关注如何高效地从电子病历中抽取高价值科研信息.CHIP2018将中文电子病历临床医疗命名实体识别作为评测任务,即从中文电子病历中抽取三种恶性肿瘤相关的实体.结合三种实体的特点和实体间的依赖关系,提出基于多神经网络协作的复杂医疗命名实体识别方法,并实现了句子级别的模型迁移...  相似文献   

16.
自然手写汉字FS识别法   总被引:3,自引:0,他引:3  
提出联机识别自然手写汉字的FS识别法。在剖析五笔字根结构和编码原则基础上,对五笔字根作适应性改造,将键盘输入技术与联机识别技术有机融合的一种识别体系。在多库识别体系中首次采用层间分级技术。分析和实验表明:充分考虑了自然手写汉字书写习惯和结构特征,系统有较高稳定性。  相似文献   

17.
在生态治理技术领域中,有大量的文献数据没有得到充分的开发与利用.提出基于字嵌入的BiL-STM-IDCNN-CRF模型,结合BiLSTM网络和IDCNN网络获取到的不同粒度的特征.在生态治理技术数据集中取得的F1值为0.7207,均高于现有主流模型取得的成绩.实验验证了字嵌入方法的有效性和模型的性能,同时也为其他文本书...  相似文献   

18.
在各类城市地图中,曲线、区域、符号、标注混杂,通过计算机完全自动地识别是很困难的。本文介绍一种基于人机交互方式的地图识别方法,该方法包括两个算法,即对线条的截断跟踪识别算法,和对线宽的区域生长识别算法。经实验证明,该方法具有识别速度快、对地图扫描图像质量的要求低等特点。  相似文献   

19.
应用化学模式识别对常用溶剂的分类研究   总被引:2,自引:1,他引:1  
根据溶剂的5个选择性参数,xe,xd,xn,xt,xm,对常用的81种溶剂应用化学模式识别方法进行了系统分析。各种模式识别方法(包括谱系聚类方法、非谱系聚类方法、主成分分析法和线性判别分析)的分类结果基本一致,且符合Snyder应用其中3个参数以三角图形式进行溶剂分类的方法。本文结论有助于色谱分析、萃取和其它分离技术的溶剂选择。  相似文献   

20.
本文提出了一种新的基于尺度变换的图象矩表示方法,并在此基础上利用SVD算法抽取了一组有效的图象特征。  相似文献   

设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号