开云优惠体育网页版入口

开云优惠体育网页版入口:脑卒中数据上报方法、装置、存储介质以及程序产品

更新时间:2026-09-01
脑卒中数据上报方法、装置、存储介质以及程序产品 专利申请类型:实用新型专利;
地区:四川-泸州;
源自:泸州高价值专利检索信息库;

专利名称:脑卒中数据上报方法、装置、存储介质以及程序产品

专利类型:实用新型专利

专利申请号:CN202411089994.9

专利申请(专利权)人:西南医科大学附属医院,四川互慧软件有限公司
权利人地址:四川省泸州市太平街25号

专利发明(设计)人:发明人:陈睦虎,罗彬,梁冬亮

专利摘要:本申请涉及一种脑卒中数据上报方法、装置、存储介质以及程序产品,涉及信息处理技术领域,能从相关系统中自动提取、校验以及上报卒中治疗的过程中所产生的各种记录。方法包括多次执行数据上报过程,单次执行数据上报过程包括:在包含有多个待上传数据项的程序系统中截取记录有任意待上传数据项的显示区域;对显示区域进行文字识别,得到对应至少一个待上传数据项的初始文本数据;针对所述至少一个待上传数据项的每个待上传数据项,在对应的词库中按照多个预选词段的优先级排列次序查找匹配初始文本数据的目标预选词段;针对至少一个待上传数据项的任意待上传数据项,若在词库中查找到所述目标预选词段,上报目标预选词段。

主权利要求:
1.一种脑卒中数据上报方法,其特征在于,应用于流程自动化软件,所述方法包括多次执行数据上报过程,单次执行数据上报过程包括:在包含有多个待上传数据项的程序系统中截取记录有任意待上传数据项的显示区域;
对截取的所述显示区域进行文字识别,得到对应至少一个待上传数据项的初始文本数据;
针对所述至少一个待上传数据项的每个待上传数据项,在对应的词库中按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段;所述词库中的预选词段优先级按照对所述待上传数据项的关联程度大小依次排列;
针对所述至少一个待上传数据项的任意待上传数据项,若在所述词库中查找到所述目标预选词段,上报所述初始文本数据;
第i次执行数据上报过程中,在上报所述初始文本数据之后,所述方法还包括:在所述词库中对所述目标预选词段进行预设操作;多个所述预选词段优先级按照历史接受所述预设操作的执行次数从大到小的次序依次排列;
第i+1次执行数据上报过程中,在构建的词库中按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段之前,所述方法还包括:在所述词库中对所述进行预设操作后的预选词段优先级在词库中的排列次序进行更新;
在构建的词库中按照多个预选词段更新后的优先级排列次序查找匹配所述初始文本数据的目标预选词段;
在构建的词库中按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段,包括:比对所述多个预选词段中排第一位的预选词段与所述初始文本数据是否相同;
若所述多个预选词段中排第一位的预选词段与所述初始文本数据相同,确定所述目标预选词段;
若所述多个预选词段中排第一位的预选词段与所述初始文本数据不相同,比对所述多个预选词段中排第二位的预选词段与所述初始文本数据是否相同,直至获得与所述初始文本数据相同的预选词段或完成所有预选词段的匹配;多次执行数据上报过程之前,所述方法还包括构建每个待上传数据项对应的词库;针对特定待上传数据项构建对应词库的步骤包括:采用多个文字识别工具对所述待上传数据项进行识别,获得描述所述待上传数据的字符或字符串;
对所述字符或所述字符串进行去重操作;
显示执行去重操作后的所述字符或所述字符串;
接收到用户对任意所述字符或任意所述字符串的确认操作,将所述确认操作对应的所述字符或所述字符串作为预选词段构建所述特定待上传数据项的词库。
2.根据权利要求1所述的脑卒中数据上报方法,其特征在于,若在所述词库中未查找到所述目标预选词段,在所述词库中增加所述初始文本数据;
生成提示在所述词库中增加所述初始文本数据的通知消息。
3.根据权利要求1所述的脑卒中数据上报方法,其特征在于,多次执行数据上报过程之前,所述方法还包括构建每个待上传数据项对应的词库;针对特定待上传数据项构建对应词库的步骤包括:采用多个文字识别工具对所述待上传数据项进行识别,获得描述所述待上传数据的字符或字符串;
对所述字符或所述字符串进行去重操作;
采用语义识别工具对执行去重操作后的所述字符或所述字符串进行语义识别,判断所述字符或所述字符串是否按照预设规则描述所述特定待上传数据项;
若所述字符或所述字符串按照预设规则描述所述特定待上传数据项,将所述字符或所述字符串作为预选词段构建所述特定待上传数据项的词库。
4.根据权利要求1所述的脑卒中数据上报方法,其特征在于,若在所述词库中未查找到所述目标预选词段,所述方法还包括:显示所述初始文本数据;
接收到用户对所述初始文本数据的修改操作,响应所述修改操作,修改所述初始文本数据;
上报修改后的初始文本数据。
5.一种脑卒中数据上报装置,其特征在于,设置于流程自动化软件,所述装置包括:截取模块,用于在包含有多个待上传数据项的程序系统中截取记录有任意待上传数据项的显示区域;
识别模块,用于对所述显示区域进行文字识别,得到对应至少一个待上传数据项的初始文本数据;
查找模块,用于针对所述至少一个待上传数据项的每个待上传数据项,在构建的词库中按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段;所述词库中的预选词段优先级按照对所述待上传数据项的关联程度大小依次排列;
上报模块,用于针对所述至少一个待上传数据项的任意待上传数据项,若在所述词库中查找到所述目标预选词段,上报所述初始文本数据;
所述装置还包括:预设操作模块和更新模块,所述预设操作模块用于在当前次执行数据上报过程中,在上报所述初始文本数据之后,在所述词库中对所述目标预选词段进行预设操作;多个所述预选词段优先级按照历史接受所述预设操作的执行次数从大到小的次序依次排列;
所述更新模块在当前次的下一次执行数据上报过程中,在所述词库中对所述进行预设操作后的预选词段优先级在词库中的排列次序进行更新;在构建的词库中按照多个预选词段更新后的优先级排列次序查找匹配所述初始文本数据的目标预选词段;
所述查找模块包括具体用于比对所述多个预选词段中排第一位的预选词段与所述初始文本数据是否相同;若所述多个预选词段中排第一位的预选词段与所述初始文本数据相同,确定所述目标预选词段;若所述多个预选词段中排第一位的预选词段与所述初始文本数据不相同,比对所述多个预选词段中排第二位的预选词段与所述初始文本数据是否相同,直至获得与所述初始文本数据相同的预选词段或完成所有预选词段的匹配;
所述装置还包括词库构建模块,用于采用多个文字识别工具对所述待上传数据项进行识别,获得描述所述待上传数据的字符或字符串;对所述字符或所述字符串进行去重操作;
采用语义识别工具对执行去重操作后的所述字符或所述字符串进行语义识别,判断所述字符或所述字符串是否正确描述所述特定待上传数据项;若所述字符或所述字符串正确描述所述特定待上传数据项,将所述字符或所述字符串作为预选词段构建所述特定待上传数据项的词库。
6.一种计算机可读存储介质,其特征在于,所述计算机可读存储介质上存储有计算机程序,其特征在于,所述计算机程序被处理器执行时实现如权利要求1至4任一所述的脑卒中数据上报方法。
7.一种计算机程序产品,包括计算机程序或计算机指令,其特征在于,所述计算机程序或所述计算机指令在计算机可读存储介质中,计算机设备的处理器从所述计算机可读存储介质读取所述计算机程序或所述计算机指令,所述处理器执行所述计算机程序或所述计算机指令,使得所述计算机设备执行如权利要求1至4任一所述的脑卒中数据上报方法。 说明书 : 脑卒中数据上报方法、装置、存储介质以及程序产品技术领域[0001] 本申请涉及医疗信息处理技术领域,具体涉及一种脑卒中数据上报方法、装置、存储介质以及程序产品。背景技术[0002] 企事业单位中,存在需要上传大量数据的业务。例如,国家规定卒中住院患者出院后,要求医院必须及时上传卒中患者进行卒中治疗的过程中所产生的各种记录至对应数据库,以进一步进行卒中病例质控和数据分析,优化治疗措施,提升治疗率,降低疾病负担。由于不同医院采用的系统不同,统一自动化上传卒中治疗的过程中所产生的各种记录也存在难度。发明内容[0003] 本申请要解决的技术问题是:针对自动化上传卒中治疗的过程中所产生的各种记录,如何从相关系统中自动提取、校验提取数据的准确性以及上报校验后的信息。[0004] 第一方面,一种实施例中提供一种脑卒中数据上报方法,应用于流程自动化软件,所述方法包括多次执行数据上报过程,单次执行数据上报过程包括:在包含有多个待上传数据项的程序系统中截取记录有任意待上传数据项的显示区域;对所述显示区域进行文字识别,得到对应至少一个待上传数据项的初始文本数据;[0005] 针对所述至少一个待上传数据项的每个待上传数据项,在对应的词库中按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段;所述预选词段按照对待上传数据的关联程度大小依次排列从大到小依次排列;针对所述至少一个待上传数据项的任意待上传数据项,若在所述词库中查找到所述目标预选词段,上报所述目标预选词段。[0006] 一种实施例中,第i次执行数据上报过程中,在上报所述初始文本数据之后,所述方法还包括:[0007] 在所述词库中对所述目标预选词段进行预设操作;多个所述预选词段优先级按照历史接受所述预设操作的执行次数从大到小的次序依次排列;[0008] 第i+1次执行数据上报过程中,在构建的词库中按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段之前,所述方法还包括:[0009] 在所述词库中对所述进行预设操作后的预选词段优先级在词库中的排列次序进行更新;[0010] 在构建的词库中按照多个预选词段更新后的优先级排列次序查找匹配所述初始文本数据的目标预选词段。[0011] 一种实施例中,若在所述词库中未查找到所述目标预选词段,在所述词库中增加所述初始文本数据;[0012] 生成提示在所述词库中增加所述初始文本数据的通知消息。[0013] 一种实施例中,在构建的词库中按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段,包括:[0014] 比对所述多个预选词段中排第一位的预选词段与所述初始文本数据是否相同;[0015] 若所述多个预选词段中排第一位的预选词段与所述初始文本数据相同,确定所述目标预选词段;[0016] 若所述多个预选词段中排第一位的预选词段与所述初始文本数据不相同,比对所述多个预选词段中排第二位的预选词段与所述初始文本数据是否相同,直至获得与所述初始文本数据相同的预选词段或完成所有预选词段的匹配。[0017] 一种实施例中,多次执行数据上报过程之前,所述方法还包括构建每个待上传数据项对应的词库;针对特定待上传数据项构建对应词库的步骤包括:[0018] 采用多个文字识别工具对所述待上传数据项进行识别,获得描述所述待上传数据的字符或字符串;[0019] 对所述字符或所述字符串进行去重操作;[0020] 采用语义识别工具对执行去重操作后的所述字符或所述字符串进行语义识别,判断所述字符或所述字符串是否按照预设规则描述所述特定待上传数据项;[0021] 若所述字符或所述字符串按照预设规则描述所述特定待上传数据项,将所述字符或所述字符串作为预选词段构建所述特定待上传数据项的词库。[0022] 一种实施例中,多次执行数据上报过程之前,所述方法还包括构建每个待上传数据项对应的词库;针对特定待上传数据项构建对应词库的步骤包括:[0023] 采用多个文字识别工具对所述待上传数据项进行识别,获得描述所述待上传数据的字符或字符串;[0024] 对所述字符或所述字符串进行去重操作;[0025] 显示执行去重操作后的所述字符或所述字符串;[0026] 接收到用户对任意所述字符或任意所述字符串的确认操作,将所述确认操作对应的所述字符或所述字符串作为预选词段构建所述特定待上传数据项的词库。[0027] 一种实施例中,若在所述词库中未查找到所述目标预选词段,所述方法还包括:[0028] 显示所述初始文本数据;[0029] 接收到用户对所述初始文本数据的修改操作,响应所述修改操作,修改所述初始文本数据;[0030] 上报修改后的初始文本数据。[0031] 第二方面,一种实施例中提供一种脑卒中数据上报装置,所述装置包括:[0032] 截取模块,用于在包含有多个待上传数据项的程序系统中截取记录有任意待上传数据项的显示区域;[0033] 识别模块,用于对所述显示区域进行文字识别,得到对应至少一个待上传数据项的初始文本数据;[0034] 查找模块,用于针对所述至少一个待上传数据项的每个待上传数据项,在构建的词库中按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段;所述词库用于更新预选词段的排列次序;所述预选词段为描述待上传数据的字符或字符串;[0035] 上报模块,用于针对所述至少一个待上传数据项的任意待上传数据项,若在所述词库中查找到所述目标预选词段,上报所述初始文本数据。[0036] 第三方面,本申请实施例还提供了一种计算机可读存储介质,其中存储有处理器可执行的程序,所述处理器可执行的程序被处理器执行时用于实现如前面所述的脑卒中数据上报方法。[0037] 第四方面,本申请实施例还提供了一种计算机程序产品,包括计算机程序或计算机指令,所述计算机程序或所述计算机指令存储在计算机可读存储介质中,计算机设备的处理器从所述计算机可读存储介质读取所述计算机程序或所述计算机指令,所述处理器执行所述计算机程序或所述计算机指令,使得所述计算机设备执行如前面所述的脑卒中数据上报方法。[0038] 本申请的有益效果是:[0039] 本申请实施例采用流程自动化软件(Roboticprocessautomation,RPA)截取系统中记录有待上传数据的显示区域,得到记录待上传数据的页面截图,对截图中的内容进行文字识别,完成对系统中相关记录的自动提。玫匠跏嘉谋臼,由于上述截取显示区域的截图和文字识别均不会调取系统本身的操作流程,因此可以适用于不同的系统,为不同医院系统均能自动化上报卒中治疗的过程中所产生的各种记录提供基础。识别页面记录的初始文本数据之后,本申请实施例还利用预先针对相关上传数据构建的词库对识别的初始文本数据进行校验,由于词库中的预选词段是历史描述过待上传数据的字符或字符串,并且在多个预选词段中查找目标预选词段的顺序是:按照各预选词段与待上传数据项的关联程度从大到小依次进行的,所以若在词库中查找到与初始文本数据匹配的词段,可以确定初始文本数据是历史描述过待上传数据的,并且初始文本数据是当前对待上传数据描述准确性最高的。通过上述过程,本申请实施例完成对识别得到的初始文本数据的校验,再上报初始文本数据,实现上报的信息是当前与待上传数据关联程度最高的文本字段。附图说明[0040] 图1是本申请提出的脑卒中数据上报方法步骤流程图;[0041] 图2是本申请一种示例截取的显示区域A示例图;[0042] 图3是一种示例中待上传数据项的程序系统显示界面示例图;[0043] 图4是本申请实施例提出的脑卒中数据上报装置的功能模块图。具体实施方式[0044] 下面通过具体实施方式结合附图对本申请作进一步详细说明。其中不同实施方式中类似元件采用了相关联的类似的元件标号。在以下的实施方式中,很多细节描述是为了使得本申请能被更好的理解。然而,本领域技术人员可以毫不费力的认识到,其中部分特征在不同情况下是可以省略的,或者可以由其他元件、材料、方法所替代。在某些情况下,本申请相关的一些操作并没有在说明书中显示或者描述,这是为了避免本申请的核心部分被过多的描述所淹没,而对于本领域技术人员而言,详细描述这些相关操作并不是必要的,他们根据说明书中的描述以及本领域的一般技术知识即可完整了解相关操作。[0045] 另外,说明书中所描述的特点、操作或者特征可以以任意适当的方式结合形成各种实施方式。同时,方法描述中的各步骤或者动作也可以按照本领域技术人员所能显而易见的方式进行顺序调换或调整。因此,说明书和附图中的各种顺序只是为了清楚描述某一个实施例,并不意味着是必须的顺序,除非另有说明其中某个顺序是必须遵循的。[0046] 为解决不同系统自动化上传卒中治疗的过程中所产生的各种记录的问题,本申请实施例提出一种脑卒中数据上报方法,应用于流程自动化软件(Roboticprocessautomation,RPA),RPA又名机器人流程自动化,按照自动化完成预先设置的一套操作流程。示例地,假设预先设置的操作流程为:从网页中复制日期??将日期填入表格??上传表格,RPA启动后无需人工从参与自动完成从网页中复制日期??将日期填入表格??上传表格的操作流程。[0047] 上述流程自动化软件可以安装于电子设备,例如计算机、手机、服务器等。[0048] 图1是本申请提出的脑卒中数据上报方法步骤流程图,如图1所示,步骤包括:[0049] S1:在包含有多个待上传数据项的程序系统中截取记录有任意待上传数据项的显示区域。[0050] 待上传数据项可以表示需要上传的卒中治疗的过程中所产生的各种记录。例如:姓名、地址、给药方式、给药时间、药品、门诊记录、治疗手段、手术时间等。其中,姓名、地址、给药方式、给药时间、药品、门诊记录、治疗手段、时间中每一个均可以作为一个上传数据项。[0051] 不同医院的程序系统可能基于不同的开放方式构建,医院程序系统的各板块都可能存在需要上传的数据记录,难以实现数据的统一上传。本申请采用可通用于各板块的记录提取方式,截取记录有任意待上传数据项的显示区域,再对截取的显示区域进行文字识别,得到初始文本数据。[0052] S2:对截取的所述显示区域进行文字识别,得到对应至少一个待上传数据项的初始文本数据。[0053] 可以采用光学字符识别(OpticalCharacterRecognition,OCR)对截取的所述显示区域进行文字识别,得到对应至少一个待上传数据项的初始文本数据。[0054] 图2是本申请一种示例截取的显示区域A示例图,显示区域A显示有待上传数据项包括姓名词组、手术时间、给药方式、地址等信息,对显示区域A进行文字识别,得到的初始文本数据包括:待上传数据项是姓名词组的对应初始文本数据1“邓百强”,待上传数据项手术时间的对应初始文本数据2“XXXX年XX月XX日”,待上传数据项给药方式的对应初始文本数据3“静脉滴注(IVGTT)”,待上传数据项地址的对应初始文本数据4“XXX市XX区XXXX街道XX号”。[0055] 考虑到RPA执行文字识别操作流程时会随机调用不同的OCR,不同的OCR识别同一个文本可能得到不同结果,同时RPA采用不用于汉语的开源算法,调用OCR进行文字识别可能出现对汉字字体识别不清晰、乱码等问题,本申请实施例预先针对每个待上传数据项设置有词库,词库存储有多个预选词段,预选词段是采用不同文字识别工具对特定待上传数据项进行文字识别得到的:历史描述过特定待上传数据项的字符或字符串。执行步骤S2之后,本申请实施例执行步骤S3,利用词库对初始文本数据进行校验,以获得特定待上传数据项更准确的描述方式。[0056] 步骤S3:针对所述至少一个待上传数据项的每个待上传数据项,在对应的词库中按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段;所述词库中的预选词段优先级按照对所述待上传数据项的关联程度大小依次排列。[0057] 由于词库中的预选词段优先级按照对所述待上传数据项的关联程度大小依次排列,所以按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段,匹配到的是当前与待上传数据项关联程度最高的词组。[0058] 一种示例中,某OCR识别特定待上传数据项得到的预选词段B,可以表示预选词段B与待上传数据存在一定的关联程度。N个OCR工具识别特定待上传数据项得到预选词段B,M个OCR工具识别特定待上传数据项得到预选词段C,其中M<N,可以确定预选词段C与待上传数据项的关联程度小于预选词段B与待上传数据项的关联程度。另一种示例中,识别待上传数据项后,多次上报预选词段B至卒中系统中心,表示预选词段B与待上传数据存在一定的关联程度。[0059] 可以理解的是,识别得到预选词段B的OCR工具数量与预选词段B表达待上传数据项的准确性正相关,因此与待上传数据项关联程度越高的词组,越能准确表达待上传数据项。[0060] 基于以图2所示示例进行说明,待上传数据项包括姓名词组、手术时间、给药方式、地址等信息,对显示区域进行文字识别得到:对应姓名的初始文本数据1,对应手术时间的初始文本数据2,对应给药方式的初始文本数据3,对应地址的初始文本数据4,针对待上传数据项姓名词组为例,识别得到的初始文本数据1为邓百强,预先构建了该姓名词组对应的词库A={邓百强、邓百弓虽、又百强、又陌了虽},在词库A中查找得到了初始文本数据1匹配的目标预选词段:邓百强,词库中存在预选词段与初始文本数据相同,由于词库中的预选词段与待上传数据项具有一定的关联性,从而可以确定识别得到的姓名词组初始文本数据1在一定程度上是可以准确表达待上传数据项的准确性,上报姓名词组“邓百强”。[0061] 本申请实施例还给出执行步骤S3的可选方式,由于词库中的预选词段按照对待上传数据项的关联程度大小依次排列,所以先验证优先级最高的预选词段与初始文本数据是否相同,保证在现有描述待上传数据项的预选词段中快速查找到准确性最高的目标预选词段。步骤S3包括以下子步骤:[0062] 步骤S31:比对所述多个预选词段中排第一位的预选词段与所述初始文本数据是否相同;[0063] 步骤S32:若所述多个预选词段中排第一位的预选词段与所述初始文本数据相同,确定所述目标预选词段;[0064] 步骤S33:若所述多个预选词段中排第一位的预选词段与所述初始文本数据不相同,比对所述多个预选词段中排第二位的预选词段与所述初始文本数据是否相同,直至获得与所述初始文本数据相同的预选词段或完成所有预选词段的匹配。[0065] 示例地,某姓名词组对应的词库A={邓百强、邓百弓虽、又百强、又陌了虽},其中各预选词段的优先级大小关系为:邓百强的优先级>邓百弓虽的优先级>又百强的优先级>又陌了虽的优先级,对截取的显示区域进行文字识别得到的初始文本数据为“邓百强”,先比对优先级最高的预选词段与“邓百强”相同,确定目标预选词段,上述过程按照多个预选词段的优先级排列次序,依次比对当前优先级最高的预选词段与初始文本数据是否相同,高效地在当前已有的具有一定准确性的预先词段中查找到匹配初始文本数据的目标预选词段。[0066] 另一种示例中,某姓名词组对应的词库A={邓百强、邓百弓虽、又百强、又陌了虽},其中各预选词段的优先级大小关系为:邓百强的优先级>邓百弓虽的优先级>又百强的优先级>又陌了虽的优先级,对截取的显示区域进行文字识别得到的初始文本数据为“又陌了虽”,先比对优先级最高的预选词段“邓百强”与“又陌了虽”是否相同,再比对优先级第二的预选词段“邓百弓虽”与“又陌了虽”是否相同,以此类推,直到匹配到与初始文本数据相同的预选词段,或完成词库A中所有预选词段的匹配。[0067] 步骤S4:针对所述至少一个待上传数据项的任意待上传数据项,若在所述词库中查找到所述目标预选词段,上报所述初始文本数据。[0068] 本申请一种示例中,上报所述初始文本数据的方式是将初始文本数据上传至卒中中心程序系统对应记录待上传数据项的存储地址。[0069] 对于特定待上传数据项,若在特定待上传数据项对应的词库中查找到匹配初始文本数据的预选词段,表示校验得到:初始文本数据具有一定的准确性,因此可以上传初始文本数据至卒中中心服务器。[0070] 继续以图2所示示例进行说明,识别图2所示显示区域得到的:待上传数据项是姓名词组的对应初始文本数据1,待上传数据项手术时间的对应初始文本数据2,待上传数据项给药方式的对应初始文本数据3,待上传数据项地址的对应初始文本数据4,可以依次针对初始文本数据1、初始文本数据2、初始文本数据3、初始文本数据4,执行步骤S3,得到初始文本数据1、初始文本数据2、初始文本数据3、初始文本数据4各自对应的目标预选词段,再执行步骤S4上报上述初始文本数据1、初始文本数据2、初始文本数据3、初始文本数据4;也可以依次针对初始文本数据1、初始文本数据2、初始文本数据3、初始文本数据4,执行步骤S3,分别执行S3?S4。[0071] 本申请实施例采用流程自动化软件(Roboticprocessautomation,RPA)截取系统中记录有待上传数据的显示区域,得到记录待上传数据的页面截图,对截图中的内容进行文字识别,完成对系统中相关记录的自动提。玫匠跏嘉谋臼,由于上述截取显示区域的截图和文字识别均不会调取系统本身的操作流程,因此可以适用于不同的系统,为不同医院系统均能自动化上报卒中治疗的过程中所产生的各种记录提供基础。识别页面记录的初始文本数据之后,本申请实施例还利用预先针对相关上传数据构建的词库对识别的初始文本数据进行校验,由于词库中的预选词段是历史描述过待上传数据的字符或字符串,并且在多个预选词段中查找目标预选词段是按照各预选词段的排列次序依次进行的,所以若在词库中查找到与初始文本数据匹配的词段,可以确定初始文本数据是历史描述过待上传数据的字符或字符串,并且初始文本数据是当前对待上传数据表达准确性最高的字符或字符串。通过上述过程,本申请实施例完成对识别得到的初始文本数据的校验,再上报初始文本数据,实现上报当前对待上传数据表达准确性最高的字符或字符串的目的。[0072] 在本申请一种实施例中,步骤S3针对特定待上传数据项查找目标预选词段,若查找到目标预选词段则执行步骤S4,若未查找到目标预选词段,则执行步骤S5或S6,或者执行S5和S6,步骤S4、步骤S5以及步骤S6并列。[0073] 步骤S5:若在所述词库中未查找到所述目标预选词段,在所述词库中增加所述初始文本数据;生成提示在所述词库中增加所述初始文本数据的通知消息。[0074] 示例地,某姓名词组对应的词库A={邓百强、邓百弓虽、又百强、又陌了虽},对截取的显示区域进行文字识别得到的初始文本数据为“邓白强”,词库A中不存在与初始文本数据匹配的预选词段,为进一步扩充词库,得到更加全面对待上传数据项的表达方式,从而能够在后续程序执行过程中,验证新增加至词库的预选词段被使用的频次,在更全面的预选词库的前提下,得到对待上传数据项更准确的表达,扩充后的某姓名词组对应的词库A’={邓百强、邓百弓虽、又百强、又陌了虽、邓白强}。[0075] S6:显示所述初始文本数据;接收到用户对所述初始文本数据的修改操作,响应所述修改操作,修改所述初始文本数据;上报修改后的初始文本数据。[0076] 若在所述词库中未查找到所述目标预选词段,可能存在识别的初始文本数据、词库中的预选词段中至少一者出现误差的情况,因此可以显示初始文本数据,以获得用户对初始文本数据的反馈信息。根据用户意图对初始文本数据进行修改后,再将初始文本数据增加至词库,可以提高词库中预选词段对待上传数据的表达准确性。[0077] 本申请实施例还对如何构建和维护各待上传数据项对应词库,以保证词库中的预选词段按照对待上传数据项的表达准确性从大到小依次排列,从而保证利用词库对初始文本数据进行校验后,得到当前表达准确性最高的词组。[0078] 若只采用人工鉴定的方式评定:RPA执行文字识别操作流程时随机调用的各OCR识别文字得到的结果是否准确,效率过低,且存在一定的局限,鉴于此,本申请实施例采用人工智能的方式,初步评价各OCR识别文字得到的结果是否符合对待上传数据项的表达方式,再采用自适应调节统计的方式获得各OCR识别文字得到的结果被使用的频次,基于各OCR识别文字得到的结果被使用的频次,客观评定各OCR识别文字得到的结果是否准确表达待上传数据项。[0079] 多次执行数据上报过程之前,本申请实施例构建每个待上传数据项对应的词库构建对应词库的步骤包括:[0080] S101:采用多个文字识别工具对特定待上传数据项进行识别,获得描述所述待上传数据的字符或字符串;[0081] 示例地,采用多个文字识别工具对待上传数据项a1“给药方式”进行识别,得到多个字符串包括:Wa1p1=静脉滴注(IVGTT)、Wa1p2=静脉滴注(IVJTT)、Wa1p3=肌肉注射法(IM)、Wa1p4=静脉滴注(IVGTT)其中pi(i取1至n中任一值,n为大于1的整数)表示不同的文字识别工具。[0082] 可以继续识别同一页面的其他待上传数据项a2,得到多个字符或多个字符串Wa2p1、Wa2p2、Wa2p3、Wa2p4,以此类推。若医院系统的病例界面具有的其他待上传数据项包括a1a2a3……a180,RPA调用的文字识别工具包括p1p2p3……pn,利用所有文字识别工具识别病例界面的待上传数据项可以得到的字符或字符串包括:[0083] {Wa1p1,Wa1p2,Wa1p3......Wa1pn;[0084] Wa2p1,Wa2p2,Wa2p3......Wa2pn;[0085] Wa3p1,Wa3p2,Wa3p3......Wa3pn;[0086] ......[0087] Wa180p1,Wa180p2,Wa180p3.......Wa180pn}[0088] S102:对所述字符或所述字符串进行去重操作;[0089] 去重操作可以减少存储词库中预选词段的数量,去除不必要的干扰,避免词库过于冗杂。[0090] 示例地,对待上传数据项a1“给药方式”进行识别,得到多个字符串包括:Wa1p1=静脉滴注(IVGTT)、Wa1p2=静脉滴注(IVJTT)、Wa1p3=肌肉注射法(IM)、Wa1p4=静脉滴注(IVGTT),对上述字符串进行去重操作,得到Wa1p1=静脉滴注(IVGTT)、Wa1p2=静脉滴注(IVJTT)、Wa1p3=肌肉注射法(IM)的结果。[0091] S103:判断所述字符或所述字符串是否按照预设规则描述所述特定待上传数据项。[0092] 本申请实施例采用语义识别工具自动检测字符或字符串是否按照预设规则描述特定待上传数据项,或者获取用户对字符或字符串的判断意图,依据用户指令确定字符或字符串是否按照预设规则描述特定待上传数据项。[0093] 采用语义识别工具自动检测字符或字符串是否正确描述特定待上传数据项的方式包括子步骤:[0094] S1031:采用语义识别工具对执行去重操作后的所述字符或所述字符串进行语义识别,判断所述字符或所述字符串是否按照预设规则描述所述特定待上传数据项;[0095] 语义识别工具可以是基于自然语言处理(NaturalLanguageProcessing,NLP)技术、构建的深度神经网络、人工智能算法模型等。[0096] 若通过语义识别工具检查字符或字符串按照预设规则描述所述特定待上传数据项,继续执行步骤S104。[0097] 获取用户对字符或字符串的判断意图,依据用户指令确定字符或字符串是否按照预设规则描述特定待上传数据项的方式包括子步骤:[0098] S1032:显示执行去重操作后的所述字符或所述字符串;若接收到用户对任意所述字符或任意所述字符串的确认操作,继续执行步骤S104。[0099] S104:将所述字符或所述字符串作为预选词段构建所述特定待上传数据项的词库。[0100] 需要以此判断各文字识别工具获得的结果是否能按照预设规则描述特定待上传数据项,若任一文字识别工具获得的结果不能确定描述特定待上传数据项,则删除该任一文字识别工具获得的结果。[0101] 示例地,特定待上传数据项是a1“给药方式”,对应预设规则是符合给药方式的规范表达,对待上传数据项a1“给药方式”进行识别,得到多个字符串包括:Wa1p1=静脉滴注(IVGTT)、Wa1p2=静脉滴注(IVJTT)、Wa1p3=肌肉注射法(IM)、Wa1p4=静脉滴注(IVGTT),执行步骤S103,确定Wa1p1=静脉滴注(IVGTT)、Wa1p3=肌肉注射法(IM)、Wa1p4=静脉滴注(IVGTT)能按照预设规则描述特定待上传数据项是a1“给药方式”,Wa1p2=静脉滴注(IVJTT)不能按照预设规则描述特定待上传数据项是a1“给药方式”,建立特定待上传数据项是a1“给药方式”对应的词库为{Wa1p1=静脉滴注(IVGTT)、Wa1p3=肌肉注射法(IM)}。[0102] 示例地,特定待上传数据项是a2“地址”,对应预设规则是字符串中同时包含市、区、街道、号的字符,对特定待上传数据项是a2“地址”进行识别进行识别,得到多个字符串包括:“XXXXXXX”、“XX市XX区XX街道X号”、“XXX市区”,执行步骤S103确定“XX市XX区XX街道X号”能够按照预设规则描述特定待上传数据项是a2。[0103] 通过上述方式构建得到的词库中的预选词段通过检验,可以给出在执行数据上报过程中校验初始文本数据的基本信息,为进一步提高词库中预选词段对待上传数据项的表达准确性,在使用待上传数据项对应词库校验初始文本数据的过中,根据词库中各预选词段被使用的频次,调整各预选词段的准确性排列次序,从而自适应调整词库对初始文本数据的校验准确性。[0104] 尤其是对于待上传数据项是地址或姓名的情况,一般地,描述地址或姓名的字符之间不具有逻辑联系,单个的字符不具有意义,本申请统计的是地址或姓名的整体词组被使用的频次,不会被单个字符影响判断整体是否具有对待上传数据的表达准确性。[0105] 若在所述词库中查找到所述目标预选词段,上报所述初始文本数据之外还可以在所述词库中对所述目标预选词段进行预设操作;多个所述预选词段优先级按照历史接受所述预设操作的执行次数从大到小的次序依次排列;从而下一次执行数据上报过程实,更新词库中预选词段的优先级:在所述词库中对所述进行预设操作后的预选词段优先级在词库中的排列次序进行更新;在构建的词库中按照多个预选词段更新后的优先级排列次序查找匹配所述初始文本数据的目标预选词段。[0106] 以相邻两次执行数据上报过程为例,对根据词库中各预选词段被使用的频次,调整各预选词段的准确性排列次序进行说明:[0107] 第i次执行数据上报过程包括步骤:[0108] S201:在包含有多个待上传数据项的程序系统中截取记录有任意待上传数据项“给药方式”的显示区域;[0109] S202:对截取的所述显示区域进行文字识别,得到对应待上传数据项“给药方式”的初始文本数据静脉滴注(IVGTT);[0110] S203:在待上传数据项“给药方式”对应的词库中按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段。[0111] 待上传数据项是a1“给药方式”对应的词库为{Wa1p1=静脉滴注(IVGTT)、Wa1p3=肌肉注射法(IM)},其中Wa1p1的优先级为第一,得分为T1,Wa1p3的优先级为第二,得分为T2,按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段为静脉滴注(IVGTT)。[0112] S204:上报所述初始文本数据静脉滴注(IVGTT)。[0113] S205:在所述词库中对目标预选词段Wa1p1静脉滴注(IVGTT)进行预设操作。一种示例中,预设操作可以是对Wa1p1的得分进行加一操作。[0114] 第i+1次执行数据上报过程包括步骤:[0115] S301:在包含有多个待上传数据项的程序系统中截取记录有任意待上传数据项“给药方式”的显示区域;[0116] S302:对截取的所述显示区域进行文字识别,得到对应待上传数据项“给药方式”的初始文本数据静脉滴注(IVGTT);[0117] S303:按照第i次执行数据上报过程得到的Wa1p1得分为T1+1,对上传数据项是a1“给药方式”对应的词库{Wa1p1=静脉滴注(IVGTT)、Wa1p3=肌肉注射法(IM)}中预选词段更新优先级,得到Wa1p1的优先级为第一,Wa1p3的优先级为第二;[0118] S304:在待上传数据项“给药方式”对应的词库中按照多个预选词段更新后的优先级排列次序查找匹配所述初始文本数据的目标预选词段。[0119] 如图3所示,图3是一种示例中待上传数据项的程序系统显示界面示例图,在C/S系统中,为实现美观性,显示界面底层是具有背景图片或色彩,显示界面底层之上显示文字,RPA就很难识别出“申请时间”、“开台时间”等黑色字体的文字,或者只能识别出其中一部分。[0120] 目前,卒中中心上报总共只有300个字段,主要来源是HIS系统病案首页系统、电子病历系统、手术麻醉系统。其中HIS系统和手术麻醉系统存在C/S系统都存在,需解决HIS系统和手术麻醉系统里面需要上报的字段的校验工作,HIS系统和手术麻醉系统的字段大概为140?180个,本申请实施例根据多种OCR识别工具识别卒中中心上报程序系统的多个界面中的显示文字,构建了词库以存储OCR对不同待上传数据项可能的识别结果,在后续使用中,以词库中存储的词段验证识别出的初始文本数据,同时验证词库中存储的词段被使用,证词库中存储的词段被使用频次越多,表示更多的OCR识别得到该词段,从而客观验证该词段对待上传数据项的表达准确性更高,由于卒中中心程序系统需要上传的字段在一定范围内,词库构建效率高,方法简单,以上述构建词库的方式验证初始文本数据成本较低。[0121] 图4是本申请实施例提出的脑卒中数据上报装置的功能模块图,如图4所示,所述装置包括:[0122] 截取模块41,用于在包含有多个待上传数据项的程序系统中截取记录有任意待上传数据项的显示区域;[0123] 识别模块42,用于对所述显示区域进行文字识别,得到对应至少一个待上传数据项的初始文本数据;[0124] 查找模块43,用于针对所述至少一个待上传数据项的每个待上传数据项,在构建的词库中按照多个预选词段的优先级排列次序查找匹配所述初始文本数据的目标预选词段;所述词库中的预选词段优先级按照对所述待上传数据项的关联程度大小依次排列;[0125] 上报模块44,用于针对所述至少一个待上传数据项的任意待上传数据项,若在所述词库中查找到所述目标预选词段,上报所述初始文本数据。[0126] 图4所示实施例提供的脑卒中数据上报装置可用于执行本说明书图1至图3所示方法实施例的技术方案,其实现原理和技术效果可以进一步参考方法实施例中的相关描述。[0127] 可选地,所述装置还包括:预设操作模块和更新模块,所述预设操作模块用于在当前次执行数据上报过程中,在上报所述初始文本数据之后,在所述词库中对所述目标预选词段进行预设操作;多个所述预选词段优先级按照历史接受所述预设操作的执行次数从大到小的次序依次排列;[0128] 所述更新模块在当前次的下一次执行数据上报过程中,在所述词库中对所述进行预设操作后的预选词段优先级在词库中的排列次序进行更新;在构建的词库中按照多个预选词段更新后的优先级排列次序查找匹配所述初始文本数据的目标预选词段。[0129] 可选地,所述装置还包括:新增模块,用于当若在所述词库中未查找到所述目标预选词段,在所述词库中增加所述初始文本数据;生成提示在所述词库中增加所述初始文本数据的通知消息。[0130] 可选地,所述查找模块包括具体用于比对所述多个预选词段中排第一位的预选词段与所述初始文本数据是否相同;若所述多个预选词段中排第一位的预选词段与所述初始文本数据相同,确定所述目标预选词段;[0131] 若所述多个预选词段中排第一位的预选词段与所述初始文本数据不相同,比对所述多个预选词段中排第二位的预选词段与所述初始文本数据是否相同,直至获得与所述初始文本数据相同的预选词段或完成所有预选词段的匹配。[0132] 可选地,所述装置还包括词库构建模块,用于采用多个文字识别工具对所述待上传数据项进行识别,获得描述所述待上传数据的字符或字符串;对所述字符或所述字符串进行去重操作;采用语义识别工具对执行去重操作后的所述字符或所述字符串进行语义识别,判断所述字符或所述字符串是否正确描述所述特定待上传数据项;若所述字符或所述字符串正确描述所述特定待上传数据项,将所述字符或所述字符串作为预选词段构建所述特定待上传数据项的词库。[0133] 可选地,词库构建模块还用于采用多个文字识别工具对所述待上传数据项进行识别,获得描述所述待上传数据的字符或字符串;对所述字符或所述字符串进行去重操作;显示执行去重操作后的所述字符或所述字符串;接收到用户对任意所述字符或任意所述字符串的确认操作,将所述确认操作对应的所述字符或所述字符串作为预选词段构建所述特定待上传数据项的词库。[0134] 可选地,所述装置还包括修改模块,用于当若在所述词库中未查找到所述目标预选词段,显示所述初始文本数据;接收到用户对所述初始文本数据的修改操作,响应所述修改操作,修改所述初始文本数据;上报修改后的初始文本数据。[0135] 关于上述实施例中描述的各个装置包含的各个模块/单元,其可以是软件模块/单元,也可以是硬件模块/单元,或者也可以部分是软件模块/单元,部分是硬件模块/单元。例如,对于应用于或集成于芯片的各个装置,其包含的各个模块/单元可以都采用电路等硬件的方式实现,或者,至少部分模块/单元可以采用软件程序的方式实现,该软件程序运行于芯片内部集成的处理器,剩余的部分模块/单元可以采用电路等硬件方式实现;对于应用于或集成于芯片模组的各个装置,其包含的各个模块/单元可以都采用电路等硬件的方式实现,不同的模块/单元可以位于芯片模组的同一组件(例如芯片、电路模块等)或者不同组件中,或者,至少部分模块/单元可以采用软件程序的方式实现,该软件程序运行于芯片模组内部集成的处理器,剩余的部分模块/单元可以采用电路等硬件方式实现;对于应用于或集成于电子终端设备的各个装置,其包含的各个模块/单元可以都采用电路等硬件的方式实现,不同的模块/单元可以位于电子终端设备内同一组件(例如,芯片、电路模块等)或者不同组件中,或者,至少部分模块/单元可以采用软件程序的方式实现,该软件程序运行于电子终端设备内部集成的处理器,剩余的(如果有)部分模块/单元可以采用电路等硬件方式实现。[0136] 本申请的一种实施例中提供了一种计算机可读存储介质,存储介质上存储有程序,存储的程序包括能够被处理器加载并处理上述任意一实施例中的方法。[0137] 本申请实施例还公开了一种计算机程序产品,包括计算机程序或计算机指令,计算机程序或计算机指令存储在计算机可读存储介质中,计算机设备的处理器从计算机可读存储介质读取计算机程序或计算机指令,处理器执行计算机程序或计算机指令,使得计算机设备执行如前面任意实施例的脑卒中数据上报方法。[0138] 本领域技术人员可以理解,上述实施方式中各种方法的全部或部分功能可以通过硬件的方式实现,也可以通过计算机程序的方式实现。当上述实施方式中全部或部分功能通过计算机程序的方式实现时,该程序可以存储于一计算机可读存储介质中,存储介质可以包括:只读存储器、随机存储器、磁盘、光盘、硬盘等,通过计算机执行该程序以实现上述功能。例如,将程序存储在设备的存储器中,当通过处理器执行存储器中程序,即可实现上述全部或部分功能。另外,当上述实施方式中全部或部分功能通过计算机程序的方式实现时,该程序也可以存储在服务器、另一计算机、磁盘、光盘、闪存盘或移动硬盘等存储介质中,通过下载或复制保存到本地设备的存储器中,或对本地设备的系统进行版本更新,当通过处理器执行存储器中的程序时,即可实现上述实施方式中全部或部分功能。[0139] 以上应用了具体个例对本申请进行阐述,只是用于帮助理解本申请,并不用以限制本申请。对于本申请所属技术领域的技术人员,依据本申请的思想,还可以做出若干简单推演、变形或替换。

专利地区:四川

专利申请日期:2024-08-09

专利公开日期:2024-10-15

专利公告号:CN118588228B


以上信息来自国家知识产权局,如信息有误请联系我方更正!
该专利所有权非本平台所有,我方无法提供专利权所有者联系方式,请勿联系我方。
电话咨询
到底部
搜本页
回顶部
开云优惠体育(中国)官网 — 开云优惠体育app下载