文本识别方法及装置、计算机可读存储介质和电子设备
2025-02-23 15:34
No.1343244752166068224
技术概要
PDF全文
本申请涉及文本识别技术领域,具体涉及一种文本识别方法和文本识别装置,以及计算机可读存储介质和电子设备,解决了文本识别不准确和效率低的问题。该文本识别方法,通过使多个字符串中相邻的字符串有部分重叠,从而可以使多个字符串体现待识别文本的上下文之间的关系。然后,对多个字符串进行词向量转化,得到多个词向量,基于多个词向量生成多个词向量各自对应的词向量识别结果,以确定词向量对应的文本是功效文本还是非功效文本,综合多个词向量识别结果来确定待识别文本的文本识别结果,识别到了待识别文本的上下文之间的关系,提高了文本识别的准确性。另外,本申请的文本识别方法不需要人工标引,提高了文本识别的效率。
背景技术
专利文献主要包括技术问题、技术方案和技术功效三个部分。根据专利文献的技术功效部分可以对专利文献进行详细的分类。 目前,有利用专利的著录项目信息来识别功效文本,从而对专利文件进行分类的方法。但是专利的著录项目信息过于宽泛,不能准确的识别出功效文本,无法对专利文献进行详细的分类。现有技术中,为了提高识别功效文本的准确度,主要通过规则标引或人工标引的方式来确定功效文本。规则标引是通过识别具体的语法模式来确定功效文本,容易遗漏语法模式无法覆盖的其他表达,从而可能遗漏重要的专利信息,导致文本识别的准确性较低。人工标引虽然准确性较高,但是需要耗费大量的人力,导致文本识别的效率较低。
实现思路
阅读余下40%
技术概要为部分技术内容,查看PDF获取完整资料
该技术已申请专利,如用于商业用途,请联系技术所有人!
技术研发人员:
李发科王为磊屠昶旸张济徽
技术所属: 智慧芽信息科技(苏州)有限公司.
相关技术
FPGA实现硬件逻辑实时仿真的方法及装置 FPGA实现硬件逻辑实时仿真的方法及装置
基于API和数据库的动态标定方法 基于API和数据库的动态标定方法
一种虚拟机的沙箱引擎更新方法、装置、设备和介质 一种虚拟机的沙箱引擎更新方法、装置、设备和介质
频域响应仿真与测量数据处理方法及装置 频域响应仿真与测量数据处理方法及装置
服务数据节点迁移方法、装置、电子设备及存储介质 服务数据节点迁移方法、装置、电子设备及存储介质
配送控制方法、装置、服务器、智能柜及机器人 配送控制方法、装置、服务器、智能柜及机器人
适用于硬件电路的高精度压缩方法、装置及电子设备 适用于硬件电路的高精度压缩方法、装置及电子设备
融合多源信息的打击目标智能识别方法和系统 融合多源信息的打击目标智能识别方法和系统
水利对象关联关系建立方法 水利对象关联关系建立方法
问题解答方法、装置、介质和电子设备 问题解答方法、装置、介质和电子设备
技术分类
电信、广播电视和卫星传输服务 电信、广播电视和卫星传输服务
互联网软件服务 互联网软件服务
集成电路设计 集成电路设计
信息集成数字服务 信息集成数字服务
电气机械制造 电气机械制造
计算机、通信、电子设备制造 计算机、通信、电子设备制造
医药制造、生物基材料 医药制造、生物基材料
石油煤矿化学用品加工 石油煤矿化学用品加工
化学原料制品加工 化学原料制品加工
非金属矿物加工 非金属矿物加工
金属制品加工 金属制品加工
专用设备制造 专用设备制造
通用设备制造 通用设备制造
通用零部件制造 通用零部件制造
汽车制造业 汽车制造业
铁路、船舶、航天设备制造 铁路、船舶、航天设备制造
电力、热力生产和供应 电力、热力生产和供应
燃气生产和供应 燃气生产和供应
水生产和供应 水生产和供应
房屋建筑、土木工程 房屋建筑、土木工程
交通运输、仓储和邮政 交通运输、仓储和邮政
农、林、牧、渔业 农、林、牧、渔业
采矿业 采矿业
农副、食品加工 农副、食品加工
烟草、酒水加工 烟草、酒水加工
纺织皮具居家制品 纺织皮具居家制品
文教体娱加工 文教体娱加工
苏ICP备18062519号-5 © 2018-2025 【123技术园】 版权所有,并保留所有权利