CN114860901A - 一种基于古籍信息的知识图谱构建方法及问答系统 - Google Patents
一种基于古籍信息的知识图谱构建方法及问答系统 Download PDFInfo
- Publication number
- CN114860901A CN114860901A CN202210410423.5A CN202210410423A CN114860901A CN 114860901 A CN114860901 A CN 114860901A CN 202210410423 A CN202210410423 A CN 202210410423A CN 114860901 A CN114860901 A CN 114860901A
- Authority
- CN
- China
- Prior art keywords
- information
- module
- feedback
- matching
- question
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Pending
Links
Images
Classifications
-
- G—PHYSICS
- G06—COMPUTING; CALCULATING OR COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F16/00—Information retrieval; Database structures therefor; File system structures therefor
- G06F16/30—Information retrieval; Database structures therefor; File system structures therefor of unstructured textual data
- G06F16/33—Querying
- G06F16/332—Query formulation
- G06F16/3329—Natural language query formulation or dialogue systems
-
- G—PHYSICS
- G06—COMPUTING; CALCULATING OR COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F16/00—Information retrieval; Database structures therefor; File system structures therefor
- G06F16/30—Information retrieval; Database structures therefor; File system structures therefor of unstructured textual data
- G06F16/33—Querying
- G06F16/3331—Query processing
- G06F16/334—Query execution
- G06F16/3344—Query execution using natural language analysis
-
- G—PHYSICS
- G06—COMPUTING; CALCULATING OR COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F16/00—Information retrieval; Database structures therefor; File system structures therefor
- G06F16/30—Information retrieval; Database structures therefor; File system structures therefor of unstructured textual data
- G06F16/36—Creation of semantic tools, e.g. ontology or thesauri
- G06F16/367—Ontology
-
- G—PHYSICS
- G06—COMPUTING; CALCULATING OR COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F16/00—Information retrieval; Database structures therefor; File system structures therefor
- G06F16/90—Details of database functions independent of the retrieved data types
- G06F16/95—Retrieval from the web
- G06F16/955—Retrieval from the web using information identifiers, e.g. uniform resource locators [URL]
Landscapes
- Engineering & Computer Science (AREA)
- Theoretical Computer Science (AREA)
- Physics & Mathematics (AREA)
- Databases & Information Systems (AREA)
- Data Mining & Analysis (AREA)
- General Engineering & Computer Science (AREA)
- General Physics & Mathematics (AREA)
- Computational Linguistics (AREA)
- Artificial Intelligence (AREA)
- Mathematical Physics (AREA)
- Human Computer Interaction (AREA)
- Life Sciences & Earth Sciences (AREA)
- Animal Behavior & Ethology (AREA)
- Information Retrieval, Db Structures And Fs Structures Therefor (AREA)
Abstract
本发明公开了一种基于古籍信息的知识图谱构建方法及问答系统,该方法包括以下步骤:S1、领域建立;S2、信息录入;S3、语句分析;S4、词汇领域匹配;S5、信息整理;本发明还提出了一种基于古籍信息的知识图谱问答系统,包括信息处理模块、语句分析模块、词汇匹配模块、信息提取模块和反馈模块。本发明通过将信息采取以本的主体方式录入,并按照章、节的分段方式进一步进行录入,建立独立的其他领域部分,可以在信息展示时更加具体化,同时可以针对古籍部分信息无法匹配到现有领域划分进行针对性划分,通过增加反馈模块可以根据用户反馈的情况进行信息提取展示,进而可以避免一次信息提取量过大,便于用户根据需要进行更加精准的问答。
Description
技术领域
本发明涉及古籍信息处理技术领域,尤其涉及一种基于古籍信息的知识图谱构建方法及问答系统。
背景技术
古籍,是指未采用现代印刷技术印制的书籍,是人们对历史研究的重要途径之一,随着社会的不断进步,人们生活水平的不断提升,对于文化建设的意识也不断提升,而古籍整理工程就是文化建设过程中重要的项目之一,伴随着计算机网络的普及,古籍信息整理展示工程与计算机网络结合也成为一种趋势,在将古籍信息与计算机网络结合时,常常会用到知识图谱构建的方式,使得古籍信息在调取使用时更加便捷,同时部分知识图谱构建时还会同时建立问答系统,进一步便于后续使用人员进行快速调取。
现有的基于古籍信息的知识图谱构建方法及问答系统,其问答系统在使用时,往往是使用人员输入提问问题后,系统根据问题中包含的关键词将所有信息全部提取出来并进行展示,这就导致系统在提取过程中需要提取的信息量巨大,增加了网络负荷,同时由于信息量巨大,使得使用人员需要人为对信息进行进一步查找筛选,造成使用人员在使用时不够便捷,所以,需要设计一种一种基于古籍信息的知识图谱构建方法及问答系统来解决上述问题。
发明内容
本发明的目的是为了解决现有技术中存在的缺点,而提出的一种一种基于古籍信息的知识图谱构建方法及问答系统。
为了实现上述目的,本发明采用了如下技术方案:
一种基于古籍信息的知识图谱构建方法,包括以下步骤:
S1、领域建立,采用常规领域模板,同时建立独立的其他领域部分,并采用存储设备进行信息存储;
S2、信息录入,将古籍按照本的主体方式录入,并按照章、节的分段方式进一步进行录入;
S3、语句分析,利用语句分析AI对分段的信息进行关键词汇提取,并建立标签;
S4、词汇领域匹配,提取的关键词汇标签与建立的领域进行匹配,一个关键词可以匹配多个领域;
S5、信息整理,将录入的分段信息分别归入关键词所述领域,其中一组分段信息可以归入不同领域中。
本发明还提出了一种基于古籍信息的知识图谱问答系统,包括信息处理模块、语句分析模块、词汇匹配模块、信息提取模块和反馈模块,所述信息处理模块用于对用户问题进行接收,所述语句分析模块用于提取用户问题的关键词提取,所述词汇匹配模块用于关键词与领域的处理匹配,所述信息提取模块用于将匹配到的信息提取并进行展示,所述反馈模块用于接收用户反馈信息。
优选地,所述信息处理模块包括信息接收模块和计数模块,所述计数模块基于反馈模块的反馈结果和反馈次数。
优选地,所述语句分析模块基于AI完成提取关键词的任务。
优选地,所述信息提取模块包括分段信息提取模块和总体信息提示模块,且分段信息提取模块和总体信息提示模块基于URL进行简短展示和扩展链接。
优选地,所述反馈模块由三个对话框基于网间控制报文协议组成,且三个对话框包括满意对话框、不满意对话框以及无法继续搜索对话框。
优选地,所述满意对话框和无法继续搜索对话框基于网间控制报文协议向信息接收模块发送停止命令,所述不满意对话框基于网间控制报文协议向信息接收模块发送再次执行的命令。
本发明中,具有以下有益效果:
1、本发明通过将信息采取以本的主体方式录入,并按照章、节的分段方式进一步进行录入,同时建立独立的其他领域部分,可以在信息展示时更加具体化,同时可以针对古籍部分信息无法匹配到现有领域划分进行针对性划分;
2、本发明通过增加反馈模块可以根据用户反馈的情况进行信息提取展示,进而可以避免一次信息提取量过大,同时便于用户根据需要进行更加精准的问答。
附图说明
图1为本发明提出的一种基于古籍信息的知识图谱构建方法的流程示意图;
图2为本发明提出的一种基于古籍信息的知识图谱问答系统组成示意图;
图3为本发明提出的一种基于古籍信息的知识图谱问答系统信息处理模块组成示意图;
图4为本发明提出的一种基于古籍信息的知识图谱问答系统信息提取模块组成示意图;
图5为本发明提出的一种基于古籍信息的知识图谱问答系统反馈模块组成示意图。
具体实施方式
下面将结合本发明实施例中的附图,对本发明实施例中的技术方案进行清楚、完整地描述,显然,所描述的实施例仅仅是本发明一部分实施例,而不是全部的实施例。
在本发明的描述中,需要理解的是,术语“上”、“下”、“前”、“后”、“左”、“右”、“顶”、“底”、“内”、“外”等指示的方位或位置关系为基于附图所示的方位或位置关系,仅是为了便于描述本发明和简化描述,而不是指示或暗示所指的装置或元件必须具有特定的方位、以特定的方位构造和操作,因此不能理解为对本发明的限制。
参照图1-5,一种基于古籍信息的知识图谱构建方法,包括以下步骤:
S1、领域建立,采用常规领域模板,同时建立独立的其他领域部分,并采用存储设备进行信息存储;
S2、信息录入,将古籍按照本的主体方式录入,并按照章、节的分段方式进一步进行录入;
S3、语句分析,利用语句分析AI对分段的信息进行关键词汇提取,并建立标签;
S4、词汇领域匹配,提取的关键词汇标签与建立的领域进行匹配,一个关键词可以匹配多个领域;
S5、信息整理,将录入的分段信息分别归入关键词所述领域,其中一组分段信息可以归入不同领域中。
本发明还提出了一种基于古籍信息的知识图谱问答系统,包括信息处理模块、语句分析模块、词汇匹配模块、信息提取模块和反馈模块,简短展示信息处理模块用于对用户问题进行接收,简短展示信息处理模块包括信息接收模块和计数模块,简短展示计数模块基于反馈模块的反馈结果和反馈次数,在运用过程中,信息模块会对用户输入的问题进行接收,同时当信息模块基于反馈模块再次激活时,计数模块会对被激活次数进行计数,并基于计数次数对搜索匹配进行调整,第一被激活时,会对用户问题中的所用关键词进行匹配,并根据针对多个关键词匹配重合领域中的信息进行提取,从而保证信息展示的精准,当第信息接收模块被后续激活时,会减少用户问题中多个关键词汇其中一个的匹配,使得关键词汇的重叠领域增加,扩大匹配范围;
简短展示语句分析模块用于提取用户问题的关键词提取,简短展示语句分析模块基于AI完成提取关键词的任务,基于现有的AI程序对语句中的主谓宾等尽心分析,并提取关键词汇,同时对关键词汇进行排序;
简短展示词汇匹配模块用于关键词与领域的处理匹配,简短展示信息提取模块用于将匹配到的信息提取并进行展示,简短展示信息提取模块包括分段信息提取模块和总体信息提示模块,且分段信息提取模块和总体信息提示模块基于URL进行简短展示和扩展链接,用户可以对简短展示部分进行查看,符合需求时可以进一步点击进入扩展了解;
简短展示反馈模块用于接收用户反馈信息,简短展示反馈模块由三个对话框基于网间控制报文协议组成,且三个对话框包括满意对话框、不满意对话框以及无法继续搜索对话框,简短展示满意对话框和无法继续搜索对话框基于网间控制报文协议向信息接收模块发送停止命令,简短展示不满意对话框基于网间控制报文协议向信息接收模块发送再次执行的命令,用于对于展示的信息进行反馈,没有符合自身需要时点击不满意对话框,信息接收模块执行后续处理任务,存在符合自身需要的信息时点击满意,信息接收模块停止执行后续处理任务,不存在符合自身需求的信息同时信息接收模块已经完成多次后续任务,造成关键词不足时点击无法继续搜索对话框,信息接收模块停止执行后续任务,用户可以重新输入带有其他关键的类似问题。
本发明中,通过将信息采取以本的主体方式录入,并按照章、节的分段方式进一步进行录入,同时在展示信息时会采取分段信息展示为主,以本为单位的主体信息同样会展示,可以在信息展示时更加具体化,同时建立独立的其他领域部分,可以针对古籍部分信息无法匹配到现有领域划分进行针对性划分,通过增加反馈模块可以根据用户反馈的情况进行信息提取展示,进而可以避免一次信息提取量过大,同时可以用户反馈情况进行多次处理并展示信息,确保信息问答的顺利进行。
以上所述,仅为本发明较佳的具体实施方式,但本发明的保护范围并不局限于此,任何熟悉本技术领域的技术人员在本发明揭露的技术范围内,根据本发明的技术方案及其实用构思加以等同替换或改变,都应涵盖在本发明的保护范围之内。
Claims (7)
1.一种基于古籍信息的知识图谱构建方法,其特征在于,包括以下步骤:
S1、领域建立,采用常规领域模板,同时建立独立的其他领域部分,并采用存储设备进行信息存储;
S2、信息录入,将古籍按照本的主体方式录入,并按照章、节的分段方式进一步进行录入;
S3、语句分析,利用语句分析AI对分段的信息进行关键词汇提取,并建立标签;
S4、词汇领域匹配,提取的关键词汇标签与建立的领域进行匹配,一个关键词可以匹配多个领域;
S5、信息整理,将录入的分段信息分别归入关键词所述领域,其中一组分段信息可以归入不同领域中。
2.一种基于古籍信息的知识图谱问答系统,包括信息处理模块、语句分析模块、词汇匹配模块、信息提取模块和反馈模块,其特征在于,所述信息处理模块用于对用户问题进行接收,所述语句分析模块用于提取用户问题的关键词提取,所述词汇匹配模块用于关键词与领域的处理匹配,所述信息提取模块用于将匹配到的信息提取并进行展示,所述反馈模块用于接收用户反馈信息。
3.根据权利要求2所述的一种基于古籍信息的知识图谱问答系统,其特征在于,所述信息处理模块包括信息接收模块和计数模块,所述计数模块基于反馈模块的反馈结果和反馈次数。
4.根据权利要求2所述的一种基于古籍信息的知识图谱问答系统,其特征在于,所述语句分析模块基于AI完成提取关键词的任务。
5.根据权利要求2所述的一种基于古籍信息的知识图谱问答系统,其特征在于,所述信息提取模块包括分段信息提取模块和总体信息提示模块,且分段信息提取模块和总体信息提示模块基于URL进行简短展示和扩展链接。
6.根据权利要求2所述的一种基于古籍信息的知识图谱问答系统,其特征在于,所述反馈模块由三个对话框基于网间控制报文协议组成,且三个对话框包括满意对话框、不满意对话框以及无法继续搜索对话框。
7.根据权利要求6所述的一种基于古籍信息的知识图谱问答系统,其特征在于,所述满意对话框和无法继续搜索对话框基于网间控制报文协议向信息接收模块发送停止命令,所述不满意对话框基于网间控制报文协议向信息接收模块发送再次执行的命令。
Priority Applications (1)
Application Number | Priority Date | Filing Date | Title |
---|---|---|---|
CN202210410423.5A CN114860901A (zh) | 2022-04-19 | 2022-04-19 | 一种基于古籍信息的知识图谱构建方法及问答系统 |
Applications Claiming Priority (1)
Application Number | Priority Date | Filing Date | Title |
---|---|---|---|
CN202210410423.5A CN114860901A (zh) | 2022-04-19 | 2022-04-19 | 一种基于古籍信息的知识图谱构建方法及问答系统 |
Publications (1)
Publication Number | Publication Date |
---|---|
CN114860901A true CN114860901A (zh) | 2022-08-05 |
Family
ID=82631763
Family Applications (1)
Application Number | Title | Priority Date | Filing Date |
---|---|---|---|
CN202210410423.5A Pending CN114860901A (zh) | 2022-04-19 | 2022-04-19 | 一种基于古籍信息的知识图谱构建方法及问答系统 |
Country Status (1)
Country | Link |
---|---|
CN (1) | CN114860901A (zh) |
Cited By (1)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
CN116340544A (zh) * | 2023-04-03 | 2023-06-27 | 浙江大学 | 一种基于知识图谱的中医药古籍可视分析方法与系统 |
-
2022
- 2022-04-19 CN CN202210410423.5A patent/CN114860901A/zh active Pending
Cited By (2)
Publication number | Priority date | Publication date | Assignee | Title |
---|---|---|---|---|
CN116340544A (zh) * | 2023-04-03 | 2023-06-27 | 浙江大学 | 一种基于知识图谱的中医药古籍可视分析方法与系统 |
CN116340544B (zh) * | 2023-04-03 | 2024-02-23 | 浙江大学 | 一种基于知识图谱的中医药古籍可视分析方法与系统 |
Similar Documents
Publication | Publication Date | Title |
---|---|---|
WO2022111244A1 (zh) | 数据处理方法、装置、电子设备及存储介质 | |
CN107153965A (zh) | 一种多终端的智能客服解决方法 | |
CN108829682B (zh) | 计算机可读存储介质、智能问答方法及智能问答装置 | |
CN105677822A (zh) | 一种基于对话机器人的招生自动问答方法及系统 | |
CN109710935B (zh) | 一种基于文物知识图谱的博物馆导览与知识推荐方法 | |
CN108932278B (zh) | 基于语义框架的人机对话方法及系统 | |
CN113889259A (zh) | 一种知识图谱辅助下的自动诊断对话系统 | |
CN110019703B (zh) | 数据标记方法及装置、智能问答方法及系统 | |
CN112163424A (zh) | 数据的标注方法、装置、设备和介质 | |
CN112115252B (zh) | 智能辅助写作处理方法、装置、电子设备及存储介质 | |
CN113627797B (zh) | 入职员工画像生成方法、装置、计算机设备及存储介质 | |
CN116501960B (zh) | 内容检索方法、装置、设备及介质 | |
CN112507139B (zh) | 基于知识图谱的问答方法、系统、设备及存储介质 | |
CN111767334A (zh) | 信息抽取方法、装置、电子设备及存储介质 | |
CN108776677B (zh) | 平行语句库的创建方法、设备及计算机可读存储介质 | |
CN114860901A (zh) | 一种基于古籍信息的知识图谱构建方法及问答系统 | |
CN114065765A (zh) | 结合ai和rpa的武器装备文本处理方法、装置及电子设备 | |
CN113553419A (zh) | 民航知识图谱问答系统 | |
CN113408253A (zh) | 一种作业评阅系统及方法 | |
CN116542676A (zh) | 一种基于大数据分析的智能客服系统及其方法 | |
CN115017271B (zh) | 用于智能生成rpa流程组件块的方法及系统 | |
CN115757720A (zh) | 基于知识图谱的项目信息搜索方法、装置、设备和介质 | |
CN115640403A (zh) | 基于知识图谱的知识管控方法及装置 | |
CN112687380B (zh) | 一种医师评价系统的数据加载方法及质控平台 | |
CN112527982A (zh) | 一种设备管理系统、方法、设备及存储介质 |
Legal Events
Date | Code | Title | Description |
---|---|---|---|
PB01 | Publication | ||
PB01 | Publication | ||
SE01 | Entry into force of request for substantive examination | ||
SE01 | Entry into force of request for substantive examination |