CN114860901A - 一种基于古籍信息的知识图谱构建方法及问答系统 - Google Patents

一种基于古籍信息的知识图谱构建方法及问答系统 Download PDF

Info

Publication number
CN114860901A
CN114860901A CN202210410423.5A CN202210410423A CN114860901A CN 114860901 A CN114860901 A CN 114860901A CN 202210410423 A CN202210410423 A CN 202210410423A CN 114860901 A CN114860901 A CN 114860901A
Authority
CN
China
Prior art keywords
information
module
feedback
matching
question
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Pending
Application number
CN202210410423.5A
Other languages
English (en)
Inventor
赵志海
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Shanghai Anyi Network Technology Co ltd
Original Assignee
Shanghai Anyi Network Technology Co ltd
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Shanghai Anyi Network Technology Co ltd filed Critical Shanghai Anyi Network Technology Co ltd
Priority to CN202210410423.5A priority Critical patent/CN114860901A/zh
Publication of CN114860901A publication Critical patent/CN114860901A/zh
Pending legal-status Critical Current

Links

Images

Classifications

    • GPHYSICS
    • G06COMPUTING; CALCULATING OR COUNTING
    • G06FELECTRIC DIGITAL DATA PROCESSING
    • G06F16/00Information retrieval; Database structures therefor; File system structures therefor
    • G06F16/30Information retrieval; Database structures therefor; File system structures therefor of unstructured textual data
    • G06F16/33Querying
    • G06F16/332Query formulation
    • G06F16/3329Natural language query formulation or dialogue systems
    • GPHYSICS
    • G06COMPUTING; CALCULATING OR COUNTING
    • G06FELECTRIC DIGITAL DATA PROCESSING
    • G06F16/00Information retrieval; Database structures therefor; File system structures therefor
    • G06F16/30Information retrieval; Database structures therefor; File system structures therefor of unstructured textual data
    • G06F16/33Querying
    • G06F16/3331Query processing
    • G06F16/334Query execution
    • G06F16/3344Query execution using natural language analysis
    • GPHYSICS
    • G06COMPUTING; CALCULATING OR COUNTING
    • G06FELECTRIC DIGITAL DATA PROCESSING
    • G06F16/00Information retrieval; Database structures therefor; File system structures therefor
    • G06F16/30Information retrieval; Database structures therefor; File system structures therefor of unstructured textual data
    • G06F16/36Creation of semantic tools, e.g. ontology or thesauri
    • G06F16/367Ontology
    • GPHYSICS
    • G06COMPUTING; CALCULATING OR COUNTING
    • G06FELECTRIC DIGITAL DATA PROCESSING
    • G06F16/00Information retrieval; Database structures therefor; File system structures therefor
    • G06F16/90Details of database functions independent of the retrieved data types
    • G06F16/95Retrieval from the web
    • G06F16/955Retrieval from the web using information identifiers, e.g. uniform resource locators [URL]

Landscapes

  • Engineering & Computer Science (AREA)
  • Theoretical Computer Science (AREA)
  • Physics & Mathematics (AREA)
  • Databases & Information Systems (AREA)
  • Data Mining & Analysis (AREA)
  • General Engineering & Computer Science (AREA)
  • General Physics & Mathematics (AREA)
  • Computational Linguistics (AREA)
  • Artificial Intelligence (AREA)
  • Mathematical Physics (AREA)
  • Human Computer Interaction (AREA)
  • Life Sciences & Earth Sciences (AREA)
  • Animal Behavior & Ethology (AREA)
  • Information Retrieval, Db Structures And Fs Structures Therefor (AREA)

Abstract

本发明公开了一种基于古籍信息的知识图谱构建方法及问答系统,该方法包括以下步骤:S1、领域建立;S2、信息录入;S3、语句分析;S4、词汇领域匹配;S5、信息整理;本发明还提出了一种基于古籍信息的知识图谱问答系统,包括信息处理模块、语句分析模块、词汇匹配模块、信息提取模块和反馈模块。本发明通过将信息采取以本的主体方式录入,并按照章、节的分段方式进一步进行录入,建立独立的其他领域部分,可以在信息展示时更加具体化,同时可以针对古籍部分信息无法匹配到现有领域划分进行针对性划分,通过增加反馈模块可以根据用户反馈的情况进行信息提取展示,进而可以避免一次信息提取量过大,便于用户根据需要进行更加精准的问答。

Description

一种基于古籍信息的知识图谱构建方法及问答系统
技术领域
本发明涉及古籍信息处理技术领域,尤其涉及一种基于古籍信息的知识图谱构建方法及问答系统。
背景技术
古籍,是指未采用现代印刷技术印制的书籍,是人们对历史研究的重要途径之一,随着社会的不断进步,人们生活水平的不断提升,对于文化建设的意识也不断提升,而古籍整理工程就是文化建设过程中重要的项目之一,伴随着计算机网络的普及,古籍信息整理展示工程与计算机网络结合也成为一种趋势,在将古籍信息与计算机网络结合时,常常会用到知识图谱构建的方式,使得古籍信息在调取使用时更加便捷,同时部分知识图谱构建时还会同时建立问答系统,进一步便于后续使用人员进行快速调取。
现有的基于古籍信息的知识图谱构建方法及问答系统,其问答系统在使用时,往往是使用人员输入提问问题后,系统根据问题中包含的关键词将所有信息全部提取出来并进行展示,这就导致系统在提取过程中需要提取的信息量巨大,增加了网络负荷,同时由于信息量巨大,使得使用人员需要人为对信息进行进一步查找筛选,造成使用人员在使用时不够便捷,所以,需要设计一种一种基于古籍信息的知识图谱构建方法及问答系统来解决上述问题。
发明内容
本发明的目的是为了解决现有技术中存在的缺点,而提出的一种一种基于古籍信息的知识图谱构建方法及问答系统。
为了实现上述目的,本发明采用了如下技术方案:
一种基于古籍信息的知识图谱构建方法,包括以下步骤:
S1、领域建立,采用常规领域模板,同时建立独立的其他领域部分,并采用存储设备进行信息存储;
S2、信息录入,将古籍按照本的主体方式录入,并按照章、节的分段方式进一步进行录入;
S3、语句分析,利用语句分析AI对分段的信息进行关键词汇提取,并建立标签;
S4、词汇领域匹配,提取的关键词汇标签与建立的领域进行匹配,一个关键词可以匹配多个领域;
S5、信息整理,将录入的分段信息分别归入关键词所述领域,其中一组分段信息可以归入不同领域中。
本发明还提出了一种基于古籍信息的知识图谱问答系统,包括信息处理模块、语句分析模块、词汇匹配模块、信息提取模块和反馈模块,所述信息处理模块用于对用户问题进行接收,所述语句分析模块用于提取用户问题的关键词提取,所述词汇匹配模块用于关键词与领域的处理匹配,所述信息提取模块用于将匹配到的信息提取并进行展示,所述反馈模块用于接收用户反馈信息。
优选地,所述信息处理模块包括信息接收模块和计数模块,所述计数模块基于反馈模块的反馈结果和反馈次数。
优选地,所述语句分析模块基于AI完成提取关键词的任务。
优选地,所述信息提取模块包括分段信息提取模块和总体信息提示模块,且分段信息提取模块和总体信息提示模块基于URL进行简短展示和扩展链接。
优选地,所述反馈模块由三个对话框基于网间控制报文协议组成,且三个对话框包括满意对话框、不满意对话框以及无法继续搜索对话框。
优选地,所述满意对话框和无法继续搜索对话框基于网间控制报文协议向信息接收模块发送停止命令,所述不满意对话框基于网间控制报文协议向信息接收模块发送再次执行的命令。
本发明中,具有以下有益效果:
1、本发明通过将信息采取以本的主体方式录入,并按照章、节的分段方式进一步进行录入,同时建立独立的其他领域部分,可以在信息展示时更加具体化,同时可以针对古籍部分信息无法匹配到现有领域划分进行针对性划分;
2、本发明通过增加反馈模块可以根据用户反馈的情况进行信息提取展示,进而可以避免一次信息提取量过大,同时便于用户根据需要进行更加精准的问答。
附图说明
图1为本发明提出的一种基于古籍信息的知识图谱构建方法的流程示意图;
图2为本发明提出的一种基于古籍信息的知识图谱问答系统组成示意图;
图3为本发明提出的一种基于古籍信息的知识图谱问答系统信息处理模块组成示意图;
图4为本发明提出的一种基于古籍信息的知识图谱问答系统信息提取模块组成示意图;
图5为本发明提出的一种基于古籍信息的知识图谱问答系统反馈模块组成示意图。
具体实施方式
下面将结合本发明实施例中的附图,对本发明实施例中的技术方案进行清楚、完整地描述,显然,所描述的实施例仅仅是本发明一部分实施例,而不是全部的实施例。
在本发明的描述中,需要理解的是,术语“上”、“下”、“前”、“后”、“左”、“右”、“顶”、“底”、“内”、“外”等指示的方位或位置关系为基于附图所示的方位或位置关系,仅是为了便于描述本发明和简化描述,而不是指示或暗示所指的装置或元件必须具有特定的方位、以特定的方位构造和操作,因此不能理解为对本发明的限制。
参照图1-5,一种基于古籍信息的知识图谱构建方法,包括以下步骤:
S1、领域建立,采用常规领域模板,同时建立独立的其他领域部分,并采用存储设备进行信息存储;
S2、信息录入,将古籍按照本的主体方式录入,并按照章、节的分段方式进一步进行录入;
S3、语句分析,利用语句分析AI对分段的信息进行关键词汇提取,并建立标签;
S4、词汇领域匹配,提取的关键词汇标签与建立的领域进行匹配,一个关键词可以匹配多个领域;
S5、信息整理,将录入的分段信息分别归入关键词所述领域,其中一组分段信息可以归入不同领域中。
本发明还提出了一种基于古籍信息的知识图谱问答系统,包括信息处理模块、语句分析模块、词汇匹配模块、信息提取模块和反馈模块,简短展示信息处理模块用于对用户问题进行接收,简短展示信息处理模块包括信息接收模块和计数模块,简短展示计数模块基于反馈模块的反馈结果和反馈次数,在运用过程中,信息模块会对用户输入的问题进行接收,同时当信息模块基于反馈模块再次激活时,计数模块会对被激活次数进行计数,并基于计数次数对搜索匹配进行调整,第一被激活时,会对用户问题中的所用关键词进行匹配,并根据针对多个关键词匹配重合领域中的信息进行提取,从而保证信息展示的精准,当第信息接收模块被后续激活时,会减少用户问题中多个关键词汇其中一个的匹配,使得关键词汇的重叠领域增加,扩大匹配范围;
简短展示语句分析模块用于提取用户问题的关键词提取,简短展示语句分析模块基于AI完成提取关键词的任务,基于现有的AI程序对语句中的主谓宾等尽心分析,并提取关键词汇,同时对关键词汇进行排序;
简短展示词汇匹配模块用于关键词与领域的处理匹配,简短展示信息提取模块用于将匹配到的信息提取并进行展示,简短展示信息提取模块包括分段信息提取模块和总体信息提示模块,且分段信息提取模块和总体信息提示模块基于URL进行简短展示和扩展链接,用户可以对简短展示部分进行查看,符合需求时可以进一步点击进入扩展了解;
简短展示反馈模块用于接收用户反馈信息,简短展示反馈模块由三个对话框基于网间控制报文协议组成,且三个对话框包括满意对话框、不满意对话框以及无法继续搜索对话框,简短展示满意对话框和无法继续搜索对话框基于网间控制报文协议向信息接收模块发送停止命令,简短展示不满意对话框基于网间控制报文协议向信息接收模块发送再次执行的命令,用于对于展示的信息进行反馈,没有符合自身需要时点击不满意对话框,信息接收模块执行后续处理任务,存在符合自身需要的信息时点击满意,信息接收模块停止执行后续处理任务,不存在符合自身需求的信息同时信息接收模块已经完成多次后续任务,造成关键词不足时点击无法继续搜索对话框,信息接收模块停止执行后续任务,用户可以重新输入带有其他关键的类似问题。
本发明中,通过将信息采取以本的主体方式录入,并按照章、节的分段方式进一步进行录入,同时在展示信息时会采取分段信息展示为主,以本为单位的主体信息同样会展示,可以在信息展示时更加具体化,同时建立独立的其他领域部分,可以针对古籍部分信息无法匹配到现有领域划分进行针对性划分,通过增加反馈模块可以根据用户反馈的情况进行信息提取展示,进而可以避免一次信息提取量过大,同时可以用户反馈情况进行多次处理并展示信息,确保信息问答的顺利进行。
以上所述,仅为本发明较佳的具体实施方式,但本发明的保护范围并不局限于此,任何熟悉本技术领域的技术人员在本发明揭露的技术范围内,根据本发明的技术方案及其实用构思加以等同替换或改变,都应涵盖在本发明的保护范围之内。

Claims (7)

1.一种基于古籍信息的知识图谱构建方法,其特征在于,包括以下步骤:
S1、领域建立,采用常规领域模板,同时建立独立的其他领域部分,并采用存储设备进行信息存储;
S2、信息录入,将古籍按照本的主体方式录入,并按照章、节的分段方式进一步进行录入;
S3、语句分析,利用语句分析AI对分段的信息进行关键词汇提取,并建立标签;
S4、词汇领域匹配,提取的关键词汇标签与建立的领域进行匹配,一个关键词可以匹配多个领域;
S5、信息整理,将录入的分段信息分别归入关键词所述领域,其中一组分段信息可以归入不同领域中。
2.一种基于古籍信息的知识图谱问答系统,包括信息处理模块、语句分析模块、词汇匹配模块、信息提取模块和反馈模块,其特征在于,所述信息处理模块用于对用户问题进行接收,所述语句分析模块用于提取用户问题的关键词提取,所述词汇匹配模块用于关键词与领域的处理匹配,所述信息提取模块用于将匹配到的信息提取并进行展示,所述反馈模块用于接收用户反馈信息。
3.根据权利要求2所述的一种基于古籍信息的知识图谱问答系统,其特征在于,所述信息处理模块包括信息接收模块和计数模块,所述计数模块基于反馈模块的反馈结果和反馈次数。
4.根据权利要求2所述的一种基于古籍信息的知识图谱问答系统,其特征在于,所述语句分析模块基于AI完成提取关键词的任务。
5.根据权利要求2所述的一种基于古籍信息的知识图谱问答系统,其特征在于,所述信息提取模块包括分段信息提取模块和总体信息提示模块,且分段信息提取模块和总体信息提示模块基于URL进行简短展示和扩展链接。
6.根据权利要求2所述的一种基于古籍信息的知识图谱问答系统,其特征在于,所述反馈模块由三个对话框基于网间控制报文协议组成,且三个对话框包括满意对话框、不满意对话框以及无法继续搜索对话框。
7.根据权利要求6所述的一种基于古籍信息的知识图谱问答系统,其特征在于,所述满意对话框和无法继续搜索对话框基于网间控制报文协议向信息接收模块发送停止命令,所述不满意对话框基于网间控制报文协议向信息接收模块发送再次执行的命令。
CN202210410423.5A 2022-04-19 2022-04-19 一种基于古籍信息的知识图谱构建方法及问答系统 Pending CN114860901A (zh)

Priority Applications (1)

Application Number Priority Date Filing Date Title
CN202210410423.5A CN114860901A (zh) 2022-04-19 2022-04-19 一种基于古籍信息的知识图谱构建方法及问答系统

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
CN202210410423.5A CN114860901A (zh) 2022-04-19 2022-04-19 一种基于古籍信息的知识图谱构建方法及问答系统

Publications (1)

Publication Number Publication Date
CN114860901A true CN114860901A (zh) 2022-08-05

Family

ID=82631763

Family Applications (1)

Application Number Title Priority Date Filing Date
CN202210410423.5A Pending CN114860901A (zh) 2022-04-19 2022-04-19 一种基于古籍信息的知识图谱构建方法及问答系统

Country Status (1)

Country Link
CN (1) CN114860901A (zh)

Cited By (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
CN116340544A (zh) * 2023-04-03 2023-06-27 浙江大学 一种基于知识图谱的中医药古籍可视分析方法与系统

Cited By (2)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
CN116340544A (zh) * 2023-04-03 2023-06-27 浙江大学 一种基于知识图谱的中医药古籍可视分析方法与系统
CN116340544B (zh) * 2023-04-03 2024-02-23 浙江大学 一种基于知识图谱的中医药古籍可视分析方法与系统

Similar Documents

Publication Publication Date Title
US8346533B2 (en) Compiling word usage frequencies
CN112631997B (zh) 数据处理方法、装置、终端及存储介质
CN107153965A (zh) 一种多终端的智能客服解决方法
CN105677822A (zh) 一种基于对话机器人的招生自动问答方法及系统
CN109710935B (zh) 一种基于文物知识图谱的博物馆导览与知识推荐方法
CN108932278B (zh) 基于语义框架的人机对话方法及系统
CN113889259A (zh) 一种知识图谱辅助下的自动诊断对话系统
CN112163424A (zh) 数据的标注方法、装置、设备和介质
CN111192024A (zh) 一种基于强化学习的人岗匹配方法及装置
CN112115252A (zh) 智能辅助写作处理方法、装置、电子设备及存储介质
CN113627797B (zh) 入职员工画像生成方法、装置、计算机设备及存储介质
CN112507139B (zh) 基于知识图谱的问答方法、系统、设备及存储介质
CN116501960B (zh) 内容检索方法、装置、设备及介质
CN108776677B (zh) 平行语句库的创建方法、设备及计算机可读存储介质
CN111767334A (zh) 信息抽取方法、装置、电子设备及存储介质
CN113902009A (zh) 一种简历分析方法、装置、电子设备、介质及产品
CN114860901A (zh) 一种基于古籍信息的知识图谱构建方法及问答系统
CN114065765A (zh) 结合ai和rpa的武器装备文本处理方法、装置及电子设备
CN113553419A (zh) 民航知识图谱问答系统
CN114253990A (zh) 数据库查询方法、装置、计算机设备和存储介质
CN113408253A (zh) 一种作业评阅系统及方法
CN116542676A (zh) 一种基于大数据分析的智能客服系统及其方法
CN115017271B (zh) 用于智能生成rpa流程组件块的方法及系统
CN115640403A (zh) 基于知识图谱的知识管控方法及装置
CN112687380B (zh) 一种医师评价系统的数据加载方法及质控平台

Legal Events

Date Code Title Description
PB01 Publication
PB01 Publication
SE01 Entry into force of request for substantive examination
SE01 Entry into force of request for substantive examination