问答模块的魔法(三)——医药知识图谱后端接口的妙用
bigegpt 2024-10-07 06:27 5 浏览
零、前言
在上篇文章中,我们共同领略了数据在Neo4j中的奇妙旅程。讲述了如何将拿到的数据存储到neo4j数据库中。
医药知识图谱的神秘面纱逐渐在迷雾中揭开,今日我们将进入系列的核心部分——问答模块。
穿插一下题外话,发现越到后面的文章,观众越少了= =、寥寥无几的阅读量。
不管怎样,这也算是对自己知识的一种复习和检验,如果你看到了这篇文章,觉得不错的话麻烦点歌赞呗~
好了~言归正传。在这个项目中,问题分类器、问题解析器、答案搜索器是核心点。
它们将如何共同演奏出医学知识的奇幻交响曲?让我们一同揭开这场数字医学的智慧之旅吧~
一、结论
开门见山,直接先展示项目的结果。以下为各种问题的后端接口展示
1.贫血的原因有哪些?
2.风寒不能吃什么食物?
3.感冒治好的概率有多少?
4.番茄对哪些疾病有用处?
5.有些逻辑错误搜索不到结果是的默认回答
接口终于大功告成,这个部分的项目还是有点麻烦的。
当然也存在不少的问题回答不了,这与实现的内部原理有关。接下来就会详细说一下新项目和原项目的调整内容。
二、新旧项目的对比
2.1 输出结果的形式
原项目以命令行窗口的形式输出结果
新项目以接口的形式输出结果
2.2 修改部分逻辑
原项目中对治疗方式并没有采取结点的形式存储,而新项目中的治疗方式为结点的形式存储。
因此在构造sql语句这部分的逻辑是需要改变的。
2.3 问句类型记录方式
原项目中每个情况直接采用字符串的形式,在问题分类器、问题解析器、答案搜集器中需输入多遍。
新项目中将这些字符串统一存放在const.py文件中,可以有效避免字符串输错的低级错误。
三、flask项目搭建
3.1 代码结构
如下图:
每个文件的功能
文件 | 子文件 | 描述 |
app.py | 后端接口项目的启动文件 | |
const.py | 存放一些常量的文件 | |
utils.py | 存放一些工具函数的文件 | |
views.py | 处理接口传来参数的逻辑函数 | |
process | prepare.py | 核心逻辑的主文件 |
questionClassifier.py | 核心逻辑中的问题分类器内容 | |
questionParser.py | 核心逻辑中的问题解析器内容 | |
answerSearch.py | 核心逻辑中的答案生成器内容 | |
dict | 好几个txt文件 | 各个文件存放所有节点的name,用于多关键词匹配时会用到 |
3.2 核心代码讲述
本项目的核心内容有三个:问题分类器、问题解析器、答案搜索器。下面为这三个内容的详细剖析
1.问题分类器
首先,问题分类器运行的过程如下:
所谓问题分类器,就是根据问句将问题归类。可视化的例子:以头痛的原因有哪些为例。
如下图:
关于疾病的种类一共分为以下18种:
# 问题类型
# 查询疾病的原因
QUESTION_TYPE_DISEASE_CAUSE = "disease_cause"
# 查询疾病的防御措施
QUESTION_TYPE_DISEASE_PREVENT = 'disease_prevent'
# 查询疾病的持续时间
QUESTION_TYPE_DISEASE_DURATION = 'disease_duration'
# 查询疾病的治愈概率
QUESTION_TYPE_DISEASE_CURE_RATE = 'disease_cure_rate'
# 查询疾病的治疗方式
QUESTION_TYPE_DISEASE_CURE_METHODS = 'disease_cure_methods'
# 查询疾病的易发人群
QUESTION_TYPE_DISEASE_SUSCEPTIBLE_PERSON = 'disease_susceptible_person'
# 查询疾病的相关介绍
QUESTION_TYPE_DISEASE_DESC = 'disease_desc'
# 查询疾病有哪些症状
QUESTION_TYPE_DISEASE_SYMPTOM = 'disease_symptom'
# 查询症状会导致哪些疾病
QUESTION_TYPE_SYMPTOM_DISEASE = 'symptom_disease'
# 查询疾病的并发症
QUESTION_TYPE_DISEASE_COMPLICATION = 'disease_complication'
# 查询疾病的忌口
QUESTION_TYPE_DISEASE_AVOIDING_FOOD = 'disease_avoiding_food'
# 查询疾病建议吃的东西
QUESTION_TYPE_DISEASE_EDIBLE = 'disease_edible'
# 已知忌口查疾病
QUESTION_TYPE_AVOIDING_FOOD_DISEASE = 'avoiding_food_disease'
# 已知推荐查疾病
QUESTION_TYPE_EDIBLE_DISEASE = 'edible_disease'
# 查询疾病常用药品-药品别名记得扩充
QUESTION_TYPE_DISEASE_DRUG = 'disease_drug'
# 已知药品查询能够治疗的疾病
QUESTION_TYPE_DRUG_DISEASE = 'drug_disease'
# 查询疾病应该进行的检查
QUESTION_TYPE_DISEASE_INSPECT = 'disease_inspect'
# 已知检查查询疾病
QUESTION_TYPE_INSPECT_DISEASE = 'inspect_disease'
2.问题解析器
问题分类器运行的过程如下:
针对不同的问句类型,生成不同的sql语句。以头痛是什么原因造成的,就会生成下面的sql语句
MATCH (m:Disease) where m.name = '头痛' return m.name, m.cause
3.答案搜索器
答案搜索器运行的过程如下:
答题模板的部分模板内容如下:
- 疾病预防类型:【xxx的预防措施包括:yyy】xxx为疾病名称,yyy为描述
- 疾病常用药品类型:【xxx通常的使用的药品包括:yyy】xxx为疾病名称,yyy为常用药品
- 疾病检查项目类型:【xxx通常可以通过以下方式检查出来:yyy】xxx为疾病名称,yyy为检查的项目
这里展示下其他类型的模板
3.3 多关键词快速匹配算法
这里涉及到了一个ahocorasick算法,这里简单介绍一下它的内容和应用。
想象一下这样一个场景,如果我们有一句话,需要看一下有没有我们对应的关键词内容。正常的思路代码是这样的:时间复杂度为O(N*M),其中N为text文本长度,M为关键字个数。
def originMatch(text, keywords):
for i in range(len(keywords)):
keyword = keywords[i]
if keyword in text:
print(f"关键词{keyword}匹配成功")
text = "abccab"
keywords = ["ab", "bc", "ca"]
originMatch(text, keywords)
而ahocorasick算法将这类多关键词匹配文本的算法时间复杂度降到了O(N),即:只与文本长度有关。
我在解析原项目的时候碰到这个算法就去学习相关内容了,之前写过一篇文章,不懂的但是想知道的同学可以看看。这篇文章就不多叙述这个算法的内容了,主要讲项目。
3.4 其他内容补充
在项目跑起来之前,我们的问题分类器、问题解析器和答案搜素器都需要做相应的初始化内容。
因此关于该函数的调用,我将其运行在flask项目中的app前。
代码如下:
from flask import Flask, request, jsonify
from flask_cors import CORS
from utils import wrapFailData
from const import ERROR_INVALID_PARAMS
from views import processQuestion
from process.prepare import prepareProcess
app = Flask(__name__)
# 支持所有跨域
CORS(app)
handle = prepareProcess()
# 获取接口
@app.route('/getAnswer', methods=['POST'])
def getAnswer():
params = request.get_json()
if params is not None and 'question' in params:
question = params['question']
return jsonify(processQuestion(handle, question))
else:
return jsonify(wrapFailData(**ERROR_INVALID_PARAMS))
if __name__ == '__main__':
# app.debug = True
app.run(port=5004)
其中handle = prepareProcess()这一行代码就是做初始化的过程,执行的效果图如下:
四、结语
在整个医药知识图谱系列项目中,本节是最核心关键的内容,直接与问答系统的核心绑定。因此也花了不少的功夫去理解并且重构这部分的内容,也算是有所收获吧。
不容易呀不容易呀~,各位看客老爷要是觉得本文不错的话,点个赞呗~求求啦
五、附
5.1 后续工作
这个项目的重构,终于完成了四分之三,即:原始数据的获取、实体关系的构建、问答系统后端接口搭建。
后续还有最后一个项目,距离胜利的终点,就差一步!
1.前端页面展示项目:打算做成chatGPT相似的页面进行问答展示
5.2 本文源码
源码地址如下:这篇文章的内容涉及的项目为project下的backend文件夹中
https://gitee.com/yz6zy/medical-kgsystem
相关推荐
- 5分钟调色大片的方法(5分钟调色大片的方法有哪些)
-
哈喽大家好。在大家印象中一定觉得ps非常难学非常难。大家不要着急,小编的教学都是针对ps零基础的同学的,而且非常实用哦。只要大家跟着图文练习一两遍,保证大家立马学会~!好了,废话少说,下面开始我们今天...
- 闪白特效原来是这么用的(闪白特效怎么使用)
-
作者|高艳侠订阅|010-86092062闪白特效是影视作品中应用比较多的效果之一,那么具体该在哪些场景使用闪白特效?具体该如何操作?下面就以AdobePremiere(以下简称PR)为例,...
- ppt常用小图标去哪里找?3个矢量素材网站推荐!
-
ppt是一个注重可视化表达的演示载体,除了高清图片,ppt中另一类常用的素材是各种小图标,也叫矢量图标,巧妙运用小图标能提升整体美观度和表现力,那么ppt常用小图标去哪里找呢?为方便各位快速找到合适的...
- 有什么好用的截图录屏工具?试试这9款
-
经常有朋友反馈苦于缺乏截屏和录屏的趁手工具,本期我们分享几个相当好用的截屏和录屏工具,希望能帮到大家。ScreenToGifScreenToGif是一款免费且开源的录屏工具。此款工具最大的特点是可以...
- 配色苦手福音!专业快速色环配色PS插件
-
今天橘子老师给的大家介绍的是一款快速配色的插件,非常强大配色苦手福音来啦!(获取方式见文末)【插件介绍】配色在后期设计中占有主导地位,好的配色能让作品更加抢眼Coolorus这款专业的配色插件,能够...
- 如何用PS抠主体?(ps怎么抠主体)
-
1.主体法抠图-抠花苞和花梗导入一张荷花苞的照片,点击上图中顶部“选择”菜单栏,下拉单击“主体”。可以看到,只有花苞被选中,但是花梗并没有被选中。接下来单击上图中左侧工具栏的“快速选择工具”,上图中顶...
- 2799元的4K电视,有保障吗?(买4k电视机哪个品牌好)
-
在上一期《电脑报》的3·15专题报道中,我们揭露了一款不靠谱的42英寸4K智能电视——TCLD42A561U。这款售价2699元的4K智能电视不仅4K画质方面存在严重问题,而且各种功能和应用体验也不理...
- 苹果电脑的Touch Bar推出一段时间了 这款工具可以帮你开发适用于它的APP
-
距离苹果推出带有TouchBar的MacBookPro已经有一段时间了,除了那些像Adobe、Google和Microsoft大公司在开发适用于TouchBar的应用之外,其实还有很多独立的开...
- 如魔法般吸取颜色的桌灯(如魔法般吸取颜色的桌灯叫什么)
-
色彩为生活带来的感官刺激,逐渐被视为理所当然。一盏桌灯运用它的神奇力量,将隐藏于物件中的颜色逐一释放,成为装点环境的空间魔法师。ColorUp是一款可以改变颜色的吸色台灯,沿用传统灯泡的造型,融入了拾...
- 一篇文章带你用jquery mobile设计颜色拾取器
-
【一、项目背景】现实生活中,我们经常会遇到配色的问题,这个时候去百度一下RGB表。而RGB表只提供相对于的颜色的RGB值而没有可以验证的模块。我们可以通过jquerymobile去设计颜色的拾取器...
- ps拾色器快捷键是什么?(ps2019拾色器快捷键)
-
ps拾色器快捷键是什么?文章末尾有获取方式,按照以下步骤就能自动获得!学会制作PS特效需要一定程度的耐心和毅力。初学者可以从基本的工具和技术开始学习,逐渐提高他们的技能水平。同时,观看更多优秀的特效作...
- 免费开源的 Windows 截图录屏工具,支持 OCR 识别和滚动截图等
-
功能很强大、安装很小巧的免费截图、录屏工具,提供很多使用的工具来帮我么能解决问题,推荐给大家。关于ShareXShareX是一款免费的windows工具,起初是一个小巧的截图工具,经过多年的迭...
- 入门到精通系列PS教程:第13篇 · 拾色器、颜色问题说明及补充
-
入门到精通系列PS教程:第13篇·拾色器、颜色问题说明及补充作者|侯潇问题说明我的第12篇教程里,有个小问题没有说清楚。要说是错误,又不算是错误,只是没有说准确。写完那篇教程后,因为已经到了深...
- PS冷知识:用吸管工具吸取屏幕上的任意颜色
-
今天,我们给大家介绍PS中的一个冷知识:用吸管工具可以吸取屏幕上的任意颜色。其实,操作起来是非常简单的。大多数情况下,我们认为,PS的吸管工具只能吸取PS软件作图区域范围内的颜色,最多加上画布四周的...
- Windows 11 将提供内置颜色选择器工具
-
Windows11内置了颜色选择器,可以扫描并识别屏幕上的颜色并生成颜色代码。此外,微软还利用人工智能技术,让屏幕上的文本扫描和选择变得更加便捷。这两项功能均已在SnippingToolv1...
- 一周热门
- 最近发表
- 标签列表
-
- mybatiscollection (79)
- mqtt服务器 (88)
- keyerror (78)
- c#map (65)
- xftp6 (83)
- bt搜索 (75)
- c#var (76)
- xcode-select (66)
- mysql授权 (74)
- 下载测试 (70)
- linuxlink (65)
- pythonwget (67)
- androidinclude (65)
- libcrypto.so (74)
- linux安装minio (74)
- ubuntuunzip (67)
- vscode使用技巧 (83)
- secure-file-priv (67)
- vue阻止冒泡 (67)
- jquery跨域 (68)
- php写入文件 (73)
- kafkatools (66)
- mysql导出数据库 (66)
- jquery鼠标移入移出 (71)
- 取小数点后两位的函数 (73)