百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 热门文章 > 正文

问答模块的魔法(三)——医药知识图谱后端接口的妙用

bigegpt 2024-10-07 06:27 5 浏览

零、前言

在上篇文章中,我们共同领略了数据在Neo4j中的奇妙旅程。讲述了如何将拿到的数据存储到neo4j数据库中。

数据的魔法(二)— 医药知识图谱在Neo4j中的奇妙旅程

医药知识图谱的神秘面纱逐渐在迷雾中揭开,今日我们将进入系列的核心部分——问答模块

穿插一下题外话,发现越到后面的文章,观众越少了= =、寥寥无几的阅读量。

不管怎样,这也算是对自己知识的一种复习和检验,如果你看到了这篇文章,觉得不错的话麻烦点歌赞呗~

好了~言归正传。在这个项目中,问题分类器、问题解析器、答案搜索器是核心点。

它们将如何共同演奏出医学知识的奇幻交响曲?让我们一同揭开这场数字医学的智慧之旅吧~

一、结论

开门见山,直接先展示项目的结果。以下为各种问题的后端接口展示

1.贫血的原因有哪些?

2.风寒不能吃什么食物?

3.感冒治好的概率有多少?

4.番茄对哪些疾病有用处?

5.有些逻辑错误搜索不到结果是的默认回答

接口终于大功告成,这个部分的项目还是有点麻烦的。

当然也存在不少的问题回答不了,这与实现的内部原理有关。接下来就会详细说一下新项目和原项目的调整内容。

二、新旧项目的对比

2.1 输出结果的形式

原项目以命令行窗口的形式输出结果

新项目以接口的形式输出结果

2.2 修改部分逻辑

原项目中对治疗方式并没有采取结点的形式存储,而新项目中的治疗方式为结点的形式存储。

因此在构造sql语句这部分的逻辑是需要改变的。

2.3 问句类型记录方式

原项目中每个情况直接采用字符串的形式,在问题分类器、问题解析器、答案搜集器中需输入多遍。

新项目中将这些字符串统一存放在const.py文件中,可以有效避免字符串输错的低级错误。

三、flask项目搭建

3.1 代码结构

如下图:

每个文件的功能

文件

子文件

描述

app.py


后端接口项目的启动文件

const.py


存放一些常量的文件

utils.py


存放一些工具函数的文件

views.py


处理接口传来参数的逻辑函数

process

prepare.py

核心逻辑的主文件


questionClassifier.py

核心逻辑中的问题分类器内容


questionParser.py

核心逻辑中的问题解析器内容


answerSearch.py

核心逻辑中的答案生成器内容

dict

好几个txt文件

各个文件存放所有节点的name,用于多关键词匹配时会用到

3.2 核心代码讲述

本项目的核心内容有三个:问题分类器、问题解析器、答案搜索器。下面为这三个内容的详细剖析

1.问题分类器

首先,问题分类器运行的过程如下:

所谓问题分类器,就是根据问句将问题归类。可视化的例子:以头痛的原因有哪些为例。

如下图:

关于疾病的种类一共分为以下18种

# 问题类型
# 查询疾病的原因
QUESTION_TYPE_DISEASE_CAUSE = "disease_cause"
# 查询疾病的防御措施
QUESTION_TYPE_DISEASE_PREVENT = 'disease_prevent'
# 查询疾病的持续时间
QUESTION_TYPE_DISEASE_DURATION = 'disease_duration'
# 查询疾病的治愈概率
QUESTION_TYPE_DISEASE_CURE_RATE = 'disease_cure_rate'
# 查询疾病的治疗方式
QUESTION_TYPE_DISEASE_CURE_METHODS = 'disease_cure_methods'
# 查询疾病的易发人群
QUESTION_TYPE_DISEASE_SUSCEPTIBLE_PERSON = 'disease_susceptible_person'
# 查询疾病的相关介绍
QUESTION_TYPE_DISEASE_DESC = 'disease_desc'
# 查询疾病有哪些症状
QUESTION_TYPE_DISEASE_SYMPTOM = 'disease_symptom'
# 查询症状会导致哪些疾病
QUESTION_TYPE_SYMPTOM_DISEASE = 'symptom_disease'
# 查询疾病的并发症
QUESTION_TYPE_DISEASE_COMPLICATION = 'disease_complication'
# 查询疾病的忌口
QUESTION_TYPE_DISEASE_AVOIDING_FOOD = 'disease_avoiding_food'
# 查询疾病建议吃的东西
QUESTION_TYPE_DISEASE_EDIBLE = 'disease_edible'
# 已知忌口查疾病
QUESTION_TYPE_AVOIDING_FOOD_DISEASE = 'avoiding_food_disease'
# 已知推荐查疾病
QUESTION_TYPE_EDIBLE_DISEASE = 'edible_disease'
# 查询疾病常用药品-药品别名记得扩充
QUESTION_TYPE_DISEASE_DRUG = 'disease_drug'
# 已知药品查询能够治疗的疾病
QUESTION_TYPE_DRUG_DISEASE = 'drug_disease'
# 查询疾病应该进行的检查
QUESTION_TYPE_DISEASE_INSPECT = 'disease_inspect'
# 已知检查查询疾病
QUESTION_TYPE_INSPECT_DISEASE = 'inspect_disease'

2.问题解析器

问题分类器运行的过程如下:

针对不同的问句类型,生成不同的sql语句。以头痛是什么原因造成的,就会生成下面的sql语句

MATCH (m:Disease) where m.name = '头痛' return m.name, m.cause

3.答案搜索器

答案搜索器运行的过程如下:

答题模板的部分模板内容如下:

  • 疾病预防类型:【xxx的预防措施包括:yyy】xxx为疾病名称,yyy为描述
  • 疾病常用药品类型:【xxx通常的使用的药品包括:yyy】xxx为疾病名称,yyy为常用药品
  • 疾病检查项目类型:【xxx通常可以通过以下方式检查出来:yyy】xxx为疾病名称,yyy为检查的项目

这里展示下其他类型的模板

3.3 多关键词快速匹配算法

这里涉及到了一个ahocorasick算法,这里简单介绍一下它的内容和应用。

想象一下这样一个场景,如果我们有一句话,需要看一下有没有我们对应的关键词内容。正常的思路代码是这样的:时间复杂度为O(N*M),其中N为text文本长度,M为关键字个数

def originMatch(text, keywords):
    for i in range(len(keywords)):
        keyword = keywords[i]
        if keyword in text:
            print(f"关键词{keyword}匹配成功")

text = "abccab"
keywords = ["ab", "bc", "ca"]
originMatch(text, keywords)

而ahocorasick算法将这类多关键词匹配文本的算法时间复杂度降到了O(N),即:只与文本长度有关。

我在解析原项目的时候碰到这个算法就去学习相关内容了,之前写过一篇文章,不懂的但是想知道的同学可以看看。这篇文章就不多叙述这个算法的内容了,主要讲项目。

ahocorasick算法

3.4 其他内容补充

在项目跑起来之前,我们的问题分类器、问题解析器和答案搜素器都需要做相应的初始化内容。

因此关于该函数的调用,我将其运行在flask项目中的app前。

代码如下:

from flask import Flask, request, jsonify
from flask_cors import CORS

from utils import wrapFailData
from const import ERROR_INVALID_PARAMS
from views import processQuestion
from process.prepare import prepareProcess
app = Flask(__name__)
# 支持所有跨域
CORS(app)

handle = prepareProcess()

# 获取接口
@app.route('/getAnswer', methods=['POST'])
def getAnswer():
    params = request.get_json()
    if params is not None and 'question' in params:
        question = params['question']
        return jsonify(processQuestion(handle, question))
    else:
        return jsonify(wrapFailData(**ERROR_INVALID_PARAMS))


if __name__ == '__main__':
    # app.debug = True
    app.run(port=5004)

其中handle = prepareProcess()这一行代码就是做初始化的过程,执行的效果图如下:

四、结语

在整个医药知识图谱系列项目中,本节是最核心关键的内容,直接与问答系统的核心绑定。因此也花了不少的功夫去理解并且重构这部分的内容,也算是有所收获吧。

不容易呀不容易呀~,各位看客老爷要是觉得本文不错的话,点个赞呗~求求啦

五、附

5.1 后续工作

这个项目的重构,终于完成了四分之三,即:原始数据的获取、实体关系的构建、问答系统后端接口搭建。

后续还有最后一个项目,距离胜利的终点,就差一步!

1.前端页面展示项目:打算做成chatGPT相似的页面进行问答展示

5.2 本文源码

源码地址如下:这篇文章的内容涉及的项目为project下的backend文件夹中

https://gitee.com/yz6zy/medical-kgsystem

#2023年度创作挑战##微头条激励计划#

相关推荐

5分钟调色大片的方法(5分钟调色大片的方法有哪些)

哈喽大家好。在大家印象中一定觉得ps非常难学非常难。大家不要着急,小编的教学都是针对ps零基础的同学的,而且非常实用哦。只要大家跟着图文练习一两遍,保证大家立马学会~!好了,废话少说,下面开始我们今天...

闪白特效原来是这么用的(闪白特效怎么使用)

作者|高艳侠订阅|010-86092062闪白特效是影视作品中应用比较多的效果之一,那么具体该在哪些场景使用闪白特效?具体该如何操作?下面就以AdobePremiere(以下简称PR)为例,...

ppt常用小图标去哪里找?3个矢量素材网站推荐!

ppt是一个注重可视化表达的演示载体,除了高清图片,ppt中另一类常用的素材是各种小图标,也叫矢量图标,巧妙运用小图标能提升整体美观度和表现力,那么ppt常用小图标去哪里找呢?为方便各位快速找到合适的...

有什么好用的截图录屏工具?试试这9款

经常有朋友反馈苦于缺乏截屏和录屏的趁手工具,本期我们分享几个相当好用的截屏和录屏工具,希望能帮到大家。ScreenToGifScreenToGif是一款免费且开源的录屏工具。此款工具最大的特点是可以...

配色苦手福音!专业快速色环配色PS插件

今天橘子老师给的大家介绍的是一款快速配色的插件,非常强大配色苦手福音来啦!(获取方式见文末)【插件介绍】配色在后期设计中占有主导地位,好的配色能让作品更加抢眼Coolorus这款专业的配色插件,能够...

如何用PS抠主体?(ps怎么抠主体)

1.主体法抠图-抠花苞和花梗导入一张荷花苞的照片,点击上图中顶部“选择”菜单栏,下拉单击“主体”。可以看到,只有花苞被选中,但是花梗并没有被选中。接下来单击上图中左侧工具栏的“快速选择工具”,上图中顶...

2799元的4K电视,有保障吗?(买4k电视机哪个品牌好)

在上一期《电脑报》的3·15专题报道中,我们揭露了一款不靠谱的42英寸4K智能电视——TCLD42A561U。这款售价2699元的4K智能电视不仅4K画质方面存在严重问题,而且各种功能和应用体验也不理...

苹果电脑的Touch Bar推出一段时间了 这款工具可以帮你开发适用于它的APP

距离苹果推出带有TouchBar的MacBookPro已经有一段时间了,除了那些像Adobe、Google和Microsoft大公司在开发适用于TouchBar的应用之外,其实还有很多独立的开...

如魔法般吸取颜色的桌灯(如魔法般吸取颜色的桌灯叫什么)

色彩为生活带来的感官刺激,逐渐被视为理所当然。一盏桌灯运用它的神奇力量,将隐藏于物件中的颜色逐一释放,成为装点环境的空间魔法师。ColorUp是一款可以改变颜色的吸色台灯,沿用传统灯泡的造型,融入了拾...

一篇文章带你用jquery mobile设计颜色拾取器

【一、项目背景】现实生活中,我们经常会遇到配色的问题,这个时候去百度一下RGB表。而RGB表只提供相对于的颜色的RGB值而没有可以验证的模块。我们可以通过jquerymobile去设计颜色的拾取器...

ps拾色器快捷键是什么?(ps2019拾色器快捷键)

ps拾色器快捷键是什么?文章末尾有获取方式,按照以下步骤就能自动获得!学会制作PS特效需要一定程度的耐心和毅力。初学者可以从基本的工具和技术开始学习,逐渐提高他们的技能水平。同时,观看更多优秀的特效作...

免费开源的 Windows 截图录屏工具,支持 OCR 识别和滚动截图等

功能很强大、安装很小巧的免费截图、录屏工具,提供很多使用的工具来帮我么能解决问题,推荐给大家。关于ShareXShareX是一款免费的windows工具,起初是一个小巧的截图工具,经过多年的迭...

入门到精通系列PS教程:第13篇 · 拾色器、颜色问题说明及补充

入门到精通系列PS教程:第13篇·拾色器、颜色问题说明及补充作者|侯潇问题说明我的第12篇教程里,有个小问题没有说清楚。要说是错误,又不算是错误,只是没有说准确。写完那篇教程后,因为已经到了深...

PS冷知识:用吸管工具吸取屏幕上的任意颜色

今天,我们给大家介绍PS中的一个冷知识:用吸管工具可以吸取屏幕上的任意颜色。其实,操作起来是非常简单的。大多数情况下,我们认为,PS的吸管工具只能吸取PS软件作图区域范围内的颜色,最多加上画布四周的...

Windows 11 将提供内置颜色选择器工具

Windows11内置了颜色选择器,可以扫描并识别屏幕上的颜色并生成颜色代码。此外,微软还利用人工智能技术,让屏幕上的文本扫描和选择变得更加便捷。这两项功能均已在SnippingToolv1...