基于人工智能标记语言 (AIML)和任务型对话系统(Task)的深度智能对话机器人demo

起因

本demo基于基于人工智能标记语言 (AIML)和开放域问答(WebQA)的深度智能对话模型而来

无意间发现一个基于人工智能标记语言 (AIML)和开放域问答(WebQA)的深度智能对话模型，但由于年代久远代码已经跑不通了，而且采用的是py2，于是边看变改，在自己摸索下，写了一个相对完整的demo且有相对完整的注释，特此开源供各位参考学习

源码与介绍

本项目相较于原项目

实现功能

知识库匹配（AIML）回答问题
任务型对话系统(Task)
利用API完成的闲聊系统回答问题
待更新....

特点

AIML知识库更多（共35个）
敏感词库更广（共1.5W个），同时敏感词判断更合理
新增NLP功能，用于处理文本相似度。
- 针对文本相似度使用了：音形码算法+余弦相似度算法
更多的API接口demo可以调用（支持莉莉、青云客、ownthink、如意、mcenjoy）

使用方法

首先下载解压你会得到一个这样一个目录结构

目录结构

chatbot_aiml_task_demo
├─ init.py
└─ core
├─ init.py
├─ chatbot.py
├─ config.cfg
├─ crawler
│ ├─ init.py
│ ├─ crawl.py
│ ├─ search.py
│ ├─ stationID.json
│ └─ weather.py
├─ deeplearning
│ ├─ NLP.py
│ ├─ .......
│ ├─ SimilarCharactor
│ ├─ init.py
│ └─ deep.py
├─ log
│ ├─ .gitkeep
│ └─ .......
├─ resources
│ ├─ Book.aiml
│ ├─ .......
│ ├─ save.aiml
│ ├─ load.aiml
│ ├─ main.aiml
│ ├─ sensitive.txt
│ ├─ .......
│ └─ .......
└─ tool
├─ init.py
└─ filter.py

其中：
chatbot.py 是主程序
config.cfg 是各种路径的配置文件
tool文件夹 下是存放的是用于敏感词过滤使用的filter.py文件
resources文件夹 建议存放AIML知识库和敏感词库
deeplearning文件夹 存放的是NLP主要代码
crawler文件夹 存放的是任务型对话系统(Task)主要代码

源码介绍与处理流程

预处理
限制字数
过滤敏感词（恶心、政治、色情、违法......）

当你需要增加敏感词时候直接在sensitive.txt中添加即可
当你需要更改敏感词库位置时候请在config.cfg中修改filter_file
知识库匹配（AIML）
基本功能：打招呼、闲聊......
异常处理：问题太长、空白问题、找不到回复......
情绪回答：表情、夸奖、嘲笑......
如果匹配不到回答，进行步骤三
任务型对话匹配
如果可以请不要完全依赖于本人提供的任务功能，请自行修改接口和对应的匹配关键词。因为本人提供的接口随时可能失效，无法保证效果。
你可以自行添加功能和匹配关键词。包括但不限制于天气查询、汉字查询、空气质量查询、百科等机器人功能

任务型对话系统(Task)功能函数建议放在search.py中
关键词逻辑判断建议写在crawl.py文件中
同时你可要单独写一个功能文件调用，例如给出的例子weather.py用于取天气
神经网络
与原作者相同，我也暂时实现不了神经网络部分功能，同样使用了API代替，同时加入了NLP文本相似度计算。

如果你需要使用API请到deep.py对应的函数中填入自己的api_key
在deep.py的bot_reply()函数中，你可以选择使用的API接口和个数，同时也支持你自己添加API

学习功能

利用AIML模板+shelve存储，同时修复了已知BUG

学习功能模板为learn.aiml库，可以自定义修改

- 说错 *
- 答错 *
......

效果展示：

1644662900-1.png

1644666590-2.png

源码

欢迎Star欢迎━(｀∀´)ノ亻!
github

参考

基于人工智能标记语言 (AIML)和开放域问答(WebQA)的深度智能对话模型
 中文相似度匹配算法
 wenyangchou/SimilarCharactor
敏感词过滤的几种实现+某1w词敏感词库

人面猴
序言：七十年代末，一起剥皮案震惊了整个滨河市，随后出现的几起案子，更是在滨河造成了极大的恐慌，老刑警刘岩，带你破解...
沈念sama阅读 211,348评论 6赞 491
死咒
序言：滨河连续发生了三起死亡事件，死亡现场离奇诡异，居然都是意外死亡，警方通过查阅死者的电脑和手机，发现死者居然都...
沈念sama阅读 90,122评论 2赞 385
救了他两次的神仙让他今天三更去死
文/潘晓璐我一进店门，熙熙楼的掌柜王于贵愁眉苦脸地迎上来，“玉大人，你说我怎么就摊上这事。” “怎么了？”我有些...
开封第一讲书人阅读 156,936评论 0赞 347
道士缉凶录：失踪的卖姜人
文/不坏的土叔我叫张陵，是天一观的道长。经常有香客问我，道长，这世上最难降的妖魔是什么？我笑而不...
开封第一讲书人阅读 56,427评论 1赞 283
港岛之恋（遗憾婚礼）
正文为了忘掉前任，我火速办了婚礼，结果婚礼上，老公的妹妹穿的比我还像新娘。我一直安慰自己，他们只是感情好，可当我...
茶点故事阅读 65,467评论 6赞 385
恶毒庶女顶嫁案：这布局不是一般人想出来的
文/花漫我一把揭开白布。她就那样静静地躺着，像睡着了一般。火红的嫁衣衬着肌肤如雪。梳的纹丝不乱的头发上，一...
开封第一讲书人阅读 49,785评论 1赞 290
城市分裂传说
那天，我揣着相机与录音，去河边找鬼。笑死，一个胖子当着我的面吹牛，可吹牛的内容都是我干的。我是一名探鬼主播，决...
沈念sama阅读 38,931评论 3赞 406
双鸳鸯连环套：你想象不到人心有多黑
文/苍兰香墨我猛地睁开眼，长吁一口气：“原来是场噩梦啊……” “哼！你这毒妇竟也来了？” 一声冷哼从身侧响起，我...
开封第一讲书人阅读 37,696评论 0赞 266
万荣杀人案实录
序言：老挝万荣一对情侣失踪，失踪者是张志新（化名）和其女友刘颖，没想到半个月后，有当地人在树林里发现了一具尸体，经...
沈念sama阅读 44,141评论 1赞 303
护林员之死
正文独居荒郊野岭守林人离奇死亡，尸身上长有42处带血的脓包…… 初始之章·张勋以下内容为张勋视角年9月15日...
茶点故事阅读 36,483评论 2赞 327
白月光启示录
正文我和宋清朗相恋三年，在试婚纱的时候发现自己被绿了。大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
茶点故事阅读 38,625评论 1赞 340
活死人
序言：一个原本活蹦乱跳的男人离奇死亡，死状恐怖，灵堂内的尸体忽然破棺而出，到底是诈尸还是另有隐情，我是刑警宁泽，带...
沈念sama阅读 34,291评论 4赞 329
日本核电站爆炸内幕
正文年R本政府宣布，位于F岛的核电站，受9级特大地震影响，放射性物质发生泄漏。R本人自食恶果不足惜，却给世界环境...
茶点故事阅读 39,892评论 3赞 312
男人毒药：我在死后第九天来索命
文/蒙蒙一、第九天我趴在偏房一处隐蔽的房顶上张望。院中可真热闹，春花似锦、人声如沸。这庄子的主人今日做“春日...
开封第一讲书人阅读 30,741评论 0赞 21
一桩弑父案，背后竟有这般阴谋
文/苍兰香墨我抬头看了看天上的太阳。三九已至，却和暖如春，着一层夹袄步出监牢的瞬间，已是汗流浃背。一阵脚步声响...
开封第一讲书人阅读 31,977评论 1赞 265
情欲美人皮
我被黑心中介骗来泰国打工，没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留，地道东北人。一个月前我还...
沈念sama阅读 46,324评论 2赞 360
代替公主和亲
正文我出身青楼，却偏偏与公主长得像，于是被迫代替她去往敌国和亲。传闻我的和亲对象是个残疾皇子，可洞房花烛夜当晚...
茶点故事阅读 43,492评论 2赞 348