一个可以使用自己语料进行训练的聊天机器人开源项目

其他 2020-09-10 10:12:52 阅读次数: 0

目录

背景
关于语料的说明
seq2seq版本代码执行顺序
seqGAN版本代码执行顺序
参考代码和文献
建议环境
已更新功能清单
版本路线图

背景

自定义语料训练聊天机器人，可以用于智能客服、在线问答、智能聊天等场景。目前包含seq2seq、seqGAN版本和tf2.0版本。

https://github.com/chatopera/chatbot-seq2seq

后续计划更新pytorch版本，欢迎大家实践交流。

关于语料的说明

以小黄鸡的语料为例子，地址

corpus-小黄鸡

其它语料：

心理咨询问答语料库

保险行业语料库

seq2seq版本代码执行顺序

1、在下载好代码和语料之后，将语料文件放入data目录下。

2、按照数据预处理器（data_utls.py)–>execute.py(执行器)–>app.py（可视化对话模块）的顺序执行就可以了。

3、超参配置在seq2seq.ini和seq2seq_sever.ini文件中配置。

seqGAN版本代码执行顺序

1 、在下载好代码和语料之后，将语料文件放入source_data目录下。
2、按照数据预处理器（source_data_utls.py)–>execute.py(执行器)–>app.py（可视化模块）的顺序执行就可以了

参考代码和文献

建议环境

ubuntu14.04
python3.5
TF1.X:
tensorflow==1.10.1 或者 tensorflow-gpu==1.10.1
flask==0.11.1

已更新功能清单

V1.1:已经增加中文分词，效果是变得更好了。注意在使用分词后，需要增加词典的大小，否则的话会导致词典无法覆盖训练集，导致出现很多的UNK。直接在seq2seq.ini中修改超参数enc_vocab_size和dec_vocab_size的值即可。

V2.0:增加一个基于SeqGan的版本，以增加训练的效果。

V3.0：增加TensorFlow2.0版，训练效果见文件夹内图片，训练数据已经准备好，直接执行python3 execute即可进行训练。 PS:预训练好了一个模型，链接:https://pan.baidu.com/s/1zcrBn8dpOhtBZu_T7TOO9w 密码:s7sq，可以下载使用，模型的效果见效果图，在使用预训练模型前需要先执行data_utl.py文件更新字典。

版本路线图

V4.0:

a、增加pytorch版本；
b、对当前的工程结构进行调整；
敬请期待。

猜你喜欢

转载自blog.csdn.net/watson243671/article/details/108466461

一个可以使用自己语料进行训练的聊天机器人开源项目

一个支持聊天机器人的开源IM

【开源】一个基于智能问答的聊天机器人实现

制作一个Python聊天机器人

快来！建立你的第一个Python聊天机器人项目

使用python构造一个微信聊天机器人

使用seq2seq模型实现一个聊天机器人

使用seq2seq搭建一个聊天机器人教程

使用JS实现一个会语音的聊天机器人

使用 Python 实现一个简单的智能聊天机器人

使用 Python 实现一个简单的智能聊天机器人(附完整代码）

Vicuna：斯坦福开源一个性能相当于90%ChatGPT的聊天机器人

【技术教学】创建一个专属于你自己的投资管理聊天机器人

应接不暇，应酬不断，不妨给自己的微信接一个聊天机器人。

应接不暇，应酬不断，不妨给自己的微信接一个聊天机器人

【聊天机器人】2：使用自己的数据集，实现中文聊天机器人

微软展示了一个像人类一样交谈的聊天机器人

一个同时支持移动端与小程序的聊天机器人

Python从环境配置到实现一个简单聊天机器人

用Go语言实现一个简单的聊天机器人

用python实现一个简单的聊天机器人

运行--TensorFlow练习13: 制作一个简单的聊天机器人

手把手创建一个聊天机器人

从零开始造一个“智障”聊天机器人

利用python制作一个聊天机器人

用Python做一个聊天机器人

如何用 Python 打造一个简单的聊天机器人？

用python做一个微信聊天机器人

不到20行代码，用Python做一个智能聊天机器人！

【Python】用Python实现一个智能聊天机器人

今日推荐

《美国对全球网络空间安全与发展的威胁和破坏》报告发布

火速冲上 GitHub 热榜 —— 开源编程语言、框架哪有这么可爱？

北京人形机器人创新中心发布全球首个纯电驱拟人奔跑的全尺寸人形机器人“天工”

LFOSSA 源来如此公开课 | 掌握云原生未来：CNCF 认证全面攻略与备考秘籍

周排行

让自己的头脑极度开放

CentOS 6.5(x64) 和Redhat6.5操作系误删libc

高可用注册中心

【日记】12.28/【题解】AtCoder AGC041

XML（5）_XML 约束_DTD

Java集合Map（四）

树梅派安装桌面环境教程

pipenv 的使用和安装

小程序白屏问题和内存研究

C语言简单选择排序

每日归档

更多

2024-05-02(0)

2024-05-01(4)

2024-04-30(1)

2024-04-29(40)

2024-04-28(0)

2024-04-27(56)

2024-04-26(39)

2024-04-25(22)

2024-04-24(36)

2024-04-23(26)