向AI转型的程序员都关注了这个号👇👇👇
机器学习AI算法工程 公众号:datayx
项目描述
本项目是一个带有超级详细中文注释的基于GPT2模型的新闻标题生成项目。
本项目参考了GPT2-Chinese、GPT2-chitchat、CDial-GPT、GPT2等多个GPT2开源项目,并根据自己的理解,将代码进行重构,添加详细注释,希望可以帮助到有需要的人。
本项目使用HuggingFace的transformers实现GPT2模型代码编写、训练及测试。
本项目通过Flask框架搭建了一个Web服务,将新闻摘要生成模型进行工程化,可以通过页面可视化地体验新闻标题生成效果。
本项目的代码详细讲解,可以自行阅读代码,也可查看代码注释介绍。
本项目提供的新闻标题模型是一个6层的小模型(其实是穷人没人卡,只能训练小模型),并且在训练该模型过程中,没有加载预训练的GPT2模型而是随机初始化的参数,并且训练轮数较少(5轮,还没收敛完),因此效果一般。如果想要更好效果的模型,可以按照个人需求训练一个模型。
本项目的目的是带领大家走一遍GPT2生成模型的训练、测试及部署全部流程。
从网上收集数据,将清华新闻数据、搜狗新闻数据等新闻数据集,以及开源的一些摘要数据进行整理清洗,构建一个较完善的中文摘要数据集。
数据集清洗时,仅进行了简单地规则清洗。例如:清洗htlm标记、去除多余空字符、去除图片标记等。
处理后数据集详细信息,见数据集描述
全部 代码 ,预训练模型 获取方式:
关注微信公众号 datayx 然后回复 标题生成 即可获取。
测试结果如下:
机器学习算法AI大数据技术搜索公众号添加: datanlp长按图片,识别二维码
阅读过本文的人还看了以下文章:
TensorFlow 2.0深度学习案例实战基于40万表格数据集TableBank,用MaskRCNN做表格检测《基于深度学习的自然语言处理》中/英PDFDeep Learning 中文版初版-周志华团队【全套视频课】最全的目标检测算法系列讲解,通俗易懂!《美团机器学习实践》_美团算法团队.pdf《深度学习入门:基于Python的理论与实现》高清中文PDF+源码《深度学习:基于Keras的Python实践》PDF和代码特征提取与图像处理(第二版).pdfpython就业班学习视频,从入门到实战项目2019最新《PyTorch自然语言处理》英、中文版PDF+源码
《21个项目玩转深度学习:基于TensorFlow的实践详解》完整版PDF+附书代码《深度学习之pytorch》pdf+附书源码PyTorch深度学习快速实战入门《pytorch-handbook》【下载】豆瓣评分8.1,《机器学习实战:基于Scikit-Learn和TensorFlow》《Python数据分析与挖掘实战》PDF+完整源码汽车行业完整知识图谱项目实战视频(全23课)李沐大神开源《动手学深度学习》,加州伯克利深度学习(2019春)教材笔记、代码清晰易懂!李航《统计学习方法》最新资源全套!
《神经网络与深度学习》最新2018版中英PDF+源码将机器学习模型部署为REST API
FashionAI服装属性标签图像识别Top1-5方案分享重要开源!CNN-RNN-CTC 实现手写汉字识别yolo3 检测出图像中的不规则汉字
同样是机器学习算法工程师,你的面试为什么过不了?前海征信大数据算法:风险概率预测【Keras】完整实现‘交通标志’分类、‘票据’分类两个项目,让你掌握深度学习图像分类VGG16迁移学习,实现医学图像识别分类工程项目
特征工程(一)特征工程(二) :文本数据的展开、过滤和分块特征工程(三):特征缩放,从词袋到 TF-IDF特征工程(四): 类别特征特征工程(五): PCA 降维特征工程(六): 非线性特征提取和模型堆叠特征工程(七):图像特征提取和深度学习如何利用全新的决策树集成级联结构gcForest做特征工程并打分?Machine Learning Yearning 中文翻译稿
蚂蚁金服2018秋招-算法工程师(共四面)通过全球AI挑战-场景分类的比赛源码(多模型融合)斯坦福CS230官方指南:CNN、RNN及使用技巧速查(打印收藏)python+flask搭建CNN在线识别手写中文网站
中科院Kaggle全球文本匹配竞赛华人第1名团队-深度学习与特征工程
不断更新资源
深度学习、机器学习、数据分析、python搜索公众号添加: datayx