本课程围绕中国人民大学高瓴人工智能学院赵鑫教授团队出品的《大语言模型》书籍展开,覆盖大语言模型训练与使用的全流程,从预训练到微调与对齐,从使用技术到评测应用,帮助学员全面掌握大语言模型的核心技术。并且,课程内容基于大量的代码实战与讲解,通过实际项目与案例,学员能将理论知识应用于真实场景,提升解决实际问题的能力。
课程地址:https://www.datawhale.cn/learn/summary/107
赵鑫教授团队:http://aibox.ruc.edu.cn/
课程学习地址:Datawhale-学用 AI,从此开始
视频地址:《大语言模型》1.3 GPT+DeepSeek模型介绍_哔哩哔哩_bilibili

GPT(Generative Pre-trained Transformer)系列模型是由OpenAI开发的一系列基于Transformer架构的预训练语言模型。以下是GPT系列模型的发展历程:
1. GPT (2018)
发布时间:2018年6月
特点:GPT是基于Transformer的解码器模型,采用了无监督预训练和有监督微调两阶段训练方法。

最低0.47元/天 解锁文章
990

被折叠的 条评论
为什么被折叠?



