陈蕴侬 -Transformer-XL、 XLNet 、RoBERTa 、SpanBERT讲解
2022 - 陈蕴侬 - Attention 机制讲解
2022-陈蕴侬-如何prompt预训练大模型
2023 - 陈蕴侬 - prompt base learning
2022秋 - 陈蕴侬 - 预训练模型 之 GPT、GPT2、GPT3介绍
2022 - 陈蕴侬 - BERT模型介绍 & Multilingual BERT
陈蕴侬 - self-Attention机制 以及MHA不同类型之间关系
2022 - 陈蕴侬 - 生成式模型 BART、T5、Meena、BlenderBot
2023 - 陈蕴侬 - 自然语言评估结果 & RL提升生成结果
2023.05.20 - 李宏毅 - 用AI解释AI
2023 - 陈蕴侬 - 评估对话系统的方法
2023 - 陈蕴侬 - 自然语言解码生成的详细策略
2023 - 李宏毅 - 对大型语言模型的两种不同期待
2023 - 李宏毅 - Diffusion Model 原理剖析
2023 - 李宏毅 - Stable Diffusion、DALL-E、ImageGen背后的基本套路
2023 - 李宏毅 - 生成式模型的两种策略 + 能够使用工具的WebGPT
Google Flan PALM Flan T5 and Flan U PALM
2023 - 李宏毅- 大模型+大资料 = 神奇力量?
2020 - 李宏毅 - BERT和他的"家族"
大模型 Google PaLM --- Scaling Language Modeling with Pathways