学习指南
语言模型如何持续学习:从灾难性遗忘到重放、正交子空间与 LoRA
从持续学习的基本公式出发,读懂 LAMOL、LFPT5、Progressive Prompts 和 O-LoRA 的核心思路与限制。
在该栏目下共发表了 5 篇文章,关注最核心的理论探讨与工程落地。
从持续学习的基本公式出发,读懂 LAMOL、LFPT5、Progressive Prompts 和 O-LoRA 的核心思路与限制。
BPE几个level的区别,以及现在LLM在使用的tokenizer
从一个真实小模型项目出发,看看工程里的Tokenizer到底长什么样
汇总大模型大部分组件、概念
汇总大模型大部分组件、概念