我的大模型零基础学习路线(已实习)

我的大模型零基础学习路线(已实习)

元数据

正文

感觉还是挺适合零基础的同学这样走的,两个多月差不多就可以学完,开始投简历#实习 #找实习 #大模型

#实习 #找实习 #大模型 #作者

长图内容(视觉重读)

由 AI 视觉重读截图整理,替代原 tesseract OCR 乱码。

图 p01:学习路线文字卡片

  1. CS224N:研一 9 月入学学的第一门 NLP 入门课,内容从最基础的 word2vec、CNN、RNN 等模型结构,到现在非常流行的 Transformer 架构。最终大作业是复刻一个简单版本的 GPT-2。
  2. CS336:非常硬核的课,建议着重做作业 1(从零实现 GPT 并做预训练)和作业 5(在 Qwen 模型基础上做 SFT+GRPO+DPO),剩下三个作业自行选择。
  3. 自己动手微调:找数据集微调一个模型并做评估。例子:找一个有人物特色的数据集,选一个基础模型微调,最后做对比得到量化结果。

做完这两个可以写在简历上大概两个项目,剩下的就是背八股、刷 leetcode。

图 p03–p08:表情包贴纸,无内容

图片

p01.webp
p03.png
p04.png
p05.png
p06.png
p07.png
p08.png

评论摘录

我的批注