机器之心 06月23日
新鲜出炉!斯坦福2025 CS336课程全公开:从零开始搓大模型
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_guoji1.html

 

斯坦福大学 2025 年春季推出的 CS336 课程「从头开始创造语言模型」现已全面上线,课程由 Percy Liang 和 Tatsunori Hashimoto 两位资深讲师授课。该课程以实践为导向,引导学生从零开始构建语言模型,涵盖预训练、模型构建、训练和评估等环节。课程分为五个单元,包含 19 门课,涵盖基础、系统、扩展、数据、对齐和推理强化学习等内容。学生将通过一系列实践作业,深入理解语言模型的各个方面,并最终完成自己的语言模型。课程强调实践,需要学生具备扎实的 Python 编程、深度学习和系统优化经验,以及微积分、线性代数、概率统计和机器学习的基础知识。

👨‍🏫 课程概述:CS336 课程旨在引导学生从零开始构建语言模型,涵盖预训练数据的收集与清理、Transformer 模型的构建、模型训练以及部署前的评估等环节。

📚 课程内容:课程包含五个单元,分别是基础、系统、扩展、数据、对齐和推理强化学习,共计 19 门课。课程目录涵盖了语言模型的各个关键方面,为学生提供了全面的学习框架。

💻 实践作业:课程非常注重实践,学生需要完成一系列实践作业,包括实现 BPE 分词器、Transformer 架构、Adam 优化器,以及在 Triton 中实现 Flash Attention 2、分布式数据并行和优化器分片等。

🎓 先修知识:学习本课程需要具备熟练的 Python 编程能力、深度学习和系统优化经验、大学微积分、线性代数、基础概率与统计,以及机器学习的基础知识,为深入理解课程内容奠定基础。

2025-06-23 12:05 北京

包括 5 单元 19 课,讲师为 Percy Liang 和 Tatsunori Hashimoto

机器之心报道

编辑:Panda


斯坦福大学 2025 年春季的 CS336 课程「从头开始创造语言模型(Language Models from Scratch)」相关课程和材料现已在网上全面发布! 




这是该课程的教职工阵容:



其中,讲师 Tatsunori Hashimoto 现为斯坦福大学计算机科学系助理教授。此前,他是斯坦福大学 John C. Duchi 和 Percy Liang 的博士后,研究机器学习模型平均性能和最差性能之间的权衡。在博士后研究之前,他在麻省理工学院攻读研究生,导师是 Tommi Jaakkola 和 David Gifford。他本科在哈佛大学学习统计学和数学,导师是 Edoardo Airoldi。他的研究成果已总计获得了超 3 万引用。



另一位讲师 Percy Liang 是斯坦福大学计算机科学系副教授,同时也是基础模型研究中心(CRFM)主任,同时也有参与以人类为中心的人工智能(HAI)、人工智能实验室、自然语言处理研究组和机器学习研究组等的研究工作。他本科毕业于 MIT,之后在该校获得工程学硕士学位,导师是 Michael Collins;之后,他在伯克利获得博士学位,导师是 Michael Jordan 和 Dan Klein;后来他进入谷歌从事博士后研究。Percy Liang 是一位引用量超过 10 万的研究大牛,我们此前也曾多次报道他的研究成果。



CS336 课程简介


CS336 课程的目标是「引导学生完成开发自己的语言模型的整个过程,从而帮助他们全面理解语言模型。」该课程借鉴了操作系统课程中从零开始创建完整操作系统的教学方法,引导学生完成语言模型创建的各个环节,包括预训练的数据收集和清理、Transformer 模型的构建、模型训练以及部署前的评估。



该课程包含 5 个单元,分别是基础、系统、扩展、数据、对齐和推理强化学习。


该课程也非常注重实践操作,因此也需要相当多的学习和开发时间。Percy Liang 也在 𝕏 上简单分享了学生需要实践的内容,包括:




更具体来说,CS336 课程的 5 个单元包含 19 门课。这里简单总结了该课程的目录,你可以在课程主页下载相应的材料:



另外,在考虑学习这门课程之前,你应该先具备以下能力:



顺带一提,CS336 课程还为完成课程的学生赠送了纪念 T 恤,有如下 4 种图案。你觉得如何呢?



© THE END 

转载请联系本公众号获得授权

投稿或寻求报道:liyazhou@jiqizhixin.com

阅读原文

跳转微信打开

Fish AI Reader

Fish AI Reader

AI辅助创作,多种专业模板,深度分析,高质量内容生成。从观点提取到深度思考,FishAI为您提供全方位的创作支持。新版本引入自定义参数,让您的创作更加个性化和精准。

FishAI

FishAI

鱼阅,AI 时代的下一个智能信息助手,助你摆脱信息焦虑

联系邮箱 441953276@qq.com

相关标签

CS336课程 语言模型 斯坦福大学 深度学习
相关文章