斯坦福大学老师讲课

机器之心报道

编辑:Panda

斯坦福大学 2025 年春季的 CS336 课程「从头开始创造语言模型(Language Models from Scratch)」相关课程和材料现已在网上全面发布!

课程视频:https://www.youtube.com/watch?v=SQ3fZ1sAqXI&list=PLoROMvodv4rOY23Y0BoGoBGgQ1zmU_MT_课程主页:https://stanford-cs336.github.io/spring2025/

这是该课程的教职工阵容:

其中,讲师 Tatsunori Hashimoto 现为斯坦福大学计算机科学系助理教授。此前,他是斯坦福大学 John C. Duchi 和 Percy Liang 的博士后,研究机器学习模型平均性能和最差性能之间的权衡。在博士后研究之前,他在麻省理工学院攻读研究生,导师是 Tommi Jaakkola 和 David Gifford。他本科在哈佛大学学习统计学和数学,导师是 Edoardo Airoldi。他的研究成果已总计获得了超 3 万引用。

另一位讲师 Percy Liang 是斯坦福大学计算机科学系副教授,同时也是基础模型研究中心(CRFM)主任,同时也有参与以人类为中心的人工智能(HAI)、人工智能实验室、自然语言处理研究组和机器学习研究组等的研究工作。他本科毕业于 MIT,之后在该校获得工程学硕士学位,导师是 Michael Collins;之后,他在伯克利获得博士学位,导师是 Michael Jordan 和 Dan Klein;后来他进入谷歌从事博士后研究。Percy Liang 是一位引用量超过 10 万的研究大牛,我们此前也曾多次报道他的研究成果。

CS336 课程简介

CS336 课程的目标是「引导学生完成开发自己的语言模型的整个过程,从而帮助他们全面理解语言模型。」该课程借鉴了操作系统课程中从零开始创建完整操作系统的教学方法,引导学生完成语言模型创建的各个环节,包括预训练的数据收集和清理、Transformer 模型的构建、模型训练以及部署前的评估。

该课程包含 5 个单元,分别是基础、系统、扩展、数据、对齐和推理强化学习。

该课程也非常注重实践操作,因此也需要相当多的学习和开发时间。Percy Liang 也在 上简单分享了学生需要实践的内容,包括:

作业 1(使基本流程正常运行):实现 BPE 分词器、Transformer 架构、Adam 优化器,并在 TinyStories 和 OpenWebText 上训练模型。只允许使用 PyTorch 原语(不能直接调用 torch. nn. Transformer 或 torch. nn. Linear)。作业 2(让 GPU 运行起来):在 Triton 中实现 Flash Attention 2、分布式数据并行 + 优化器分片。作业 3(Scaling Law):使用 IsoFLOP 拟合 Scaling Law。为了模拟训练运行的高风险,学生会获得一个训练 API [超参数→损失] 和一个固定的计算预算,并且必须选择提交哪些运行来收集数据点。在后台,训练 API 是通过在一系列预先计算的运行之间进行插值来支持的。作业 4(数据):将 Common Crawl HTML 转换为文本,过滤(质量、有害内容、PII),删除重复数据。这是一项苦差事,却没有得到足够的重视。作业 5(对齐):实现监督微调、专家迭代、GRPO 和变体,在 Qwen 2.5 Math 1.5B 上运行 RL 以提升在 MATH 上的指标。我们也曾考虑过让学生自己实现推理(inference),但决定(可能是明智的)让人们使用 vllm。

更具体来说,CS336 课程的 5 个单元包含 19 门课。这里简单总结了该课程的目录,你可以在课程主页下载相应的材料:

课程概述和 token 化PyTorch 和资源(包括内存和计算资源)架构与超参数混合专家(MoE)GPUKernel,Triton并行化并行化Scaling Law推理Scaling Law评估数据数据对齐 ——SFT/RLHF对齐 —— 强化学习对齐 —— 强化学习客座讲座:阿里巴巴达摩院研究员、Qwen 团队技术负责人 Junyang Lin(林俊旸)客座讲座:Facebook AI 研究科学家、Llama 3 预训练负责人 Mike Lewis

另外,在考虑学习这门课程之前,你应该先具备以下能力:

熟练掌握 Python:大部分课程作业将使用 Python 完成。与大多数其他 AI 课程不同,本课程只会给学生提供极少的脚手架。你编写的代码量将至少比其他课程多一个数量级。因此,熟练掌握 Python 和软件工程至关重要。有深度学习和系统优化经验:本课程的很大一部分内容是关于如何使神经语言模型在多台机器的 GPU 上快速高效地运行。我们希望学生能够熟练掌握 PyTorch,并了解内存层次结构等基本系统概念。大学微积分、线性代数(例如 MATH 51、CME 100):你应该能够轻松理解矩阵 / 向量符号和运算。基础概率与统计(例如 CS 109 或同等课程):你应该了解概率、高斯分布、均值、标准差等基础知识。机器学习(例如 CS221、CS229、CS230、CS124、CS224N):你应该熟悉机器学习和深度学习的基础知识。

顺带一提,CS336 课程还为完成课程的学生赠送了纪念 T 恤,有如下 4 种图案。你觉得如何呢?

声明:壹贝网所有作品(图文、音视频)均由用户自行上传分享,仅供网友学习交流,版权归原作者wangteng@admin所有,原文出处。若您的权利被侵害,请联系 756005163@qq.com 删除。

本文链接:https://www.ebaa.cn/49784.html

(0)
上一篇 2025年8月7日
下一篇 2025年8月7日

相关推荐

  • 夏威夷杨伯翰大学

    从猪圈到国际电影节:那个被张艺谋说"丑"的农村女孩,如今活成这样! "农村娃想当明星?不如回家喂猪!"1999年河北赤城县的夏天,13岁的魏敏芝蹲在猪圈旁喂食时,绝对想不到这句话会改变她的一生。当副导演郦红在村口喊她"来拍电影"时,这个扎着歪辫子、裤腿沾满泥巴的姑娘,正盘算着放学后去割猪草。 命运转…

    2025年8月14日
  • 伦敦大学伯贝克学院地址

    英国伦敦大学伯贝克学院(Birkbeck, University of London)是一所位于伦敦市中心的研究型大学,以其灵活的夜间教学和高质量的教育而闻名。以下是高考后申请该学院的指南: ### 申请条件 1. **学术成绩**:申请者需具备相关的学术背景或专业经验,伯贝克学院提供从本科到博士的多种课程。 2. **语言成绩**:一般学科雅思要求6.5分…

    2024年9月26日
  • 美国阿拉巴马大学怎么样

    美国西阿拉巴马大学怎么样?西阿拉巴马大学成立于1835年,该校办学宗旨是是满足国家,特别是西方阿拉巴马州地区的教育需求。重视多样化的学生入学,它也欢迎来自美国各地和其他国家的学生。那么很多刚刚开始了解西阿拉巴马的小伙伴问小编美国西阿拉巴马大学怎么样?下面小编来帮你解答。 西阿拉巴马大学(The University of West Alabama),简称UW…

    2025年8月27日
  • 马来西亚落地签证(马来西亚落地签证最新政策2023)

    马来西亚落地签证(VOA):申请需符合以下条件 (1)须从泰国、新加坡、印尼或文莱抵达的符合资格中国公民,并持有上述三国的有效签证。 (2)须经由吉隆坡国际机场(KLIA及KLIA2)、槟城国际机场、新山士乃国际机场、沙捞越古晋国际机场、沙巴亚庇国际机场、吉打浮罗交怡机场、吉打黑木山出入境检查站、沙捞越美里国际机场、沙捞越双溪都九出入境检查站、纳闽渡轮码头和…

    2023年10月25日
  • brandeis是什么大学_brandeis university什么学校

    原创作者:雅小果,转载请联络我们美国留学荟 Brandeis University 布兰迪斯大学 学校地址 415 South Street, Waltham, MA 02454 学校概况 布兰迪斯大学Brandeis University,简称Brandeis,是一所位于美国马萨诸塞州波士顿地区沃尔瑟姆镇的私立顶尖研究型大学,成立于1948年。 虽然建校至…

    2024年3月8日
  • 菏泽学院属于重点大学吗

    菏泽的大学排名第一的是菏泽学院, 排名第二的是菏泽医学专科学校, 排名第三的是菏泽职业学院, 排名第四的是菏泽家政职业学院, 以下是具体榜单,供大家参考。 取材网络 1、菏泽学院 菏泽学院(Heze University)位于山东省菏泽市,是一所全日制普通本科高校,是数据中国“百校工程”项目建设院校。 菏泽学院的前身是创建于1949年的冀鲁豫区第二师范学校,…

    2025年4月29日
  • 纽约大学研究生申请条件及学费

    到上海这个地方上学,去那个叫上海纽约大学的学校,花钱是头一件事。一年不是个小数目,四年下来,家里得准备一笔钱。这钱还不是一年一个价,读着读着,它还会变。 钱的事,得先说清楚 头两年,一年是二十万元。等到第三年、第四年,就变成了二十三万元一年。这个钱,是按学期给的,不是一次性交完。学校有个说法,就是学生要是去了纽约或者阿布扎比那些地方学习,学费还是照样交给上海…

    2025年7月25日
  • 清华大学全世界排名多少

    6月17日,U.S. News官网发布的2025-2026年度全球最佳院校排名显示,中国高校共有15所进入百强,较去年13所高校有所增加。其中,清华大学位列全球大学第11、亚洲第一,是唯一进入前20名的中国高校。北京大学位列全球第25。 U.S.News 2025-2026年度全球最佳院校排名前20名。澎湃新闻据U.S.News官方信息制图 进入全球最佳院校…

    2025年7月22日
  • 中国大学排名前十名要多少分

    根据2024年校友会中国大学排名,北大、清华、复旦这三所高校如同璀璨的明珠,继续在众多院校中脱颖而出,成为全国一本大学的领头羊。这些学校不仅在学术研究上具有卓越成就,更是无数学子梦寐以求的求学之地。 在传统高考省份,这三所高校无疑是文科和理科的热门选择。2023年贵州的录取数据显示,文科一本大学的分数线在545分到679分之间,而理科则在459分到684分之…

    2024年11月13日
  • ncaa篮球联赛排名_ncaa篮球联赛排名32强

    新赛季NCAA-M(男篮)第一级别联赛(Division 1)的战力排名AP TOP 25更新至第10周。 AP TOP 25代表着NCAA第一级别联赛球队实力排行的前25位,由美联社根据数十名全美知名的体育记者和广播员投票所选出,该排名情况会在北京时间每周二更新,是评定一支球队近期实力的重要标准。 本周AP前四名位置稳固,密歇根大学和弗吉尼亚仍然保持着全胜…

    2024年3月19日

联系我们

400-800-8888

在线咨询: QQ交谈

邮件:admin@example.com

工作时间:周一至周五,9:30-18:30,节假日休息

关注微信