3:31:24Andrej Karpathy
这是YouTube上对大语言模型本质最清晰的端到端讲解,涵盖预训练、token化、SFT、RLHF、推理强化学习、工具使用和幻觉,详细程度足以帮助工程师分析模型权衡。完整看过一遍后,文章中的“GPT级模型、开放权重模型与推理模型”之选就不再像品牌选择,而会成为训练方案的选择。
您应该从中获得什么: 充分理解现代大语言模型架构,能够分析token、训练、工具和故障。
先观看或了解: 工程背景会有所帮助;无须机器学习基础,但请为三个半小时的片长预留时间。
AI Expert 注释: 模型名称、价格和能力变化很快。请用本视频掌握决策模式,并在采用模型前核实现有模型的实际表现。
