59:48Andrej Karpathy
OpenAI的创始工程师之一用通俗英语,对大语言模型(LLM)究竟是什么做出了最清晰的一小时讲解。其中“LLM的心理学”一节正是文章希望你建立的思维模型:这些模型为什么会产生幻觉,为什么擅长把握感觉却不擅长计数,以及为什么编写提示词更接近指导,而不是编程。
您应该从中获得什么: 建立一个去除神秘色彩的LLM思维模型,将其理解为具有上下文窗口、训练数据、采样机制和失败模式的预测系统。
先观看或了解: 无;演讲虽然较长,但对初学者很友好。
AI Expert 注释: 这仍然是最出色的概念讲解之一。不要过于照字面理解拟人化表述:模型不会思考,也不具备知识;它们只是在约束条件下生成可能性较高的延续内容。
