18 分钟AWS re:Invent 2025——为多智能体AI系统实现人在回路控制(CNS428)
了解如何将审批关卡实现为明确的工作流检查点,而不是等问题发生后再进行非正式人工审核。
AI Explained. 这是最清晰、不炒作的讲解,说明o1(以及由此延伸的o3、R1和Claude extended thinking)为何在下一个token预测之上加入强化学习,以奖励正确的多步骤答案,以及这对你与模型沟通的方式意味着什么。看过它之后,文章中“不要再说‘一步一步思考’,而要开始编写规格”的建议就不会显得武断。
将o1术语视为历史背景。真正有用的经验,是提示方法转向严谨的任务规格;当前的模型名称、产品限制和最佳实践仍会不断变化。
理解推理模型的提示词为何应明确问题、约束条件和成功标准,而不是要求模型展示思维链。
具备基本的提示词使用经验,并熟悉o系列、Claude extended thinking和R1等模型名称。
最后审核:2026年5月18日
通过相同的视频学习路径,继续观看下一个精选配套视频。
精选的外部课程,帮助您更深入地了解该主题。
Isa Fulford · Andrew Ng
用90分钟获得相当于一年实践积累的直觉。如果你已经开始编写调用LLM的代码,或正准备这样做,这是目前网上最高效的课程,能帮你弥合“试用ChatGPT”和“交付一项调用LLM的功能”之间的差距。
Dr. Jules White
这是DeepLearning.AI短期课程的学术型补充:方法同样严谨,但学习周期更长,面向不会编程的人。Dr. White将提示词设计讲解为一组可复用的模式(请求输入、扩展大纲、事实核查清单、菜单操作),而不是零散技巧。学完后,你会像设计师一样设计LLM提示词,而不再依靠猜测。
Microsoft Learn
Prompt engineering, but for the tool most office workers will actually touch first. Microsoft's own four-part prompting framework (goal, context, source, expectation) is a genuinely useful mental model, and unlike the generic ChatGPT prompting courses already in our catalog, this one is grounded entirely in Microsoft 365 Copilot's specific quirks and grounding behavior.