文档与PDF
阅读长文档、构建基于来源的助手,并确保文档工作可核实。
22 项内容 (10 篇文章 · 12 个视频)
从这里开始
浏览完整内容之前,先阅读几篇推荐文章。
此主题下的更多内容
6 分钟阅读读租约或合同是为了提出问题,不是得出法律结论
把租约或消费者合同变成逐条账本——原文摘录、通俗释义,以及给合格专业人士的问题。模型帮你读得更快;它不告诉你条款是否可强制执行,也不告诉你有哪些权利。
初级
7 分钟阅读理解医疗文件,而不把它变成医疗建议
出院小结或检查报告满是你从未学过如何阅读的临床缩写。四栏方法——原文、通俗转述、不确定点、向临床医生的问题——让AI翻译语言,却从不告诉你结果对你意味着什么。
初级
9 分钟阅读一套帮你检索、而不是囤积的个人知识系统
一套范围明确的「收集到检索」系统:定义使用场景、检索测试、复核日期和删除规则,并警惕敏感笔记、他人数据,以及由服务商托管的账户。
中级
20 分钟RAG权限与访问控制:深入教程
Paragon. 视频逐步讲解生产环境中的RAG权限问题,并比较工具调用、命名空间、ACL表和基于关系的权限。这直接支持文章的核心规则:检索只能返回当前用户获准查看的来源,而且不能把源系统权限视为事后补充。
高级
7 分钟用Docling提升RAG与AI智能体
IBM Technology. 视频讲解RAG和智能体的摄取环节:如何准备PDF和其他文件,使文档结构、表格和版面布局能够保留到后续检索阶段。这印证了文章的提醒:RAG的质量与安全始于嵌入之前,解析复杂业务文档时尤其如此。
高级
11 分钟阅读RAG 的安全文档摄取:PDF、OCR、元数据与保留策略
RAG 质量始于检索之前。本文是一份安全摄取指南,涵盖 PDF、OCR、元数据、权限、来源时效性、删除、恶意软件风险和运营责任归属。
高级
10 分钟阅读企业知识RAG:权限、泄露与来源边界
只有检索过程遵守权限,企业知识助手才是安全的。本文介绍如何设计RAG来源边界、ACL筛选、文档责任归属、日志记录、过时来源处理和拒绝行为。
高级
11 分钟阅读分块、重排序与混合搜索:让RAG真正发挥作用
大多数RAG实现效果不佳,是因为三个环节出了问题。本实用指南介绍如何对文档分块、对结果重排序,并将关键词搜索与语义搜索结合起来,而无需成为搜索工程师。
中级
12 分钟阅读构建生产级RAG:摄取、嵌入、检索、重排序与评估
生产级RAG流水线包含六个阶段,每个阶段都有决定质量的特定模式。本文介绍整体架构、各阶段的选择,以及让有效RAG与令人失望的RAG拉开差距的迭代评估规范。
高级
18 分钟这套NotebookLM + Perplexity工作流程可将研究时间缩短50%(甚至更多)
Grace Leung. 这是一套更实用的双工具工作流程:用Perplexity查找文档和引用来源,再用NotebookLM实际阅读并综合这些内容。如果你面对的“长文档”问题其实是“一大叠文档”问题,例如市场研究、监管申报文件或多来源报告,这套方法会很有用。
AI新手
26 分钟如何使用NotebookLM(Google的AI“理解工具”)
Tiago Forte. NotebookLM是文章最积极推荐的长文档AI工具,而以Building a Second Brain闻名的Tiago Forte对其价值作出了最清楚的介绍。他演示了如何总结会议记录、查询长篇PDF,以及如何利用基于来源的回答功能,防止模型编造文档中没有的事实。看完后,你会明白为什么文章默认建议“把PDF上传到NotebookLM”。
AI新手
11 分钟2024年NotebookLM新手教程
TheAIGRID. 这段较早、以功能为主的介绍展示了录制时界面中的混合来源上传、单一来源聚焦、简报文档和音频概览。它适合用来识别工作流组成部分,而不能用来确认当前Gemini Notebook界面或功能可用性。
中级
26 分钟如何使用NotebookLM(Google的AI“理解工具”)
Tiago Forte. 《Building a Second Brain》的作者Tiago Forte使用笔记、PDF和摘录演示了当时名为NotebookLM的产品。可复用的模式是选择范围明确的来源集、提出文档问题、检查链接段落,并确定生成工件如何融入现有知识工作流。
中级
69 分钟用于检索的5级文本拆分方法
Greg Kamradt. 文章用了大量篇幅介绍分块;这段视频对每种分块策略的实际作用进行了最详尽、最耐心的讲解——从递归字符拆分,到感知文档结构的拆分,再到语义拆分和智能体式拆分。开始调优前,可以结合Greg的免费ChunkViz工具观看,以建立直观认识。
中级
24 分钟“我想让Llama3结合我的私有知识实现10倍性能”——使用llama3构建本地智能体式RAG
AI Jason. 视频在一个可运行的构建项目中涵盖了文章主张的完整技术栈——查询转换、混合检索、重排序和纠正型RAG循环。它提供了实用的心智模型,让你看到分块→重排序→回答这条流水线真正发挥作用时是什么样子。
中级
28 分钟35+种不可思议的NotebookLM免费用法
Matt Wolfe. 了解基础知识后,这段视频很适合作为第二段观看。Matt逐一介绍了许多不太明显的用法,例如将一本书转化为学习指南、根据竞争对手发布的内容为自己制作简报,以及从装有PDF的文件夹生成思维导图。这些示例能帮助你理解“基于来源的笔记本”这一模式究竟有多灵活。
初级
35 分钟如何在2026年精通NotebookLM(免费课程)
Paul J Lipsky. 视频以三个清晰步骤组织内容:筛选整理来源、提出正确的问题、生成最终成果。这与文章建议你理解NotebookLM的方式几乎一一对应。视频发布得足够新(2026年初),与当前界面一致,并涵盖Studio、音频概览和思维导图。
初级
17 分钟生产环境中的RAG智能体:我们得到的10条经验——RAG提出者Douwe Kiela
AI Engineer. Douwe Kiela在FAIR领导了最初的RAG论文工作,如今为受监管企业交付RAG。演讲主要讨论规模扩大后哪些做法会失效——无法应对100k份文档的分块策略、“准确只是基本要求,不准确才是真正的问题”,以及为何归因和可观测性比嵌入模型更重要。重读文章的评估和监控章节之前,这是一份很好的校准材料。
高级
19 分钟构建生产就绪的RAG应用:Jerry Liu
AI Engineer. LlamaIndex CEO讲解“朴素RAG演示”与真实流水线之间的差距,涵盖由小到大的检索、子问题路由、混合搜索和评估。他的幻灯片结构几乎与文章的流水线章节直接对应;建议先看视频,再带着其中的图示重读文章。
高级

