AI安全
提示词注入、泄露、不安全的工具访问、权限和生产环境失效模式。
19 项内容 (12 篇文章 · 7 个视频)
从这里开始
浏览完整内容之前,先阅读几篇推荐文章。
14 分钟阅读提示词注入与大语言模型安全:威胁模型与纵深防御
提示词注入是长期存在的一类大语言模型安全风险,并非提示词编写失误。本文是一份面向生产环境的指南,涵盖威胁模型、数据边界、工具权限、回归测试、监控和事件响应。
高级
10 分钟阅读企业知识RAG:权限、泄露与来源边界
只有检索过程遵守权限,企业知识助手才是安全的。本文介绍如何设计RAG来源边界、ACL筛选、文档责任归属、日志记录、过时来源处理和拒绝行为。
高级
11 分钟阅读RAG 的安全文档摄取:PDF、OCR、元数据与保留策略
RAG 质量始于检索之前。本文是一份安全摄取指南,涵盖 PDF、OCR、元数据、权限、来源时效性、删除、恶意软件风险和运营责任归属。
高级此主题下的更多内容
7 分钟阅读Hermes Webhook:无需巨型万能提示的事件驱动智能体
使用符合事件来源要求的身份验证、8644 端口健康检查和小型命名路由配置 Hermes Agent webhook,让事件触发目标明确、交付位置清楚的智能体运行。
中级
10 分钟阅读DGX Spark 上的 NemoClaw:部署与安全计划
规划并评估如何在 DGX Spark 的 NVIDIA OpenShell 中运行 OpenClaw、Hermes 或 Deep Agents Code:当前上手流程、策略层、路由推理,以及上线前必须取得的验收证据。
高级
8 分钟阅读OpenClaw 允许列表、配对与群组提及安全
渠道允许列表、DM 配对与群组提及规则是 OpenClaw 真正的安全边界,因为工具可能包括 shell、文件与浏览器。本文提供一份实用的锁定清单。
中级
9 分钟阅读OpenClaw 个人网关设置:安装、初始配置与控制台
OpenClaw 是什么、如何安装并完成自托管多渠道网关的初始配置、在 18789 端口打开 Control UI,以及支持哪些 Node 版本,同时不跳过安全基线。
中级
10 分钟阅读OpenClaw 技能、心跳自治与审批关卡
了解 OpenClaw 如何加载技能、心跳周期性轮次如何运行、如何限制主机 shell 执行,以及如何通过严格的浏览器策略和经过审查的工作流确认来约束浏览器自动化。
中级
20 分钟RAG权限与访问控制:深入教程
Paragon. 视频逐步讲解生产环境中的RAG权限问题,并比较工具调用、命名空间、ACL表和基于关系的权限。这直接支持文章的核心规则:检索只能返回当前用户获准查看的来源,而且不能把源系统权限视为事后补充。
高级
69 分钟智能体生态:将智能体投入生产后得到的经验
MLOps.community. Prosus的AI副总裁和一位AI工程师讲述了他们在集团旗下公司部署智能体时真正出现的问题:上线前进行提示词注入渗透测试;Jira智能体无法理解人类简写而执行了不安全的写入;通过让智能体明确展示自身假设来处理陈旧上下文;以及在降级设计中,一旦智能体增加认知负担,就将其合并或停用。这就像把文章中的失败模式登记表搬进了一场现场复盘。
高级
7 分钟用Docling提升RAG与AI智能体
IBM Technology. 视频讲解RAG和智能体的摄取环节:如何准备PDF和其他文件,使文档结构、表格和版面布局能够保留到后续检索阶段。这印证了文章的提醒:RAG的质量与安全始于嵌入之前,解析复杂业务文档时尤其如此。
高级
10 分钟阅读生产AI失败模式:演示之后会出什么问题
AI系统通常以可预测的方式失败:幻觉、上下文过时、过度迎合、提示词注入、不安全的工具调用、模式漂移和薄弱的降级机制。这是一份面向真实工作流交付团队的生产AI失败模式清单。
高级
10 分钟阅读私有 AI 部署模式:本地、VPC、自托管和混合
私有 AI 并非单一架构。本文面向重视隐私和控制权的中小企业,对比本地模型、企业 SaaS、VPC 部署、自托管推理和混合模式。
高级
10 分钟阅读安全地将 AI 连接到电子邮件、日历和 CRM 系统
一份基于风险的指南:以最小权限、审批关卡、受保护的审计证据、负向测试与恢复路径,把AI连接到电子邮件、日历和CRM。
中级
8 分钟阅读在工作中使用AI时的隐私与数据卫生
一份实用指南,帮助你降低工作中使用AI时的隐私和保密风险。粘贴前,应检查具体产品、套餐、配置、数据和适用规则。
初级
25 分钟OWASP攻击LLM的10种方式:AI漏洞揭秘
IBM Technology. 视频从提示词注入扩展到更全面的OWASP LLM十大风险——不安全的输出处理、敏感信息泄露、过度代理等。在向任何工具授予Gmail或HubSpot权限范围之前,你正需要在脑中备好这份故障模式清单。
中级
11 分钟什么是提示词注入攻击?
IBM Technology. Jeff Crume用“以$1购买一辆SUV”的例子,在10分钟内极其清楚地解释了为什么直接提示词注入与间接提示词注入是两类不同的问题,以及为什么过滤无法彻底解决任何一类。这与文章的论点直接呼应:对于任何不可逆操作,你需要最小权限范围、专用智能体账号和人在回路机制,而不是更巧妙的系统提示词。
中级
13 分钟攻击LLM:提示词注入
LiveOverflow. 视频将提示词注入描述为一种经典的注入攻击,目标是混合指令与不可信数据的系统,并给出一个具体的内容审核示例:攻击者借此陷害无辜用户。从“模型是攻击目标”转变为“应用才是攻击目标”,正是文章开篇要求建立的思维方式。
高级
17 分钟保护LLM:防御提示词注入
LiveOverflow. 视频逐一讲解实际的纵深防御方案:对LLM输出进行污点分析、限制预期输出形态、用户隔离、少样本脚手架、微调、使用温度0实现确定性,以及为关键路径设置冗余。它与文章的防御体系章节几乎逐项对应。
高级