主题

AI安全

提示词注入、泄露、不安全的工具访问、权限和生产环境失效模式。

19 项内容 (12 篇文章 · 7 个视频)

从这里开始

浏览完整内容之前,先阅读几篇推荐文章。

此主题下的更多内容

7 分钟阅读
文章

Hermes Webhook:无需巨型万能提示的事件驱动智能体

使用符合事件来源要求的身份验证、8644 端口健康检查和小型命名路由配置 Hermes Agent webhook,让事件触发目标明确、交付位置清楚的智能体运行。

中级
10 分钟阅读
文章

DGX Spark 上的 NemoClaw:部署与安全计划

规划并评估如何在 DGX Spark 的 NVIDIA OpenShell 中运行 OpenClaw、Hermes 或 Deep Agents Code:当前上手流程、策略层、路由推理,以及上线前必须取得的验收证据。

高级
8 分钟阅读
文章

OpenClaw 允许列表、配对与群组提及安全

渠道允许列表、DM 配对与群组提及规则是 OpenClaw 真正的安全边界,因为工具可能包括 shell、文件与浏览器。本文提供一份实用的锁定清单。

中级
9 分钟阅读
文章

OpenClaw 个人网关设置:安装、初始配置与控制台

OpenClaw 是什么、如何安装并完成自托管多渠道网关的初始配置、在 18789 端口打开 Control UI,以及支持哪些 Node 版本,同时不跳过安全基线。

中级
10 分钟阅读
文章

OpenClaw 技能、心跳自治与审批关卡

了解 OpenClaw 如何加载技能、心跳周期性轮次如何运行、如何限制主机 shell 执行,以及如何通过严格的浏览器策略和经过审查的工作流确认来约束浏览器自动化。

中级
20 分钟
视频

RAG权限与访问控制:深入教程

Paragon. 视频逐步讲解生产环境中的RAG权限问题,并比较工具调用、命名空间、ACL表和基于关系的权限。这直接支持文章的核心规则:检索只能返回当前用户获准查看的来源,而且不能把源系统权限视为事后补充。

高级
69 分钟
视频

智能体生态:将智能体投入生产后得到的经验

MLOps.community. Prosus的AI副总裁和一位AI工程师讲述了他们在集团旗下公司部署智能体时真正出现的问题:上线前进行提示词注入渗透测试;Jira智能体无法理解人类简写而执行了不安全的写入;通过让智能体明确展示自身假设来处理陈旧上下文;以及在降级设计中,一旦智能体增加认知负担,就将其合并或停用。这就像把文章中的失败模式登记表搬进了一场现场复盘。

高级
7 分钟
视频

用Docling提升RAG与AI智能体

IBM Technology. 视频讲解RAG和智能体的摄取环节:如何准备PDF和其他文件,使文档结构、表格和版面布局能够保留到后续检索阶段。这印证了文章的提醒:RAG的质量与安全始于嵌入之前,解析复杂业务文档时尤其如此。

高级
10 分钟阅读
文章

生产AI失败模式:演示之后会出什么问题

AI系统通常以可预测的方式失败:幻觉、上下文过时、过度迎合、提示词注入、不安全的工具调用、模式漂移和薄弱的降级机制。这是一份面向真实工作流交付团队的生产AI失败模式清单。

高级
10 分钟阅读
文章

私有 AI 部署模式:本地、VPC、自托管和混合

私有 AI 并非单一架构。本文面向重视隐私和控制权的中小企业,对比本地模型、企业 SaaS、VPC 部署、自托管推理和混合模式。

高级
10 分钟阅读
文章

安全地将 AI 连接到电子邮件、日历和 CRM 系统

一份基于风险的指南:以最小权限、审批关卡、受保护的审计证据、负向测试与恢复路径,把AI连接到电子邮件、日历和CRM。

中级
8 分钟阅读
文章

在工作中使用AI时的隐私与数据卫生

一份实用指南,帮助你降低工作中使用AI时的隐私和保密风险。粘贴前,应检查具体产品、套餐、配置、数据和适用规则。

初级
25 分钟
视频

OWASP攻击LLM的10种方式:AI漏洞揭秘

IBM Technology. 视频从提示词注入扩展到更全面的OWASP LLM十大风险——不安全的输出处理、敏感信息泄露、过度代理等。在向任何工具授予Gmail或HubSpot权限范围之前,你正需要在脑中备好这份故障模式清单。

中级
11 分钟
视频

什么是提示词注入攻击?

IBM Technology. Jeff Crume用“以$1购买一辆SUV”的例子,在10分钟内极其清楚地解释了为什么直接提示词注入与间接提示词注入是两类不同的问题,以及为什么过滤无法彻底解决任何一类。这与文章的论点直接呼应:对于任何不可逆操作,你需要最小权限范围、专用智能体账号和人在回路机制,而不是更巧妙的系统提示词。

中级
13 分钟
视频

攻击LLM:提示词注入

LiveOverflow. 视频将提示词注入描述为一种经典的注入攻击,目标是混合指令与不可信数据的系统,并给出一个具体的内容审核示例:攻击者借此陷害无辜用户。从“模型是攻击目标”转变为“应用才是攻击目标”,正是文章开篇要求建立的思维方式。

高级
17 分钟
视频

保护LLM:防御提示词注入

LiveOverflow. 视频逐一讲解实际的纵深防御方案:对LLM输出进行污点分析、限制预期输出形态、用户隔离、少样本脚手架、微调、使用温度0实现确定性,以及为关键路径设置冗余。它与文章的防御体系章节几乎逐项对应。

高级