Tema

Seguridad de la IA

Inyección de prompts, filtraciones, acceso inseguro a herramientas, permisos y modos de fallo en producción.

19 contenidos (12 artículos · 7 vídeos)

Comienza aquí

Una selección inicial antes de explorar todo el contenido.

Más sobre este tema

7 min de lectura
Artículo

Webhooks de Hermes: agentes impulsados por eventos sin un prompt gigante que lo abarque todo

Configura webhooks de Hermes Agent con la autenticación adecuada para cada proveedor, controles de estado en el puerto 8644 y rutas pequeñas con nombre, para que los eventos desencadenen ejecuciones de agente enfocadas y con un destino de entrega explícito.

Intermedio
10 min de lectura
Artículo

NemoClaw en DGX Spark: plan de despliegue y seguridad

Planifica y evalúa OpenClaw, Hermes o Deep Agents Code dentro de NVIDIA OpenShell en DGX Spark: puesta en marcha actual, capas de políticas, inferencia enrutada y evidencia de aceptación necesaria.

Avanzado
8 min de lectura
Artículo

Listas de permitidos, emparejamiento y seguridad de menciones en grupos de OpenClaw

Las listas de permitidos de canal, el emparejamiento DM y las reglas de mención en grupos son el límite de seguridad real de OpenClaw — porque las herramientas pueden incluir shell, archivos y navegador. Un checklist práctico de bloqueo.

Intermedio
9 min de lectura
Artículo

Configuración del gateway personal de OpenClaw: instalación, onboarding y panel de control

Qué es OpenClaw, cómo instalar y configurar la pasarela multicanal autoalojada, abrir la UI de control en el puerto 18789 y qué versiones de Node son compatibles sin omitir las bases de seguridad.

Intermedio
10 min de lectura
Artículo

Skills, heartbeat y puertas de aprobación en OpenClaw

Cómo se cargan las skills de OpenClaw, cómo funcionan los turnos periódicos del heartbeat, cómo controlar la ejecución del shell del host y cómo mantener la automatización del navegador tras una política restrictiva y la confirmación de un workflow revisado.

Intermedio
20 minutos
Vídeo

Permisos y control de acceso para RAG: tutorial detallado

Paragon. Explica el problema de los permisos en un RAG de producción y compara las llamadas a herramientas, los espacios de nombres, las tablas ACL y los permisos basados en relaciones. Esto respalda directamente la regla principal del artículo: la recuperación solo debe devolver fuentes que el usuario actual esté autorizado a ver, y los permisos de los sistemas de origen no pueden tratarse como una consideración posterior.

Avanzado
69 minutos
Vídeo

El panorama de los agentes: lecciones aprendidas al llevar agentes a producción

MLOps.community. El vicepresidente de IA de Prosus y un ingeniero de IA explican qué falló realmente cuando desplegaron agentes en las empresas de la cartera del grupo: pruebas de penetración de inyección de prompts antes del lanzamiento; una escritura insegura cuando un agente de Jira no interpretó correctamente la taquigrafía humana; contexto obsoleto gestionado haciendo que los agentes expusieran sus supuestos; y mecanismos alternativos que fusionaban o retiraban agentes cuando estos empezaban a añadir carga cognitiva. Es como ver el registro de modos de fallo del artículo reproducido en una autopsia en directo.

Avanzado
7 minutos
Vídeo

Mejora tu RAG y tus agentes de IA con Docling

IBM Technology. Explica la parte de ingestión de RAG y de los agentes: cómo preparar PDFs y otros archivos para que la estructura del documento, las tablas y el diseño se conserven durante la recuperación posterior. Esto respalda la advertencia del artículo de que la calidad y la seguridad de RAG comienzan antes de crear embeddings, especialmente al procesar documentos empresariales complejos.

Avanzado
10 min de lectura
Artículo

Modos de fallo de IA en producción: qué falla después de la demostración

Los sistemas de IA suelen fallar de formas predecibles: alucinaciones, contexto obsoleto, complacencia, inyección de prompts, uso inseguro de herramientas, deriva de esquemas y gestión deficiente de fallos. Este registro de modos de fallo está dirigido a equipos que despliegan flujos de trabajo reales.

Avanzado
10 min de lectura
Artículo

Patrones de despliegue de IA privada: local, VPC, en infraestructura propia e híbrido

La IA privada no es una única arquitectura. Una comparación práctica de modelos locales, SaaS empresarial, despliegues en VPC, inferencia alojada en infraestructura propia y patrones híbridos para pymes que priorizan la privacidad y el control.

Avanzado
10 min de lectura
Artículo

Conectar la IA a tu correo electrónico, calendario y CRM de forma segura

Una guía basada en riesgos para conectar la IA con correo electrónico, calendario y CRM mediante alcance mínimo, puertas de aprobación, evidencia de auditoría protegida, pruebas negativas y rutas de recuperación.

Intermedio
8 min de lectura
Artículo

Privacidad e higiene de los datos al usar IA en el trabajo

Una guía práctica para reducir los riesgos de privacidad y confidencialidad al usar IA en el trabajo. Comprueba el producto, el plan, la configuración, los datos y las reglas aplicables antes de pegar contenido.

Principiante
25 minutos
Vídeo

OWASP Top 10: formas de atacar los LLM y vulnerabilidades de IA al descubierto

IBM Technology. Amplía el foco desde la inyección de prompts hasta el OWASP Top 10 para LLM —gestión insegura de las salidas, divulgación de información sensible y autonomía excesiva—, exactamente el catálogo de modos de fallo que conviene tener presente antes de conceder a un agente permisos de Gmail o HubSpot.

Intermedio
11 minutos
Vídeo

¿Qué es un ataque de inyección de prompt?

IBM Technology. El ejemplo de Jeff Crume de «comprar un SUV por $1» es la explicación más clara en 10 minutos de por qué la inyección directa y la indirecta son problemas distintos, y de por qué el filtrado no puede resolver por completo ninguno de los dos. Enlaza directamente con el argumento del artículo: necesitas ámbitos que apliquen el principio de mínimo privilegio, una cuenta específica para el agente y una persona que supervise cualquier acción irreversible, no un prompt del sistema más ingenioso.

Intermedio
13 minutos
Vídeo

Ataques contra LLM: inyección de prompts

LiveOverflow. Presenta la inyección de prompts como un ataque de inyección clásico contra sistemas que mezclan instrucciones con datos no fiables, mediante un ejemplo de moderación de contenido en el que el atacante incrimina a una persona inocente. El cambio mental de «el modelo es el objetivo» a «la aplicación es el objetivo» coincide exactamente con el inicio del artículo.

Avanzado
17 minutos
Vídeo

Defensa de LLM: inyección de prompts

LiveOverflow. Recorre el verdadero método de defensa en profundidad: análisis de contaminación (*taint analysis*) de las salidas del LLM, restricción de la estructura esperada, aislamiento entre usuarios, estructuras *few-shot*, fine-tuning, temperatura 0 para obtener determinismo y redundancia en rutas críticas. Coincide casi elemento por elemento con el stack defensivo del artículo.

Avanzado