Seguridad de la IA
Inyección de prompts, filtraciones, acceso inseguro a herramientas, permisos y modos de fallo en producción.
19 contenidos (12 artículos · 7 vídeos)
Comienza aquí
Una selección inicial antes de explorar todo el contenido.
14 min de lecturaInyección de prompts y seguridad de los LLM: modelos de amenazas y defensa en profundidad
La inyección de prompts es una categoría permanente de riesgo para la seguridad de los LLM, no un error de redacción de prompts. Esta guía para producción aborda modelos de amenazas, límites de datos, permisos de herramientas, pruebas de regresión, monitorización y respuesta a incidentes.
Avanzado
10 min de lecturaRAG de conocimiento corporativo: permisos, filtraciones y límites de las fuentes
Un asistente de conocimiento corporativo solo es seguro si la recuperación respeta los permisos. Explicamos cómo diseñar límites de fuentes RAG, filtrado por ACL, responsables de documentos, registros, tratamiento de fuentes obsoletas y respuestas de rechazo.
Avanzado
11 min de lecturaIngestión segura de documentos para RAG: PDFs, OCR, metadatos y conservación
La calidad del RAG comienza antes de la recuperación. Una guía de ingestión segura para PDFs, OCR, metadatos, permisos, frescura de las fuentes, eliminación, riesgo de malware y propiedad operativa.
AvanzadoMás sobre este tema
7 min de lecturaWebhooks de Hermes: agentes impulsados por eventos sin un prompt gigante que lo abarque todo
Configura webhooks de Hermes Agent con la autenticación adecuada para cada proveedor, controles de estado en el puerto 8644 y rutas pequeñas con nombre, para que los eventos desencadenen ejecuciones de agente enfocadas y con un destino de entrega explícito.
Intermedio
10 min de lecturaNemoClaw en DGX Spark: plan de despliegue y seguridad
Planifica y evalúa OpenClaw, Hermes o Deep Agents Code dentro de NVIDIA OpenShell en DGX Spark: puesta en marcha actual, capas de políticas, inferencia enrutada y evidencia de aceptación necesaria.
Avanzado
8 min de lecturaListas de permitidos, emparejamiento y seguridad de menciones en grupos de OpenClaw
Las listas de permitidos de canal, el emparejamiento DM y las reglas de mención en grupos son el límite de seguridad real de OpenClaw — porque las herramientas pueden incluir shell, archivos y navegador. Un checklist práctico de bloqueo.
Intermedio
9 min de lecturaConfiguración del gateway personal de OpenClaw: instalación, onboarding y panel de control
Qué es OpenClaw, cómo instalar y configurar la pasarela multicanal autoalojada, abrir la UI de control en el puerto 18789 y qué versiones de Node son compatibles sin omitir las bases de seguridad.
Intermedio
10 min de lecturaSkills, heartbeat y puertas de aprobación en OpenClaw
Cómo se cargan las skills de OpenClaw, cómo funcionan los turnos periódicos del heartbeat, cómo controlar la ejecución del shell del host y cómo mantener la automatización del navegador tras una política restrictiva y la confirmación de un workflow revisado.
Intermedio
20 minutosPermisos y control de acceso para RAG: tutorial detallado
Paragon. Explica el problema de los permisos en un RAG de producción y compara las llamadas a herramientas, los espacios de nombres, las tablas ACL y los permisos basados en relaciones. Esto respalda directamente la regla principal del artículo: la recuperación solo debe devolver fuentes que el usuario actual esté autorizado a ver, y los permisos de los sistemas de origen no pueden tratarse como una consideración posterior.
Avanzado
69 minutosEl panorama de los agentes: lecciones aprendidas al llevar agentes a producción
MLOps.community. El vicepresidente de IA de Prosus y un ingeniero de IA explican qué falló realmente cuando desplegaron agentes en las empresas de la cartera del grupo: pruebas de penetración de inyección de prompts antes del lanzamiento; una escritura insegura cuando un agente de Jira no interpretó correctamente la taquigrafía humana; contexto obsoleto gestionado haciendo que los agentes expusieran sus supuestos; y mecanismos alternativos que fusionaban o retiraban agentes cuando estos empezaban a añadir carga cognitiva. Es como ver el registro de modos de fallo del artículo reproducido en una autopsia en directo.
Avanzado
7 minutosMejora tu RAG y tus agentes de IA con Docling
IBM Technology. Explica la parte de ingestión de RAG y de los agentes: cómo preparar PDFs y otros archivos para que la estructura del documento, las tablas y el diseño se conserven durante la recuperación posterior. Esto respalda la advertencia del artículo de que la calidad y la seguridad de RAG comienzan antes de crear embeddings, especialmente al procesar documentos empresariales complejos.
Avanzado
10 min de lecturaModos de fallo de IA en producción: qué falla después de la demostración
Los sistemas de IA suelen fallar de formas predecibles: alucinaciones, contexto obsoleto, complacencia, inyección de prompts, uso inseguro de herramientas, deriva de esquemas y gestión deficiente de fallos. Este registro de modos de fallo está dirigido a equipos que despliegan flujos de trabajo reales.
Avanzado
10 min de lecturaPatrones de despliegue de IA privada: local, VPC, en infraestructura propia e híbrido
La IA privada no es una única arquitectura. Una comparación práctica de modelos locales, SaaS empresarial, despliegues en VPC, inferencia alojada en infraestructura propia y patrones híbridos para pymes que priorizan la privacidad y el control.
Avanzado
10 min de lecturaConectar la IA a tu correo electrónico, calendario y CRM de forma segura
Una guía basada en riesgos para conectar la IA con correo electrónico, calendario y CRM mediante alcance mínimo, puertas de aprobación, evidencia de auditoría protegida, pruebas negativas y rutas de recuperación.
Intermedio
8 min de lecturaPrivacidad e higiene de los datos al usar IA en el trabajo
Una guía práctica para reducir los riesgos de privacidad y confidencialidad al usar IA en el trabajo. Comprueba el producto, el plan, la configuración, los datos y las reglas aplicables antes de pegar contenido.
Principiante
25 minutosOWASP Top 10: formas de atacar los LLM y vulnerabilidades de IA al descubierto
IBM Technology. Amplía el foco desde la inyección de prompts hasta el OWASP Top 10 para LLM —gestión insegura de las salidas, divulgación de información sensible y autonomía excesiva—, exactamente el catálogo de modos de fallo que conviene tener presente antes de conceder a un agente permisos de Gmail o HubSpot.
Intermedio
11 minutos¿Qué es un ataque de inyección de prompt?
IBM Technology. El ejemplo de Jeff Crume de «comprar un SUV por $1» es la explicación más clara en 10 minutos de por qué la inyección directa y la indirecta son problemas distintos, y de por qué el filtrado no puede resolver por completo ninguno de los dos. Enlaza directamente con el argumento del artículo: necesitas ámbitos que apliquen el principio de mínimo privilegio, una cuenta específica para el agente y una persona que supervise cualquier acción irreversible, no un prompt del sistema más ingenioso.
Intermedio
13 minutosAtaques contra LLM: inyección de prompts
LiveOverflow. Presenta la inyección de prompts como un ataque de inyección clásico contra sistemas que mezclan instrucciones con datos no fiables, mediante un ejemplo de moderación de contenido en el que el atacante incrimina a una persona inocente. El cambio mental de «el modelo es el objetivo» a «la aplicación es el objetivo» coincide exactamente con el inicio del artículo.
Avanzado
17 minutosDefensa de LLM: inyección de prompts
LiveOverflow. Recorre el verdadero método de defensa en profundidad: análisis de contaminación (*taint analysis*) de las salidas del LLM, restricción de la estructura esperada, aislamiento entre usuarios, estructuras *few-shot*, fine-tuning, temperatura 0 para obtener determinismo y redundancia en rutas críticas. Coincide casi elemento por elemento con el stack defensivo del artículo.
Avanzado