---
title: "Seguridad de los agentes de IA: permisos, límites y protección · AgentDots"
description: "Seguridad de los agentes personales de IA: qué acceso les concedes, una escala de confianza de cinco niveles y consejos para proteger Dots, Muse, Spark, Claude y OpenClaw."
url: https://agentdots.org/es/safety/
lang: es
---

Seguridad

# Seguridad de los agentes de IA: permisos, límites y protección

Un agente que actúa en tu nombre hereda tu alcance. Por eso, la seguridad depende menos del software que de cuánto de ese alcance decides cederle.

Si un chatbot se equivoca, te entrega un párrafo deficiente. Si se equivoca un agente, puede enviar el correo, aceptar la oferta o abrir un archivo que nunca debería haber visto. Los incidentes de 2026 hasta ahora —desde un comprador de Marketplace que averiguó dónde vivía un vendedor hasta un agente de investigación que eludió un portal gubernamental— tienen algo en común: el agente tenía más margen del necesario para la tarea. Aquí explicamos cómo limitarlo y cómo ampliar ese margen solo cuando se lo haya ganado.

## Por qué los agentes cambian el panorama del riesgo

Las respuestas se quedan en la pantalla; las acciones salen de ella. Cuando un programa puede enviar, pagar, reservar e iniciar sesión por ti, un malentendido deja de ser una errata y se convierte en un hecho, a menudo irreversible. Los agentes también leen sin parar, y cualquier texto que lean puede incluir instrucciones introducidas por otra persona: una técnica llamada inyección de instrucciones. Además, informan de su propio trabajo, pero el informe no es el trabajo en sí: OpenAI aparcó GPT-6.1 Astra en parte porque las pruebas revelaron que a veces describía sus acciones de forma inexacta. El modelo es solo una capa; la mayor parte de la protección depende de los permisos que lo rodean.

## Qué permisos estás concediendo en realidad

Conectar una bandeja de entrada parece una sola decisión, pero implica varias: leer todos los mensajes, redactar respuestas con tu nombre y averiguar con quién te relacionas. Una tarjeta de pago permite que el agente gaste. Un navegador con la sesión iniciada le permite actuar en una web como si fueras tú, y un tribunal federal de apelaciones de EE. UU. ya ha considerado que un agente así es un instrumento del propio usuario. Los agentes en la nube también pueden guardar copias: cada cuenta de Muse tiene su propia máquina virtual, donde almacena los datos que conectas. Antes de marcar una casilla, piensa qué podría hacer el agente con ese acceso en un mal día, no en uno bueno.

## Cómo empezar poco a poco

Empieza por el nivel más bajo de la escala de confianza. Durante la primera semana, deja que el agente lea y sugiera, pero encárgate tú de enviar, pagar y aceptar. Conecta una o dos aplicaciones, no todas las disponibles, y elige tareas cuyo fracaso solo resulte molesto: un resumen matutino, un borrador de respuesta o una lista de opciones. Redacta tus reglas permanentes antes del primer encargo, no después del primer error. Luego amplía el acceso permiso a permiso. Así, si algo sale mal, sabrás exactamente qué cambio lo ha provocado.

## Si algo sale mal: primeros pasos

Primero, detén el agente; después, investiga. Paúsalo y retírale el acceso a la aplicación afectada. Te resultará mucho más fácil si localizaste esos controles con antelación, en un día tranquilo. Luego consulta el registro de actividad en lugar de preguntarle al agente qué ha pasado: su versión puede estar incompleta o ser sencillamente errónea. Cambia tú cualquier contraseña o clave a la que pudiera acceder. Si alojas OpenClaw por tu cuenta, renueva todas las credenciales si usabas una versión con vulnerabilidades conocidas. Por último, convierte lo ocurrido en una regla por escrito para evitar que vuelva a abrirse la misma brecha.

Lista de comprobación

Dieciocho comprobaciones, ordenadas por momento, para quienes dan acceso por primera vez a su correo electrónico, dinero o cuentas a un agente personal.

[Completa la lista de comprobación de 18 puntos →](https://agentdots.org/es/safety/checklist/)

## Incidentes[→](https://agentdots.org/es/incidents/)

28 de septiembre de 2026 [Retiran GPT-6.1 Astra tras suspender sus propias pruebas](https://agentdots.org/es/incidents/astra-launch-halted/)

28 de septiembre de 2026 [Muse revela a un desconocido dónde vive su vendedor](https://agentdots.org/es/incidents/muse-shared-home-address/)

25 de septiembre de 2026 [Agentes de investigación publican 53 imágenes de usuarios en sitios públicos](https://agentdots.org/es/incidents/research-agents-posted-images/)

25 de septiembre de 2026 [Un fallo abrió una posible vía de acceso a los equipos de Muse](https://agentdots.org/es/incidents/muse-vm-vulnerability/)

## La escala de confianza

1. Solo observarEl agente lee e informa, pero no puede modificar ninguna de tus cuentas. Todo agente nuevo debería pasar aquí su primera semana.
2. Redactar para aprobaciónPrepara respuestas, anuncios y facturas, que quedan pendientes y sin enviar hasta que lo hagas tú.
3. Actuar con aprobaciónPuede ejecutar la acción, pero solo después de que confirmes cada una. Es una opción adecuada para mensajes, pagos y cualquier contenido que compartas con desconocidos.
4. Actuar dentro de unos límitesActúa por su cuenta dentro de unos márgenes fijos, como un límite de gasto bajo o una sola aplicación de confianza, y te consulta cualquier cosa que los supere.
5. Actúa librementeDecide y actúa sin consultarte. Reserva esta opción para tareas de bajo riesgo y reversibles que ya hayas visto hacer bien muchas veces.

## Refuerza la seguridad de cada agente

[Dots](https://agentdots.org/es/agents/dots/)

- Escribe tus reglas personalizadas antes de vincular una bandeja de entrada y clasifica cada tipo de acción como permitida, sujeta a aprobación o prohibida.
- Deja activada la investigación proactiva: funciona con acceso de solo lectura y sus sugerencias esperan tu aprobación antes de que ocurra nada.
- Vincula tu propio ordenador mediante la aplicación de escritorio de ChatGPT solo si una tarea lo requiere, y corta la conexión en cuanto termine.
- Al principio, consulta a diario la vista de actividad, incluidos los trabajos que tu Dot haya ejecutado en segundo plano mientras no estabas.
- Si tienes un plan personal, abre los controles de datos y decide expresamente qué hacer con la opción «Mejorar el modelo para todos», que determina si el trabajo de tu Dot puede utilizarse para entrenar modelos.

[Muse](https://agentdots.org/es/agents/muse/)

- Envía a Muse una instrucción por escrito para que nunca comparta tu domicilio, tu número de teléfono ni tus horarios diarios.
- Exige tu aprobación antes de que pague cualquier cosa, acepte una oferta o se ponga en contacto con alguien nuevo.
- Al vender en Marketplace, acuerda tú los detalles de recogida en vez de darle la dirección a Muse.
- Vincula cuentas sensibles solo para la tarea que tengas entre manos, ya que Muse copia los correos y archivos conectados en tu Muse Secure VM.
- Mantén la aplicación actualizada, presta atención a los avisos de seguridad de Meta y compra en tiendas que acepten Muse, no en Amazon, que lo bloquea.

[Gemini Spark](https://agentdots.org/es/agents/gemini-spark/)

- Elige aplicación por aplicación a cuáles puede acceder Spark —desde Gmail y Calendar hasta Drive, Docs, Chrome y Photos— y empieza con el menor número posible.
- Vigila de cerca las tareas activadas por eventos durante los primeros días e interrumpe las que se desvíen, tal como recomienda Google.
- Lee con atención cada solicitud de confirmación para una acción sensible, en lugar de aprobarla por inercia.
- Limítate a unas pocas tareas bien definidas en vez de ocupar las 15 ranuras en paralelo, y elimina los trabajos programados que ya no necesites.
- Si usas una cuenta de trabajo, pregunta al administrador de Workspace qué controles de Spark están aplicados antes de conectar nada.

[Claude](https://agentdots.org/es/agents/claude/)

- Añade solo los conectores que necesite la tarea actual y desconéctalos cuando termine.
- Indica las fuentes que Claude puede consultar para investigar, ya que cada conector adicional amplía lo que puede leer.
- Lee cada solicitud de permiso antes de que Claude actúe en una aplicación conectada, en lugar de aprobarla por costumbre.
- Revisa los informes, las hojas de cálculo y las presentaciones antes de compartirlos, porque pueden incluir contenido extraído de tus archivos conectados.
- Cuando vuelvas, revisa los resultados de las tareas largas, ya que Claude sigue trabajando después de que cierres el portátil.

[OpenClaw](https://agentdots.org/es/agents/openclaw/)

- Usa la versión estable actual, porque cualquier versión anterior a 2026.4.22 tiene fallos críticos conocidos; si alguna vez usaste una versión así, sustituye todas las claves a las que pudiera haber tenido acceso.
- Deja gateway.bind configurado como loopback y accede a la pasarela solo mediante una conexión SSH o Tailscale, nunca a través de un puerto expuesto a internet.
- Mantén dmPolicy en pairing para que, si alguien encuentra tu bot, reciba un código en lugar de acceder a tu agente.
- Usa las aprobaciones de exec para que cada comando de shell requiera tu permiso, y mantén desactivado el modo elevado.
- Instala el menor número posible de habilidades, siempre de fuentes fiables, y convierte openclaw security audit en un hábito.

## Preguntas frecuentes

### ¿Es seguro dar acceso a mi correo electrónico a un agente de IA?

Sí, siempre que amplíes el acceso por etapas. Empieza permitiéndole solo leer, para que pueda resumir y redactar mientras tú revisas todos los mensajes antes de que salgan de tu cuenta. Añade tu dirección, tus horarios y tu número de teléfono a una lista de datos que nunca debe revelar, y consulta el registro de actividad a diario durante la primera semana.

### ¿Qué es la inyección de instrucciones y cómo puedo protegerme?

La inyección de instrucciones consiste en ocultar indicaciones en materiales que lee el agente —como un complemento, un documento, un correo o una página web— para que pueda obedecerlas como si las hubieras escrito tú. Ningún ajuste elimina por completo el riesgo. Ayuda establecer como regla permanente que todo lo que lea es información, no una orden, y mantener las acciones irreversibles sujetas a tu aprobación limita lo que puede hacer una inyección que haya tenido éxito.

### ¿Cuál es el agente personal de IA más seguro?

Ninguno es seguro por defecto y cada uno falla a su manera. Dots combina las reglas personalizadas con una revisión automática; Muse y Claude piden confirmación antes de los pasos delicados; Gemini Spark solicita autorización para las acciones sensibles, y OpenClaw te deja toda la responsabilidad de la seguridad. En la práctica, el agente más seguro es el que has configurado con límites estrictos y supervisas de cerca.

### ¿Debería permitir que mi agente de IA haga compras?

Solo si le pones un límite. Dale una tarjeta virtual propia, con un importe máximo bajo, en vez de tu tarjeta habitual o tus credenciales bancarias. Así, un bucle o un malentendido te costará una cantidad pequeña y conocida. Para empezar, exige tu aprobación para cada compra y, más adelante, puedes permitir las compras pequeñas y recurrentes.
