No le creas a las buenas intenciones de tu copiloto de IA
La cosa es esta: tu asistente de programación basado en IA no es malicioso. Pero no sabe qué es peligroso. Y eso es un problema.
Simon Willison acuñó el término **“trifecta mortal”**: datos privados, contenido no confiable y una forma de exfriarlos —todo en una sola sesión. Eso es justamente lo que pasa cuando dejas que un agente de IA se suelte por tu código, archivos locales o incluso pestañas del navegador. Lee todo, conecta puntos y luego… manda cosas a APIs. Quizás no con intención. Pero va a pasar.
Así que deja de confiar solo en filtros de prompt.
Déjame explicarte por qué.
---
¿Qué son los filtros de prompt?
Los filtros de prompt son mecanismos de seguridad integrados directamente en las instrucciones al modelo. Cosas como:
> "No muestres rutas de archivos."
>
> "Nunca envíes datos fuera del sistema."
Suena genial en teoría. En la práctica? Se saltan fácilmente con demasiada información, frases reformuladas o simplemente porque el modelo se olvida cuando la conversación se alarga demasiado.
Son como poner un post-it en la nevera que diga “no comas el pastel”… mientras dejas la puerta abierta.
---
Por qué el camino de ejecución importa más que los prompts
La verdadera protección debe estar donde se toman decisiones: **el flujo de ejecución**. No puedes esperar a que la IA haga lo correcto solo porque le dijiste que lo haga.
Piensa en las leyes de tránsito. Las señales guían, pero los semáforos, los baches y las verjas bloquean físicamente los errores. Eso necesitamos también para la IA.
Ejemplo 1: Acceso a archivos locales mal hecho
Imagina que estás construyendo una app en Flutter con ayuda de IA. Le pides que refactoriza algunos componentes. Durante la charla, accede a tu estructura de proyecto —incluyendo archivos de configuración con secretos como claves API.
Más tarde, sin querido, le preguntas: “¿Puedes resumir este error?” Y de repente, sin darte cuenta, la IA incluye fragmentos de esos archivos sensibles en su respuesta.
¿Por qué? Porque nada se lo impidió.
En vez de eso, pon límites con herramientas de aislamiento o controles a nivel de entorno. Bloquea el acceso a ciertos archivos a menos que se autorice explícitamente. Cosas como [OpenCode](https://opencode.ai/) o agentes personalizados hechos con frameworks como LangChain pueden dirigir las solicitudes por ejecutores controlados, no por accesos directos al sistema.
Ejemplo 2: Desastre con extensiones de navegador
Usas una extensión de IA para escribir correos o resumir artículos. Un día, mientras estás en tu banca en línea, le dices a la IA: “resume esta página”. Ups —toma números de cuenta e historial de transacciones junto con el texto.
Aunque el prompt diga “no incluyas información personal”, igual la puede hacer. Hay demasiada información ahí.
¿Solución? Restringe los permisos de extracción del DOM. Solo permite acceso a ciertos dominios. Usa aislamiento con iframes o navegadores sin cabeza limitados a sitios aprobados.
Ejemplo 3: Riesgos en intérpretes de código
Herramientas como cuadernos Jupyter con LLM integrados parecen seguros —corren en contenedores. Pero a veces están mal configurados. La IA lee variables del entorno, extrae claves SSH o peor: empieza a mandar logs a servidores externos.
Pon reglas estrictas sobre llamadas de red, acceso a variables de entorno y escritura en disco, dentro del intérprete mismo. No solo en el prompt.
---
Cómo crear flujos de trabajo seguros con IA
Entonces, ¿cómo dejamos de confiar ciegamente en la IA?
Paso 1: Establece límites desde el principio
Define qué puede y qué no puede tocar la IA antes de empezar. Limita tipos de archivos, carpetas y procesos.
Usa herramientas como:
- [GitHub Copilot Enterprise](https://github.com/features/copilot)
- [Replit Ghost](https://replit.com/site/ghost)
- Agentes personalizados con [LangGraph](https://www.langchain.com/langgraph)
Paso 2: Monitorea las acciones reales
Registra cada llamada API, lectura/escritura de archivos, comando de terminal y petición web hecha por la IA. Revísalas con frecuencia.
Si usas algo como [Astra](https://arcprize.org/blog/astra), revisa sus paneles de monitoreo.
Paso 3: Agrega capas de seguridad
Pon firewalls, proxys y gestores de credenciales entre la IA y los sistemas críticos. Nunca guardes contraseñras en texto plano.
Herramientas como HashiCorp Vault o AWS Secrets Manager funcionan bien con cualquier pipeline de desarrollo.
---
Reflexión final: confía, pero verifica
Los copilotos de IA son aliados poderosos… pero solo si los mantienes bien atados.
Confiar solo en prompts es como dejar tu puerta principal abierta porque esperas que los ladrones no entren. Falla más de lo que crees.
Construye barreras en tu infraestructura, no solo en tus instrucciones.
Porque la próxima vez que tu IA decida ayudarte compartiendo un archivo de configuración, no querrás descubrirlo a posteriori.
---
Preguntas frecuentes
P1: ¿No puedo simplemente desconectar internet?
Sí —pero eso limita funcionalidad. Mejor idea: controla qué URLs o endpoints puede alcanzar la IA.
P2: ¿No lo manejan ya la mayoría de las plataformas?
No del todo. Muchas ofrecen protecciones básicas, pero suelen depender más de prompts que de restricciones reales.
P3: ¿Y los entornos aislados?
Excelente. Contenedores, máquinas virtuales y shells restringidos evitan fugas accidentales.
P4: ¿Dónde aprendo más sobre seguridad con IA?
Sigue el blog de Simon Willison ([simonwillison.net](https://simonwillison.net/)) y mantente al día con equipos como el de seguridad de IA de Mozilla o OpenAI.
Tecnología
Comments (0)
No comments yet. Be the first to comment!
Leave a Comment