Los atacamos
Buscamos cómo romper tus agentes antes de que lo haga otro. Te entregamos cada problema con los pasos exactos para reproducirlo, no una lista de teorías.
ACELERA SAFETY
Si tu empresa tiene agentes conectados a datos, sistemas o clientes, alguien tiene que revisar qué pueden hacer mal. Eso hacemos: los atacamos, los limitamos y los vigilamos.
Sin integración · Sin tocar producción · Respuesta en 24 h
Ejemplo con datos ficticios
QUÉ HACEMOS
No vendemos una plataforma ni un curso. Entramos, revisamos tus agentes y los dejamos funcionando igual pero sin poder causar daño.
Buscamos cómo romper tus agentes antes de que lo haga otro. Te entregamos cada problema con los pasos exactos para reproducirlo, no una lista de teorías.
Cada agente queda con permiso para hacer solo su trabajo. Nada más. Y lo que es irreversible —pagar, borrar, publicar— pasa por una persona.
Queda registro de todo lo que leen, deciden y ejecutan. Si algo se sale de lo normal, te avisamos el mismo día.
Probamos meterle instrucciones escondidas por cada canal que tu agente lee: mails, PDFs, tickets, páginas web. También intentamos sacarle datos y usar sus herramientas para lo que no fueron pensadas.
Hoy la mayoría de los agentes corren con la credencial de un humano senior porque era lo más rápido de conectar. Lo dejamos con el mínimo que necesita, aplicado donde se ejecuta —no como una instrucción que el modelo puede ignorar.
Cada lectura y cada acción queda registrada con su contexto. Sirve para dos cosas: enterarte el mismo día de que algo raro pasó, y poder responder cuando te lo pregunte un cliente, un auditor o tu directorio.
QUÉ PUEDE SALIR MAL
No son hipótesis. Es lo que aparece una y otra vez cuando revisamos agentes que ya están trabajando.
Un mail, un PDF o una página web con instrucciones escondidas. El agente las obedece como si vinieran de tu equipo. El atacante no necesita saber programar: escribe en español.
Puede borrar, pagar o publicar porque le dieron la credencial que ya existía. Nadie definió el mínimo que necesita para la tarea que realmente hace.
Lee de tu base y escribe en un servicio de afuera. Con la combinación justa de permisos, una sola corrida alcanza para sacar toda la tabla sin que suene ninguna alarma.
Cada plugin o servidor MCP que le conectás es código corriendo con las credenciales de tu agente. Se actualiza solo, cambia lo que hace, y nadie lo revisa.
Tokens sin vencimiento metidos en el prompt, en el repo o en el entorno. Se comparten entre agentes, sobreviven al proyecto y nadie sabe cuáles siguen vivos.
Agentes que un equipo levantó por su cuenta, conectados a datos reales, que no figuran en ninguna lista. Son justo los que nadie revisa.
CÓMO EMPEZÁS
Casi todos empiezan por el diagnóstico gratis. Si de ahí no sale nada grave, te lo decimos y listo.
Diagnóstico
Gratis
1 semana · 1 agente
Auditoría completa
A medida
2 a 4 semanas · todos tus agentes
Protección continua
Abono
Mensual · incluye lo anterior
Medimos contra marcos públicos —OWASP Top 10 para LLM, NIST AI RMF, MITRE ATLAS, ISO/IEC 42001— para que el informe le sirva a tu equipo de seguridad y a tu auditor sin tener que creernos a nosotros.
DUDAS
Ayuda, pero no hace falta. Si estás por lanzar el primero, revisarlo antes sale mucho más barato que arreglarlo después: se definen los permisos y el registro cuando todavía no hay nada que migrar.
Es el caso más común. Trabajamos sobre agentes hechos in-house, con frameworks de terceros o contratados a otro proveedor. Tampoco importa qué modelo usen.
Solo si vos lo pedís y con un alcance firmado. Por defecto trabajamos en un entorno espejo con datos inventados. El diagnóstico gratis nunca toca producción.
No. Les damos la parte que todavía no tienen herramientas para cubrir. El objetivo es que después lo sostengan solos: si al final nos necesitás para operarlo todos los meses, algo hicimos mal.
Te lo decimos y te queda el informe para mostrarlo. Es el mismo criterio que usamos en Acelera con la IA: si no necesitás el trabajo, lo decimos en la primera reunión en vez de venderte una etapa más.
EMPEZÁ ACÁ
Contanos qué agente te preocupa y a qué llega. En una semana te decimos qué puede hacer mal. Sin integración, sin tocar producción y sin compromiso.