La decisión no es «¿Qué logo aloja el agente?», sino «¿Quién puede operar, inspeccionar, restaurar y cambiar cada parte del runtime?»
¿Qué incluye el alojamiento de agentes de IA?
El alojamiento incluye el runtime y cada dependencia necesaria para mantener el trabajo del agente disponible, inspeccionable y recuperable. La arquitectura de referencia de Google Cloud separa la plataforma de alojamiento, las interacciones, los modelos, la memoria, las bases vectoriales, las herramientas y la ejecución de código (Google Cloud, verificado el 18 de septiembre de 2026). Mastra también separa el runtime del acceso a modelos, el almacenamiento persistente, los secretos, las trazas y las llamadas a herramientas (Mastra, verificado el 18 de septiembre de 2026).
Usa este mapa de propiedad:
- Cómputo y runtime. Registra dónde corre el proceso y quién puede desplegarlo, pararlo, reiniciarlo o actualizarlo. Cloud Run documenta servicios, instancias, worker pools y jobs como recursos distintos para cargas de agentes (Google Cloud, verificado el 18 de septiembre de 2026).
- Acceso a modelos. Registra cada endpoint, la cuenta propietaria y la persona autorizada para cambiarlo. La arquitectura de Google Cloud muestra la capa de orquestación llamando a modelos alojados mediante distintos servicios (Google Cloud, verificado el 18 de septiembre de 2026).
- Archivos y estado. Registra archivos de trabajo, estado de conversación, checkpoints, memoria y el almacén usado para cada elemento. Mastra indica que los agentes con estado necesitan un almacén duradero y que el estado en memoria no sobrevive a un reinicio del servidor (Mastra, verificado el 18 de septiembre de 2026).
- Secretos. Registra claves de modelos, credenciales de base de datos y credenciales de herramientas, además de quién puede crearlas, leerlas, rotarlas o revocarlas. Mastra recomienda mantenerlas en el servidor y usar variables de entorno o un almacén de secretos en vez de incluirlas en el código (Mastra, verificado el 18 de septiembre de 2026).
- Registros y trazas. Registra qué eventos se capturan, adónde van y quién los revisa. Mastra describe trazas que cubren llamadas a modelos, invocaciones de herramientas, recuperación de memoria y respuesta final (Mastra, verificado el 18 de septiembre de 2026).
- Copias de seguridad. Define qué almacenes persistentes, archivos y configuración entran en el alcance. Las fuentes establecen que el estado debe persistir fuera de la memoria del proceso; el alcance exacto sigue siendo una decisión del despliegue (Mastra, verificado el 18 de septiembre de 2026).
- Recuperación. Nombra quién restaura cada componente conservado y quién acepta el servicio restaurado. Mastra identifica los reintentos y la recuperación de fallos como asuntos de producción, mientras el procedimiento real depende del despliegue (Mastra, verificado el 18 de septiembre de 2026).
La lista descubre una separación habitual. Un proveedor puede operar el cómputo mientras tu empresa conserva las cuentas de modelos, las credenciales de herramientas, los almacenes o las decisiones de recuperación. Una máquina propia puede invertir la asignación del cómputo y seguir llamando a modelos y herramientas externos (Google Cloud, verificado el 18 de septiembre de 2026).
¿Cómo se comparan el alojamiento gestionado y una máquina propia?
Se diferencian por el operador predeterminado del runtime, no por el número de responsabilidades que hay que asignar. Mastra describe los runtimes gestionados como un intercambio de trabajo operativo por dependencia de las abstracciones y precios del proveedor. También describe los servidores autoalojados como despliegues flexibles cuyo operador gestiona escalado, monitorización y reinicios (Mastra, verificado el 18 de septiembre de 2026).
| Fila de propiedad | Alojamiento gestionado | Máquina operada por su dueño | Evidencia que recopilar |
|---|---|---|---|
| Cómputo | El proveedor opera el runtime dentro del límite documentado | Un operador nombrado administra host o contenedor | Destino, administradores y ruta de reinicio (Mastra, verificado el 18 de septiembre de 2026) |
| Modelos | Puede venir incluido o conectado mediante otra cuenta | El operador configura endpoints locales o externos | Endpoints, dueño de cuenta y autoridad de cambio (Google Cloud, verificado el 18 de septiembre de 2026) |
| Archivos y estado | El proveedor puede aportar almacenamiento o el comprador conectarlo | El operador elige y mantiene los almacenes | Mapa de almacenes, roles y prueba de persistencia (Mastra, verificado el 18 de septiembre de 2026) |
| Secretos | La plataforma puede guardar las credenciales | El operador elige el mecanismo | Inventario, responsable de rotación y ruta de revocación (Mastra, verificado el 18 de septiembre de 2026) |
| Registros | Las herramientas del proveedor pueden capturar eventos elegidos | El operador elige y mantiene las herramientas | Eventos, destino y roles lectores (Mastra, verificado el 18 de septiembre de 2026) |
| Copias | Hay que confirmar archivos y almacenes incluidos | El operador define y ejecuta el alcance | Componentes, responsable y registro vigente (Mastra, verificado el 18 de septiembre de 2026) |
| Recuperación | Hay que separar tareas de proveedor y comprador | El operador posee la ruta escrita de restauración | Responsable de restaurar, de aceptar y registro (Mastra, verificado el 18 de septiembre de 2026) |
La tabla es una hoja de trabajo, no una garantía del proveedor. Complétala con la documentación actual, la configuración y el registro operativo del servicio elegido.
Mira el cockpit de AI Jungle OS para comparar una máquina propia y done-with-you con un runtime gestionado sin ocultar el reparto de responsabilidades.
¿Puedo alojar un agente de IA?
Sí. Puedes alojarlo como servicio por petición, instancia persistente, worker en segundo plano o job que termina cuando ese recurso corresponde al trabajo. Google Cloud asigna agentes sin estado y dirigidos por peticiones a servicios; bucles dedicados y persistentes a instancias; flotas de fondo a worker pools; y flujos acotados a jobs (Google Cloud, verificado el 18 de septiembre de 2026).
El destino de despliegue es solo una parte del mapa. Un agente alojado también puede llamar a modelos externos, guardar memoria aparte, consultar una base vectorial, usar herramientas y ejecutar código (Google Cloud, verificado el 18 de septiembre de 2026). El alojamiento se convierte en una decisión operativa cuando esos caminos tienen dueño.
Ajusta el runtime al trabajo:
- Usa un servicio para trabajo por petición. Google Cloud presenta servicios para agentes sin estado que responden a tráfico variable (Google Cloud, verificado el 18 de septiembre de 2026).
- Usa una instancia para un bucle persistente. Google Cloud presenta instancias para bucles dedicados, con estado y siempre activos (Google Cloud, verificado el 18 de septiembre de 2026).
- Usa un worker pool para trabajo en cola. Google Cloud presenta worker pools para agentes distribuidos que consumen tareas sin endpoint HTTP público (Google Cloud, verificado el 18 de septiembre de 2026).
- Usa un job para ejecución acotada. Google Cloud presenta jobs para flujos que terminan, incluidos trabajos programados o por lotes (Google Cloud, verificado el 18 de septiembre de 2026).
Son ejemplos del modelo de recursos de una plataforma, no categorías universales. Aplica la descripción de la carga a cada candidato y verifica sus límites reales.
¿Dónde deben vivir los archivos, secretos y registros?
Coloca cada registro operativo en un almacén identificado y asigna su acceso y mantenimiento. Un agente con estado necesita almacenamiento duradero para el historial, la memoria de trabajo o los checkpoints si deben sobrevivir a un reinicio (Mastra, verificado el 18 de septiembre de 2026). Google Cloud enumera memoria y bases vectoriales como componentes separados (Google Cloud, verificado el 18 de septiembre de 2026).
No los comprimas bajo la palabra «datos». Escribe una fila para archivos subidos, estado del workflow, memoria, documentos recuperados y resultados cuando la carga los use. Para cada fila, nombra el servicio, los roles de acceso, la decisión de retención, el alcance de la copia y el responsable de recuperación. Las fuentes respaldan la separación entre memoria, bases y estado; la retención y recuperación pertenecen al despliegue (Google Cloud, verificado el 18 de septiembre de 2026; Mastra, verificado el 18 de septiembre de 2026).
Mantén los secretos separados del contenido. Mastra dice que las claves de modelos, las cadenas de base de datos y las claves de herramientas deben quedar en el servidor mediante variables de entorno o un almacén apropiado (Mastra, verificado el 18 de septiembre de 2026). Registra quién altera cada secreto y cómo lo revoca.
Trata los registros como otro camino de datos. Mastra describe trazas que registran llamadas a modelos, herramientas, memoria y respuesta final (Mastra, verificado el 18 de septiembre de 2026). Decide qué eventos necesita la carga, dónde van y quién los inspecciona. No deduzcas la respuesta del lugar del cómputo.
La ubicación de una máquina no es un mapa de datos. El registro útil nombra cada almacén, camino de credenciales, destino de registros y servicio externo.
¿Quién controla las copias de seguridad y la recuperación?
El responsable de copias conserva los componentes acordados; el de recuperación los restaura y presenta el resultado para su aceptación. El estado duradero impide que el proceso sea la única copia del workflow, pero no define por sí solo una copia de seguridad ni un procedimiento de restauración (Mastra, verificado el 18 de septiembre de 2026).
Escribe el traspaso antes del lanzamiento:
- Alcance. Enumera archivos, almacenes de estado, configuración y registros incluidos. Mastra distingue el estado y almacenamiento persistentes del proceso runtime (Mastra, verificado el 18 de septiembre de 2026).
- Operador. Nombra a la persona o proveedor responsable de la copia. Las opciones gestionadas y autoalojadas reparten el trabajo de forma distinta; confirma la tarea del servicio seleccionado (Mastra, verificado el 18 de septiembre de 2026).
- Ruta de restauración. Escribe qué componente vuelve primero y quién realiza cada acción. Mastra trata la recuperación de fallos como asunto de producción sin prescribir un procedimiento universal (Mastra, verificado el 18 de septiembre de 2026).
- Aceptación. Nombra a la persona que verifica el trabajo aprobado tras restaurar. Google Cloud separa recursos y componentes, por lo que la aceptación debe ajustarse a la arquitectura desplegada (Google Cloud, verificado el 18 de septiembre de 2026).
- Evidencia. Conserva el último registro de copia y recuperación junto a la matriz. Las fuentes establecen componentes y persistencia; el registro es la evidencia del operador para el despliegue elegido (Mastra, verificado el 18 de septiembre de 2026).
Si una propuesta gestionada dice «copias incluidas», pregunta qué almacenes y configuración cubre. Si una máquina propia dice «controlamos los datos», pregunta quién ejecuta la copia y quién acepta una restauración. Son preguntas de compra, no afirmaciones sobre ninguno de los modelos.
¿Cuáles son las mejores plataformas de alojamiento de agentes de IA?
La mejor es aquella cuyo runtime documentado coincide con la carga y cuyo mapa de responsabilidades puede operar tu equipo. Es una regla editorial, no un ranking. Las fuentes permitidas documentan tipos de recursos y compromisos operativos, pero no establecen un ganador universal.
Compara cada candidato con la misma carga y el mismo mapa de propiedad. Registra cada modelo, almacén, herramienta, secreto y destino de registros externo. Asigna las copias de seguridad y la recuperación. Mantén cada respuesta ausente como asunto abierto. El método somete un runtime gestionado y una máquina propia a las mismas preguntas.
Preguntas frecuentes
¿Puedo alojar un agente de IA?
Sí. Puede desplegarse como servicio por petición, instancia persistente, worker pool o job, según la carga (Google Cloud, verificado el 18 de septiembre de 2026). Aún necesitas responsables para modelos, estado, herramientas, secretos, registros, copias y recuperación.
¿Cuáles son las mejores plataformas de alojamiento de agentes de IA?
Las fuentes capturadas no permiten un ranking universal. Compara el runtime y la propiedad del cómputo, los modelos, los archivos, los secretos, los registros, las copias y la recuperación. Elige el candidato que encaje con la carga y no deje ninguna tarea necesaria sin dueño.
Mira el cockpit de AI Jungle OS para examinar una máquina propia y done-with-you con el mapa de responsabilidades visible.
Written by Tileo, who operates a portfolio of internet businesses on this same cockpit.
