Coste de mantenimiento de un agente de IA: lo que nadie te cuenta
agentes de ia costes mantenimiento automatización

Coste de mantenimiento de un agente de IA: lo que nadie te cuenta

· CompaniesAutomation

El coste de mantener un agente de IA: 10-20% del proyecto al año más inferencia. Desglose por partidas y qué debe incluir el contrato.

El coste de mantenimiento de un agente de IA se mueve entre el 10 y el 20% del coste del proyecto al año, más la inferencia (lo que consume de modelo), que en un agente típico de pyme va de 20 a 300€ al mes según volumen. Para un agente de 8.000€, eso significa presupuestar entre 1.000 y 2.000€ anuales de mantenimiento y del orden de 500-3.000€ anuales de inferencia. Es la cifra que casi ningún proveedor pone en la primera página del presupuesto, y la que decide si el proyecto sigue funcionando el segundo año.


Nosotros mantenemos agentes propios y de clientes, así que este desglose no viene de un informe: viene de las facturas. Vamos a repasar en qué se va exactamente ese dinero, qué pasa si no lo pagas y cómo distinguir un contrato de mantenimiento razonable de una suscripción de humo.

¿Por qué un agente de IA necesita mantenimiento si "ya funciona"?

Porque un agente vive conectado a sistemas que cambian sin pedirte permiso: APIs de terceros que se actualizan, modelos de IA que se deprecian y sustituyen, aplicaciones que rediseñan su interfaz y procesos de negocio que evolucionan. Un agente es software en producción integrado con media docena de piezas móviles, y cada pieza móvil es una fuente de averías futuras que no dependen de ti.

La comparación honesta no es con una web —que puede quedarse quieta años—, sino con una furgoneta de reparto: funciona cada día, acumula kilómetros y necesita taller. La diferencia con el software tradicional es que aquí hay una fuente extra de deriva: el propio modelo de lenguaje. El proveedor retira el modelo que usabas, el sustituto responde distinto ante los mismos prompts, y comportamientos que estaban ajustados al milímetro se desajustan. Eso no es un defecto del proyecto: es la física del sector, y se gestiona con mantenimiento.

¿En qué se desglosa el coste mensual real?

El coste recurrente de un agente en producción tiene cinco partidas. Las cuatro primeras suelen ir dentro del fee de mantenimiento; la inferencia va aparte porque depende del uso:

PartidaQué cubreOrden de magnitud (agente típico pyme)
Inferencia (tokens del modelo)Cada ejecución consume llamadas al modelo20-300€/mes según volumen; casos intensivos, más
InfraestructuraServidor, base de datos, colas, backups10-100€/mes
Monitorización y guardiaAlertas, revisión de logs, detectar deriva antes que el clienteIncluido en el fee
Ajustes de prompt y evoluciónCorregir comportamientos, adaptar a cambios del proceso, mejoras pequeñasIncluido en el fee
Cambios de APIs de terceros y modelosMigraciones de modelo, actualizaciones de conectores (CRM, ERP, WhatsApp...)Incluido en el fee; cambios mayores, presupuesto aparte

Sumando fee e inferencia, un agente de proyecto 5.000-10.000€ cuesta en total entre 100 y 500€ al mes en operación normal. Si alguien te vende que el mantenimiento es cero, o no ha operado nunca un agente en producción o ha escondido el coste en otra parte.

¿Qué pasa si no pagas mantenimiento?

El agente no se rompe el primer mes; se degrada en silencio y se rompe el día menos oportuno. La secuencia habitual que vemos al heredar proyectos abandonados: primero se desajustan comportamientos finos (respuestas algo peores, algún caso límite mal resuelto), después falla una integración cuando el tercero cambia su API y esa parte del proceso vuelve a hacerse a mano "temporalmente", y meses más tarde el proveedor del modelo retira la versión que usabas y el agente deja de funcionar del todo.

El coste de recuperar un agente abandonado suele superar con mucho lo ahorrado: entre auditar qué hacía, actualizar modelo e integraciones y reconstruir la confianza del equipo, hablamos de un 30-50% del proyecto original. La cuenta sale mal por otro camino más: sin monitorización, quien detecta el fallo es un cliente tuyo, y ese coste no aparece en ninguna factura.

¿Cómo se controla el coste de inferencia?

El coste de inferencia se controla con tres palancas: usar el modelo adecuado para cada paso (los baratos para clasificar y extraer, los potentes solo donde hay razonamiento de verdad), cachear y acortar contexto (no reenviar documentación entera en cada llamada) y poner límites de gasto con alertas. Bien diseñado, el enrutado por niveles reduce la factura de modelo un 50-80% respecto al diseño ingenuo de "todo al modelo grande".

Dos avisos prácticos. Los precios de API bajan con el tiempo, pero el consumo crece cuando el agente funciona bien —le das más trabajo—, así que presupuesta la tendencia, no la foto. Y pide siempre visibilidad: un panel con coste por proceso y por día es parte de lo que debe entregar el proveedor, porque la inferencia es el único coste del agente que escala con el uso y conviene verlo venir. Esa visibilidad forma parte de la gobernanza básica de un agente, junto con permisos y trazabilidad.

¿Qué debe incluir un buen contrato de mantenimiento?

Un contrato serio de mantenimiento de agentes incluye, como mínimo:

  1. Monitorización proactiva con alertas: el proveedor detecta el fallo antes que tú, con compromiso de tiempo de respuesta ante incidencias (horas para lo crítico, días para lo menor).
  2. Bolsa de horas de evolución mensual o trimestral para ajustes de prompts, casos límite nuevos y mejoras pequeñas, con reporte de en qué se usó.
  3. Migraciones de modelo incluidas: cuando el proveedor de IA deprecia un modelo, el cambio y la revalidación del comportamiento no deberían facturarse aparte.
  4. Actualización de conectores ante cambios de APIs de terceros, con la frontera clara: adaptar el conector entra; reconstruir la integración porque cambiaste de CRM es proyecto nuevo.
  5. Revisión periódica de rendimiento: métricas del agente contra su línea base (precisión, tasa de escalado a humano, coste por operación) cada trimestre.

Con ese contenido, el 10-20% anual es un precio justo: por debajo del 10% sospecha que solo cubre "apagar fuegos", y por encima del 25% pide el desglose. Y una alternativa legítima: internalizarlo. Si tienes equipo técnico, el proveedor puede formarlo y entregar la operación; lo importante es que alguien concreto sea el dueño del agente.

¿Cómo encaja esto en el coste total del proyecto?

La regla rápida para decidir con números completos: coste total a 3 años = proyecto + 3 × (mantenimiento anual + inferencia anual). Para un agente de 8.000€ con mantenimiento de 1.500€/año y 100€/mes de inferencia, son unos 16.100€ a tres años, es decir, en torno al doble del presupuesto inicial. Esa es la cifra que hay que comparar contra las horas liberadas, no el precio del proyecto solo.

La buena noticia es que el retorno también se acumula: el agente trabaja los tres años, y las horas que libera cada mes no caducan. En los proyectos bien elegidos —procesos con volumen y reglas claras— el coste total a 3 años sigue siendo una fracción del coste laboral equivalente. Tienes el desglose completo de la inversión inicial en nuestra guía sobre cuánto cuesta un agente de IA a medida, y el mapa de dónde rinde más en los casos de uso por departamento.

Si ya tienes agentes en producción y sospechas que estás pagando de más —o de menos, que es peor—, una revisión externa del contrato y de las métricas es un trabajo corto que hacemos desde nuestra consultoría de inteligencia artificial.

Preguntas frecuentes

¿El mantenimiento es negociable si el agente es sencillo?

Sí: un agente con una sola integración y bajo riesgo puede mantenerse en el rango bajo (10% anual o un fee plano de 80-150€/mes). Lo que no es negociable es el concepto: todo agente en producción necesita a alguien que lo vigile y un presupuesto para cambios de terceros.

¿Puedo pagar el mantenimiento solo cuando algo se rompa?

Puedes, pero suele salir más caro: sin monitorización los fallos los detectan tus clientes, las averías se atienden sin compromiso de plazo y cada intervención se factura a tarifa de urgencia. El modelo reactivo tiene sentido solo en agentes internos no críticos donde un día de parada no duele.

¿Cuánto cuesta la inferencia de un agente concreto? Dame un ejemplo.

Un agente de atención al cliente que gestione 1.500 conversaciones al mes, con enrutado por niveles bien hecho, suele moverse entre 30 y 150€ mensuales de modelo. El mismo agente diseñado sin cuidado —modelo grande para todo, contexto redundante— puede multiplicar esa cifra por cinco. El diseño importa más que la tarifa del proveedor.

¿Qué pasa cuando sale un modelo mejor? ¿Hay que migrar siempre?

No siempre, pero conviene evaluarlo: los modelos nuevos suelen ser mejores y más baratos a la vez, así que la migración se paga sola en muchos casos. La evaluación (probar el modelo nuevo contra los casos de prueba del agente) debería entrar en el mantenimiento; la migración, si es mayor, se presupuesta con datos delante.

¿El mantenimiento incluye añadir funciones nuevas al agente?

Las mejoras pequeñas sí (ajustar un comportamiento, añadir un caso límite); las capacidades nuevas no (conectar otro sistema, asumir otro proceso). La frontera práctica: si cambia lo que el agente hace, es evolución dentro del fee; si cambia lo que el agente es, es un miniproyecto con su presupuesto.