Este artículo responde a la pregunta que más repetimos en auditorías: cuánto cuesta implementar agentes de IA con criterio de producción, no de demo. Usamos puntos de partida publicados por Yerbabuena Digital y rangos claramente etiquetados como ilustrativos donde no hay cifra cerrada para tu caso. Para el marco completo de agentes, consulta la guía de agentes de IA para empresas; para elegir herramienta (agente vs RPA vs Zapier), la comparativa honesta.
Qué incluye (y qué no) cada línea de presupuesto
Antes del desglose numérico, aclaremos qué suele olvidarse en presupuestos «desde X €» del mercado:
- Sí suele incluirse en un piloto gobernado serio: diseño del flujo, conexión acotada a herramientas, instrucciones y controles de aprobación, despliegue en tus cuentas, métricas acordadas, documentación operativa básica.
- No suele estar incluido sin alcance explícito: licencias de terceros (CRM, PMS, ERP), horas de tu IT interno, reforma completa de datos maestros, traducción de todo el contenido corporativo, formación extendida a toda la plantilla.
Si comparas propuestas, pide el entregable por fase por escrito — no solo el total.
Desglose por fase (puntos de partida publicados)
| Fase | Qué incluye | Punto de partida |
|---|---|---|
| Entrada | Auditoría de Eficiencia — 20 min + seguimiento escrito | Gratis |
| Diagnóstico | Taller de Discovery — plan acotado, datos, seguridad, criterios de éxito | 1.950 € fijo |
| Piloto gobernado | Operating Layer Sprint — un flujo en producción con supervisión humana | desde 4.800 € |
| Implementación | Varios flujos, integraciones, formación operativa | desde 12.000 € (presupuesto a medida tras Discovery) |
| Operación continua | Retainer Run — monitorización, ajustes, fiabilidad | desde 1.850 €/mes |
Ninguna fila de la tabla es presupuesto cerrado sin Discovery. Si un proveedor te da un solo número sin alcance, pregunta qué no incluye.
Coste de inferencia por flujo (ilustrativo)
Además del proyecto, hay coste variable de modelos:
| Escenario ilustrativo | Supuestos | Orden de magnitud mensual |
|---|---|---|
| Triaje de correo — volumen medio | ~2.000 mensajes/mes, mayoría en modelos abiertos | Decenas de € |
| Mismo flujo — todo con modelos de frontera | Misma volumetría, sin enrutamiento | 6–12× el coste de modelos abiertos (referencia del stack híbrido) |
| Agente con 5–8 herramientas MCP | Incluye logging y gateway | Sumar hosting del gateway y almacenamiento de trazas |
Estos rangos no son ahorros garantizados ni facturas medidas en clientes concretos: sirven para dimensionar antes de comprometer presupuesto.
Ejemplo numérico ilustrativo — un solo flujo de triaje
Supón 2.000 mensajes/mes, enrutamiento 80 % modelos abiertos / 20 % modelos de frontera (patrón habitual en diseño consciente del coste):
| Partida | Cálculo ilustrativo | Orden de magnitud/mes |
|---|---|---|
| Inferencia con modelos abiertos (80 %) | Volumen alto, coste/token bajo | ~30–50 € |
| Inferencia con modelos de frontera (20 %) | Casos complejos | ~40–80 € |
| Gateway + logs | Hosting mínimo | ~10–30 € |
| Total inferencia ilustrativo | ~80–160 €/mes |
Si enrutas 100 % modelos de frontera sin criterio, multiplica la fila de modelos abiertos por 6–12× en la referencia del stack — el proyecto deja de cuadrar aunque la demo fuera impresionante.
Costes ocultos que Discovery debe sacar a la luz
- Datos: FAQs contradictorias, plantillas obsoletas, permisos heredados en carpetas compartidas.
- Integración: sistemas sin API; dependencia de IT externo o proveedor del ERP.
- Supervisión humana: tiempo de revisión — desplazado, no eliminado.
- Formación: uso de la cola, escalado, pausa de emergencia.
- Deriva del modelo: re-evaluación trimestral cuando cambian tipos de solicitud.
Omitirlos en la propuesta inicial es la causa más frecuente de «el piloto funcionó en la demo y falló en septiembre».
Señales de presupuesto inflado o incompleto
- Un solo precio «todo incluido» sin lista de sistemas conectados.
- Sin mención de cola humana ni tiempo de revisión.
- Sin línea de coste de API recurrente.
- Promesa de «autonomía total» en atención al cliente el primer mes.
- Integración con ERP legacy sin fase de prueba acotada.
Cómo reducir el coste total sin recortar gobernanza
- Enrutamiento con modelos abiertos por defecto — modelos de frontera solo donde el delta de calidad paga el precio.
- Un flujo en el Sprint — no tres flujos a medias.
- MCP y APIs frente a scraping de pantalla frágil.
- Alcance por fases — triaje antes de borrador automático; borrador antes de envío asistido.
- Métricas acordadas — evita pagar por «autonomía» que nadie usa.
La práctica de IA agéntica y automatización detalla entregables por fase.
La Capa Operativa de IA concentra enrutamiento, trazas y controles de aprobación — evita pagar tres veces por la misma integración en cada nuevo experimento.
Escenarios ilustrativos de año 1 (no presupuesto cerrado)
| Perfil | Supuestos | Orden de magnitud año 1 (ilustrativo) |
|---|---|---|
| Mínimo viable | Discovery + Sprint, un flujo, inferencia con modelos abiertos, sin retainer | ~7.000–9.000 € + inferencia |
| Operación estable | Lo anterior + Run 6 meses, segundo flujo en Q3 | ~18.000–25.000 € (muy dependiente de alcance) |
| Solo Discovery | Plan escrito, decide posponer piloto | 1.950 € |
Los rangos mezclan proyecto e inferencia; tu cifra depende de integraciones, volumen y adopción del equipo.
Costes orientativos — lectura ejecutiva
Rango ilustrativo total año 1 para pyme con un flujo en producción tras piloto: Discovery 1.950 € + Sprint 4.800 € + inferencia ~600–1.200 €/año (modelos abiertos, volumen medio) + opcional Run 1.850 €/mes si necesitas continuidad multi-flujo. No es presupuesto cerrado — es brújula para conversación interna.
Cuándo posponer el gasto (honestidad que ahorra)
- Menos de ~20 casos/mes en el flujo candidato.
- Sin dueño operativo para la cola de aprobación.
- Datos en silos sin acceso acordado.
- Expectativa de «cero revisión humana» en el primer trimestre.
En esos casos, la Auditoría gratuita suele recomendar conector simple, ordenar datos o esperar temporada — antes de firmar Discovery.
Este artículo se revisa trimestralmente; la fecha Actualizado en cabecera refleja el último repaso de cifras publicadas.
Para cifras aplicadas a tus sistemas y volumen, pide presupuesto de Web & eCommerce o empieza por US → EMEA. Las cifras de arriba son contexto de cuando se escribió esta nota.
Preguntas frecuentes
¿Cuánto cuesta un agente de IA al mes en producción?
Además del proyecto inicial: inferencia (decenas €/mes con modelos abiertos para volumen medio), hosting del gateway y, cuando corresponda, retainer Run desde 1.850 €/mes con varios flujos vivos. Todo ilustrativo hasta confirmar volumen y enrutamiento en Discovery.
¿El Discovery se descuenta del piloto?
Consulta condiciones vigentes en la página de encargos; el Discovery entrega plan escrito acotado. Muchos clientes lo usan como filtro antes de comprometer el Sprint — evita piloto mal acotado.
¿Por qué hay tanto rango entre presupuestos del mercado?
Porque mezclan demo, producción, integración legacy, gobernanza y operación. Un número sin alcance escrito suele omitir datos, revisión humana o coste de API.
¿Open source reduce el coste total?
Reduce inferencia por token cuando el enrutamiento es disciplinado; no elimina integración, supervisión ni operación. Los modelos de frontera son 6–12× más caros por llamada equivalente — referencia ilustrativa del stack híbrido.
