Inteligencia Artificial y Agentes Autónomos
ℹ️ Nota: Esta sección define la estrategia de IA para la plataforma. Incluye dos capas: (1) capacidades de IA para agentes humanos y (2) agentes autónomos residentes que monitorean, protegen y optimizan la plataforma. Toda IA se consume vía APIs públicas/comerciales.
Visión General: Dos Capas de IA
┌──────────────────────────────────────────────────────────────────┐
│ CAPA 2: AGENTES RESIDENTES │
│ ┌──────────┐ ┌──────────┐ ┌──────────┐ ┌──────────┐ │
│ │ KPI │ │ Security │ │ Policy │ │ Health │ │
│ │ Guardian │ │ Sentinel │ │ Engine │ │ Monitor │ │
│ └────┬─────┘ └────┬─────┘ └────┬─────┘ └────┬─────┘ │
│ │ │ │ │ │
│ ┌────▼─────────────▼─────────────▼─────────────▼─────┐ │
│ │ Event Bus (todos los eventos) │ │
│ └────────────────────────────────────────────────────┘ │
├──────────────────────────────────────────────────────────────────┤
│ CAPA 1: IA PARA AGENTES │
│ ┌──────────┐ ┌──────────┐ ┌──────────┐ ┌──────────┐ │
│ │ Resumen │ │ Suggested│ │ Sentiment│ │ Traducción│ │
│ │ │ │ Replies │ │ Analysis │ │ │ │
│ └──────────┘ └──────────┘ └──────────┘ └──────────┘ │
├──────────────────────────────────────────────────────────────────┤
│ CAPA 0: ABSTRACCIÓN │
│ ┌────────────────────────────────────────────────────────┐ │
│ │ Puerto de IA → Adaptadores (OpenAI, Anthropic, etc.) │ │
│ │ MCP Server → Chatbot + Integración externa │ │
│ └────────────────────────────────────────────────────────┘ │
└──────────────────────────────────────────────────────────────────┘Capa 0: Abstracción de IA
Puerto de IA (interfaz)
La arquitectura utiliza puertos y adaptadores para el consumo de servicios de IA:
┌─────────────────────────────────────────────────┐
│ Dominio de la plataforma │
│ │
│ ┌──────────────┐ ┌──────────────────────┐ │
│ │ Casos de │───▶│ Puerto de IA │ │
│ │ uso │ │ (interfaz) │ │
│ └──────────────┘ └──────────┬───────────┘ │
│ │ │
└─────────────────────────────────┼────────────────┘
│
┌─────────────┼─────────────────┐
│ │ │
┌───────▼──────┐ ┌───▼──────────┐ ┌────▼──────────┐
│ Adaptador │ │ Adaptador │ │ Adaptador │
│ OpenAI │ │ Anthropic │ │ Google │
└──────────────┘ └──────────────┘ └───────────────┘Implementaciones de proveedores
- OpenAI: GPT-4o, GPT-4o-mini, Whisper (transcripción), embeddings
- Anthropic: Claude 3.5 Sonnet, Claude 3 Haiku (análisis, resumen)
- Google: Gemini 1.5 Pro, Gemini Flash
- BYOK: Cada tenant puede traer sus propias claves de API
Capacidades de la capa de IA
- Conmutación de proveedor: Cambiar dinámicamente entre proveedores sin downtime
- Tracking de costos por tenant: Registro de uso y costos desglosados por cliente
- Rate limiting por tenant: Límites de consumo configurables
- Cache de embeddings: Almacenamiento de embeddings para evitar recomputación
- Fallback automático: Cadena de respaldo cuando un proveedor falla
BYOK (Bring Your Own Key)
Capacidad soportada desde el diseño inicial:
- Claves de API por tenant (no solo una clave global)
- Almacenamiento seguro (encriptación en reposo)
- Configuración de proveedor por tenant
- Auditoría de uso por tenant y proveedor
Capa 1: IA para Agentes Humanos
Alto Valor (valor comercial real)
| Capacidad | Beneficio | Métrica de impacto |
|---|---|---|
| Resumen de conversaciones | Reduce el cambio de contexto del agente | Reducción medible de AHT |
| Respuestas sugeridas | Respuesta más rápida, entrenada sobre knowledge base | Reducción de tiempo de primera respuesta |
| Clasificación de intención | Enrutamiento automático, triaje por chatbot | Porcentaje de enrutamiento correcto |
| Análisis de sentimiento | Disparadores de escalamiento, scoring de QA | Precisión de escalamiento automático |
| Auto-clasificación | Categorización automática de tickets | Reducción de tiempo de clasificación manual |
| Traducción | Soporte multilingüe en tiempo real (crítico para LATAM) | Cobertura de idiomas |
Valor Medio
| Capacidad | Beneficio | Métrica de impacto |
|---|---|---|
| QA de agentes | Scoring automatizado de respuestas | Cobertura de auditoría |
| Búsqueda semántica | Búsqueda en base de conocimiento | Precisión de resultados |
| Análisis de campañas | Optimización de mensajes, predicción de horarios | Tasa de conversión |
| Enrutamiento inteligente | Basado en intención + sentimiento + skills | Precisión de enrutamiento |
Capa 2: Agentes Residentes Autónomos
💡 Diferenciador clave: Los agentes residentes son agentes de IA que viven dentro de la plataforma, monitorean el event bus en tiempo real, y toman acciones autónomas dentro de políticas configurables. Son el diferenciador principal frente a competidores.
Arquitectura del Sistema de Agentes
┌─────────────────────────────┐
│ Event Bus │
│ (todos los eventos del │
│ sistema en tiempo real) │
└──────────┬──────────────────┘
│
┌──────────────────┼──────────────────┐
│ │ │
┌───────▼───────┐ ┌──────▼──────┐ ┌────────▼────────┐
│ Subscriber │ │ Subscriber │ │ Subscriber │
│ Group A │ │ Group B │ │ Group C │
└───────┬───────┘ └──────┬──────┘ └────────┬────────┘
│ │ │
┌───────▼───────┐ ┌──────▼──────┐ ┌────────▼────────┐
│ Agent: │ │ Agent: │ │ Agent: │
│ KPI │ │ Security │ │ Policy │
│ Guardian │ │ Sentinel │ │ Engine │
└───────┬───────┘ └──────┬──────┘ └────────┬────────┘
│ │ │
│ │ │
┌───────▼──────────────────▼───────────────────▼──────┐
│ Acciones Autónomas │
│ ┌──────────┐ ┌──────────┐ ┌──────────┐ │
│ │ Alertas │ │ Ajustes │ │ Notificar│ │
│ │ │ │ políticas│ │ humanos │ │
│ └──────────┘ └──────────┘ └──────────┘ │
└────────────────────────────────────────────────────┘Agentes Residentes Definidos
1. KPI Guardian
Misión: Monitorear métricas de negocio en tiempo real y tomar acciones preventivas.
Eventos que consume:
ConversationOpened,ConversationClosed,ConversationAssignedMessageReceived,MessageSent,MessageDeliveredAgentAvailable,AgentUnavailable,AgentPausedCallInitiated,CallAnswered,CallEndedDispositionRecorded
KPIs que monitorea:
- Tiempo medio de primera respuesta (FRT)
- Tiempo medio de resolución (ART)
- Tasa de primer contacto resuelto (FCR)
- Nivel de servicio (SLA compliance)
- Utilización de agentes
- Tasa de abandono de colas
- CSAT / NPS
- Volumen de conversaciones por canal
Acciones autónomas:
- Ajustar routing: Si un canal está saturado, redirigir tráfico a otros canales
- Reasignar agentes: Si un equipo está sobrecargado, sugerir transferencias
- Alertar umbrales: Notificar cuando un KPI está por debajo del objetivo
- Sugerir cambios de política: Proponer ajustes a horarios, capacidades, prioridades
Restricciones:
- NO puede modificar configuración de campañas sin aprobación humana
- NO puede desactivar canales sin autorización
- NO puede cambiar políticas de precios o SLA
- SÍ puede ajustar pesos de routing dentro de rangos predefinidos
- SÍ puede escalar alertas a supervisores
Human-in-the-loop:
KPI Guardian detecta: FRT > 5 minutos en canal WhatsApp
│
├─→ Acción autónoma: Reasignar 2 agentes de email a WhatsApp
│
└─→ Notificación: "FRT WhatsApp elevado. Se reasignaron agentes.
¿Confirmar cambio de política de routing? [Autorizar/Revertir]"2. Security Sentinel
Misión: Detectar y prevenir abuso, fraude, spam y ataques en la plataforma.
Eventos que consume:
MessageReceived(todos los canales)ContactCreated,ContactUpdatedConversationOpenedAgentLogin,AgentLogoutAPIRequest(todos los endpoints)WebhookReceived
Amenazas que monitorea:
- Spam masivo: Detección de patrones de envío anómalos
- Abuso de API: Rate limiting inteligente, detección de scraping
- Suplantación de identidad: Análisis de patrones de comportamiento
- Filtración de datos: Detección de acceso anómalo a información
- Cuentas comprometidas: Análisis de comportamiento de login
- Phishing: Detección de contenido malicioso en mensajes
Acciones autónomas:
- Bloquear temporalmente: Suspender cuentas con comportamiento anómalo
- Throttle: Reducir velocidad de envío para cuentas sospechosas
- Alertar al admin: Notificar incidentes de seguridad inmediatamente
- Log forense: Registrar evidencia para investigación posterior
- Ajustar WAF: Modificar reglas de protección ante ataques conocidos
Restricciones:
- NO puede eliminar datos de usuarios sin autorización
- NO puede desactivar permanentemente cuentas sin revisión humana
- NO puede acceder al contenido de mensajes en texto plano (solo metadata y patrones)
- SÍ puede bloquear temporalmente cuentas por 24h máximo
- SÍ puede activar protecciones adicionales
Human-in-the-loop:
Security Sentinel detecta: Cuenta con 500+ mensajes en 5 minutos (patrón spam)
│
├─→ Acción autónoma: Throttle (1 msg/segundo) + alerta roja
│
└─→ Notificación URGENTE: "Posible spam detectado en cuenta X.
Se activó throttle. ¿Bloquear cuenta? [Sí/No/Investigar]"3. Policy Engine
Misión: Gestionar y optimizar políticas de negocio, asegurando cumplimiento y rendimiento óptimo.
Eventos que consume:
- Todos los eventos del sistema (suscripción completa)
- Cambios en configuración
- Métricas agregadas (periódicamente)
- Notificaciones de otros agentes
Políticas que gestiona:
- Políticas de routing: Cómo se asignan conversaciones a agentes
- Políticas de campañas: Horarios, frecuencia, segmentación
- Políticas de SLA: Umbrales, escalamiento, penalizaciones
- Políticas de retención: Cuánto tiempo conservar datos
- Políticas de acceso: Permisos, roles, restricciones
Acciones autónomas:
- Optimizar routing: Ajustar pesos basado en performance histórica
- Sugerir cambios: Proponer modificaciones a políticas con justificación
- Detectar drift: Identificar cuando las políticas no están funcionando
- Auditar cumplimiento: Verificar que las acciones se ajustan a políticas
- Simular impacto: Evaluar qué pasaría si se cambia una política
Restricciones:
- NO puede implementar cambios de política sin aprobación
- NO puede modificar permisos de seguridad
- NO puede cambiar configuración de billing
- SÍ puede proponer cambios con análisis de impacto
- SÍ puede revertir cambios recientes que estén causando problemas
Human-in-the-loop:
Policy Engine detecta: Routing actual asigna 70% de conversaciones a 30% de agentes
│
├─→ Análisis: Distribución desbalanceada, eficiencia baja
│
└─→ Propuesta: "Rebalancear routing de round-robin a weighted-round-robin
basado en skills. Impacto estimado: +15% eficiencia.
¿Autorizar cambio? [Ver simulación / Autorizar / Rechazar]"4. Health Monitor
Misión: Monitorear la salud técnica de la plataforma y tomar acciones preventivas.
Eventos que consume:
- Métricas de sistema (CPU, memoria, disco, red)
- Logs de aplicación
- Métricas de base de datos
- Estado de conexiones WebSocket
- Estado de integraciones externas (Asterisk, APIs de canales)
- Latencia de respuestas
Métricas que monitorea:
- Latencia de API (p50, p95, p99)
- Tasa de errores (4xx, 500)
- Conexiones WebSocket activas
- Uso de base de datos (conexiones, queries lentas)
- Estado de Asterisk (canales activos, calidad de llamadas)
- Estado de integraciones (webhooks fallidos, API de Meta)
Acciones autónomas:
- Escalar horizontalmente: Añadir instancias bajo carga alta
- Rotar logs: Gestionar tamaño de logs automáticamente
- Limpiar cache: Invalidar cache cuando hay inconsistencias
- Restart selectivo: Reiniciar componentes con problemas
- Failover: Cambiar a réplicas de base de datos si hay problemas
Restricciones:
- NO puede modificar datos de usuarios
- NO puede desactivar componentes críticos sin autorización
- SÍ puede reiniciar servicios no críticos
- SÍ puede escalar infraestructura automáticamente
- SÍ puede activar protocolos de emergencia
Motor de Skills (Personalidad de Agentes)
Cada agente residente se configura mediante skills que definen su personalidad, misiones y restricciones:
# Ejemplo: skill para KPI Guardian
name: kpi-guardian
version: "1.0"
description: "Monitorea métricas de negocio y optimiza rendimiento"
personality:
role: "Guardián de Métricas"
tone: "Profesional, datos-driven, preventivo"
language: "es"
missions:
- id: frt-monitoring
name: "Monitoreo de Tiempo de Primera Respuesta"
description: "Detectar cuando FRT excede umbrales"
metrics:
- name: first_response_time
threshold: 300 # 5 minutos
operator: ">"
actions:
- type: reroute
params:
source_channel: "{{channel}}"
target_agents: "{{available_agents}}"
max_reassignment: 3
- type: notify
params:
channel: "supervisor"
severity: "warning"
message: "FRT elevado en {{channel}}: {{value}}s (umbral: {{threshold}}s)"
- id: agent-utilization
name: "Utilización de Agentes"
description: "平衡 la carga de trabajo entre agentes"
metrics:
- name: agent_utilization
threshold: 85
operator: ">"
actions:
- type: suggest
params:
action: "rebalance_agents"
analysis: "Agentes con utilization > 85%, sugerir redistribución"
constraints:
max_autonomous_actions_per_hour: 10
require_approval_for:
- campaign_config_change
- channel_deactivation
- sla_threshold_change
- pricing_change
allowed_autonomous:
- agent_reassignment
- routing_weight_adjustment
- alert_escalation
- throttling
escalation:
levels:
- severity: "info"
notify: ["supervisor"]
- severity: "warning"
notify: ["supervisor", "admin"]
- severity: "critical"
notify: ["supervisor", "admin", "oncall"]
auto_action: "throttle"Interacción entre Agentes
Los agentes residentes se comunican entre sí a través del event bus:
Security Sentinel detecta anomalía
│
├─→ Publica evento: SecurityAnomalyDetected
│
├─→ KPI Guardian recibe: Evalúa impacto en métricas
│ └─→ Publica: KPILikelyImpact
│
├─→ Policy Engine recibe: Evalúa si hay política aplicable
│ └─→ Publica: PolicyRecommendation
│
└─→ Health Monitor recibe: Evalúa salud del sistema
└─→ Publica: SystemHealthUpdateServidor MCP (Model Context Protocol)
Visión
El servidor MCP permite que personas externas y herramientas de IA se conecten a la plataforma usando lenguaje natural. Es el canal de integración para:
- Chatbot interno: Consultas en lenguaje natural dentro de la plataforma
- Integración externa: Herramientas de IA externas que necesitan acceder a la plataforma
- Agentes autónomos externos: Otros sistemas que quieren interactuar con la plataforma
Arquitectura MCP
┌──────────────────────────────────────────────────────────────────┐
│ SERVIDOR MCP │
│ │
│ ┌─────────────────────────────────────────────────────────────┐ │
│ │ Capa de Transporte │ │
│ │ ┌──────────┐ ┌──────────┐ ┌──────────┐ │ │
│ │ │ HTTP │ │WebSocket │ │ Stdio │ │ │
│ │ │ (REST) │ │ (Real- │ │ (Local) │ │ │
│ │ │ │ │ time) │ │ │ │ │
│ │ └──────────┘ └──────────┘ └──────────┘ │ │
│ └─────────────────────────────────────────────────────────────┘ │
│ │ │
│ ┌───────────────────────────▼──────────────────────────────────┐│
│ │ Capa de Autenticación ││
│ │ ┌──────────┐ ┌──────────┐ ┌──────────┐ ││
│ │ │ API Key │ │ OAuth2 │ │ Tenant │ ││
│ │ │ │ │ (SSO) │ │ Context │ ││
│ │ └──────────┘ └──────────┘ └──────────┘ ││
│ └─────────────────────────────────────────────────────────────┘│
│ │ │
│ ┌───────────────────────────▼──────────────────────────────────┐│
│ │ Capa de Herramientas (Tools) ││
│ │ ││
│ │ ┌─────────────┐ ┌─────────────┐ ┌─────────────┐ ││
│ │ │ Consulta │ │ Gestión │ │ Resolución │ ││
│ │ │ (Read) │ │ (Write) │ │ (Actions) │ ││
│ │ └─────────────┘ └─────────────┘ └─────────────┘ ││
│ │ ││
│ │ Tools disponibles: ││
│ │ • search_contacts • get_conversation ││
│ │ • get_metrics • get_agent_status ││
│ │ • create_ticket • update_ticket ││
│ │ • assign_agent • transfer_conversation ││
│ │ • get_campaign_stats • update_routing ││
│ │ • get_audit_log • run_report ││
│ └─────────────────────────────────────────────────────────────┘│
│ │ │
│ ┌───────────────────────────▼──────────────────────────────────┐│
│ │ Capa de Dominio ││
│ │ ┌──────────────────────────────────────────────────────┐ ││
│ │ │ Mapeo de lenguaje natural → operaciones de dominio │ ││
│ │ │ │ ││
│ │ │ "¿Cuántas conversaciones abiertas hay en WhatsApp?" │ ││
│ │ │ → get_metrics(channel="whatsapp", status="open") │ ││
│ │ │ │ ││
│ │ │ "Asigna a Juan la conversación 12345" │ ││
│ │ │ → assign_agent(conv_id=12345, agent="juan") │ ││
│ │ │ │ ││
│ │ │ "¿Por qué está lento el canal de email?" │ ││
│ │ │ → get_metrics(channel="email") + get_health() │ ││
│ │ └──────────────────────────────────────────────────────┘ ││
│ └─────────────────────────────────────────────────────────────┘│
└──────────────────────────────────────────────────────────────────┘Herramientas MCP Disponibles
Herramientas de Consulta (Read-only)
| Tool | Descripción | Ejemplo de uso |
|---|---|---|
search_contacts | Buscar contactos por nombre, email, teléfono, atributos | “Busca contactos de Lima con tag premium” |
get_conversation | Obtener detalles de una conversación | “Muéstrame la conversación 45678” |
get_conversation_history | Obtener historial de mensajes | “¿Qué dijeron en la conversación 45678?” |
get_metrics | Obtener métricas de canal, agente, campaña | “¿Cuál es el FRT promedio de hoy?” |
get_agent_status | Estado de un agente o todos los agentes | “¿Qué agentes están disponibles?” |
get_campaign_stats | Estadísticas de una campaña | “¿Cómo va la campaña de cobranzas?” |
get_audit_log | Obtener registro de auditoría | “¿Quién cambió la configuración ayer?” |
run_report | Ejecutar un reporte predefinido | “Genera el reporte de productividad semanal” |
get_health | Estado de salud del sistema | “¿Hay problemas con el sistema?” |
Herramientas de Gestión (Write)
| Tool | Descripción | Ejemplo de uso |
|---|---|---|
create_ticket | Crear un ticket de soporte | “Crea un ticket: problema con webhook de WhatsApp” |
update_ticket | Actualizar un ticket | “Cierra el ticket 789, resuelto” |
assign_agent | Asignar un agente a una conversación | “Asigna a María la conversación 12345” |
transfer_conversation | Transferir conversación a otro agente/equipo | “Transfiere a soporte técnico” |
update_routing | Actualizar configuración de routing | “Aumenta prioridad del canal email” |
send_message | Enviar un mensaje a un contacto | “Envía confirmación al contacto 111” |
update_contact | Actualizar información de contacto | “Actualiza teléfono del contacto 222” |
Herramientas de Acción (Actions)
| Tool | Descripción | Ejemplo de uso |
|---|---|---|
pause_agent | Pausar/unpausar un agente | “Pausa a Juan por 15 minutos” |
start_campaign | Iniciar una campaña | “Inicia la campaña de bienvenida” |
stop_campaign | Detener una campaña | “Detiene la campaña de cobranzas” |
escalate | Escalar a un supervisor | “Escala este caso a un supervisor” |
trigger_automation | Disparar una automatización | “Ejecuta la limpieza de contactos duplicados” |
Chatbot Integrado
El chatbot se integra directamente en la interfaz de la plataforma:
┌─────────────────────────────────────────────────────────────┐
│ 🤖 Asistente de Plataforma │
│ │
│ Hola, soy tu asistente. Puedo ayudarte con: │
│ • Consultar métricas y reportes │
│ • Gestionar conversaciones y contactos │
│ • Configurar campañas y routing │
│ • Resolver problemas técnicos │
│ • Ejecutar acciones de administración │
│ │
│ Escribe tu consulta en lenguaje natural... │
│ │
│ ┌──────────────────────────────────────────────────────┐ │
│ │ ¿Cuántas conversaciones tenemos abiertas hoy? │ │
│ └──────────────────────────────────────────────────────┘ │
│ │
│ 📊 Hoy tienes 247 conversaciones abiertas: │
│ • WhatsApp: 156 (63%) │
│ • Email: 45 (18%) │
│ • Instagram: 32 (13%) │
│ • TikTok: 14 (6%) │
│ │
│ ¿Necesitas que filtre por agente, equipo o prioridad? │
│ │
│ ┌──────────────────────────────────────────────────────┐ │
│ │ Asigna las de TikTok a Juan │ │
│ └──────────────────────────────────────────────────────┘ │
│ │
│ ✅ 14 conversaciones de TikTok asignadas a Juan. │
│ ¿Algo más? │
└─────────────────────────────────────────────────────────────┘Seguridad del MCP
- Autenticación obligatoria: API key, OAuth2, o SSO del tenant
- Aislamiento por tenant: Cada tenant solo ve sus datos
- Rate limiting: Límites de requests por conexión
- Audit logging: Todas las acciones quedan registradas
- Permisiones granulares: Control fino de qué puede hacer cada conexión
- Aprobación humana: Acciones destructivas requieren confirmación
Integración con Herramientas Externas
El servidor MCP permite que herramientas externas se conecten:
# Ejemplo de conexión desde Claude Desktop
mcp_servers:
omnichannel-platform:
url: https://api.plataforma.com/mcp
api_key: "tu-api-key"
tenant_id: "tenant-123"# Ejemplo de uso desde código Python
from mcp import Client
client = Client("https://api.plataforma.com/mcp", api_key="...")
result = await client.call("get_metrics", {
"channel": "whatsapp",
"period": "today"
})
print(result) # { "open": 247, "resolved": 189, "avg_frt": 145 }Roadmap de IA
Fase 1: IA para Agentes (MVP)
- Resumen de conversaciones
- Respuestas sugeridas
- Análisis de sentimiento básico
- Chatbot interno (consultas simples)
Fase 2: Agentes Residentes (V1)
- KPI Guardian (monitoreo de métricas)
- Health Monitor (salud del sistema)
- Servidor MCP (herramientas de consulta)
- Chatbot avanzado (gestión de conversaciones)
Fase 3: Autonomía Avanzada (V2)
- Security Sentinel (detección de abuso)
- Policy Engine (optimización de políticas)
- Agentes que se auto-ajustan
- Integración con herramientas externas vía MCP
Fase 4: Plataforma IA-Nativa (Contact Center)
- Agentes que pueden resolver problemas complejos
- Aprendizaje continuo de las optimizaciones
- Predicción de tendencias y anomalías
- Automatización completa de tareas rutinarias
Consideraciones de Implementación
Python
Python se utilizará solo si una biblioteca Go madura es claramente inferior:
- Procesamiento de datos ML: Cuando se necesite procesamiento pesado
- Pipelines de datos: Solo si Go no ofrece alternativa viable
- NO para prototipado rápido: No justifica otro runtime
Costos de Referencia
| Proveedor | Modelo | Costo aprox. | Uso principal |
|---|---|---|---|
| OpenAI | GPT-4o | $2.50/1M tokens input | Resumen, clasificación compleja |
| OpenAI | GPT-4o-mini | $0.15/1M tokens input | Respuestas sugeridas, clasificación simple |
| Anthropic | Claude 3.5 Sonnet | $3/1M tokens | Análisis profundo, policy engine |
| Anthropic | Claude 3 Haiku | $0.25/1M tokens | Sentiment, triaje |
| Gemini 1.5 Flash | $0.075/1M tokens | Traducción, procesamiento masivo |
💡 Consejo: Los agentes residentes consumirán más tokens que las capacidades de IA para agentes humanos. El ROI se mide en: prevención de incidentes, optimización automática de métricas, y reducción de carga operativa para supervisores.
Métricas de Éxito para Agentes Residentes
| Agente | Métrica de éxito | Objetivo |
|---|---|---|
| KPI Guardian | Reducción de FRT/ART | -20% en 3 meses |
| KPI Guardian | Mejora en utilización de agentes | +15% |
| Security Sentinel | Incidentes detectados vs reportados | >90% detectados automáticamente |
| Security Sentinel | Tiempo de respuesta a incidentes | <5 minutos |
| Policy Engine | Cambios de política sugeridos y aprobados | >60% aprobados |
| Health Monitor | Tiempo de downtime no planificado | -50% |