Elytra AI Native

Dos bots se dieron los buenos días 1.500 veces.

A las diez y media de la noche, un asistente de IA ajeno le escribió al WhatsApp de un cliente que atiende uno de nuestros bots. Se saludaron. Se despidieron. Cinco minutos después nuestro bot se volvió a presentar, y así siguieron toda la noche: un intercambio cada 21 segundos, nueve horas y media sin pausa.

En menos de tres horas consumieron nueve millones de tokens y agotaron el saldo del proveedor del modelo. Desde ese momento el bot no pudo generar una frase, para nadie, durante casi siete horas. El chequeo de salud siguió en verde todo ese tiempo. Lo cortamos a mano en la mañana.

En dinero fue poco: algo más de nueve dólares. No se perdió ningún prospecto, y eso fue suerte, no diseño. Era madrugada de miércoles. La misma falla un martes a media mañana habría dejado a cada persona que escribiera recibiendo un mensaje de error, sin que ninguna alerta nos avisara.

Antes de arreglar, separamos la causa de lo que la empeoró. La causa fue una sola: no existía ningún tope por contacto. Un solo número podía consumir el presupuesto completo sin encontrar una barrera.

Lo demás fueron amplificadores. El mensaje de error pedía «¿me puede repetir su mensaje?», que con una persona es buena atención y con otro bot es una máquina de movimiento perpetuo: se envió más de mil veces. La memoria del bot tenía un límite que borraba su propia despedida, así que se volvió a presentar 44 veces. Y el cierre de la conversación dependía del criterio del modelo, que nunca lo aplicó porque el otro bot fue impecablemente educado.

Arreglamos cada falla con su propia capa. Un tope de turnos por contacto, que silencia sin bloquear. Respaldo real entre proveedores, esta vez en el camino que el bot usa de verdad. Una prueba cada pocos minutos que le pide al modelo una respuesta del mismo tamaño que un turno real, porque la falla fue de saldo y una prueba barata habría pasado sin notar nada. El chequeo de salud ahora depende de esa prueba. Un detector de conversaciones que no avanzan. Un mensaje de error que ya no invita a repetir. Y las alertas técnicas llegan a nuestro canal, no al del cliente.

Cada capa falla abierta: si un control se cae, deja pasar tráfico. Aceptamos ese riesgo porque un control caído nunca debería silenciar a un cliente legítimo.

Al verificar el arreglo apareció algo que nadie buscaba. La transcripción de notas de voz llevaba tres meses y medio rota. Nadie lo notó porque el bot, con toda amabilidad, le pedía a la gente que escribiera.

De ahí salió una regla que hoy aplicamos a todo lo que construimos. Diseñar un sistema para que no se rompa frente al usuario sigue siendo correcto, pero cada respuesta amable ante un error debe dejar un conteo persistente de cuántas veces ocurrió. El chequeo de salud prueba la función, no la infraestructura. Y ningún mensaje de error invita a reintentar cuando del otro lado puede haber una máquina.

Elytra rediseño inteligente de procesos
México
Sede fiscal
Calle 18B # 251
Mérida, Yucatán
CP 97305
+52 246 208 6256
Colombia
Oficina
Cúcuta, Norte de Santander
CP 540003
+57 333 758 3244
Canadá
Oficina
Montréal, Québec
H3C 0B4
+1 438 300 9091
Venezuela
Próximamente