Arquitectura técnica

El menú resuelve lo de siempre, la IA lo que se sale del guion

En resumen: casi todo lo que te preguntan son las mismas veinte preguntas, y esas las contesta tu menú de botones al instante y sin gastar IA. Cuando el cliente escribe algo que no está en el menú, entra la IA. Y si hace falta una persona, la conversación llega a tu equipo con todo el historial. Son tres pasos y en ese orden.

Cómo decide quién responde

Lo predecible siempre responde igual; lo demás, con IA

En resumen: el menú de botones resuelve la mayoría de los mensajes sin gastar un céntimo de IA. Solo lo que no encaja en ninguna opción pasa a la IA, y lo que la IA no puede cerrar pasa a una persona.

1Primero, el menú (la mayoría)
  • «¿Hasta qué hora atienden?»
  • «¿Cuánto cuesta el envío?»
  • «¿Dónde está mi pedido?»
  • Tomar el pedido y confirmarlo
  • Pedirle el nombre y la dirección
Qué cuesta
No gasta IA
2Después, la IA
  • «¿Y eso me sirve para mi caso?»
  • Comparar dos productos
  • Una queja con varias cosas mezcladas
  • Cuando escribe como habla, con jerga
  • Cuando pregunta dos cosas a la vez
Qué cuesta
~$39/mes a 50.000 conversaciones
3Y si hace falta, una persona
  • «Quiero hablar con alguien»
  • Un reclamo que hay que resolver
  • Un problema con un pago
  • Cualquier cosa que prefieras decidir tú
Qué cuesta
Tu equipo, con el historial completo
Ver el detalle técnico

La decisión es exacta, no probabilística: no hay clasificador de intención ni umbral de confianza que calibrar. El motor compara el mensaje con los disparadores de los flujos activos y con las opciones del paso en el que está la conversación. Si coincide, ejecuta ese paso.

Si no coincide, entra el rescate de la IA, que responde la duda con tu base de conocimiento y devuelve la conversación al paso donde estaba. El tope de rescates por sesión es dos; al tercero la IA se queda liderando la conversación en vez de reenviar el mismo menú.

La derivación a una persona también sale de reglas exactas: se detecta en el texto que escribe el cliente («quiero hablar con alguien», «pásame con una persona»), no preguntándole a la IA. Se hizo así a propósito — si la IA se equivoca juzgando, el cliente se queda trabado, y un «?» es un «?».

Un paso del flujo puede además llamar a tu sistema para traer stock, el estado de un pedido o un precio actualizado, y usar la respuesta en los pasos siguientes. Eso sigue sin gastar IA.

El problema: IA pura en WhatsApp

  • Cada mensaje pasa por el LLM, incluso "¿cuáles son sus horarios?"
  • El contexto crece con cada turno: tokens = dinero × tiempo
  • Un bot de 10.000 conversaciones/mes puede costar $35/mes solo en IA
  • Latencias de 1–3s para respuestas que podrían ser instantáneas
  • Y no hay forma de fijarlo: la IA puede inventarse un precio o una condición

La solución: Arquitectura híbrida FlujosChat

  • El 80% del volumen lo resuelve lógica JSON: velocidad instantánea, $0 tokens
  • La IA solo interviene cuando la lógica no cubre el caso
  • Los flujos garantizan respuestas correctas y auditables para datos críticos
  • Reducción del 78% en costos de API vs modelo de IA pura
  • Control total sobre el árbol de decisiones sin alucinaciones posibles

Los tres pasos, en orden

Cada mensaje que llega pasa por aquí. La mayoría se queda en el primer paso y nunca llega a la IA.

01

El menú manda

Mientras el mensaje del cliente coincida con un disparador o con una de las opciones del flujo activo, responde el flujo. Es una comparación exacta, así que responde al instante y no gasta IA.

Qué cuesta
No gasta IA
02

La IA rescata

Si el cliente escribe algo que no coincide con ninguna opción, la IA responde esa duda con la información que le cargaste, y el flujo vuelve a la pregunta donde estaba. El menú no se pierde.

Qué cuesta
~$39 al mes a 50.000 conversaciones
03

La IA toma el control, o pasa a una persona

Al segundo rescate en la misma conversación ya está claro que ese cliente prefiere escribir, así que la IA lidera en vez de dejarlo dando vueltas en el mismo menú. Y si pide hablar con alguien —detectado por reglas de texto, no por la IA— la conversación llega a tu equipo con todo el historial.

Qué cuesta
Tu equipo, solo cuando hace falta

¿Y esto cuánto cuesta al mes?

Los números por volumen, con los supuestos del cálculo a la vista, están en una sola página para que no haya dos versiones del mismo dato.

Ver los números →

Preguntas frecuentes

¿Cuándo entra la IA y cuándo sigue el menú?
No hay que calibrar nada: la regla es exacta. Mientras el mensaje del cliente coincida con una opción del menú, responde el menú. Si escribe algo que no coincide con ninguna, la IA responde esa duda y el flujo vuelve a la pregunta donde estaba. Si eso pasa dos veces en la misma conversación, ya está claro que ese cliente prefiere escribir y la IA se queda con la conversación. Lo que sí eliges es qué preguntas cubre el menú: todo lo que esté ahí no gasta IA.
¿Cuánto me ahorra esto frente a mandar todo a la IA?
Depende de cuántas preguntas cubra tu menú. Con el supuesto de que cubre el 80% —que es el habitual cuando están las de siempre: horarios, precios, estado del pedido— el gasto de IA baja alrededor de un 78%. Los números por volumen, con los supuestos del cálculo a la vista, están en la página de cuánto cuesta.
¿El menú puede consultar datos de mi sistema en el momento?
Sí. Un paso del flujo puede llamar a tu sistema para consultar el stock, el estado de un pedido o un precio actualizado, y usar la respuesta en los pasos siguientes. Eso no gasta IA: sigue siendo el menú.
¿Qué pasa si la IA responde mal un precio o una condición?
Por eso los datos que tienen que salir exactos van en el menú y no en la IA. El menú devuelve siempre lo que tú escribiste, así que no hay nada que se pueda inventar. La recomendación es poner siempre ahí los precios, las devoluciones y las condiciones de venta, y dejarle a la IA lo que hay que interpretar.
¿Puedo usar otra IA en vez de la de ChatGPT?
Sí. Funciona con cualquier proveedor compatible con la API de OpenAI, así que puedes conectar Claude, Gemini u otro, incluido uno más económico. La decisión de quién responde —menú, IA o persona— no cambia según el proveedor.