No parpadees...

Disponible para proyectos · Bitácora técnica @byalcantar
Home/Blog/Arquitectura de mi Asistente Híbrido en WhatsApp: Docker, Node.js y Claude API
Volver a todos los artículos
Arquitectura10 Abril, 2026
7 min de lectura

Arquitectura de mi Asistente Híbrido en WhatsApp: Docker, Node.js y Claude API

Desglose técnico de JARVIS: enrutamiento tri-state, bypass de latencia para el dueño, pausa nocturna y protección anti-baneos.

Manejar un único número de teléfono cuando eres estudiante de ingeniería en IA y fundador de una agencia puede volverse un caos rápidamente. Para solucionar esto sin depender de plataformas de terceros costosas, diseñé mi propio **Asistente Híbrido en WhatsApp (codenamed JARVIS)**.

El problema de los bots convencionales

La mayoría de los bots de WhatsApp sufren de tres grandes defectos: 1. Tratan a todo el mundo igual (le responden a tu mamá igual que a un cliente potencial). 2. Tienen respuestas instantáneas sin variación que activan los algoritmos de spam de WhatsApp. 3. Requieren estar encendidos 24/7 sin respetar horas de descanso.

La solución: Arquitectura Tri-State

Construí un servidor puente en **Node.js (Express)** conectado a un contenedor **Docker de OpenWA API Gateway** que clasifica cada mensaje entrante en tres perfiles:

       Mensaje de WhatsApp
                ↓
      OpenWA API Gateway (Docker)
                ↓  (Webhook HMAC)
      Node.js Express Bridge
                ↓
     ┌──────────┼──────────┐
     ▼          ▼          ▼
   Dueño      Familia    Clientes
  (Juan)    (Excluidos) (Desconocidos)
     │          │          │
  Bypass     Silencio   Asistente IA
  500ms      Manual     5-15s delay

1. Dueño (Bypass total · 500ms) Cuando le escribo a mi asistente desde mi número personal, salta todas las restricciones. Actúa como **JARVIS**: respuestas técnicas ultra cortas, confirmación de tareas y ejecución de comandos sin rodeos.

2. Contactos Excluidos (Silencio absoluto) Ciertos números (familia, amigos cercanos) son silenciados automáticamente por el bot. El servidor registra el webhook pero no envía respuesta, permitiéndome chatear manualmente de forma normal.

3. Clientes (Asistente Comercial · Latencia adaptativa) Para números desconocidos, el bot responde en su rol comercial. Para evitar sospechas de automatización: - Aplica un **delay aleatorio de 5 a 15 segundos** (simulando tiempo de tipeo humano). - Incluye una **pausa nocturna** (10 PM a 8 AM) donde los mensajes se encolan para ser procesados al inicio de la jornada.

Conclusión

Controlar tu propia infraestructura de comunicación da una flexibilidad increíble. Con un par de contenedores Docker y código limpio en Node, es posible construir sistemas de IA adaptados exactamente a tu flujo de trabajo diario.