Cómo conectar un agente de IA a WhatsApp (Claude, ChatGPT y otros)
El camino para poner un agente de IA a atender en el número oficial de la empresa: MCP, OAuth 2.1, alcances que son roles y qué puede y qué no puede hacer el agente.
Actualizado el 2 de septiembre de 2026
Un agente de IA empieza a atender en el WhatsApp de la empresa cuando la cuenta se expone como un servidor MCP y el agente recibe una credencial con alcance. A partir de ahí, Claude, ChatGPT, Cursor, Codex, n8n o un agente propio leen la bandeja y responden en el mismo número del equipo, con las mismas reglas.
Qué es MCP y por qué resuelve esto
MCP (Model Context Protocol) es un protocolo abierto que estandariza cómo un modelo de IA se comunica con herramientas y datos externos. Antes, cada asistente exigía su propia integración. Con él publicas un servidor una vez y cualquier cliente compatible puede usarlo.
Eso cambia el coste de meter IA en la atención: en vez de escribir un bot, le das a un agente que ya existe las herramientas que necesita — listar conversaciones, leer mensajes, responder, enviar plantillas, marcar como leído.
Dos formas de autenticar
OAuth 2.1 es la vía para clientes con soporte de autorización: claude.ai, Claude Desktop, ChatGPT, editores de código. El cliente descubre solo los endpoints, abre el navegador, el administrador elige el nivel de acceso y qué números puede usar ese agente, y pulsa autorizar. No se pega ninguna clave y el acceso aparece en la misma lista desde la que se revoca.
Clave de API es la vía para todo lo demás: un script, un flujo en n8n, un agente propio. El administrador genera la clave, se muestra una sola vez y va al almacén de secretos del cliente. En el servidor solo queda el hash: la clave en texto no se puede recuperar.
El alcance es un rol, no una lista suelta de permisos
Un agente no recibe un montón de permisos sueltos: recibe un rol, el mismo vocabulario que se aplica a las personas.
| Alcance | Equivale a | Puede |
|---|---|---|
| lectura | espectador | listar conversaciones y leer mensajes |
| mensajes | agente | lo anterior + responder y enviar plantillas aprobadas |
| completo | gerente | lo anterior + crear y borrar plantillas |
Las acciones administrativas — invitar personas, cambiar roles, conectar o desconectar números — no existen por MCP, en ningún alcance. Y cada credencial solo ve los números que el administrador le habilitó: esa lista es la frontera, verificada en cada lectura y en cada envío.
Lo que el agente sigue sin poder hacer
Las reglas de WhatsApp valen igual para personas y para agentes:
- responder libremente solo dentro de la ventana de 24 horas que abre el cliente;
- fuera de ella, solo una plantilla aprobada reabre la conversación;
- nada de disparar a quien no lo pidió: la calidad del número es de la empresa, no del agente.
Un agente bien portado respeta eso porque el servidor rechaza lo que rompe la regla, no porque el prompt lo pidiera con educación.
Cómo sabe el cliente con quién habla
Cada mensaje enviado registra a su autor: una persona del equipo o el agente, identificado por su nombre. La bandeja muestra esa autoría dentro de la conversación, así que el relevo queda explícito en el historial: el cliente ve un solo número y el equipo ve exactamente dónde se detuvo el agente.
Una forma realista de empezar
- Conecta el número por la API oficial.
- Crea un acceso con alcance de lectura y deja que el agente solo resuma y clasifique conversaciones durante unos días.
- Sube a mensajes con un encargo estrecho: preguntas frecuentes, horario, estado del pedido.
- Escribe cuándo debe parar el agente y llamar a una persona, y prueba ese límite antes de abrirlo a todo el mundo.
La documentación técnica con endpoints, herramientas y ejemplos por cliente está en /docs/mcp.
¿Te quedó alguna duda?
Las preguntas frecuentes cubren precios, reglas de Meta, roles del equipo y acceso de agentes. La documentación técnica es pública y cualquier agente de IA puede leerla.