Menu Dot MENÚ

IA en WhatsApp Business API: cuánto cuesta cada alternativa para responder

_ Nestor Tejero Bermejo

11 minutos de lectura

Índice: cuánto cuesta la IA en WhatsApp Business API

Los dos artículos anteriores de esta serie explicaban cuánto vas a pagar por cada mensaje y cómo diseñar mejor la conversación para necesitar menos. Este va de la pregunta que viene justo después: si cada respuesta tiene un coste, ¿quién o qué debería escribirla? Si aún no los has leído, empieza por el cambio de precios de WhatsApp Business API y por cómo reducir esa factura.

Cuánto cuesta la IA en WhatsApp Business API según quién responda

Desde el 1 de octubre de 2026, cada respuesta dentro de la ventana de 24 horas tiene un coste. Pero no cuesta lo mismo según quién la escriba. Si responde una persona, un bot o una IA de terceros, Meta cobra la misma tarifa de servicio por mensaje. Si responde el agente de IA de Meta, cobra por los tokens que consume ese mensaje, y no se suma la tarifa de servicio.

A eso hay que añadir lo que no aparece en la factura de Meta: las horas de tu equipo, el consumo del modelo de IA si es de terceros y lo que cuesta montar cada opción. Por eso la pregunta ya no es solo cuántos mensajes mandas, sino cuánto te cuesta de verdad cada forma de responder.

Qué es un token y qué lee la IA antes de responder

Los modelos de IA no leen palabras, leen tokens: pequeños fragmentos de texto de pocos caracteres. En español, una palabra suele ocupar uno o dos tokens, así que 1.000 tokens equivalen, de forma orientativa, a entre 600 y 750 palabras según el modelo.

Lo importante es qué lee la IA cada vez que responde. No lee solo el último mensaje del cliente: en cada turno vuelve a leer todo lo que necesita para contestar.

  • Instrucciones. Tono, reglas y qué puede hacer. Entre 500 y 2.000 tokens.
  • Conocimiento. Preguntas frecuentes, catálogo, precios o datos del CRM. De 500 a 20.000 tokens, según cómo esté organizado.
  • Acciones. Lo que puede ejecutar: crear una cita, consultar un pedido. Hasta 1.500 tokens.
  • Historial. Lo hablado hasta ahora. Crece con cada turno.
  • Mensaje del cliente. Lo que acaba de escribir: entre 20 y 60 tokens.
  • Respuesta. Lo que genera la IA: entre 80 y 200 tokens. Es lo único que escribe; todo lo demás lo lee.

Por eso, aunque los tokens de salida son más caros por unidad, la mayor parte de la factura es lectura. Una IA que lee 20.000 tokens para escribir 120 paga casi todo por lo que lee.

Gráfico que compara los 20.940 tokens que lee la IA en cada respuesta con los 120 que escribe
La IA escribe 120 tokens, pero lee más de 20.000 para escribirlos: casi toda la factura es lectura.

Las cuatro formas de responder en WhatsApp

Hay cuatro maneras de que un mensaje reciba respuesta, y se pueden combinar en el mismo número. Cada una tiene un perfil de coste distinto:

AlternativaQué paga a Meta por respuestaQué se paga aparteCuánto cuesta ponerla en marcha
PersonasTarifa de servicio (0,0166 € en España)Las horas del equipoOrganizar al equipo y la bandeja compartida
Bot sin IATarifa de servicioNada por respuesta, más allá de la licencia de la plataformaDiseñar, configurar y mantener el flujo
IA de tercerosTarifa de servicioLos tokens del proveedor de IA y, si la hay, la cuota del módulo de IA de la plataformaConfigurar el asistente, ordenar el conocimiento, integrarlo con el CRM y supervisarlo
Agente de IA de MetaSin tarifa de servicio: un único cargo por tokens (2 $ por millón)NadaCargar el conocimiento, configurar el agente y supervisarlo

Personas

Un agente del equipo lee, decide y responde. Es la opción más flexible y la única que maneja bien la ambigüedad, una negociación o una queja delicada. Su coste tiene dos partes: la tarifa de servicio de Meta por cada respuesta y el tiempo que dedica la persona. Con un supuesto de 2 minutos por respuesta y un coste de 22 € por hora, cada respuesta cuesta unos 0,73 € en tiempo, frente a los 0,0166 € de la tarifa de Meta.

Bot sin IA

Un flujo conversacional con botones, listas, WhatsApp Flows y respuestas fijas. Es la opción más barata por respuesta cuando la pregunta es predecible —horarios, ubicación, estado de un pedido—, porque no suma coste de IA a la tarifa de Meta. Su coste real está en el tiempo de diseñarlo, configurarlo y mantenerlo al día. Y se queda corto en cuanto la pregunta se sale del guion.

IA de terceros vía plataforma

Un modelo de IA de OpenAI, Google, Anthropic u otro proveedor, conectado a WhatsApp a través de tu plataforma —Woztell, Blip, Spoki u otra—. Aquí el coste llega en dos facturas: la tarifa de servicio de Meta, igual que en las opciones anteriores, y el consumo del modelo de IA. Ese consumo depende de cuántos tokens procese el modelo elegido, y eso depende a su vez de qué tareas tenga que hacer en cada respuesta.

Los precios varían mucho entre modelos. Un modelo ligero cuesta veinte veces menos que uno avanzado del mismo proveedor, y para atención al cliente el ligero suele bastar.

Agente de IA de Meta

El agente de IA propio de Meta, integrado en la plataforma de WhatsApp Business. Agrupa en un solo cargo la IA y la entrega: Meta cobra 2 $ por millón de tokens, sin tarifa de servicio y sin factura aparte de un proveedor de IA.

La contrapartida es el consumo. Según la propia Meta, un mensaje suele consumir entre 20.000 y 25.000 tokens, unos 4–5 céntimos de dólar (entre 3,5 y 4,4 céntimos de euro). Las respuestas sencillas consumen menos, pero incluso su ejemplo de pregunta simple ronda los 20.000 tokens por mensaje. Además, no eliges el modelo ni controlas qué lee la IA en cada turno, así que la decisión depende de cómo se comporte con tu caso concreto.

Dos excepciones que cambian las cuentas

Las primeras 1.000 respuestas de servicio son gratis cada mes por número de teléfono. Por debajo de ese volumen, una persona, un bot o una IA de terceros no pagan nada a Meta por responder. El agente de Meta, en cambio, cobra por tokens desde el primer mensaje.

La segunda es la ventana de 72 horas de Click-to-WhatsApp: cuando el cliente llega desde un anuncio y respondes en 24 horas, la entrega de mensajes es gratis durante 72 horas. Pero Meta aclara que los mensajes de su agente se siguen cobrando por tokens dentro de esa ventana. Si buena parte de tu tráfico llega por anuncios, la balanza se inclina hacia las otras tres opciones. Lo explicamos en el punto 6 de cómo reducir el coste de WhatsApp Business API.

Rejilla que muestra que persona, bot e IA de terceros no pagan a Meta en las primeras 1.000 respuestas ni en la ventana de 72 horas, y el agente de Meta sí
En las dos excepciones, el agente de Meta sigue cobrando por tokens.

Cinco casos: cuánto cuestan 1.000 respuestas

Para comparar, hemos calculado cinco casos ilustrativos, con negocios y conversaciones ficticios pero con tarifas reales consultadas el 23 de septiembre. Todas las cifras son por cada 1.000 respuestas a partir de la respuesta 1.001 del mes, en euros y sin IVA.

CasoQué haceTokens que lee por respuestaIA ligera + servicioIA avanzada + servicioAgente de Meta
1. Clínica SonrisaPreguntas frecuentes sobre citas y precios, conversaciones cortas1.65016,79 €20,36 €35–44 €
2. Tienda LúaCatálogo, datos del cliente en el CRM y devoluciones9.25017,47 €34,09 €35–44 €
3. Fisio NorteTodo el conocimiento cargado en cada turno20.94018,48 €54,28 €35–44 €
CasoCómo respondeCoste por 1.000 respuestas
4. Hotel Mar AzulBot sin IA: menús, botones y Flows16,60 € (solo tarifa de servicio)
5. Asesoría VegaResponde una persona (supuesto: 2 minutos por respuesta a 22 €/hora)≈ 750 € (733 € de tiempo + 16,60 € de servicio)
Gráfico de barras con el coste por cada 1.000 respuestas de IA ligera, IA avanzada y agente de Meta en tres casos, frente al bot y a la persona
Con una IA ligera, la diferencia entre opciones es pequeña; lo que dispara el coste es la IA avanzada con demasiado contexto o la respuesta humana.

Con una IA ligera, casi todo es tarifa de Meta: de los 16,79 € de la clínica, 16,60 € son mensajes de servicio y apenas 0,19 € son tokens. El modelo y la configuración empiezan a pesar cuando se usa una IA avanzada o cuando el asistente lee demasiado, como en el caso 3.

Y la diferencia grande no está entre las opciones automáticas, sino frente a la persona: una respuesta humana cuesta entre 14 y 45 veces más que cualquiera de las automáticas. El ahorro de automatizar no está en los tokens: está en las horas que libera para lo que de verdad necesita a una persona.

Cómo lo hemos calculado:

  • IA ligera: GPT-6 Luna de OpenAI (0,10 $ por millón de tokens de entrada y 0,50 $ de salida).
  • IA avanzada: GPT-6 Sol (2 $ y 10 $)
  • Agente de Meta: la referencia de consumo que publica Meta, de 20.000 a 25.000 tokens por mensaje a 2 $ por millón, porque su consumo no depende de cómo configures el asistente. Tarifa de servicio en España: 0,0166 €.

Cambio: 1 € = 1,14 $. Los precios cambian varias veces al año: compruébalos antes de decidir.

¿Sale más barato el agente de Meta o una IA de terceros?

Depende del caso, y no es blanco o negro. Dos ejemplos de la tabla:

  • Meta sale más caro. En la clínica, una IA ligera de terceros cuesta 16,79 € por cada 1.000 respuestas, tarifa de servicio incluida. El agente de Meta, entre 35 y 44 €: más del doble.
  • Meta sale más barato. En Fisio Norte, con todo el conocimiento cargado y una IA avanzada, la opción de terceros sube a 54,28 €. Ahí, los 35–44 € del agente de Meta son la opción más económica.

La propia Meta llega a una conclusión parecida en su comparativa: una IA de terceros sencilla sale más barata que su agente, y una compleja, más cara. A favor de terceros juegan también las 1.000 respuestas gratuitas por número y la ventana de 72 horas de los anuncios. A favor de Meta, que es un solo proveedor y una sola factura.

Y el precio no debería ser lo único que decida. Pesan tanto o más otras cuestiones: la calidad de las respuestas, la integración con tu CRM, el control sobre lo que dice el bot y cómo pasa la conversación a una persona.

Cómo se abarata una IA de terceros: el ejemplo de Fisio Norte

Volvamos al caso 3. Es un ejemplo ilustrativo, pero es un patrón muy habitual en asistentes montados deprisa. Un cliente pregunta: «¿Cuánto cuesta una sesión?». Así cambia lo que la IA tiene que leer para responder a la misma pregunta, según cómo esté configurada:

Antes · 20.940 tokens de entradaDespués de optimizar · 4.140 tokens de entrada
Instrucciones2.000 tokens: el manual completo del asistente, con dos páginas de ejemplos, en cada turno900 tokens: solo cómo responder; los ejemplos viven en un documento aparte
Conocimiento18.000 tokens: toda la base, con tratamientos, precios, seguros, horarios, los 3 centros y los 9 fisios2.500 tokens: base de conocimiento troceada; solo viajan los 3 fragmentos que pide la pregunta (sesiones, bonos y seguros)
Acciones500 tokens: las 8 acciones disponibles, aunque la pregunta sea de precios300 tokens: solo «pedir cita» y «pasar a persona»

La respuesta que recibe el cliente es la misma. Lo que cambia es lo que la IA lee para escribirla: cinco veces menos. Estas son las palancas:

  • Recuperar solo lo relevante. La técnica se llama RAG (Retrieval-Augmented Generation, generación aumentada por recuperación): el conocimiento se trocea en fragmentos y en cada pregunta solo viajan los que hacen falta. Es la palanca con más impacto.
  • Instrucciones cortas. Reglas concisas, y los ejemplos largos fuera del mensaje principal.
  • Acciones según la intención. Si la pregunta es de precios, la IA no necesita evaluar las ocho acciones que sabe ejecutar.
  • Caché de entrada. Los proveedores cobran mucho menos por la parte fija que se repite en cada turno si se marca como caché.
  • Menos turnos. Botones y WhatsApp Flows acortan la conversación, y con ella el historial que se relee. Lo contamos en cómo reducir el coste de WhatsApp Business API.
  • Respuestas cortas. Dos o tres frases, sin repetir la pregunta: la salida es el token más caro.

La tabla recoge los tres primeros ajustes, que dejan la lectura en 4.140 tokens. Si además se acortan la conversación y las respuestas, se llega a 3.935. Este es el ahorro de cada palanca:

Gráfico de cascada con el ahorro de tokens de cada palanca, de 20.940 a 3.935 tokens por respuesta
Trocear el conocimiento ahorra 15.500 de los 17.005 tokens: es, con diferencia, la palanca que más ahorra.

El efecto depende del modelo. Con una IA avanzada, el coste baja a menos de la mitad: de 54,28 € a 24,27 € por cada 1.000 respuestas, sin contar la caché. Con una ligera apenas se nota, porque casi todo es tarifa de Meta. Y en el agente de Meta el margen es mucho menor, porque es Meta quien gestiona qué lee su IA. En resumen: una IA bien diseñada lee solo lo que necesita.

Qué alternativa conviene según tu caso

No hay una opción que gane siempre. La decisión depende de tres preguntas:

  • ¿Cuánto varía la pregunta? Si la mayoría de las conversaciones son las mismas cinco preguntas, un bot sin IA las resuelve igual de bien y sin coste de IA.
  • ¿Tienes el conocimiento ordenado? Una IA necesita información troceada y accesible. Sin eso, lee de más y cuesta más de lo que debería.
  • ¿Qué pasa cuando la conversación se complica? Ninguna opción automática debería quedarse sola ante una queja seria o una negociación. Ahí la persona sigue siendo la opción correcta.

En la práctica, las empresas que atienden bien por WhatsApp combinan tres capas en el mismo número:

  1. Un bot para lo predecible,
  2. una IA —la de Meta o una de terceros— para lo que necesita contexto,
  3. y personas para lo que necesita criterio. Diseñar esa combinación, y el asistente que hay detrás, es lo que hacemos en nuestro servicio de chatbots con IA, integrado con WhatsApp Business Platform.
Esquema de tres capas de atención en WhatsApp: bot sin IA, IA y persona, con qué resuelve cada una
Cada capa resuelve lo suyo y deriva lo demás: así se paga IA solo donde aporta.

Si quieres poner números a tu caso, nuestra calculadora de costes de WhatsApp estima tu factura de Meta desde el 1 de octubre y las horas de equipo que liberas al automatizar respuestas:

ReiniciaCalculadora gratuita
Nuevas tarifas Meta · España 2026

0,02 $
cada respuesta desde la 1.001
0,0585 €
cada plantilla de marketing
1 min
para ver tu caso
No guardamos ningún dato
Paso 1 de 2 · tus datos básicos

Un mes normal de WhatsApp

Meta cobra según el país del número al que escribes
mens.
Lo que tu equipo o tu bot responde dentro de las 24 h
núm.
Si dudas, pon 1
mens.
Campañas y promociones. 0 si no envías
min
0 si ya responde un bot
* campo obligatorio
Rellena los campos obligatorios

Preguntas frecuentes

¿El agente de Meta es más caro que una IA de terceros?

Depende. Frente a una IA ligera de terceros bien configurada, el agente de Meta suele salir más caro: en nuestros casos, más del doble. Frente a una IA avanzada que lee demasiado en cada turno, puede ser al revés. Compara siempre con tus volúmenes reales.

¿Puedo mezclar un bot sin IA con una IA en el mismo número?

Sí, y es lo habitual. El bot resuelve las preguntas cerradas y deriva a la IA o a una persona cuando la conversación se sale del guion. Así no pagas IA por preguntas que un árbol de decisión ya resuelve.

¿Qué pesa más en la factura, los tokens de entrada o los de salida?

Por unidad, los de salida: suelen costar varias veces más que los de entrada (cinco veces en los modelos de OpenAI que usamos en el ejemplo). Pero por respuesta pesan más los de entrada, porque la IA lee mucho más de lo que escribe: en el caso de Fisio Norte, 20.940 tokens leídos para escribir 120. Por eso lo que más ahorra en WhatsApp es recortar lo que lee.

¿Las 1.000 respuestas gratuitas cuentan también si responde una IA?

Sí, si es una IA de terceros, un bot o una persona: son mensajes de servicio y entran en el tramo gratuito. El agente de Meta es una categoría distinta y se cobra por tokens desde el primer mensaje.

¿Un bot sin IA puede sonar tan natural como uno con IA?

No en la conversación libre, pero para preguntas cerradas la diferencia que nota el cliente es mínima. Ahí, pagar de más por IA no compra mejor experiencia, solo más factura.

Diseñamos el asistente de IA que se ajusta a tu volumen, no el que más caro suena_

Sobre las fuentes de este artículo

Tarifas de Meta: precios de mensajes sin plantilla (agente de IA de Meta y mensajes de servicio) y tarifas de WhatsApp Business Platform. Precios de modelos: página de precios de la API de OpenAI. Consultados el 23 de septiembre de 2026; tipo de cambio: 1 € = 1,14 $. Los cinco casos son ejemplos ilustrativos elaborados por Reinicia, y el coste por hora de las personas es un supuesto.

Te enseñamos el camino inteligente para alcanzar tus metas_
¡Dinos cómo quieres que nos conozcamos!