Precios de Vapi AI: cuánto cuesta de verdad el modelo por minuto

Coste de Vapi AI: el precio por minuto no incluye el componente de plataforma ni otros costes para desplegar un agente de voz con IA como HappyRobot.

Gonzalo Ybanez
Gonzalo Ybáñez
Growth Strategist
Actualizado 7 ago 20269 min de lectura
Vapi AI pricing
Saltar a la sección

Los precios de Vapi AI se basan en el uso, con tarifas de plataforma que se cobran por minuto. A eso se suma un coste independiente por cada proveedor de voz a texto, modelo de lenguaje y texto a voz que conectes.

Este es el detalle que la mayoría de las páginas de precios se salta. También es la razón por la que la cifra anunciada en la página de inicio casi nunca coincide con la que aparece en la factura.

Vamos a desglosar cuánto cuesta Vapi realmente más allá de su tarifa por minuto. Eso implica contar las horas de ingeniería necesarias para convertir una API de voz en un agente que aguante en producción. Porque esa es una cifra completamente distinta que muchas empresas no incluyen en su presupuesto.

Cómo funciona el modelo de precios de Vapi

Vapi cobra su propia tarifa de plataforma por minuto por gestionar la llamada en sí. Después repercute los costes independientes de cada proveedor de voz a texto, modelo de lenguaje y texto a voz que conectes.

Vapi AI pricing per minute

Esto demuestra que seguirás pagando un conjunto de cargos en lugar de una sola cifra.

La tarifa de plataforma de Vapi

El plan autogestionado Build de Vapi indica una tarifa de plataforma de 0,05 $ por minuto en llamadas y 0,005 $ por mensaje en SMS y chat. Incluye más de 60 minutos y 10 llamadas simultáneas. Cada línea adicional cuesta 10 $ al mes.

Ahora bien, esto cubre únicamente la tarifa de plataforma, que incluye la parte que Vapi aporta para ejecutar la llamada. Mantiene la llamada conectada y gestiona el traspaso entre los modelos de voz y de lenguaje en tiempo real. No cubre los modelos que realmente ejecutan la llamada, como el reconocimiento de voz o los modelos de lenguaje.

Lo que pagas además de eso

Los costes de los modelos se facturan por separado a la tarifa del proveedor, salvo que uses tu propia clave de API, en cuyo caso Vapi no les aplica ningún margen.

Una llamada que utiliza un modelo de lenguaje premium y un proveedor de voz premium cuesta bastante más por minuto que la misma llamada con un stack más económico, aunque la tarifa de plataforma de Vapi se mantenga fija en 0,05 $ en ambos casos.

Por ejemplo, Claude 3.7 Sonnet cuesta 0,09 $/1M de tokens, mientras que GPT-4o Realtime Preview cuesta 1,14 $/1M de tokens.

A eso hay que añadir la capa de texto a voz, por la que se te cobra un extra por minuto.

Vapi TTS pricing models and cost


Como no puedes planificar de antemano el número de minutos de llamada, no puedes presupuestar Vapi, y por eso tampoco puedes compararlo con un producto de tarifa plana con una única cifra.

La vía empresarial

Para grandes empresas, Vapi ofrece además un plan Scale que requiere un contrato anual con una tarifa de plataforma fija y un volumen de llamadas comprometido. Este plan incluye SOC 2, HIPAA, SSO y un equipo de cuenta dedicado.

Los precios de ambos planes pueden cambiar, así que trata cada cifra aquí como una referencia y confirma las tarifas actuales en la página oficial de precios de Vapi antes de presupuestar en base a ellas.

¿Cuánto cuesta Vapi AI por minuto?

Vapi cobra una tarifa de plataforma fija de 0,05 $ por minuto. A eso se suma lo que pagues por los proveedores de voz a texto, modelo de lenguaje y texto a voz que elijas.

Sumándolo todo, las pruebas independientes sitúan el coste real entre 0,07 $ y algo más de 1,00 $ por minuto.

Qué determina el coste:

  • Tarifa de plataforma: Fija en 0,05 $ por minuto, sea cual sea lo que construyas
  • Voz a texto: De 0,008 $ a 0,017 $ por minuto, según el proveedor
  • Modelo de lenguaje: Menos de un céntimo hasta 0,32 $ por minuto, según el modelo que elijas
  • Texto a voz: Desde una fracción de céntimo hasta 0,65 $ por minuto en voces premium

Qué significa esto en la práctica:

  • Stack más barato + tarifa de plataforma: alrededor de 0,07 $ por minuto
  • Stack más caro + tarifa de plataforma: puede superar 1,00 $ por minuto

Estas cifras proceden de las pruebas independientes de Softailed, no de los datos publicados por Vapi. Un análisis distinto de Lindy encontró un rango más estrecho, de 0,07 $ a 0,25 $ o más, con las mismas variables. Ambas son estimaciones de terceros. Tómalas como punto de partida y comprueba el coste de tu propio stack antes de comprometerte a un volumen.

Algo que el precio por minuto no incluye: el tiempo de desarrollo

Un desarrollador en Reddit documentó 760 llamadas y más de 100 horas de trabajo creando un agente de Vapi. Su conclusión: la IA en sí supuso aproximadamente el 20 % del esfuerzo. El resto se destinó a la gestión de errores y a los flujos de automatización necesarios para devolver los resultados de las llamadas a un CRM.

Este post trata sobre la creación de un agente fuera de horario para ayudar a los clientes a localizar artículos concretos en una tienda de Shopify con más de 4.500 productos. Requería un flujo de trabajo aparte para extraer los productos adecuados de un catálogo desordenado y entregar a la IA una respuesta limpia, todo ello en 800 milisegundos, antes de que la llamada se quedara en silencio. Solo esa pieza tardó días en estabilizarse.

Las respuestas dicen lo mismo. Un desarrollador cambió de plataforma porque, cuando una llamada de Vapi fallaba, los registros no mostraban qué había ido mal. Otro publicó un error en directo: un flujo de trabajo que funcionaba en una URL de prueba dejó de ejecutarse en cuanto pasó a producción, sin registros que explicaran por qué.

Este tiempo de desarrollo no es exclusivo de Vapi. Aparece en la mayoría de las plataformas de voz modulares. Y es también el motivo por el que conviene presupuestarlo antes de comparar la tarifa anunciada de Vapi con una alternativa totalmente gestionada.

Los planes de precios de Vapi

Vapi ofrece dos planes:
I. Build: un plan de autoservicio basado en el uso, para desarrolladores individuales y equipos pequeños

II. Scale: un contrato empresarial anual con precios por volumen personalizados.

Aquí lo vemos con más detalle.

Plan Vapi Build (autoservicio, basado en el uso)

Build es donde empieza la mayoría. Las cuentas nuevas reciben un crédito de prueba único de 10 $ en lugar de un nivel gratuito permanente y, una vez agotado ese crédito, cada llamada se factura a las tarifas estándar por minuto.

Otras características incluidas:

  • 10 llamadas simultáneas; las líneas adicionales cuestan 10 $ por línea y mes
  • El historial de llamadas se conserva 14 días; el de chats, 30 días
  • No incluye SSO, RBAC ni SOC 2

Plan Vapi Scale (empresarial, contrato anual)

Scale es la vía empresarial, que funciona con una cuota de plataforma fija y un volumen de llamadas comprometido.

Se negocian tres cosas:

  • Una cuota de plataforma fija
  • Un volumen de llamadas comprometido
  • La tarifa por minuto que ese volumen te permite conseguir.

Vapi no publica la tarifa de Scale, así que la cifra que pagues dependerá de a qué te comprometas.

No negociable:

  • El complemento HIPAA (2.000 $/mes)
  • La Retención Cero de Datos (1.000 $/mes) cuesta lo mismo en Scale que en Build.

Otras características incluidas:

  • Cumplimiento de SOC 2, HIPAA y PCI
  • SSO, RBAC y un equipo de cuenta dedicado

Conviene saberlo: costes de los proveedores de modelos
En el plan Build, Vapi indica que los costes de los modelos (STT, LLM, TTS) se te facturan a precio de coste. Son gratuitos si aportas tu propia clave de API.

En Scale, esas mismas celdas de su tabla están en blanco. Por tanto, no sabemos si los clientes empresariales siguen pagando esos costes de modelos por separado o si están incluidos en el contrato. Pero, para una empresa que compara Vapi con una alternativa totalmente gestionada, el verdadero punto de comparación es el plan Scale, ya que es el nivel diseñado para competir en coste y soporte con un agente de voz desplegado.

¿Merece la pena Vapi o es mejor desplegar un agente de voz con IA?

Vapi merece su precio modular si tu equipo cuenta con los ingenieros necesarios para montar, probar y mantener un pipeline de voz. Si no dispones de esos ingenieros, una tarifa baja por minuto te aporta muy poco.

Vapi call charges per minute dashboard

VAPI average cost per call | Source: YouTube

En esencia, sigues pagando el desarrollo, solo que a través de salarios de ingeniería en lugar de tarifas por uso.

Vapi encaja con equipos que quieren elegir sus propios proveedores de reconocimiento de voz, lenguaje y voz sintética, y que están dispuestos a asumir la gestión de errores y la automatización que convierte una llamada finalizada en una actualización del CRM o en un mensaje de seguimiento. Es un control real, pero tiene el coste del tiempo de ingeniería necesario para construirlo y mantenerlo.

HappyRobot como alternativa a Vapi: agente de voz con IA

HappyRobot despliega trabajadores de IA construidos sobre un stack de voz propio, ya listo para producción, compatible con más de 30 idiomas y que se pone en marcha con un contrato en lugar de una factura por minuto más componentes que tienes que montar tú mismo.

No hay facturas separadas de STT, LLM y TTS que cuadrar cada mes, ni una capa de webhooks que mantener cuando un proveedor cambia su API.

Los Forward Deployed Engineers se encargan directamente de la implementación. Una vez que el agente está activo, cada llamada entrante se conecta nada más llegar, con una tasa de respuesta del 100% y sin colas de espera.

Vapi te da control sobre cada capa del pipeline de voz. HappyRobot te da el agente ya creado y en funcionamiento.

Aspect to ConsiderVapiHappyRobot
Pricing modelPer-minute platform fee plus separate component costsEnterprise contract for a deployed agent
Cost components to manageSTT, LLM, TTS, and telephony, assembled and billed individuallyBundled into one deployment
Per-minute predictabilityChanges with the models you chooseFixed under contract
Build and maintenanceYours: engineering time to build, test, and keep workingNone: built and maintained for you
Voice agentYou assemble it yourself via APIAlready built on a proprietary stack
Best fitDevelopers who want to own every layerTeams who want a working agent, not a build project
HappyRobot Vs Vapi: A Comparision

Las cifras de Vapi reflejan las tarifas publicadas por la compañía en el momento de redactar este texto y están sujetas a cambios. Confirma los precios actuales directamente con Vapi antes de elaborar tu presupuesto.

Las cifras de HappyRobot reflejan su modelo de despliegue y contratación publicado. Para una comparativa completa sobre arquitectura y profundidad de los flujos de trabajo, consulta Vapi vs. HappyRobot.

Preguntas frecuentes

  • ¿Cuánto cuesta Vapi AI?
    Vapi aplica un precio basado en el uso: una tarifa de plataforma de 0,05 $ por minuto en su plan Build, más los costes independientes de los modelos de voz, lenguaje y habla que conectes. No hay una tarifa mensual fija, así que el coste real depende de tu volumen de llamadas y de los modelos que elijas. Los compradores enterprise pueden pasarse al plan Scale, con precio personalizado.
  • ¿Cuánto cuesta Vapi AI por minuto?
    La tarifa de plataforma de Vapi es de 0,05 $ por minuto. Si añades el reconocimiento de voz, el modelo de lenguaje y la síntesis de voz, las pruebas independientes sitúan el total real entre 0,07 $ y algo más de 1,00 $ por minuto.
  • ¿Vapi tiene un plan gratuito?
    No. Las cuentas nuevas reciben un crédito de prueba único de 10 $, no un plan gratuito permanente. Cuando se agota, todas las llamadas se facturan a las tarifas de uso estándar.
  • ¿Por qué es difícil estimar por adelantado el precio de Vapi?
    Por dos motivos: no puedes predecir tus minutos de llamada y tu tarifa por minuto cambia cada vez que cambias de modelo. Es decir, obtienes un rango, pero no un presupuesto.
  • ¿Cuál es la alternativa si no quieres montar y mantener tú mismo toda la estructura de precios?
    HappyRobot despliega un agente de voz con IA sobre una tecnología propia, con un precio por contrato en lugar de por minuto más componentes. Encaja con los equipos que quieren un agente funcionando sin tener que montarlo.