Plataforma
Plataforma de agentes de voz con IA
Crea agentes de voz con IA basados en LLM
Explorar más →

ASR MRCP
ASR para plataformas IVR VoiceXML
Explorar más →
Desarrolladores
API, SDK, documentación y precios
Explorar más →
Por industria
Conversión de voz a texto, bot de telefonía, análisis de voz y ASR MRCP. En la nube, en su VPC o en sus propias instalaciones. Regístrese gratis con $50 de crédito; sin tarjeta de crédito ni llamadas de demostración.
Todas las API de Voicegain comparten la misma autenticación, los mismos formatos de audio y las mismas opciones de implementación. Úselas por separado o combínelas.
Voz a texto
Lotes · Streaming
89% de precisión en audio de llamadas. Omega para procesamiento por lotes, Kappa para streaming con latencia inferior a 100 ms. Diarización, redacción de PII y vocabulario personalizado.
Ver documentación →Bot de telefonía
SIP · Devoluciones de llamada
Cree bots de voz y sistemas IVR integrando Voicegain en una sesión SIP. Turnos basados en JSON. Utilice su propio LLM o lógica de negocio.
Ver documentación →Análisis
Asíncrono
Análisis de sentimiento, reconocimiento de entidades, palabras clave, intención y extracción de temas. Transcripción y análisis en una sola llamada.
Ver documentación →ASR MRCP
MRCPv1 · MRCPv2
Reconocimiento de voz integrado para IVR VoiceXML. Gramáticas SRGS, grXML, JSGF. Reemplaza ASR heredados sin necesidad de reescribir aplicaciones.
Ver documentación →Sin llamadas de ventas. Regístrate, obtén tu clave de API y envía una solicitud.
01
Correo electrónico y contraseña, o inicia sesión con Google. No se requiere tarjeta de crédito. Recibes $50 de crédito en la plataforma al registrarte.
02
Claves con alcance de proyecto, con sus propios límites de tasa y registros de auditoría. Rota o revoca cualquier clave sin tiempo de inactividad.
03
Una solicitud desde tu terminal: audio de entrada, transcripción de salida. O abre un WebSocket de streaming para reconocimiento en tiempo real.
*para otros idiomas, llama directamente a la API REST y WebSocket.
from voicegain_speech import Configuration, ApiClient, AsrApi cfg = Configuration() cfg.access_token = os.environ["VG_KEY"] api = AsrApi(ApiClient(cfg)) session = api.asr_recognize_async_post( async_recognition_request={ "audio": {"source": {"stream": {"protocol": "WEBSOCKET"}}},
"settings": {"asr": {"languages": ["es-ES"], "model": "kappa"}} } )
Voicegain es propietario de sus modelos, no somos una interfaz de la API de terceros. Elija el que mejor se adapte a su caso de uso.
Idiomas: inglés, español, alemán, portugués, coreano, hindi (y próximamente neerlandés y francés). Entrenamiento personalizado de modelos acústicos y de lenguaje disponible.
Las mismas API, el mismo SDK y los mismos modelos, ya sea en nuestra nube o en su propio entorno.
SaaS multiinquilino con certificación SOC 2 y cumplimiento de HIPAA. Donde Casey opera para planes de salud del mercado medio y administradores externos (TPA), y el inicio más rápido para los desarrolladores de plataformas.
RÁPIDO DE EMPEZARImplementa en tu VPC de AWS, Azure o GCP. Las mismas API, las mismas interfaces: tu red, tus claves de cifrado.
PARA PAGADORES DE ATENCIÓN MÉDICA EMPRESARIALKubernetes bare-metal o totalmente aislado (air-gapped). Tu centro de datos, tu hardware, sin salida a internet. Ideal para sectores regulados.
Para sectores reguladosSin tarifas por puesto ni trampas de salida de datos. La nube se factura por segundo de audio; las implementaciones Edge se licencian por puerto.
Empieza gratis
$50 de crédito
Suficiente para evaluar, desarrollar y lanzar una integración real; no se requiere tarjeta de crédito.
Nube
$0.00020 / seg
Por segundo de audio, mínimo de 6 segundos por solicitud. Los compromisos de volumen y plazo reducen la tarifa.
Edge
Por puerto / mes
Licencia por puerto para implementaciones en su VPC o centro de datos. Con conexión a la nube o en entorno aislado (air-gapped).
Empresarial
Personalizado
Para alto volumen, SLA personalizados, soporte dedicado, entrenamiento de modelos a medida y BAA.
¿Cómo autentico las solicitudes a la API?
+Cada solicitud utiliza un token de portador generado a partir de tu clave de API con alcance de proyecto en la consola; no se requiere el proceso de OAuth.
¿Qué formatos de audio son compatibles?
+WAV, MP3, FLAC y PCM sin procesar son compatibles para solicitudes por lotes y en tiempo real, en las frecuencias de muestreo habituales de telefonía y radiodifusión.
¿Existe un plan gratuito?
+Sí, cada cuenta comienza con 50 $ de crédito de plataforma, sin necesidad de tarjeta de crédito, suficiente para desarrollar e implementar una integración real.
¿Puedo ejecutar Voicegain de forma local o en un entorno aislado (air-gapped)?
+Sí, la licencia Edge utiliza las mismas API y modelos en tu VPC o centro de datos, ya sea con conexión a nuestra plataforma o totalmente aislado (air-gapped).
La documentación completa se encuentra en el Centro de Soporte de Voicegain. El SDK y el código de ejemplo están en GitHub. Aquí tienes todo en un solo lugar.
Documentación
Referencia de API, guías y tutoriales sobre STT, bots de telefonía, analítica, MRCP e implementación en el borde (Edge).
support.voicegain.ai →Código abierto
El SDK oficial de Python, el repositorio de la plataforma con docenas de integraciones de ejemplo y una utilidad de comparación de transcripciones.
github.com/voicegain →Cumplimiento total con las normativas de salud.
Auditoría completada en los 5 criterios de SOC 2.
Cumple con las directrices PCI Nivel 2 v4.0.
Soluciones seguras de principio a fin.