Agente de voz
GPT Live: voces, estilo y escucha
betaDescubre GPT Live 1, prueba sus voces y configura tu agente.
GPT Live 1 es un modelo de voz distinto de GPT Realtime: sigue escuchando mientras habla. En yourang.ai utiliza las instrucciones, el contexto y las herramientas de tu agente; el backend gestiona las acciones y devuelve sus resultados a la voz. Cambiar de voz no añade herramientas ni permisos.
Personalidad, tono y escucha
- Señales de escucha: Desactivadas, Discretas, Naturales o Expresivas. Naturales es una recomendación, nunca un ajuste automático. «Mmm» indica atención, no una reserva confirmada.
- Pausas: Naturales o más paciencia mientras el cliente piensa. Son instrucciones sin frecuencias ni duraciones garantizadas. Interrumpir la voz no cancela automáticamente una acción ya iniciada.
En Avanzado puedes elegir tono, formalidad, longitud de respuesta, ritmo expresivo y una nota de hasta 500 caracteres. Equilibrado, Acogedor, Profesional y Directo son perfiles editables. Usar las instrucciones actuales conserva el comportamiento existente; restablecer las preferencias lo recupera. El ritmo es una guía expresiva, no una velocidad numérica.
Saludo instantáneo en las llamadas salientes
En los agentes salientes el primer mensaje puede empezar en cuanto el cliente contesta, y no tras unos segundos. Hace falta un primer mensaje fijo (sin variables), ningún retraso antes del primer mensaje y la opción Que se escuche completo activada: la pestaña Instrucciones te indica si el saludo instantáneo está activo. A cambio el saludo se escucha completo: el cliente no puede interrumpirlo y el agente no lo oye hasta que termina. Con la opción desactivada el agente saluda en directo, se le puede interrumpir y escucha al cliente desde el principio. Tras un cambio en el primer mensaje o en la voz, la primera llamada aún saluda en directo mientras se prepara el saludo.
Elegir, configurar y probar
Elige una voz
Abre tu agente → Voz, selecciona GPT Live 1 y escucha las muestras disponibles. Las variantes Live son distintas de las voces Realtime del mismo nombre; el idioma y la descripción no garantizan un acento.
Adapta el estilo
En Avanzado configura estilo, señales de escucha y pausas. Los cambios se guardan tras una breve pausa: espera la confirmación. Si falla el guardado, el borrador sigue disponible para reintentarlo.
Prueba tu agente
Después de guardar, usa Probar tu agente en la cabecera. Explica una petición con pausas, interrumpe para corregir un detalle y comprueba una respuesta mientras trabaja una herramienta.
Conserva tus preferencias
Al cambiar de proveedor se conserva el estilo común. Los ajustes de escucha y pausas Live siguen guardados, pero inactivos en otros modelos. Las reglas operativas permanecen en Instrucciones.
Demo y acciones reales
Respuestas al ritmo de tu negocio
El nivel de razonamiento, o effort, regula cuánto analiza el modelo una solicitud antes de responder o elegir una herramienta. En GPT Live, la voz mantiene la conversación mientras un modelo backend recibe las comprobaciones y operaciones delegadas. Su nombre aparece en los ajustes avanzados: el effort no cambia el modelo.
Rápido: un cliente pregunta el horario o una disponibilidad sencilla. Equilibrado: una reserva debe respetar hora, número de personas y preferencias. Profundo: hay que comparar alternativas, combinar condiciones y coordinar comprobaciones. Empieza con Equilibrado y prueba solicitudes representativas.
En Modelo y voz, abre Ajustes avanzados → Gestión de solicitudes. Elige un perfil; los cambios se guardan automáticamente tras una breve pausa. Después prueba el agente. Los nuevos agentes GPT Live empiezan en Equilibrado; los existentes conservan Rápido hasta que lo cambies. Restaurar una versión anterior mantiene Rápido. Restablecer el valor de la plataforma selecciona Equilibrado.
Grok ofrece Rápido y Profundo; la plataforma usa Rápido por defecto. Aquí no hay un nivel medio equivalente. Gemini Live, GPT Realtime, ElevenLabs y Nova no tienen un control effort en esta página. Las preferencias se conservan al cambiar de modelo, pero solo actúan en el modelo compatible.
Más razonamiento puede aumentar la espera y los tokens utilizados, sin garantizar exactitud ni tiempos precisos. No modifica el timbre, la velocidad de la voz, el tono, las pausas ni las señales de escucha; tampoco resuelve datos ausentes, herramientas lentas o instrucciones contradictorias. Los permisos y confirmaciones se mantienen en todos los niveles. Una prueba simulada no demuestra la calidad de audio de una llamada real.
Más información
Actualizado:
¿Te ha resultado útil esta página?