Agente de voz
GPT Live: voces, estilo y escucha
betaDescubre GPT Live 1, prueba sus voces y configura tu agente.
GPT Live 1 es un modelo de voz distinto de GPT Realtime: sigue escuchando mientras habla. En yourang utiliza las instrucciones, el contexto y las herramientas de tu agente; el backend gestiona las acciones y devuelve sus resultados a la voz. Cambiar de voz no añade herramientas ni permisos.
Personalidad, tono y escucha
- Señales de escucha: Desactivadas, Discretas, Naturales o Expresivas. Naturales es una recomendación, nunca un ajuste automático. «Mmm» indica atención, no una reserva confirmada.
- Pausas: Naturales o más paciencia mientras el cliente piensa. Son instrucciones sin frecuencias ni duraciones garantizadas. Interrumpir la voz no cancela automáticamente una acción ya iniciada.
En Avanzado puedes elegir tono, formalidad, longitud de respuesta, ritmo expresivo y una nota de hasta 500 caracteres. Equilibrado, Acogedor, Profesional y Directo son perfiles editables. Usar las instrucciones actuales conserva el comportamiento existente; restablecer las preferencias lo recupera. El ritmo es una guía expresiva, no una velocidad numérica.
Elegir, configurar y probar
Elige una voz
Abre tu agente → Voz, selecciona GPT Live 1 y escucha las muestras disponibles. Las variantes Live son distintas de las voces Realtime del mismo nombre; el idioma y la descripción no garantizan un acento.
Adapta el estilo
En Avanzado configura estilo, señales de escucha y pausas. Los cambios se guardan tras una breve pausa: espera la confirmación. Si falla el guardado, el borrador sigue disponible para reintentarlo.
Prueba tu agente
Después de guardar, usa Probar tu agente en la cabecera. Explica una petición con pausas, interrumpe para corregir un detalle y comprueba una respuesta mientras trabaja una herramienta.
Conserva tus preferencias
Al cambiar de proveedor se conserva el estilo común. Los ajustes de escucha y pausas Live siguen guardados, pero inactivos en otros modelos. Las reglas operativas permanecen en Instrucciones.
Demo y acciones reales
Respuestas al ritmo de tu negocio
El nivel de razonamiento, o effort, regula cuánto analiza el modelo una solicitud antes de responder o elegir una herramienta. En GPT Live, la voz mantiene la conversación mientras un modelo backend recibe las comprobaciones y operaciones delegadas. Su nombre aparece en los ajustes avanzados: el effort no cambia el modelo.
Rápido: un cliente pregunta el horario o una disponibilidad sencilla. Equilibrado: una reserva debe respetar hora, número de personas y preferencias. Profundo: hay que comparar alternativas, combinar condiciones y coordinar comprobaciones. Empieza con Equilibrado y prueba solicitudes representativas.
En Modelo y voz, abre Ajustes avanzados → Gestión de solicitudes. Elige un perfil; los cambios se guardan automáticamente tras una breve pausa. Después prueba el agente. Los nuevos agentes GPT Live empiezan en Equilibrado; los existentes conservan Rápido hasta que lo cambies. Restaurar una versión anterior mantiene Rápido. Restablecer el valor de la plataforma selecciona Equilibrado.
Grok ofrece Rápido y Profundo; la plataforma usa Rápido por defecto. Aquí no hay un nivel medio equivalente. Gemini Live, GPT Realtime, ElevenLabs y Nova no tienen un control effort en esta página. Las preferencias se conservan al cambiar de modelo, pero solo actúan en el modelo compatible.
Más razonamiento puede aumentar la espera y los tokens utilizados, sin garantizar exactitud ni tiempos precisos. No modifica el timbre, la velocidad de la voz, el tono, las pausas ni las señales de escucha; tampoco resuelve datos ausentes, herramientas lentas o instrucciones contradictorias. Los permisos y confirmaciones se mantienen en todos los niveles. Una prueba simulada no demuestra la calidad de audio de una llamada real.
Más información
Actualizado:
¿Te ha resultado útil esta página?