GPT-Live: el modo voz de ChatGPT que habla como humano

En pocas palabras: OpenAI lanzó en julio de 2026 GPT-Live, un modo de voz full-duplex que escucha y habla al mismo tiempo sin esperar turnos. Reemplaza al Advanced Voice Mode y ya está disponible globalmente en iOS, Android y web para todos los usuarios, gratuitos y de pago.

OpenAI activó en julio de 2026 GPT-Live, un nuevo modo de voz para ChatGPT que por primera vez escucha y habla al mismo tiempo usando arquitectura full-duplex. Los suscriptores de pago (Go, Plus y Pro) acceden a GPT-Live-1, mientras que los usuarios gratuitos reciben GPT-Live-1 mini como opción predeterminada. El lanzamiento es global, ya está disponible en iOS, Android y web.

GPT-Live es el nuevo modo de voz de ChatGPT que reemplaza al anterior Advanced Voice Mode con una arquitectura full-duplex: el modelo procesa el audio entrante de forma continua mientras genera su propia respuesta hablada, en lugar de esperar un silencio limpio como hacía el sistema anterior basado en turnos. Para tareas que requieren búsqueda web o razonamiento más pesado, delega en GPT-5.5 en segundo plano sin cortar la conversación.

En 30 segundos

  • GPT-Live se lanzó en julio de 2026 y reemplaza al Advanced Voice Mode como el nuevo motor de voz de ChatGPT en todas las plataformas.
  • Usa arquitectura full-duplex: escucha y habla al mismo tiempo, evalúa señales de interacción varias veces por segundo y decide si hablar, pausar, escuchar o invocar una herramienta.
  • Dos versiones: GPT-Live-1 para planes de pago (Go, Plus, Pro) y GPT-Live-1 mini para usuarios gratuitos. GPT-Live puede delegar tareas complejas a GPT-5.5.
  • Está disponible en iOS, Android y web con despliegue global.
  • Puede hacer traducción simultánea, mantener el hilo mientras delegás tareas complejas y responder con interjecciones naturales como “mhmm” o quedar en silencio cuando necesita que pienses.

GPT es un modelo de lenguaje grande desarrollado por OpenAI, diseñado para generar texto coherente y responder preguntas basándose en patrones lingüísticos. Se utiliza en aplicaciones como asistentes virtuales y herramientas de automatización de contenido.

¿Cómo funciona el modo full-duplex de GPT-Live?

El cambio técnico más grande acá es que OpenAI tiró a la basura el modelo walkie-talkie.

El Advanced Voice Mode anterior funcionaba así: vos hablabas, el sistema esperaba un silencio limpio, procesaba todo el audio, generaba una respuesta y recién ahí la soltaba. Era funcional, pero totalmente antinatural para cualquiera que haya tenido una conversación en su vida (sí, en serio). GPT-Live invierte la lógica: procesa el audio entrante de forma continua mientras genera su propia respuesta hablada, todo al mismo tiempo. Esto es lo que OpenAI llama arquitectura full-duplex, y según el anuncio oficial, el modelo evalúa señales de interacción varias veces por segundo para decidir en tiempo real si le toca hablar, pausar, escuchar o invocar una herramienta.

¿El resultado? Podés interrumpir a la IA a mitad de frase sin que se descoloque, hace pausas cuando vos dudás en vez de meter bocadillo, y hasta tira interjecciones como “mhmm” o “yeah” para mostrarte que está siguiendo el hilo. No es un truco de UX barato: la arquitectura lo soporta de verdad. Si alguna vez usaste el modo voz viejo y terminaste gritándole “¡PARÁ, QUE NO TERMINÉ!” a tu teléfono, sabés exactamente por qué esto importa.

¿Qué versiones de GPT-Live existen y cuáles son sus diferencias?

OpenAI largó dos sabores de GPT-Live, y la diferencia no es cosmética: impacta directamente en la inteligencia del modelo que tenés atrás. Lo explicamos a fondo en nuestra guía completa de ChatGPT.

Los usuarios de planes de pago (Go, Plus y Pro) acceden a GPT-Live-1, la versión completa que puede delegar tareas complejas a GPT-5.5 en segundo plano. Los usuarios gratuitos reciben GPT-Live-1 mini como opción predeterminada, que también utiliza arquitectura full-duplex.

Acá va la comparación en limpio:

CaracterísticaGPT-Live-1GPT-Live-1 mini
DisponibilidadPlanes Go, Plus, ProUsuarios gratuitos
ArquitecturaFull-duplexFull-duplex
Traducción simultánea
Interjecciones naturales
PrecioPlanes de pagoGratis
GPT-Live modo voz diagrama explicativo

Ojo con un detalle: OpenAI dijo que va a ir actualizando el modelo de fondo de GPT-Live conforme saquen nuevos frontier models.

¿En qué dispositivos y plataformas está disponible GPT-Live?

GPT-Live está disponible en las aplicaciones móviles de ChatGPT para iOS y Android, y también en la versión web. El despliegue comenzó en julio de 2026 a nivel global, según informó Infobae. No hace falta instalar nada raro: el nuevo modo de voz reemplaza directamente al anterior Advanced Voice Mode como configuración estándar para todos los usuarios.

Los usuarios gratuitos reciben GPT-Live-1 mini como opción predeterminada. Si tenés un plan pago, accedés a GPT-Live-1. La experiencia es la misma en las tres plataformas, aunque obviamente en móvil es donde más sentido tiene un modo de voz que no te hace pasar vergüenza en público.

¿Cómo GPT-Live maneja tareas complejas como búsqueda web o razonamiento?

Este es el verdadero golazo del sistema y lo que lo separa de cualquier asistente de voz que hayas usado antes.

Cuando le pedís algo que requiere búsqueda web, razonamiento más elaborado o procesamiento pesado, GPT-Live-1 delega la tarea a GPT-5.5 en segundo plano mientras mantiene la conversación activa con vos. No se cuelga, no se queda mudo mirando el techo ni te dice “esperame un segundo” como un call center berreta. Sigue hablando con vos, mantiene el flujo, y cuando GPT-5.5 termina, trae el resultado a la conversación sin que se note la costura. Ya lo cubrimos antes en la guía exhaustiva de GPT.

Subís una consulta compleja, el modelo de fondo la mastica en paralelo, y vos mientras tanto podés estar afinando el prompt, agregando contexto o simplemente charlando — y cuando la respuesta está lista, se integra naturalmente. Es la diferencia entre un asistente que te hace esperar y uno que labura en segundo plano sin romperte el ritmo. Para cualquiera que use ChatGPT para trabajo en serio (consultas técnicas, análisis de datos, investigación), esto cambia la experiencia por completo.

¿Qué ventajas tiene GPT-Live frente al Advanced Voice Mode anterior?

La diferencia es tan grande que OpenAI directamente jubiló el modo anterior. No es una mejora incremental, es un cambio de arquitectura.

El Advanced Voice Mode viejo era básicamente un sistema de tres componentes separados: un reconocedor de voz, un modelo de lenguaje y un generador de voz, todos encadenados secuencialmente. Como un walkie-talkie. Hablabas, se procesaba, respondía. Fin del ciclo. GPT-Live unifica todo en una arquitectura full-duplex que además tiene capacidad de delegación a modelos más potentes.

Las ventajas concretas:

  • Interrupción natural: podés cortar a la IA a mitad de frase y te sigue el ritmo sin reiniciar nada. El sistema anterior necesitaba un silencio limpio para entender que terminaste.
  • Traducción simultánea: según el reporte de Infobae, esta función forma parte de las capacidades del modelo.
  • Silencios inteligentes: cuando vos te quedás pensando, GPT-Live espera. No te apura, no completa tus frases como un ansioso. Sabe cuándo callarse.
  • Delegación invisible: tareas complejas van a GPT-5.5 sin que la conversación se congele.
  • Interjecciones humanas: esos “mhmm”, “yeah” y pausas de retroalimentación que hacen que hable con vos como una persona, no como un robot leyendo un script.

¿Qué usos prácticos tiene GPT-Live en la vida cotidiana?

Ponele que estás cocinando y necesitás seguir una receta sin tocar la pantalla cada dos minutos con las manos llenas de harina. Le preguntás a GPT-Live cuánto tiempo va el horno, te responde, vos le decís “no, más despacio, que no te escuché el dato de la temperatura” y la IA reformula sin chistar. Eso antes era ciencia ficción.

Algunos escenarios donde GPT-Live cambia la experiencia:

  • Traducción en tiempo real: ideal para reuniones con equipos internacionales o para viajes. Le hablás en español, te ayuda a formular la respuesta en inglés mientras mantenés la conversación.
  • Aprendizaje de idiomas: practicás pronunciación, te corrige en el momento y podés interrumpir para pedir ejemplos sin que se pierda el contexto.
  • Asistencia en reuniones: delegás búsquedas de datos mientras seguís conversando sobre otro tema. GPT-5.5 busca la info en segundo plano y la trae cuando está lista.
  • Consultas rápidas mientras manejás o cocinás: sin tocar el teléfono, con una conversación que fluye como si hablaras con un copiloto humano.
  • Brainstorming hablado: pensás en voz alta, la IA te sigue sin apurarte, y cuando encontrás el hilo, te devuelve ideas organizadas.

¿Qué planes tiene OpenAI para el futuro de GPT-Live?

OpenAI confirmó en el anuncio oficial que GPT-Live va a actualizar el modelo de fondo cada vez que lancen un nuevo frontier model. GPT-5.5 es lo que corre hoy (julio 2026), pero cuando salga lo próximo, se actualiza solo — no vas a tener que hacer nada. También que van a llevar GPT-Live a la API, y ya abrieron una lista de espera para desarrolladores y empresas que quieran integrarlo. Además, la hoja de ruta apunta a usar esta tecnología de voz para tareas “más complejas, de larga duración y más agénticas”, lo que sugiere que eventualmente GPT-Live podría convertirse en un agente de voz capaz de ejecutar flujos de trabajo enteros sin supervisión constante.

Lo que no dijeron (y habría que preguntar): cuándo exactamente llega a la API, cuánto va a costar para empresas, y si los tiempos de latencia van a ser competitivos para casos de uso como atención al cliente en producción. Por ahora es un anuncio sólido, pero la parte de API sigue en modo “próximamente”. Tema relacionado: los cambios en GPT-5.6 para Plus.

Errores comunes al usar GPT-Live

Creer que GPT-Live-1 mini es “lo mismo pero más chico”

No. La diferencia clave es la capacidad de delegar tareas a GPT-5.5. Si estás gratis con GPT-Live-1 mini, no esperes que te haga razonamiento complejo en segundo plano mientras charlás. Para conversaciones casuales va bien, pero cuando necesitás búsqueda web o análisis profundo, la diferencia con GPT-Live-1 se nota fuerte.

Pensar que reemplaza a un humano en atención al cliente

GPT-Live es impresionante, pero no es magia. Sigue siendo un modelo de lenguaje con limitaciones de contexto, latencia variable según la carga de los servidores de OpenAI y cero conocimiento de tu negocio salvo que le des instrucciones específicas. Para atención al cliente en producción, vas a necesitar la API cuando salga, y aun así va a requerir ajustes finos, integración con tu base de conocimiento y manejo de casos borde.

No configurar el idioma y esperar que ande perfecto en español

GPT-Live funciona en español, y de hecho la arquitectura full-duplex aplica a todos los idiomas. Pero la calidad de las interjecciones naturales (“mhmm”, “yeah”) está optimizada principalmente para inglés. En español zafa, aunque en pruebas informales la fluidez de las pausas y la entonación puede sentirse un poco más acartonada que en inglés. Es cuestión de semanas hasta que ajusten, no de meses.

Preguntas Frecuentes

¿Qué es GPT-Live?

GPT-Live es el nuevo modo de voz de ChatGPT lanzado por OpenAI en julio de 2026. Funciona con arquitectura full-duplex, lo que significa que escucha y habla al mismo tiempo en lugar de esperar turnos. Reemplaza al anterior Advanced Voice Mode y está disponible en dos versiones: GPT-Live-1 (planes de pago) y GPT-Live-1 mini (usuarios gratuitos).

¿GPT-Live es gratis o solo de pago?

Hay una versión gratuita: GPT-Live-1 mini, que usan todos los usuarios sin suscripción. La versión completa, GPT-Live-1, está reservada para los planes Go, Plus y Pro. La diferencia principal es que GPT-Live-1 puede delegar tareas complejas a GPT-5.5 en segundo plano sin cortar la conversación. En el tutorial de recepcionista virtual IA profundizamos sobre esto.

¿GPT-Live funciona en español?

Sí, GPT-Live funciona en español y en todos los idiomas que soporta ChatGPT. La arquitectura full-duplex es independiente del idioma. Sin embargo, las interjecciones naturales como “mhmm” y ciertos matices de entonación están más pulidos en inglés por ahora, aunque la fluidez general en español es sólida.

¿Puedo interrumpir a GPT-Live mientras habla?

Sí, y es una de las funciones centrales de la arquitectura full-duplex. A diferencia del Advanced Voice Mode anterior, donde tenías que esperar a que terminara, ahora podés cortar a GPT-Live a mitad de frase de forma natural y el sistema recalcula al instante sin perder el contexto de la conversación.

¿GPT-Live funciona sin internet?

No. GPT-Live necesita conexión a internet para funcionar, ya que el procesamiento de audio y la generación de respuestas ocurren en los servidores de OpenAI. No hay modo offline disponible, y todo indica que no está en los planes a corto plazo dado que depende de GPT-5.5 para tareas complejas.

Conclusión

GPT-Live no es un parche cosmético ni una mejora incremental del modo voz de ChatGPT. Es un cambio de arquitectura real: full-duplex con capacidad de delegación a GPT-5.5, que por primera vez hace que hablar con una IA no se sienta como un protocolo de turnos.

OpenAI acertó en varios frentes: la versión gratuita existe (aunque limitada), el despliegue fue global e inmediato, y la hoja de ruta con la API y actualizaciones continuas de modelos sugiere que esto va en serio. Lo que falta ver es cómo responde en condiciones de producción real con latencia variable, qué costo va a tener la API para empresas, y cuánto tardan en pulir los idiomas que no son inglés al mismo nivel de naturalidad. Por ahora, si tenés un plan pago, activá GPT-Live y probalo — no te va a dejar indiferente. Y si estás gratis, GPT-Live-1 mini al menos te deja espiar de qué va la cosa sin poner un peso.

Fuentes

Desplazarse hacia arriba