ChatGPT: OpenAI lanza GPT-Live-1 para diálogos por voz más humanos
Los nuevos modelos GPT-Live-1 y GPT-Live-1 mini prometen una interacción por voz fluida y natural, acercando la IA a la conversación cotidiana.

OpenAI lanzó el 8 de julio de 2026 sus nuevos modelos conversacionales GPT-Live-1 y GPT-Live-1 mini, diseñados para ofrecer una experiencia de voz mucho más natural y fluida en ChatGPT. Estos avances buscan transformar la interacción entre usuarios y asistentes virtuales, acercando la comunicación con inteligencia artificial a una dinámica semejante a la humana.
La principal novedad de estos modelos es su capacidad full-duplex, lo que permite a ChatGPT hablar y escuchar al mismo tiempo. Esta característica es crucial porque posibilita que las personas interrumpan a la inteligencia artificial de manera natural, y que el asistente gestione la conversación en tiempo real, como ocurre en cualquier diálogo cotidiano.

Esta tecnología habilita funciones avanzadas como la traducción simultánea, haciendo que la interacción se sienta mucho más orgánica. La actualización reemplaza el modo Advanced Voice Mode anterior, con GPT-Live-1 mini establecido como la configuración estándar para todos los usuarios. Quienes utilicen las versiones de pago de ChatGPT podrán acceder al modelo de mayor tamaño, GPT-Live-1.
Atty Eleti, responsable de producto de ChatGPT Voice, afirmó durante la presentación que ha sostenido conversaciones de entre 30 y 40 minutos consecutivos con el asistente mientras caminaba.
Los modelos GPT-Live-1 y GPT-Live-1 mini resuelven problemas frecuentes de las versiones previas de ChatGPT. Antes, el sistema a menudo no podía detenerse frente a una interrupción o carecía de precisión en las respuestas. Ahora, el sistema envía consultas a los modelos de texto más recientes, como GPT-5.5, para mejorar la búsqueda, el razonamiento y la gestión de tareas complejas, todo mientras mantiene una conversación activa.

Una capacidad destacada es que el modelo puede permanecer en silencio y captar el contexto durante períodos extensos, respondiendo solo cuando el usuario lo solicita. Además, el nuevo modo de voz tiene la habilidad de presentar información en formato visual, gracias a su acceso a los modelos GPT más recientes, un enfoque que otras empresas del sector tecnológico también están explorando.
El objetivo de OpenAI es que la voz se convierta en una interfaz primaria para gestionar tareas informáticas complejas, y no solo para comandos breves o consultas simples. Según datos de OpenAI, más de 150 millones de personas ya interactúan con ChatGPT a través de funciones de voz y dictado, lo que subraya la relevancia de esta tecnología.

El desarrollo de asistentes conversacionales más expresivos y útiles no es exclusivo de OpenAI. Empresas como Apple y Amazon actualizaron recientemente sus asistentes para optimizar la gestión del contexto y mejorar la naturalidad en las respuestas. Startups como Sesame, fundada por Brendan Iribe y Ankit Kumar, exploran asistentes capaces de mantener conversaciones naturales mientras ejecutan tareas en segundo plano. Monogram, por su parte, invirtió más de 40 millones de dólares estadounidenses en rondas iniciales de financiación para apostar por respuestas visuales e interactivas.

A pesar de las mejoras, existen aspectos por perfeccionar. Durante una demostración, la función de traducción en vivo en hindi presentó un marcado acento estadounidense y una entonación poco natural, con un tono literario en el idioma que no resultó del todo fluido. La empresa explicó que el nuevo modo de voz está optimizado para la mayoría de los idiomas hablados, aunque no especificó cuáles forman parte de esa lista.

La compañía vislumbra que la voz podría convertirse en la interfaz principal para trabajar con sistemas de inteligencia artificial capaces de gestionar tareas complejas y prolongadas. Sin embargo, a pesar de algunos informes que mencionan la posibilidad de que OpenAI lance auriculares con capacidades de IA este año, hasta el momento no se ha compartido información concreta sobre productos de hardware.

Seguí leyendo online — escaneá el código
https://go.tricuatro.com/chatgpt
© tricuatro.com
Temas de la nota
Notas relacionadas

TikTok prueba herramienta de IA para proteger creadores de deepfakes
La plataforma de videos está implementando una opción para que los usuarios verifiquen su identidad y reporten usos no autorizados de su imagen generados por inteligencia artificial.

Apple demanda a OpenAI por robo de secretos comerciales de hardware
La compañía de la manzana acusa a ex empleados clave, incluyendo a Tang Tan, de sustraer información confidencial para el beneficio de OpenAI y su expansión en hardware.

Anthropic aborda las preguntas clave sobre el futuro de la IA
La empresa lanza una iniciativa para entender las preocupaciones públicas y transparentar sus esfuerzos en el desarrollo responsable de la inteligencia artificial.
Últimas noticias
Ver todas
Chip del MIT convierte luz infrarroja invisible en información crucial
Investigadores del MIT desarrollaron un innovador chip que detecta metano y propano usando luz infrarroja media, con potencial para millones de píxeles y computación óptica.

Assassin's Creed Black Flag Resynced Supera 3 Millones de Ventas y Anuncia New Game Plus
El exitoso relanzamiento del clásico pirata de Ubisoft continúa rompiendo récords, confirmando una de las funciones más solicitadas por la comunidad de jugadores.

Tesla Lanza Réplica Eléctrica del Cybertruck para Niños en EE. UU.
Tesla presenta su Cybertruck a escala para niños de 6 a 12 años, un vehículo eléctrico de USD 1.500 que por ahora solo está disponible en el mercado estadounidense.
Comentarios (0)
Aún no hay comentarios. ¡Sé el primero!
Solo los lectores registrados pueden comentar.