OpenAI actualiza ChatGPT con funciones de voz natural
OpenAI presentó los modelos GPT-Live-1 y GPT-Live-1 mini, tecnologías conversacionales que permiten a ChatGPT escuchar y hablar en tiempo real sin interrupciones.
La compañía de inteligencia artificial OpenAI anunció el lanzamiento oficial de sus nuevos modelos conversacionales denominados GPT-Live-1 y GPT-Live-1 mini. Esta actualización tecnológica tiene como objetivo transformar radicalmente la experiencia de voz en ChatGPT, permitiendo diálogos mucho más fluidos, naturales y cercanos a la dinámica de la comunicación humana cotidiana, reemplazando el antiguo esquema de procesamiento por fases.
La principal innovación de estos sistemas radica en que son estructuras full-duplex (capaces de transmitir y recibir datos de forma simultánea). Esta característica técnica permite al chatbot hablar y escuchar al mismo tiempo, lo que significa que vas a poder interrumpir a la inteligencia artificial en medio de su alocución de manera natural. El asistente recalibrará su respuesta en tiempo real basándose en la interrupción, facilitando tareas complejas como la traducción simultánea.
La distribución de la herramienta se dividirá según el perfil de la cuenta. El modelo GPT-Live-1 mini se convirtió en la configuración estándar y gratuita para todos los usuarios de la plataforma, mientras que la versión de mayor tamaño y potencia, GPT-Live-1, quedó reservada de forma exclusiva para los suscriptores de los planes de pago, integrando soporte de razonamiento avanzado mediante el ecosistema GPT-5.5.
Evolución del ecosistema de voz y mercado tecnológico
La adopción de asistentes con capacidades expresivas avanzadas se consolidó como una prioridad competitiva para las grandes firmas del sector tecnológico. Si analizás los datos de impacto compartidos por la empresa, vas a notar las siguientes métricas y tendencias comerciales actuales:
- Más de 150 millones de personas ya utilizan de forma activa las funciones de voz y dictado en la aplicación.
- Capacidad de mantener el contexto en silencio durante periodos extensos y responder solo bajo petición directa.
- Integración de respuestas visuales e interactivas combinadas con el soporte de audio de manos libres.
- Optimización general del sistema para la mayoría de los idiomas globales, corrigiendo desfases de entonación.
La firma liderada por Sam Altman aclaró que no busca posicionar esta tecnología como un compañero digital afectivo, sino como una herramienta de productividad segura y eficiente dotada de salvaguardas especiales para proteger a usuarios adolescentes frente a temas sensibles. Con este paso, la industria de la inteligencia artificial avanza hacia un escenario donde la voz se proyecta como la interfaz primaria para operar sistemas informáticos complejos.
