ChatGPT acaba de conseguir un rival de Gemini Live que puede seguir hablando mientras piensa

Síguenos en Google DiscoverAgréganos como fuente preferida
TL;DR
  • El nuevo modelo de voz de OpenAI, GPT-Live, puede escuchar y hablar al mismo tiempo.
  • Para preguntas que requieren más reflexión o una búsqueda en la web, GPT-Live puede seguir hablando mientras procesa cosas en segundo plano.
  • GPT-Live-1 y GPT-Live-mini se están implementando ahora y estarán disponibles en las aplicaciones ChatGPT y en la web.

Interactuar con modelos de IA hablando con ellos ha sido posible durante un tiempo, pero nunca ha sido la experiencia más fluida. Sin embargo, los últimos modelos de OpenAI podrían cambiar eso para mejor.

OpenAI ha anunciado hoy su nuevo modelo de voz GPT-Live. Está construido sobre una arquitectura full-duplex, lo que significa que el modelo puede escuchar a los usuarios y hablar simultáneamente. Esto podría dar como resultado conversaciones más naturales con GPT-Live. Según se informa, el modelo podrá demostrar que está prestando atención utilizando frases como «mhmm» o «sí» mientras el usuario habla.

Para hacer todo esto, GPT-Live procesa continuamente las entradas y decide si hablar, escuchar o hacer una pausa mientras escucha al usuario. De esta manera, puede interponer respuestas naturales incluso mientras el usuario continúa hablando. Una conversación de ejemplo compartida por OpenAI mostró que GPT-Live interactuaba con un usuario de una manera considerablemente más natural que antes.

GPT-Live también adopta un nuevo enfoque para las preguntas que requieren pensar más o buscar en la web. Básicamente, el modelo entrega la tarea a un modelo como GPT-5.5 y continúa interactuando con el usuario. Es una buena manera de garantizar que la conversación no se estanque mientras ChatGPT investiga en segundo plano.

GPT-Live también escucha mejor a los usuarios en general. Si un usuario hace una pausa para pensar mientras habla, GPT-Live esperará a que termine de hablar. Los usuarios también podrán pedirle a ChatGPT que permanezca en silencio y escuche, y también es mejor concentrarse en la voz del usuario sin distraerse con el ruido ambiental.

El nuevo modelo también admite respuestas visuales. Puede mostrar tarjetas visuales ricas para preguntas sobre el clima, acciones, deportes y más.

Si ha utilizado Gemini Live en el pasado, el nuevo modelo de OpenAI podría parecer bastante similar. Sin embargo, GPT-Live parece ser más avanzado que la oferta de Google. Gemini Live puede mantener largas conversaciones, pero no responde de la misma manera que GPT-Live en sus demostraciones. GPT-Live también puede mostrar resultados visuales y delegar tareas a otros modelos OpenAI para mantener la conversación fluida y natural, algo que Gemini Live no puede hacer todavía. Eso podría cambiar en el futuro, pero por ahora, GPT-Live parece tener la ventaja.

OpenAI lanza dos modelos GPT-Live: GPT-Live-1 y GPT-Live-mini. Ambos modelos se lanzan hoy. GPT-Live-1 será la experiencia predeterminada para los usuarios de ChatGPT Pro, Plus y Go, mientras que GPT-Live-mini será el modelo predeterminado para los usuarios gratuitos. La nueva experiencia de voz estará disponible en las aplicaciones para teléfonos inteligentes de ChatGPT y en la web.

AIChatGPTOpenAI
Seguir

Gracias por ser parte de nuestra comunidad. Lea nuestra Política de comentarios antes de publicar.