Miami

miércoles 15 de marzo | 2023

¡AI News!: ya llega GPT-4 multimodal (Microsoft confirmó que el nuevo modelo de lenguaje se conocerá la próxima semana)

(Por Dino Dal Molin, Ceo de Bizit Global, en cocreación con Marcelo Maurizio) La próxima semana conoceremos GPT-4, la próxima generación del popular modelo de lenguaje de inteligencia artificial. Desde Microsoft adelantan que será multimodal.

Sabíamos que GPT-4 sería presentado, con mucha probabilidad, durante el primer semestre de 2023. Afortunadamente, OpenAI no decepcionará en este sentido. Microsoft, uno de los principales inversores de la startup especializada en inteligencia artificial, ha confirmado que el mundo conocerá el nuevo modelo de lenguaje la próxima semana.

De momento, eso sí, no revelaron el día específico.

Si bien gran parte de las novedades técnicas se las guardarán hasta el anuncio oficial, los de Redmond ya han adelantado un detalle clave: GPT-4 será multimodal.

OpenAI, la empresa detrás de Chat GPT y de potenciar el nuevo BING de Microsoft, ha dado a conocer finalmente la nueva versión de su modelo de lenguaje que utiliza Inteligencia Artificial, se trata de una nueva generación del modelo presente en el buscador de Microsoft, que acepta entradas tanto de texto, al igual que con la versión GPT-3, pero que ahora también soporta imágenes aunque las respuestas se mantienen únicamente de forma escrita.

Con GPT-4, por lo tanto, sería posible generar texto, imágenes, vídeos e incluso música. Andreas Braun, director de tecnología de Microsoft Alemania, se pronunció al respecto:

A pesar de que OpenAI clasifica a GPT-4 como "menos capaz que los humanos en muchos escenarios del mundo real, cuenta con un rendimiento a nivel humano en varios entornos académicos y profesionales".

La compañía detalla que esta nueva versión de la IA es más confiable, creativa, y puede manejar instrucciones mucho más matizadas que su modelo más reciente, el GPT-3.5. Además, GPT-4 supera "considerablemente" a los modelos de lenguaje existentes y a la mayoría de los modelos de última generación.

¿Que quiere decir que un modelo de lenguaje sea multimodal?

Básicamente, que puede interpretar tanto texto como imágenes. La versión anterior, que da vida a ChatGPT, solo es capaz de producir textos.

Braun describió GPT-4 como un game changer para el sector de la inteligencia artificial, ya que el modelo de lenguaje dará otro paso para acercarse a la capacidad de interpretación humana. Evidentemente, para igualarla todavía le queda un largo trayecto.

Otro de los beneficios de GPT-4 como lenguaje multimodal es que podrá gestionar la entrada y salida de datos en diferentes idiomas. Trasladando esta posibilidad a ChatGPT, podrías realizar la petición en español, pero que el texto generado se encuentre en inglés. Evidentemente, esta novedad también sería de gran ayuda para las herramientas de traducción

Desde Microsoft reiteran que el impacto de ChatGPT en la vida diaria de tantas personas es similar al que provocó el iPhone hace más de una década. No obstante, la popularidad del chatbot no frenó sus aspiraciones de seguir mejorando el modelo de lenguaje que lo hace posible. Por ello la gran atención que le están dedicando a la presentación de GPT-4.

Asimismo, la compañía dirigida por Saya Nadella ha dejado claro que GPT-4 no llega para robarse los empleos de las personas. Por ejemplo, aquellos que trabajan en medios de comunicación escrito. El objetivo principal es simplificar o potenciar su trabajo, no quitárselos.

Uno de los aspectos más interesantes de GPT-4 es su capacidad para comprender tanto imágenes como texto. GPT-4 puede subtitular -e incluso interpretar- imágenes relativamente complejas.

Lamentablemente, la capacidad de comprensión de imágenes aún no está disponible para todos los usuarios. Por ahora está en la etapa final de prueba y será accesible a través de una lista de espera solamente para quienes estén suscriptos a ChatGPT Plus.

Por ahora estará disponible solo para quienes paguen la suscripción al servicio premium de la herramienta. Se accede a través de una lista de espera.

Tu opinión enriquece este artículo:

Ingresar con Google

¡AI News!: ya llega GPT-4 multimodal (Microsoft confirmó que el nuevo modelo de lenguaje se conocerá la próxima semana)

Tu opinión enriquece este artículo:

Inmigrantes

Germán Berterame, el argentino-mexicano de US$ 15 Millones que se convirtió en la joya del Inter Miami

Miami

MotoGP aterriza en la capital del sol con la presentación oficial de la temporada 2027 (Miami acelera al futuro)

Nota Principal

¡Histórico! Colapinto se mete en el podio del marketing global: sexto en Canadá, y mejor argentino desde Reutemann en 1982

Shopping IN Miami

Kith x adidas x Messi: la colaboración que redefine el cruce entre fútbol, lujo urbano y branding cultural global

Miami

Inter Miami 6-4 Philadelphia: épica de Suárez, Berterame y De Paul (cuando Miami es Uruguay, México y Argentina)

Miami

Nude Miami, el supermercado orgánico de lujo que convirtió Brickell en la nueva meca del retail experiencial

Nota Principal

"El diablo de la F1 usa Gucci" (Colapinto, Gasly y todo Alpine, también)

The Best Places to Enjoy

Jacinta de México le pone picante al Aventura Mall para ser uno de los epicentros latinos mas divertidos en el Mundial

The capital of the capital

Saturación de contenido, fatiga digital y el colapso del scroll infinito (los datos que muestran que hay un stop)

Retail

Lacoste Roland-Garros 2026: el cocodrilo reinventa el lujo deportivo con su Club más icónico en París

Suscribite gratis a nuestro newsletter

¡AI News!: ya llega GPT-4 multimodal (Microsoft confirmó que el nuevo modelo de lenguaje se conocerá la próxima semana)

Compartir con tus amigos de

Tu opinión enriquece este artículo:

Te puede interesar:

Suscribite gratis a nuestro newsletter