El modelo de IA de Alibaba ya se sitúa por delante de sus rivales chinos

Comparte

Únicamente GPT-4o de OpenAI y Claude 3.5 Sonnet de Anthropic, se encuentran ya por delante de uno de los modelos de inteligencia artificial (en adelante, “IA”) de Alibaba, Gwen-72B-Instruct, después de que este haya superado a todos sus rivales en el territorio chino, y se haya posicionado tercero a nivel global.

Este modelo es la versión más avanzada de la familia de grandes modelos lIngüísticos (en adelante, por sus siglas en inglés, “LLM”), del gigante de comercio electrónico chino, y recibió este tercer puesto en una clasificación de SuperClue, que es una plataforma dedicada a llevar a cabo evaluaciones comparativas de este tipo de LLMs. Además de este gran hito, otros cinco modelos de IA de distintas empresas chinas, fueron superiores al LLM GPT-4 Turbo, uno de los mejores modelos de Microsoft-OpenAI, de acuerdo con la plataforma SuperClue.

Los modelos de IA chinos parecen estar cerrando la brecha tecnológica existente con los LLMs desarrollados en Estados Unidos, y este es únicamente el último ejemplo de esto. Hace unas semanas, este mismo modelo Gwen, de Alibaba, resultó ganador de una clasificación de modelos de código abierto, llevada a cabo esta vez por la plataforma de desarrollo de “machine-learning” Huggin Face. El propio CEO de la plataforma indicó que los modelos chinos estaban empezando a dominar el mercado.

No obstante, esta última clasificación hay que tomarla con algo de perspectiva, ya que no tiene en cuenta herramientas de código cerrado que son las que suelen liderar este tipo de rankings. Prueba de ellos es que en otra clasificación realizada por la plataforma LMSYS, respaldada por la Universidad de California, el modelo Gwen-72B ocupó el puesto 20, mientras que otros modelos de código cerrado de OpenAI o Google se repartieron los primeros puestos. Sin embargo, sobre lo que no hay duda, es que la pelea por el mejor LLM va a continuar, y las empresas chinas van a empezar a entrar en la conversación, muchos de sus modelos de código cerrado, afirman los expertos, ya han superado las capacidades de GPT-3.5-Turbo, la penúltima versión del GPT-4o.

Leer más

Posts relacionados que podrían interesarte

26, marzo 2020

Paco León acusa a Vox de un delito de odio en Twitter por llamar “titiriteros” a varios artistas españoles.

19, diciembre 2024

La UE investiga a TikTok por permitir injerencias rusas en las elecciones de Rumanía

23, octubre 2019

Disney, Sony, Warner y Universal, investigadas por la CNMC por posibles prácticas restrictivas de la competencia.

8, julio 2021

Una brecha de seguridad deja al descubierto datos de miles de madrileños, incluyendo el rey

6, febrero 2020

El Corte Inglés se alía con Deliveroo para repartir su comida preparada.

10, diciembre 2020

Nueva Guía de la IAB para la realización de Evaluaciones de Impacto para publicidad digital.