El modelo de IA de Alibaba ya se sitúa por delante de sus rivales chinos

Publicaciones

julio 18, 2024

Comparte

Únicamente GPT-4o de OpenAI y Claude 3.5 Sonnet de Anthropic, se encuentran ya por delante de uno de los modelos de inteligencia artificial (en adelante, “IA”) de Alibaba, Gwen-72B-Instruct, después de que este haya superado a todos sus rivales en el territorio chino, y se haya posicionado tercero a nivel global.

Este modelo es la versión más avanzada de la familia de grandes modelos lIngüísticos (en adelante, por sus siglas en inglés, “LLM”), del gigante de comercio electrónico chino, y recibió este tercer puesto en una clasificación de SuperClue, que es una plataforma dedicada a llevar a cabo evaluaciones comparativas de este tipo de LLMs. Además de este gran hito, otros cinco modelos de IA de distintas empresas chinas, fueron superiores al LLM GPT-4 Turbo, uno de los mejores modelos de Microsoft-OpenAI, de acuerdo con la plataforma SuperClue.

Los modelos de IA chinos parecen estar cerrando la brecha tecnológica existente con los LLMs desarrollados en Estados Unidos, y este es únicamente el último ejemplo de esto. Hace unas semanas, este mismo modelo Gwen, de Alibaba, resultó ganador de una clasificación de modelos de código abierto, llevada a cabo esta vez por la plataforma de desarrollo de “machine-learning” Huggin Face. El propio CEO de la plataforma indicó que los modelos chinos estaban empezando a dominar el mercado.

No obstante, esta última clasificación hay que tomarla con algo de perspectiva, ya que no tiene en cuenta herramientas de código cerrado que son las que suelen liderar este tipo de rankings. Prueba de ellos es que en otra clasificación realizada por la plataforma LMSYS, respaldada por la Universidad de California, el modelo Gwen-72B ocupó el puesto 20, mientras que otros modelos de código cerrado de OpenAI o Google se repartieron los primeros puestos. Sin embargo, sobre lo que no hay duda, es que la pelea por el mejor LLM va a continuar, y las empresas chinas van a empezar a entrar en la conversación, muchos de sus modelos de código cerrado, afirman los expertos, ya han superado las capacidades de GPT-3.5-Turbo, la penúltima versión del GPT-4o.

Leer más

Posts relacionados que podrían interesarte

7, octubre 2021

Añadir participantes en un grupo de WhatsApp sin su consentimiento puede conllevar sanción de la AEPD

Leer más

8, abril 2021

La OEPM publica un manual informativo sobre la prueba de uso de signos distintivos

Leer más

10, octubre 2019

Legal Management Forum 2019: «el futuro de la abogacía».

Leer más

16, enero 2025

Apple se enfrenta a una acción judicial colectiva en Reino Unido por prácticas anticompetitivas en su App Store

Leer más

19, mayo 2021

La Autoridad Islandesa de Protección de Datos sanciona a una empresa tras una brecha de seguridad que afectó a 424 menores de edad

Leer más

2, noviembre 2022

La INTERPOL anuncia su propio metaverso