El modelo de IA de Alibaba ya se sitúa por delante de sus rivales chinos

Comparte

Únicamente GPT-4o de OpenAI y Claude 3.5 Sonnet de Anthropic, se encuentran ya por delante de uno de los modelos de inteligencia artificial (en adelante, “IA”) de Alibaba, Gwen-72B-Instruct, después de que este haya superado a todos sus rivales en el territorio chino, y se haya posicionado tercero a nivel global.

Este modelo es la versión más avanzada de la familia de grandes modelos lIngüísticos (en adelante, por sus siglas en inglés, “LLM”), del gigante de comercio electrónico chino, y recibió este tercer puesto en una clasificación de SuperClue, que es una plataforma dedicada a llevar a cabo evaluaciones comparativas de este tipo de LLMs. Además de este gran hito, otros cinco modelos de IA de distintas empresas chinas, fueron superiores al LLM GPT-4 Turbo, uno de los mejores modelos de Microsoft-OpenAI, de acuerdo con la plataforma SuperClue.

Los modelos de IA chinos parecen estar cerrando la brecha tecnológica existente con los LLMs desarrollados en Estados Unidos, y este es únicamente el último ejemplo de esto. Hace unas semanas, este mismo modelo Gwen, de Alibaba, resultó ganador de una clasificación de modelos de código abierto, llevada a cabo esta vez por la plataforma de desarrollo de “machine-learning” Huggin Face. El propio CEO de la plataforma indicó que los modelos chinos estaban empezando a dominar el mercado.

No obstante, esta última clasificación hay que tomarla con algo de perspectiva, ya que no tiene en cuenta herramientas de código cerrado que son las que suelen liderar este tipo de rankings. Prueba de ellos es que en otra clasificación realizada por la plataforma LMSYS, respaldada por la Universidad de California, el modelo Gwen-72B ocupó el puesto 20, mientras que otros modelos de código cerrado de OpenAI o Google se repartieron los primeros puestos. Sin embargo, sobre lo que no hay duda, es que la pelea por el mejor LLM va a continuar, y las empresas chinas van a empezar a entrar en la conversación, muchos de sus modelos de código cerrado, afirman los expertos, ya han superado las capacidades de GPT-3.5-Turbo, la penúltima versión del GPT-4o.

Leer más

Posts relacionados que podrían interesarte

12, octubre 2023

El Sistema de Madrid incluirá nuevos cambios en 2023 y 2024

30, enero 2020

RTVE contrata a EFE para implantar un servicio de redacción de artículos sin periodistas a través de Inteligencia Artificial.

14, enero 2021

Nueva versión de Website Evidence Collector, la herramienta que permite recopilar pruebas del tratamiento de datos en Internet.

13, julio 2022

La autoridad inglesa de competencia en el mercado investiga la adquisición anticipada por parte de Microsoft Corporation de Activision Blizzard, Inc.

27, noviembre 2019

Multa de 500.000 euros a una empresa francesa por seguir llamando a clientes que se habían opuesto.

19, septiembre 2019

Por qué el reconocimiento facial y los datos biométricos solo deberían usarse en situaciones excepcionales, según los expertos.