La carrera por hacerse con el modelo de IA más avanzado y eficiente está en pleno desarrollo. No pasaron ni 7 días de la irrupción de DeepSeek, que Alibaba ya ha lanzado su modelo inteligencia artificial más reciente, Qwen2.5-Max, diseñado para superar a sus mayores competidores: GPT-4o de OpenAI, Llama-3.1-405B de Meta y, principalmente, a DeepSeek-V3, que hasta el momento era el mejor de todos.
La nueva herramienta ya está disponible en Qwen Chat, el chatbot de la compañía, pero también puedes acceder a ella a través de Hugging Face, el repositorio en GitHub y ModelScope, la plataforma de código abierto desarrollada por Alibaba Cloud. Analizamos sus principales características Qwen2.5-Max y las diferencias con DeepSeek-V3.
Qwen2.5-Max es un modelo de lenguaje de gran escala (LLM) desarrollado por Alibaba Cloud -también conocida como Aliyun-, la división de computación en la nube del Grupo Alibaba. Este modelo se basa en una arquitectura de Mixture of Experts (MoE), una técnica de aprendizaje automático que activa únicamente las partes necesarias para una tarea específica, optimizando el uso de recursos y mejorando la eficiencia.
Entrenado con más de 20 billones de tokens de alta calidad, Qwen2.5-Max ha sido refinado mediante técnicas de ajuste supervisado y aprendizaje por refuerzo a partir de retroalimentación humana. Está diseñado para sobresalir en tareas como programación, razonamiento y conversación, soportando más de 29 idiomas y una longitud de contexto de hasta 128.000 tokens.
DeepSeek ha ganado atención recientemente por sus modelos de IA de alto rendimiento y bajo costo. Sin embargo, Qwen2.5-Max supera a DeepSeek-V3 en varias pruebas de referencia. Por ejemplo, en el benchmark de Arena-Hard, que se aproxima a las preferencias humanas, el modelo de Alibaba supera en casi 4 puntos a DeepSeek.
En MMLU-Pro, que evalúa el conocimiento a través de problemas de nivel universitario, Qwen2.5-Max también obtuvo una puntuación superior. Incluso en evaluaciones como LiveCodeBench y LiveBench, que miden capacidades de codificación y rendimiento general, respectivamente, Qwen2.5-Max tuvo un desempeño superior, no solo a DeepSeek, sino a toda la competencia.
Aunque ambos modelos utilizan la arquitectura MoE, Qwen2.5-Max ha refinado su implementación para lograr una mayor eficiencia y eficacia en diversas tareas.
Comparativa entre Qwen2.5-Max y la competencia. Fuente: Github
Incluso comparando a Qwen2.5-Max con modelos anteriores de Alibaba, se puede ver una superioridad en varios parámetros analizados, especialmente en tareas como la comprensión del lenguaje, matemáticas y programación.
Analizamos el cuadro comparativo en detalle:
En comparación con versiones anteriores, Qwen2.5-Max representa un avance notable en términos de capacidad y rendimiento. Mientras que los modelos previos de la serie Qwen ya ofrecían capacidades multilingües y especialización en áreas como codificación y matemáticas, Qwen2.5-Max amplía estas capacidades y mejora su eficiencia gracias a la arquitectura MoE. Además, su entrenamiento con una cantidad significativamente mayor de datos le permite manejar contextos más largos y realizar análisis más complejos.
Además de Qwen2.5-Max, Alibaba Cloud también ha presentado otro modelo, el Qwen2.5-VL, una evolución significativa de su predecesor Qwen2-VL, que está disponible en tamaños de 3, 7 y 72 mil millones de parámetros, incluyendo versiones base y ajustadas para instrucciones.
Esta nueva variante incorpora potentes capacidades de análisis de documentos, permitiendo analizar archivos de gran tamaño en múltiples idiomas y reconocer elementos como tablas, gráficos, fórmulas químicas y partituras musicales. Además, permite la generación de salidas estructuradas, transformando datos no organizados en formatos como JSON, y funciona como un agente visual autónomo, ejecutando tareas en dispositivos inteligentes.
Foto: Qwen.
No se han encontrado publicaciones relacionadas
Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *
Δ