Productos FTTH

Tienda FFTH desde 2004

Entradas Mensuales

Síguenos en:

Canal Oficial Telegram de elhacker.NET Grupo Facebook elhacker.NET Twitter elhacker.NET Canal Youtube elhacker.NET Comunidad Steam: Grupo elhacker.NET Mastodon

Entradas populares

PostHeaderIcon IA china gratuita supera a Claude programando sola


Alibaba ha lanzado Qwen 3.8-Max, una IA de 2,4 billones de parámetros diseñada para rivalizar con GPT-5.6 y Claude Fable 5, destacando por ser de código abierto.





Alibaba presenta Qwen 3.8-Max: la nueva potencia de la IA china

  • La empresa Alibaba ha sorprendido al sector tecnológico con el lanzamiento de Qwen 3.8-Max, un modelo de inteligencia artificial extremadamente avanzado que cuenta con 2,4 billones de parámetros.
  • Este nuevo desarrollo tiene como objetivo superar la capacidad de modelos referentes como Claude Fable 5 y GPT-5.6. Una de las características más disruptivas de esta herramienta es su capacidad para programar de forma autónoma durante 16 días y el compromiso de la compañía de abrir el código de su modelo, ofreciendo así una alternativa gratuita y competitiva frente a las opciones de OpenAI y Anthropic.



Alibaba ha lanzado uno de los modelos de inteligencia artificial más ambiciosos del 2026. La compañía china presentó Qwen 3.8-Max, una IA de 2,4 billones de parámetros que prometer rivalizar con Claude Fable 5 y GPT-5.6. A diferencia de lo que ofrecen Anthropic y OpenAI, el gigante asiático prometió abrir el código de su modelo más potente a partir de la próxima semana.



De acuerdo con una publicación en su blog, Qwen 3.8-Max está construido sobre la arquitectura de Qwen 3.5 y utiliza la técnica Mixture-of-Experts (o MoE). Esta arquitectura divide el modelo en varios "expertos", cada uno especializado en una parte del problema. Alibaba menciona que su IA solo activa 95.000 millones de parámetros por cada solicitud, lo que le ayuda a reducir los tiempos de respuesta sin sacrificar la potencia.

En términos de rendimiento, Qwen 3.8-Max admite un contexto de hasta un millón de tokens, pudiendo procesar texto, imágenes y vídeo dentro de una misma conversación. Hasta ahora todo suena como a algo que veríamos en las versiones más potentes de Claude y ChatGPT, pero esta IA china va más lejos. Sus creadores afirman que Qwen puede desarrollar software de forma autónoma durante más de diez días seguidos sin perder el hilo.

Qwen 3.8-Max programando

Uno de los ejemplos más sorprendentes tiene que ver con el desarrollo del proyecto Oh My CLI, un pequeño agente de código para la terminal, con herramientas para gestionar archivos y comandos de consola. Según los ingenieros, Qwen 3.8-Max trabajó en este proyecto durante 16 días en los que acumuló 265 commits, 127 pull requests y 151 issues resueltos, todo sin intervención humana.

En otro experimento, Alibaba le pidió al modelo que reprodujera un estudio académico sobre selección de datos para entrenamiento de IA y que después intentara mejorarlo. Qwen 3.8-Max trabajó en solitario durante casi cinco días, escribiendo unas 7.600 líneas de código y ejecutando 33 rondas de entrenamiento en GPU. Al final, la IA superó los resultados originales con una mejora de 2,7 puntos en el examen de matemáticas AIME24.

Qwen 3.8-Max reproduciendo estudio académico

Qwen 3.8 Max frente a Claude Fable 5, GPT-5.6 Sol y Gemini 3.1 Pro

Como ocurre en estos anuncios, Alibaba publicó una tabla de comparativas donde Qwen 3.8-Max supera a Claude Fable 5 y a GPT-5.6 Sol en siete pruebas de programación y capacidades generales. La IA china también lidera en 36 pruebas de visión y multimodalidad frente a los modelos más poderosos de Anthropic y OpenAI.

En benchmarks de programación real, Qwen 3.8-Max se mueve con soltura en tareas que simulan el trabajo diario de un desarrollador, como ejecutar comandos, depurar errores o completar proyectos paso a paso. El modelo de Alibaba obtuvo 86,6 puntos en Terminal Bench 2.1, por encima de los 84,6 que lograron tanto Opus 4.8 como Fable 5. Qwen 3.8-Max también destacó en una prueba que mide qué tan bien un modelo puede replicar experimentos científicos completos a partir de un artículo académico.

Benchmarks Qwen 3.8-Max

Claude Fable 5 mantiene ventaja en pruebas que evalúan la capacidad de resolver problemas reales de código reportados por desarrolladores. Ahí, la IA de Anthropic alcanza 80 puntos frente a los 67,7 de Qwen 3.8-Max, y en FrontierSWE, con 88.8 puntos contra 73.5. En cambio, el modelo de Alibaba se impone en una prueba centrada en preguntas médicas complejas y en otra que evalúa el conocimiento legal aplicado.

Gemini 3.1 Pro mantiene ventaja sobre el resto de modelos en pruebas de comprensión de vídeo que exigen entender el contenido de grabaciones largas y responder preguntas sobre lo que ocurre en ellas. El único momento en el que no puede hacerle frente a la IA de Alibaba es en vídeos de mayor duración, con múltiples escenas y eventos.

Qwen 3.8 Max ya está disponible a través de QwenCloud. Alibaba adelantó que los pesos del modelo serán de código abierto y se liberarán la próxima semana a través de Hugging Face y ModelScope. Esta decisión pone en jaque a OpenAI y Anthropic, quienes están teniendo problemas para competir con la oleada de modelos chinos que llegaron al mercado este año.


Fuentes:
https://hipertextual.com/inteligencia-artificial/qwen-3-8-max-alibaba-nueva-ia-caracteristicas/

0 comentarios :

Publicar un comentario

Los comentarios pueden ser revisados en cualquier momento por los moderadores.

Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.

Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.