
Alibaba lanza una IA que programa sola 16 días sin parar
Alibaba acaba de presentar Qwen 3.8-Max, un modelo de inteligencia artificial capaz de programar de forma completamente autónoma durante más de dos semanas sin intervención humana. El gigante chino ha conseguido con esta IA lo que parecía ciencia ficción hace apenas unos meses: una máquina que no solo escribe código, sino que lo mejora, lo depura y lo itera por sí sola, acumulando cientos de cambios en repositorios reales.
Un experimento que duró 16 días sin parar
Según informa hipertextual.com, Alibaba demostró las capacidades de su modelo dejándolo trabajar en un proyecto real llamado Oh My CLI, una herramienta para la terminal. El resultado fue espectacular: Qwen 3.8-Max acumuló 265 commits, 127 pull requests y 151 issues resueltos durante esos 16 días sin que un solo ingeniero tocara el teclado.
En otro experimento igualmente ambicioso, el modelo trabajó durante casi cinco días reproduciendo un estudio académico sobre selección de datos para entrenamiento de IA. La máquina escribió 7.600 líneas de código y ejecutó 33 rondas de entrenamiento en GPU, consiguiendo incluso mejorar los resultados originales con una ganancia de 2,7 puntos en el examen de matemáticas AIME24.
Técnica sofisticada: menos parámetros en uso, más velocidad
El secreto detrás de esta capacidad reside en su arquitectura. Qwen 3.8-Max cuenta con 2,4 billones de parámetros totales, pero utiliza una técnica llamada Mixture-of-Experts (MoE) que divide el modelo en especialistas. Lo inteligente es que solo activa 95.000 millones de parámetros por cada solicitud, lo que reduce tiempos de respuesta sin perder potencia computacional.
El modelo también admite un contexto de hasta un millón de tokens, lo que significa que puede procesar conversaciones enormes sin olvidar el hilo. Y no solo entiende texto: maneja imágenes y vídeo en la misma conversación, convirtiéndolo en una herramienta verdaderamente multimodal.
Supera a Claude y GPT-5.6 en programación
En las pruebas de rendimiento publicadas por Alibaba, Qwen 3.8-Max obtiene resultados llamativos. Supera a Claude Fable 5 y a GPT-5.6 Sol en siete pruebas de programación y lideran en 36 pruebas de visión y capacidades multimodales. En benchmarks de programación real, donde se simulan tareas cotidianas de desarrolladores, la IA china alcanza 86,6 puntos en Terminal Bench 2.1, por encima de los 84,6 de Claude Fable 5.
Donde Qwen cede terreno es en pruebas que evalúan la resolución de bugs reales reportados por desarrolladores. Ahí Claude Fable 5 logra 80 puntos frente a los 67,7 de la IA china. Sin embargo, Qwen se impone en preguntas médicas complejas y en conocimiento legal aplicado, demostrando que sus fortalezas no se limitan al código.
Disponible ya, y el código abierto viene muy pronto
El modelo ya está disponible a través de QwenCloud para quien quiera probarlo. Pero lo más disruptivo es que Alibaba prometió liberar los pesos del modelo en código abierto esta próxima semana a través de Hugging Face y ModelScope. Esto contrasta radicalmente con la estrategia de OpenAI y Anthropic, que mantienen sus modelos más potentes cerrados.
Esta decisión pone nerviosos a los gigantes estadounidenses, que este año han visto cómo una oleada de modelos chinos competitivos ha llegado al mercado sin avisar. ¿Podrán mantener su liderazgo cuando una IA de código abierto y rendimiento comparable esté al alcance de cualquiera?
Fuente: hipertextual.com


