Juanma Aranda

MODELOS

Qwen3.8-27B de Alibaba lidera los modelos abiertos en la prueba Image‑to‑WebDev de Arena

El equipo Qwen de Alibaba situó su modelo abierto Qwen3.8‑27B en el primer puesto entre modelos abiertos y séptimo global en la clasificación Image‑to‑WebDev de Arena, una prueba basada en preferencias humanas que evalúa la conversión de referencias visuales en interfaces web. Es un indicio útil para generación de UI, no una garantía de código listo para producción.

Audio con ElevenLabs

Qué ha ocurrido

Alibaba comunicó que su modelo abierto Qwen3.8‑27B ocupa el primer lugar entre los modelos de código abierto y el séptimo en el ranking global de la prueba Image‑to‑WebDev de Arena, que valora cómo los sistemas convierten referencias visuales en interfaces web funcionales. El resultado corresponde al modelo ya lanzado Qwen3.8‑27B y es independiente del preview Qwen3.8‑Flash‑Next.

Qué significa para creadores

Si generas sitios o apps a partir de capturas o maquetas, Qwen3.8‑27B es un candidato para probar en flujos de “imagen a interfaz”. Es multimodal (texto, imagen y vídeo), con licencia Apache 2.0 y una ventana de contexto nativa de 262.144 tokens ampliable a 1 millón. Puedes desplegarlo en tu infraestructura con SGLang, vLLM o TokenSpeed y evaluar con tus propios prompts de recreación de UI. Decide en producción midiendo consumo de memoria, latencia a los contextos que usas, resultados de revisión de código y tasas de fallo; estos aspectos dependen de cuantización, longitud de contexto, tamaño de lote, configuración de razonamiento y del stack de hardware/software.

Fuente y contexto

La clasificación de Arena se basa en comparaciones por pares con votos humanos y puntúa con un modelo Bradley‑Terry; es una preferencia de salida, no evidencia de código seguro, accesible o mantenible. Alibaba afirmó que el modelo rinde “a la par de otros 100× mayores”, pero esa comparación no queda identificada en la prueba; lo verificable es el primer puesto entre abiertos y el séptimo global. En otras evaluaciones, la tarjeta del modelo reporta un 48,0% en WildClawBench (octavo), lo que recuerda que el rendimiento varía según tarea y métrica. Más detalles: RuntimeWire (https://runtimewire.com/article/alibaba-qwen3-8-27b-arena-image-to-webdev-qwen4-preview).