Nano Banana 2 Lite ya está en VibeArt: Gemini 3.1 Flash Lite Image cuesta 3 créditos por generación 1K, así que 100 créditos de prueba cubren unas 33 generaciones rápidas. Probar Nano Banana 2 Lite
Guía de prompts de Qwen Image 3: 13 pruebas reales de texto, infografías y UI
Probamos Qwen-Image-3.0 con 13 prompts reales: texto pequeño, cuadrículas 3×3 multilingües, periódicos extensos, UI anidada, edición y sus fallos exactos.
26 de julio de 2026
•Por VibeArt Team•
27 min de lectura
•— visualizaciones
Lo interesante de Qwen-Image-3.0 no es que pueda generar otra imagen bonita. Lo interesante es que intenta concentrar en una sola imagen la estructura de un entregable: texto pequeño, fórmulas, gráficos, jerarquía de interfaz, distribución por zonas y conocimiento.
Esa promesa es mucho más difícil de evaluar que la calidad estética. Un cartel puede parecer impecable y escribir mal un nombre. Una pantalla puede incluir todos los componentes pedidos y aun así ordenar mal la información. Una infografía financiera puede mostrar un número con nitidez y, sin embargo, mostrar el número equivocado.
Por eso esta guía plantea una pregunta más exigente que «¿se ve bien la demo?»:
¿Qwen Image 3 produce un documento visual útil o una captura atractiva que todavía exige una revisión línea por línea?
Respuesta rápida: ¿Qwen Image 3 es realmente útil?
Qwen-Image-3.0 se lanzó el 21 de julio de 2026 con una propuesta centrada en imágenes de alta densidad informativa: hasta 4,5K tokens de entrada, texto de unos 10 píxeles, renderizado nativo en 12 idiomas, documentos complejos, detalle realista y simulación de interfaces.
Conservamos trece primeros intentos generados en el producto oficial Qwen Chat. Las diez pruebas base cubren una infografía 3×3, cinco expresiones matemáticas, seis sistemas de escritura, datos financieros proporcionados por nosotros y una portada de periódico. Después añadimos tres pruebas de estrés: un muro de conocimiento multilingüe de 3.646 caracteres, un periódico de seis columnas y 3.812 caracteres, y una interfaz anidada de cuatro capas y 3.538 caracteres.
El resultado no convierte al modelo en un programa de maquetación determinista. La prueba de UI añadió tres signos parecidos a una barra y texto inventado; la escena panorámica dibujó cinco drones en vez de cuatro y tres puentes en vez de dos. La edición cambió la taza correcta y mantuvo el cartel, pero redujo la imagen de 1792×2400 a 1072×1440 y alteró algunos píxeles fuera de la zona solicitada.
La regla práctica es sencilla:
usa Qwen Image 3 cuando importen la estructura visual, la densidad de información y la composición de texto e imagen
entrega al modelo el texto y los datos exactos; no le pidas que invente hechos
revisa cada carácter, número, fórmula, región y relación de UI antes de publicar
conserva los hechos, los datos y el archivo editable fuera del mapa de bits generado
Para un moodboard o una dirección visual, un error pequeño puede ser aceptable. Para exámenes, material científico, precios, gráficos financieros, UI de producto o información pública, la imagen debe seguir considerándose un borrador hasta superar una lista de control explícita.
Qué es Qwen-Image-3.0 y qué aún no es público
El lanzamiento oficial describe el modelo con una palabra: “Real”. Qwen lo divide en tres áreas:
Contenido enriquecido: instrucciones extensas y diseños densos, como periódicos, guiones gráficos, exámenes, presentaciones e interfaces anidadas.
Detalles auténticos: texto pequeño más textura visual fina, como poros, cabello, piel y materiales físicos.
Conocimiento profundo: representación multilingüe, software e interfaces de consumidor familiares y composiciones ricas en conocimiento.
El lanzamiento muestra una infografía completa de 3×3 generada en una sola pasada en lugar de ensamblada a partir de nueve imágenes separadas. Esa es una dirección de producto significativa. También aumenta la carga de la prueba: nueve regiones limpias no son suficientes si una fórmula, fecha, etiqueta o diagrama es incorrecto.
A partir del 25 de julio de 2026, pudimos verificar y usar Qwen-Image-3.0 en una cuenta oficial de Qwen Chat iniciada. Una conversación de imagen nueva tenía como valor predeterminado Qwen-Image 2.0, por lo que seleccionamos explícitamente Qwen-Image 3.0 antes de cada prueba y confirmamos la etiqueta del modelo visible después del envío.
Alibaba Cloud ahora documenta el ID del modelo API qwen-image-3.0-pro, pero se encuentra en una vista previa solo por invitación, no en disponibilidad general. El límite documentado en China continental es de una solicitud por minuto, y la página de precios muestra una vista previa gratuita por tiempo limitado en lugar de un precio duradero de disponibilidad general. Todavía no pudimos verificar los pesos 3.0 descargables, una tarjeta de modelo 3.0 pública, un informe técnico, una licencia, un recuento de parámetros o una resolución de salida máxima fija. El repositorio público Qwen-Image no ha agregado una entrada de versión 3.0.
Esa distinción importa:
Elemento
Estado verificado el 25 de julio de 2026
Lanzamiento oficial
Confirmado
Acceso a Qwen Chat
Confirmado con una cuenta autenticada
ID del modelo de API 3.0
qwen-image-3.0-pro
Disponibilidad de la API
Vista previa solo por invitación
Precio y límite de la API
Vista previa gratuita por tiempo limitado; 1 solicitud por minuto en China continental
Pesos 3.0 descargables
No confirmado
Tarjeta del modelo / informe técnico 3.0
No confirmado
Licencia de código abierto 3.0
No confirmado
Resolución máxima de salida
No confirmado
No infiera que 3.0 es de código abierto porque las versiones anteriores de Qwen-Image estaban abiertas. No infiera un contrato de API de producción a partir del producto de chat para consumidores.
Qué cambió con respecto a Qwen-Image-2.0
Qwen-Image-2.0 ya estaba posicionado en torno a infografías profesionales, generación y edición unificadas, salida nativa de 2K, instrucciones de aproximadamente 1K token y una arquitectura más liviana. La historia 3.0 pasa de “mejor generación de imágenes con texto” a “generar todo el documento visual en una sola pasada”.
Aspecto
Qwen-Image-2.0
Qwen-Image-3.0
Longitud de las instrucciones
Aproximadamente 1K tokens
Hasta unos 4,5K tokens
Resultado típico
Infografía o imagen individual
Periódico, examen, guion gráfico, presentación, UI anidada o infografía densa
Propuesta sobre texto
Renderizado de texto sólido
Texto de hasta unos 10 px
Propuesta sobre conocimiento
Calidad de generación y edición
Composición visual rica en conocimiento e interfaces conocidas
Despliegue público
Ejemplos de API disponibles de forma general
qwen-image-3.0-pro en vista previa solo por invitación
La mejora útil no consiste simplemente en admitir «más tokens». Consiste en intentar conservar la jerarquía cuando aparecen muchas restricciones independientes a la vez. Por eso evaluamos por separado la estructura y la corrección.
Cómo probamos: un documento visual necesita más que una puntuación de belleza
Cada prueba registra:
punto de entrada y etiqueta de modelo visible
fecha de generación
dimensiones solicitadas y reales
tiempo de generación
intentos totales y primer intento utilizable
errores de texto exacto
errores fácticos o de cálculo
errores de diseño y región
errores semánticos de la interfaz de usuario
deriva no objetivo para edición
tiempo estimado de reparación manual
No asignamos una puntuación global. Un solo número esconde el fracaso que importa. En cambio, cada resultado se revisa en siete dimensiones:
Dimensión
Qué comprobamos
Texto exacto
Mayúsculas, puntuación, dígitos, símbolos, saltos de línea y ortografía
Precisión factual
Fechas, cálculos, declaraciones científicas, unidades y datos suministrados
Cumplimiento del diseño
Recuento de regiones, orden, posición relativa, módulos faltantes y duplicados
UI
Jerarquía, relaciones de componentes, objetivos táctiles y lógica de producto familiar
Fidelidad de la edición
Si cambió algo fuera de la zona solicitada
Calidad visual
Materiales, iluminación, anatomía, composición y artefactos locales
Eficiencia del flujo de trabajo
Tiempo de espera, reintentos, tasa de primera utilización y tiempo de reparación manual
Todos los resultados a continuación se generaron el 25 de julio de 2026 en el producto web oficial de Qwen Chat registrado. Cada resultado retenido es el primer intento después de seleccionar y confirmar explícitamente la etiqueta visible Qwen-Image 3.0. El tiempo de cola es aproximado porque la interfaz de usuario del consumidor no muestra ningún tiempo legible por máquina. Qwen no expone un interruptor de expansión de mensajes en esta interfaz, por lo que no podemos afirmar que la reescritura de mensajes internos esté deshabilitada.
Las pruebas 1 a 10 utilizan resultados descargados convertidos a WebP de calidad 90 sin cambiar el tamaño. Las pruebas 11 a 13 utilizan copias WebP optimizadas sin cambiar el tamaño. Todas las imágenes se publican desde nuestra CDN en sus dimensiones de píxeles nativas. El mensaje completo utilizado para cada prueba aparece debajo de su resultado; Los tres mensajes más largos están contraídos de forma predeterminada para mantener el artículo legible.
Prueba 1: Infografía densa de 3×3 y texto exacto
Esta prueba separa el éxito del diseño del éxito del contenido. Contiene nueve regiones, 27 viñetas obligatorias, fórmulas, códigos de estado y etiquetas exactas.
Resultado: 2048×2048, aproximadamente 173 segundos, un intento. Las nueve regiones aparecieron en el orden solicitado. Los títulos, declaraciones científicas, códigos de estado y ecuaciones de color son legibles y correctos. Dos desviaciones a nivel de caracteres impiden una puntuación literal perfecta: la expresión de interés compuesto se compuso como un superíndice real en lugar de conservar los caracteres originales ^(nt), y el diagrama de búsqueda binaria contiene una etiqueta R adicional. Reparación manual estimada: 1 a 2 minutos en un diseño editable, pero el mapa de bits en sí no es convenientemente reparable.
Aviso:
Create a square 1:1 educational infographic with a 3×3 grid on off-white. Each cell has a navy title bar, one simple diagram, and only the specified copy. Do not add, remove, paraphrase, translate, or repeat text.1 WATER CYCLE: Evaporation—liquid becomes vapor; Condensation—vapor forms clouds; Precipitation—water returns to Earth.2 PHOTOSYNTHESIS: Inputs—water, carbon dioxide, sunlight; Output—glucose and oxygen; Location—chloroplasts.3 NEWTON'S LAWS: First—motion stays unchanged without net force; Second—F = ma; Third—every action has an equal opposite reaction.4 BINARY SEARCH: Requires a sorted list; Compare with the middle value; Time complexity—O(log n).5 COMPOUND INTEREST: Formula—A = P(1 + r/n)^(nt); P is the principal; A is the final amount.6 DNA: Bases—A, T, C, G; Shape—double helix; A pairs with T; C pairs with G.7 SUPPLY AND DEMAND: Higher price can reduce demand; Higher price can increase supply; Equilibrium is where curves meet.8 HTTP STATUS: 200 OK; 404 Not Found; 500 Internal Server Error.9 COLOR MIXING: Red + blue = magenta; Blue + green = cyan; Red + green = yellow.Use consistent editorial styling. All text legible. No logo, watermark, or footer.
Prueba 2: texto pequeño, fórmulas y una página académica
Una fórmula que simplemente se parece a la fuente es un fracaso. Verificamos números primos, límites, límites integrales, superíndices, signos menos y cada dígito.
Resultado: 1792×2400, aproximadamente 89 segundos, un intento. Las cinco afirmaciones matemáticas son correctas, incluido el límite, la derivada, los exponentes, los límites integrales, la marca prima, el logaritmo y las fracciones. El título, la fecha y el pie de página son correctos. Los caracteres de subrayado solicitados después de Name: se convirtieron en una regla horizontal convencional, por lo que las matemáticas pasan, mientras que la preservación estricta de caracteres no. Reparación manual estimada: menos de 1 minuto si la fuente sigue siendo editable.
Aviso:
Create a portrait A4 mathematics practice sheet, photographed flat from directly above, black text on white paper.Exact title: "Limits and Derivatives — Practice Sheet"Exact subtitle: "Name: ____________ Date: 2026-07-25"Include exactly these five numbered items:1. lim(x→0) sin(x)/x = 12. d/dx [x³ + 2x² − 5x + 7] = 3x² + 4x − 53. f(x) = e^(2x), therefore f′(x) = 2e^(2x)4. ∫₀¹ 3x² dx = 15. If y = ln(x² + 1), then dy/dx = 2x/(x² + 1)Footer exactly: "Check every exponent, limit, fraction, and derivative symbol before submitting."No handwriting, extra formulas, logo, or watermark.
Prueba 3: Representación de texto multilingüe
Esta prueba utiliza seis sistemas de escritura y le da al árabe la misma importancia. Verificamos la ortografía exacta, la combinación de caracteres, la dirección, la puntuación y si el modelo agrega silenciosamente una copia decorativa.
Resultado: 1696×2528, aproximadamente 112 segundos, un intento. Inglés, chino simplificado, japonés, coreano, español y árabe coinciden con las cadenas proporcionadas. El árabe se traduce de derecha a izquierda y no aparece ninguna séptima línea ni pseudotexto decorativo. El tamaño visual no es perfectamente igual (la línea en inglés es más ancha) pero la jerarquía no degrada un idioma. Reparación manual estimada: ninguna.
Aviso:
Create a portrait international bookstore poster with a dark green background, cream paper texture, and one central open book. It must contain exactly these six lines and no other text:Stories Across Borders跨越边界的故事国境を越える物語국경을 넘는 이야기Historias sin fronterasحكايات بلا حدودOne language per line, exact spelling, Arabic right-to-left, equal visual importance. No logo, watermark, or invented characters.
Prueba 4: IU realista versus lógica de IU correcta
Una interfaz puede parecer plausible pero comportarse como si no fuera un producto real. Aquí, la restricción crítica es que cada autor del comentario debe aparecer encima del texto del comentario.
Resultado: 1536×2752, aproximadamente 157 segundos, un intento. La jerarquía de publicaciones, los tres autores, el orden de los comentarios, el recuento de acciones y la navegación inferior son correctos. Cada autor aparece encima del comentario correspondiente. Todavía falla en la limpieza de la copia: aparece un glifo parecido a una barra invertida antes de cada comentario, y la vista previa de la imagen contiene letras pseudo-CJK inventadas. Esta es una maqueta de interfaz de usuario convincente, no una captura de pantalla de producción. Reparación manual estimada: 3 a 5 minutos en un archivo de diseño.
Aviso:
Create a portrait 390×844 dark-mode mobile social app screenshot.Top: avatar, centered "Following", search and settings.Post hierarchy: "Maya Chen", "@mayac", "2h", text "Testing a multilingual poster workflow today.", one landscape preview, then reply 12, repost 28, like 316, bookmark.Exactly three comments, username ABOVE comment text:Leo Park — "The spacing feels much better now."Sofia Ruiz — "Can you test Spanish text next?"Amir Haddad — "Please include Arabic direction too."Bottom navigation: Home, Search, Create, Notifications, Profile; Home active. Believable spacing and touch targets. No extra comments, numbers, device frame, logo, or watermark.
Prueba 5: Recuento exacto de objetos y restricciones espaciales
Las indicaciones de diseño de objetos son fáciles de auditar. “Casi ocho objetos” no es un resultado subjetivo.
Resultado: 2048×2048, aproximadamente 88 segundos, un intento. Aparecen exactamente ocho categorías de objetos, cada elemento es completamente visible y los ocho ocupan su región asignada. No hay categorías duplicadas ni extras decorativos. El pasaporte es intencionalmente sencillo porque el mensaje también prohíbe enviar mensajes de texto. Reparación manual estimada: ninguna.
Aviso:
Create a square top-down product photograph on a matte charcoal table. Show exactly eight objects and nothing else:1 red passport at top-left2 silver fountain pen at top-center3 black compact camera at top-right4 green ceramic cup at middle-left5 closed blue notebook at exact center6 white earbuds case at middle-right7 yellow keychain at bottom-left8 pair of round brown sunglasses at bottom-rightEvery object fully visible, separated, only in its assigned position. Soft studio shadows, realistic materials. No text, logo, watermark, or duplicates.
Prueba 6: una infografía financiera con datos proporcionados
El modelo recibe todos los números. Volvemos a calcular el total y el porcentaje nosotros mismos y luego comprobamos si el pulido visual cambió los datos.
Resultado: 2752×1536, aproximadamente 138 segundos, un intento. Todos los valores y etiquetas suministrados son correctos: 12,4, 15,1, 14,5, 42,0, 45,0, 3,0 y 93,3%. Las barras siguen el orden abril-mayo-junio, mayo es el más alto, el total suma correctamente y no se inventó ninguna métrica adicional. Reparación manual estimada: ninguna.
Aviso:
Create a landscape financial infographic using only this data.Title: "Northwind Q2 Revenue"Subtitle: "All values in USD millions"April 12.4; May 15.1; June 14.5; Quarter total 42.0; Quarter target 45.0; Gap to target 3.0.Include one April-May-June bar chart, progress "42.0 of 45.0", callout "May was the strongest month", and callout "Target attainment: 93.3%". Every number, label, bar order, and calculation must match exactly. No other metrics, conversion, logo, or watermark.
Prueba 7: fotorrealismo, edad, manos y detalle del material
Este no es un retrato de belleza. La escena fuente también se convierte en la entrada para la prueba de preservación que sigue.
Resultado: 1792×2400, aproximadamente 78 segundos, un intento. El resultado tiene detalles creíbles de la edad, luz de la ventana desde la izquierda, manos naturales con cinco dedos cada una, residuos de arcilla, textura del material, una taza blanca a la derecha y el texto exacto de la tarjeta FIRE TO 1220°C. La composición se volvió vertical aunque no se especificó ninguna relación de aspecto; se trata de una elección de producto y no de una infracción inmediata. Reparación manual estimada: ninguna.
Aviso:
Documentary-style environmental portrait of a 58-year-old female ceramic artist seated at a wooden worktable in her studio. Natural window light from the left. Visible age lines, realistic pores, a few gray hairs, clay dust on both hands, small wrinkles in a linen apron, unfinished stoneware bowls on wooden shelves, subtle fingerprints on wet clay.Place one plain white ceramic cup on the right side of the table. Place a small paper studio card behind it containing exactly the text "FIRE TO 1220°C".Neutral color grading, 50mm lens look, shallow but believable depth of field. Preserve natural asymmetry and real skin texture. No glamour retouching, no waxy skin, no extra fingers, no other text, no logo, no watermark.
Prueba 8: edición de imágenes y conservación no objetivo
El resultado de la Prueba 7 se utiliza como única entrada. La edición solicitada es intencionalmente pequeña; cualquier otro cambio cuenta como deriva.
Original: 1792×2400Editado: 1072×1440
Resultado: aproximadamente 61 segundos, un intento. La copa adquiere un color azul cobalto profundo con una media luna dorada, mientras que la persona, las manos, el delantal, la dirección de la luz, los estantes, la mesa, la arcilla y la tarjeta de cocción exacta permanecen visualmente cerca. Esta no es una edición local de píxeles: el servicio reduce ambas dimensiones en aproximadamente un 40% y, después de cambiar el tamaño de la fuente a las dimensiones editadas, la diferencia media absoluta de canales RGB fuera de una máscara de copa conservadora es 9,4 en una escala de 0 a 255. La edición es visualmente útil, pero se debe verificar la resolución y la preservación no deseada antes de encadenar más ediciones. Reparación manual estimada: ninguna para esta solicitud; Es posible que sea necesario volver a escalar o componer la fuente en producción.
Aviso:
Edit only the ceramic cup on the right side of the table: change its color from white to deep cobalt blue and add a small gold crescent on its front.Preserve every other detail as closely as possible, including the person's identity, face, hands, clothing, lighting, camera angle, table objects, background shelves, and the exact existing text "FIRE TO 1220°C". Do not move, resize, add, or remove anything else.
Prueba 9: Diseño de periódico y copia larga
Esta prueba verifica las columnas, la jerarquía, la texto exacto, el manejo de fechas y si el modelo inventa titulares adicionales para que la página parezca más completa.
Resultado: 1792×2400, aproximadamente 141 segundos, un intento. El encabezado, la fecha, el título principal, la plataforma, las tres líneas de la lista de verificación, el texto del clima y el pie de página coinciden. El resultado no agrega texto de artículo inventado y mantiene una jerarquía de portada creíble en torno a la fotografía solicitada. Reparación manual estimada: ninguna.
Aviso:
Create a portrait broadsheet newspaper front page photographed flat overhead. Use exactly this readable copy and no other text.Masthead: "THE DAILY WORKBENCH"Date: "Saturday, July 25, 2026"Main headline: "Small Teams Turn Visual Drafts Into Deliverables"Deck: "A new workflow keeps prompts, source data, revisions, and approvals connected."Left headline: "Three Checks Before Publishing"Bullets: "Verify every number"; "Compare every label"; "Preserve the editable source"Right headline: "Weather"Copy: "Morning cloud, afternoon sun, high 24°C."Footer: "Edition 01 • Price $2.00"Black, warm white, muted red; one photo of a designer reviewing a proof; believable hierarchy and columns. No invented copy, logo, or watermark.
Prueba 10: Escena extremadamente amplia y detalle local
Las escenas amplias exponen texturas repetidas, anatomía débil y una brecha entre la resolución nominal y los detalles útiles.
Resultado: 2752×1536, aproximadamente 96 segundos, un intento. La escena tiene tres regiones claramente diferentes, exactamente tres barcos solares, una aeronave, torres variadas, más de 20 personas y actividades reconocibles para caminar, andar en bicicleta, hacer ejercicio, pintar, hacer picnic y jugar al ajedrez. El cumplimiento del conteo falla: hay cinco drones de reparto visibles en lugar de cuatro, y tres estructuras de puentes en lugar de dos. La anatomía humana pequeña es aceptable en tamaño de página pero suave con zoom nativo. Reparación manual estimada: 5 a 10 minutos con eliminación o regeneración del objeto.
Aviso:
Create an ultra-wide 16:9 realistic future ecological city.Left third: residential towers with varied vertical gardens and maintenance walkways, no repeated facade.Center: river with exactly three solar passenger boats and two pedestrian bridges.Right: public park with at least 20 visible people doing distinct activities including walking, reading, cycling, chess, and exercise.Sky: exactly four delivery drones and one transparent passenger airship.Coherent daylight, scale, anatomy, natural materials, continuous city plan. No text, logo, watermark, cloned people or trees, repeated windows, malformed limbs, or impossible bridges.
Pruebas de estrés extremas: mensajes largos, texto denso y interfaz de usuario anidada
El lanzamiento oficial hace más que mostrar muestras atractivas. Sus ejemplos más difíciles combinan un mensaje largo con amplitud horizontal (un muro de conocimiento completo de 3×3) o profundidad vertical, donde una interfaz contiene otra interfaz que contiene contenido más estructurado. Diseñamos tres nuevas pruebas en torno a esos dos ejes.
Se trata de instrucciones deliberadamente irrazonables para un generador de imágenes normal. El objetivo no es demostrar que un mapa de bits deba reemplazar una herramienta de diseño de periódico, un flujo de trabajo de localización o un editor de código. El objetivo es localizar el límite entre estructuralmente completo y literalmente correcto.
Prueba
Tamaño de aviso
Resultado estructural
Fallo literal
11. Muro de conocimiento extremo 3×3
3,646 caracteres
Los nueve dominios presentes en una cuadrícula estricta
Varias etiquetas no latinas más pequeñas degradadas
12. Periódico de seis columnas
3.812 caracteres
Aparecen todos los módulos principales del periódico
El artículo principal y parte del texto chino no son literales
13. UI anidada de cuatro capas
3.538 caracteres
Aparecen las cuatro capas de interfaz y los seis pasos del runbook
El código parece plausible, pero contiene errores de sintaxis y ortografía
Prueba 11: Muro de conocimiento multilingüe extremo 3×3
Esta es una versión sustancialmente más difícil de la Prueba 1. Nueve celdas deben cubrir comando de incidentes, geometría espacial, genómica, redes de confianza cero, respuesta a tifones, controles bancarios, orientación en 12 idiomas, un SOP de laboratorio y verificaciones de preparación de barcos. El mensaje combina fórmulas, tablas, flechas, coordenadas, etiquetas de estado y 12 scripts al tiempo que prohíbe módulos omitidos o inventados.
Resultado: 2048×2048, aproximadamente 130 segundos, un intento de Qwen-Image 3.0 retenido. El modelo produjo una estricta cuadrícula de 3×3 con los nueve dominios solicitados y un sistema visual coherente. Los títulos, fórmulas, coordenadas, la mayoría de los números y las entradas de tablas más grandes en inglés y chino siguen siendo sorprendentemente legibles. El resultado se lee como un artefacto diseñado en lugar de nueve miniaturas no relacionadas.
El fracaso aparece exactamente donde las afirmaciones oficiales de texto pequeño y multilingüe se vuelven más difíciles de combinar. Varias cadenas de tamaño micro en ruso, árabe e hindi están mal formadas; Una pequeña copia de la leyenda del tifón y algunas etiquetas de flechas de red se colapsan en pseudotexto. Parte de la puntuación decimal se localiza de un punto a una coma. Esto supera la integridad estructural pero no el control de calidad literal multilingüe.
Vea el mensaje exacto de 3646 caracteres utilizado para la Prueba 11
请用 Qwen-Image 3.0 一次性生成一张超高信息密度、正方形 1:1、清晰可读的专业“3×3 应用知识图谱”海报。它不是九张图拼接,而是一张统一设计系统中的完整九宫格;严格 3 行×3 列,共 9 格,不多不少。画布四周留 64px 外边距,格间留 28px 白色沟槽,每格都有细灰边框、独立标题栏、编号 01–09、图表区、正文区和页脚来源标签。全图使用瑞士国际主义信息设计:白底、深墨蓝文字、青色/橙色/红色作为状态色,网格严谨,印刷级排版。主标题精确写:“QWEN IMAGE 3 — EXTREME 3×3 KNOWLEDGE WALL”;副标题精确写:“Nine domains · one canvas · zero omitted labels”。所有引号中的文字必须逐字呈现,不得改写、翻译、漏字或生成乱码;正文允许 10–14px 视觉字号但仍需清晰。严禁水印、品牌误拼、额外面板、跨格元素、重复图标。第 01 格,标题精确写:“INCIDENT COMMAND / 事故指挥”。左侧画一条 5 节点时间轴,逐行精确写:“09:17 API latency > 2.0s”“09:21 Error rate reaches 8.4%”“09:26 Read replica isolated”“09:34 Cache warmed to 92%”“09:41 Service fully recovered”。右侧是四张 KPI 小卡:“P95 684 ms”“Errors 0.7%”“RPS 12,480”“MTTR 24 min”。底部红框写:“DECISION: HOLD DEPLOYMENT”。第 02 格,标题精确写:“SPATIAL GEOMETRY / 空间几何”。绘制透明立方体 ABCD–A₁B₁C₁D₁、对角线 AC₁、平面 BB₁D₁D 和 35° 角标。右侧严格排出三行公式:“|AC₁| = √(a²+b²+c²)”“cos θ = (u·v)/(|u||v|)”“V = |a·(b×c)|”。下方定理框逐字写:“If u·n = 0, then u ∥ plane Π.” 和中文:“向量与法向量垂直,则向量平行于平面。”第 03 格,标题精确写:“GENOMICS PIPELINE / 基因组流程”。从左到右画五步流程:“Sample → Extraction → Library → Sequencing → Variant Call”。画双螺旋、FASTQ 文件、覆盖度直方图、染色体 7 的局部放大。小表格三列标题:“Variant”“Depth”“Effect”,三行精确数据:“chr7:140453136 A>T | 812× | missense”“chr12:25398284 C>G | 406× | intronic”“chr17:7674220 G>A | 1,024× | stop gained”。页脚写:“Reference: GRCh38 · QC PASS”。第 04 格,标题精确写:“ZERO-TRUST NETWORK / 零信任网络”。画清晰架构图:左侧“USER DEVICE”经过“IDENTITY PROXY”进入中心“POLICY ENGINE”,再分流到“WEB APP”“POSTGRES”“OBJECT STORE”;每条箭头旁分别标注“mTLS”“OIDC”“short-lived token”“deny by default”。右下角放 2×2 状态卡:“Auth 99.99%”“Blocked 1,284”“Risk HIGH 03”“Key age 17d”。底部精确写:“Never trust. Always verify. Log every decision.”第 05 格,标题精确写:“TYPHOON BRIEFING / 台风简报”。画东亚沿海地图、台风路径 6 个时间点、同心风圈、颜色图例。路径标签精确写:“T+00 18.2°N 126.4°E”“T+12 19.7°N 124.8°E”“T+24 21.3°N 123.1°E”“T+36 23.8°N 121.6°E”“T+48 26.1°N 120.9°E”“T+60 28.4°N 121.7°E”。右侧风险表:“Wind 145 km/h — SEVERE”“Rain 280 mm — EXTREME”“Surge 2.4 m — HIGH”。警示条写:“EVACUATE LOW-LYING AREAS BEFORE 18:00”。第 06 格,标题精确写:“BANK CONTROL MATRIX / 银行内控矩阵”。画 4×4 表格,列标题:“Control”“Owner”“Frequency”“Evidence”;四行精确写:“Dual approval | Treasury | Daily | Signed ledger”“Limit review | Risk | Weekly | Exception log”“Access recertification | Security | Quarterly | IAM report”“Backup restore | SRE | Monthly | Recovery record”。右侧画环形图:“PASS 87%”“OPEN 9%”“OVERDUE 4%”。底部橙框精确写:“3 HIGH-RISK EXCEPTIONS REQUIRE ACTION”。第 07 格,标题精确写:“12-LANGUAGE WAYFINDING / 十二语导视”。画现代地铁换乘站平面图,中央圆形“PLATFORM 4”,八条彩色线路,四个出口。右侧必须逐行准确出现以下 12 行,不合并:“English — Central Station”“中文 — 中央车站”“日本語 — 中央駅”“한국어 — 중앙역”“Español — Estación Central”“Français — Gare Centrale”“Deutsch — Hauptbahnhof”“Italiano — Stazione Centrale”“Português — Estação Central”“Русский — Центральный вокзал”“العربية — المحطة المركزية”“हिन्दी — केंद्रीय स्टेशन”。底部写:“Exit C · Lift · Tickets · First Aid”。第 08 格,标题精确写:“LAB SOP / 实验室规程”。画分子结构、烧杯、移液器、离心机和四枚标准危险图标。右侧编号步骤逐字写:“1. Wear nitrile gloves and goggles.”“2. Add 25.0 mL buffer at 4°C.”“3. Centrifuge 12,000×g for 10 min.”“4. Transfer exactly 200 μL supernatant.”“5. Record batch ID before disposal.” 参数卡写:“pH 7.40 ± 0.05”“Temp 4°C”“RPM 13,200”“Timer 00:10:00”。红色页脚:“DO NOT MIX ACID WITH HYPOCHLORITE”。第 09 格,标题精确写:“SHIP-READINESS CHECK / 发布检查”。画 12 项双列核对清单,每项前有绿色勾或橙色圆点,文字精确为:“Schema migration reviewed”“Rollback tested”“Feature flag off by default”“Secrets rotated”“Error budget checked”“Accessibility AA”“Mobile 360px verified”“P95 under 800 ms”“Audit log retained”“Runbook linked”“On-call acknowledged”“Customer notice drafted”。右下角盖章精确写:“GO WITH CONDITIONS”。页脚版本号:“REV 3.0 · 2026-07-25 · OWNER: PLATFORM”。整张图必须在一张画布中维持九格互不干扰:每格视觉语言统一但内容图形各异;所有表格行列对齐;数字、标点、上下标、希腊字母、中文、阿拉伯文、天城文都清楚;无随机伪文字,无文本块缺失。优先保证文字准确性、九格完整性和可判读性,其次才是装饰。
Prueba 12: Periódico de seis columnas con copia larga
El periódico de base utilizó un pequeño conjunto de titulares exactos y textos breves. Esta versión solicita una hoja ancha auténtica de seis columnas con cabecera, fecha y línea de precios, un artículo principal titulado LUNAR WATER TREATY CLEARS FINAL VOTE, tres párrafos en inglés, una fotografía y título lunar, tarjetas KPI, un gráfico de líneas, una tabla de mercado de cinco filas, cuatro despachos, una sección en chino, una tabla de datos y fórmulas de investigación, un cuadro informativo y un pie de página literal.
Resultado: 1792×2400, aproximadamente 75 segundos, un intento. La jerarquía es excelente. Todos los módulos principales están presentes, el encabezado y el titular principal son correctos, el KPI y la tabla de mercado son legibles, y el gráfico, los despachos, la sección china, la ecuación, el diagrama de estratigrafía, la tabla de investigación, el informe, la dirección de correo electrónico y el número de página ocupan posiciones creíbles en el periódico.
No es una copia perfecta. El párrafo inicial en inglés contiene palabras superpuestas y corruptas, parte del texto del cuerpo chino y una firma divergen de la fuente proporcionada, y varias oraciones largas están parafraseadas o acortadas. La imagen es una composición editorial inusualmente convincente, pero publicarla sin volver a componer la copia no sería seguro.
Vea el mensaje exacto de 3812 caracteres utilizado para la Prueba 12
请使用 Qwen-Image 3.0 生成一张竖版 4:5、2048px 级别、可直接印刷的真实英文数据报纸首页。它不是海报,而是一张完整 broadsheet newspaper front page:纸张有轻微米白纤维、墨色细微渗透、折痕和套印误差,但所有文字必须清晰。采用严格 6 栏网格、细黑分隔线、经典衬线正文字体、无衬线数据标签。主报头逐字写:“THE ORBITAL LEDGER”;其下细字逐字写:“Independent reporting for Earth, Moon and Mars”;左上日期:“FRIDAY, JULY 25, 2026”;右上:“VOL. 18 · NO. 207 · PRICE $3.50”。不得生成伪文字,不得用无意义 lorem ipsum,不得遗漏引号中的任何段落。所有正文保持真实报纸密度,最小字看起来约 10px 但放大可读。第一、二、三栏组成头版主稿。超大标题精确写:“LUNAR WATER TREATY CLEARS FINAL VOTE”。副标题精确写:“Twelve nations agree on shared extraction limits, emergency reserves and open telemetry after a 19-hour session.” 署名精确写:“BY MAYA CHEN · SCIENCE & POLICY EDITOR”。正文必须逐字排出以下三段,不改写:“GENEVA — Delegates approved the Lunar Water Accord at 04:12 local time on Friday, creating the first enforceable limits on polar ice extraction. The agreement assigns annual quotas, protects permanently shadowed craters, and requires every operator to publish machine-readable telemetry within sixty seconds.”“Negotiators resolved the final dispute by placing a six-month emergency reserve under joint control. Any release now requires three independent signatures: one from the host nation, one from the scientific council, and one from the civilian settlement network.”“Markets reacted cautiously. Oxygen futures fell 2.8 percent while launch-insurance shares rose. Engineers welcomed the data clause but warned that sensor calibration standards must be finished before the treaty takes effect on January 1, 2027.”主稿中间放一张写实月球南极基地照片:低角度阳光、机械臂、冰样品罐、三名宇航员;照片说明逐字写:“Survey team 7A returns from Shackleton Ridge with sealed core samples. PHOTO: LUNA PRESS POOL”。第四栏顶部做数据模块,标题:“THE NUMBERS”。四行 KPI 精确写:“12 signatory nations”“18.6 million liters annual cap”“15% emergency reserve”“60 seconds telemetry delay”。其下画折线图标题:“WATER OUTPUT, 2027–2032”,横轴年份 2027、2028、2029、2030、2031、2032,纵轴标注“million liters”,三条线图例严格写:“Approved quota”“Projected demand”“Protected reserve”。图下注释:“Forecast range: ±6.2%”。第五栏顶部标题:“MARKET SIGNALS”。画 5 行金融表格,列标题严格为:“Asset”“Close”“Change”。数据逐行精确写:“OXY-FUT 84.20 −2.8%”“HELIO 118.44 +1.6%”“CISLUNAR 72.09 +0.4%”“ICE-INDEX 204.81 −1.1%”“LAUNCH-RE 51.77 +3.2%”。表下短文逐字写:“Volume was 31 percent above the 20-day average. Analysts cited lower scarcity risk and stronger compliance spending.”第六栏顶部标题:“FIELD DISPATCHES”。列出四条带地点的小稿,每条标题和句子都要准确:“SHACKLETON — Power restored” 下写:“A damaged 40 kV cable was isolated at 06:30; habitats remained on battery for eleven minutes.”“MARE IMBRIUM — Dust alert” 下写:“Electrostatic dust reached level orange. Exterior maintenance is paused until 14:00 UTC.”“TYCHO — School opens” 下写:“The first bilingual primary school welcomed 86 students from nine settlement zones.”“L1 GATEWAY — Docking delay” 下写:“Cargo vehicle Kestrel-4 will berth six hours late after a guidance-software rollback.”页面下半部横跨前三栏做中文栏目。栏目名准确写:“中文速览”。标题:“月球水资源公约通过最终表决”。正文两段逐字写:“十二个参与国同意公开开采遥测数据,并为科研、民用与应急储备设定独立配额。公约将永久阴影区列为重点保护区域,任何商业作业都必须保留完整审计记录。”“联合执行委员会每季度发布一次透明度报告。若连续两次未能上报数据,相关运营方将自动暂停许可证,直至第三方完成安全复核。”右下角署名:“记者 陈雨 · 日内瓦”。页面下半部中间做科研插页,标题:“RESEARCH NOTE: ICE STABILITY”。准确排出公式:“∂C/∂t = D∇²C − kC” 和 “T_eq = 112 ± 4 K”。画三层剖面:“REGOLITH 0–18 cm”“MIXED ICE 18–64 cm”“DENSE ICE >64 cm”。旁边小表格列标题:“Depth”“Purity”“Confidence”,三行:“22 cm | 31% | 0.82”“48 cm | 67% | 0.94”“81 cm | 91% | 0.97”。注释逐字写:“n = 214 cores · instrument drift corrected”。页面最下方横贯六栏的短讯带标题:“BRIEFING”。依次排出四条:“Solar weather: G2 storm watch begins 16:00 UTC.” “Earth desk: Pacific heatwave breaks 14 records.” “Mars desk: Valles Marineris relay returns to service.” “Culture: The zero-gravity orchestra announces an autumn tour.” 最底部页脚精确写:“orbitalledger.news · Corrections: corrections@orbitalledger.news · Printed with 62% recycled fiber”。右下角印页码:“A1”。整体要求:像真实获奖报纸设计,不像 AI 海报;六栏从头到尾对齐;长段落完整;英文大小写、连字符、百分号、邮箱、数学符号、中文标点准确;照片与图表服务于内容但不遮挡文字;绝无随机字母串、重复段落、水印或多余标题。优先保证所有指定文本逐字可读。
Prueba 13: Interfaz de software anidada de cuatro capas
Esta prueba solicita a una imagen que preserve la jerarquía semántica en cuatro capas visibles: un shell de escritorio estilo VS Code; un navegador integrado que muestra un panel de incidentes Atlas Ops; una superposición de chat telefónico; y una tarjeta runbook anidada dentro de la interfaz de usuario de ese teléfono. El informe también proporciona código fuente, registros de terminal, KPI, un mapa de red, un gráfico, una tabla de incidentes, mensajes de chat y seis pasos ordenados del runbook.
Resultado: 2752×1536, aproximadamente 125 segundos, un intento. Las cuatro capas están presentes y sus límites son inmediatamente comprensibles. El panel conserva el mapa, el gráfico, la jerarquía de KPI, la línea de tiempo y la tabla de incidentes. El teléfono contiene la conversación solicitada y el runbook más interno conserva los seis pasos más los campos de propietario, reversión, verificación y regla. Esta es una fuerte demostración de la composición de la interfaz de usuario y el anidamiento semántico.
El editor de código es el punto débil. Los nombres de funciones y las rutas de acceso se desvían, function está mal escrito, las llaves y la estructura de líneas son inconsistentes y algunas líneas están duplicadas. Un valor decimal también cambia la puntuación. El resultado es excelente como imagen conceptual de un producto y peligroso como captura de pantalla de código literal: la sintaxis plausible no es una sintaxis válida.
Vea el mensaje exacto de 3538 caracteres utilizado para la Prueba 13
请用 Qwen-Image 3.0 一次生成一张 16:9、2560×1440 视觉分辨率、极清晰的“四层嵌套软件界面”真实产品截图。核心测试是纵向语义深度:外层是 VS Code;VS Code 的右侧预览里嵌套一个浏览器运维仪表盘;仪表盘中弹出一个手机协作聊天窗口;聊天里又嵌入一张微型事故处置卡片。四层必须同时完整、边界清晰、透视一致,不能把某层的按钮或文字串到另一层。所有引号里的文本必须逐字呈现,代码标点、日志时间、表格数字、手机消息和最内层卡片都要可读。不要水印,不要随机伪文字,不要重复窗口。第 1 层:完整 VS Code 深色界面,占整张图。顶部 macOS 标题栏和交通灯按钮,窗口标题精确写:“atlas-ops — Visual Studio Code”。菜单精确写:“File Edit Selection View Go Run Terminal Help”。左侧 Activity Bar 有 Explorer、Search、Source Control、Run、Extensions 五个标准图标。Explorer 标题:“ATLAS-OPS”,文件树准确显示:“src”“app”“api”“incidents”“route.ts”“components”“IncidentPanel.tsx”“lib”“telemetry.ts”“package.json”“README.md”。打开的标签页有:“route.ts”“IncidentPanel.tsx”“telemetry.ts”。底部状态栏逐项写:“main*”“0 errors”“2 warnings”“Ln 18, Col 27”“Spaces: 2”“UTF-8”“TypeScript”“Prettier”。VS Code 中央编辑区打开 src/app/api/incidents/route.ts,显示带语法高亮、行号 1–18 的 TypeScript 代码,代码必须尽量准确排出:“import { NextResponse } from 'next/server'”“import { getIncidentSummary } from '@/lib/telemetry'”“”“export async function GET() {”“ const summary = await getIncidentSummary({”“ service: 'payments',”“ windowMinutes: 30,”“ includeRegions: ['us-east', 'eu-west', 'ap-south'],”“ })”“”“ return NextResponse.json({”“ generatedAt: '2026-07-25T09:42:18Z',”“ status: summary.errorRate > 0.02 ? 'degraded' : 'healthy',”“ summary,”“ })”“}”当前行高亮在第 13 行。左下 Terminal 面板标题精确写:“TERMINAL OUTPUT DEBUG CONSOLE PORTS”。终端命令与输出逐行写:“$ npm run dev”“▲ Next.js 16.2.6”“✓ Ready in 842ms”“GET /api/incidents 200 in 47ms”“WARN payments error_rate=0.034 region=eu-west”“INFO fallback_route=active recovered=92%”。第 2 层:VS Code 右侧约 44% 宽区域是内嵌浏览器预览,但仍在 VS Code 编辑器分栏内。浏览器地址栏精确写:“https://ops.atlas.example/incidents/INC-2048”。页面是浅色专业运维仪表盘,页眉左侧标志:“ATLAS OPS”,面包屑:“Incidents / INC-2048”,右侧绿色状态:“LIVE · updated 09:42:18 UTC”。主标题:“Payment authorization latency”。红色标签:“SEV-1 ACTIVE”。副标题:“Elevated p95 and issuer timeouts in EU West”。四张指标卡逐字写:“P95 LATENCY 2.84 s”“ERROR RATE 3.4%”“AFFECTED 18,240”“RECOVERED 92%”。仪表盘左中画欧洲地图,三枚节点标签:“DUBLIN 4.1%”“FRANKFURT 3.7%”“PARIS 2.9%”,红色链路从 Dublin 指向 Frankfurt。右中折线图标题:“Latency by region · last 30 min”,图例:“eu-west”“us-east”“ap-south”,横轴从 09:12 到 09:42,红线在 09:31 峰值 3.2s。下方时间线表格列标题:“Time”“Event”“Owner”“State”,四行精确写:“09:17 | Alert fired | SRE Bot | OPEN”“09:23 | Traffic shifted 20% | Mina K. | DONE”“09:31 | Issuer timeout spike | Payments | WATCH”“09:39 | Cache warm 92% | Leo R. | DONE”。右下按钮:“OPEN RUNBOOK”“ACKNOWLEDGE”“START BRIDGE”。第 3 层:仪表盘右下角覆盖一个约页面高度 48% 的手机协作窗口,外形像真实现代手机但完全在浏览器预览内部,不可溢出到 VS Code。手机顶部频道名:“# incident-inc-2048”,旁边小字:“8 members · bridge live”。消息按时间排列,头像与气泡清晰:“09:24 Mina — Shifted 20% of EU traffic. Error rate is falling.”“09:28 Leo — Cache warm-up reached 74%. ETA six minutes.”“09:33 SRE Bot — Threshold breached: issuer_timeout > 3.0%.”“09:37 Priya — No data loss. Retries remain idempotent.”“09:41 Mina — Recovery at 92%. Holding deployment until 10:15.”输入框占位文字:“Message #incident-inc-2048”,右侧按钮:“Send”。顶部红点提示:“1 unresolved decision”。第 4 层:在手机里 Priya 的消息下方嵌一张小而完整的事故处置卡片,像聊天附件,卡片标题精确写:“RUNBOOK R-17 · PAYMENT DEGRADATION”。橙色状态条:“CURRENT STEP 4 OF 6”。六步纵向流程必须出现并带编号:“1 Confirm telemetry”“2 Freeze deploys”“3 Shift 20% traffic”“4 Warm issuer cache”“5 Validate retries”“6 Restore gradually”。第 1–3 步绿色打勾,第 4 步橙色高亮,第 5–6 步灰色。卡片底部三项细字:“Owner: Payments SRE”“Rollback: ready”“Next check: 09:46 UTC”。最下方红色规则:“STOP IF ERROR RATE > 5%”。整体要求:外层 VS Code 像真正桌面应用,内层浏览器像真正 SaaS,第三层手机像真实协作工具,第四层卡片像真实附件;四层尺度递减但每层关键文字仍清晰;每一层只显示属于自己的导航和控件;代码、终端、指标、地图、折线图、时间线、手机消息、六步 runbook 全部存在。优先级依次是:层级完整 > 文本准确 > UI 真实性 > 装饰。
En conjunto, estos tres resultados exponen el techo actual del modelo. Qwen-Image-3.0 es inusualmente bueno para preservar muchos módulos y sus relaciones en una sola pasada. La exactitud se degrada más rápido que la estructura a medida que el texto se hace más pequeño, el número de guiones crece o la copia se vuelve similar a un código. Esa distinción debería determinar si la salida puede enviarse o debe seguir siendo un borrador visual.
Dónde sigue fallando Qwen Image 3
Las categorías de fracaso importan más que una tabla de clasificación:
El texto claro aún puede ser texto incorrecto. Legibilidad no es exactitud.
Un diseño correcto puede contener conocimientos incorrectos. El diagrama y las etiquetas requieren comprobaciones por separado.
Una interfaz realista puede violar la lógica de la interfaz. Revise la jerarquía y las relaciones, no solo los píxeles.
La densidad de una sola pasada aumenta el costo de la auditoría. Más contenido por imagen significa más oportunidades de cometer un error silencioso.
Un mapa de bits no es un documento editable. Conserve el texto original, los datos y la intención del diseño fuera de la salida generada.
Una edición exitosa aún puede derivar en otra parte. Compare la identidad, el texto, la iluminación y la composición con la entrada.
La precisión multilingüe disminuye con el tamaño de los caracteres. Un modelo puede aprobar un póster en un idioma de seis líneas y reprobar los mismos guiones que una microcopia dentro de una cuadrícula densa.
El código plausible no es código ejecutable. Trate las capturas de pantalla del editor generadas como conceptos visuales a menos que cada token se verifique de forma independiente.
Una comparación temprana de terceros publicada después del lanzamiento informó la misma distinción importante: Qwen podía producir un diseño convincente y escenas realistas sin dejar de cometer un error de texto en árabe, un error de conocimiento en un póster científico y un error de jerarquía de información en una interfaz de usuario social. Tratamos esas observaciones como hipótesis de prueba, no como nuestros propios resultados.
Una fórmula reutilizable para prompts de Qwen Image 3
Las indicaciones largas funcionan mejor cuando se comportan como briefings de producción:
[deliverable type][canvas / aspect ratio / visual hierarchy][exact source copy or source data][region-by-region composition][style, material, and lighting][non-negotiable constraints][explicit forbidden additions][verification instruction]
Cinco reglas prácticas:
proporcione el texto fuente exacto; no pida al modelo que invente contenido factual
numerar regiones y jerarquía en lugar de ocultar los requisitos de diseño en un párrafo
utilice exactly, only y no other text para que el resultado sea auditable
cambiar una variable central por prueba
mantener juntas las notas de aviso, datos de origen, resultados y revisión
infinite Canvas de VibeArt es útil para este flujo de trabajo más amplio incluso antes de que se integre Qwen Image 3: mantenga visibles el material fuente, los intentos de modelos, las comparaciones, las ediciones y las aprobaciones en lugar de perderlos en hilos de chat separados.
Qwen Image 3 frente a GPT Image 2: una elección práctica
La respuesta depende del trabajo, no de una puntuación universal.
Elija Qwen Image 3 para la evaluación cuando necesite probar específicamente resúmenes muy largos, una composición densa similar a un documento, sistemas de escritura combinados y la interfaz de Qwen o sus afirmaciones de conocimiento. Elija GPT Image 2 dentro de VibeArt cuando necesite un modelo que ya esté disponible en el flujo de trabajo de Canvas para generación, comparación, refinamiento y exportación.
No compare una galería Qwen oficial cuidadosamente seleccionada con una salida GPT promedio. Utilice el mismo mensaje fuente, desactive la reescritura cuando el producto lo permita, repita la prueba, registre las dimensiones y el tiempo de salida reales y califique la exactitud por separado de la calidad visual.
Sí. Generamos los trece resultados retenidos en el producto web oficial Qwen Chat con una cuenta iniciada. El acceso al producto puede variar según la cuenta y el estado de implementación. Una conversación de imagen nueva tuvo como valor predeterminado Qwen-Image 2.0 en nuestra sesión, así que verifique y seleccione explícitamente la etiqueta visible Qwen-Image 3.0 antes de tratar una salida como un resultado 3.0.
¿Existe una API Qwen Image 3?
Sí, con una matización importante. Alibaba Cloud documenta el ID del modelo qwen-image-3.0-pro, pero el modelo actualmente es una vista previa solo por invitación, no una API de producción disponible de forma general. El límite de velocidad documentado en China continental es de una solicitud por minuto. Trate tanto el acceso como los límites como condiciones de vista previa que pueden cambiar.
¿Qwen Image 3 es de código abierto?
No pudimos verificar los pesos 3.0 publicados ni una licencia 3.0. El repositorio Qwen-Image más antiguo es Apache-2.0, pero eso no se aplica automáticamente a un paquete de peso 3.0 inédito.
¿Cuánto cuesta Qwen Image 3?
La página de precios de Alibaba Cloud enumera qwen-image-3.0-pro como gratuito por tiempo limitado en China continental durante la vista previa. Ese no es un precio de disponibilidad general estable y no prueba que todas las regiones, cuentas o niveles de Qwen Chat sean gratuitos. Consulte la página de precios regionales actual antes de crear un modelo de costos.
¿Qwen Image 3 genera 2K o 4K?
No pudimos verificar un máximo de modelo fijo. Registre las dimensiones reales desde el punto de entrada del producto utilizado para cada prueba; no convierta el resultado de un producto en un límite de modelo universal.
Veredicto final: úsalo como generador más sistema de QA
La aportación más importante de Qwen-Image-3.0 no es una imagen más bonita. Es la posibilidad de que una sola imagen generada conserve la estructura de un entregable complejo.
Esa posibilidad solo resulta útil con un proceso de revisión. Los hechos deben quedar fuera del mapa de bits; el texto y la jerarquía visual se revisan por separado; los intentos fallidos también se registran; las imágenes de entrada se conservan; y el tiempo relevante es generación más corrección, no solo generación.
La decisión práctica es sencilla: si una maquetación de 40 minutos pasa a requerir cinco minutos de generación y cinco de revisión, el modelo ahorra trabajo. Si comprobar y reparar la imagen tarda más que rehacerla en un formato editable, sigue siendo una demo impresionante, no un entregable.
Eso es exactamente lo que miden estos trece primeros intentos de Qwen-Image 3.0.