Nano Banana 2 Lite가 VibeArt에 추가되었습니다. Gemini 3.1 Flash Lite Image는 1K 생성 1회당 3 credits라서, 평가판 100 credits로 빠른 이미지 생성을 약 33회 할 수 있습니다. Nano Banana 2 Lite 사용하기
13개의 실제 프롬프트로 Qwen-Image-3.0을 테스트했습니다. 작은 글자, 다국어 3×3 그리드, 장문 신문, 중첩 UI, 이미지 편집과 정확성의 한계를 다룹니다.
2026년 7월 26일
•작성자: VibeArt Team•
25분 읽기
•조회수 —
Qwen-Image-3.0에서 정말 흥미로운 점은 예쁜 이미지를 한 장 더 만든다는 사실이 아닙니다. 작은 글자, 수식, 차트, 인터페이스 계층, 영역별 배치, 지식까지 한 장의 이미지 안에 넣어 ‘납품 가능한 결과물’의 구조를 만들려 한다는 점입니다.
이 약속은 미적 완성도보다 훨씬 평가하기 어렵습니다. 포스터는 세련돼 보여도 이름 하나를 틀릴 수 있습니다. 앱 화면은 요청한 컴포넌트를 모두 담고도 정보 계층을 거꾸로 배치할 수 있습니다. 금융 인포그래픽은 숫자를 또렷하게 보여주면서도 잘못된 숫자를 보여줄 수 있습니다.
그래서 이 글은 “데모가 멋져 보이는가?”보다 더 엄격한 질문을 던집니다.
Qwen Image 3은 실제로 쓸 수 있는 시각 문서를 만드는가, 아니면 여전히 한 줄씩 검수해야 하는 멋진 스크린샷을 만드는가?
빠른 결론: Qwen Image 3은 실제로 쓸 만한가?
Qwen-Image-3.0은 2026년 7월 21일 공개됐습니다. 최대 4.5K 입력 토큰, 약 10px 크기의 작은 글자, 12개 언어의 네이티브 렌더링, 복잡한 문서 레이아웃, 사실적인 디테일, 인터페이스 시뮬레이션을 내세웁니다.
공식 Qwen Chat에서 생성한 첫 시도 13개를 그대로 보관해 검수했습니다. 기본 테스트 10개는 3×3 인포그래픽, 수식 다섯 개, 여섯 가지 문자 체계, 제공된 재무 데이터, 신문 1면을 다룹니다. 여기에 3,646자 다국어 지식 월, 3,812자 6단 신문, 3,538자 4계층 중첩 UI라는 세 가지 스트레스 테스트를 추가했습니다.
결과는 분명합니다. 공식 주장은 실제 능력에 기반하지만, Qwen Image 3은 결정론적 레이아웃 도구가 아닙니다. 모바일 UI에는 불필요한 사선 문자 세 개와 가짜 텍스트가 생겼고, 와이드 장면은 드론 네 대를 다섯 대로, 다리 두 개를 세 개로 그렸습니다. 이미지 편집은 올바른 컵을 바꾸고 문구를 보존했지만 해상도를 1792×2400에서 1072×1440으로 낮추고 비대상 영역의 픽셀도 일부 바꿨습니다.
실전 규칙은 네 가지입니다.
시각 구조, 정보 밀도, 텍스트와 이미지의 조합이 중요할 때 Qwen Image 3을 사용합니다
정확한 원문과 데이터를 제공하고, 모델이 사실을 지어내게 하지 않습니다
공개 전에 모든 글자, 숫자, 수식, 영역, UI 관계를 검수합니다
사실, 원본 데이터, 편집 가능한 파일은 생성된 비트맵 밖에 보관합니다
무드보드나 시각 방향안은 작은 오류를 허용할 수 있습니다. 시험지, 과학 자료, 가격표, 금융 차트, 제품 UI, 공공 정보는 다릅니다. 명시적인 QA 체크리스트를 통과하기 전까지는 모두 초안으로 봐야 합니다.
Qwen-Image-3.0이란 무엇이며 아직 공개되지 않은 것은 무엇입니까?
공식 출시에서는 **“진짜”**라는 한 단어로 모델을 설명합니다. Qwen은 이를 세 가지 영역으로 나눕니다.
리치 콘텐츠 — 긴 지침과 신문, 스토리보드, 시험지, 프레젠테이션, 중첩된 인터페이스와 같은 조밀한 레이아웃.
진정한 세부 정보 — 작은 텍스트에 모공, 머리카락, 피부, 물리적 소재 등 미세한 시각적 질감을 더한 것입니다.
깊은 지식 — 다국어 렌더링, 친숙한 소프트웨어 및 소비자 인터페이스, 풍부한 지식 구성.
이번 출시에서는 9개의 개별 이미지를 조합하는 대신 한 번의 패스로 생성된 완전한 3×3 인포그래픽을 보여줍니다. 이는 의미있는 제품 방향입니다. 이는 또한 증명의 부담을 높입니다. 하나의 공식, 날짜, 레이블 또는 다이어그램이 잘못된 경우 9개의 깨끗한 영역으로는 충분하지 않습니다.
2026년 7월 25일 현재 로그인된 공식 Qwen Chat 계정에서 Qwen-Image-3.0을 확인하고 사용할 수 있습니다. 새로운 이미지 대화는 기본적으로 Qwen-Image 2.0으로 설정되어 있으므로 모든 테스트 전에 Qwen-Image 3.0을 명시적으로 선택하고 제출 후 보이는 모델 라벨을 확인했습니다.
Alibaba Cloud는 이제 API 모델 ID qwen-image-3.0-pro를 문서화하지만 일반 가용성이 아닌 초대 전용 미리 보기 상태입니다. 문서화된 중국 본토 제한은 분당 요청 1개이며, 가격 페이지에는 내구성 있는 일반 공급 가격이 아닌 기간 한정 무료 미리 보기가 나열되어 있습니다. 우리는 여전히 다운로드 가능한 3.0 가중치, 공개 3.0 모델 카드, 기술 보고서, 라이센스, 매개변수 수 또는 고정된 최대 출력 해상도를 확인할 수 없습니다. 공개 Qwen-Image 저장소는 3.0 릴리스 항목을 추가하지 않았습니다.
그 구별이 중요합니다:
항목
2026년 7월 25일 기준 확인 상태
공식 출시
확인됨
Qwen Chat 사용 가능 여부
로그인된 계정에서 확인
3.0 API 모델 ID
qwen-image-3.0-pro
API 제공 상태
초대 전용 프리뷰
API 가격 및 요청 제한
프리뷰 기간 한시적 무료; 중국 본토에서 분당 1회
다운로드 가능한 3.0 가중치
확인하지 못함
3.0 모델 카드 / 기술 보고서
확인하지 못함
3.0 오픈소스 라이선스
확인하지 못함
최대 출력 해상도
확인하지 못함
이전 Qwen-Image 릴리스가 공개되었기 때문에 3.0이 오픈 소스라고 추론하지 마십시오. 소비자 채팅 제품에서 프로덕션 API 계약을 추론하지 마세요.
Qwen-Image-2.0에서 달라진 점
Qwen-Image-2.0은 이미 전문 인포그래픽, 통합 생성 및 편집, 기본 2K 출력, 대략 1K 토큰 지침 및 더 가벼운 아키텍처를 중심으로 포지셔닝되었습니다. 3.0 스토리는 '텍스트를 통한 더 나은 이미지 생성'에서 '한 번에 전체 문서와 같은 비주얼 생성'으로 나아갑니다.
비교 항목
Qwen-Image-2.0
Qwen-Image-3.0
지시문 길이
약 1K 토큰
최대 약 4.5K 토큰
대표 결과물
인포그래픽 또는 단일 이미지
신문, 시험지, 스토리보드, 프레젠테이션, 중첩 UI, 고밀도 인포그래픽
텍스트 관련 주장
강력한 텍스트 렌더링
약 10px 크기의 작은 글자
지식 관련 주장
생성 및 편집 품질
지식 집약적 구성과 익숙한 인터페이스
공개 배포 상태
일반 제공 API 예시
qwen-image-3.0-pro 초대 전용 프리뷰
실질적인 변화는 단순히 “더 많은 토큰”을 받는 데 있지 않습니다. 서로 독립적인 제약이 동시에 많아져도 계층 관계를 보존하려는 시도에 있습니다. 그래서 구조 완성도와 내용 정확도를 따로 평가했습니다.
테스트 방법: 시각적 문서에는 아름다움 점수 이상의 것이 필요합니다.
모든 테스트 기록:
진입점 및 눈에 보이는 모델 라벨
생성 날짜
요청된 치수와 실제 치수
생성 시간
총 시도 횟수 및 첫 번째 사용 가능한 시도 횟수
정확한 텍스트 오류
사실 또는 계산 오류
레이아웃 및 지역 오류
UI 의미 오류
편집을 위한 비대상 드리프트
예상 수동 수정 시간
우리는 하나의 전체 점수를 부여하지 않습니다. 하나의 숫자에 중요한 실패가 숨겨져 있습니다. 대신 각 출력은 7가지 차원에서 검토됩니다.
차원
우리가 확인하는 것
텍스트 정확도
대소문자, 문장부호, 숫자, 기호, 줄바꿈, 철자
사실적 정확성
날짜, 계산, 과학적 진술, 단위 및 제공된 데이터
레이아웃 준수
영역 수, 순서, 상대 위치, 누락 및 중복 모듈
UI 의미론
계층 구조, 구성 요소 관계, 터치 대상 및 친숙한 제품 논리
편집 보존
요청한 편집 내용 이외의 내용이 변경되었는지 여부
시각적 품질
재질, 조명, 인체 구조, 구성, 국소 아티팩트
워크플로 효율
대기 시간, 재시도, 첫 시도 사용 가능 여부, 수동 수정 시간
아래의 모든 출력은 로그인된 공식 Qwen Chat 웹 제품에서 2026년 7월 25일에 생성되었습니다. 유지된 각 결과는 눈에 보이는 Qwen-Image 3.0 라벨을 명시적으로 선택하고 확인한 후의 첫 번째 시도입니다. 소비자 UI는 기계가 읽을 수 있는 타이밍을 노출하지 않으므로 대기열 시간은 대략적인 것입니다. Qwen은 이 인터페이스에서 프롬프트 확장 스위치를 노출하지 않으므로 내부 프롬프트 재작성이 비활성화되었다고 주장할 수 없습니다.
테스트 1~10에서는 크기 조정 없이 품질 90 WebP로 변환된 다운로드된 출력을 사용합니다. 테스트 11-13에서는 크기 조정 없이 최적화된 WebP 복사본을 사용합니다. 모든 이미지는 CDN에서 기본 픽셀 크기로 제공됩니다. 모든 테스트에 사용되는 전체 프롬프트는 해당 결과 아래에 나타납니다. 기사를 계속 읽을 수 있도록 세 개의 가장 긴 프롬프트가 기본적으로 축소됩니다.
테스트 1: 조밀한 3×3 인포그래픽 및 정확한 원문
이 테스트는 레이아웃 성공과 콘텐츠 성공을 구분합니다. 여기에는 9개 지역, 27개 필수 글머리 기호, 수식, 상태 코드 및 정확한 레이블이 포함되어 있습니다.
결과: 2048×2048, 약 173초, 1회 시도. 9개 지역 모두 요청한 순서대로 나타났습니다. 제목, 과학적 설명, 상태 코드 및 색상 방정식은 읽기 쉽고 정확합니다. 두 개의 문자 수준 편차로 인해 문자 그대로의 완벽한 점수가 방지됩니다. 복리 표현식은 소스 문자 ^(nt)를 유지하는 대신 실제 위 첨자로 조판되었으며 이진 검색 다이어그램에는 추가 R 레이블이 포함되어 있습니다. 예상 수동 복구: 편집 가능한 레이아웃에서 1~2분 정도 소요되지만 비트맵 자체는 편리하게 복구할 수 없습니다.
프롬프트:
Create a square 1:1 educational infographic with a 3×3 grid on off-white. Each cell has a navy title bar, one simple diagram, and only the specified copy. Do not add, remove, paraphrase, translate, or repeat text.1 WATER CYCLE: Evaporation—liquid becomes vapor; Condensation—vapor forms clouds; Precipitation—water returns to Earth.2 PHOTOSYNTHESIS: Inputs—water, carbon dioxide, sunlight; Output—glucose and oxygen; Location—chloroplasts.3 NEWTON'S LAWS: First—motion stays unchanged without net force; Second—F = ma; Third—every action has an equal opposite reaction.4 BINARY SEARCH: Requires a sorted list; Compare with the middle value; Time complexity—O(log n).5 COMPOUND INTEREST: Formula—A = P(1 + r/n)^(nt); P is the principal; A is the final amount.6 DNA: Bases—A, T, C, G; Shape—double helix; A pairs with T; C pairs with G.7 SUPPLY AND DEMAND: Higher price can reduce demand; Higher price can increase supply; Equilibrium is where curves meet.8 HTTP STATUS: 200 OK; 404 Not Found; 500 Internal Server Error.9 COLOR MIXING: Red + blue = magenta; Blue + green = cyan; Red + green = yellow.Use consistent editorial styling. All text legible. No logo, watermark, or footer.
테스트 2: 작은 텍스트, 공식 및 학술 페이지
단지 소스와 유사한 공식은 실패입니다. 우리는 소수, 극한, 적분 범위, 위 첨자, 빼기 기호 및 모든 숫자를 확인합니다.
결과: 1792×2400, 약 89초, 1회 시도. 극한, 도함수, 지수, 적분 범위, 소수, 대수 및 분수를 포함하여 다섯 가지 수학적 설명이 모두 정확합니다. 제목, 날짜, 바닥글이 정확합니다. Name: 이후에 요청된 밑줄 문자는 일반적인 수평 규칙이 되었기 때문에 수학은 통과하지만 엄격한 문자 보존은 통과하지 못합니다. 예상 수동 복구: 소스를 편집 가능한 상태로 유지하는 경우 1분 미만입니다.
프롬프트:
Create a portrait A4 mathematics practice sheet, photographed flat from directly above, black text on white paper.Exact title: "Limits and Derivatives — Practice Sheet"Exact subtitle: "Name: ____________ Date: 2026-07-25"Include exactly these five numbered items:1. lim(x→0) sin(x)/x = 12. d/dx [x³ + 2x² − 5x + 7] = 3x² + 4x − 53. f(x) = e^(2x), therefore f′(x) = 2e^(2x)4. ∫₀¹ 3x² dx = 15. If y = ln(x² + 1), then dy/dx = 2x/(x² + 1)Footer exactly: "Check every exponent, limit, fraction, and derivative symbol before submitting."No handwriting, extra formulas, logo, or watermark.
테스트 3: 다국어 텍스트 렌더링
이 테스트는 6가지 쓰기 체계를 사용하며 아랍어에 동등한 중요성을 부여합니다. 정확한 철자법, 문자 혼합, 방향, 구두점, 모델이 조용히 장식 문구를 추가하는지 여부를 확인합니다.
결과: 1696×2528, 약 112초, 1회 시도. 영어, 중국어 간체, 일본어, 한국어, 스페인어 및 아랍어가 모두 제공된 문자열과 일치합니다. 아랍어는 오른쪽에서 왼쪽으로 렌더링되며 일곱 번째 줄이나 장식적인 의사 텍스트는 나타나지 않습니다. 시각적 크기는 완벽하게 동일하지 않습니다. 즉, 영어 줄이 더 넓습니다. 하지만 계층 구조가 언어 수준을 낮추지는 않습니다. 예상 수동 수리: 없음.
프롬프트:
Create a portrait international bookstore poster with a dark green background, cream paper texture, and one central open book. It must contain exactly these six lines and no other text:Stories Across Borders跨越边界的故事国境を越える物語국경을 넘는 이야기Historias sin fronterasحكايات بلا حدودOne language per line, exact spelling, Arabic right-to-left, equal visual importance. No logo, watermark, or invented characters.
테스트 4: 현실적인 UI와 올바른 UI 로직 비교
인터페이스는 실제 제품처럼 작동하지 않으면서도 그럴듯해 보일 수 있습니다. 여기서 중요한 제약은 각 댓글 작성자가 댓글 텍스트 위에 표시되어야 한다는 것입니다.
결과: 1536×2752, 약 157초, 1회 시도. 게시물 계층 구조, 작성자 3명, 댓글 순서, 작업 수, 하단 탐색이 모두 정확합니다. 각 작성자는 일치하는 댓글 위에 표시됩니다. 여전히 복사 청결성에 실패합니다. 모든 주석 앞에 백슬래시와 같은 문자 모양이 흩어지고, 이미지 미리 보기에는 가상 CJK 문자가 포함되어 있습니다. 이것은 프로덕션 스크린샷이 아닌 설득력 있는 UI 모형입니다. 예상 수동 수리: 디자인 파일에서 3~5분.
프롬프트:
Create a portrait 390×844 dark-mode mobile social app screenshot.Top: avatar, centered "Following", search and settings.Post hierarchy: "Maya Chen", "@mayac", "2h", text "Testing a multilingual poster workflow today.", one landscape preview, then reply 12, repost 28, like 316, bookmark.Exactly three comments, username ABOVE comment text:Leo Park — "The spacing feels much better now."Sofia Ruiz — "Can you test Spanish text next?"Amir Haddad — "Please include Arabic direction too."Bottom navigation: Home, Search, Create, Notifications, Profile; Home active. Believable spacing and touch targets. No extra comments, numbers, device frame, logo, or watermark.
테스트 5: 정확한 객체 수와 공간 제약
개체 레이아웃 프롬프트는 검수하기 쉽습니다. "거의 8개 개체"는 주관적인 결과가 아닙니다.
결과: 2048×2048, 약 88초, 한 번의 시도. 정확히 8개의 개체 범주가 나타나고 모든 항목이 완전히 표시되며 8개 모두 할당된 영역을 차지합니다. 중복된 카테고리나 장식적인 추가 항목이 없습니다. 프롬프트에서는 텍스트도 금지하므로 여권은 의도적으로 단순하게 표시됩니다. 예상 수동 수리: 없음.
프롬프트:
Create a square top-down product photograph on a matte charcoal table. Show exactly eight objects and nothing else:1 red passport at top-left2 silver fountain pen at top-center3 black compact camera at top-right4 green ceramic cup at middle-left5 closed blue notebook at exact center6 white earbuds case at middle-right7 yellow keychain at bottom-left8 pair of round brown sunglasses at bottom-rightEvery object fully visible, separated, only in its assigned position. Soft studio shadows, realistic materials. No text, logo, watermark, or duplicates.
테스트 6: 제공된 사실을 포함한 금융 인포그래픽
모델은 모든 번호를 수신합니다. 우리는 총계와 백분율을 다시 계산한 다음 시각적인 개선으로 인해 데이터가 변경되었는지 확인합니다.
결과: 2752×1536, 약 138초, 1회 시도. 제공된 모든 값과 라벨은 12.4, 15.1, 14.5, 42.0, 45.0, 3.0, 93.3%로 정확합니다. 막대는 4월5월6월 순서를 따르며 5월이 가장 높고 총 합계가 정확하며 추가 측정항목이 만들어지지 않았습니다. 예상 수동 수리: 없음.
프롬프트:
Create a landscape financial infographic using only this data.Title: "Northwind Q2 Revenue"Subtitle: "All values in USD millions"April 12.4; May 15.1; June 14.5; Quarter total 42.0; Quarter target 45.0; Gap to target 3.0.Include one April-May-June bar chart, progress "42.0 of 45.0", callout "May was the strongest month", and callout "Target attainment: 93.3%". Every number, label, bar order, and calculation must match exactly. No other metrics, conversion, logo, or watermark.
테스트 7: 포토리얼리즘, 연령, 손 및 재료 세부 사항
이것은 아름다운 초상화가 아닙니다. 소스 장면은 이후의 보존 테스트에도 입력이 됩니다.
결과: 1792×2400, 약 78초, 1회 시도. 그 결과 믿을 수 있는 연령 디테일, 왼쪽의 창 조명, 각각 다섯 손가락이 있는 자연스러운 손, 점토 잔여물, 재료 질감, 오른쪽의 흰색 컵 및 정확한 카드 텍스트 FIRE TO 1220°C가 생성되었습니다. 가로 세로 비율이 지정되지 않았음에도 불구하고 구성이 세로 방향으로 되었습니다. 이는 즉각적인 위반이 아니라 제품 선택입니다. 예상 수동 수리: 없음.
프롬프트:
Documentary-style environmental portrait of a 58-year-old female ceramic artist seated at a wooden worktable in her studio. Natural window light from the left. Visible age lines, realistic pores, a few gray hairs, clay dust on both hands, small wrinkles in a linen apron, unfinished stoneware bowls on wooden shelves, subtle fingerprints on wet clay.Place one plain white ceramic cup on the right side of the table. Place a small paper studio card behind it containing exactly the text "FIRE TO 1220°C".Neutral color grading, 50mm lens look, shallow but believable depth of field. Preserve natural asymmetry and real skin texture. No glamour retouching, no waxy skin, no extra fingers, no other text, no logo, no watermark.
테스트 8: 이미지 편집 및 비대상 보존
테스트 7의 결과가 유일한 입력으로 사용됩니다. 요청한 편집 내용은 의도적으로 작습니다. 다른 모든 변경 사항은 드리프트로 간주됩니다.
원본: 1792×2400편집: 1072×1440
결과: 약 61초, 1회 시도. 컵은 하나의 골드 초승달이 있는 진한 코발트 블루가 되며, 사람, 손, 앞치마, 빛의 방향, 선반, 테이블, 점토 및 정확한 발사 카드가 시각적으로 가깝게 유지됩니다. 이는 픽셀 로컬 편집이 아닙니다. 서비스는 두 치수를 모두 약 40% 줄이고 소스 크기를 편집된 치수로 조정한 후 보수적인 컵 마스크 외부의 평균 절대 RGB 채널 차이는 0-255 스케일에서 9.4입니다. 편집은 시각적으로 유용하지만 추가 편집을 연결하기 전에 해상도와 비대상 보존을 확인해야 합니다. 예상 수동 수리: 이 요청에는 없음; 제작 시에는 재업스케일링이나 소스 합성이 필요할 수 있습니다.
프롬프트:
Edit only the ceramic cup on the right side of the table: change its color from white to deep cobalt blue and add a small gold crescent on its front.Preserve every other detail as closely as possible, including the person's identity, face, hands, clothing, lighting, camera angle, table objects, background shelves, and the exact existing text "FIRE TO 1220°C". Do not move, resize, add, or remove anything else.
테스트 9: 신문 레이아웃 및 긴 카피
이 테스트에서는 열, 계층 구조, 정확한 원문, 날짜 처리 및 모델이 페이지를 더욱 완벽하게 보이도록 추가 헤드라인을 만드는지 여부를 확인합니다.
결과: 1792×2400, 약 141초, 1회 시도. 마스트헤드, 날짜, 메인 헤드라인, 데크, 세 개의 체크리스트 라인, 날씨 문구, 바닥글이 모두 일치합니다. 출력에는 허위 기사 텍스트가 추가되지 않으며 요청된 사진 주위에 신뢰할 수 있는 첫 페이지 계층 구조가 유지됩니다. 예상 수동 수리: 없음.
프롬프트:
Create a portrait broadsheet newspaper front page photographed flat overhead. Use exactly this readable copy and no other text.Masthead: "THE DAILY WORKBENCH"Date: "Saturday, July 25, 2026"Main headline: "Small Teams Turn Visual Drafts Into Deliverables"Deck: "A new workflow keeps prompts, source data, revisions, and approvals connected."Left headline: "Three Checks Before Publishing"Bullets: "Verify every number"; "Compare every label"; "Preserve the editable source"Right headline: "Weather"Copy: "Morning cloud, afternoon sun, high 24°C."Footer: "Edition 01 • Price $2.00"Black, warm white, muted red; one photo of a designer reviewing a proof; believable hierarchy and columns. No invented copy, logo, or watermark.
테스트 10: 극도로 넓은 장면과 로컬 디테일
넓은 장면은 반복되는 질감, 취약한 해부학적 구조, 공칭 해상도와 유용한 디테일 간의 격차를 노출합니다.
결과: 2752×1536, 약 96초, 1회 시도. 장면에는 정확히 3개의 태양광 보트, 비행선, 다양한 타워, 20명 이상의 사람들, 눈에 띄는 걷기, 자전거 타기, 운동, 그림 그리기, 피크닉 및 체스 활동 등 세 가지 분명히 다른 영역이 있습니다. 카운트 준수 실패: 눈에 보이는 배달 드론이 4개가 아닌 5개 있고, 교량 구조물이 2개가 아닌 3개가 있습니다. 작은 인체 해부학은 페이지 크기에서는 허용되지만 기본 확대/축소에서는 부드럽습니다. 수동 수리 예상 시간: 물체 제거 또는 재생 시 5~10분.
프롬프트:
Create an ultra-wide 16:9 realistic future ecological city.Left third: residential towers with varied vertical gardens and maintenance walkways, no repeated facade.Center: river with exactly three solar passenger boats and two pedestrian bridges.Right: public park with at least 20 visible people doing distinct activities including walking, reading, cycling, chess, and exercise.Sky: exactly four delivery drones and one transparent passenger airship.Coherent daylight, scale, anatomy, natural materials, continuous city plan. No text, logo, watermark, cloned people or trees, repeated windows, malformed limbs, or impossible bridges.
극심한 스트레스 테스트: 긴 프롬프트, 조밀한 텍스트 및 중첩된 UI
공식 출시는 매력적인 샘플을 보여주는 것 이상의 역할을 합니다. 더 어려운 예는 긴 프롬프트를 수평 폭(완전한 3×3 지식 벽) 또는 수직 깊이(한 인터페이스에 더 구조화된 콘텐츠가 포함된 다른 인터페이스가 포함됨)와 결합합니다. 우리는 이 두 축을 중심으로 세 가지 새로운 테스트를 설계했습니다.
이는 일반 이미지 생성기에게는 의도적으로 무리한 브리핑입니다. 목표는 비트맵이 신문 레이아웃 도구, 현지화 작업 흐름 또는 코드 편집기를 대체해야 한다는 것을 증명하는 것이 아닙니다. 목표는 구조적으로 완전한 것과 문자 그대로 올바른 사이의 경계를 찾는 것입니다.
테스트
프롬프트 크기
구조적 결과
리터럴 실패
11. 극한의 3×3 지식 월
3,646자
9개 주제가 모두 엄격한 그리드 안에 배치됨
가장 작은 비라틴 문자 일부가 손상됨
12. 6단 브로드시트
3,812자
주요 신문 모듈이 모두 등장함
리드 기사와 일부 중국어 문구가 원문과 다름
13. 4계층 중첩 UI
3,538자
4개 인터페이스 계층과 6단계 런북이 모두 등장함
코드는 그럴듯하지만 구문 및 철자 오류가 있음
테스트 11: 극한의 3×3 다국어 지식 벽
이는 테스트 1보다 훨씬 더 어려운 버전입니다. 9개의 셀은 사고 명령, 공간 기하학, 유전체학, 제로 트러스트 네트워킹, 태풍 대응, 은행 통제, 12개 언어 길 찾기, 실험실 SOP 및 선박 준비 확인을 다루어야 합니다. 프롬프트에는 생략되거나 발명된 모듈을 금지하면서 공식, 표, 화살표, 좌표, 상태 레이블 및 12개의 스크립트가 혼합되어 있습니다.
결과: 2048×2048, 약 130초, Qwen-Image 3.0 시도 1회 유지. 이 모델은 요청된 9개 도메인과 일관된 시각적 시스템을 모두 갖춘 엄격한 3×3 그리드를 생성했습니다. 영어와 중국어 제목, 수식, 좌표, 대부분의 숫자 및 더 큰 표 항목은 놀라울 정도로 읽기 쉽습니다. 결과는 관련 없는 9개의 축소판이 아니라 하나의 디자인된 아티팩트로 읽혀집니다.
실패는 공식적인 작은 텍스트와 다국어 주장을 결합하기 가장 어려운 부분에서 정확하게 나타납니다. 몇몇 마이크로 크기의 러시아어, 아랍어, 힌디어 문자열의 형식이 잘못되었습니다. 작은 태풍 전설 사본과 몇 개의 네트워크 화살표 레이블이 의사 텍스트로 축소됩니다. 일부 소수 구두점은 마침표에서 쉼표로 현지화됩니다. 이는 구조적 완전성을 통과했지만 문자 그대로의 다국어 QA에는 실패했습니다.
테스트 11에 사용된 정확한 3,646자 프롬프트 보기
请用 Qwen-Image 3.0 一次性生成一张超高信息密度、正方形 1:1、清晰可读的专业“3×3 应用知识图谱”海报。它不是九张图拼接,而是一张统一设计系统中的完整九宫格;严格 3 行×3 列,共 9 格,不多不少。画布四周留 64px 外边距,格间留 28px 白色沟槽,每格都有细灰边框、独立标题栏、编号 01–09、图表区、正文区和页脚来源标签。全图使用瑞士国际主义信息设计:白底、深墨蓝文字、青色/橙色/红色作为状态色,网格严谨,印刷级排版。主标题精确写:“QWEN IMAGE 3 — EXTREME 3×3 KNOWLEDGE WALL”;副标题精确写:“Nine domains · one canvas · zero omitted labels”。所有引号中的文字必须逐字呈现,不得改写、翻译、漏字或生成乱码;正文允许 10–14px 视觉字号但仍需清晰。严禁水印、品牌误拼、额外面板、跨格元素、重复图标。第 01 格,标题精确写:“INCIDENT COMMAND / 事故指挥”。左侧画一条 5 节点时间轴,逐行精确写:“09:17 API latency > 2.0s”“09:21 Error rate reaches 8.4%”“09:26 Read replica isolated”“09:34 Cache warmed to 92%”“09:41 Service fully recovered”。右侧是四张 KPI 小卡:“P95 684 ms”“Errors 0.7%”“RPS 12,480”“MTTR 24 min”。底部红框写:“DECISION: HOLD DEPLOYMENT”。第 02 格,标题精确写:“SPATIAL GEOMETRY / 空间几何”。绘制透明立方体 ABCD–A₁B₁C₁D₁、对角线 AC₁、平面 BB₁D₁D 和 35° 角标。右侧严格排出三行公式:“|AC₁| = √(a²+b²+c²)”“cos θ = (u·v)/(|u||v|)”“V = |a·(b×c)|”。下方定理框逐字写:“If u·n = 0, then u ∥ plane Π.” 和中文:“向量与法向量垂直,则向量平行于平面。”第 03 格,标题精确写:“GENOMICS PIPELINE / 基因组流程”。从左到右画五步流程:“Sample → Extraction → Library → Sequencing → Variant Call”。画双螺旋、FASTQ 文件、覆盖度直方图、染色体 7 的局部放大。小表格三列标题:“Variant”“Depth”“Effect”,三行精确数据:“chr7:140453136 A>T | 812× | missense”“chr12:25398284 C>G | 406× | intronic”“chr17:7674220 G>A | 1,024× | stop gained”。页脚写:“Reference: GRCh38 · QC PASS”。第 04 格,标题精确写:“ZERO-TRUST NETWORK / 零信任网络”。画清晰架构图:左侧“USER DEVICE”经过“IDENTITY PROXY”进入中心“POLICY ENGINE”,再分流到“WEB APP”“POSTGRES”“OBJECT STORE”;每条箭头旁分别标注“mTLS”“OIDC”“short-lived token”“deny by default”。右下角放 2×2 状态卡:“Auth 99.99%”“Blocked 1,284”“Risk HIGH 03”“Key age 17d”。底部精确写:“Never trust. Always verify. Log every decision.”第 05 格,标题精确写:“TYPHOON BRIEFING / 台风简报”。画东亚沿海地图、台风路径 6 个时间点、同心风圈、颜色图例。路径标签精确写:“T+00 18.2°N 126.4°E”“T+12 19.7°N 124.8°E”“T+24 21.3°N 123.1°E”“T+36 23.8°N 121.6°E”“T+48 26.1°N 120.9°E”“T+60 28.4°N 121.7°E”。右侧风险表:“Wind 145 km/h — SEVERE”“Rain 280 mm — EXTREME”“Surge 2.4 m — HIGH”。警示条写:“EVACUATE LOW-LYING AREAS BEFORE 18:00”。第 06 格,标题精确写:“BANK CONTROL MATRIX / 银行内控矩阵”。画 4×4 表格,列标题:“Control”“Owner”“Frequency”“Evidence”;四行精确写:“Dual approval | Treasury | Daily | Signed ledger”“Limit review | Risk | Weekly | Exception log”“Access recertification | Security | Quarterly | IAM report”“Backup restore | SRE | Monthly | Recovery record”。右侧画环形图:“PASS 87%”“OPEN 9%”“OVERDUE 4%”。底部橙框精确写:“3 HIGH-RISK EXCEPTIONS REQUIRE ACTION”。第 07 格,标题精确写:“12-LANGUAGE WAYFINDING / 十二语导视”。画现代地铁换乘站平面图,中央圆形“PLATFORM 4”,八条彩色线路,四个出口。右侧必须逐行准确出现以下 12 行,不合并:“English — Central Station”“中文 — 中央车站”“日本語 — 中央駅”“한국어 — 중앙역”“Español — Estación Central”“Français — Gare Centrale”“Deutsch — Hauptbahnhof”“Italiano — Stazione Centrale”“Português — Estação Central”“Русский — Центральный вокзал”“العربية — المحطة المركزية”“हिन्दी — केंद्रीय स्टेशन”。底部写:“Exit C · Lift · Tickets · First Aid”。第 08 格,标题精确写:“LAB SOP / 实验室规程”。画分子结构、烧杯、移液器、离心机和四枚标准危险图标。右侧编号步骤逐字写:“1. Wear nitrile gloves and goggles.”“2. Add 25.0 mL buffer at 4°C.”“3. Centrifuge 12,000×g for 10 min.”“4. Transfer exactly 200 μL supernatant.”“5. Record batch ID before disposal.” 参数卡写:“pH 7.40 ± 0.05”“Temp 4°C”“RPM 13,200”“Timer 00:10:00”。红色页脚:“DO NOT MIX ACID WITH HYPOCHLORITE”。第 09 格,标题精确写:“SHIP-READINESS CHECK / 发布检查”。画 12 项双列核对清单,每项前有绿色勾或橙色圆点,文字精确为:“Schema migration reviewed”“Rollback tested”“Feature flag off by default”“Secrets rotated”“Error budget checked”“Accessibility AA”“Mobile 360px verified”“P95 under 800 ms”“Audit log retained”“Runbook linked”“On-call acknowledged”“Customer notice drafted”。右下角盖章精确写:“GO WITH CONDITIONS”。页脚版本号:“REV 3.0 · 2026-07-25 · OWNER: PLATFORM”。整张图必须在一张画布中维持九格互不干扰:每格视觉语言统一但内容图形各异;所有表格行列对齐;数字、标点、上下标、希腊字母、中文、阿拉伯文、天城文都清楚;无随机伪文字,无文本块缺失。优先保证文字准确性、九格完整性和可判读性,其次才是装饰。
테스트 12: 긴 형식의 사본이 포함된 6단 신문
기본 신문은 정확한 헤드라인과 짧은 카피의 작은 세트를 사용했습니다. 이 버전은 마스트헤드, 날짜 및 가격 라인, LUNAR WATER TREATY CLEARS FINAL VOTE라는 제목의 주요 스토리, 제공된 영어 단락 3개, 달 사진 및 캡션, KPI 카드, 꺾은선형 차트, 5행 시장 테이블, 4개의 파견, 중국어 섹션, 연구 공식 및 데이터 테이블, 브리핑 상자 및 문자 그대로의 바닥글이 포함된 실제 6열의 브로드시트를 요구합니다.
결과: 1792×2400, 약 75초, 1회 시도. 계층 구조가 훌륭합니다. 모든 주요 모듈이 존재하고 마스트헤드와 기본 헤드라인이 정확하며 KPI와 시장 테이블을 읽을 수 있으며 차트, 디스패치, 중국어 섹션, 방정식, 층서 다이어그램, 연구 테이블, 브리핑, 이메일 주소 및 페이지 번호가 모두 신문의 믿을 만한 위치를 차지합니다.
완벽하게 복사되지는 않습니다. 첫 번째 영어 문단에는 중복되거나 손상된 단어가 포함되어 있고, 일부 중국어 본문과 작성자가 제공된 소스와 다르며, 여러 개의 긴 문장이 의역되거나 단축되었습니다. 이미지는 매우 설득력 있는 편집 구성이지만 사본을 다시 조판하지 않고 게시하는 것은 안전하지 않습니다.
테스트 12에 사용된 정확한 3,812자 프롬프트 보기
请使用 Qwen-Image 3.0 生成一张竖版 4:5、2048px 级别、可直接印刷的真实英文数据报纸首页。它不是海报,而是一张完整 broadsheet newspaper front page:纸张有轻微米白纤维、墨色细微渗透、折痕和套印误差,但所有文字必须清晰。采用严格 6 栏网格、细黑分隔线、经典衬线正文字体、无衬线数据标签。主报头逐字写:“THE ORBITAL LEDGER”;其下细字逐字写:“Independent reporting for Earth, Moon and Mars”;左上日期:“FRIDAY, JULY 25, 2026”;右上:“VOL. 18 · NO. 207 · PRICE $3.50”。不得生成伪文字,不得用无意义 lorem ipsum,不得遗漏引号中的任何段落。所有正文保持真实报纸密度,最小字看起来约 10px 但放大可读。第一、二、三栏组成头版主稿。超大标题精确写:“LUNAR WATER TREATY CLEARS FINAL VOTE”。副标题精确写:“Twelve nations agree on shared extraction limits, emergency reserves and open telemetry after a 19-hour session.” 署名精确写:“BY MAYA CHEN · SCIENCE & POLICY EDITOR”。正文必须逐字排出以下三段,不改写:“GENEVA — Delegates approved the Lunar Water Accord at 04:12 local time on Friday, creating the first enforceable limits on polar ice extraction. The agreement assigns annual quotas, protects permanently shadowed craters, and requires every operator to publish machine-readable telemetry within sixty seconds.”“Negotiators resolved the final dispute by placing a six-month emergency reserve under joint control. Any release now requires three independent signatures: one from the host nation, one from the scientific council, and one from the civilian settlement network.”“Markets reacted cautiously. Oxygen futures fell 2.8 percent while launch-insurance shares rose. Engineers welcomed the data clause but warned that sensor calibration standards must be finished before the treaty takes effect on January 1, 2027.”主稿中间放一张写实月球南极基地照片:低角度阳光、机械臂、冰样品罐、三名宇航员;照片说明逐字写:“Survey team 7A returns from Shackleton Ridge with sealed core samples. PHOTO: LUNA PRESS POOL”。第四栏顶部做数据模块,标题:“THE NUMBERS”。四行 KPI 精确写:“12 signatory nations”“18.6 million liters annual cap”“15% emergency reserve”“60 seconds telemetry delay”。其下画折线图标题:“WATER OUTPUT, 2027–2032”,横轴年份 2027、2028、2029、2030、2031、2032,纵轴标注“million liters”,三条线图例严格写:“Approved quota”“Projected demand”“Protected reserve”。图下注释:“Forecast range: ±6.2%”。第五栏顶部标题:“MARKET SIGNALS”。画 5 行金融表格,列标题严格为:“Asset”“Close”“Change”。数据逐行精确写:“OXY-FUT 84.20 −2.8%”“HELIO 118.44 +1.6%”“CISLUNAR 72.09 +0.4%”“ICE-INDEX 204.81 −1.1%”“LAUNCH-RE 51.77 +3.2%”。表下短文逐字写:“Volume was 31 percent above the 20-day average. Analysts cited lower scarcity risk and stronger compliance spending.”第六栏顶部标题:“FIELD DISPATCHES”。列出四条带地点的小稿,每条标题和句子都要准确:“SHACKLETON — Power restored” 下写:“A damaged 40 kV cable was isolated at 06:30; habitats remained on battery for eleven minutes.”“MARE IMBRIUM — Dust alert” 下写:“Electrostatic dust reached level orange. Exterior maintenance is paused until 14:00 UTC.”“TYCHO — School opens” 下写:“The first bilingual primary school welcomed 86 students from nine settlement zones.”“L1 GATEWAY — Docking delay” 下写:“Cargo vehicle Kestrel-4 will berth six hours late after a guidance-software rollback.”页面下半部横跨前三栏做中文栏目。栏目名准确写:“中文速览”。标题:“月球水资源公约通过最终表决”。正文两段逐字写:“十二个参与国同意公开开采遥测数据,并为科研、民用与应急储备设定独立配额。公约将永久阴影区列为重点保护区域,任何商业作业都必须保留完整审计记录。”“联合执行委员会每季度发布一次透明度报告。若连续两次未能上报数据,相关运营方将自动暂停许可证,直至第三方完成安全复核。”右下角署名:“记者 陈雨 · 日内瓦”。页面下半部中间做科研插页,标题:“RESEARCH NOTE: ICE STABILITY”。准确排出公式:“∂C/∂t = D∇²C − kC” 和 “T_eq = 112 ± 4 K”。画三层剖面:“REGOLITH 0–18 cm”“MIXED ICE 18–64 cm”“DENSE ICE >64 cm”。旁边小表格列标题:“Depth”“Purity”“Confidence”,三行:“22 cm | 31% | 0.82”“48 cm | 67% | 0.94”“81 cm | 91% | 0.97”。注释逐字写:“n = 214 cores · instrument drift corrected”。页面最下方横贯六栏的短讯带标题:“BRIEFING”。依次排出四条:“Solar weather: G2 storm watch begins 16:00 UTC.” “Earth desk: Pacific heatwave breaks 14 records.” “Mars desk: Valles Marineris relay returns to service.” “Culture: The zero-gravity orchestra announces an autumn tour.” 最底部页脚精确写:“orbitalledger.news · Corrections: corrections@orbitalledger.news · Printed with 62% recycled fiber”。右下角印页码:“A1”。整体要求:像真实获奖报纸设计,不像 AI 海报;六栏从头到尾对齐;长段落完整;英文大小写、连字符、百分号、邮箱、数学符号、中文标点准确;照片与图表服务于内容但不遮挡文字;绝无随机字母串、重复段落、水印或多余标题。优先保证所有指定文本逐字可读。
테스트 13: 4계층 중첩 소프트웨어 인터페이스
이 테스트는 한 장의 이미지 안에서 네 단계의 의미 관계를 유지하도록 요구합니다. 가장 바깥은 VS Code 스타일 데스크톱이고, 오른쪽에는 Atlas Ops 사고 대시보드를 띄운 브라우저가 들어갑니다. 그 대시보드 위에는 모바일 협업 창이 겹치며, 모바일 메시지 안에는 다시 런북 카드가 들어갑니다. 여기에 소스 코드, 터미널 로그, KPI, 네트워크 맵, 그래프, 사고 표, 채팅 메시지, 6단계 대응 절차까지 모두 담아야 합니다.
결과: 2752×1536, 약 125초, 1회 시도. 4개 레이어가 모두 존재하며 해당 레이어의 경계를 즉시 이해할 수 있습니다. 대시보드에는 지도, 그래프, KPI 계층 구조, 타임라인 및 사건 테이블이 유지됩니다. 전화기에는 요청된 대화가 포함되어 있으며 가장 안쪽 Runbook에는 소유자, 롤백, 확인 및 규칙 필드를 포함한 6개 단계가 모두 보존됩니다. 이는 UI 구성 및 의미 중첩을 강력하게 보여줍니다.
코드 편집기가 약점입니다. 함수 이름과 경로가 드리프트되고, function의 철자가 틀리고, 중괄호와 줄 구조가 일치하지 않으며, 일부 줄이 중복됩니다. 10진수 값은 구두점도 변경합니다. 결과는 제품 컨셉 이미지로는 훌륭하지만 문자 그대로의 코드 스크린샷으로는 위험합니다. 그럴듯한 구문은 유효한 구문이 아닙니다.
테스트 13에 사용된 정확한 3,538자 프롬프트 보기
请用 Qwen-Image 3.0 一次生成一张 16:9、2560×1440 视觉分辨率、极清晰的“四层嵌套软件界面”真实产品截图。核心测试是纵向语义深度:外层是 VS Code;VS Code 的右侧预览里嵌套一个浏览器运维仪表盘;仪表盘中弹出一个手机协作聊天窗口;聊天里又嵌入一张微型事故处置卡片。四层必须同时完整、边界清晰、透视一致,不能把某层的按钮或文字串到另一层。所有引号里的文本必须逐字呈现,代码标点、日志时间、表格数字、手机消息和最内层卡片都要可读。不要水印,不要随机伪文字,不要重复窗口。第 1 层:完整 VS Code 深色界面,占整张图。顶部 macOS 标题栏和交通灯按钮,窗口标题精确写:“atlas-ops — Visual Studio Code”。菜单精确写:“File Edit Selection View Go Run Terminal Help”。左侧 Activity Bar 有 Explorer、Search、Source Control、Run、Extensions 五个标准图标。Explorer 标题:“ATLAS-OPS”,文件树准确显示:“src”“app”“api”“incidents”“route.ts”“components”“IncidentPanel.tsx”“lib”“telemetry.ts”“package.json”“README.md”。打开的标签页有:“route.ts”“IncidentPanel.tsx”“telemetry.ts”。底部状态栏逐项写:“main*”“0 errors”“2 warnings”“Ln 18, Col 27”“Spaces: 2”“UTF-8”“TypeScript”“Prettier”。VS Code 中央编辑区打开 src/app/api/incidents/route.ts,显示带语法高亮、行号 1–18 的 TypeScript 代码,代码必须尽量准确排出:“import { NextResponse } from 'next/server'”“import { getIncidentSummary } from '@/lib/telemetry'”“”“export async function GET() {”“ const summary = await getIncidentSummary({”“ service: 'payments',”“ windowMinutes: 30,”“ includeRegions: ['us-east', 'eu-west', 'ap-south'],”“ })”“”“ return NextResponse.json({”“ generatedAt: '2026-07-25T09:42:18Z',”“ status: summary.errorRate > 0.02 ? 'degraded' : 'healthy',”“ summary,”“ })”“}”当前行高亮在第 13 行。左下 Terminal 面板标题精确写:“TERMINAL OUTPUT DEBUG CONSOLE PORTS”。终端命令与输出逐行写:“$ npm run dev”“▲ Next.js 16.2.6”“✓ Ready in 842ms”“GET /api/incidents 200 in 47ms”“WARN payments error_rate=0.034 region=eu-west”“INFO fallback_route=active recovered=92%”。第 2 层:VS Code 右侧约 44% 宽区域是内嵌浏览器预览,但仍在 VS Code 编辑器分栏内。浏览器地址栏精确写:“https://ops.atlas.example/incidents/INC-2048”。页面是浅色专业运维仪表盘,页眉左侧标志:“ATLAS OPS”,面包屑:“Incidents / INC-2048”,右侧绿色状态:“LIVE · updated 09:42:18 UTC”。主标题:“Payment authorization latency”。红色标签:“SEV-1 ACTIVE”。副标题:“Elevated p95 and issuer timeouts in EU West”。四张指标卡逐字写:“P95 LATENCY 2.84 s”“ERROR RATE 3.4%”“AFFECTED 18,240”“RECOVERED 92%”。仪表盘左中画欧洲地图,三枚节点标签:“DUBLIN 4.1%”“FRANKFURT 3.7%”“PARIS 2.9%”,红色链路从 Dublin 指向 Frankfurt。右中折线图标题:“Latency by region · last 30 min”,图例:“eu-west”“us-east”“ap-south”,横轴从 09:12 到 09:42,红线在 09:31 峰值 3.2s。下方时间线表格列标题:“Time”“Event”“Owner”“State”,四行精确写:“09:17 | Alert fired | SRE Bot | OPEN”“09:23 | Traffic shifted 20% | Mina K. | DONE”“09:31 | Issuer timeout spike | Payments | WATCH”“09:39 | Cache warm 92% | Leo R. | DONE”。右下按钮:“OPEN RUNBOOK”“ACKNOWLEDGE”“START BRIDGE”。第 3 层:仪表盘右下角覆盖一个约页面高度 48% 的手机协作窗口,外形像真实现代手机但完全在浏览器预览内部,不可溢出到 VS Code。手机顶部频道名:“# incident-inc-2048”,旁边小字:“8 members · bridge live”。消息按时间排列,头像与气泡清晰:“09:24 Mina — Shifted 20% of EU traffic. Error rate is falling.”“09:28 Leo — Cache warm-up reached 74%. ETA six minutes.”“09:33 SRE Bot — Threshold breached: issuer_timeout > 3.0%.”“09:37 Priya — No data loss. Retries remain idempotent.”“09:41 Mina — Recovery at 92%. Holding deployment until 10:15.”输入框占位文字:“Message #incident-inc-2048”,右侧按钮:“Send”。顶部红点提示:“1 unresolved decision”。第 4 层:在手机里 Priya 的消息下方嵌一张小而完整的事故处置卡片,像聊天附件,卡片标题精确写:“RUNBOOK R-17 · PAYMENT DEGRADATION”。橙色状态条:“CURRENT STEP 4 OF 6”。六步纵向流程必须出现并带编号:“1 Confirm telemetry”“2 Freeze deploys”“3 Shift 20% traffic”“4 Warm issuer cache”“5 Validate retries”“6 Restore gradually”。第 1–3 步绿色打勾,第 4 步橙色高亮,第 5–6 步灰色。卡片底部三项细字:“Owner: Payments SRE”“Rollback: ready”“Next check: 09:46 UTC”。最下方红色规则:“STOP IF ERROR RATE > 5%”。整体要求:外层 VS Code 像真正桌面应用,内层浏览器像真正 SaaS,第三层手机像真实协作工具,第四层卡片像真实附件;四层尺度递减但每层关键文字仍清晰;每一层只显示属于自己的导航和控件;代码、终端、指标、地图、折线图、时间线、手机消息、六步 runbook 全部存在。优先级依次是:层级完整 > 文本准确 > UI 真实性 > 装饰。
세 가지 결과를 함께 보면 현재 모델의 상한이 선명해집니다. Qwen-Image-3.0은 한 번의 생성으로 많은 모듈과 그 관계를 유지하는 데 강합니다. 그러나 글자가 작아지고, 문자 체계가 늘어나고, 내용이 코드에 가까워질수록 구조보다 정확도가 먼저 무너집니다. 결과물을 납품할지 시각 초안으로 남길지는 이 경계를 기준으로 판단해야 합니다.
Qwen Image 3이 여전히 실패하는 경우
실패 카테고리는 순위표보다 더 중요합니다.
깨끗한 텍스트는 여전히 잘못된 텍스트일 수 있습니다. 가독성은 정확성이 아닙니다.
올바른 레이아웃에는 잘못된 지식이 포함될 수 있습니다. 다이어그램과 라벨은 별도의 확인이 필요합니다.
현실적인 인터페이스는 인터페이스 논리를 위반할 수 있습니다. 픽셀뿐만 아니라 계층 구조와 관계도 검토합니다.
원패스 밀도는 검수 비용을 증가시킵니다. 이미지당 콘텐츠가 많을수록 자동 오류가 발생할 가능성이 더 커집니다.
비트맵은 편집 가능한 문서가 아닙니다. 생성된 출력 외부에서 원문, 데이터 및 레이아웃 의도를 보존합니다.
요청한 편집이 성공해도 다른 영역이 달라질 수 있습니다. 인물의 정체성, 문구, 조명, 구성을 입력 이미지와 비교해야 합니다.
글자가 작아질수록 다국어 정확도가 떨어집니다. 여섯 줄짜리 다국어 포스터에서는 통과한 문자 체계도 조밀한 그리드의 마이크로카피에서는 무너질 수 있습니다.
타당한 코드는 실행 가능한 코드가 아닙니다. 모든 토큰이 독립적으로 확인되지 않는 한 생성된 편집기 스크린샷을 시각적 개념으로 취급합니다.
출시 후 발표된 초기 타사 비교에서는 동일한 중요한 차이가 보고되었습니다. Qwen은 아랍어 텍스트 오류, 과학 포스터의 지식 오류, 소셜 UI의 정보 계층 오류를 계속 발생시키면서 설득력 있는 레이아웃과 사실적인 장면을 생성할 수 있었습니다. 우리는 이러한 관찰을 자체 결과가 아닌 테스트 가설로 취급합니다.
재사용 가능한 Qwen Image 3 프롬프트 공식
긴 프롬프트는 프로덕션 브리핑처럼 작동할 때 더 잘 작동합니다.
[deliverable type][canvas / aspect ratio / visual hierarchy][exact source copy or source data][region-by-region composition][style, material, and lighting][non-negotiable constraints][explicit forbidden additions][verification instruction]
다섯 가지 실제 규칙:
정확한 원문을 제공하십시오. 모델에게 사실 문구을 작성해 달라고 요청하지 마세요.
레이아웃 요구를 한 문단에 묻어 두지 말고 영역과 계층에 번호를 매기세요.
결과를 검수할 수 있도록 exactly, only 및 no other text를 사용합니다.
테스트당 하나의 핵심 변수를 변경합니다.
프롬프트, 소스 데이터, 출력, 리뷰 노트를 함께 보관하세요.
VibeArt의 infinite Canvas는 Qwen Image 3가 통합되기 전에도 이러한 광범위한 워크플로우에 유용합니다. 소스 자료, 모델 시도, 비교, 편집 및 승인을 별도의 채팅 스레드에서 잃지 않고 계속 표시할 수 있습니다.
Qwen Image 3과 GPT Image 2 비교: 실용적인 선택
답은 보편적인 점수가 아닌 직무에 따라 다릅니다.
매우 긴 개요, 조밀한 문서 형식의 구성, 혼합 스크립트, Qwen의 인터페이스 또는 지식 주장을 특별히 테스트해야 하는 경우 평가를 위해 Qwen Image 3을 선택하십시오. 생성, 비교, 개선 및 내보내기를 위해 Canvas 워크플로에서 이미 사용할 수 있는 모델이 필요한 경우 VibeArt 내에서 GPT Image 2를 선택하세요.
선별된 공식 Qwen 갤러리를 평균 GPT 출력과 비교하지 마십시오. 동일한 소스 프롬프트를 사용하고, 제품에서 허용하는 경우 다시 쓰기를 비활성화하고, 테스트를 반복하고, 실제 출력 크기와 시간을 기록하고, 시각적 품질과 별도로 점수 정확성을 기록합니다.
그렇습니다. 우리는 로그인된 계정을 사용하여 공식 Qwen Chat 웹 제품에 보관된 13개의 출력을 모두 생성했습니다. 제품 액세스는 계정 및 출시 상태에 따라 달라질 수 있습니다. 우리 세션에서는 새로운 이미지 대화가 기본적으로 Qwen-Image 2.0으로 설정되어 있으므로 출력을 3.0 결과로 처리하기 전에 보이는 Qwen-Image 3.0 라벨을 확인하고 명시적으로 선택하세요.
Qwen Image 3 API가 있나요?
있지만 중요한 제한이 있습니다. Alibaba Cloud는 모델 ID qwen-image-3.0-pro를 문서화했지만, 현재는 일반 제공되는 프로덕션 API가 아니라 초대 전용 프리뷰입니다. 문서상 중국 본토 요청 제한은 분당 1회입니다. 접근 권한과 제한 모두 바뀔 수 있는 프리뷰 조건으로 봐야 합니다.
Qwen Image 3는 오픈 소스인가요?
릴리스된 3.0 가중치 또는 3.0 라이센스를 확인할 수 없습니다. 이전 Qwen-Image 저장소는 Apache-2.0이지만 출시되지 않은 3.0 가중치 패키지에는 자동으로 적용되지 않습니다.
Qwen Image 3의 가격은 얼마인가요?
Alibaba Cloud의 가격 페이지에는 qwen-image-3.0-pro가 미리 보기 기간 동안 중국 본토에서 한시적으로 무료로 제공됩니다. 이는 안정적인 일반 가용성 가격이 아니며 모든 지역, 계정 또는 Qwen Chat 계층이 무료라는 것을 증명하지 않습니다. 비용 모델을 구축하기 전에 현재 지역별 가격 페이지를 확인하세요.
Qwen Image 3은 2K를 생성합니까, 아니면 4K를 생성합니까?
고정된 모델 최대값을 확인할 수 없습니다. 각 테스트에 사용된 제품 진입점의 실제 치수를 기록합니다. 하나의 제품 결과를 보편적인 모델 제한으로 바꾸지 마십시오.
최종 결론: 생성기와 QA 시스템을 함께 사용해야 한다
Qwen-Image-3.0의 핵심은 더 예쁜 이미지가 아닙니다. 한 장의 생성 이미지가 복잡한 결과물의 구조를 유지할 수 있다는 점입니다.
이 능력은 검수 체계와 결합될 때만 유용합니다. 사실과 원본 데이터는 비트맵 밖에 두고, 문구와 시각 계층을 따로 확인해야 합니다. 실패한 시도도 기록하고 편집 입력도 보존해야 합니다. 측정할 시간은 생성 시간만이 아니라 생성과 수정에 든 전체 시간입니다.
판단 기준은 간단합니다. 40분짜리 레이아웃 작업이 5분 생성과 5분 검수로 바뀐다면 생산성 도구입니다. 반대로 촘촘한 이미지를 확인하고 고치는 시간이 편집 가능한 문서를 다시 만드는 시간보다 길다면, 아직은 인상적인 데모일 뿐 납품물은 아닙니다.