AI 벤치마크 ‘자전거를 탄 펠리컨 그리기’를 Gemini 3.1 Pro와 Qwen3.6-35B-A3B에 시켜보면 이렇게 된다
This is what happens when AI benchmark “Draw a pelican riding a bicycle” is tried on Gemini 3.1 Pro and Qwen3.6-35B-A3B

TL;DR AI
1분핵심 요약
PyCon US 2026에서 Simon Willison은 오랫동안 이어온 ‘펠리컨이 자전거를 타는’ 이미지 벤치마크 결과를 다시 소개했다.
그는 Gemini 3.1 Pro와 Qwen3.6-35B-A3B 같은 최신 모델이 특히 더 자연스럽고 완성도 높은 이미지를 만들었다고 평가했다.
Claude Sonnet 4.5, Claude Opus 4.7, Gemma 4, GLM-5.1 등도 전반적으로 개선된 모습을 보였다.
다만 이 벤치마크는 모델별 강점과 특성을 드러내는 데는 유용하지만, AI 성능 전체를 판단하기에는 너무 좁다고 강조했다.
