다들 LLM 성능 경쟁만 보고 있는 사이, xAI의 이미지 모델이 조용히 세계 2위에 올라섰다. Grok 공식 계정이 밝힌 내용은 간단하다 — Imagine Image 2.0이 텍스트→이미지 생성과 이미지 편집 두 부문 모두 Arena 세계 2위.
두 부문 모두 오픈AI 바로 다음, 숫자로 확인
| 부문 | 1위 | 2위(xAI) | 점수차 |
|---|---|---|---|
| Text-to-Image Arena | gpt-image-2 (OpenAI) 1380 | grok-imagine-image-2 low 1320 | 60점 |
| Image Edit Arena | gpt-image-2 (OpenAI) 1463 | grok-imagine-image-2 low 1439 | 24점 |
두 부문 모두 OpenAI의 gpt-image-2가 1위, 그 바로 다음이 xAI다. 특히 이미지 편집 부문은 점수 차가 24점밖에 나지 않아 사실상 근접한 2위다.
확인해야 할 디테일 — '2위'는 low 옵션 기준
다만 정확히 짚을 부분이 있다. xAI는 같은 모델을 두 가지 옵션(low/quality)으로 Arena에 제출했는데, 2위를 차지한 건 low 옵션이다. quality 옵션은 텍스트→이미지 부문에서 1228점으로 순위표 최하단에 가깝고, 이미지 편집 부문에서는 1390점으로 5위권이다. "2위"라는 발표 문구만 보면 모델 전체가 2위인 것처럼 읽히지만, 실제로는 옵션에 따라 순위가 크게 갈린다.
정밀 편집 도구 3종도 함께 나왔다
같은 발표 스레드에서 xAI는 새 편집 도구 3종도 공개했다.
1. Magic Wand — 이미지의 한 영역만 바꾸고 나머지는 그대로 유지
2. Segmentation — 정밀한 영역 선택
3. Smart Resize — 원하는 화면비로 맞춤 조정
인포그래픽·광고 이미지·게임 에셋·UI/UX 목업·스토리보드까지 만들 수 있다고 소개했고, API는 추후 제공 예정이다.
Arena 2위, 실무도 잡을까?
1. LLM 경쟁에서 밀린 만큼, 이미지에서 존재감을 냈다. 발표 스레드 반응 중에는 "Grok 4.6은 출시 일정을 놓쳤지만, 이미지 2.0은 조용히 세계 2위에 올랐다"는 지적이 있었다. LLM 본진 경쟁이 치열한 사이 이미지 모델에서 실적을 냈다는 해석이다.
2. 실무 용도를 명시적으로 강조했다. "real world usefulness"라는 표현과 함께 인포그래픽·광고·UI 목업 등 실무 산출물을 직접 언급한 건, 단순 이미지 생성 데모가 아니라 업무 도구로 포지셔닝하려는 의도로 읽힌다.
Arena 점수는 참고 지표, API 공개 전까지는 직접 검증 필요
Arena 순위는 사용자 투표 기반 벤치마크로 널리 쓰이지만, 실제 업무 품질과 완전히 일치하지는 않는다. API가 아직 열리지 않은 상태라 이 시점에서는 grok.com/imagine에서 직접 테스트해보는 게 가장 확실하다.
관련: Grok 공식 X 포스트



