
grok-imagine-image-2Grok Imagine Image 2.0은 보기 좋은 그림이 아니라 그대로 업무에 투입할 이미지를 만들기 위한 xAI의 이미지 모델입니다. 글자 조판과 레이아웃을 디자이너처럼 설계합니다 —— 2K 포스터로 직접 시험해 보니 지정한 헤드라인, 날짜 줄, 아래쪽 작은 글씨 URL 세 군데가 모두 글자 하나 틀리지 않고 읽히는 상태로 나왔습니다. 한 번의 호출에서 참조 이미지를 최대 3장까지 융합하며 어떤 피사체를 어디에 놓을지도 헷갈리지 않습니다. 4장째는 조용히 버려지는 대신 명시적인 오류로 거부됩니다 —— 말없이 빠지면 융합이 된 줄로 착각하게 되기 때문입니다. 편집할 때는 피사체와 장면을 함께 지킵니다. 빨간 주전자를 남색으로 바꾸라고 했을 때 주전자 형태, 나무 탁자의 결, 창으로 드는 빛, 창턱의 화분, 배경의 나무 의자가 모두 그대로 남고 색만 바뀌었습니다. 실측으로 확인한 주의점이 하나 있습니다. 원본 픽셀을 그 자리에서 고치는 방식이 아니라 같은 장면을 다시 그리는 방식이라, 출력할 때마다 카메라 위치와 크롭, 피사체 크기가 달라집니다. 색 교체, 재질 교체, 요소 추가와 삭제, 여러 참조 이미지 합성에는 잘 맞지만 '여기만 바꾸고 나머지 픽셀은 하나도 건드리지 말 것'이 요구사항이라면 GPT Image 2나 Nano Banana Pro 계열을 쓰세요. 또 하나의 제약은 투명 배경입니다. 알파 채널을 요구하면 회색과 흰색 체크무늬를 일반 픽셀로 그려 버리고, 돌아오는 PNG는 알파가 아예 없는 RGB입니다(2K 편집과 2K text-to-image 두 경로 모두 같은 결과였습니다). 배경 제거가 필요하면 전용 단계를 따로 두세요. 가격은 해상도 × 품질로 네 등급입니다. 1K low $0.03, 2K low $0.04, 1K medium $0.045, 2K medium $0.06(장당). quality 값은 low와 medium 둘뿐이고 생략하면 medium이라, 명시하지 않으면 medium을 사는 셈입니다. 네 등급 모두 xAI 공식 정가보다 25% 저렴하고 2K low는 33% 저렴합니다. 참조 이미지에는 추가 요금이 붙지 않습니다(xAI는 입력 이미지 장당 $0.01을 더 받지만 저희는 전가하지 않습니다). 그래서 image-to-image와 text-to-image 가격이 같습니다. 화면비는 14종이고 19.5:9 / 9:19.5 / 20:9 / 9:20 초광각 4종이 포함되는데, 이 넷은 규격표를 옮겨 적은 것이 아니라 하나씩 실제로 호출해 확인했습니다(19.5:9는 1248×576이 나왔습니다). 저희의 다른 Grok 채널은 바로 이 넷을 거부합니다. API 키 하나로 바로 호출하고 별도의 xAI 계정이 필요 없으며 중국에서도 직접 연결되고, 실패한 요청은 과금되지 않습니다.
Omitting quality in the API defaults to medium. Reference images are not charged extra.
Generated image will appear here
Enter a prompt and click Generate
2K 포스터에 지정한 헤드라인, 날짜 줄, 작은 글씨 URL을 요청했더니 세 곳 모두 글자 하나 틀리지 않고 읽히는 상태로 나왔습니다. 출시 공지를 옮긴 게 아니라 실제 가동 중인 모델로 확인한 결과입니다.
참조 이미지를 최대 3장까지 보내고 각각 어디에 들어갈지 지정하면, 텍스트로 다시 그리지 않고 피사체를 알아볼 수 있게 유지합니다. 4장째는 조용히 버려지지 않고 분명하게 거부됩니다.
제품 색만 바꾸면 물체 형태, 표면 질감, 조명, 주변 소품이 그대로 따라옵니다. 따라오지 않는 건 프레이밍입니다 — 다음 항목을 보세요.
실행할 때마다 구도와 크롭이 달라집니다. 피사체가 더 가까워지기도 하고 카메라 각도가 바뀌기도 합니다. 색 변경, 스타일 변경, 요소 추가·제거에는 최적이지만 “이것만 바꾸고 나머지는 건드리지 말 것”이 요구사항이라면 맞지 않는 도구입니다.
투명 배경을 요청하면 회색과 흰색 체크무늬를 그냥 픽셀로 그려 버리고, 받은 PNG에는 알파 채널이 없습니다. 썸네일에선 누끼처럼 보이지만 아닙니다. 배경 제거는 전용 단계를 따로 두세요.
1K Low $0.03, 2K Low $0.04, 1K Medium $0.045, 2K Medium $0.06 — 세 등급은 xAI 정가보다 25%, 2K Low는 33% 쌉니다. xAI는 참조 이미지 한 장당 $0.01을 받지만 여기서는 추가 비용이 없습니다. 19.5:9와 20:9를 포함해 화면비 14종.
Grok Imagine Image 2.0은(는) xAI의 이미지 생성 API입니다. Grok Imagine Image 2.0은 보기 좋은 그림이 아니라 그대로 업무에 투입할 이미지를 만들기 위한 xAI의 이미지 모델입니다. 글자 조판과 레이아웃을 디자이너처럼 설계합니다 —— 2K 포스터로 직접 시험해 보니 지정한 헤드라인, 날짜 줄, 아래쪽 작은 글씨 URL 세 군데가 모두 글자 하나 틀리지 않고 읽히는 상태로 나왔습니다. 한 번의 호출에서 참조 이미지를 최대 3장까지 융합하며 어떤 피사체를 어디에 놓을지도 헷갈리지 않습니다. 4장째는 조용히 버려지는 대신 명시적인 오류로 거부됩니다 —— 말없이 빠지면 융합이 된 줄로 착각하게 되기 때문입니다. 편집할 때는 피사체와 장면을 함께 지킵니다. 빨간 주전자를 남색으로 바꾸라고 했을 때 주전자 형태, 나무 탁자의 결, 창으로 드는 빛, 창턱의 화분, 배경의 나무 의자가 모두 그대로 남고 색만 바뀌었습니다. 실측으로 확인한 주의점이 하나 있습니다. 원본 픽셀을 그 자리에서 고치는 방식이 아니라 같은 장면을 다시 그리는 방식이라, 출력할 때마다 카메라 위치와 크롭, 피사체 크기가 달라집니다. 색 교체, 재질 교체, 요소 추가와 삭제, 여러 참조 이미지 합성에는 잘 맞지만 '여기만 바꾸고 나머지 픽셀은 하나도 건드리지 말 것'이 요구사항이라면 GPT Image 2나 Nano Banana Pro 계열을 쓰세요. 또 하나의 제약은 투명 배경입니다. 알파 채널을 요구하면 회색과 흰색 체크무늬를 일반 픽셀로 그려 버리고, 돌아오는 PNG는 알파가 아예 없는 RGB입니다(2K 편집과 2K text-to-image 두 경로 모두 같은 결과였습니다). 배경 제거가 필요하면 전용 단계를 따로 두세요. 가격은 해상도 × 품질로 네 등급입니다. 1K low $0.03, 2K low $0.04, 1K medium $0.045, 2K medium $0.06(장당). quality 값은 low와 medium 둘뿐이고 생략하면 medium이라, 명시하지 않으면 medium을 사는 셈입니다. 네 등급 모두 xAI 공식 정가보다 25% 저렴하고 2K low는 33% 저렴합니다. 참조 이미지에는 추가 요금이 붙지 않습니다(xAI는 입력 이미지 장당 $0.01을 더 받지만 저희는 전가하지 않습니다). 그래서 image-to-image와 text-to-image 가격이 같습니다. 화면비는 14종이고 19.5:9 / 9:19.5 / 20:9 / 9:20 초광각 4종이 포함되는데, 이 넷은 규격표를 옮겨 적은 것이 아니라 하나씩 실제로 호출해 확인했습니다(19.5:9는 1248×576이 나왔습니다). 저희의 다른 Grok 채널은 바로 이 넷을 거부합니다. API 키 하나로 바로 호출하고 별도의 xAI 계정이 필요 없으며 중국에서도 직접 연결되고, 실패한 요청은 과금되지 않습니다. APIMODELS 플랫폼을 거치면 통합 API와 투명한 종량 과금으로 이 모델을 호출할 수 있습니다. 현재 가격: 1K Low: $0.03, 2K Low: $0.04, 1K Medium: $0.045, 2K Medium: $0.06.





온라인 스토어와 광고, 마케팅 자료에 쓸 고품질 상품 비주얼을 생성합니다.
눈길을 끄는 비주얼을 만들어 참여도와 브랜드 인지도를 끌어올립니다.
캐릭터와 배경, 소품의 콘셉트 아트를 뽑아 게임 개발의 초반 속도를 높입니다.
포스터와 배너, 프로모션 그래픽을 기존 디자인 비용의 일부만으로 준비합니다.
Grok Imagine Image 2.0은(는) APIMODELS를 통해 1K Low: $0.03, 2K Low: $0.04, 1K Medium: $0.045, 2K Medium: $0.06에 이용할 수 있습니다. 과금은 종량제라서 생성한 만큼만 냅니다.
APIMODELS에 가입해 API 키를 받고 통합 엔드포인트를 호출하면 됩니다. cURL / Python / Node.js 예제를 담은 상세 문서를 제공합니다.
APIMODELS는 같은 Grok Imagine Image 2.0을(를) 집약 플랫폼을 통해 제공합니다. API 인터페이스가 통합되어 있어 공급자마다 계정을 만들 필요가 없고, 키 하나로 모든 모델에 닿습니다.
등급은 resolution × quality로 결정됩니다. 1K low $0.03, 2K low $0.04, 1K medium $0.045, 2K medium $0.06(장당). quality는 low와 medium 두 값뿐이며 생략하면 medium이 적용됩니다 — 즉 지정하지 않는 것은 medium 등급을 사는 것입니다. 대량 초안에는 1K low를, 실제로 게시할 결과물에는 2K medium을 쓰세요. 참조 이미지는 추가 비용이 없습니다: xAI는 입력 이미지 1장당 $0.01을 청구하지만 저희는 전가하지 않습니다. 네 등급 모두 xAI 공식가보다 25% 저렴하고, 2K low는 33% 저렴합니다.
최대 3장입니다. 한 장이면 image_url(또는 image_base64), 여러 장이면 image_urls에 배열로 넘기고 prompt 안에서 <IMAGE_0>, <IMAGE_1>처럼 지칭합니다. 네 번째는 조용히 버려지지 않고 명확한 오류로 거부됩니다 — 조용히 버려지면 합성이 성공했다고 착각하게 되므로 이 차이가 중요합니다. 참조 이미지에는 추가 비용이 없습니다. 편집 시 aspect_ratio를 생략하면 출력 비율은 첫 번째 입력 이미지를 따릅니다. 서로 다른 세 물체로 실측한 결과 셋 다 개별적으로 식별 가능했고, 텍스트로부터 다시 그려진 것이 아니었습니다.
14가지입니다. 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3, 2:1, 1:2에 초광각 19.5:9, 9:19.5, 20:9, 9:20, 그리고 auto. 초광각 네 가지는 사양표를 베낀 것이 아니라 실제 채널에서 하나씩 호출해 확인했습니다(19.5:9는 1248×576 반환). 편집 시 aspect_ratio를 생략하면 첫 번째 입력 이미지의 비율을 따릅니다.
피사체와 장면은 유지하지만 구도는 다시 그립니다. 실측 결과, 빨간 주전자 사진에 '짙은 남색으로'라고 지시하자 주전자 형태, 나뭇결, 창문 빛, 창가 화분, 뒤쪽 의자가 모두 남고 색만 바뀌었습니다. 매번 달라지는 것은 구도입니다 — 카메라 각도, 크롭, 피사체 크기가 움직입니다. 픽셀 단위 수정이 아니라 같은 장면을 다시 그리기 때문입니다. 색상·질감 변경, 요소 추가·제거, 다중 참조 합성에는 훌륭하지만 '이것만 바꾸고 다른 픽셀은 손대지 말라'는 요구에는 맞지 않습니다.
불가능합니다. '투명 배경, 알파 채널'을 요청하면 회색과 흰색 체크무늬를 일반 픽셀로 그려버립니다. 반환되는 PNG는 RGB이며 알파 채널이 아예 없습니다. 썸네일에서는 완성된 누끼처럼 보이지만 실제로는 아닙니다. 2K 편집과 2K 텍스트→이미지 두 경로 모두 같은 결과였습니다. 배경 제거가 필요하면 전용 단계를 따로 두세요.
2.0은 새 세대로 타이포그래피와 다중 참조 작업에 강합니다. 2K 포스터에서 정확한 헤드라인, 날짜 줄, 작은 글씨 URL을 요청했더니 셋 다 읽을 수 있고 한 글자도 틀리지 않았습니다. 한 번의 호출로 참조 이미지를 최대 3장까지 합성하며, 네 번째는 조용히 버리지 않고 명확히 거부합니다. 가격도 $0.03부터로 Pro의 $0.08(1K) / $0.12(2K)보다 저렴합니다. Pro는 1.0 엔진의 고정밀 등급으로 남아 있습니다. apimodels.app에서 둘은 엔드포인트와 키가 같으므로 전환은 model 문자열 하나만 바꾸면 됩니다.
APIMODELS에서는 Grok Imagine Image 2.0이(가) 60개가 넘는 모델과 같은 API 키, 같은 잔액 위에 나란히 놓입니다. 그래서 선택은 궁합의 문제이지 종속의 문제가 아닙니다. Text to Image、Multi-Image Editing (up to 3)、Typography & Layout、14 Aspect Ratios、1K/2K × Low/Medium、From $0.03을(를) 지원하며 다른 이미지 생성 모델과 가격·성능을 나란히 놓고 따져볼 수 있습니다. 갈아타기는 모델 이름 문자열 하나만 바꾸면 되고 새 계정도 추가 작업도 필요 없습니다. 이미지 생성 선택지와 실시간 가격은 apimodels.app/models에서 볼 수 있습니다.
Grok Imagine Image 2.0은(는) 다음을 지원합니다: Text to Image、Multi-Image Editing (up to 3)、Typography & Layout、14 Aspect Ratios、1K/2K × Low/Medium、From $0.03. 전체 파라미터와 호출 예제는 APIMODELS 문서를 참고하세요.
네. APIMODELS는 Grok Imagine Image 2.0을(를) 하나의 통합 API와 키 한 개로 제공합니다. 공급자별 계정도 필요 없고, 각 공급자의 지역별 네트워크 경로를 직접 챙길 필요도 없습니다.
Stripe(Visa, Mastercard 등 해외 카드)와 Alipay를 지원합니다. 결제 후 잔액은 즉시 반영됩니다.
Prompts shared by their authors — copy and adapt them. Each one credits its author and links back to the original post.

Weathered sailor on a fishing boat
Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat. He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms. He is calmly adjusting a net while his dog sits nearby on the deck. Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens. Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance. The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail. No glamorization, no heavy retouching.
by OpenAI

Automatic coffee machine workflow infographic
Create a detailed Infographic of the functioning and flow of an automatic coffee machine like a Jura. From bean basket, to grinding, to scale, water tank, boiler, etc. I'd like to understand technically and visually the flow.
by OpenAI

Thread streetwear ad with exact typography
Give me a cool in culture ad / fashion shot for a brand called Thread. It's a hip young street brand. The ad shows a group of friends hanging out together with the tagline "Yours to Create." Make it feel like a polished campaign image for a youth streetwear audience: stylish, contemporary, energetic, and tasteful. Use clean composition, strong color direction, natural poses, and premium fashion photography cues. Render the tagline exactly once, clearly and legibly, integrated into the ad layout. No extra text, no watermarks, no unrelated logos.
by OpenAI
We curate copy-ready prompt libraries — every entry shows its full text and a sample result, ready to adapt.
How to get access, regional availability, and how this model compares with its alternatives.