
qwen3-imageQwen Image 3.0 は Alibaba の画像モデルで、テキストからの生成と画像編集がひとつのモデルにまとまっています。参照画像を渡さなければ生成、渡せば(最大 3 枚、1 枚 10MB まで)編集や複数画像の合成になります。いちばんの得意分野は画面の中に文字を詰め込む組版で、プロンプトは最大 4.5k トークン、10px の小さな文字も判読でき、12 言語と 20 種類以上のフォントをネイティブに描き分けます。新聞紙面、メニュー、絵コンテ、試験用紙のような版面が一度の生成で仕上がるので、あとから文字を貼り込む工程が要りません。出力は 1K か 2K、アスペクト比は 8 種類(1:1、3:2、2:3、4:3、3:4、16:9、9:16、21:9)、形式は PNG です。価格は 1K も 2K も 1 枚 $0.035 の均一で、参照画像は 1 枚につき +$0.004。課金は成功した生成のみで、失敗した分は返金されます。呼び出しは apimodels.app の POST /api/v1/images/generations で、タスクを作成したあとポーリングするか callback を受け取ります。当社の実測値は中央値 73 秒、9 割が 96 秒以内なので、ポーリングの待ち時間は 3 分見ておけば十分です。生成ファイルの保管は 7 日間。ないものははっきり書きます。4K はなく上限は 2K、マスクによる部分描き直しもないので、直したい箇所はプロンプトの文章で指示してください。apimodels.app のキー 1 本で他のモデルも同じ残高から呼べます。
Generated image will appear here
Enter a prompt and click Generate
Text-to-image and image editing on one model name — add reference images and it edits, omit them and it generates
Up to 4.5k-token prompts and 10px small-text rendering — newspapers, storyboards, menus and exam sheets in a single pass
Native multilingual and multi-font rendering, legible for infographics and UI mockups straight out
$0.035 per image at 1K or 2K; each reference image adds $0.004. Failures are never charged
High-volume posters, web and UI layouts, and text-heavy designs where small type must stay legible
Qwen Image 3.0 は Alibaba の画像生成 API です。Qwen Image 3.0 は Alibaba の画像モデルで、テキストからの生成と画像編集がひとつのモデルにまとまっています。参照画像を渡さなければ生成、渡せば(最大 3 枚、1 枚 10MB まで)編集や複数画像の合成になります。いちばんの得意分野は画面の中に文字を詰め込む組版で、プロンプトは最大 4.5k トークン、10px の小さな文字も判読でき、12 言語と 20 種類以上のフォントをネイティブに描き分けます。新聞紙面、メニュー、絵コンテ、試験用紙のような版面が一度の生成で仕上がるので、あとから文字を貼り込む工程が要りません。出力は 1K か 2K、アスペクト比は 8 種類(1:1、3:2、2:3、4:3、3:4、16:9、9:16、21:9)、形式は PNG です。価格は 1K も 2K も 1 枚 $0.035 の均一で、参照画像は 1 枚につき +$0.004。課金は成功した生成のみで、失敗した分は返金されます。呼び出しは apimodels.app の POST /api/v1/images/generations で、タスクを作成したあとポーリングするか callback を受け取ります。当社の実測値は中央値 73 秒、9 割が 96 秒以内なので、ポーリングの待ち時間は 3 分見ておけば十分です。生成ファイルの保管は 7 日間。ないものははっきり書きます。4K はなく上限は 2K、マスクによる部分描き直しもないので、直したい箇所はプロンプトの文章で指示してください。apimodels.app のキー 1 本で他のモデルも同じ残高から呼べます。 APIMODELS のプラットフォーム経由なら、統一 API と明朗な従量課金でこのモデルを呼び出せます。 現在の料金: 1K: $0.035, 2K: $0.035。
関連モデル: qwen3-image-pro — the higher-fidelity tier of the same model — micro-expressions, pores and hair strands near real photography, 1K $0.037 / 2K $0.075
関連モデル: gpt-image-2 — stronger on general in-image text and the only one here with native 4K — 1K $0.025, 2K $0.03, 4K $0.05
関連モデル: nanobananapro — Gemini 3 Pro Image — reach for it when the subject is a realistic portrait rather than a text-heavy layout
Up to 4.5k-token prompts and 10px small-text rendering — newspapers, storyboards, menus and exam sheets generate as one structured layout, not a picture with text pasted on.
Native multilingual and multi-font rendering, so infographics, UI mockups and multilingual marketing assets come out legible and usable straight away.
Understands complex instructions and organizes many elements into web pages, dashboards, game and livestream UIs in a single pass.
Pass reference images in image_urls and it edits — swap elements, restyle, or repaint while keeping the subject; omit them for pure text-to-image. One model, both modes.
Flat $0.035 per image at 1K and 2K, plus $0.004 per reference image. Failures are never charged, and one apimodels.app key also calls image, video, LLM and audio.
Qwen Image 3.0 は APIMODELS 経由で 1K: $0.035, 2K: $0.035 で利用できます。課金は従量制で、生成した分だけの支払いです。
APIMODELS に登録して API キーを取得し、統一エンドポイントを呼ぶだけです。cURL / Python / Node.js のサンプルを含む詳しいドキュメントを用意しています。
APIMODELS は同じ Qwen Image 3.0 を集約プラットフォーム経由で提供します。統一された API インターフェースなので、プロバイダごとにアカウントを作る必要はありません。キー 1 本ですべてのモデルに届きます。
Qwen Image 3.0 は Alibaba の画像生成モデルで、写実的な描写、構造化されたレイアウト、画像内の密なテキスト、質の高いタイポグラフィを得意とします。apimodels.app では text-to-image と画像編集が同一モデルで、参照画像を渡したかどうかでモードが自動的に切り替わります。渡さなければ生成、渡せば編集です。解像度は 1K/2K、1 枚あたり一律 $0.035、参照画像は 1 枚につき $0.004 が加算されます。
標準の Qwen Image 3.0 は日常使いのティアです。指示追従が明快で(プロンプトは最大 4.5k トークン)、テキストレンダリングが安定しており(10px の小さな文字、12 言語、20 以上のフォント)、1K でも 2K でも一律 $0.035。ポスター、Web ページ、UI モックアップを量産する用途向けです。Pro(qwen3-image-pro)はより高忠実度のティアで、微細な表情、毛穴、髪の一本一本が実写に迫ります。1K $0.037 / 2K $0.075 で、メインビジュアルやポートレート、追加のディテールが要るレイアウト向けです。
解像度ごとの 1 枚単位の従量課金です。標準版は 1K でも 2K でも $0.035、編集に使う参照画像は 1 枚につき $0.004 が加算されます。失敗した分は課金されません。例: 1K の text-to-image は $0.035、参照画像 1 枚での編集は $0.035 + $0.004 = $0.039 です。
参照画像を image_urls に入れて渡すと、バックエンドが自動的に image-to-image へルーティングします。複数枚渡せば、要素の差し替え、スタイル変更、被写体を保ったままの描き直しができます。image_urls を省略すれば純粋な text-to-image です。モデル名は 1 つのまま両方のモードを使えるので、エンドポイントを切り替える必要はありません。
ここが一番の強みの 1 つです。最大 4.5k トークンのプロンプトと画像内の密なレイアウトにより、新聞、絵コンテ、メニュー、試験問題用紙のような複雑な紙面を一度の生成で作れ、10px の小さな文字も判読できる形でレンダリングされます。12 言語と 20 以上のフォントをネイティブに描画するので、インフォグラフィックや UI モックアップはそのまま使えます。後からテキストを重ねる必要はありません。
12 言語と 20 以上のフォントをネイティブにレンダリングし、複数字種の混植や多言語 UI のレイアウトも安定しています。プロンプト自体は中国語でも英語でも受け付けます。多言語のマーケティング素材、教育コンテンツ、Web / ゲーム / ライブ配信のインターフェースモックアップに向いています。
1K または 2K で、アスペクト比は 1:1、3:2、2:3、4:3、3:4、16:9、9:16、21:9 の 8 種類です。出力は PNG。参照画像は 1 枚あたり 10MB まで、一般的な形式(jpeg / png / webp)に対応します。
最大 3 枚です。複数枚渡すと、複数画像の融合や、編集時により強い制約を与える用途に使えます。参照画像は 1 枚 $0.004 なので、1K で 3 枚を融合すると $0.035 + 3×$0.004 = $0.047 になります。
非同期です。タスクを作成して taskId を受け取り、ポーリングで状態を確認します。あるいは callBackUrl を渡せば完了時に Webhook が飛びます。生成結果は当社のストレージに転送され、安定したダウンロードリンクとして返ります。
Qwen Image 3.0 は画像内の密なテキスト、多言語の組版、構造化されたレイアウト(新聞 / メニュー / UI / 試験問題用紙)で優位で、価格も安価です($0.035 から)。gpt-image-2 は一般的な画像内テキストとネイティブ 4K が強み。Nano Banana(Gemini)は写実的なポートレートと高速なイテレーションに便利です。テキスト量が多く、レイアウトが複雑で、多言語が絡む仕事なら Qwen Image 3.0 を選んでください。
apimodels.app に登録して API キーを 1 本取得し、model に qwen3-image を指定するだけです。同じキーで画像・動画・LLM・音声のモデルも呼べます。複数のプロバイダーやアカウントを使い分ける必要はありません。失敗分は課金されず、1 枚単位の課金で月額費用もありません。
自社の本番トラフィックから実測したパーセンタイルでは、標準ティアは中央値 73s、90% が 96s 以内に完了し、最速は 36s でした。ポーリングの猶予は 3 分見ておけば十分です。数十秒でクライアント側のリクエストを打ち切っている場合、見えている「詰まり」は自分のタイムアウトです。ジョブは当社側で動き続けており、ポーリングを続ければ state は completed に変わります。本当に異常なときは state=failed になり、理由が failMsg に入ります。
課金されません。課金対象は state=completed のみで、失敗したタスクは無料です。まったく同じリクエストでリトライできます。もっとも多い失敗は上流の混雑(UPSTREAM_BUSY)で、これはリトライで解消するのが普通です。コンテンツモデレーションやパラメータ不正による失敗はリトライしても変わらないので、プロンプトやパラメータのほうを直してください。
結果ファイルは 7 日間保持され、その後自動的に削除されます。それ以上必要なら自分でダウンロードして再ホストしてください。当社の URL を恒久的な画像ホスティングとして自社の DB やページに直接書き込むのは避けてください。
率直に言うと、どちらも非対応です。Qwen Image 3.0 はどのティアでも 2K を超えません。ネイティブ 4K が必要なら gpt-image-2(4K 1 枚 $0.05)を使ってください。mask / inpainting のパラメータもありません。部分的に直したいときは元画像を image_urls で渡し、変更内容をプロンプトで説明します。この種の指示にはよく従いますが、ピクセル単位のマスク制御ではありません。
同じモデルで、名前が違うだけです。当社の model 文字列は qwen3-image(Pro は qwen3-image-pro)で、Alibaba の qwen-image-3.0 / qwen-image-3.0-pro に対応します。プレフィックスなしで当社の文字列をそのまま渡してください。
判読できることと一字一句正しいことは別です。描かれる小さな文字は確かにシャープですが、スペル、数式、価格、バーコード、日付など、1 文字違うと事故になるものは公開前に人が確認してください。組版能力として使うもので、文字入力ツールではありません。
APIMODELS では Qwen Image 3.0 が 60 以上のモデルと同じ API キー・同じ残高の上に並んでいるので、選択は「相性」の問題であって「囲い込み」の問題ではありません。Text to Image、Image Editing、Dense Text Layout、12 Languages, 20+ Fonts、1K/2K、Async に対応しており、他の画像生成モデルと価格・機能を並べて評価できます。乗り換えはモデル名の文字列を 1 つ書き換えるだけ。新しいアカウントも追加の実装も要りません。画像生成の選択肢と最新価格は apimodels.app/models で確認できます。
Qwen Image 3.0 は次に対応しています: Text to Image、Image Editing、Dense Text Layout、12 Languages, 20+ Fonts、1K/2K、Async。パラメータの全一覧と呼び出し例は APIMODELS のドキュメントをご覧ください。
はい。APIMODELS は Qwen Image 3.0 を単一の統一 API とキー 1 本で提供します。プロバイダごとのアカウントも、各社の地域ごとのネットワーク経路を自分で面倒みる必要もありません。
Stripe(Visa、Mastercard などの国際カード)と Alipay に対応しています。支払い後、残高はすぐ反映されます。
Prompts shared by their authors — copy and adapt them. Each one credits its author and links back to the original post.

Weathered sailor on a fishing boat
Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat. He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms. He is calmly adjusting a net while his dog sits nearby on the deck. Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens. Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance. The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail. No glamorization, no heavy retouching.
by OpenAI

Automatic coffee machine workflow infographic
Create a detailed Infographic of the functioning and flow of an automatic coffee machine like a Jura. From bean basket, to grinding, to scale, water tank, boiler, etc. I'd like to understand technically and visually the flow.
by OpenAI

Thread streetwear ad with exact typography
Give me a cool in culture ad / fashion shot for a brand called Thread. It's a hip young street brand. The ad shows a group of friends hanging out together with the tagline "Yours to Create." Make it feel like a polished campaign image for a youth streetwear audience: stylish, contemporary, energetic, and tasteful. Use clean composition, strong color direction, natural poses, and premium fashion photography cues. Render the tagline exactly once, clearly and legibly, integrated into the ad layout. No extra text, no watermarks, no unrelated logos.
by OpenAI
We curate copy-ready prompt libraries — every entry shows its full text and a sample result, ready to adapt.
How to get access, regional availability, and how this model compares with its alternatives.