
qwen3-imageQwen Image 3.0 是阿里巴巴的图像生成模型,最见功力的地方是「图里的字」。10px 的小字它能渲染得清晰可辨,12 国语言、20+ 字体原生支持,所以报纸版式、餐厅菜单、试卷、信息图、网页与 UI 稿这类「文字密集又要讲版面」的活,它能一次生成到位,不必事后再往图上贴文字。指令理解也扎实:最长 4.5k token 的提示词它读得完、照着做,复杂图文指令不会做一半丢一半。 在 APIMODELS 上,文生图和图像编辑是同一个模型、同一个端点,靠有没有传参考图自动切换 —— 不传就是文生图,传了(最多 3 张)就是按图编辑或多图融合。输出 1K 或 2K,8 种画幅(1:1、3:2、2:3、4:3、3:4、16:9、9:16、21:9)或 auto 跟随输入图,PNG 格式。异步任务:POST 创建后 GET 轮询,也可以传 callback_url 让我们回调你。 价格 1K 与 2K 同价 $0.035/张,图像编辑时每张参考图另加 $0.004,失败不扣费。出图按我们自己的生产数据:中位 73 秒、九成在 96 秒内,最快见过 36 秒;轮询窗口留 3 分钟足够,别按几十秒就掐。结果文件在我们的存储上保留 7 天,需要长期留存请自行转存。一个 API Key 同时可调图片、视频、大模型与语音,国内可直连。
Generated image will appear here
Enter a prompt and click Generate
不传参考图就是文生图,传了(最多 3 张)同一个模型就转为图像编辑或多图融合 —— 不用换端点,也不用换模型名
10px 小字清晰可辨,报纸版式、菜单、试卷、信息图这类文字密集又讲版面的活能一次生成到位,不必事后再往图上贴字
多语种排版原生渲染,长提示词也读得完(最长 4.5k token),复杂图文指令不会做一半丢一半
1K 与 2K 同价 $0.035/张,2K 不加钱;图像编辑每张参考图 +$0.004,失败不扣费
适合海报、网页、界面稿、信息图这类批量任务;出图中位 73 秒、九成在 96 秒内。要原生 4K 请用 gpt-image-2,也没有蒙版局部重绘
Qwen Image 3.0 是由 Alibaba 提供的图片生成 API。Qwen Image 3.0 是阿里巴巴的图像生成模型,最见功力的地方是「图里的字」。10px 的小字它能渲染得清晰可辨,12 国语言、20+ 字体原生支持,所以报纸版式、餐厅菜单、试卷、信息图、网页与 UI 稿这类「文字密集又要讲版面」的活,它能一次生成到位,不必事后再往图上贴文字。指令理解也扎实:最长 4.5k token 的提示词它读得完、照着做,复杂图文指令不会做一半丢一半。 在 APIMODELS 上,文生图和图像编辑是同一个模型、同一个端点,靠有没有传参考图自动切换 —— 不传就是文生图,传了(最多 3 张)就是按图编辑或多图融合。输出 1K 或 2K,8 种画幅(1:1、3:2、2:3、4:3、3:4、16:9、9:16、21:9)或 auto 跟随输入图,PNG 格式。异步任务:POST 创建后 GET 轮询,也可以传 callback_url 让我们回调你。 价格 1K 与 2K 同价 $0.035/张,图像编辑时每张参考图另加 $0.004,失败不扣费。出图按我们自己的生产数据:中位 73 秒、九成在 96 秒内,最快见过 36 秒;轮询窗口留 3 分钟足够,别按几十秒就掐。结果文件在我们的存储上保留 7 天,需要长期留存请自行转存。一个 API Key 同时可调图片、视频、大模型与语音,国内可直连。 通过 APIMODELS 平台,您可以使用统一的 API 接口调用该模型,按量计费、价格透明。当前定价:1K: $0.035, 2K: $0.035。
相关模型:qwen3-image-pro — 同一模型更高保真的一档 —— 微表情、毛孔、发丝逼近真实摄影,1K $0.037 / 2K $0.075
相关模型:gpt-image-2 — 通用图内文字更强,也是这里唯一原生 4K 的 —— 1K $0.025、2K $0.03、4K $0.05
相关模型:nanobananapro — Gemini 3 Pro Image —— 主体是写实人像而不是文字密集版面时选它
最大 4.5k token 输入、10px 小字精准渲染 —— 报纸、分镜、菜单、试卷等复杂版面一次生成,是排出来的结构化版面,不是往图上贴字。
多语言、多字体原生渲染,信息图、界面稿、多语言营销素材直接可用,不用后期补字。
理解复杂指令,把多个元素组织成网页、仪表盘、游戏与直播界面,一次生成。
在 image_urls 里传参考图就是编辑:替换元素、转风格、保留主体重绘;不传就是纯文生图。同一个模型两种用法。
1K 与 2K 同价 $0.035/张,每张参考图 +$0.004,失败不扣费。一把 apimodels.app key 同时通调图片/视频/大模型/语音。
Qwen Image 3.0 通过 APIMODELS 平台调用,当前定价:1K: $0.035, 2K: $0.035。按量计费,用多少付多少。
在 APIMODELS 注册账号并获取 API Key,然后通过我们的统一 API 端点调用即可。我们提供详细的 API 文档和 cURL、Python、Node.js 代码示例。
APIMODELS 通过聚合平台提供与官方相同的 Qwen Image 3.0 模型。我们提供统一的 API 接口,无需分别注册各平台账号,一个 API Key 即可调用所有模型。
Qwen Image 3.0 是阿里巴巴的图像生成模型,擅长写实画面、结构化版面、密集图内文字和高质量排版。在 apimodels.app 上,文生图与图像编辑是同一个模型,靠有没有传参考图自动切换:不传就是文生图,传了就是按图编辑。分辨率 1K/2K,统一 $0.035/张,每张参考图另加 $0.004。
标准版 Qwen Image 3.0 主打日常创作:指令理解清晰(最大 4.5k token 输入)、文字渲染稳定(10px 小字、12 国语言、20+ 字体),1K/2K 同价 $0.035/张,适合海报、网页、界面等批量任务。Pro 版(qwen3-image-pro)是更高保真的一档:微表情、毛孔、发丝逼近真实摄影,1K $0.037 / 2K $0.075,适合主图、人像和需要额外细节的排版。
按分辨率计费,用多少付多少:标准版 1K 和 2K 都是 $0.035/张;每传一张参考图(图像编辑时)另加 $0.004。失败不扣费。举例:文生图一张 1K = $0.035;拿一张参考图做编辑 = $0.035 + $0.004 = $0.039。
在 image_urls 里传参考图,后端自动走图像编辑通道(image-to-image)。可传多张,用于替换画面元素、改风格、在保留主体的前提下重绘。不传 image_urls 就是纯文生图。同一个模型名两种用法,不用切换端点。
这是它最突出的能力之一:支持最大 4.5k token 输入和图中图密集信息排版,能一次生成报纸、分镜、菜单、试卷等复杂版面,并稳定渲染 10px 的小字。12 国语言、20+ 字体原生渲染,信息图和 UI 稿直接可用 —— 不用后期再往图上贴字。
原生支持 12 国语言与 20+ 字体渲染,中英文混排、多语言界面仿真都稳定。prompt 本身中英文都支持。这让它很适合做多语言的营销素材、教育内容和网页/游戏/直播界面稿。
分辨率 1K 或 2K。画幅支持 8 种:1:1、3:2、2:3、4:3、3:4、16:9、9:16、21:9。输出格式默认 PNG。参考图单张上限 10MB,支持 jpeg/png/webp 等常见格式。
最多 3 张。多张参考图用于多图融合或在编辑时提供更多约束。每张参考图计费 $0.004,所以一次融合 3 张 1K 图 = $0.035 + 3×$0.004 = $0.047。
异步。创建任务拿到 taskId 后轮询状态,或传 callBackUrl 让我们在完成时回调。成片会转存到我们自己的存储,返回稳定的下载链接。
Qwen Image 3.0 的强项是密集图内文字、多语言排版和结构化版面(报纸/菜单/UI/试卷),价格也更低($0.035 起)。gpt-image-2 在通用图内文字和 4K 原生输出上更强。Nano Banana(Gemini)在写实人像和快速迭代上顺手。文字密集、版面复杂、要多语言,优先 Qwen Image 3.0。
在 apimodels.app 注册、拿一把 API Key,model 填 qwen3-image 即可,一个 key 同时能调图片/视频/大模型/语音。无需管理多个供应商或单独开户,失败不扣费,按张计价、无月费。
按我们自己生产数据的实测分位数:标准版中位 73 秒、九成在 96 秒内,最快见过 36 秒。轮询窗口留 3 分钟足够。如果你按几十秒的超时去掐客户端请求,看到的「卡住」其实是自己掐的 —— 任务在我们这边还在正常跑,轮询 state 会变成 completed。真的异常是 state 变成 failed,那时 failMsg 里有原因。
不扣。只有 state=completed 才计费,failed 一分钱不收,可以直接用同样的参数重试。最常见的失败是上游繁忙(UPSTREAM_BUSY),重试通常就好;如果是内容审核或参数错误,重试同样的输入不会变好,要改提示词或参数。
结果文件在我们的存储上保留 7 天,到期自动删除。要长期使用请在拿到 resultUrls 后自行下载转存 —— 别把我们的链接直接当图床写进你的数据库或页面。
都不支持,直说。Qwen Image 3.0 任何档位最高只到 2K,要原生 4K 请用 gpt-image-2($0.05/张 4K)。也没有 mask/inpainting 参数,局部修改的做法是传原图进 image_urls,再用提示词描述「把哪里改成什么」—— 它对这种指令式编辑的遵从度不错,但不是像素级蒙版控制。
同一个模型,只是名字不同:我们的 model 串是 qwen3-image(Pro 是 qwen3-image-pro),对应阿里官方的 qwen-image-3.0 / qwen-image-3.0-pro。填我们的串就行,不用带任何前缀。
可读 ≠ 逐字正确。它渲染的小字确实清晰,但拼写、公式、价格、条码、日期这类「错一个字符就出事」的内容必须人工过一遍再上线。把它当排版能力用,别当文字输入工具用。
在 APIMODELS,Qwen Image 3.0 与 60+ 个模型共用一个 API Key、一个余额,所以选型只看合不合适,不存在锁定。它支持 Text to Image、Image Editing、Dense Text Layout、12 Languages, 20+ Fonts、1K/2K、Async,你可以在价格和能力上把它和其它图片生成模型对比,换模型只需改一个模型名字符串——无需新账号、无需重新对接。所有图片生成模型与实时价格见 apimodels.app/models。
Qwen Image 3.0 支持:Text to Image、Image Editing、Dense Text Layout、12 Languages, 20+ Fonts、1K/2K、Async。完整参数与调用方式见 APIMODELS 的 API 文档。
可以。APIMODELS 提供可直接访问的统一 API,一个 API Key 即可调用 Qwen Image 3.0,无需分别注册官方账号、也无需自行处理官方接口的网络访问。
我们支持 Stripe(Visa、Mastercard 等国际信用卡)和支付宝付款。充值后积分即时到账。
社区作者公开的提示词,可直接复制修改。每条都标注作者并回链原帖。

老水手与渔船纪实摄影
Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat. He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms. He is calmly adjusting a net while his dog sits nearby on the deck. Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens. Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance. The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail. No glamorization, no heavy retouching.
作者 OpenAI

自动咖啡机工作流程信息图
Create a detailed Infographic of the functioning and flow of an automatic coffee machine like a Jura. From bean basket, to grinding, to scale, water tank, boiler, etc. I'd like to understand technically and visually the flow.
作者 OpenAI

Thread 街头服饰广告
Give me a cool in culture ad / fashion shot for a brand called Thread. It's a hip young street brand. The ad shows a group of friends hanging out together with the tagline "Yours to Create." Make it feel like a polished campaign image for a youth streetwear audience: stylish, contemporary, energetic, and tasteful. Use clean composition, strong color direction, natural poses, and premium fashion photography cues. Render the tagline exactly once, clearly and legibly, integrated into the ad layout. No extra text, no watermarks, no unrelated logos.
作者 OpenAI