本文最后更新于 2026年9月5日。
为你整理了2026年9月可用的免费生图大模型API,按真免费、按量付费、开源自建三类划分。先说结论:过去几个月这个领域变动不小,谷歌的免费出图额度已经取消,现在真正能稳定白嫖的是 Cloudflare Workers AI 和 ModelScope;如果你能接受按张付费,Gemini 3 系列反而是画质和中文最好的选择。
一、 真正免费的生图 API
1. Cloudflare Workers AI(首选,免信用卡)
目前综合看最划算的一个。免费账号即可调用,图像模型不在「需绑定付费方式」的模型名单内(该名单目前只有 kimi-k2.6/2.7-code、glm-5.2/5.3/5.3-flash、deepseek-v4-flash/pro)。
- 额度:10,000 Neurons/天,00:00 UTC 重置,Free 与 Paid 计划都有。
- 端点:
POST https://api.cloudflare.com/client/v4/accounts/{account_id}/ai/run/{model} - 可选模型:
@cf/black-forest-labs/flux-1-schnell(文生图)、@cf/black-forest-labs/flux-2-dev(图生图)、@cf/black-forest-labs/flux-2-klein-4b、@cf/black-forest-labs/flux-2-klein-9b、@cf/leonardo/lucid-origin、@cf/leonardo/phoenix-1.0。 - 实际能跑多少张:2026 年起计价改为「tile + step」粒度。flux-1-schnell 为 4.80 neurons/512² tile + 9.60 neurons/step,4 步约 43 neurons/张,约合 230 张/天(按官方公式估算,实际取决于分辨率与步数)。
- 超额:$0.011 / 1K Neurons。
2. ModelScope API-Inference(国内直连,额度最大)
- Base URL:
https://api-inference.modelscope.cn/v1/,生图用Qwen/Qwen-Image。 - 额度:每天 2000 次调用,单模型上限 500 次。这是目前免费生图方案里量级最大的。
- 门槛:ModelScope 账号(阿里云体系,需实名),国内直连,中文出图效果好。
- 注意:额度数字目前主要见于社区与聚合文档,官方文档页为动态渲染难以直接核对,以控制台实际显示为准。
3. Hugging Face Inference Providers
- 额度:Free 用户每月 $0.10,PRO 每月 $2.00。用 Custom Provider Key 时不享受免费额度。
- 端点:
https://router.huggingface.co/v1/(OpenAI 兼容)。 - 实际够用吗:在 hf-inference 上跑 FLUX.1-dev 约 10 秒 × $0.00012/秒 ≈ $0.0012/张,$0.10 大概只够 80 张。结论是够验证接口,不够干活。
4. NVIDIA NIM(build.nvidia.com)
- 现状:目录内 97 个模型中约 38 个带 Free Endpoint,Text-to-Image 类 7 个、Image Generation 类 8 个。
- 端点:
https://ai.api.nvidia.com/v1/(OpenAI 兼容),https://integrate.api.nvidia.com/v1。 - 门槛:注册 NVIDIA 开发者计划账号领免费 credits,一般免信用卡,约 40 RPM。
- 注意:首页可见的
QWEN-IMAGE、QWEN-IMAGE-EDIT标为 Downloadable(可下载权重),并非免费端点。使用前请在目录页用 “Free Endpoint + Text-to-Image” 过滤确认。
二、 按量付费,但值得考虑
1. Google Gemini(画质与中文最强,但已无免费额度)
这里要特别说明:谷歌的免费出图额度已经取消。gemini-2.5-flash-image 已弃用,Gemini 2.5 全系将于 2026 年 10 月关停;Imagen 全系已于 2026-08-17 关停。官方文档明确写着——无论使用哪个 Gemini API 提供方,图像模型都需要采用随用随付的 Blaze 定价方案。
- 现行模型:
gemini-3.1-flash-image(Nano Banana 2)、gemini-3.1-flash-lite-image(Nano Banana 2 Lite)、gemini-3-pro-image(Nano Banana Pro)。注意通用模型如gemini-3.7-flash不支持出图。 - 端点:
POST https://generativelanguage.googleapis.com/v1beta/models/{model}:generateContent - 能力:1K/2K/4K 分辨率(flash-lite 仅 512/1K),支持 1:1、1:4、9:16、16:9、21:9 等比例;提示与图内文字支持 35+ 语言(含 zh-CN),图内中文渲染能力目前最强;仅输出 PNG。
- 门槛:需绑定账单;Vertex 上 3.x Image 仅
global位置;2026-11-02 起 Firebase AI Logic 强制 App Check。 - 适用:对画质和中文有要求的商业场景,以及需要 4K 输出的场合。
2. OpenRouter Image API
OpenRouter 已上线独立的图像 API,一个 key 打通多家出图模型。
- 端点:
POST https://openrouter.ai/api/v1/images;GET /api/v1/images/models可枚举模型。 - 参数:
resolution(512/1K/2K/4K)、aspect_ratio、n(1–10)、quality、output_format(png/jpeg/webp/svg)、input_references(图生图)、stream(SSE 流式)。 - 价格:按张 / 百万像素计。
bytedance-seed/seedream-4.5约 $0.05/张;openai/gpt-image-2high / 16:9(1536×864)约 $0.13/张。生成失败或中断不计费。 - 注意:没有
:free图像模型——:free后缀目前只覆盖文本模型。
3. 国内云厂商
国内厂商的免费额度普遍很小,实际使用建议直接按量付费,单价在 0.2 元/张量级:
- 阿里云百炼:通义万相
wan2.6-t2i文生图,免费额度为「开通后 90 天内 50 张」,超出 0.2 元/张。优势是国内访问稳定、可备案、能开发票。 - 硅基流动 SiliconFlow:
https://api.siliconflow.cn/v1,新用户送 14 元人民币额度,文本与图像通用,图像按张计费。 - 火山方舟:注册赠送 50 万 tokens,但只抵扣按 token 计费的在线推理,文生图按张计费,不在赠送范围内。
三、 开源自建(完全可控、可商用)
如果你要的是「能商用 + 自建 + 一张 3060 就能跑」,2026 年的答案是 FLUX.2 klein 4B,而不是几年前的 SDXL。
| 模型 | 参数 | 许可 | 硬件门槛 |
|---|---|---|---|
| FLUX.2 [klein] 4B | 4B | Apache 2.0(可商用) | 约 8GB 显存起步,4 步蒸馏,亚秒级出图 |
| FLUX.2 [klein] 9B | 9B | BFL 非商用许可 | 中高端消费卡 / 服务器卡 |
| FLUX.2 [dev] | 32B | 非商用许可 | 官方脚本需 H100 级;4090 需量化版 + 远程文本编码器 |
| Qwen-Image | 20B MMDiT | Apache 2.0 | 消费级需量化,中文出图优秀 |
| Z-Image-Turbo | 6B | 待核实 | 社区称 6GB 卡可跑(自媒体口径,非官方 benchmark) |
注:BFL 官方称 FLUX 3 的开放权重仍在 rollout 中,目前没有可自托管的权重。另外只有 klein 4B、klein 4B Base 与 FLUX.2 VAE 是 Apache 2.0,klein 9B 与 FLUX.2 [dev] 商用需向 BFL 购买授权。
封装成 API 的方式
ComfyUI 目前的官方推荐是 Comfy API v2:
GET /api/v2/jobs/{id}——任务状态的权威视图:当前状态、最新进度、已产出的全部输出,在expires_at前一直可用(崩溃后一小时回来仍能取回结果)。GET /api/v2/jobs/{id}/events——SSE 实时进度流。官方明确这是非权威源:无事件 ID、无恢复游标,断连期间帧会丢失,只用来驱动进度条。- v2 内只做增量变更,破坏性变更以 v3 发布;旧的
/prompt、/history、/ws暂不弃用。 - Beta 期间自托管需并行运行开源的
comfy-api-proxy提供 v2 契约,稳定后并入核心。官方提供 Python / TypeScript SDK。
顺便提醒一句官网设计文档里的原话:旧端点「是为了服务 ComfyUI 网页界面而存在的,在它们之上构建意味着依赖从未向你承诺过的内部实现」。所以用旧接口的存量项目,建议逐步往 v2 迁。
成本粗算
以下是估算,不是实测:以 4090 约 2 元/小时、klein 4B 出 1024×1024 约 2 秒/张计,1000 张 ≈ 0.56 小时 ≈ 约 1.1 元/千张;若上 20–32B 大模型(8–20 秒/张),约 4.5–11 元/千张。这个量级远低于任何按张计费的商业 API,但没算模型下载、镜像存储、空闲计费和运维成本。
四、 关于「逆向免费接口」
网上流传的 jimeng-free-api-all 这类项目(封装即梦 AI 的 OpenAI 兼容接口,靠官方每日赠送的积分出图)不建议用于任何正式场景,原因有三:
- 本质是逆向工程、模拟网页端行为,直接违反即梦用户协议,随时可能失效或被封号;所谓「免费额度」是官方赠送积分,不是稳定供给。
- 无 SLA、无法备案、数据链路不透明。
- 若对外转售或提供工具,会触碰《人工智能生成合成内容标识办法》第十条(见下节)。
结论:个人尝鲜可以,别写进生产方案。
五、 选型建议
| 场景 | 推荐方案 | 核心理由 |
|---|---|---|
| 要真免费、量够用、无信用卡 | Cloudflare Workers AI(flux-1-schnell) | 10K Neurons/天 ≈ 230 张/天,免费账号直用 |
| 国内直连、中文优先 | ModelScope Qwen-Image | 2000 次/天,单模型 500 次 |
| 可商用 + 自建 | FLUX.2 klein 4B | Apache 2.0,约 8GB 显存,4 步出图 |
| 画质优先、可接受付费 | Gemini 3 Pro Image(Blaze) | 4K 输出,中文图内文字最强 |
| 一个 key 打通多家 | OpenRouter Image API | $0.05/张起,失败不计费 |
| 稳定生产、要发票要 SLA | 阿里云百炼万相 / 硅基流动按量付费 | 0.2 元/张量级,合规可备案 |
六、 调用示例
以 ModelScope Qwen-Image 为例,接口兼容 OpenAI 风格,开通后在控制台获取 API Key 即可:
import requests
import json
url = "https://api-inference.modelscope.cn/v1/images/generations"
payload = json.dumps({
"model": "Qwen/Qwen-Image",
"prompt": "北京故宫雪景,红墙白雪,庄严大气,8K分辨率"
})
headers = {
"Content-Type": "application/json",
"Authorization": "Bearer YOUR_API_KEY"
}
response = requests.post(url, headers=headers, data=payload)
print(response.json())
若走 Cloudflare Workers AI,则是另一套路径(需替换 ACCOUNT_ID 与 API_TOKEN):
import requests
url = ("https://api.cloudflare.com/client/v4/accounts/"
"ACCOUNT_ID/ai/run/@cf/black-forest-labs/flux-1-schnell")
headers = {
"Authorization": "Bearer API_TOKEN",
"Content-Type": "application/json"
}
resp = requests.post(url, headers=headers,
json={"prompt": "a red panda in a bamboo forest"})
with open("out.png", "wb") as f:
f.write(resp.content)
七、 注意事项
- 合规性:国内使用优先选择阿里云、百度智能云、腾讯云等合规厂商,避免境外服务的数据出境风险。
- 额度会变:免费额度普遍是限时/限量,且这几个月一直在收紧,建议代码里做好降级,别把免费端点当唯一依赖。
- 性能要求:自建方案需要 NVIDIA GPU,轻量模型 klein 4B 约 8GB 显存起步,20B 以上的模型消费级卡需要量化。
八、 生成内容标识:这条线不要踩
《人工智能生成合成内容标识办法》(网信办等四部门,2025-09-01 起施行)与本话题直接相关:
- 第四条:图片须在适当位置添加显著的提示标识;提供下载、复制、导出功能时,文件中必须含有显式标识。
- 第五条:须在文件元数据中写入隐式标识,包含生成合成内容属性信息、服务提供者名称或编码、内容编号;鼓励再加数字水印。
- 第六条:传播平台须核验元数据中的隐式标识;核验不到但检测到痕迹的,按「疑似生成合成内容」加显著提示,并在元数据补写传播要素信息。
- 第九条:用户申请不带显式标识的内容时,服务提供者可在用户协议中明确用户标识义务后提供,但须留存提供对象信息日志不少于 6 个月。
- 第十条:任何组织和个人不得恶意删除、篡改、伪造、隐匿标识,不得为他人实施上述行为提供工具或者服务。
落到自建方案上就是两件事:出口图片加角标或文字(显式),写入 EXIF / PNG 元数据(隐式)。BFL 官方推理仓库自带 invisible-watermark 参数,并建议接入 C2PA。
相关阅读
- 免费大模型API汇总与分析——同一话题的语言模型版本,含轮询架构与熔断降级方案,配本文的生图 API 一起用。
- 免费大模型api大全——按 provider 列出的英文对照表,查 base URL 和 rate limit 时最快的那一篇。
顺手推荐:威聚 Weihub 开源项目库
hub.weiyoun.com(威聚 Weihub)是一个中文开源项目库,目前收录了 220 个项目,按功能(AI 工具、Web 框架、效率工具、运维、网络工具、数据资源、教育可视化等)和编程语言(Go、Python、Rust、TypeScript、C++ 等)两个维度分类,支持按星级、最近更新时间和名称排序。它比较特别的一点是,每个项目都配了一句 AI 摘要和一个「二开难度」评级(易二开 / 中等 / 难二开),能很快判断这个项目是「拿来改改就能用」还是「看看就好」。
对本文读者来说,用法很直接:想自己搭生图服务时,去 AI 工具分类里按星级排一遍,ComfyUI 生态、本地推理、模型部署相关的轮子基本都在那儿,配合「二开难度」标签筛选,比在 GitHub 上翻要省事。站点还挂了 AiniaDoc 爱译匣、威扬盘搜、威扬网盘分享、wyshop 源码商店等几个同系列工具。
数据核实说明:Cloudflare、OpenRouter、Google/Firebase、Hugging Face 的数据来自官方一手页面;ModelScope、阿里云百炼万相、火山方舟的额度来自社区文档,请以官方控制台为准。Groq、NVIDIA NIM 等平台的限额未能取得官方页面确认,落地前建议用实际调用测一遍。