哪里有免费生图的大模型api

4850 次阅读

本文最后更新于 2026年9月5日。

为你整理了2026年9月可用的免费生图大模型API,按真免费、按量付费、开源自建三类划分。先说结论:过去几个月这个领域变动不小,谷歌的免费出图额度已经取消,现在真正能稳定白嫖的是 Cloudflare Workers AI 和 ModelScope;如果你能接受按张付费,Gemini 3 系列反而是画质和中文最好的选择。

一、 真正免费的生图 API

1. Cloudflare Workers AI(首选,免信用卡)

目前综合看最划算的一个。免费账号即可调用,图像模型不在「需绑定付费方式」的模型名单内(该名单目前只有 kimi-k2.6/2.7-code、glm-5.2/5.3/5.3-flash、deepseek-v4-flash/pro)。

  • 额度10,000 Neurons/天,00:00 UTC 重置,Free 与 Paid 计划都有。
  • 端点POST https://api.cloudflare.com/client/v4/accounts/{account_id}/ai/run/{model}
  • 可选模型@cf/black-forest-labs/flux-1-schnell(文生图)、@cf/black-forest-labs/flux-2-dev(图生图)、@cf/black-forest-labs/flux-2-klein-4b@cf/black-forest-labs/flux-2-klein-9b@cf/leonardo/lucid-origin@cf/leonardo/phoenix-1.0
  • 实际能跑多少张:2026 年起计价改为「tile + step」粒度。flux-1-schnell 为 4.80 neurons/512² tile + 9.60 neurons/step,4 步约 43 neurons/张,约合 230 张/天(按官方公式估算,实际取决于分辨率与步数)。
  • 超额:$0.011 / 1K Neurons。

2. ModelScope API-Inference(国内直连,额度最大)

  • Base URLhttps://api-inference.modelscope.cn/v1/,生图用 Qwen/Qwen-Image
  • 额度每天 2000 次调用,单模型上限 500 次。这是目前免费生图方案里量级最大的。
  • 门槛:ModelScope 账号(阿里云体系,需实名),国内直连,中文出图效果好。
  • 注意:额度数字目前主要见于社区与聚合文档,官方文档页为动态渲染难以直接核对,以控制台实际显示为准

3. Hugging Face Inference Providers

  • 额度:Free 用户每月 $0.10,PRO 每月 $2.00。用 Custom Provider Key 时不享受免费额度。
  • 端点https://router.huggingface.co/v1/(OpenAI 兼容)。
  • 实际够用吗:在 hf-inference 上跑 FLUX.1-dev 约 10 秒 × $0.00012/秒 ≈ $0.0012/张,$0.10 大概只够 80 张。结论是够验证接口,不够干活

4. NVIDIA NIM(build.nvidia.com)

  • 现状:目录内 97 个模型中约 38 个带 Free Endpoint,Text-to-Image 类 7 个、Image Generation 类 8 个。
  • 端点https://ai.api.nvidia.com/v1/(OpenAI 兼容),https://integrate.api.nvidia.com/v1
  • 门槛:注册 NVIDIA 开发者计划账号领免费 credits,一般免信用卡,约 40 RPM。
  • 注意:首页可见的 QWEN-IMAGEQWEN-IMAGE-EDIT 标为 Downloadable(可下载权重),并非免费端点。使用前请在目录页用 “Free Endpoint + Text-to-Image” 过滤确认。

二、 按量付费,但值得考虑

1. Google Gemini(画质与中文最强,但已无免费额度)

这里要特别说明:谷歌的免费出图额度已经取消gemini-2.5-flash-image 已弃用,Gemini 2.5 全系将于 2026 年 10 月关停;Imagen 全系已于 2026-08-17 关停。官方文档明确写着——无论使用哪个 Gemini API 提供方,图像模型都需要采用随用随付的 Blaze 定价方案

  • 现行模型gemini-3.1-flash-image(Nano Banana 2)、gemini-3.1-flash-lite-image(Nano Banana 2 Lite)、gemini-3-pro-image(Nano Banana Pro)。注意通用模型如 gemini-3.7-flash 不支持出图
  • 端点POST https://generativelanguage.googleapis.com/v1beta/models/{model}:generateContent
  • 能力:1K/2K/4K 分辨率(flash-lite 仅 512/1K),支持 1:1、1:4、9:16、16:9、21:9 等比例;提示与图内文字支持 35+ 语言(含 zh-CN),图内中文渲染能力目前最强;仅输出 PNG。
  • 门槛:需绑定账单;Vertex 上 3.x Image 仅 global 位置;2026-11-02 起 Firebase AI Logic 强制 App Check。
  • 适用:对画质和中文有要求的商业场景,以及需要 4K 输出的场合。

2. OpenRouter Image API

OpenRouter 已上线独立的图像 API,一个 key 打通多家出图模型。

  • 端点POST https://openrouter.ai/api/v1/imagesGET /api/v1/images/models 可枚举模型。
  • 参数resolution(512/1K/2K/4K)、aspect_ration(1–10)、qualityoutput_format(png/jpeg/webp/svg)、input_references(图生图)、stream(SSE 流式)。
  • 价格:按张 / 百万像素计。bytedance-seed/seedream-4.5$0.05/张openai/gpt-image-2 high / 16:9(1536×864)约 $0.13/张。生成失败或中断不计费。
  • 注意没有 :free 图像模型——:free 后缀目前只覆盖文本模型。

3. 国内云厂商

国内厂商的免费额度普遍很小,实际使用建议直接按量付费,单价在 0.2 元/张量级:

  • 阿里云百炼:通义万相 wan2.6-t2i 文生图,免费额度为「开通后 90 天内 50 张」,超出 0.2 元/张。优势是国内访问稳定、可备案、能开发票。
  • 硅基流动 SiliconFlowhttps://api.siliconflow.cn/v1,新用户送 14 元人民币额度,文本与图像通用,图像按张计费。
  • 火山方舟:注册赠送 50 万 tokens,但只抵扣按 token 计费的在线推理,文生图按张计费,不在赠送范围内。

三、 开源自建(完全可控、可商用)

如果你要的是「能商用 + 自建 + 一张 3060 就能跑」,2026 年的答案是 FLUX.2 klein 4B,而不是几年前的 SDXL。

模型 参数 许可 硬件门槛
FLUX.2 [klein] 4B 4B Apache 2.0(可商用) 约 8GB 显存起步,4 步蒸馏,亚秒级出图
FLUX.2 [klein] 9B 9B BFL 非商用许可 中高端消费卡 / 服务器卡
FLUX.2 [dev] 32B 非商用许可 官方脚本需 H100 级;4090 需量化版 + 远程文本编码器
Qwen-Image 20B MMDiT Apache 2.0 消费级需量化,中文出图优秀
Z-Image-Turbo 6B 待核实 社区称 6GB 卡可跑(自媒体口径,非官方 benchmark)

注:BFL 官方称 FLUX 3 的开放权重仍在 rollout 中,目前没有可自托管的权重。另外只有 klein 4B、klein 4B Base 与 FLUX.2 VAE 是 Apache 2.0,klein 9B 与 FLUX.2 [dev] 商用需向 BFL 购买授权。

封装成 API 的方式

ComfyUI 目前的官方推荐是 Comfy API v2

  • GET /api/v2/jobs/{id}——任务状态的权威视图:当前状态、最新进度、已产出的全部输出,在 expires_at 前一直可用(崩溃后一小时回来仍能取回结果)。
  • GET /api/v2/jobs/{id}/events——SSE 实时进度流。官方明确这是非权威源:无事件 ID、无恢复游标,断连期间帧会丢失,只用来驱动进度条。
  • v2 内只做增量变更,破坏性变更以 v3 发布;旧的 /prompt/history/ws 暂不弃用
  • Beta 期间自托管需并行运行开源的 comfy-api-proxy 提供 v2 契约,稳定后并入核心。官方提供 Python / TypeScript SDK。

顺便提醒一句官网设计文档里的原话:旧端点「是为了服务 ComfyUI 网页界面而存在的,在它们之上构建意味着依赖从未向你承诺过的内部实现」。所以用旧接口的存量项目,建议逐步往 v2 迁。

成本粗算

以下是估算,不是实测:以 4090 约 2 元/小时、klein 4B 出 1024×1024 约 2 秒/张计,1000 张 ≈ 0.56 小时 ≈ 约 1.1 元/千张;若上 20–32B 大模型(8–20 秒/张),约 4.5–11 元/千张。这个量级远低于任何按张计费的商业 API,但没算模型下载、镜像存储、空闲计费和运维成本。

四、 关于「逆向免费接口」

网上流传的 jimeng-free-api-all 这类项目(封装即梦 AI 的 OpenAI 兼容接口,靠官方每日赠送的积分出图)不建议用于任何正式场景,原因有三:

  • 本质是逆向工程、模拟网页端行为,直接违反即梦用户协议,随时可能失效或被封号;所谓「免费额度」是官方赠送积分,不是稳定供给。
  • 无 SLA、无法备案、数据链路不透明。
  • 若对外转售或提供工具,会触碰《人工智能生成合成内容标识办法》第十条(见下节)。

结论:个人尝鲜可以,别写进生产方案。

五、 选型建议

场景 推荐方案 核心理由
要真免费、量够用、无信用卡 Cloudflare Workers AI(flux-1-schnell) 10K Neurons/天 ≈ 230 张/天,免费账号直用
国内直连、中文优先 ModelScope Qwen-Image 2000 次/天,单模型 500 次
可商用 + 自建 FLUX.2 klein 4B Apache 2.0,约 8GB 显存,4 步出图
画质优先、可接受付费 Gemini 3 Pro Image(Blaze) 4K 输出,中文图内文字最强
一个 key 打通多家 OpenRouter Image API $0.05/张起,失败不计费
稳定生产、要发票要 SLA 阿里云百炼万相 / 硅基流动按量付费 0.2 元/张量级,合规可备案

六、 调用示例

ModelScope Qwen-Image 为例,接口兼容 OpenAI 风格,开通后在控制台获取 API Key 即可:

import requests
import json

url = "https://api-inference.modelscope.cn/v1/images/generations"
payload = json.dumps({
  "model": "Qwen/Qwen-Image",
  "prompt": "北京故宫雪景,红墙白雪,庄严大气,8K分辨率"
})
headers = {
  "Content-Type": "application/json",
  "Authorization": "Bearer YOUR_API_KEY"
}

response = requests.post(url, headers=headers, data=payload)
print(response.json())

若走 Cloudflare Workers AI,则是另一套路径(需替换 ACCOUNT_IDAPI_TOKEN):

import requests

url = ("https://api.cloudflare.com/client/v4/accounts/"
       "ACCOUNT_ID/ai/run/@cf/black-forest-labs/flux-1-schnell")
headers = {
    "Authorization": "Bearer API_TOKEN",
    "Content-Type": "application/json"
}
resp = requests.post(url, headers=headers,
                     json={"prompt": "a red panda in a bamboo forest"})
with open("out.png", "wb") as f:
    f.write(resp.content)

七、 注意事项

  • 合规性:国内使用优先选择阿里云、百度智能云、腾讯云等合规厂商,避免境外服务的数据出境风险。
  • 额度会变:免费额度普遍是限时/限量,且这几个月一直在收紧,建议代码里做好降级,别把免费端点当唯一依赖。
  • 性能要求:自建方案需要 NVIDIA GPU,轻量模型 klein 4B 约 8GB 显存起步,20B 以上的模型消费级卡需要量化。

八、 生成内容标识:这条线不要踩

《人工智能生成合成内容标识办法》(网信办等四部门,2025-09-01 起施行)与本话题直接相关:

  • 第四条:图片须在适当位置添加显著的提示标识;提供下载、复制、导出功能时,文件中必须含有显式标识。
  • 第五条:须在文件元数据中写入隐式标识,包含生成合成内容属性信息、服务提供者名称或编码、内容编号;鼓励再加数字水印。
  • 第六条:传播平台须核验元数据中的隐式标识;核验不到但检测到痕迹的,按「疑似生成合成内容」加显著提示,并在元数据补写传播要素信息。
  • 第九条:用户申请不带显式标识的内容时,服务提供者可在用户协议中明确用户标识义务后提供,但须留存提供对象信息日志不少于 6 个月
  • 第十条:任何组织和个人不得恶意删除、篡改、伪造、隐匿标识,不得为他人实施上述行为提供工具或者服务

落到自建方案上就是两件事:出口图片加角标或文字(显式),写入 EXIF / PNG 元数据(隐式)。BFL 官方推理仓库自带 invisible-watermark 参数,并建议接入 C2PA。

相关阅读

顺手推荐:威聚 Weihub 开源项目库

hub.weiyoun.com(威聚 Weihub)是一个中文开源项目库,目前收录了 220 个项目,按功能(AI 工具、Web 框架、效率工具、运维、网络工具、数据资源、教育可视化等)和编程语言(Go、Python、Rust、TypeScript、C++ 等)两个维度分类,支持按星级、最近更新时间和名称排序。它比较特别的一点是,每个项目都配了一句 AI 摘要和一个「二开难度」评级(易二开 / 中等 / 难二开),能很快判断这个项目是「拿来改改就能用」还是「看看就好」。

对本文读者来说,用法很直接:想自己搭生图服务时,去 AI 工具分类里按星级排一遍,ComfyUI 生态、本地推理、模型部署相关的轮子基本都在那儿,配合「二开难度」标签筛选,比在 GitHub 上翻要省事。站点还挂了 AiniaDoc 爱译匣、威扬盘搜、威扬网盘分享、wyshop 源码商店等几个同系列工具。

数据核实说明:Cloudflare、OpenRouter、Google/Firebase、Hugging Face 的数据来自官方一手页面;ModelScope、阿里云百炼万相、火山方舟的额度来自社区文档,请以官方控制台为准。Groq、NVIDIA NIM 等平台的限额未能取得官方页面确认,落地前建议用实际调用测一遍。