Flux

🆓 免费

新一代开源图像生成,质量媲美闭源

🚀 访问官网🔍 探索更多

工具简介

Flux(全称 Flux.1)是 2024 年下半年横空出世的新一代开源图像生成模型,由 Black Forest Labs 开发——这支团队的核心成员正是 Stable Diffusion 的原始创造者。Flux 一经发布便在 AI 社区引发了巨大震动,因为它的图像质量不仅碾压了 Stable Diffusion 全系版本,在诸多场景下甚至直接对标乃至超越了付费的 Midjourney 和 DALL·E 3。Flux 系列包含三个版本:Flux Pro(商用 API)、Flux Dev(非商用研究)、Flux Schnell(极速版),均采用 Apache 2.0 许可证开源,意味着任何人都可以免费使用。

Flux 最令人印象深刻的突破在于手部渲染、文字生成和复杂场景的构图能力。在 AI 图像生成领域,"手"一直是个老大难问题——多一根手指、畸形的手指、诡异的关节角度几乎成了 AI 出图的标志性缺陷。Flux 在手部解剖精度上的表现堪称革命性:自然的手指弯曲弧度、正确的手指数量、合理的关节比例,在大多数情况下无需后期修图。同时,Flux 的文字渲染能力也非常出色,在图片中嵌入英文标语的准确率达到了 Midjourney V6 以上的水平。此外,Flux 对自然语言的理解极其精准,长 prompt 中的每个元素几乎都能正确呈现,不像旧版 SD 那样容易遗漏或混淆多个对象。由于架构与 SD 兼容,现有的 ComfyUI 生态可以直接适配 Flux 模型,已有大量社区用户搭建出了 Flux + ControlNet + LoRA 的工作流。

✨ 优劣势分析

👍 优点

  • 手部渲染精度史诗级提升:Flux 对人物手部的生成能力远超 SDXL 和 SD 3,在大多数场景下能生成正确的手指数量、合理的姿势和自然的关节弯曲,极大减少了后期修图的工作量。
  • 画面质感和细节丰富度接近 Midjourney:光影处理、皮肤质感、毛发细节、布料褶皱——Flux 在这些维度的表现已经可以与付费闭源产品掰手腕,尤其是在写实人像和产品摄影风格上。
  • 完全开源且生态兼容性好:Apache 2.0 协议、支持 ComfyUI、可训练 LoRA——对于已经在 SD 生态中的用户来说,迁移成本几乎为零。

👎 不足

  • 硬件需求极高:Flux Dev 版本需要 24GB+ 显存才能以全精度运行(FP16),即使用量化版本也需要 12-16GB 显存。大多数消费级显卡(如 RTX 3060/4060 的 8GB 版本)运行起来非常吃力。
  • 生成速度较慢:同硬件条件下,Flux 的出图速度大约是 SDXL 的 1/3 到 1/5。生成一张高质量图片可能需要 30-90 秒,对于需要快速迭代的场景来说用户体验不佳。
  • 生态成熟度仍在追赶:虽然 ComfyUI 已支持 Flux,但 ControlNet、IP-Adapter 等关键工具的适配还在进行中。相比 SD 积累了两年多的海量 LoRA 和 Checkpoint,Flux 的社区模型储备还需要时间积累。

🎯 适用场景

💡 使用建议

🔄 同类替代推荐

以下AI绘画类工具也值得关注:

核心功能

Flux 系列模型代表了开源图像生成的最前沿,核心能力包括:

1. 超高写实人像生成——Flux 在人物渲染上的表现是它的标志性优势。皮肤的微观纹理(毛孔、细纹、光泽)、毛发的自然层次、眼神的高光和深邃感、衣物的材质与褶皱质感——这些细节在 Flux 的输出中表现得极为真实。与 SDXL 相比,Flux 的人物面部几乎没有"塑料感"或"CG 味",更接近高质量摄影作品的质感。

2. 精准的文字渲染——在 AI 图像生成领域,在图片中生成准确可读的文字一直是个难题。Flux 在这方面的表现堪称革命性:你可以在 prompt 中指定要在画面中出现的文字内容,模型能以高准确率将文字渲染到图片中。这对于需要生成带文字的产品宣传图、海报、标牌等场景非常重要。

3. 超长 Prompt 精准理解——旧版 Stable Diffusion 在面对复杂 prompt(包含多个对象、场景关系、风格限定)时经常遗漏或混淆元素。Flux 对复杂 prompt 的解析准确率大幅提升——你可以用一段 200 词的详细描述,模型几乎能正确呈现其中的每一个元素和它们之间的空间关系。

4. 多版本覆盖不同需求——Flux Pro(通过 API 使用,商业授权)、Flux Dev(本地部署,非商业研究)、Flux Schnell(极速版,适合快速迭代),三个版本的定位清晰:Pro 画质最高,Dev 适合深度定制和研究,Schnell 适合快速验证和批量生成。

5. ComfyUI 生态兼容——Flux 的模型架构与 ComfyUI 兼容,这意味着已有的 ComfyUI 节点和工作流可以直接适配 Flux。社区已经开发了大量 Flux 专用的 LoRA、ControlNet 和 IP-Adapter 适配器,为 Flux 的创作自由度持续加码。

上手体验

使用 Flux 的方式分为云端和本地两条路径。云端路径最简单:访问 replicate.com、fal.ai 或 Hugging Face Spaces 上的 Flux 在线 Demo,在文本框中输入 prompt → 选择版本(Pro/Dev/Schnell)→ 点击生成 → 等待 15-90 秒(取决于版本和排队情况)→ 下载图片。云端方案按调用次数计费,对于偶尔使用或硬件配置不够的用户来说经济实惠。

本地部署则需要一定的技术基础。最推荐的方式是使用 ComfyUI:下载 Flux Dev 模型文件(约 23GB)→ 放入 ComfyUI 的 models 目录 → 加载社区分享的 Flux 工作流 → 开始生成。本地部署的好处是完全控制、无次数限制、零单次调用成本,但硬件门槛高——推荐 24GB+ 显存的显卡(如 RTX 4090、A6000)。如果你的显卡只有 12GB,可以使用量化版本(FP8 或 GGUF),会损失一些画质但能跑起来。

写 Prompt 方面,Flux 对自然语言的理解非常好,不需要像早期 SD 那样用大量关键词堆砌。用完整的英文句子描述画面即可,例如 'A young woman with wavy brown hair sitting at a wooden desk in a sunlit library, reading an old leather-bound book, warm golden hour light streaming through tall windows, photorealistic'。Flux 会对 prompt 中的每个元素给予合理权重,不需要复杂的加权语法。

价格方案

使用方式价格说明
Flux Dev(本地)免费Apache 2.0 开源,本地下载运行,需 24GB+ 显存
Flux Schnell(本地)免费速度最快、显存需求最低(12GB),适合快速验证
BFL API - Flux Pro按量计费$0.04-0.12/张 起(取决于分辨率),商业授权
Replicate / Fal.ai按量计费每张约 $0.01-0.05(Schnell),$0.03-0.10(Dev)

开源本地部署是 Flux 最大的成本优势——如果你有合适的硬件,生成成本为零。云 API 方案的价格在 $0.01-0.12/张 区间,相比 Midjourney 的 $10-60/月订阅制,对于按量使用的用户来说可能更划算,但对高频用户来说订阅制可能更经济。以上价格以 bfl.ai/pricing 及各云平台实时价格为准。

同类工具对比

维度FluxMidjourneyStable Diffusion
价格免费(本地)$10-60/月免费(本地)
写实人像顶级顶级良好(取决于模型)
文字渲染优秀中等
生态成熟度快速成长中不开放(闭源)最成熟、LoRA最多
硬件要求高(24GB+)无(云端)中等(8GB+)
最佳场景极致画质、本地控制即开即用、最佳美学海量LoRA、深度定制

常见问题

Q:Flux 和 Stable Diffusion 是什么关系?
A:Flux 由 Black Forest Labs 开发,核心团队成员正是 Stable Diffusion 的原始创造者(从 Stability AI 离开后创立的新公司)。可以理解为 SD 原班人马做的"下一代 SD",但独立于 Stability AI 的官方 SD 产品线。两者的模型架构不同,但底层都是扩散模型。

Q:我的显卡是 RTX 3060 12GB,能跑 Flux 吗?
A:可以跑量化版本(FP8 或 GGUF),但不能跑全精度的 Dev 版。量化版本会牺牲一些画质(主要是细节纹理和色彩深度),但对于个人学习和创作来说完全够用。生成一张图大约需要 60-120 秒。

Q:Flux 现在有足够多的 LoRA 可以用吗?
A:相比 SD 积累了两年的海量 LoRA 生态,Flux 的 LoRA 数量还处于追赶阶段。在 CivitAI 上搜索 Flux 分类,目前已有数千个 LoRA 模型,涵盖人物风格、服装、建筑、特定艺术家风格等,品类在快速增长中。

Q:Flux Pro 和 Dev 画质差距大吗?
A:在大多数场景下差距不明显。Pro 版在极高分辨率和极限细节(如群体人像中每个人的面部表情)上有优势。对于 90% 的创作需求,Dev 版的画质已经非常出色。

本文基于公开资料整理,价格与功能以官网实时信息为准。