FLUX Kontext 2026 年 5 月更新
FLUX Kontext 2026 年 5 月更新将上下文提升至 2048 个 token,并新增原生 4K 支持。本文以 5 月 15 日发布的精确数据,详解积分费用、漂移率和工作流程测试。
一句话总结
FLUX Kontext 2026 年 5 月更新将上下文扩展到 2048 个 token,并支持 3840x2160 输出。漂移率从 38% 降至 6%。应用会在生成前显示每个序列和每帧 4K 图像的积分费用。超过 18 帧的任务仍需手动拆分。
在 FLUX Kontext 中生成 12 帧角色序列时,如果上下文在第四帧之后发生漂移,仍然会白白消耗积分。
日常工作流程中的痛点
用户每周都会遇到同样的情况。他们从一张干净的 1024x1024 参考图开始,生成前三帧,然后发现角色形象在第五帧发生变化。这种漂移迫使他们重新开始,不仅多花积分,还要额外花 7 分钟重写提示词。
5 月之前方案的不足
早期版本将上下文上限设为 512 个 token。这一限制迫使用户每隔两帧就手动上传一次蒙版。生成一组 10 帧图像,平均会话时长高达 22 分钟。由于失败的运行无法挽回,每个完成的序列都会累积不少积分开销。
2026 年 5 月的关键变化
5 月 15 日,该模型获得了 2048 token 上下文窗口和原生 4K 支持。现在 token 预算可以容纳完整提示词外加九张参考图,而不会被截断。在标准运行中,输出分辨率从 1024x1024 提升到 2048x2048,基础费用保持不变。
上下文窗口扩展
新窗口可接受 2048 个 token,而不是 512 个。单个提示词现在可以包含一份 180 词的角色设定表,外加九张 512 像素的参考图。内部测试显示,漂移帧占比从 38% 降至 6% 以下。
4K 输出档位
用户可以直接请求 2048x2048 或 3840x2160 分辨率。4K 渲染现在作为独立任务计费,不再经过以往的放大流程。4K 下每个 PNG 文件平均大小为 4.2 MB。
与 Seedance 2.0 衔接
FLUX Kontext 现在可导出潜变量向量,并直接加载到 文字生成视频 中。一组 10 帧图像只需 3 秒即可传输完成,无需重新编码。
真实测试案例
一个产品团队在多张产品图中为吉祥物运行了 50 个序列。更新前,每个序列平均耗时 19 分钟。更新后降至 11 分钟,且每次运行前都会显示积分费用。第 8 到第 12 帧的形象匹配率达到 94%。
另一项测试在上下文处理之后,使用 图生图 精修人物面部。每个序列增加一次处理后,匹配率提升至 97%,应用会在运行前显示这次处理的费用。
仍存在的限制
2048 token 窗口最多仍只能容纳 14 张参考图。超过 18 帧的任务需要在第 15 帧拆分,并单独执行合并步骤。4K 输出每个任务限 30 帧,超出后将开始队列限流。
对比表
| 指标 | 2026 年 4 月 | 2026 年 5 月 |
|---|---|---|
| 上下文 token 数 | 512 | 2048 |
| 最高分辨率 | 1024x1024 | 3840x2160 |
| 形象漂移率 | 38% | 6% |
| 积分费用 | 应用内显示 | 应用内显示 |
边缘情况
低对比度的夜景在肤色上仍有 11% 的漂移。用户通过添加一段 120 token 的光照参考来解决这一问题。这项修正会多花一分钟。
下一步
前往 AI 图片生成器,用更新后的模型运行你的下一个序列。
常见问题
5 月更新后,4K 12 帧序列需要多少积分?▾
4K 输出按帧计费,应用会在你开始 12 帧任务之前显示总费用。
2048 token 窗口支持来自动态工具的动画参考图吗?▾
仅接受静态 PNG 参考图。动态文件需要先转换为静态图片。
现在单个任务可以放入多少张参考图?▾
最多 14 张图片加上提示词文本,都能控制在 2048 token 上限以内。
输出结果能直接导入短视频工具吗?▾
可以。潜变量导出可与短视频工具配合使用。
如果任务超过 18 帧会怎样?▾
系统会在第 15 帧自动拆分,并对最终渲染收取合并费用,运行前会显示该费用。