AI绘画与视频工作流的事实标准ComfyUI,迎来了又一次重磅更新。7月30日,ComfyUI正式发布v0.29.0版本。据网易科技7月31日报道,本次版本共包含53次提交、涉及70个文件变更,并汇集了14位贡献者的工作成果。v0.29.0的更新重点非常集中:一方面继续推进底层模型推理优化,尤其是围绕Comfy Kitchen、RMS RoPE、INT8等方向进行性能改进;另一方面持续强化视频、音频、训练集处理、工作流模板和原生模型支持,合作节点新增或更新了OpenAI、Google、HeyGen、OpenRouter、Anthropic、ByteDance、Recraft等多个服务能力。
对于日常使用ComfyUI进行图像生成、视频生成、模型训练、工作流搭建以及云端服务调用的用户来说,这个版本带来了大量值得关注的功能与兼容性改进,尤其是视频处理能力的重大升级,正在重新定义AI内容创作工具链的效率边界。
v0.29.0对视频处理能力进行了关键修复。此前,视频转码过程会将每一帧内容缓冲到内存中再进行处理,对于分辨率较高、帧数较多或时长较长的视频任务,这种方式会持续占用大量内存资源,甚至可能引发内存不足问题。本次更新将视频转码改为流式处理,不再将每一帧完整缓存于RAM中,这一修复直接作用于视频转码阶段,使视频处理流程不再依赖全部帧先进入内存的模式。
对于视频生成、视频重绘、视频转换及后处理工作流而言,这项调整是本次版本中最实际的稳定性改进之一。创作者在批量处理高分辨率视频时,不再需要为内存不足而频繁重启工作流,长视频项目的处理上限被显著抬高。在AI视频生成日益普及的当下,这一底层能力的提升,为大规模视频内容生产扫清了障碍。
v0.29.0新增并完善了多个原生模型支持,使用户能够在ComfyUI中直接使用更多模型类型和能力。其中,新增JoyImageEdit原生模型支持,让ComfyUI的原生模型能力进一步扩展到JoyImageEdit相关场景,并针对JoyAI图像模型使用了优化后的RMS RoPE函数。在模型性能优化部分,JoyAI图像模型已切换至优化版RMS RoPE实现,以适配新的底层计算优化方向。
与此同时,MageFlow、Gemma4等新一代模型的加入,让ComfyUI的模型生态更加丰富。MageFlow是微软Mage团队于2026年7月发布的4B参数图像生成与编辑模型,支持原生分辨率生成与指令式编辑;Gemma4则代表了谷歌端侧多模态模型的最新进展。这些模型的全面支持,意味着创作者可以在一个统一的工作流环境中自由组合不同厂商的模型能力,大幅降低了多模型协作的技术门槛。
合作节点的新增与更新是v0.29.0的另一大看点。OpenAI、Google、HeyGen、OpenRouter、Anthropic、ByteDance、Recraft等多家服务能力的加入,让ComfyUI从单一的开源绘图工具,进化为连接各大AI服务商的超级枢纽。无论是调用云端大模型、接入视频生成服务,还是对接语音合成能力,用户都可以在ComfyUI的可视化工作流中完成,无需在多个平台间反复切换。
从行业视角看,ComfyUI的持续迭代反映了AI内容创作工具链的整合趋势。随着图像、视频、音频生成能力的边界日益模糊,创作者需要一个统一的工作流平台来编排所有AI能力,而ComfyUI凭借开源生态和灵活的可视化设计,正在成为这个平台的默认选项。v0.29.0的发布,进一步巩固了其作为AI创作基础设施的地位,也为下一阶段的多模态创作工作流奠定了更坚实的基础。
v0.29.0的53次提交、70个文件变更与14位贡献者,直观展示了ComfyUI开源社区协作模式的效率。与封闭的商用工具不同,ComfyUI的每一次版本迭代都吸纳了全球开发者的智慧:有人提交性能优化补丁,有人完善模型适配,有人修复边缘场景的bug,社区的力量让这款工具的迭代速度远超任何单一团队所能达到的水平。
这种模式对AI创作工具的生态演进具有深远影响。一方面,开源让工具的能力边界不断拓展,用户无需等待厂商排期就能获得新模型的支持;另一方面,社区贡献者通过参与开发积累了技术声誉,形成了良性的贡献循环。在AI技术日新月异的当下,开源协作正在成为AI创作基础设施保持领先的关键机制。对于普通创作者而言,这意味着每一次版本更新都能第一时间享受到社区沉淀的最新成果,而无需支付高昂的软件授权费用。从v0.29.0开始,ComfyUI还进一步优化了云端服务的接入体验,让个人创作者与专业工作室都能按需调度算力,降低大规模生成任务的硬件门槛。这套组合拳,让ComfyUI在AI创作工具中的地位更加稳固。