精品AI基于开源ComfyUI整合开发Bernini wubUI整合包工具
Bernini 强大视频编辑模型-免费webUI整合包(v1.0版本)-开箱即用!
夸克网盘下载:https://pan.quark.cn/s/ac182a4eb642
百度网盘下载:https://pan.baidu.com/s/11M__sT7108CQ2OEdXojVkQ?pwd=JPAI
视频教程:https://www.bilibili.com/video/BV17GgD6YEE8/
虚拟内存设置:https://www.bilibili.com/video/BV1kcm9BMELE/
Bernini 官方简介
Bernini 是字节跳动开源的统一式 AI 视频生成与编辑框架,核心目标是让模型先“理解和规划”要改什么,再完成视频生成或编辑。[ref:1,2]
- 核心架构:由多模态大模型(MLLM)充当语义规划器,解析文字、图片、原视频等输入;再由基于 DiT 的扩散渲染器生成结果。
- 支持能力:文生视频(T2V)、视频编辑(V2V)、参考图引导的视频编辑(如替换服装/插入物体)、参考图生视频(R2V)等。[ref:1,2]
- 主要特点:更强调复杂指令理解和可控编辑,例如既能保持原视频运动,也可按指令改变人物动作;可结合参考图保持角色、服饰或物体的一致性。
- 版本:
- Bernini:完整管线,含语义规划器与渲染器,复杂指令跟随更强;
- Bernini-R:仅渲染器,部署相对简单,基于 Wan 系列扩散渲染器微调;另有 1.3B 轻量版,适合风格迁移、去字幕/水印、局部修改等较简单任务。[ref:1]
- 开源情况:论文于 2026 年 5 月发布,代码和模型权重已开源,采用 Apache-2.0 许可;但本地推理对 CUDA GPU 要求较高,官方主要在 H100 环境测试。[ref:1,2]
一句话说:它更像一个“先做编辑方案、再执行渲染”的开源 AI 视频编辑器,而不仅是单纯的文生视频模型。
部分截图演示


评论0