
MarDini是Meta AI Research推出的视频扩散模型工具站点,核心定位是为用户提供多场景视频生成服务。核心功能包括支持任意位置任意数量掩码帧的视频生成,可完成视频插值、图像转视频、视频扩展三类主流任务,采用低分辨率规划模型优先的资源分配架构提升运行效率。目标用户覆盖AI视频研发人员、内容创作从业者、计算机视觉相关领域学生等群体,可用于短视频内容补全、静态素材动态化、长视频片段延伸、视频生成技术学术研究等多种场景。
- 运营状态
- 正常运营
- 地址
- mardini-vidgen.github.io
- 定价模式
- 目前MarDini处于公开体验阶段,提供
- 是否开源
- 闭源
- 适合人群
- AI视频研发人员、短视频创作者、计算机视觉专业学生、影视后期从业者
- 收录时间
- 2026/6/14
- 访问量
- 0 次
编辑点评
这款由Meta AI Research推出的视频扩散模型工具,最大的特点是打破了传统视频生成模型对参考帧位置和数量的限制,用户不需要按照固定规则提供参考素材,即可在视频的任意位置补全内容。其将掩码自回归和扩散模型的优势融合的架构,既保留了掩码自回归在内容逻辑连贯性上的优势,也具备扩散模型在画质渲染上的能力,同时低分辨率优先的资源分配设计,也让普通设备也能运行相对复杂的视频生成任务。对于需要处理各类非标准化视频生成需求的用户来说,它提供了更多的操作灵活性,少步推理的设计也能提升日常使用的效率,适合作为视频生成领域的工具选项之一。
核心功能
使用指南
- 1
访问MarDini官方站点,在首页查看功能说明和使用须知,确认站点当前开放的生成功能和使用限制,提前准备好需要上传的参考素材。
- 2
选择对应的生成功能入口,可选项包括视频插值、图像到视频生成、视频扩展三类,点击对应选项进入功能配置页面。
- 3
按照页面提示上传参考素材,视频插值任务需上传前后参考片段,图像转视频需上传参考图像,视频扩展需上传原视频片段。
- 4
配置生成参数,包括生成视频的时长、帧率、分辨率,以及视频扩展的方向、插值的中间帧数量等,确认参数符合需求后提交生成请求。
- 5
等待模型完成推理后,预览生成的视频内容,确认效果符合预期即可下载输出文件,若效果不满意可调整参数重新提交生成任务。
优势与不足
优点4 项
"支持任意位置任意数量掩码帧的生成条件设置,适配多样化的非标准化视频补全需求"
"同时覆盖视频插值、图像转视频、视频扩展三类主流视频生成任务,功能场景覆盖全面"
"采用低分辨率规划优先的架构,降低大规模时空注意力的计算成本,提升生成效率"
"少量推理步骤即可输出画质和连贯性表现较好的视频,降低用户等待时间"
不足4 项
"站点目前没有中文界面,对不熟悉英文的用户存在使用门槛"
"生成高分辨率长视频时仍会出现细节模糊、动作逻辑偏差的问题"
"目前没有提供云端存储功能,用户生成的内容需要及时下载避免丢失"
"暂不支持自定义风格、运镜等细化参数调整,生成内容的可控性有限"
定价说明
目前MarDini处于公开体验阶段,提供免费使用权限,免费版用户可使用所有核心生成功能,单任务生成视频时长上限为10秒,分辨率上限为720P,单日提交任务数量不超过5次。暂时没有推出付费版本的公开计划,适合有短时长视频生成需求的用户体验使用,若有长时长、高分辨率的批量生成需求,可关注官方后续的版本更新公告。
价格和授权政策可能变化,请以官网最新信息为准
适合人群与场景
- AI视频研发人员
视频生成技术迭代研究
- 短视频创作者
内容补全与素材扩展
- 计算机视觉专业学生
视频生成模型学习
- 影视后期从业者
视频片段过渡优化
- 独立动画制作者
静态分镜转动态片段
- 内容运营人员
营销素材动态化制作
- AI技术爱好者
视频生成效果体验
- 学术研究人员
视频扩散模型性能测试
常见问题
深度了解
MarDini作为Meta AI Research推出的视频扩散模型工具,将掩码自回归的优势整合到统一的扩散模型框架中,填补了传统视频生成模型在参考帧设置灵活性上的不足。用户使用MarDini时,可以在目标视频的任意帧位置设置任意数量的掩码帧作为生成条件,不需要遵循固定的参考帧规则,即可完成视频内容的补全生成,适配各类非标准化的视频制作需求。站点目前覆盖视频插值、图像到视频生成、视频扩展三大核心功能,用户上传对应的参考素材并设置参数后,即可快速得到生成结果。MarDini采用低分辨率规划优先的资源分配架构,将大部分计算资源分配给低分辨率的内容规划阶段,先完成整体视频的时空逻辑排布,再逐步渲染细节,既降低了计算成本,也提升了生成效率,仅需要少量推理步骤即可输出效果可观的视频内容。无论是AI视频研发人员做技术研究,还是内容创作者处理日常的视频素材制作需求,都可以通过MarDini实现相应的目标,目前站点处于公开免费体验阶段,用户可以直接访问官网使用相关功能。
Ready to try
准备好体验 MarDini 了吗?
点击下方按钮在新标签页打开官网,开始探索它的全部功能。
相关工具

Stable Video Diffusion AI
Stable Video Diffusion AI是专注于AI视频生成的在线工具站点,基于Stable Video Diffusion技术框架打造,为用户提供图像转视频、文本生成视频、视频风格迁移等核心能力。站点无需本地部署复杂模型,用户通过浏览器即可访问使用,适合内容创作者、设计从业者、影视制作人员等群体,可用于制作短视频素材、广告创意demo、游戏场景动画、教育科普视频等多种内容,帮助用户降低视频创作的技术门槛,提升内容产出效率。
img2video
免费img2video是基于AI技术的静态图像与文本转短视频生成平台,核心定位为降低视频创作门槛的内容生产工具。平台支持单图生成动态视频、文本描述控制视频动效、多风格视频参数调节三类核心功能,面向内容创作者、电商运营者、个人内容分享者等群体,可应用于社交媒体短视频制作、产品展示短片生成、老照片动态化处理、创意内容二次创作等多种场景,帮助用户在不需要复杂视频剪辑技能的前提下,产出适配不同传播渠道的动态视频内容。

Motion-I2V
免费Motion-I2V是专注于图像到视频生成的技术框架展示站点,核心面向AI生成内容领域的研究者与开发者,提供可控且一致性更高的图像转视频方案。其核心功能包括两阶段式图像转视频生成,支持大运动与视角变化场景下的稳定输出;可配置的稀疏轨迹控制功能,允许用户自定义运动路径与作用区域;零样本视频到视频转换能力,无需额外训练即可完成视频风格或内容调整。适合AIGC从业者验证视频生成效果、计算机视觉研究者对比算法性能、内容创作者尝试静态素材动态化的各类场景。
Seedance 2.0
Seedance 2.0是字节跳动推出的多模态AI视频生成平台,核心定位是帮助用户创作可控性强、内容一致性高且音画同步的高质量视频内容。平台支持文本生成视频、图像生成视频、视频风格迁移、音频匹配生成等多项功能,同时提供片段长度调节、镜头运镜控制、角色形象一致性保留等精细化调整选项。目标用户覆盖影视内容创作者、短视频运营者、广告策划人员、新媒体从业者、学生创作群体等,可应用于微电影创作、商业广告片制作、短视频内容产出、课程教学演示视频制作、创意内容原型验证等多种场景,满足不同用户对AI视频生成的多样化需求。
Seedance 2
Seedance 2是字节跳动推出的多模态AI视频生成工具,核心定位为依托先进多模态AI技术,将文本、图像等输入转化为高清专业级视频内容。平台支持文本生成视频、图像生成视频、自定义分辨率输出、视频风格调整、视频时长控制等核心功能,可生成最高8K分辨率的视频内容。目标用户覆盖影视内容创作者、新媒体运营人员、独立视频制作人、广告创意从业者、艺术设计师以及高校传媒专业学生,适用场景包含影视概念片预制作、新媒体短视频创作、广告创意小样生成、艺术视觉内容创作、课堂多媒体内容制作等多个领域。
Seedance 3.0
Seedance 3.0是由字节跳动提供技术支持的AI视频生成工具,核心定位为面向内容创作者提供从文本或图像生成高清视频的服务。核心功能包括文本生成视频、图像生成视频、视频帧延续生成、镜头风格迁移以及剧本分镜转成片,支持创作者自定义视频时长、镜头运动和画面风格。目标用户覆盖影视行业创作者、新媒体内容生产者、独立内容创作者和广告营销人员,适用于影视前期概念片制作、短视频内容产出、广告创意视频小样生成、个人创意内容可视化等多种场景。

Sora 2
Sora 2是OpenAI开发的AI音视频生成平台,在原版Sora基础上优化了生成能力,支持根据文本指令生成长时长高清音视频,具备精准物理模拟、高写实画面生成、音画同步生成和创意参数控制等核心功能,面向内容创作者、影视制作团队、新媒体运营人员、设计从业者、教育内容创作者以及游戏开发者等用户,可用于广告视频制作、概念短片预览、新媒体内容创作、教学动画生成、游戏场景预演等多种创作场景。
Seedance 2.5 AI
Seedance 2.5 AI是一款专注于AI视频生成的工具,核心定位是将文本、图像转化为高分辨率视频内容的生成平台。它支持生成4K分辨率的电影级视频片段,提供文本生成视频、图像生成视频、风格迁移、镜头参数自定义、帧一致性控制等核心功能,面向内容创作者、影视制作团队、广告营销人员、短视频博主等用户,适用于影视概念片制作、广告创意视频输出、短视频内容创作、个人艺术影像创作等多个场景。
你是 MarDini 的开发者或团队吗?
认领后可编辑工具信息、获取真实点击数据,并在页面上展示官方认证徽章。
访问第三方工具时,请注意账号、隐私与支付安全

用户评论
0· 0 条