Meta 发布最新 AI 视频生成模型 Movie Gen

Meta发布Movie Gen,30亿参数视频模型支持文生高清视频/图像,13亿参数音频模型实现音画精准同步;具备局部与全局编辑能力,并能基于个人图像保持角色特征。演示效果媲美Sora,整体表现优于Runway、可灵等主流工具。

发布于2024年10月5日 02:04
编辑零重力瓦力
评论0
阅读64

Meta 今天发布了自己的 AI 视频生成模型 Movie Gen,他们认为是迄今为止最先进的媒体基础模型。

Meta 今天发布了其 AI 视频生成模型 Movie Gen,称其为迄今为止最先进的媒体基础模型。

Movie Gen 是一个拥有 30 亿参数的变换器模型,能够从单一文本提示生成高质量、高分辨率的视频和图像。

除了视频生成,Movie Gen 还包括一个 13 亿参数的音频模型,能够通过视频输入和文本提示生成与视频同步的高保真音频,涵盖环境音、背景音和音效,确保音质优良且视频与音频精确对齐。

此外,Movie Gen 还具备编辑功能,可以通过生成的视频及文本指令执行局部编辑,如添加、删除或替换元素,或进行全局样式和背景的更改。

Movie Gen 还能够利用个人图像和文本提示,生成保留角色特征和自然运动效果的视频。

就目前发布的演示视频来看,画面质量和动态效果和 Sora 无异,总体效果甚至优于 Runway、可灵等目前最主流的 AI 视频生成工具。

详细介绍

Movie Gen

相关文章

OpenSpec 实操,68k 星框架让 AI 编程变成可复核清单
AI 产品工具
2026年9月18日
0 条评论
小创

OpenSpec 实操,68k 星框架让 AI 编程变成可复核清单

OpenSpec 是一款获 68k 星的 AI 编程工作流工具,通过规格驱动开发解决上下文遗忘与行为漂移问题。它将需求固化为结构化 Markdown 文件,利用差异规格和五步标准链路,把 AI 编程转化为可复核清单。该框架支持增量生长与项目级配置注入,适合复杂重构及团队协作,但需注意 Windows 归档回滚、YAML 解析隐患等已知缺陷。其本质是状态治理协议,而非代码生成替代品。

#AI编程#智能体#提示词工程
阅读全文
ChatGPT Work 实战,一句话让智能体自主完成复杂地理计算与交付
AI 产品工具
2026年9月15日
0 条评论
小创

ChatGPT Work 实战,一句话让智能体自主完成复杂地理计算与交付

ChatGPT Work 通过联网代码沙盒、Headless Chrome 及持久化文件系统,推动 AI 从问答工具演进为自主执行体。实测显示,智能体可凭单条指令自主调用 API 完成复杂地理计算并交付可视化地图与数据文件。该平台还支持一键建站、子智能体协作及定时任务,适用于实体交付场景。但当前仍存在代码透明度不足、上下文压缩致历史丢失及资源安全策略限制等问题,在生产环境的可复现性仍面临挑战。

#AI工具#智能体#ChatGPT
阅读全文
commit-rewriter 用本地 Web 界面重写 AI 编程产生的杂乱 Git 提交记录
AI 产品工具
2026年9月15日
0 条评论
小创

commit-rewriter 用本地 Web 界面重写 AI 编程产生的杂乱 Git 提交记录

针对 AI 编程代理产生的杂乱 Git 提交记录,开源工具 commit-rewriter 提供了本地 Web 可视化清洗方案。该工具基于 Git 交互式变基,支持批量编辑提交说明、查看代码差异及自动备份分支,确保操作安全可逆。其核心理念是将 AI 快速生成与人类发布前治理解耦,作为自动化编码的质量过滤网。尽管单机清理流程已简化,但多人协作场景下的历史重写冲突仍是待解决的挑战。

#AI工具#vibe coding
阅读全文
互动讨论

评论区

围绕《Meta 发布最新 AI 视频生成模型 Movie Gen》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。