0

0

美团开源LongCat-Video支持高效长视频生成,迈出“世界模型”探索第一步

爱谁谁

爱谁谁

发布时间:2025-10-28 11:40:18

|

643人浏览过

|

来源于php中文网

原创

美团迈出通往“世界模型”的关键一步,旨在更高效地连接现实世界的“原子”与数字世界的“比特”。
美团开源longcat-video支持高效长视频生成,迈出“世界模型”探索第一步

▲美团LongCat团队发布并开源LongCat-Video视频生成模型,开启“世界模型”探索之路(资料图)

10月27日,美团旗下LongCat团队正式推出并开源其最新研发的LongCat-Video视频生成模型。该模型在文生视频和图生视频任务中均达到开源领域的SOTA(最先进)水平,同时通过原生支持视频续写任务的预训练机制,成功实现分钟级长度的高质量、连贯性视频生成,在跨帧时序一致性与物理运动合理性方面表现突出,显著提升了长视频生成的技术上限。

近年来,“世界模型”(World Model)因其具备理解、预测乃至重构真实世界运行规律的能力,被广泛视为通向下一代人工智能的核心路径。作为一种能够学习物理法则、时空动态及场景逻辑的智能系统,“世界模型”使AI获得对现实世界的深层认知能力。而视频生成技术正被视为构建此类模型的重要突破口——通过从大量视频数据中提炼几何结构、语义信息与物理规律,AI可在虚拟空间中模拟和推演真实世界的演变过程。

基于这一愿景,LongCat团队指出,此次发布的LongCat-Video正是迈向“世界模型”的首次实质性尝试。未来,该模型将有望应用于美团持续布局的自动驾驶、具身智能等需要深度环境交互的业务场景中,成为连接“比特世界”与“原子世界”的核心技术桥梁。

美团开源LongCat-Video支持高效长视频生成,迈出“世界模型”探索第一步

▲LongCat-Video实现视频推理速度提升至10.1倍,突破效率瓶颈(资料图)

根据技术文档披露,LongCat-Video基于Diffusion Transformer(DiT)架构打造,是一款多功能统一的视频生成基座模型。其创新性地利用“条件帧数量”作为任务区分信号:无条件帧时执行文本生成视频,输入1帧图像则进行图生视频,多帧历史序列则用于视频续写任务,无需额外微调或模块切换,真正实现了“文生—图生—续写”三大任务的一体化闭环。

图酷AI
图酷AI

下载即用!可以免费使用的AI图像处理工具,致力于为用户提供最先进的AI图像处理技术,让图像编辑变得简单高效。

下载

尤为值得一提的是,得益于以视频续写为核心的预训练策略,该模型可稳定输出长达5分钟的连续视频内容,且在整个过程中保持画质稳定、动作流畅,有效避免了行业常见的色彩漂移、画面降级和动作断裂等问题,确保长时间序列下的视觉一致性和物理合理性,满足数字人、机器人仿真、世界模型训练等高要求应用场景的需求。

为应对长序列处理中的计算冗余问题,模型引入块稀疏注意力(BSA)与条件token缓存机制,在处理93帧以上的长视频时仍能维持高效推理与高质量输出,彻底打破“视频越长,质量越差”的技术困局。

针对高分辨率、高帧率带来的算力挑战,LongCat-Video采用“二阶段粗到精生成(C2F)+ 块稀疏注意力(BSA)+ 模型蒸馏”三重优化方案,使整体视频推理速度提升达10.1倍,在保证视觉表现力的同时实现极致效率平衡。

美团开源LongCat-Video支持高效长视频生成,迈出“世界模型”探索第一步

美团开源LongCat-Video支持高效长视频生成,迈出“世界模型”探索第一步

▲LongCat-Video在多项基础任务中达到开源SOTA水平(资料图)

据评估报告,LongCat-Video的性能测试涵盖内部基准与多个公开评测体系,重点考察Text-to-Video(文本生成视频)和Image-to-Video(图像生成视频)两大核心任务,并从文本对齐度、图像保真度、视觉质量、运动连贯性及整体观感等多个维度进行全面评估。结果显示:其136亿参数规模的基座模型在两项任务上均达到当前开源模型中的领先水平;尤其在文本匹配精度、动作自然性等关键指标上优势明显;在VBench等权威公开基准测试中,综合表现位居前列,展现出强大的泛化能力与实用性。

相关文章

美团
美团

美团app是一款吃喝玩乐一应俱全的生活服务类软件,汇集团购、美食、酒店、外卖、电影、美发、美甲、KTV等服务于一体,为用户提供非常便利且全面的服务,有需要的小伙伴快来保存下载体验吧!

下载

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
登录token无效
登录token无效

登录token无效解决方法:1、检查token的有效期限,如果token已经过期,需要重新获取一个新的token;2、检查token的签名,如果签名不正确,需要重新获取一个新的token;3、检查密钥的正确性,如果密钥不正确,需要重新获取一个新的token;4、使用HTTPS协议传输token,建议使用HTTPS协议进行传输 ;5、使用双因素认证,双因素认证可以提高账户的安全性。

6559

2023.09.14

登录token无效怎么办
登录token无效怎么办

登录token无效的解决办法有检查Token是否过期、检查Token是否正确、检查Token是否被篡改、检查Token是否与用户匹配、清除缓存或Cookie、检查网络连接和服务器状态、重新登录或请求新的Token、联系技术支持或开发人员等。本专题为大家提供token相关的文章、下载、课程内容,供大家免费下载体验。

840

2023.09.14

token怎么获取
token怎么获取

获取token值的方法:1、小程序调用“wx.login()”获取 临时登录凭证code,并回传到开发者服务器;2、开发者服务器以code换取,用户唯一标识openid和会话密钥“session_key”。想了解更详细的内容,可以阅读本专题下面的文章。

1089

2023.12.21

token什么意思
token什么意思

token是一种用于表示用户权限、记录交易信息、支付虚拟货币的数字货币。可以用来在特定的网络上进行交易,用来购买或出售特定的虚拟货币,也可以用来支付特定的服务费用。想了解更多token什么意思的相关内容可以访问本专题下面的文章。

1872

2024.03.01

JavaScript浏览器渲染机制与前端性能优化实践
JavaScript浏览器渲染机制与前端性能优化实践

本专题围绕 JavaScript 在浏览器中的执行与渲染机制展开,系统讲解 DOM 构建、CSSOM 解析、重排与重绘原理,以及关键渲染路径优化方法。内容涵盖事件循环机制、异步任务调度、资源加载优化、代码拆分与懒加载等性能优化策略。通过真实前端项目案例,帮助开发者理解浏览器底层工作原理,并掌握提升网页加载速度与交互体验的实用技巧。

28

2026.03.06

Rust内存安全机制与所有权模型深度实践
Rust内存安全机制与所有权模型深度实践

本专题围绕 Rust 语言核心特性展开,深入讲解所有权机制、借用规则、生命周期管理以及智能指针等关键概念。通过系统级开发案例,分析内存安全保障原理与零成本抽象优势,并结合并发场景讲解 Send 与 Sync 特性实现机制。帮助开发者真正理解 Rust 的设计哲学,掌握在高性能与安全性并重场景中的工程实践能力。

68

2026.03.05

PHP高性能API设计与Laravel服务架构实践
PHP高性能API设计与Laravel服务架构实践

本专题围绕 PHP 在现代 Web 后端开发中的高性能实践展开,重点讲解基于 Laravel 框架构建可扩展 API 服务的核心方法。内容涵盖路由与中间件机制、服务容器与依赖注入、接口版本管理、缓存策略设计以及队列异步处理方案。同时结合高并发场景,深入分析性能瓶颈定位与优化思路,帮助开发者构建稳定、高效、易维护的 PHP 后端服务体系。

164

2026.03.04

AI安装教程大全
AI安装教程大全

2026最全AI工具安装教程专题:包含各版本AI绘图、AI视频、智能办公软件的本地化部署手册。全篇零基础友好,附带最新模型下载地址、一键安装脚本及常见报错修复方案。每日更新,收藏这一篇就够了,让AI安装不再报错!

84

2026.03.04

Swift iOS架构设计与MVVM模式实战
Swift iOS架构设计与MVVM模式实战

本专题聚焦 Swift 在 iOS 应用架构设计中的实践,系统讲解 MVVM 模式的核心思想、数据绑定机制、模块拆分策略以及组件化开发方法。内容涵盖网络层封装、状态管理、依赖注入与性能优化技巧。通过完整项目案例,帮助开发者构建结构清晰、可维护性强的 iOS 应用架构体系。

114

2026.03.03

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
麻省理工大佬Python课程
麻省理工大佬Python课程

共34课时 | 5.4万人学习

国外Web开发全栈课程全集
国外Web开发全栈课程全集

共12课时 | 1万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号