0

0

一图一3D世界,视频还可交互,昆仑万维「空间智能」开年首秀来了

聖光之護

聖光之護

发布时间:2025-02-15 16:00:26

|

497人浏览过

|

来源于php中文网

原创

2025年被誉为智能体爆发元年,ai应用将迎来井喷式增长。然而,除了备受瞩目的智能体领域,另一个ai分支——空间智能(spatial intelligence)——也可能迎来其“chatgpt时刻”。

今年春节,动画电影《哪吒2》的爆火,不仅刷新了中国影史票房纪录,更在全球票房榜单上屡创新高。影片中令人叹为观止的3D特效,例如山河社稷图、石矶娘娘的石头山变身以及最终的仙魔大战,都展现了3D动画技术的巨大进步。而空间智能这项新兴技术,有望将3D动画的质量和观众的沉浸式体验提升到一个全新的高度。“AI教母”李飞飞对其寄予厚望并进行了投资。她认为,空间智能对于AI理解世界和与世界互动至关重要,如同语言对于AI一样基础,将成为AI发展的新方向。去年12月,李飞飞团队World Labs的首个产品已展示了其单图生成3D世界的惊艳效果。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

图片

然而,要让AI真正理解和操控3D空间,仍面临诸多挑战:高质量3D数据匮乏、生成的3D场景细节不足或存在瑕疵、多视角一致性难以保证,以及处理复杂场景时计算量巨大等。

国内一家专注于AGI和AIGC的大模型厂商——昆仑万维——率先在空间智能领域取得突破性进展。2月14日,昆仑万维正式发布了Matrix-Zero世界模型,标志着其在空间智能探索中的关键一步。Matrix-Zero包含3D场景生成大模型和可交互视频大模型,能够将图片转化为可自由探索的3D场景,并生成可交互视频,堪称功能强大的3D物理世界和视频生成器。

图片

昆仑万维成为国内首家同时推出3D场景生成和可交互视频生成模型的空间智能企业,Matrix-Zero预计将于4月份正式上线。

突破二维平面:3D虚拟世界的全新体验

将单张图片转化为符合物理几何规则的3D世界,是空间智能领域的关键技术突破。AI需要具备感知、理解和交互能力,才能像人类一样在三维空间中自由导航、操作和创造。从李飞飞World Labs的3D世界产品到谷歌DeepMind的Genie 2,空间智能正不断进化,从内容生成走向世界构建,这需要AI不仅理解像素,更要解析空间坐标、几何关系和物理规律,从而实现逼真的立体感和空间深度。

昆仑万维的Matrix-Zero正是朝着这一目标迈进,其领先的技术方案在3D世界生成领域展现出诸多优势。

一图一世界:AI让3D世界触手可及

Matrix-Zero采用与World Labs不同的技术路线,实现了更真实、更可自由探索的3D场景生成效果。它支持不同风格的图片输入(例如写实风和卡通风),并能保持与原图风格的一致性。

图片图片

Matrix-Zero还具备风格转换能力,可在生成3D场景时将原图风格切换成其他风格,例如将房屋变成红瓦白墙。

图片

智川X-Agent
智川X-Agent

中科闻歌推出的一站式AI智能体开发平台

下载

此外,Matrix-Zero生成的3D场景具有高度的全局一致性,解决了单视角图片生成大范围3D场景时前后不一致的问题。它利用空间扩散模型和可微渲染技术,不断细化细节,构建完整一致的3D世界。

图片图片

Matrix-Zero的最大亮点在于支持大范围、长距离的自由探索。用户可以自由移动视角,进行360度环视、俯视,以及更复杂的复合移动。

图片图片

Matrix-Zero生成的3D场景还可以加入动态物体,并模拟水流、光照、云雾等符合物理规律的动态效果。

图片图片

Matrix-Zero在3D场景生成和自由探索方面的优势,使其在空间智能领域具备与国际竞品匹敌甚至超越的实力。

可交互视频:增强用户参与度

Matrix-Zero的另一个子模型——可交互视频生成模型——更注重实时交互和大范围场景。它具有强大的泛化能力,能高效生成高质量、流畅一致的视频,并增强了视频内容的可操作性,用户可以自由调整视角、操控场景元素,并实时影响视频内容。

图片图片

Matrix-Zero的技术架构

Matrix-Zero的进步源于昆仑万维在3D场景生成、基础视频生成模型和用户输入交互模型上的全方位升级。3D场景生成大模型包含场景布局生成模块和纹理生成模块,通过可微渲染、扩散模型和3D高斯泼溅技术,构建完整、合理、自然的3D世界。可交互视频生成则基于自研的生成式视频模型,结合用户输入交互模型,实现以用户输入为核心的空间智能视频生成。

结语

2024年是大语言模型快速发展的一年,空间智能也随之崛起。昆仑万维在AI各个发展阶段都展现出前瞻性,Matrix-Zero是其在空间智能领域的又一标志性成果,将进一步强化其多元AI业务矩阵,并为多模态大模型的应用开辟新的赛道。未来,空间智能将有无限可能,成为AGI发展的重要支柱。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
ChatGPT注册
ChatGPT注册

ChatGPT注册方法:1、访问OpenAI的官方网站,进入注册页面;2、完成注册后收到一份邮件,打开后点击验证账号;3、选择一个适合您需求的订阅计划;4、获得访问ChatGPT的权限即可。

558

2023.09.12

国内免费ChatGPT大全
国内免费ChatGPT大全

ChatGPT是一种基于深度学习技术的自然语言处理模型,由OpenAI开发。它是GPT的一个变体,专门设计用于生成上下文相关的文本回复。ChatGPT被训练成一个聊天机器人,可以与用户进行对话交互。更多关于ChatGPT的文章详情请查看本专题,希望对大家能有所帮助。

616

2023.10.25

手机安装chatgpt的方法
手机安装chatgpt的方法

手机安装chatgpt的方法:1、在ChatGTP官网或手机商店上下载ChatGTP软件;2、打开后在设置界面中,选择语言为中文;3、在对局界面中,选择人机对局并设置中文相谱;4、开始后在聊天窗口中输入指令,即可与软件进行交互。想了解更多chatgpt的相关内容,可以阅读本专题下面的文章。

3040

2024.03.05

chatgpt国内可不可以使用
chatgpt国内可不可以使用

chatgpt在国内可以使用,但不能注册,港澳也不行,用户想要注册的话,可以使用国外的手机号进行注册,注意注册过程中要将网络环境切换成国外ip。想了解更多chatgpt的相关内容,可以阅读本专题下面的文章。

1098

2024.03.05

C# ASP.NET Core微服务架构与API网关实践
C# ASP.NET Core微服务架构与API网关实践

本专题围绕 C# 在现代后端架构中的微服务实践展开,系统讲解基于 ASP.NET Core 构建可扩展服务体系的核心方法。内容涵盖服务拆分策略、RESTful API 设计、服务间通信、API 网关统一入口管理以及服务治理机制。通过真实项目案例,帮助开发者掌握构建高可用微服务系统的关键技术,提高系统的可扩展性与维护效率。

74

2026.03.11

Go高并发任务调度与Goroutine池化实践
Go高并发任务调度与Goroutine池化实践

本专题围绕 Go 语言在高并发任务处理场景中的实践展开,系统讲解 Goroutine 调度模型、Channel 通信机制以及并发控制策略。内容包括任务队列设计、Goroutine 池化管理、资源限制控制以及并发任务的性能优化方法。通过实际案例演示,帮助开发者构建稳定高效的 Go 并发任务处理系统,提高系统在高负载环境下的处理能力与稳定性。

38

2026.03.10

Kotlin Android模块化架构与组件化开发实践
Kotlin Android模块化架构与组件化开发实践

本专题围绕 Kotlin 在 Android 应用开发中的架构实践展开,重点讲解模块化设计与组件化开发的实现思路。内容包括项目模块拆分策略、公共组件封装、依赖管理优化、路由通信机制以及大型项目的工程化管理方法。通过真实项目案例分析,帮助开发者构建结构清晰、易扩展且维护成本低的 Android 应用架构体系,提升团队协作效率与项目迭代速度。

83

2026.03.09

JavaScript浏览器渲染机制与前端性能优化实践
JavaScript浏览器渲染机制与前端性能优化实践

本专题围绕 JavaScript 在浏览器中的执行与渲染机制展开,系统讲解 DOM 构建、CSSOM 解析、重排与重绘原理,以及关键渲染路径优化方法。内容涵盖事件循环机制、异步任务调度、资源加载优化、代码拆分与懒加载等性能优化策略。通过真实前端项目案例,帮助开发者理解浏览器底层工作原理,并掌握提升网页加载速度与交互体验的实用技巧。

97

2026.03.06

Rust内存安全机制与所有权模型深度实践
Rust内存安全机制与所有权模型深度实践

本专题围绕 Rust 语言核心特性展开,深入讲解所有权机制、借用规则、生命周期管理以及智能指针等关键概念。通过系统级开发案例,分析内存安全保障原理与零成本抽象优势,并结合并发场景讲解 Send 与 Sync 特性实现机制。帮助开发者真正理解 Rust 的设计哲学,掌握在高性能与安全性并重场景中的工程实践能力。

223

2026.03.05

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号