0

0

MotionLM:多智能体运动预测的语言建模技术

WBOY

WBOY

发布时间:2023-10-13 12:09:05

|

1615人浏览过

|

来源于51CTO.COM

转载

本文经自动驾驶之心公众号授权转载,转载请联系出处。

原标题:MotionLM: Multi-Agent Motion Forecasting as Language Modeling

论文链接:https://arxiv.org/pdf/2309.16534.pdf

作者单位:Waymo

会议:ICCV 2023

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

MotionLM:多智能体运动预测的语言建模技术

论文思路:

对于自动驾驶车辆安全规划来说,可靠地预测道路代理未来行为是至关重要的。本研究将连续轨迹表示为离散运动令牌序列,并将多智能体运动预测视为语言建模任务。我们提出的模型MotionLM具有以下几个优点:首先,它不需要使用锚点或显式潜变量来优化学习多模态分布。相反,我们利用标准的语言建模目标,最大化序列令牌的平均对数概率。其次,我们的方法避免了事后交互启发法,其中个体代理轨迹生成是在交互评分之后进行的。相反,MotionLM在单个自回归解码过程中生成了交互式代理未来的联合分布。此外,模型的顺序分解可以实现时间上的因果条件推断。我们提出的方法在Waymo Open Motion Dataset上取得了新的最先进性能,排名第一于交互式挑战排行榜

主要贡献:

在这篇文章中,我们将多智能体运动预测作为一项语言建模任务进行讨论。我们引入了时间因果解码器,对经过因果语言建模损失训练的离散运动令牌进行解码

本文将结合模型中的采样和简单的 rollout 聚合方案,以提高联合轨迹的加权模式识别能力。我们通过在 Waymo Open Motion Dataset 交互预测挑战中的实验,证明了这一新的方法在排名联合 mAP 指标上提高了6%,达到了最先进的性能水平

本文对本文的方法进行了广泛的消融实验,并对它的时间因果条件预测进行了分析,这在很大程度上是目前的联合预测模型所不支持的。

网络设计:

本文的目标是以一种通用的方式对多智能体交互上的分布建模,这种分布可以应用于不同的下游任务,包括最低限度的、联合的和条件预测。为了实现这一目标,需要一个有表现力的生成框架,能够捕捉到驾驶场景中的多种形态。此外,本文在这里考虑保存时间依赖性;即,在本文的模型中,推理遵循一个有向无环图,每个节点的父节点在时间上较早,子节点在时间上较晚,这使得条件预测更接近于因果干预,因为它消除了某些虚假的相关性,否则就会导致不服从时间因果关系。本文观察到,不保留时间依赖关系的联合模型可能在预测实际agent反应方面的能力有限,这是规划中的一个关键用途。为此,本文利用了未来解码器的自回归分解,其中代理的运动tokens有条件地依赖于所有先前采样的tokens,并且轨迹按顺序推出

MotionLM:多智能体运动预测的语言建模技术

图1。本文的模型自回归地为一组代理生成离散运动tokens序列,以产生一致的交互式轨迹预测。

MotionLM:多智能体运动预测的语言建模技术

请看图2,这是MotionLM的架构

本文首先将与每个建模代理相关的异构场景特征(左)编码为形状R、N、·、H的场景嵌入。其中,R为首次推出(rollouts)的数量,N为联合建模的代理数量,H为每次嵌入的维数。在推理过程中,为了并行采样,本文在批量维度上重复嵌入R次。接下来,一个轨迹解码器以一种时间因果的方式(中心)为多个代理推出(rolls out) T 个离散运动tokens。最后,通过使用非最大抑制初始化的k-means聚类的简单聚合,可以恢复 rollouts 典型模式(右图)。

MotionLM:多智能体运动预测的语言建模技术

图3。展示了三个WOMD场景的前两种预测联合推出(joint rollout)模式。

颜色梯度表示了从t = 0秒到t = 8秒的时间变化。联合模式由绿色过渡到蓝色,次联合模式由橙色过渡到紫色的概率最大。我们观察到了三种类型的交互:相邻车道中的智能体会根据变道时间给予变道智能体让行(左侧),行人会根据车辆的进度走在过往车辆后面(中间),转弯车辆要么会给过路的骑车人让路(最可能的模式),要么会在骑车人接近之前转弯(次要模式)(右侧)

MotionLM:多智能体运动预测的语言建模技术

请看图4。这张图展示了联合推出(左侧)、干预后因果贝叶斯网络(中间)和因果条件反射(右侧)的因果贝叶斯网络表示

实线表示时间上的因果相关性,而虚线表示因果信息流。没有时间依赖约束的模型将支持因果条件作用,但不支持时间因果条件作用,这在试图预测agent反应时可能是有问题的。

实验结果:

MotionLM:多智能体运动预测的语言建模技术

MotionLM:多智能体运动预测的语言建模技术

MotionLM:多智能体运动预测的语言建模技术

MotionLM:多智能体运动预测的语言建模技术

MotionLM:多智能体运动预测的语言建模技术

MotionLM:多智能体运动预测的语言建模技术

MotionLM:多智能体运动预测的语言建模技术

引用:

Seff, A., Cera, B., Chen, D., Ng, M., Zhou, A., Nayakanti, N., Refaat, K. S., & Sapp, B. (2023). MotionLM: Multi-Agent Motion Forecasting as Language Modeling. ArXiv. /abs/2309.16534

MotionLM:多智能体运动预测的语言建模技术

原文链接:https://mp.weixin.qq.com/s/mtai0ra8penfuj7ujcfd6a

IMCart开源网店系统(外贸B2C)
IMCart开源网店系统(外贸B2C)

IMCart是目前国内首家最为完善的开源b2c商城系统。同时也是PAYPAL官方认证建站系统的金牌合作伙伴。系统支持多语言,多站点,移动端, 本地国际化,API对接等,丰富的营销功能跟完善的商品体系,优良的下单体验,更为符合SEO优化,完善的插件支持/模板中心更是让IMCART更加无法 替代。而IMCART全新的技术架构、全新的UI设计、丰富的促销体系、官方各项服务支持能从根源上解决了目前市面上一

下载

相关专题

更多
golang map内存释放
golang map内存释放

本专题整合了golang map内存相关教程,阅读专题下面的文章了解更多相关内容。

75

2025.09.05

golang map相关教程
golang map相关教程

本专题整合了golang map相关教程,阅读专题下面的文章了解更多详细内容。

36

2025.11.16

golang map原理
golang map原理

本专题整合了golang map相关内容,阅读专题下面的文章了解更多详细内容。

60

2025.11.17

java判断map相关教程
java判断map相关教程

本专题整合了java判断map相关教程,阅读专题下面的文章了解更多详细内容。

40

2025.11.27

http与https有哪些区别
http与https有哪些区别

http与https的区别:1、协议安全性;2、连接方式;3、证书管理;4、连接状态;5、端口号;6、资源消耗;7、兼容性。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

2026

2024.08.16

Golang 性能分析与pprof调优实战
Golang 性能分析与pprof调优实战

本专题系统讲解 Golang 应用的性能分析与调优方法,重点覆盖 pprof 的使用方式,包括 CPU、内存、阻塞与 goroutine 分析,火焰图解读,常见性能瓶颈定位思路,以及在真实项目中进行针对性优化的实践技巧。通过案例讲解,帮助开发者掌握 用数据驱动的方式持续提升 Go 程序性能与稳定性。

8

2026.01.22

html编辑相关教程合集
html编辑相关教程合集

本专题整合了html编辑相关教程合集,阅读专题下面的文章了解更多详细内容。

51

2026.01.21

三角洲入口地址合集
三角洲入口地址合集

本专题整合了三角洲入口地址合集,阅读专题下面的文章了解更多详细内容。

27

2026.01.21

AO3中文版入口地址大全
AO3中文版入口地址大全

本专题整合了AO3中文版入口地址大全,阅读专题下面的的文章了解更多详细内容。

354

2026.01.21

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Django 教程
Django 教程

共28课时 | 3.4万人学习

Go 教程
Go 教程

共32课时 | 4.1万人学习

TypeScript 教程
TypeScript 教程

共19课时 | 2.4万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号