0

0

瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破

WBOY

WBOY

发布时间:2024-05-05 13:01:01

|

656人浏览过

|

来源于机器之心

转载

机器狗在瑜伽球上稳稳当当的行走,平衡力那是相当的好:

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

瑜伽球上遛「狗」!入选英伟达十大项目之一的eureka有了新突破

各种场景都能拿捏,不管是平坦的人行道、还是充满挑战的草坪都能 hold 住:

瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破

甚至是研究人员踢了一脚瑜伽球,机器狗也不会歪倒:

瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破

给气球放气机器狗也能保持平衡:

瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破

AdMaker AI
AdMaker AI

从0到爆款高转化AI广告生成器

下载
上述展示都是 1 倍速,没有经过加速处理。
瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破
  • 论文地址:https://eureka-research.github.io/dr-eureka/assets/dreureka-paper.pdf
  • 项目主页:https://github.com/eureka-research/DrEureka
  • 论文标题:DrEureka: Language Model Guided Sim-To-Real Transfer

这项研究由宾夕法尼亚大学、 NVIDIA 、得克萨斯大学奥斯汀分校的研究者联合打造,并且完全开源。他们提出了 DrEureka(域随机化 Eureka),这是一种利用 LLM 实现奖励设计和域随机化参数配置的新型算法,可同时实现模拟到现实的迁移。该研究展示了 DrEureka 算法能够解决新颖的机器人任务,例如四足机器人平衡和在瑜伽球上行走,而无需迭代手动设计。

DrEureka 是基于 Eureka 完成的,后者还被评为 2023 年英伟达十大项目之一。了解 Eureka 更多内容可参考《有了 GPT-4 之后,机器人把转笔、盘核桃都学会了》。

在论文摘要部分,研究者表示将在模拟中学习到的策略迁移到现实世界是一种大规模获取机器人技能的有前途的策略。然而,模拟到现实的方法通常依赖于任务奖励函数以及模拟物理参数的手动设计和调整,这使得该过程缓慢且耗费人力。本文研究了使用大型语言模型 (LLM) 来自动化和加速模拟到现实的设计。

论文作者之一、英伟达高级科学家 Jim Fan 也参与了这项研究。此前英伟达成立 AI 实验室,领队人就是 Jim Fan,专攻具身智能。Jim Fan 表示:

「我们训练了一只机器狗能在瑜伽球上保持平衡并行走,这完全是在模拟中进行的,然后零样本迁移到现实世界,无需微调,直接运行。

对机器狗来说,走瑜伽球任务尤其困难,因为我们无法准确模拟弹力球表面。然而,DrEureka 可以轻松搜索大量模拟真实配置,并让机器狗能够在各种地形上操控球,甚至横着走!

一般来讲,从模拟到现实的迁移是通过域随机化实现的,这是一个繁琐的过程,需要机器人专家盯着每个参数并手动调整。像 GPT-4 这样的前沿 LLM 拥有大量内置的物理直觉,包括摩擦、阻尼、刚度、重力等,借助 GPT-4,DrEureka 可以熟练地调整这些参数并很好地解释其推理。」

瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破

论文介绍

DrEureka 流程如下所示,其接受任务和安全指令以及环境源代码,并运行 Eureka 以生成正则化的奖励函数和策略。然后,它在不同的模拟条件下测试该策略以构建奖励感知物理先验,并将其提供给 LLM 以生成一组域随机化 (DR) 参数。最后,使用合成的奖励和 DR 参数训练策略以进行实际部署。
瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破
Eureka 奖励设计。奖励设计组件基于 Eureka,因为它简单且具有表现力,但本文引入了一些改进,以增强其在模拟到真实环境中的适用性。伪代码如下:
瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破
奖励感知物理先验(RAPP,reward aware physics prior)。安全奖励函数可以规范策略行为以固定环境选择,但本身不足以实现模拟到现实的迁移。因此本文引入了一种简单的 RAPP 机制来限制 LLM 的基本范围。
瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破
LLM 用于域随机化。给定每个 DR 参数的 RAPP 范围,DrEureka 的最后一步指示 LLM 在 RAPP 范围的限制内生成域随机化配置。具体过程参见图 3:
瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破
该研究使用 Unitree Go1 来实验,Go1 是一个小型四足机器人,四条腿有 12 个自由度。在四足运动任务中,本文还系统地评估了 DrEureka 策略在几个现实世界地形上的性能,发现它们仍然具有鲁棒性,并且优于使用人类设计的奖励和 DR 配置训练的策略。
瑜伽球上遛「狗」!入选英伟达十大项目之一的Eureka有了新突破
了解更多内容,请参考原论文。

相关专题

更多
页面置换算法
页面置换算法

页面置换算法是操作系统中用来决定在内存中哪些页面应该被换出以便为新的页面提供空间的算法。本专题为大家提供页面置换算法的相关文章,大家可以免费体验。

402

2023.08.14

http与https有哪些区别
http与https有哪些区别

http与https的区别:1、协议安全性;2、连接方式;3、证书管理;4、连接状态;5、端口号;6、资源消耗;7、兼容性。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

1976

2024.08.16

PHP 命令行脚本与自动化任务开发
PHP 命令行脚本与自动化任务开发

本专题系统讲解 PHP 在命令行环境(CLI)下的开发与应用,内容涵盖 PHP CLI 基础、参数解析、文件与目录操作、日志输出、异常处理,以及与 Linux 定时任务(Cron)的结合使用。通过实战示例,帮助开发者掌握使用 PHP 构建 自动化脚本、批处理工具与后台任务程序 的能力。

28

2025.12.13

高德地图升级方法汇总
高德地图升级方法汇总

本专题整合了高德地图升级相关教程,阅读专题下面的文章了解更多详细内容。

0

2026.01.16

全民K歌得高分教程大全
全民K歌得高分教程大全

本专题整合了全民K歌得高分技巧汇总,阅读专题下面的文章了解更多详细内容。

0

2026.01.16

C++ 单元测试与代码质量保障
C++ 单元测试与代码质量保障

本专题系统讲解 C++ 在单元测试与代码质量保障方面的实战方法,包括测试驱动开发理念、Google Test/Google Mock 的使用、测试用例设计、边界条件验证、持续集成中的自动化测试流程,以及常见代码质量问题的发现与修复。通过工程化示例,帮助开发者建立 可测试、可维护、高质量的 C++ 项目体系。

10

2026.01.16

java数据库连接教程大全
java数据库连接教程大全

本专题整合了java数据库连接相关教程,阅读专题下面的文章了解更多详细内容。

32

2026.01.15

Java音频处理教程汇总
Java音频处理教程汇总

本专题整合了java音频处理教程大全,阅读专题下面的文章了解更多详细内容。

14

2026.01.15

windows查看wifi密码教程大全
windows查看wifi密码教程大全

本专题整合了windows查看wifi密码教程大全,阅读专题下面的文章了解更多详细内容。

42

2026.01.15

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
最新Python教程 从入门到精通
最新Python教程 从入门到精通

共4课时 | 1.7万人学习

Node.js 教程
Node.js 教程

共57课时 | 8.7万人学习

CSS3 教程
CSS3 教程

共18课时 | 4.6万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号