首个具身智能强化学习框架RLinf开源，助力AI从感知迈向行动

蓮花仙者

发布时间：2025-09-19 13:02:01

375人浏览过

来源于php中文网

原创

近日，无问芯穹联合清华大学、北京中关村学院，携手北京大学、加州大学伯克利分校等机构，正式开源首个面向具身智能的“渲训推一体化”大规模强化学习框架rlinf。这一举措为人工智能从“感知”向“行动”的跨越提供了关键技术支撑。

人工智能正经历从“感知”到“行动”的跨越式发展，融合大模型的具身智能被视为人工智能的下一发展阶段，受到学术界和工业界的共同关注。在大模型领域，随着o1/R1系列推理模型的发布，模型训练重心逐渐从数据驱动的预训练/后训练转向奖励驱动的强化学习。OpenAI预测强化学习所需算力将超过预训练，能够高效利用大规模算力的RL infra的重要性日益凸显，近期也涌现出一批优秀框架，推动了该领域的发展。

然而，当前框架对具身智能的支持仍存在局限。与纯推理大模型不同，具身智能领域存在大脑（侧重推理、长程规划）、小脑（侧重执行、短程操作）及大小脑联合等多样模型。此外，具身智能还具有“渲训推一体化”的独特属性，当前主流仿真器通常采用GPU加速，耦合多步决策带来了算力和显存竞争的新挑战。具身智能领域不仅继承了推理大模型和数字智能体的难点，还引入了新的渲训推一体化特征，再加上具身智能模型尚未收敛，对框架的灵活性、高效性和易用性提出了更高要求。

RLinf名称中的“inf”，既代表“infrastructure”（基础设施），也寓意“infinite”（无限扩展），其核心就是解决当前框架对具身智能支持受限的问题。该框架通过六大层级设计，即用户层（统一编程接口）、任务层（多后端集成方案）、执行层（灵活执行模式）、调度层（自动化调度）、通信层（自适应通信）和硬件层（异构硬件），针对性地突破技术难点。

在执行模式方面，当前强化学习框架通常采用共享式和分离式，但这两种模式在具身智能“渲训推一体”的特点下存在局限性。RLinf提出混合式执行模式，兼具分离式和共享式的优势，配合细粒度流水设计，显著提升了系统运行效率。同时，RLinf采用创新的宏工作流到微执行流的映射机制，实现从组件级进行调度，解决了传统计算流图构建编程灵活性低的问题。在后端集成方面，为支持具身智能不同用户的需求，RLinf集成了两套后端。Megatron + SGLang/vLLM针对已收敛的模型架构，支持已适配模型的快速接入，是大规模集群训练的首选模式；FSDP + Hugging Face针对未收敛的模型架构，支持Hugging Face模型开箱即用无需适配，是快速小规模验证的首选模式。此外，RLinf还支持多项刚需，如LoRA训练、断点续训以及训练可视化等，并且正在集成SFT模块，致力于提供一站式服务。在通信和调度方面，RLinf设计了自适应通信库和自动化调度模块。自适应通信库包含自适应CUDAIPC/NCCL通信、负载均衡传输队列、多通道并发通信机制、快速通信重配置等优化技术，提升了通信效率和稳定性。自动化调度模块可以针对用户的训练流和计算资源，选择最优的执行模式，还集成了“秒级在线扩缩容”能力，显著提升了训练效率。

在性能方面，RLinf在具身性能和推理性能上均表现出色。在具身性能测试中，采用FSDP+HuggingFace后端，相比其他框架的分离式执行模式，系统效率显著提速120%以上，模型成功率也有大幅提升。在推理性能测试中，采用Megtatron+SGLang后端，支持的推理大模型训练在多个测试集上取得SOTA性能。

知元AI

AI智能语音聊天对讲问答 AI绘画 AI写作 AI创作助手工具

下载

考虑到框架的易用性，RLinf提供了全面且系统化的使用文档，还提供完整的API文档与集成AI问答机器人支持。RLinf团队的开发成员具有交叉研究背景，能够从应用需求驱动算法设计，算法指导系统设计，高效系统加速算法迭代。未来，RLinf团队将持续开发和维护该框架。

总之，RLinf的开源为具身智能领域的发展带来了新的机遇，其灵活、可扩展的设计理念和出色的性能，有望推动人工智能从“感知”向“行动”的跨越。

多个网络账号向蔚来公开道歉赔偿款将用于公益事业

Lumen5导入Notion怎样批量制AI动画_Lumen5导Notion批量制AI动画招式【指南】

安装量1.1亿！夸克AI浏览器与千问深度融合，突破硬件限制领跑赛道

AI伦理困境：面部识别技术标准与安全监控的未来

揭秘面部不对称：原因、影响与矫正方法全攻略

相关标签:

人工智能后端 ai openai 大模型性能测试架构继承接口并发算法人工智能自动化负载均衡

本站声明：本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

上一篇：微软将GPT - 5接入多平台，企业AI应用创新迎来新突破下一篇：告别AI感！FLUX.1 Krea dev文生图模型带来照片级写实体验

作者最新文章

极兔快递智能物流追踪页面极兔速运实时更新官网链接

2026-01-20 04:39

一米滴答如何找回登录密码_一米滴答密码重置安全步骤【防护】

2026-01-20 05:53

橙子阅读怎么屏蔽不想看的类型_橙子阅读屏蔽设置与偏好调整【技巧】

2026-01-20 06:25

AdobePhotoshop如何调整图片分辨率_PS调整分辨率步骤【教程】

2026-01-20 07:19

百度网盘客户端下载入口百度网盘最新版安装入口

2026-01-20 08:41

饮水机长时间不用如何处置_安全停用法【须知】

2026-01-20 09:06

一吨柴油等于多少公斤_标准下柴油一吨即一千公斤【实例】

2026-01-20 09:17

荣耀手机智慧语音怎么唤醒和设置荣耀YOYO语音助手实用功能盘点【步骤】

2026-01-20 09:23

苹果手机AppleID密码忘了咋办_苹果手机AppleID找回法【步骤】

2026-01-20 09:31

语雀怎样设置标签_语雀设标签教程【方法】

2026-01-20 09:44

热门AI工具

DeepSeek

幻方量化公司旗下的开源大模型平台

AI大模型

开放平台

豆包大模型

字节跳动自主研发的一系列大型语言模型

AI大模型

通义千问

阿里巴巴推出的全能AI助手

AI大模型

腾讯元宝

腾讯混元平台推出的AI助手

文档处理

Excel 表格

文心一言

文心一言是百度开发的AI聊天机器人，通过对话可以生成各种形式的内容。

AI大模型

中文写作

讯飞写作

基于讯飞星火大模型的AI写作工具，可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

中文写作

写作工具

即梦AI

一站式AI创作平台，免费AI图片和视频生成。

图片拼接

图画生成

ChatGPT

最最强大的AI聊天机器人程序，ChatGPT不单是聊天机器人，还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

AI大模型

中文写作

智谱清言 - 免费全能的AI助手

AI大模型

PDF 文档

相关专题

硬盘接口类型介绍

硬盘接口类型有IDE、SATA、SCSI、Fibre Channel、USB、eSATA、mSATA、PCIe等等。详细介绍：1、IDE接口是一种并行接口，主要用于连接硬盘和光驱等设备，它主要有两种类型：ATA和ATAPI，IDE接口已经逐渐被SATA接口；2、SATA接口是一种串行接口，相较于IDE接口，它具有更高的传输速度、更低的功耗和更小的体积；3、SCSI接口等等。

1049

2023.10.19