7 月 16 日,全球具身智能強化學習開源框架 RLinf 正式發(fā)布 v0.3 版本。百度(BIDU)智能云于發(fā)布當天完成適配,成為國內首家支持 RLinf v0.3 的云廠商。開發(fā)者可基于百度(BIDU)百舸 AI 計算平臺,一鍵體驗 RLinf 最新能力,加速前沿開源成果向產業(yè)應用落地。此次 RLinf v0.3 首次打通數據管理、監(jiān)督微調(SFT)、強化學習(RL)、模型評測及真機部署等關鍵環(huán)節(jié),實現(xiàn)從仿真訓練到真機在線學習,再到持續(xù)迭代優(yōu)化的完整開發(fā)閉環(huán),為機器人持續(xù)進化提供更加完善的技術基礎。
國內首家完成 RLinf v0.3 適配,最新開源(300109)成果快速進入產業(yè)實踐
近年來,具身智能快速發(fā)展,機器人訓練逐漸從單一算法突破轉向數據、模型、算力和工程協(xié)同優(yōu)化。RLinf 作為全球具身智能領域重要的開源強化學習框架,持續(xù)快速迭代,已成為機器人強化學習開發(fā)的重要基礎設施。此次發(fā)布的 RLinf v0.3 進一步擴展了模型生態(tài)與訓練能力,不僅新增支持 DreamZero、GR00T、StarVLA、LingBot-VLA 等主流模型,還完善了真機強化學習、仿真強化學習及 Human-in-the-loop 等訓練范式,首次實現(xiàn)機器人持續(xù)學習全流程閉環(huán)。
百度(BIDU)智能云第一時間完成適配,讓開發(fā)者無需等待框架遷移,即可第一時間體驗最新開源(300109)能力,進一步縮短技術創(chuàng)新向產業(yè)應用轉化周期(883436)。
百度百舸打造具身智能研發(fā)全流程底座,加速模型訓練與部署
依托百度(BIDU)百舸 AI 計算平臺,開發(fā)者可通過 " 快速開始 " 能力,一鍵啟動 RLinf v0.3 開發(fā)環(huán)境,快速完成 LIBERO 仿真環(huán)境、OpenVLA 模型訓練等預置鏡像部署,無需繁瑣配置,即可開展模型開發(fā)與訓練。
除了快速完成框架適配,百度(BIDU)百舸還依托高性能計算、極致存儲及高速互聯(lián)網絡,構建覆蓋數據準備、開發(fā)訓練、仿真驗證到推理部署的完整研發(fā)鏈路,并結合 AI Infra 工程優(yōu)化能力,進一步提升模型訓練效率、縮短迭代周期(883436),提高算力資源利用效率,為具身智能研發(fā)提供穩(wěn)定高效的基礎設施支撐。
AI Infra 工程優(yōu)化能力持續(xù)驗證
此前,百度(BIDU)百舸聯(lián)合上海交通大學、地瓜機器人共同發(fā)布強化學習訓練框架 dVLA-RL,首次打通經典 PPO 算法與離散擴散 VLA 模型的適配路徑,為機器人 Foundation Model 持續(xù)自主進化提供新的技術路徑,相關實驗全部基于百度(BIDU)百舸 AI 計算平臺完成。
目前,百度(BIDU)百舸已服務超過 30 家具身智能頭部企業(yè)及創(chuàng)新中心。未來,百度(BIDU)智能云將持續(xù)攜手開源社區(qū)、科研機構及產業(yè)伙伴,不斷完善 AI 計算平臺與 AI Infra 工程能力,加速前沿技術創(chuàng)新向產業(yè)應用轉化,推動具身智能邁向規(guī)模化發(fā)展。
