ICC訊 NVIDIA Research 開發(fā)的一款名為 Eureka 的新型 AI 智能體可以教機(jī)器人復(fù)雜的技能,它教會了機(jī)器人手快速轉(zhuǎn)筆,并且第一次轉(zhuǎn)得像人類一樣好。
上面視頻中所展示的令人驚嘆的“魔術(shù)”是機(jī)器人通過 Eureka 學(xué)會熟練完成的近 30 項任務(wù)之一,Eureka 可以自動編寫?yīng)剟钏惴▉碛?xùn)練機(jī)器人。
Eureka 還教會了機(jī)器人完成打開抽屜和柜子、拋接球、操作剪刀等任務(wù)。
于 10 月 20 日發(fā)布的這一 Eureka 研究包含一篇論文和該項目的 AI 算法,開發(fā)者可以使用 NVIDIA Isaac Gym(一款用于強(qiáng)化學(xué)習(xí)研究的物理模擬參考應(yīng)用)進(jìn)行實驗。Isaac Gym 基于 NVIDIA Omniverse 而構(gòu)建,后者是一個用于基于 OpenUSD 框架構(gòu)建 3D 工具和應(yīng)用的開發(fā)平臺。Eureka 自身是由 GPT-4 大型語言模型驅(qū)動的。
NVIDIA AI 研究高級總監(jiān)、Eureka 論文作者之一的 Anima Anandkumar 表示:“在過去十年,強(qiáng)化學(xué)習(xí)取得了空前成功,但依然面臨許多挑戰(zhàn),比如獎勵設(shè)計需要不斷試錯才能完成。Eureka 是朝著開發(fā)將生成式和強(qiáng)化學(xué)習(xí)方法結(jié)合以解決這些艱巨的任務(wù)的新算法邁出的第一步?!?
相關(guān)精彩視頻已在NVIDIA中國西瓜視頻賬號發(fā)布:
NVIDIA Research 最新研究成果:Eureka 用 LLM 訓(xùn)練機(jī)器人靈巧操作
AI訓(xùn)練機(jī)器人
據(jù)該論文介紹,Eureka 生成的獎勵程序(可讓機(jī)器人進(jìn)行試錯學(xué)習(xí))在超過 80% 的任務(wù)上優(yōu)于人類專家編寫的程序,這使得機(jī)器人的平均性能提高了 50% 以上。
該 AI 智能體使用 GPT-4 LLM 和生成式 AI 編寫軟件代碼,為機(jī)器人進(jìn)行強(qiáng)化學(xué)習(xí)提供獎勵。它不需要任何特定任務(wù)提示或預(yù)定義的獎勵模板,并且能夠隨時結(jié)合人類的反饋改進(jìn)其獎勵,使結(jié)果更加精準(zhǔn)地符合開發(fā)者的愿望。
利用 Isaac Gym 中的 GPU 加速模擬,Eureka 能夠快速評估大批獎勵候選者的質(zhì)量,從而提高訓(xùn)練效率。
Eureka 隨后會基于訓(xùn)練結(jié)果匯總關(guān)鍵統(tǒng)計數(shù)據(jù),并指導(dǎo) LLM 改進(jìn)其獎勵函數(shù)的生成。通過這種方式,AI 可以自我完善。Eureka 教會了各類機(jī)器人,包括四足機(jī)器人、雙足機(jī)器人、四旋翼機(jī)器人、靈巧手、協(xié)作機(jī)器人臂等,來完成不同類型的任務(wù)。
該研究論文對 20 個 Eureka 訓(xùn)練任務(wù)進(jìn)行了深入評估,這些任務(wù)基于開源的靈巧性基準(zhǔn),要求機(jī)器人手展示一系列復(fù)雜的雙手任務(wù)。
這些來自九個 Isaac Gym 環(huán)境的測試結(jié)果通過使用 NVIDIA Omniverse 生成的可視化進(jìn)行了展示。
該項目的貢獻(xiàn)者之一、NVIDIA 高級研究科學(xué)家 Linxi “Jim” Fan 表示:“Eureka 是一個獨特的組合,將大型語言模型與 NVIDIA GPU 加速的模擬技術(shù)相結(jié)合,可以實現(xiàn)靈巧的機(jī)器人控制,并且為藝術(shù)家提供了一種制作物理逼真動畫的新方法?!?
除了 NVIDIA Research 最近取得的進(jìn)展(比如使用 GPT-4 構(gòu)建的能夠自主玩 《我的世界》的 AI 智能體 Voyager)之外,這項突破性的研究成果也必將讓開發(fā)者們腦洞大開。
NVIDIA Research 由全球數(shù)百名科學(xué)家和工程師組成,團(tuán)隊專注于 AI、計算機(jī)圖形學(xué)、計算機(jī)視覺、自動駕駛汽車、機(jī)器人學(xué)等領(lǐng)域的研究。
進(jìn)一步了解 Eureka 與 NVIDIA Research。
關(guān)于NVIDIA
自1993年成立以來,NVIDIA (NASDAQ: NVDA) 一直是加速計算領(lǐng)域的先驅(qū)。NVIDIA 1999 年發(fā)明的 GPU 驅(qū)動了 PC 游戲市場的增長,并重新定義了現(xiàn)代計算機(jī)圖形,開啟了現(xiàn)代 AI 時代,正在推動跨市場的工業(yè)數(shù)字化。NVIDIA 現(xiàn)在是一家全棧計算公司,其數(shù)據(jù)中心規(guī)模的解決方案 正在重塑整個行業(yè)。更多信息,請訪問https://nvidianews.nvidia.com/。