加入星計(jì)劃,您可以享受以下權(quán)益:

  • 創(chuàng)作內(nèi)容快速變現(xiàn)
  • 行業(yè)影響力擴(kuò)散
  • 作品版權(quán)保護(hù)
  • 300W+ 專業(yè)用戶
  • 1.5W+ 優(yōu)質(zhì)創(chuàng)作者
  • 5000+ 長期合作伙伴
立即加入
  • 正文
  • 推薦器件
  • 相關(guān)推薦
  • 電子產(chǎn)業(yè)圖譜
申請(qǐng)入駐 產(chǎn)業(yè)圖譜

Eureka!NVIDIA 研究突破為機(jī)器人學(xué)習(xí)注入新動(dòng)力

2023/10/24
3463
閱讀需 5 分鐘
加入交流群
掃碼加入
獲取工程師必備禮包
參與熱點(diǎn)資訊討論

AI 智能體利用 LLM 自動(dòng)生成獎(jiǎng)勵(lì)算法,訓(xùn)練機(jī)器人完成復(fù)雜任務(wù)。

NVIDIA Research 開發(fā)的一款名為 Eureka 的新型 AI 智能體可以教機(jī)器人復(fù)雜的技能,它教會(huì)了機(jī)器人手快速轉(zhuǎn)筆,并且第一次轉(zhuǎn)得像人類一樣好。

上面視頻中所展示的令人驚嘆的“魔術(shù)”是機(jī)器人通過 Eureka 學(xué)會(huì)熟練完成的近 30 項(xiàng)任務(wù)之一,Eureka 可以自動(dòng)編寫?yīng)剟?lì)算法來訓(xùn)練機(jī)器人。

Eureka 還教會(huì)了機(jī)器人完成打開抽屜和柜子、拋接球、操作剪刀等任務(wù)。

于 10 月 20 日發(fā)布的這一 Eureka 研究包含一篇論文和該項(xiàng)目的 AI 算法,開發(fā)者可以使用 NVIDIA Isaac Gym(一款用于強(qiáng)化學(xué)習(xí)研究的物理模擬參考應(yīng)用)進(jìn)行實(shí)驗(yàn)。Isaac Gym 基于 NVIDIA Omniverse 而構(gòu)建,后者是一個(gè)用于基于 OpenUSD 框架構(gòu)建 3D 工具和應(yīng)用的開發(fā)平臺(tái)。Eureka 自身是由 GPT-4 大型語言模型驅(qū)動(dòng)的。

NVIDIA AI 研究高級(jí)總監(jiān)、Eureka 論文作者之一的 Anima Anandkumar 表示:“在過去十年,強(qiáng)化學(xué)習(xí)取得了空前成功,但依然面臨許多挑戰(zhàn),比如獎(jiǎng)勵(lì)設(shè)計(jì)需要不斷試錯(cuò)才能完成。Eureka 是朝著開發(fā)將生成式和強(qiáng)化學(xué)習(xí)方法結(jié)合以解決這些艱巨的任務(wù)的新算法邁出的第一步?!?/p>

相關(guān)精彩視頻已在NVIDIA中國西瓜視頻賬號(hào)發(fā)布: NVIDIA Research 最新研究成果:Eureka 用 LLM 訓(xùn)練機(jī)器人靈巧操作

AI訓(xùn)練機(jī)器人

據(jù)該論文介紹,Eureka 生成的獎(jiǎng)勵(lì)程序(可讓機(jī)器人進(jìn)行試錯(cuò)學(xué)習(xí))在超過 80% 的任務(wù)上優(yōu)于人類專家編寫的程序,這使得機(jī)器人的平均性能提高了 50% 以上。

Eureka 教機(jī)械臂打開一個(gè)抽屜。

該 AI 智能體使用 GPT-4 LLM 和生成式 AI 編寫軟件代碼,為機(jī)器人進(jìn)行強(qiáng)化學(xué)習(xí)提供獎(jiǎng)勵(lì)。它不需要任何特定任務(wù)提示或預(yù)定義的獎(jiǎng)勵(lì)模板,并且能夠隨時(shí)結(jié)合人類的反饋改進(jìn)其獎(jiǎng)勵(lì),使結(jié)果更加精準(zhǔn)地符合開發(fā)者的愿望。

利用 Isaac Gym 中的 GPU 加速模擬,Eureka 能夠快速評(píng)估大批獎(jiǎng)勵(lì)候選者的質(zhì)量,從而提高訓(xùn)練效率。

Eureka 隨后會(huì)基于訓(xùn)練結(jié)果匯總關(guān)鍵統(tǒng)計(jì)數(shù)據(jù),并指導(dǎo) LLM 改進(jìn)其獎(jiǎng)勵(lì)函數(shù)的生成。通過這種方式,AI 可以自我完善。Eureka 教會(huì)了各類機(jī)器人,包括四足機(jī)器人、雙足機(jī)器人、四旋翼機(jī)器人、靈巧手、協(xié)作機(jī)器人臂等,來完成不同類型的任務(wù)。

該研究論文對(duì) 20 個(gè) Eureka 訓(xùn)練任務(wù)進(jìn)行了深入評(píng)估,這些任務(wù)基于開源的靈巧性基準(zhǔn),要求機(jī)器人手展示一系列復(fù)雜的雙手任務(wù)。

這些來自九個(gè) Isaac Gym 環(huán)境的測(cè)試結(jié)果通過使用 NVIDIA Omniverse 生成的可視化進(jìn)行了展示。

類人型機(jī)器人通過 Eureka 學(xué)習(xí)跑步步態(tài)。

該項(xiàng)目的貢獻(xiàn)者之一、NVIDIA 高級(jí)研究科學(xué)家 Linxi “Jim” Fan 表示:“Eureka 是一個(gè)獨(dú)特的組合,將大型語言模型與 NVIDIA GPU 加速的模擬技術(shù)相結(jié)合,可以實(shí)現(xiàn)靈巧的機(jī)器人控制,并且為藝術(shù)家提供了一種制作物理逼真動(dòng)畫的新方法?!?/p>

除了 NVIDIA Research 最近取得的進(jìn)展(比如使用 GPT-4 構(gòu)建的能夠自主玩 《我的世界》的 AI 智能體 Voyager)之外,這項(xiàng)突破性的研究成果也必將讓開發(fā)者們腦洞大開。

NVIDIA Research 由全球數(shù)百名科學(xué)家和工程師組成,團(tuán)隊(duì)專注于 AI、計(jì)算機(jī)圖形學(xué)、計(jì)算機(jī)視覺、自動(dòng)駕駛汽車、機(jī)器人學(xué)等領(lǐng)域的研究。

推薦器件

更多器件
器件型號(hào) 數(shù)量 器件廠商 器件描述 數(shù)據(jù)手冊(cè) ECAD模型 風(fēng)險(xiǎn)等級(jí) 參考價(jià)格 更多信息
ATXMEGA16D4-AU 1 Atmel Corporation RISC Microcontroller, 16-Bit, FLASH, AVR RISC CPU, 32MHz, CMOS, PQFP44, 10 X 10 MM, 1 MM HEIGHT, 0.80 MM PITCH, GREEN, PLASTIC, MS-026ACB, TQFP-44

ECAD模型

下載ECAD模型
$3.06 查看
MCP23S17T-E/SS 1 Microchip Technology Inc 16 I/O, PIA-GENERAL PURPOSE, PDSO28, 5.30 MM, PLASTIC, SSOP-28

ECAD模型

下載ECAD模型
$1.74 查看
MK66FN2M0VLQ18 1 NXP Semiconductors FLASH, 180MHz, RISC MICROCONTROLLER, PQFP144

ECAD模型

下載ECAD模型
$48.66 查看
英偉達(dá)

英偉達(dá)

NVIDIA(中國大陸譯名:英偉達(dá),港臺(tái)譯名:輝達(dá)),成立于1993年,是一家美國跨國科技公司,總部位于加利福尼亞州圣克拉拉市,由黃仁勛、克里斯·馬拉科夫斯基(Chris Malachowsky)和柯蒂斯·普里姆(Curtis Priem)共同創(chuàng)立。公司早期專注于圖形芯片設(shè)計(jì)業(yè)務(wù),隨著公司技術(shù)與業(yè)務(wù)發(fā)展,已成長為一家提供全棧計(jì)算的人工智能公司,致力于開發(fā)CPU、DPU、GPU和AI軟件,為建筑工程、金融服務(wù)、科學(xué)研究、制造業(yè)、汽車等領(lǐng)域的計(jì)算解決方案提供支持。

NVIDIA(中國大陸譯名:英偉達(dá),港臺(tái)譯名:輝達(dá)),成立于1993年,是一家美國跨國科技公司,總部位于加利福尼亞州圣克拉拉市,由黃仁勛、克里斯·馬拉科夫斯基(Chris Malachowsky)和柯蒂斯·普里姆(Curtis Priem)共同創(chuàng)立。公司早期專注于圖形芯片設(shè)計(jì)業(yè)務(wù),隨著公司技術(shù)與業(yè)務(wù)發(fā)展,已成長為一家提供全棧計(jì)算的人工智能公司,致力于開發(fā)CPU、DPU、GPU和AI軟件,為建筑工程、金融服務(wù)、科學(xué)研究、制造業(yè)、汽車等領(lǐng)域的計(jì)算解決方案提供支持。收起

查看更多

相關(guān)推薦

電子產(chǎn)業(yè)圖譜