NVIDIA 最新 AI 模型幫助機器人像人類一樣表演旋轉筆

NVIDIA Research 宣布創建了 Eureka,這是一個由 GPT-4 驅動的 AI 代理,通過獎勵算法訓練機器人執行任務。值得注意的是,Eureka 教會了一個機器人手進行旋轉筆的技巧,就像人類一樣(實際上,正如下面的 YouTube 視頻所示,比我們許多人都要好)。Eureka 還教會了四足機器人、靈巧的手、協作機器人手臂和其他機器人開抽屜、使用剪刀、接球以及近 30 項不同的任務。

Share
NVIDIA 最新 AI 模型幫助機器人像人類一樣表演旋轉筆

NVIDIA Research 宣布創建了 Eureka,這是一個由 GPT-4 驅動的 AI 代理,通過獎勵算法訓練機器人執行任務。值得注意的是,Eureka 教會了一個機器人手進行旋轉筆的技巧,就像人類一樣(實際上,正如下面的 YouTube 視頻所示,比我們許多人都要好)。Eureka 還教會了四足機器人、靈巧的手、協作機器人手臂和其他機器人開抽屜、使用剪刀、接球以及近 30 項不同的任務。根據 NVIDIA Research 的說法,AI 代理的試錯型獎勵程序比人類專家編寫的程序有效 80%,這一轉變意味著機器人的性能也提高了超過 50%。Eureka 也會根據訓練結果自我評估,根據需要指示獎勵功能的變更。

NVIDIA Research 已經發布了其的 Eureka 算法,鼓勵其他人在 NVIDIA Isaac Gym 上試用,這是該組織的“強化學習研究的物理模擬參考應用程序”。

機器人教育機器人的想法越來越受到關注和成功,2023 年 5 月發表在 Transactions on Machine Learning Research 期刊上的一篇論文介紹了一個名為 SKILL(共享知識終身學習)的新系統,該系統允許 AI 系統學習 102 種不同的技能,包括從胸部 X 光片診斷疾病和識別花的品種。AI 通過通信網絡彼此分享他們的知識,就像老師一樣,並能夠掌握每一項技能,像 MIT 和布里斯托大學這樣的學校的研究人員也取得了成功,特別是在使用 AI 教育機器人如何操作物體方面。

Read more

Anthropic 官方重構發表 Claude Projects:從資料夾走向對話

Claude 專案大重構!告別靜態資料夾:Projects 化身「對話式幕僚長」,並行調度多 Threads、跨 Repo 自動開 PR 與共享記憶體深度解析

Anthropic 震撼重構 Claude Projects!告別過去「靜態資料夾」架構,進化為「對話式技術幕僚長」。只需交代目標,Claude 自動拆解需求、雲端平行調度多條 Threads 獨立拉分支開發、跨 API/Web/Mobile 三大倉庫提 PR 並排序合併依賴,更具備跨執行緒動態記憶庫與手機離線接力。本文全面深度解析。

智譜 Z.ai 官方發布:Toward Recursive Self-Improvement: How GLM Built Its Own Inference Infrastructure

智譜 Z.ai 重磅揭密「模型自造基礎設施」!GLM-5.3 帶領 Infra Agent 於 10 萬國產算力卡兩週吞吐飆 3 倍:Ox Alpha 身分正式揭曉、稠密反饋擊破 GIL 鎖死瓶頸與遞歸自我改進(RSI)黎明深度解析

智譜 AI(Z.ai)發表《Toward Recursive Self-Improvement》技術震撼彈!證實 8 月在 OpenRouter 橫掃 62 兆 Token 的匿名模型 Ox Alpha 真身為 GLM-5.3-Flash。更首度揭露 GLM-5.3 驅動的 Infra Agent 如何在超過 10 萬張國產算力卡叢集上自主修復底層算子精度與 Python GIL 鎖死,兩週內將推論吞吐拉升 3 倍,能效逼平 NVIDIA。深度剖析稠密反饋機制與「模型優化系統,系統運行模型」的 RSI 黎明。