Toyota 的「機器人幼兒園」正在教導機器人學習如何製作早餐!

Toyota Research Institute (TRI) 利用生成式 AI 在一個被稱為「機器人幼兒園」的環境中教導機器人如何製作早餐,這不是通過數百小時的編碼、錯誤和錯誤修復來完成的。相反,研究人員通過給予機器人觸覺,將它們接入 AI 模型,然後像教導人類一樣向它們展示操作方法。研究人員表示,觸覺是“一個關鍵的啟動器”,通過給予機器人在下面視頻中看到的大型、蓬鬆的拇指,該模型可以“感覺”到它正在做的事情,從而獲得更多的信息,這使得僅憑視覺難以完成的困難任務變得更容易。

Share
Toyota 的「機器人幼兒園」正在教導機器人學習如何製作早餐!

Toyota Research Institute (TRI) 利用生成式 AI 在一個被稱為「機器人幼兒園」的環境中教導機器人如何製作早餐,這不是通過數百小時的編碼、錯誤和錯誤修復來完成的。相反,研究人員通過給予機器人觸覺,將它們接入 AI 模型,然後像教導人類一樣向它們展示操作方法。研究人員表示,觸覺是“一個關鍵的啟動器”,通過給予機器人在下面視頻中看到的大型、蓬鬆的拇指,該模型可以“感覺”到它正在做的事情,從而獲得更多的信息,這使得僅憑視覺難以完成的困難任務變得更容易。

實驗室的操作經理 Ben Burchfiel 表示,看到機器人與其環境互動“非常令人興奮”。首先,一位“教師”展示了一套技能,然後模型在幾個小時內學習,他補充說,“我們常常在下午教導機器人,讓它在夜間學習,然後在第二天早上看到一個新的行為。”

研究人員表示,他們正在嘗試為機器人創建“大型行為模型”或 LBMs。與 LLMs 通過注意人類寫作中的模式進行訓練類似,Toyota 的 LBMs 會通過觀察學習,然後“概括,執行他們從未被教導過的新技能”,TRI 的機器人研究副總裁兼 MIT 機器人學教授 Russ Tedrake 說。

研究人員表示他們已經訓練了超過 60 項具有挑戰性的技能,如“倒液體、使用工具和操作可變形的物體”,他們希望到 2024 年底能提高到 1,000項。

Read more

Anthropic 官方重構發表 Claude Projects:從資料夾走向對話

Claude 專案大重構!告別靜態資料夾:Projects 化身「對話式幕僚長」,並行調度多 Threads、跨 Repo 自動開 PR 與共享記憶體深度解析

Anthropic 震撼重構 Claude Projects!告別過去「靜態資料夾」架構,進化為「對話式技術幕僚長」。只需交代目標,Claude 自動拆解需求、雲端平行調度多條 Threads 獨立拉分支開發、跨 API/Web/Mobile 三大倉庫提 PR 並排序合併依賴,更具備跨執行緒動態記憶庫與手機離線接力。本文全面深度解析。

智譜 Z.ai 官方發布:Toward Recursive Self-Improvement: How GLM Built Its Own Inference Infrastructure

智譜 Z.ai 重磅揭密「模型自造基礎設施」!GLM-5.3 帶領 Infra Agent 於 10 萬國產算力卡兩週吞吐飆 3 倍:Ox Alpha 身分正式揭曉、稠密反饋擊破 GIL 鎖死瓶頸與遞歸自我改進(RSI)黎明深度解析

智譜 AI(Z.ai)發表《Toward Recursive Self-Improvement》技術震撼彈!證實 8 月在 OpenRouter 橫掃 62 兆 Token 的匿名模型 Ox Alpha 真身為 GLM-5.3-Flash。更首度揭露 GLM-5.3 驅動的 Infra Agent 如何在超過 10 萬張國產算力卡叢集上自主修復底層算子精度與 Python GIL 鎖死,兩週內將推論吞吐拉升 3 倍,能效逼平 NVIDIA。深度剖析稠密反饋機制與「模型優化系統,系統運行模型」的 RSI 黎明。