Alphabet旗下Google DeepMind正式對外發表專為具身智慧(Embodied AI)與人形機器人量產設計的「Gemini Robotics 2」系列模型。該系統改善長程步驟(Long-horizon tasks)推理與多台機械設備跨品牌協同合作的瓶頸,讓實體AI邁入自主規劃能力的新階段。
Gemini Robotics 2定位為適用於各類機器人的核心智慧層(Intelligence Layer)。該系統涵蓋三大核心模型,成功將視覺與語言理解直接轉化為馬達控制,賦予機器人全身協調、精密操作以及多機協作能力,標誌著通用機器人技術邁入全新里程碑。
在模型架構方面,系統由視覺語言行動(VLA)模型與具身推理(ER)模型協同運作。主力模型Gemini Robotics 2能將輸入影像與指令即時轉譯為馬達控制訊號;具備長程規劃能力的Gemini Robotics ER 2負責實體空間推理與任務拆解;而Gemini Robotics On-Device 2則是專為機器人硬體本機運算優化的輕量化端側模型,有效降低控制延遲。
...
...
| 使用者別 | 新聞閱讀限制 | 文章閱讀限制 | 出版品優惠 |
| 一般使用者 | 10則/每30天 | 0則/每30天 | 付費下載 |
| VIP會員 | 無限制 | 25則/每30天 | 付費下載 |

