作者tanted (為何世界會那麼不單純)
看板Stock
標題[新聞] Google發表Gemini Robotics ER 2!讓機
時間Fri Jul 31 23:32:34 2026
文章標題 請使用 原新聞標題 勿刪減或自創標題,違者4-1處分
原文標題: 請勿刪減或自創標題,違者4-1處分,此行請刪除
Google發表Gemini Robotics ER 2!讓機器人邁向「高階大腦」時代
原文連結: 網址超過一行,請用縮網址,連結不能點擊者板規 1-2-2 處分。
https://ec.ltn.com.tw/article/breakingnews/5524402
發布時間: 請勿張貼超過3天新聞
2026/07/31 17:00
記者署名:
原文內容:
〔記者邱巧貞/台北報導〕Google 30日宣布推出全新機器人AI模型 Gemini Robotics
ER 2,這是目前Google最先進的「具身推理(Embodied Reasoning)」模型,可視為機器
人的「高階大腦」,相較前一代 Gemini Robotics ER 1.6,新版本最大的突破在於加入
連續影片理解(Video Understanding)、任務進度追蹤、工具調度(Tool
Orchestration)以及多機器人協作能力等。
Google指出,若要讓機器人在真實世界中協助人類,光具備精準的空間推理能力仍然不夠
,更大的挑戰在於,機器人能否即時理解現場狀況、判斷下一步該採取什麼行動,並在執
行任務的過程中,根據環境變化隨時調整策略。
請繼續往下閱讀...
因此,Gemini Robotics ER 2被定位為機器人的「高階大腦」,主要負責與人類對話、理
解周遭物理環境、規劃多步驟任務,並可呼叫Google Search等工具取得資訊,或串接開
發者自訂的函式與API。完成任務規劃後,再將實際動作交由底層的視覺-語言-動作模
型(Vision-Language-Action,VLA)執行。
此次更新的一大突破,是導入連續影片理解(Continuous Video Understanding)能力。
過去機器人大多只能分析單張影像,如今則能持續觀看攝影機畫面,即時掌握任務完成進
度、判斷執行過程是否出錯、是否需要重新嘗試,以及是否可以進入下一個步驟。
Google表示,這讓機器人真正具備「即時情境感知」能力,例如能判斷燈泡是否已鎖緊、
垃圾袋是否綁好,或咖啡是否已倒至適當容量,只有在確認任務完成後,才會繼續下一步
。
為了更精準掌握工作進度,Gemini Robotics ER 2新增進度分類功能,可將影片中的每一
個畫面依任務完成程度分為0至20%、20至40%、40至60%、60至80%及80至100%等階段,藉
此判斷工作進行到哪裡、是否偏離流程,以及是否需要採取補救措施。官方測試顯示,
Gemini Robotics ER 2在進度分類任務中的準確率約57.4%,優於前一代模型。
另一項重要升級則是關鍵時刻辨識(Moment Finding),可找出影片中任務完成的關鍵時
間點,例如判斷咖啡何時倒至適當容量、燈泡何時完全鎖緊等。Google表示,新模型在這
項測試中的準確率達 91.3%,平均時間誤差僅 0.96 秒;相較同級大型模型,在維持高準
確率的同時,推論速度約快 4 倍,且運算成本更低。
Google此次也正式加入多機器人協作功能。官方指出,不同類型的機器人各有所長,例如
:輪式機器人擅長室內導航,人形機器人則更適合跨越崎嶇地形,Gemini Robotics ER 2
可讓不同機器人共享語意理解能力,彼此分工、交接任務,共同完成單一機器人無法獨立
處理的複雜工作流程。
Google也展示與波士頓動力(Boston Dynamics)的合作成果,透過Gemini Robotics ER
2整合Spot四足機器人的導航API與機械手臂控制能力,使用者只需以自然語言下達「幫我
拿爆米花」等指令,Spot便能自主導航、尋找目標物並完成取物。Google也同步於GitHub
公開相關範例程式,供開發者參考與應用。
此外,Gemini Robotics ER 2也全面提升空間理解能力,涵蓋三大核心功能。首先,在成
功/失敗偵測(Success / Failure Detection)方面,Gemini Robotics ER 2 現在可直
接分析原始影片串流,而非僅依賴靜態影像,因此能在任務執行過程中即時偵測液體灑出
、物品滑落、對位偏移等失敗情況。
其次,在儀器讀值(General Instrument Reading)方面,已從過去主要支援類比儀表,
擴展至可辨識10種不同類型的儀器,包括數位顯示器、直尺、線性刻度及液體溫度計等,
可因應更多工業場域的檢測需求。
最後,在視覺問答方面,受惠於Gemini多模態理解能力的提升,機器人能更準確理解複雜
的視覺資訊,並回答與空間環境相關的問題。
在安全性方面,Google表示,Gemini Robotics ER 2在人員接近偵測及安全指令遵循兩項
測試中,表現均優於前一代模型。舉例來說,當有人靠近機器人時,系統能自動停止作業
、持續監測周遭環境,並在確認人員離開後自主恢復工作。
Google同時推出全新的安全評估基準,檢驗AI是否具備執行安全限制、持續監控環境、判
斷動作是否符合物理可行性,以及在必要時主動向人類尋求確認等能力,進一步提升未來
具身AI(Embodied AI)的安全性。
Google表示,Gemini Robotics ER 2已透過Gemini API(可於 Google AI Studio 使用)
開放開發者;企業版則以 Private Preview 形式於 Gemini Enterprise Agent Platform
提供。
https://www.youtube.com/watch?v=4lSQnrMC6nY
心得/評論:
※必須填寫滿30正體中文字,心得過短或濫竽充數將以板規 1-2-3 處分
谷歌現在給機器人「高階大腦」
不只會做事
還會邊做邊看進度條
確認自己有沒有搞砸
不過再強有我們中國宇樹會後空翻機器人嗎?
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 123.193.229.55 (臺灣)
※ 文章網址: https://webptt.com/m.aspx?n=bbs/Stock/M.1785511956.A.725.html
1F:→ InfoWars : 要給我初音了嗎? 07/31 23:34
2F:噓 ss425727100 : 台灣只要無人機 這些機器人能幹嗎 07/31 23:35
3F:推 sdbb : 給我能幹的機器人 07/31 23:36
4F:→ Eide : 未來想量產可以去找特斯拉合作 07/31 23:37
5F:推 HiuAnOP : 會支那功夫嗎?不會下去 07/31 23:37
6F:推 iTWN : 這沒有中國跳舞機器人厲害,下去 07/31 23:42
7F:推 Picoro : gemini那幻覺率。。。 07/31 23:43
8F:噓 oldntu : 先把Gemini恢復正常吧 07/31 23:46
9F:推 kobelakers : 好扯 07/31 23:46
10F:推 MyKal1001 : Gemini跟屎一樣 機器人真的能用嗎 07/31 23:54
11F:→ azhu : 長照機器人 08/01 00:00
12F:推 steak5566 : 物理ai才是真的能大規模商用的東西 08/01 00:01
13F:推 zagato : 支那功夫?給我精通床上功夫的就行 08/01 00:11
14F:推 ilGroundhog : gemini...現在好像幾乎沒一項贏的 08/01 00:12
15F:→ ilGroundhog : 我從付費到退出 便宜真的沒用 好用才是真的 08/01 00:12
16F:推 zetatmrptt : 過氣了 08/01 00:14
17F:噓 e123456ddd : gemini的品質爛到誇張 哪個公司高層會相信它的模型 08/01 00:14
18F:→ e123456ddd : 很可靠 08/01 00:14
19F:→ galic : 人家可是世界模型 08/01 00:19
20F:噓 matlab1106 : 手機太爛搶不到市佔 只能吹個其他東西 08/01 00:46
21F:噓 PeterU : 像小兒麻痺 08/01 00:47
22F:→ ThreekRoger : 什麼時後會跟人類說不 08/01 01:06
23F:→ hijacker : 想讓你自家的waymo聰明點吧 08/01 01:19
24F:→ tanted : 今天谷歌大漲 好像就這個原因 08/01 01:37
25F:→ strlen : 性愛機器人呢 08/01 02:35
26F:推 ted1985 : 阿三公司快解決阿三國內的性飢渴問題吧 加油! 08/01 03:23
27F:推 waitrop : 不是這原因,這種鳥新聞根本沒人有注意,今天大漲 08/01 03:34
28F:→ waitrop : 可能是小幅軋空跟放空回補,主因是因為大家發現微 08/01 03:34
29F:→ waitrop : 軟跟亞麻財報跟谷歌一樣,甚至成長跟錢賺得更少, 08/01 03:34
30F:→ waitrop : 但是股價大漲,發覺華爾街的說法完全不通,所以空 08/01 03:34
31F:→ waitrop : 軍開始回補 08/01 03:34
32F:推 myyalga : Ai與機器人都是工具,這些工具沒有人類就沒有意義, 08/01 05:23
33F:→ myyalga : 這些工具也沒辦法為自己的行為負責,最後都不能脫離 08/01 05:23
34F:→ myyalga : 人類控制,人類擔責! 08/01 05:23
35F:→ myyalga : — 08/01 05:23
36F:→ myyalga : 那為什麼有ai、機器人,我們還要學習? 08/01 05:23
37F:→ myyalga : 因為有了知識,你才能控制它們。 08/01 05:23
38F:→ myyalga : 而不是變成機器人與ai養的豬,任它們宰割。 08/01 05:23
39F:→ myyalga : 那人類如何操控它們? 08/01 05:33
40F:→ myyalga : 用軟體控制,不管這軟體是用自然語言寫的程式,或機 08/01 05:33
41F:→ myyalga : 器語言寫的程式,我們都需要會用寫程式控制它們的資 08/01 05:33
42F:→ myyalga : 工人才,所以我一直很不解為什麼有人一直渲染它們可 08/01 05:33
43F:→ myyalga : 以取代軟體工程師?也可以理解為什麼現在硬體跑到幾 08/01 05:33
44F:→ myyalga : 乎在軟體前面,沒什麼人開發軟體,讓軟體開發速度慢 08/01 05:33
45F:→ myyalga : 得可憐! 08/01 05:33
46F:噓 darkangel119: 連高鐵票價都會搞錯 …. 08/01 06:48
47F:推 hcchen0014 : 真好奇他搞砸後也會說 我只是個語言模型嗎? 08/01 07:55
48F:推 madaofreak : Gemini現在都是給滿情緒價值,嗯 08/01 08:18
49F:推 jimlexus : 新的工業革命要來了 08/01 08:23
50F:推 kalapon : 更高階的要有更強大的晶片來跑,GG還有的玩 08/01 09:17
51F:推 zaqimon : 這台機器人可以自己開車去上班賺錢了嗎 08/01 09:31
52F:推 ted1985 : 博通 發哥 抖起? 08/01 09:35
53F:推 CKRO : 先說可以瑟瑟嗎 08/01 09:52
54F:推 YJM1106 : VLA也出現幻覺的話…B級驚悚片XD 08/01 10:32
55F:→ zo6596001 : 這個很有用啊,以後監控儀器的工作可以交給機器人 08/01 11:05
56F:→ zo6596001 : 做了 08/01 11:05
57F:→ zo6596001 : 這個很有用啊,像是管線壓力之類要去現場讀表的工 08/01 11:07
58F:→ zo6596001 : 作都可以讓機器人完成 08/01 11:07
59F:→ zo6596001 : 波士頓動力用的就是Gemini 08/01 11:07
60F:推 sniper578 : 世界末日是不是裝了Gemini 大腦的機器人造成的? 08/01 11:21
61F:推 GinginDenSha: 最後梯隊的腦殘model放到物理世界,不要害人 08/01 13:30
62F:推 kimula01 : 我就問天網哪時候才會出來 08/01 14:53
63F:推 momochacha : 降智後 OAI好用多了 08/01 17:14
64F:噓 spen2005 : 滿廢的 08/01 17:25
65F:→ gottsucher : 廢物gemini 08/01 21:45