AI離開螢幕之後:人類會先需要一個工人、照護者,還是一個陪伴者?
本文為繁體中文版。English version: When AI Leaves the Screen: Will We Need a Worker, a Caregiver, or a Companion First? 本站為文字版;含完整圖表的版本請見 Medium 原文。 這個問題對我不是抽象的未來想像。 最近半年,我九十多歲的母親在家中跌倒了幾次。我的姊姊、姊夫一直在照顧她,我們也定期陪她回醫院檢查。家人已經付出很多,但沒有人能一天二十四小時始終站在她身旁。幸好幾次跌倒沒有造成嚴重傷害,卻留下了一個無法迴避的問題:如果當時有一個能持續觀察、及時提醒,並在異常發生後立刻求助的實體AI,結果是否可能不同? 我想到的不是一台取代家人的機器,而是一個補上「人不可能永遠在場」這段空白的系統。 這也是我重新理解Physical AI的起點。它最重要的價值,未必是讓機器像人一樣跳舞、跑步或表演,也不只是下一波資本市場題材。真正值得問的是:當人工智慧離開螢幕、取得身體,它能不能在人類無法持續在場的時刻看見風險、做出回應,並把真正的人帶回現場? 過去幾年,AI的主要成果發生在螢幕裡。它回答問題、寫程式、生成圖像、整理資料。但對一位夜裡起身的老人而言,再聰明的聊天機器人,如果沒有看見她失去平衡,也無法在跌倒後確認是否受傷,那份智慧仍然停留在另一個世界。 現在,AI正開始走出那個世界。 在工廠裡,它被要求搬料、分揀、裝配並連續工作;在家庭市場,它被想像成家務助手;在中國新出現的仿生人產品中,它甚至被包裝成具有表情、記憶與人格的陪伴者。 當AI離開螢幕,人類會先為它的勞動力付費、為家人的安全付費,還是先為它的存在感付費? 一、Physical AI到底多了什麼? Physical AI、具身智慧與空間智慧經常被混在一起。它們彼此相關,但不完全相同。 李飛飛近年強調的Spatial Intelligence,是AI對三維世界的理解:深度、幾何、物體彼此的位置、運動,以及它們如何在空間中互動。Embodied Intelligence更進一步:智慧不只在模型內推理,而是透過身體與環境互動,在行動和結果之間學習。 Physical AI則是較接近產業化的總稱。它把感知、空間與物理推理、規劃、控制和動作連成閉環,應用可以是人形機器人、自駕車、無人機、工業機械或智慧空間。 生成式AI的循環大致是: 提示 → 模型推理 → 文字、影像或程式碼 Physical AI的循環則是: 感測世界 → 建立物理狀態 → 規劃 → 動作 → 接觸結果 → 發現誤差 → 修正下一步 大型語言模型主要從人類留下的文字、影像、程式碼與數位紀錄中學習。Physical AI面對的則是另一種資料:它不只要知道「杯子」這個詞,也要知道杯子的位置、重量、材質與可抓取部位;手指施力後,杯子會不會滑動、傾倒或破裂;第一次沒抓好,下一步該如何修正。 它的經驗單位不再只是一句話或一張圖,而是一段感知—行動—結果: 看見物體 → 預測結果 → 採取動作 → 感覺接觸 → 觀察成功或失敗 → 修正策略 ...