DIGITIMES
AI Agent能力版圖到哪裡了?未來呢?
Token單價下滑、總消耗量大增,專欄2026年3月分析過,趨勢至今有增無減。新一代前瞻模型朝AI代理(AI Agent)的使用型態設計:這幾個月各家前瞻實驗室競爭加劇,接連發布的新模型能規劃任務、分派工作、運用各種技能與工具、直接操作電腦介面,定價卻更低。AI代理正被快速導入各種知識工作。那麼,AI代理真的能承接知識工作嗎?能承接多少?尚未承接的部分,是還沒有人投入,還是技術未到?7月初參加在加州聖地牙哥舉辦的計算語言學年會ACL 2026,一場「AI代理人與工作的未來」專題講座(tutorial)把技術現況以及這些問題拆開來看。浮現一張讓人驚訝的能力版圖:AI代理已經站穩的區域,小得出乎意料;版圖之外,一部分是還沒有人投入的空白,另一部分是技術還待克服的難題。先看站穩的區域。前瞻模型業者OpenAI在2025年推出代理人基準測驗(benchmark)GDPval,從GDP貢獻最大的44種職業中,設計出1,300多項「規格明確」的真實任務(如簡報、財務模型、工程圖說),來測試代理人執行能力,並請同行專家盲評AI與人類的成品。依業者2026年4月發布的最新結果,最強模型的成品已有逾8成被評為不輸人類專家;這套基準2025年9月推出時,這比例還不到5成,再前一代模型也只達到1成出頭。依業者推出這套基準時的估算,完成速度與成本約為人類專家的百分之一。單看這些數字,AI代理似乎已經可以上工。但這片區域在整個勞動版圖上有多大?ACL會議中主講的CMU團隊把目前43個AI代理基準測驗(學術、產業時常使用的Agent評測任務)共72,342個任務,對應到美國1,016種職業的技能分類(參考美國O*NET職業資訊資料庫)。基準測驗的分布,可當作目前AI代理研發重心地圖:考題集中的地方,訓練資料與研究人力也跟著集中。結果顯示,任務多數落在「取得資訊」與「操作電腦」2項技能,在整體就業所需技能中的權重合計不到5%;投入最深的程式與數學領域,只對應7.6%的就業人口。原因不難理解:這些工作結構化程度高、輸入輸出明確、成功與否可以驗證。本專欄先前提過,自動化總是先從結構化的場域開始,研發投入也一樣。版圖之外的第一種空白,是還沒有人投入的高價值區。同一份報告指出,管理、法務、建築工程的工作已高度數位化(約88%、70%、71%),基準測驗的覆蓋卻只有1.4%、0.3%、0.7%,而管理正是以薪資加權後經濟價值集中的領域。這些工作中不少環節有明確的輸入輸出,未必是技術做不到,更可能是還沒有人投入;論文稱之為「錯失的機會」。一旦投入到位,對企業來說,這裡可能是生產力改善較早出現的地方。第二種空白,是技術還待突破的複雜工作。資料標註平台業者與AI安全研究機構合作的「遠距勞動指數(Remote Labor Index)」,從接案平台選取真實付費委託(3D建模、建築圖說、影音製作、資料分析等,專業者完成一件的中位時間約11.5小時),讓前瞻AI代理端到端執行,再由人類評審對照專業接案者的成品盲評,以此模擬企業交付員工的工作指令。指數2025年10月發布時,最佳模型只有2.5%的專案達到可驗收水準。真實委託的需求模糊、規格多步驟、常要求修改既有成品,這些都還沒被結構化。長時序的複雜任務是另一道關卡。前述CMU團隊的報告同時量測AI代理自主性:即使在表現最好的軟體領域,任務複雜度一提高,成功率就明顯下滑;其他測驗加入工具中途出錯、給定資訊不完整、需要多人協作等情境後(模擬真實複雜場域),表現同樣走低。值得注意的是這張版圖移動的速度。2026年7月,研究機構以最新一代模型、搭配更完整的代理人執行環境重測遠距勞動指數:最佳模型的成功率已從2.5%升到15.8%,前後不到1年;同一份更新也指出,絕大多數專案的成品仍達不到專業驗收水準。兩個現象並行:能做的還很少,推進的速度很快。GDPval從1成出頭到逾8成不輸專家,說的是同一件事:AI代理目前的能力版圖比想像中小,但持續擴張中。這類成長難免包含針對測驗最佳化的成分;但這兩套測驗過的是人類專家對真實成品的驗收,能拉高分數的改進,多半也是AI代理真實能力的提升。目前技術擴張的方向也有跡可循。研發正把做不到的難題當成訓練目標:新一代測驗把出錯、協作、真實委託等情境逐步納入題目,最新的訓練方法把專家驗收的標準(rubric)轉成訓練訊號;今天做不到的清單,很可能就是下一輪訓練資料與運算投入瞄準的地方。還沒有人投入的高價值空白,很可能也將循同一條路逐步被填補。回到開頭的需求端。目前代理人技能只在結構化的一小塊版圖上站穩,如今的用量成長與供應鏈投資,大致就發生在這一小塊之上(但已相當可觀)。版圖之外的大量工作,仍由人補位:釐清模糊的需求、拆解執行步驟、修正最後的產出;而這些補位動作,專欄近期談過,正是企業在教模型。目前AI代理能完成的工作比想像中少,但是需求已經這麼大,而技術能力版圖還在往外擴。接下來市場的成長與組織的變動,可能又會超乎我們的想像。
複製嬌妻
今日大力推動人形機器人時,讓我想到《複製嬌妻》(The Stepford Wives)這部伊拉・萊文(Ira Levin)於1972年創作的小說,1975年由布萊恩・福布斯(Bryan Forbes)改編成同名驚悚電影。這部作品超越科幻與恐怖類型的範疇,成為映照社會焦慮的鏡子,凸顯父權社會對女性的物化、對個性自主的壓抑,以及對科技失控的潛在恐懼。故事講述攝影師喬安娜(Joanna)與丈夫搬入康乃狄克州寧靜的郊區小鎮Stepford。起初,她被小鎮整潔的街景與居民的禮貌吸引,但漸漸察覺異樣:鎮上的妻子們舉止相似、語氣溫順、生活完全圍繞家務。當好友查梅恩(Charmaine)突然失去個性、變得順從後,喬安娜與另一位新住民展開調查,最終發現恐怖的真相。鎮上的男子協會利用科技手段將妻子取代為完美順從的機器人,讓這座小鎮成為男人幻想的烏托邦。電影上映時評價分歧,由此產生的文化詞彙「Stepford Wife」卻影響後世,用來象徵被馴化、順從而失去靈魂的女性。飾演查梅恩的路易絲(Tina Louise)表現出女性對抗社會定型的掙扎,成為理解這部電影的重要視角。電影《複製嬌妻》拍攝於1970年代第二波女權主義的高峰期,直接反映部分男性對女性追求平權的焦慮與反撲。片中的男子協會以科技重塑女性形象,象徵徹底抹除女性主體性。電影以恐怖敘事揭露這種烏托邦的殘酷,在完美的草坪與笑容背後,潛藏的是靈魂的死亡。它提出尖銳的問題:所謂的「完美女人」,是否必須以犧牲自由與個性為代價?近半世紀後,這部作品的寓言在人工智慧(AI)時代更加貼近現實。深度偽造(Deepfake)技術能重塑人的聲音與容貌,延續數位層面對人的物化。電影中的機器人妻,如今以虛擬形式重現。當人類利用科技塑造「理想對象」,往往忽略背後的倫理界線。AI的「個性定制」與社群媒體演算法的回音室效應,也在無形中削弱思想的多樣性,使人們在意識上成為新的「複製人」。電影所諷刺的「完美」幻象,如今透過演算法與濾鏡重生,構築出表面幸福卻內在空洞的社會模板。《複製嬌妻》的性別寓言,是一則對自由與真實的警示。它提醒我們,真正的進步不應製造順從的複製體,而需尊重差異與不完美的人性。科技或許能創造無數「理想化的她」,但唯有拒絕被定義的個體,才真正擁有不可複製的靈魂。
企業的AI資產,不是模型,是學習迴圈
過去20年,企業資訊治理的核心是保護資料:分級、加密、備援、不出門,這套做法如今已是標準作業。但資料本身是靜態的;真正創造競爭力的,不是資料,而是「運用資料改善工作」的能力:用它最佳化產品設計、良率、客戶經營與銷售流程,讓被動的資料「活化」。例如,晶圓廠把檢測資料回饋到製程參數,物流業者拿配送紀錄重排路線,品牌廠拿客服對話修正產品設計:資料的價值,在商業迴圈中被最佳化放大。AI時代,這個迴圈有了新的參與者。企業的工作流程本來就持續在最佳化、修正,行之有年的持續改善是營運的日常;過去改善的成果寫進SOP,如今企業把AI嵌入工作流程,AI跟著每一次調整吸收經驗。這裡說的「學習迴圈」,正是持續改善的新形態:不是模型自我學習,而是企業最佳化流程、AI吸收經驗、讓下一次做得更好的循環;迴圈轉得愈久,累積愈厚。AI吸收經驗的管道,多半是人提供的提示詞與脈絡資料(context)。AI代理(AI Agent)目前能穩定接手的,還只是結構化程度最高的一小塊工作;其餘大量工作,仍需要專人介入:用提示詞補上模糊的需求、提供流程脈絡、修正不到位的產出。每一次補位都是一次示範,規格文件、報價邏輯、內部術語,隨著提示詞一併交給模型;本意是讓眼前的工作更有效率,實際上卻也在教導模型。模型做不到的部分愈多,人教得愈勤,留下的教材愈密集;模型的能力邊界,恰好沿著人補位最密集的地方往外推。企業教得愈多,前瞻模型能力愈強,而這個原本屬於企業的改良過程,可能逐漸累積在外部平台掌控的學習系統中。企業領導人的疑慮,開始浮上檯面。2026年7月初,一家美系資料分析軟體大廠的執行長在訪談中批評,前瞻實驗室一邊把模型能力講得過滿,一邊透過客戶的日常使用,吸收企業的專有工作流程與策略知識;7月中旬,微軟(Microsoft)執行長Satya Nadella發表短文〈The Reverse Information Paradox〉,表達他的想法。他借用經濟學家Kenneth Arrow在1966年提出的資訊悖論:原始版本是賣方的困境,要證明資訊有價值就得先揭露,一揭露,買方就免費取得了;Nadella認為AI把風險反轉到買方這一側:企業為AI付2次錢,一次付訂閱與運算費用,另一次付出為了讓智慧派得上用場、不得不揭露的企業know-how。外流的管道不只是上傳文件:提示詞、附帶的脈絡與額外資料,尤其是「糾正模型錯誤」的動作,每一次修正都是高價值訊號,把機構知識一筆一筆輸出,進了外部平台手裡。Nadella這篇短文提出警訊,要企業自問:你親手教模型的訊息,流向哪裡?業界的討論多半集中在他提出的5個C架構:Control是自建並持有評測與機構記憶,所有權留在企業手上;Capability是在自己的環境內,讓模型針對真實工作流程練習與微調,不必把敏感脈絡交給第三方;Choice是把調度層與任何單一模型脫鉤,換模型時不必重建評測、不遺失脈絡;Cost則是Choice的直接結果:能換模型,就能按任務挑選通過評測的最經濟選項。前四項是手段,第五項Compound才是目的:把它們組成一個學習迴圈,AI隨使用愈變愈好,而改進成果像資產一樣留在企業內部,屬於企業,而不是供應商。企業與供應商之間這條界線該畫在哪裡,與用哪一家雲端平台無關。哪一份輸出被接受、哪裡被改、為什麼被改,這些過程訊息過去不被當成資產,也不在資料治理的範圍內;知識的價值,正在從文件移向「過程」;資料治理守住的是原料,尚未涵蓋製程改良迴圈。外流的輕重,對不同企業並不相同。多數企業的日常使用,外流的多是通用內容,影響有限;有相當規模的企業則不同:獨特的工作流程、客戶結構、長年累積的領域資料,正是修正訊息價值集中的地方。如何把學習迴圈留在內部?一半條件在運算平台。這不意味著放棄前瞻模型:更可能的形態是混用(hybrid),通用能力繼續交給公有雲上的這些模型;而關鍵的評測、記憶、教導模型的指示與範例、修正紀錄,在自己掌控的環境內累積——本專欄2026年5月談AI運算架構5層重組時描述過的企業資料中心與本地伺服器,正是這個迴圈落腳的地方。延伸報導專家講堂:Token帳單之後:AI運算架構的5層重組另一半條件在模型端。開放權重模型是前提:權重能掌握在自己手上,模型才能搬進企業門內;迴圈於是累積在企業的評測與記憶上,而不是綁在某一個模型身上;Choice的議價能力,在架構上由此而來。成本也比直覺想像的低:NVIDIA研究部門2025年的論文主張,代理人系統中大量呼叫是重複、特化的小任務,小型模型已足以勝任;評測評分、任務分派、記憶整理這類迴圈裡的控制工作,恰好都屬於這一類,不需要仰賴前瞻模型。「消費智慧的同時,你也在創造智慧。你創造的東西應該屬於你。」Nadella說得直白。模型會走向商品化,企業的know-how、工作流程最佳化迴圈不會;真正的資產,不是模型,而是企業每天都在累積、並且留在自己手上的學習迴圈。
從牛頓煉金術看現代資通訊工程
我在杭廷頓圖書館(Huntington Library)的古籍收藏中,發現牛頓(Isaac Newton, 1643~1727)的《操作順序》(Operationum Ordo)。這是一本關於煉金術的手稿,撰寫於1690年代,顯示這位科學巨擘少為人知的一面。經濟學家凱因斯(John Keynes, 1883~1946)於1942年檢視這些筆記後曾感嘆:「牛頓不是理性時代的第一人,而是最後一位魔法師。」隨著學術研究的深入,我們逐漸認識,牛頓的煉金實驗其實是一種極其理性的思維模式,對今日資通訊工程具有相當啟示。牛頓的煉金研究並非出於迷信,而是建立在嚴謹的實驗設計與系統性紀錄之上。他仔細記載每個步驟,精確衡量材料比例,並反覆驗證結果。這種系統性思維,與他在物理與數學領域的研究一脈相承。對於現代資通訊工程師而言,這是設計與分析複雜系統不可或缺的基礎。當今工程師在規劃網路架構或開發通訊協定時,須掌握各模組間的互動關係,正如牛頓觀察物質間反應時所展現的細膩與縝密。軟體工程的模組化設計、版本控制、持續整合等實務,也發揮類似的理性精神。牛頓在《操作順序》中對每一實驗環節的細緻紀錄,與現代資通訊工程師在除錯與系統優化時所需的紀律與洞察相映成趣。牛頓的獨特之處,在於他能穿越知識領域的邊界,將數學、物理、光學乃至煉金術相互融通。這樣的跨域能力,是當代資通訊工程發展的核心精神。人工智慧結合神經科學與統計學,物聯網融合硬體設計與人機介面,6G技術更須整合射頻工程與通訊協定。牛頓追求「物質轉化」的精神,如今亦實踐於工程師努力將不同知識轉化為創新的解決方案。牛頓在面對外界對煉金術的質疑下,仍投入大量時間與心力研究,表現出不畏探索未知的勇氣與毅力。這種挑戰常規、堅持探索的態度,是科技創新的驅動力。從人工智慧到量子通訊的發展,皆源於對現有技術架構的突破。牛頓對實驗的執著提醒我們:真正的創新,來自時間的累積與反覆試驗。《操作順序》的另一重要價值,在於其對知識管理的示範意義。牛頓詳實記錄每次實驗,包括觀察結果與失敗嘗試,建構出一套完整的知識積累機制。對現代工程團隊而言,良好的知識管理系統如Git、Confluence等,是協作與技術傳承的基礎;技術文件撰寫與註解,也是工程實踐中不可或缺的一環。凱因斯將牛頓形容為「魔法師」,是讚賞牛頓在理性分析與直覺洞察之間取得的平衡。煉金術雖披神祕色彩,牛頓的操作方式卻極為理性。這種理性與直覺並行的能力,在現代工程中同樣重要。優秀的工程師不僅需掌握科學方法,亦須具備技術直覺與創新思維。深度學習架構設計、系統調校與效能優化,往往來自工程師的直覺引導,隨後再以實驗驗證。正如牛頓的實驗精神最終孕育出科學革命,今日的技術革新,也同樣根植於理性思維與實驗勇氣的結合。
日本JR南武線的昔日風華
因為所服務的公司,在日本東京神奈川縣的川崎市設立一研究所,因此這一年來每個月都會出差到日本一趟。由川崎到立川的JR南武線,就是我必搭的鐵道。不論一天中的哪一個時段,南武線的人潮總是熙熙攘攘絡繹不絕,有次在上班尖峰期,我在南武線的平交道上,兩邊的電車你來我往地,足足就等了十多分鐘,平交道的閘門才打開。有回我跟一位東京工業大學的教授(東工大因為併了醫學院,改名為東京科學大學)聊到這個現象,他跟我說南武線過往是日本半導體的重要聚落。我才想起在二十多年前,曾經拜訪過NEC半導體事業的總部,就是在南武線上。的確,後來查了資料,不僅是NEC,富士通(Fujitsu)、東芝(Toshiba)也都在南武線上設立半導體研發及生產的基地。昔日日本半導體的五強,就剩下三菱(Mitsubishi)及日立(Hitachi)沒在南武線上設廠。再加上其他的科技類產業,難怪南武線被當地政府稱為High Tech Line。就連1950年代末期,Sony研究員江崎玲於奈(Leo Esaki)博士發現半導體的量子穿隧效應(tunneling effect)的研究室,坐落於東京的品川地區,離南武線也沒多遠的距離。江崎博士因為這個發現而得到1973年諾貝爾物理獎,諾貝爾委員會稱其的發現與發明為第一個量子電子元件。眾所周知全球第一個使用電晶體的收音機是出自於Sony,Sony在1953年取得貝爾實驗室(Bell Lab)電晶體的授權,1955年就推出這款電晶體收音機。當時電晶體使用的是鍺(Ge)元素的半導體,而不是現在大家所熟悉的矽(Si)半導體。然而開發的初期為了增加電晶體的訊號放大能力,通常都會增加雜質參雜的濃度,而導致電晶體的良率不佳,江崎博士授命解決這個問題。他的發現是來自於不良品的特異現象,並且用量子力學來解釋這個現象,之後並利用這個現象設計出隧道二極體(Tunnel diode)或稱為Esaki diode(江崎二極體)的電子元件,應用於相關電子電路的產品開發。相信絕大部分的人在產線上作不良品的分析,很少會仔細地探討其異於平常的特性,而從中得到巨大的發現。話題回到南武線上,日本半導體的五強在全盛時期,曾佔DRAM市場的80%。曾經市佔第一的英特爾(Intel),被迫於1985放棄DRAM市場,轉進到CPU領域。我曾在1987年參加IEDM的年會,在DRAM的論文報告中清一色全是日本公司在主導。日本半導體產業由極勝而衰,美國在政策上的掣肘發生極大的作用。美國絕不願意看到盟國,有一個重要且強大產業發生,威脅到其生存。因此大家所熟知的廣場協議、進出口稅及的配額、反傾銷、反托拉斯等多項顢頇措施就應運而生,最後就是扶植南韓成為日本半導體的競爭對手,這些林林總總現在也不就正發生在我們的身上。當然日本在產業發展的過程中,錯失PC及數位時代的來臨,也是半導體產業由盛而衰的重要因數。JR南武線的人潮依然熙熙攘攘,只不過由先前的半導體從業人員,轉換為大都會區的上班族及通勤的學生。依舊的電車,依舊的鐵道,看盡日本半導體產業的滄桑史。
南韓半導體政策制定 (二)
南韓的科技政策,譬如前述的兩個階段的半導體政策,或者前一陣子內容更廣泛的K-登月式計畫(K-Moonshot),雖然是分別由貿易、工業和能源部(MOTIE)、總統辦公室(Presidential Office)與科學與資訊通訊部(MSICT)撰寫,但都享有一些共同通的特點。 這些政策在其目標領域中涵蓋完整、條理清楚,是明顯產業內資深人士的手筆。 這並不難理解。譬如南韓DRAM的開創者陳大濟在三星退下後曾經擔任南韓資訊通訊部(MIC)長官,而NAND Flash的先驅黃昌圭在自三星電子(Samsung Electronics)退下後曾在南韓政府擔任知識經濟部(Ministry of Knowledge Economy)國家R&D戰略企劃團長(President of the Office of Strategic R&D Planning),這正是國家研發政策的頭。在這樣的管理層安排下,做出來的計畫自然比其他國家通常由政務、常務文官或學者撰寫的政策能更精確掌握產業現況。 但是南韓的政策也存在一些明顯短板,第一個是前瞻性不足。 用甫發布三大計畫與於2021年發布的K-Semiconductor Strategy來比較,AI部分的增益是顯而易見的。一個問題是為什麼2021年的政策沒有包括進AI? 南韓在AI半導體的有些次領域其實是全世界的領先者,譬如SK海力士(SK Hynix)與超微(AMD)在2009年就開始共同研發高頻寬記憶體(HBM),且在2010年向JEDEC提議制定標準。 當時整個產業和市場環境是2017年Google發表大語言模型基礎機制transformer,人工智慧的深度神經網路(Deep Neural Network;DNN)取代過去的模型;雲端業者廣泛部署卷積神經網路(Convolutional Neural Network;CNN),GPU已成人工智慧訓練的主要工具等。隨即在2018年中OpenAI公開GPT(Generative Pre-trained Transformer),生成式應用明顯啟動。 南韓政府有明確感知到AI的發展趨勢,於2017年成立第四次工業革命委員會(Presidential Committee on the Fourth Industrial Revolution),將AI列為國家戰略技術之一,之後2018年的AI研發戰略(AI R&D Strategy)補強了研發、人才和資料建設。2019年的AI國家策戰略(National Strategy for AI)則完成一個完整的國家戰略,目標是在2030年前成為世界AI強國。 即使AI被清楚的認知為戰略目標,但在2021年發布的K-Semiconductor Strategy中,AI並未被未在計劃中被綑綁進來。AI與半導體綑綁的重要性可以由2026年的Three Mega Projects的修訂中可以自證。 這個疏失是由於沒有預見到AI可能會成為半導體產業主要市場驅動力的結果,而可能原因是南韓半導體產業高度集中於記憶體,與其他環節科技業者的接觸面向比較受限,相信這也是K-Semiconductor Strategy的目標形成背景之一。 同樣的侷限也發生在三大計畫中。儘管已經將半導體、AI資料中心與具身AI綑綁在同一計畫之中,但是沒有將量子計算整合進來。 對於未來的高效能計算會是AI與量子計算的混合此一發展方向,業界意見並無分歧;有些量子計算公司已經預期在2028年—已經是計畫期間內的可見未來—推出通用容錯量子計算機(general fault-tolerant quantum computer)。目前整個AI產業的上下游都在準備此混合計算(hybrid computing)的架構。 南韓當然也有單獨的量子計算計畫,譬如2023年的國家量子策略(National Quantum Strategy),但是未能將量子計算併入三大計畫之中,很有可能錯失此波AI發展中搭其AI生態鏈連結及資本市場動能便車的機會。 另外的闕漏是戰略目標與經濟體制的深層沒有精準的對齊。南韓的經濟體制—雖然經過80、90年代的整改—仍然是財閥主導的市場經濟(chaebol-led market economy)。這種經濟體制在某些領域有顯著的優勢,譬如在垂直整合、品牌、成長速度、規模經濟等,這些都是眾所周知的事實。但是財閥經濟體制也有弱點,譬如南韓有些產業目前面臨的困境就是因為新進入產業的其他國家資本,以數倍乃至十數倍的體量在規模經濟此一面向上的輾壓所致。在半導體發展的領域,特別是以生態系的角度來討論,財閥經濟與水平分工在很多方面是彼此相扞格的。但是在先後兩個半導體戰略中,主要的資源提供以及戰略執行上,卻都集中在財閥手中。 因為經濟體制形成目前南韓半導體產業的長短板,卻還要寄望依相同體制去發展其所缺失的部分,在邏輯上很難說得通透。在戰略目標的制定以及經濟體制兩個層面需要有更深度的思考,以及更細緻的協作。
Digital AI vs. Physical AI:同一套成長邏輯,兩條路徑
2026年5月東京人形機器人高峰會上,一家國際顧問公司的合夥人展示一張實體AI(Physical AI)的全球勞動自動化市場潛力圖。回來後,我把同一家機構的智庫報告中關於數位AI(Digital AI)的職能分類,重劃成一張對應圖。2張圖最有意思的地方,不是整體潛在市場(TAM)規模相近,而是說的是同一件事:自動化總是先從「結構化」場域開始。過去2年,AI帶動的運算與供應鏈經濟規模快速成長,動力主要來自Digital AI:推論模型的token消耗、推論經濟的成形,加上AI代理(AI Agent)的興起。那麼,Digital AI的演進時程,也會是Physical AI的路徑嗎?先看第一張圖。Digital AI的市場版圖,核心原則清楚:任務愈規則化、資料愈密集,自動化愈快發生。以職能分類,差距顯著:財務、法律、行政領域有55%至65%的工作屬於高度可自動化範疇;軟體、研發、STEM領域約40%至50%;醫療、教育、管理領域則只有15%至25%。合約審閱、財務對帳、法遵查核,有明確的輸入輸出與可學習的歷史資料,數位代理人活在「已被結構化」的資訊環境裡。反觀主治醫師的臨床決策或管理者的組織判斷,牽涉情緒脈絡與權責,超出當前代理人的處理能力。Digital AI的邊界,是「非結構化判斷」的邊界。Physical AI的市場版圖,則以地理維度切分:以製造業高度密集的南韓、德國為代表,實體勞動中有65%至75%屬於高度結構化任務,涵蓋工廠產線、倉儲物流、重複性組裝;日本、中國、美國等混合型經濟體,這個比例約為40%至55%;以印度為代表、服務業與非正式勞動佔比偏高的經濟體,則只有10%至20%。這個地理切分,邏輯與Digital AI相同,只是「環境」從資訊空間換成實體空間:工廠的產線是被高度設計過的實體環境——固定的作業台、可預期的物件、重複的動作序列——對機器人來說是相對友善的場域。零售服務、建築工地、居家照護,面對動態、不可預測的實體情境,機器人的自主能力仍非常有限。2個版圖的邊界因此高度對稱:一邊是「非結構化判斷」,一邊是「非結構化實體環境」。換句話說:Digital AI把資訊世界結構化、智慧化,Physical AI再把實體世界結構化、行動化。2條路徑的不同,先出現在時程上。Digital AI已進入擴散期:本專欄〈推論經濟學〉與〈Token帳單之後〉追蹤過這個變化,推論成本已從每百萬token 30美元跌至1美元以下,但帳單不減反增,總用量的成長速度遠超單價下滑。市場研究機構預測,2026年底約40%的企業應用將整合任務型AI代理,從2025年不到5%的基礎一年內大幅跳升,是臨界點後的快速擴散。Physical AI這一邊,需求走在技術前面:製造與物流現場的缺工是剛性需求,4兆美元的潛在市場逐漸成形,但機器人在現場能穩定做到的仍然有限。2026年5月東京的人形機器人高峰會與6月維也納的ICRA,反覆出現的觀察是:當前被稱為「成功」的機器人部署案例,幾乎都是透過縮窄問題範疇來達成自主性,而不是真正解決泛化能力的問題。觸覺、Sim-to-Real、長時序規劃與世界模型的差距,本系列前幾篇已分別說明。這個需求與能力的落差,不代表方向錯了,而是時程不同:Digital AI的問題是「該在哪裡找到成長曲線」;Physical AI的問題是「該在哪裡確認成功案例」。這條時間差,有一條能力曲線可以量化比較。模型評估機構METR(Model Evaluation & Threat Research)的Time Horizon追蹤計畫,以「人類完成同一任務所需時間」衡量各世代模型能以50%成功率自主完成的任務複雜度。從2019年GPT-2只能處理約1至2秒的簡單任務,到2026年的新一代模型,可完成的軟體類任務時長已達16小時等級,依其估算約每7個月翻倍。以8小時(一個標準工作天)為參考線,近期模型已陸續越過,意味著數位代理人有機會從「加速執行」走向「獨立接手整天的工作」。這條指數曲線,目前只存在於數位世界:機器人要在實體環境中跨越數小時穩定完成複雜任務,所需的規劃深度、容錯能力與環境適應性,還需研究突破。Physical AI的慢,不只在模型能力,也在部署方式。數位代理人的導入本質上是軟體問題:API串接、資料清理、流程重新設計,從決策到運行快則幾週;失敗可以修正,持續迭代。Physical AI的導入是系統整合問題:場地改造、安全認證、與既有設備的整合,時程以年計,成本以千萬計。但是高門檻反而創造黏性:一家工廠花兩年把機器人整合進產線,不會因為競爭對手推出更好的軟體就輕易替換。兩者的差距,也體現在「驗證」這個環節。數位代理人的迭代迴路是:推理、工具呼叫、執行、檢查結果、修正,整個循環在數位空間完成,失敗成本低,可即時重試,能力就在快速循環裡累積。Physical AI的迴路根本不同:機器人難以在真實場域反覆試錯,一次碰撞或抓取失誤的代價,可能是設備損壞或人員風險,驗證必須在執行之前完成,而非之後。這也是大家對世界模型在Physical AI中的期待:機器人需要先在模擬中「預演」動作結果,確認可行後才進入實體執行。在數位空間,驗證迴路天然存在;在實體空間,可能得靠世界模型解決,但是還沒收斂。因此,Physical AI的市場進入邏輯更接近「先深後廣」:先在結構化程度高的場域建立灘頭堡,累積具身資料與安全認證紀錄,再逐步向更複雜的場域擴張。具身資料難以從網路大量取得,主要來自真實部署;而獲得真實部署機會,又需要先通過安全認證與場域驗證。這個循環,讓先進入特定場域的廠商建立起難以複製的護城河,即使後進者的軟體技術更先進。Digital AI與Physical AI 2個市場都在快速成長,合計每年潛在經濟價值達數兆美元等級,涵蓋的是人類2種核心的勞動形態。Digital AI開始進入收成期,競爭格局正在集中;Physical AI仍在播種期,先行優勢可能要再過幾年才會清晰顯現。2條路徑,同一套成長邏輯:AI總是先在結構化世界立足,再從那裡逼近非結構化世界。
由修仙看人與AI的共生
技術迭代使AI深度嵌入人類工作與生活,人機關係成為無法迴避的命題。修仙小說《凡人修仙傳》中法寶與修士的敘事恰好構成一則當代寓言:AI之於人類,正如本命法寶之於修仙者,既是渡劫飛升的依仗,亦是噬主隕落的風險。主角韓立最核心的機緣是「掌天瓶」。此法寶初得時僅能催熟草藥,隨心神溫養與境界提升,影響時間法則的威能才逐步顯現。法寶之力並非恆定,而是隨使用者的認知與投入動態成長。AI工具亦然。ChatGPT與Midjourney對初用者不過是高效生成器,唯有持續使用、資料投餵與提示詞(Prompt)最佳化,才能適配個體思維,進化為獨特的外腦。正如韓立以神識駕馭劍陣,我們以提示詞調度算力,工具的價值始終取決於使用者賦予它的靈性。然而反噬向來如影隨形。修仙世界的第一重反噬在於神識消耗:韓立操控「青竹蜂雲劍」或「大衍傀儡」時需分出神識,過度使用便眩暈遲鈍。這不是法寶主動攻擊,而是對精神力極限的警示。AI時代的對應物,是認知卸載與注意力蠶食。當文案、推論乃至創意決策大量外包給AI,大腦相應功能因用進廢退而鈍化,思考耐力與批判敏銳度在便捷中靜靜流失。這種退化不致命,卻讓人逐漸淪為工具的附庸,正如過度依賴飛劍的修士,終將遺忘本身步法的精妙。更深一重的反噬,指向判斷力與價值觀的扭曲。魔道寶物慣於侵蝕心性,修煉「血魔功」者必嗜殺,執掌「噬靈杖」者必貪婪,器物的邏輯悄然重塑主人。AI時代最隱蔽的反噬,是演算法繭房(Algorithm Echo Chamber)與邏輯慣性。AI被設計成擅長迎合而非反駁,持續以偏見投餵便得到更精緻的偏見作為回報。決策者一旦依賴AI輸出策略,便被禁錮在模型訓練集的認知邊界之內。AI輸出常具邏輯閉合性與表述權威性,使用者更易在看似合理的錯誤中越陷越深。最致命的危機,非前述任何一種,而是修士將全部道途寄託於外物。韓立若未曾苦修夯實根基,即便擁有通天靈寶,遇上古禁制也寸步難行。人類面對AI同理:若將創意原點、情感判斷、價值抉擇悉數交付演算法,便退化為儀器的操作員,一旦算力斷絕,頃刻淪為無知凡人。真正的飛升不依賴某件神器,而在於歷經劫數後的自身領悟。修仙寓言還有一處值得深思:每位飛升者必須親渡「雷劫」,無人可代,無寶器能全擋。這正呼應AI時代的核心倫理困境。機器可以處理資訊,卻無法替人承擔選擇的後果。醫師以AI輔助診斷,法官以演算法參考量刑,最終的道德重量仍落在人的肩上。逃避此重,便是將「人」這個概念本身拱手讓渡。修仙者韓立證道飛升,雖借助寶物,但他始終記得一件事:法寶是渡河之筏,不是棲身之岸。關鍵時刻,他相信的是苦修所得的判斷力,而非手中的神器。面對AI,我們亦當如此。以AI增效而不以AI代思,借AI破局而不被AI定義。唯有在協作中錨定人的主體性,技術才能真正成為文明的舟楫,而非將人困住的彼岸。
南韓半導體政策制定 (一)
2026年6月底南韓李在明總統宣布AI及半導體的三大計畫(Three Mega Projects for AI and Semiconductors,以下簡稱三大計畫),目標在提升南韓至AI及半導體的領先群,執行半導體、實體AI(physical AI)以及AI資料中心(AI Data Center)的三大計畫。5年內提升DRAM產量至2倍,強化特殊半導體環節如高頻寛記憶體(HBM)、先進封裝、AI處理器、下世代記憶體,並將半導體產業擴張至首爾區域之外。 一個在半導體產業處於領先群的國家發展策原本就引人矚目,兼之內容又擴及足以改變社會各層面的AI,這無疑值得所有在高科技領域參與者和國家的深度解析。 南韓近年半導體政策可分為2個重要階段。第一階段是文在寅政府於2021年5月13日公布的K-半導體戰略(K-Semiconductor Strategy),第二階段則是李在明政府於2026年6月29日提出的Three Mega Projects for AI and Semiconductors。兩者均以維持南韓半導體競爭力為核心,但在政策範疇、產業定位及資源投入上呈現明顯的延續與擴充。文在寅政府的K-Semiconductor Strategy,是在全球晶片短缺及供應鏈重組背景下提出,實施期限以2030年為主要目標年。其核心理念是建構「K-半導體帶(K-Semiconductor Belt)」,串聯京畿道及忠清道等地的晶圓製造、記憶體、材料、設備、封裝及IC設計產業,形成完整供應鏈聚落。政策目標包括:民間投資超過510兆韓元、半導體出口提升至2,000億美元、培育3.6萬名專業人才,以及建立全球最大的半導體製造基地。政府主要扮演促進者角色,透過租稅優惠、研發補助、人才培育、土地、水電等基礎建設及行政程序簡化,引導三星(Samsung Electronics)及海力士(SK Hynix)等大型企業持續投資,而晶圓廠本身的資本支出則主要由企業負擔。5年後,李在明政府提出新的三大計畫,雖然仍以半導體為核心,但政策視野已由原先只限於傳統半導體產業,提升擴充至AI時代的國家競爭力建構。新政策包含三大支柱:半導體、實體AI及AI資料中心,並將三者視為互相支撐、共同發展的國家戰略。政策規劃興建4座新的大型晶圓廠,建立國家級先進封裝聚落,大幅擴充HBM產能力,同時發展AI晶片、小晶片(Chiplet)、先進封裝及大型AI資料中心,希望形成完整的AI半導體生態系。相較於前一階段,新政策更強調半導體與AI應用的整合,而不再僅以半導體製造能力為主要目標。在資金規模方面,2項政策也有明顯差異。文在寅政府提出的510兆韓元主要為民間企業投資承諾,政府則提供租稅優惠、基礎建設及研發支援。李在明政府則將企業投資規模進一步提升至約800兆韓元,另規劃約81兆韓元建設先進封裝聚落,以及至2035年前超過1,000兆韓元的AI資料中心投資。值得注意的是,後者雖然投資規模遠高於前者,但絕大部分仍屬三星、SK集團及其他大型企業、金融機構與民間資本的投資計畫,政府直接財政支出仍主要集中於基礎設施、研發補助、人才培育、土地取得及行政支援,而非直接興建工廠。若比較2項政策內容,李在明政府大致保留文在寅政府建立供應鏈聚落、強化材料設備、培育人才及維持記憶體優勢等主要方向,並在此基礎上增加數項新的重點。首先,政策範圍由半導體供應鏈擴展至AI、資料中心及機器人等應用產業,使半導體由單一製造業提升為AI基礎設施的一部分。其次,先進封裝的重要性大幅提升,成為與晶圓製造、HBM並列的核心發展項目。第三,政策更強調建立完整AI生態系,而非單純追求記憶體市場佔有率。此外,對AI資料中心及大型電力、網路等基礎建設的投入,也顯示政策開始由製造能力延伸至算力基礎設施。另一方面,新政策也淡化部分前一階段的內容。文在寅政府相當重視系統半導體、IC設計、生態系及中小企業培育,希望改善南韓長期偏重記憶體產業的結構;李在明政府雖仍提及AI晶片及設計能力,但整體政策重心已明顯轉向大型AI投資、HBM、先進封裝及資料中心等具有較高資本密集特性的領域,對中小企業創新、EDA(Electronic Design Automation)、IP(Intellectual Property)及新創企業的著墨相對較少。整體而言,李在明政府的新政策並非推翻文在寅政府的K-Semiconductor Strategy,而是在其建立的供應鏈架構上進一步擴充,將政策重心由「半導體製造強國」提升為「AI與半導體整合強國」。兩者具有高度延續性,但也反映出南韓政府政策焦點已由供應鏈安全與製造能力,逐漸轉向AI時代的新一輪國際科技競爭。
Physical AI:從產業競爭走向國家競爭
2026年5月底東京Humanoids Summit,原本以技術與商業化為主軸的峰會,今年也為政府代表與政策觀察者保留講台。一家美系機器人大廠的政策副總裁在會中直言:「政府不介入已經不行了。」理由包括:AI政策與機器人政策開始交疊、自主系統的軍民兩用性質讓機器人進入國安視野。技術一旦被劃入國安範疇,政策資源往往隨之增加,無人機與5G都走過這條路,接下來可能輪到機器人。這不只是一位企業高階主管的觀察。截至2026年,已有十餘個國家或地區提出具官方背書的機器人或智慧機器國家發展架構,從日本、南韓、新加坡、印度,到德國、法國、荷蘭、中國與澳洲。架構的核心要素已逐漸成形:從人才訓練、研究資金、安全標準,到供應鏈韌性、國安與貿易政策;後三項關聯地緣政治。這些路徑大致可以收斂成4種模式:1. 美國是產業先行、政府補位的產業主導型;2. 中國是全政府動員、由上而下推進的國家動員型;3. 歐盟是以法規架構定義可信任生態系的法規治理型;4. 日本與南韓則同屬政府與產業緊密配合的協同生態型,但做法不同:日本靠政府主導的共用資料平台,南韓靠政策延續與大企業投資。美國的邏輯一貫:產業夠強,政府通常不急於介入。從晶片運算、電動車跨足機器人的科技大廠,到人形機器人新創與頂尖AI研究實驗室,實體AI(Physical AI)生態系的資本、模型與平台能量仍高度集中在美國。美國國會2025年起開始相關討論,目前推進較快的是對中國機器人的限制措施;聯邦層級、以機器人產業為核心的國家機器人戰略,尚未成形。日本曾長期位居全球工業機器人密度第一,但依IFR修正後的計算基準,2025年已滑落到第四,類似的反思在東京峰會多次出現:硬體優勢不再夠用,政策重心轉向資料與基礎模型的競爭。日本經濟產業省(METI)近年整合高效能運算(HPC)基礎設施與新設的具身智慧(embodied AI)旗艦計畫,讓企業共用機器人資料與模型;2026年3月發布的新版AI機器人戰略,目標2040年在全球AI機器人市場取得30%以上市佔率,期望重新站回與中美並列的位置。南韓是最早把機器人提升到國家法律層級的國家:2008年的智慧型機器人開發與普及促進法奠定基礎,十餘年政策延續性累積出生態系厚度。2026年六月底,南韓進一步把Physical AI與半導體、AI資料中心並列為三大國家旗艦計畫,由總統府直接督導,目標2028年讓10個產業別的人形機器人進入商用,並開發自主的機器人基礎模型。南韓模式裡,資本仍來自民間,但政府的主導性明顯增強。中國的機器人政策以2015年「中國製造2025」為分水嶺,機器人列入十大重點產業;2026年的第十五個五年規劃首次把具身智慧與量子技術、腦機介面、6G並列為頂層新興產業方向。同年2月,工信部轄下的標準化委員會發布人形機器人與具身智慧標準體系,並明列國際標準化目標:先立標準、再定市場門檻,過去用在5G,如今延伸到機器人。地方政府競相設基金、建園區,形成外界稱「全政府推進」的格局,但商業化仍待驗證:出貨多流向研究、教育與展示市場,製造現場仍以試點居多;規劃文件強調供應鏈自主化,反映精密減速器等核心零組件仍仰賴日德業者。歐盟AI Act於2024年8月生效,但2026年6月定案的簡化方案,把機器人安全元件等高風險應用的合規時程延後到2028年。2025年公布的AI Continent Action Plan擴建歐洲AI運算基礎設施;同年推出的Apply AI策略把機器人列為戰略產業之一。德國、法國、荷蘭各自執行國家機器人戰略,中央法規加成員國執行的雙層架構,即使時程放緩,寄望的仍是「布魯塞爾效應」:當AI法規成為進入全球市場的門檻,歐盟的監管架構就有機會成為實質的全球標準。真正的競爭在標準,不在速度。4種模式之上,還有一張全球分工圖,東京會場的版本是:矽谷負責模型與資本,日本負責精密製造,南韓負責量產可靠性,中國負責硬體速度。台灣近期推出「智慧機器人產業推動方案」,規劃4年投入百億元、設立國家智慧機器人研究中心,以服務型機器人切入醫療照護與餐飲等缺工場域,也在試著標出自己在這張分工圖上的位置。訓練資料的問題,在機器人領域格外值得關注:相較於大型語言模型,機器人可用的訓練資料少了2到3個數量級;彌補這個差距的方式之一,是讓機器人在真實作業環境中「持續學習」,邊部署邊累積場域資料、持續更新模型。台灣的製造與服務場域,恰好提供這個機制所需的條件。Physical AI最終競爭的,未必只是誰能造出最多機器人,而是誰能建立讓機器人持續、安全、可驗證地進入真實場域的產業條件。
智慧應用 影音