在线精品视频小说1_亚洲精品不卡在线_亚洲欧洲视频在线_日韩电影中文字幕av


 

物理AI在等待屬于它的架構(gòu) 焦點播報
發(fā)布時間:2026-06-11 14:02:56 文章來源:證券之星財經(jīng)

你隨便打開手機上的大模型,問它一個問題:“把一只玻璃杯推到桌子邊緣,會發(fā)生什么?”

它會毫不猶豫地告訴你:杯子會掉下去,然后摔碎。


(資料圖片僅供參考)

聽起來很聰明。但真相是,它根本不知道杯子為什么往下掉。它只是在訓練數(shù)據(jù)里見過太多次“杯子”“掉落”“破碎”這幾個詞扎堆出現(xiàn),然后根據(jù)概率統(tǒng)計,給出了最像正確答案的那句話。

文本世界里,這種“聰明的猜測”游刃有余。可一旦我們試圖把AI塞進一臺需要端盤子、疊衣服、走樓梯的機器人,麻煩就來了。

過去幾年,CNN和Transformer稱得上是人工智能領(lǐng)域最耀眼的兩個名字。一個統(tǒng)治了計算機視覺,一個把語言模型推到了前所未有的高度。但當聚光燈從屏幕轉(zhuǎn)向現(xiàn)實世界,當AI必須離開數(shù)字沙盤、踏入物理環(huán)境與人真實交互時,一個越來越尖銳的問題浮出水面:這兩種我們無比依賴的架構(gòu),是不是從根本上就不適合干物理AI這檔子事?

只會認皮相的眼睛

先說CNN。

這套機制的設計初衷是模擬人的視覺系統(tǒng),用一堆可學習的濾波器去掃描圖像,提取邊緣、紋理、形狀,然后層層抽象直到完成識別。在ImageNet上它打敗了人類,在很多視覺任務上幾乎成了默認方案。

但問題恰恰出在它的設計哲學上——CNN本質(zhì)上是在學習“像素與標簽之間的統(tǒng)計關(guān)聯(lián)”,而不是在理解“物體由什么構(gòu)成”。

來看一個簡單的例子。一個小孩看到一輛被幾棵盆栽擋住一半的汽車,即便從沒見過這種遮擋方式,也能毫不費力判斷那是一輛車。因為他的腦子有一個“車由輪子、車身、車窗組成”的認知框架,某個部件被擋住,他用其他線索照樣補全。可標準的CNN沒這個本事。它的判斷基于整體像素模式,一旦遮擋方式稍微變化——比如擋的不是車身而是車燈——那些精心訓練的卷積核就亂了陣腳。

研究表明,傳統(tǒng)黑箱式深度CNN在處理部分遮擋時表現(xiàn)極不穩(wěn)定,直到研究者引入“物體部件組合”的結(jié)構(gòu)化方法,才顯著提升了對遮擋物體的識別魯棒性。換句話說,你得額外給它加料,它才勉強學會了人類天生就懂的事情。

把這個問題放到物理AI的場景里,更要命。機器人走在路上,眼前隨時出現(xiàn)堆疊的箱子、交錯的管道、半開的門——全是動態(tài)的、部分遮擋的真實場景。如果它只能依賴CNN輸出的像素特征做決策,而缺乏對物體構(gòu)成的內(nèi)在理解,稍微轉(zhuǎn)個身、光線變一下,原本“認識”的東西就認不出來了。

還有更頭疼的:CNN對紋理有一種近乎偏執(zhí)的依賴。它更傾向于根據(jù)表面紋理分類,而不是根據(jù)物體形狀。就像一個人判斷貓不看耳朵、瞳孔和胡須,只看毛色——毛色像貓的動物全算貓,換個毛色就翻臉不認。這種偏執(zhí),在變幻莫測的物理世界里,是致命的。

只背答案的考生

如果說CNN的盲區(qū)在于“看見了卻不懂”,那Transformer的問題更深刻——它壓根不是為了理解因果而設計的。

Transformer的核心武器是自注意力機制,能一次性捕捉序列中任意兩個位置之間的依賴關(guān)系。這在語言模型里簡直是神器——一個詞能和幾千字外的另一個詞建立關(guān)聯(lián),對理解語義、生成連貫文本至關(guān)重要。但請注意,“注意力”算出來的只是統(tǒng)計相關(guān)性。訓練數(shù)據(jù)里,“打雷”和“下雨”常常一起出現(xiàn),所以它們之間的注意力權(quán)重很高。但模型并不知道,是打雷導致了下雨,還是兩者背后另有原因。

說穿了,Transformer是個頂級的“開普勒”——能描述現(xiàn)象、總結(jié)規(guī)律,卻永遠成不了“牛頓”。它背下了答案,卻沒學懂公式。

物理AI不需要這種死記硬背的好學生。一臺在工廠里搬運零件的機器人,必須理解力學的基本規(guī)則:推一個箱子,箱子的移動速度和方向取決于推力大小、摩擦系數(shù)、箱子質(zhì)量。如果模型沒有內(nèi)化這些物理因果,只是根據(jù)視覺輸入與動作輸出的統(tǒng)計關(guān)聯(lián)做決策,那一旦地板從干燥變濕滑,或者零件材質(zhì)從金屬換成塑料——整套策略就全盤崩塌。

有研究者一針見血地指出,當前的具身大模型本質(zhì)上是“記憶軌跡”而非“理解邏輯”。圖靈獎得主姚期智也直言:如今具身智能最大的技術(shù)瓶頸之一,就是它們只會不斷模仿人的行為,卻缺乏可解釋的世界模型和物理因果推理過程。從“模仿”走向“推理”,這道門檻,Transformer的底層邏輯——預測下一個token——根本跨不過去。

數(shù)據(jù)的荒漠,能耗的黑洞

就算暫時把架構(gòu)層面的根本局限放在一邊,光看工程現(xiàn)實,CNN和Transformer在物理AI上也已經(jīng)步履蹣跚了。

數(shù)據(jù)就是第一個繞不過去的坎。大語言模型之所以能成,是因為互聯(lián)網(wǎng)本身就是一座取之不盡的數(shù)據(jù)礦山——維基百科、新聞、論壇、論文、代碼庫,全是現(xiàn)成的、經(jīng)過標注的文本數(shù)據(jù)。但物理AI呢?機器人需要的數(shù)據(jù)來自真實世界中的每一次交互:每一次抓取、每一步行走、每一下推拉。每一幀數(shù)據(jù)背后都是真實的物理動作和對應的多模態(tài)傳感反饋。

這樣的數(shù)據(jù)極難大規(guī)模采集。一臺遙操作采集設備,單條高質(zhì)量數(shù)據(jù)的成本折合高達3到5元,而全行業(yè)匯聚的高質(zhì)量具身數(shù)據(jù)僅約50萬小時,不足大語言模型訓練數(shù)據(jù)的數(shù)萬分之一。一個具備通用泛化能力的具身模型,至少需要千萬小時級別的數(shù)據(jù)支撐。缺口擺在這里,誰都看得到問題的嚴重性。

數(shù)據(jù)問題即使解決了,算力成本也不容樂觀。Transformer的注意力機制有一個廣為人知的軟肋:計算復雜度與序列長度的平方成正比。在語言模型里,這O(n2)的復雜度已經(jīng)夠讓人頭疼了;但在物理AI場景里,傳感器流是連續(xù)、高頻、多模態(tài)的——視覺、觸覺、慣性測量單元、關(guān)節(jié)角度——數(shù)據(jù)源源不斷涌入。如果在機器人本體上跑一個參數(shù)量幾十億的Transformer來處理這么多維度的時序數(shù)據(jù),功耗和延遲都會飆到不可接受的水平。

有研究指出,全局注意力機制下每個token都要和所有其他token計算,而CNN里最基本的相鄰關(guān)系,在Transformer里卻需要大量冗余運算。用一句話說:你花了大價錢買了張貴得離譜的入場券,換來的是拖泥帶水的決策速度。

需要新地圖

說CNN和Transformer不適用于物理AI,不是說它們在物理AI中完全沒有用武之地。CNN可以拿來做感知端的多模態(tài)特征提取,Transformer可以用來做高層任務規(guī)劃和語義理解。問題是,不能把一個本來設計來處理離散序列或靜態(tài)圖像的架構(gòu),硬塞給它“理解物理世界因果律”這種完全不匹配的期望。

物理AI需要的是能內(nèi)嵌物理規(guī)律的模型——它應該天然懂得連續(xù)性、守恒律和因果鏈,而不是靠海量數(shù)據(jù)硬生生去擬合出這些規(guī)律的表面特征。它需要高效的時序推理能力,能在有限計算資源下完成實時閉環(huán)控制。它需要從“模仿人的動作”升級為“理解物理的邏輯”,先想清楚再動手。

劍橋大學一位控制理論學者打過一個讓人深思的比方:用Transformer去學習物理規(guī)律,就像用鋼琴彈一首小提琴奏鳴曲——聲音可能接近,但弓弦之間那種復雜的物理耦合,是你永遠彈不出來的。

眼下,物理AI的賽道才剛起跑。真正需要的東西,不是把CNN和Transformer往機器人里硬塞,而是敢于質(zhì)疑主流范式的勇氣。畢竟,物理世界不會因為你的模型參數(shù)夠多、注意力頭夠密,就放棄它對因果律的堅持。

在一條用概率統(tǒng)計撐起來的數(shù)字長廊里,你永遠找不到牛頓的蘋果。

(文章來源:公眾號退一步看看)

熱門推薦HOT

最近更新

猜你喜歡LOVE

Copyright @ 2001-2023 www.sjttj.com All Rights Reserved 商業(yè)時報網(wǎng) 版權(quán)所有 關(guān)于我們

網(wǎng)站信息內(nèi)容, 均為相關(guān)單位具有著作權(quán),未經(jīng)書面授權(quán),轉(zhuǎn)載注明出處
未經(jīng)商業(yè)時報網(wǎng)書面授權(quán),請勿建立鏡像,轉(zhuǎn)載請注明來源,違者依法必究

皖I(lǐng)CP備2022009963號-4
聯(lián)系郵箱:311 3831 582@qq.com

關(guān)于我們 | 聯(lián)系方式 | 供稿服務 | 版權(quán)聲明 | 友情鏈接 | 合作伙伴 |

主站蜘蛛池模板: 欧美日韩一道本| 国产精品久久久久久久7电影| 日本高清久久天堂| 日韩aⅴ视频一区二区三区| 国产精品美女www爽爽爽视频| 国语精品免费视频| 欧美极品欧美精品欧美视频| 国产成人av一区二区三区| 久久中文字幕一区| 国产精品一区二区不卡视频| 国产美女精品免费电影| 国产精品久久久一区| 日韩视频永久免费观看| 国产精品极品尤物在线观看| 在线一区亚洲V| 国产欧美精品在线| 久久露脸国产精品| 国产一区二区在线免费| 高清国产一区| 精品国产欧美成人夜夜嗨| 日本精品久久久久中文字幕| 亚洲国产欧美不卡在线观看| 超碰97国产在线| 国产成人精品av在线| 免费观看亚洲视频| 国产亚洲综合视频| 久久久久五月天| 不卡av在线网站| 91成人免费观看| 久久视频在线免费观看| 在线免费一区| 欧美极品第一页| 国产精品久久久久av福利动漫| 日本高清久久一区二区三区| 日韩欧美视频一区二区三区四区| 国产在线精品成人一区二区三区| 国产精品99久久久久久久| 国产日韩精品电影| 亚洲高清视频一区| 久久人人爽人人爽人人片av高请| 日韩一区视频在线|