7月17日,2026世界人工智能大會(WAIC 2026)在上海世博展覽館盛大啟幕。酷哇科技(COOWA)在上海國投展區驚艷亮相,展台現場,由酷哇全棧自研的 COOWAM 雙層智能體世界模型驅動的機械臂,流暢完成了長程複雜操作——「夏日特調」飲品製作演示;同時,面向城市複雜場景研發的首款重載型四足機器狗X0也完成了其線下首秀。
同期舉行的「解碼世界」發展創新分論壇上,酷哇科技創始人、 CTO廖文龍博士發表了題為《世界模型:物理世界 Agent 的技術底座》的主題演講。他在會上向業界披露了行業首個雙層智能體世界模型架構——COOWAM(Co-Optimized World Action Model),並以此為基礎勾勒出由統一模型驅動的「RoboCity(機械人城市)」終極願景。
從技術實演、新品亮相到解密底層模型架構,深耕城市場景的酷哇科技,正以世界模型為底座,推動城市具身智能從單體作業走向多智能體協同,加速讓智能成為新的生產力。

酷哇科技創始人兼 CTO 廖文龍博士在論壇中闡述了自研雙層智能體世界模型 COOWAM (Co-Optimized World Action Model)架構的設計邏輯
01擰瓶蓋、切西瓜、製作特調——COOWAM世界模型的「實戰場」
在展台現場,由 COOWAM 世界模型驅動的機械臂全天候持續「上崗」,為現場觀眾製作「夏日特調」——將西瓜切塊榨汁,擰開瓶蓋、再按照一定配比加入檸檬片、倒入蘇打水,整套動作完全自主,流暢自然。
該任務涉及多機械臂協同以及對接觸力、流體等物理規律的處理。在光照、水杯位置等環境因素動態變化的條件下,機械臂需要進行實時預測與修正。與依賴預設程序在固定環境中重複特定動作的傳統機械人不同,基於 COOWAM 的機械人在理解任務目標的基礎上,能夠根據實時環境反饋進行推演、決策與行動,完成非固定流程的複雜任務。
該演示驗證了 COOWAM 作為通用底座,支撐不同機械人形態適應多類物理交互任務的技術可行性,為具身智能設備在城市公共服務與物流配送等場景的落地提供技術支撐。
02四足作業平台X0亮相——打造城市場景服務「全能標桿」
展台的另一側,基於酷哇「Aether 以太」重載型四足平台打造的X0機器狗線下亮相。
高達68kg的重載能力與全地形自適應行走能力,讓X0能夠輕鬆突破傳統輪式設備的平面作業限制,將作業範圍延伸至樓梯、斜坡、碎石路面、花壇周邊等立體複雜空間。
對X0而言,能走、能負重只是基礎,「全能」的價值在於深入城市毛細血管,實現「一機多用」。憑藉高度模塊化的設計,X0可快速更換上裝模塊,無縫適配市政環衛、末端配送、安防巡檢等多樣化任務。目前,X0已完成多場景驗證並步入真機部署階段,應用於城市精細化運維場景。
03重構「城市具身智能」技術底座——披露行業首個雙層智能體世界模型架構
7月18日,酷哇科技創始人兼CTO廖文龍博士在論壇演講中闡述了自研雙層智能體世界模型COOWAM (Co-Optimized World Action Model)架構的設計邏輯。他指出,Physical Agent面對的是兩個同時存在且彼此耦合的世界:遵循物理規律的自然世界和遵循社會規則的人類世界。
廖文龍認為,機械人要實現應用價值,至少需要具備三種能力:理解自然規律(如重力、摩擦、慣性);在行動前推演不同動作選擇帶來的結果;認知人類社會規則與行業SOP(標準作業程序)。
「機械人真正需要的世界模型,並不是單一的物理世界模型,而是物理世界模型與人類社會世界模型的統一。」廖文龍表示 「只有同時理解這兩個世界,Physical Agent才能真正走出實驗室,進入真實社會,並持續創造生產力價值。」
基於此,酷哇研發了COOWAM雙層智能體世界模型:
CooWAIM(交互式世界動作模型):負責處理物理規律。該模型聚焦0-4秒短時未來窗口,在機械人產生動作時,同步推演環境變化並修正當前動作,形成「動作 — 未來推演 — 動作修正」的決策閉環。
Urban VLM(人類社會世界模型):基於城市服務數據構建,負責理解任務語義、行業SOP和生產力價值導向。
在Urban VLM內部,酷哇構建了PVM(生產力價值模塊),用於評估物理策略是否符合任務目標,使機械人實現在理解、推理、預測、執行和反饋中的持續自主決策。
模型架構之外,廖文龍還提到一個關鍵問題,世界模型如何變得更強?酷哇的答案是:通過與真實世界的持續交互,讓模型在數據閉環中不斷自我進化。機械人每一次執行任務,都是一次對世界模型的驗證。它看到什麼、採取什麼動作、環境如何變化、結果是否符合目標,這些反饋會不斷反哺模型。
依託全球範圍內超過50個城市及地區的常態化運營,酷哇目前已建立了「真實世界交互 — 數據沉澱 — 模型學習 — 能力提升」的商業數據飛輪,通過規模化真機部署持續優化世界模型性能。

酷哇眼中的未來圖景
04從單體智能到互聯協同——邁向「Robocity」未來之城
2026年,具身智能正在跨越拐點,從單純的技術探索,逐漸走向規模化應用。
在酷哇的戰略藍圖中,單個Physical Agent或商業場景的成熟僅僅是一個開端。當我們真正實現了「一腦多態」,讓同一套COOWAM統一底座,去驅動形態各異的輪式機械人、無人小巴、機器狗和人形機械人時,我們的目標就已經不再是造好一台自動化的設備,而是要去重構未來城市的運行方式。
這就是酷哇眼中的未來圖景——一個由統一模型驅動的「RoboCity(機械人城市)」
在未來的RoboCity願景中,機械人將告別執行固定任務的孤立狀態,進化為具備自主決策能力、持續創造價值的 Physical Agent(具身智能體)網絡。基於共享的「物理-社會」統一世界模型,它們將打破信息孤島,構建起真正默契的城市級協同生態。
為實現這一圖景,酷哇規劃了一條「從圍牆外走向圍牆內」的清晰演進路徑:
第一階段(單體智能): 深耕垂直領域。在城市出行、市政環衛及物業服務等場景,率先完成單一設備的智能化落地。
第二階段(多機協同): 拓展複合場景。以統一世界模型為驅動,在園區、社區及工業等場景中,實現不同形態智能體的高效協同作業。
第三階段(全面泛化): 邁向家庭場景。攻克複雜操作與高泛化能力的壁壘,讓具身智能真正走進千家萬戶。
這也是酷哇持續探索 World Model 的終極目標:讓機械人真正進入真實社會,把智能編織進城市的每一根毛細血管,讓 Physical Agent 成為驅動未來 RoboCity 的新型底層生產力。(記者 楊凌雲)
頂圖:酷哇科技(COOWA)亮相2026世界人工智能大會,其全棧自研COOWAM 雙層智能體世界模型驅動的機械臂「夏日特調」飲品製作非常吸睛