從 “讀懂文字” 到 “理解世界”,空間智能将重塑 AI 與人類的共處方式

2025-11-14 11:46:44 來源:新華網
        【每日科技網】
從 “讀懂文字” 到 “理解世界”,空間智能将重塑 AI 與人類的共處方式

  人工智能的發展正站在從 “理解語言” 躍向 “理解世界” 的關鍵節點。2025 年 11 月 10 日,美國斯坦福大學教授、World Labs 聯合創始人李飛飛發布重磅文章《從語言到世界:空間智能是 AI 的下一個前沿》。文中,她抛出極具前瞻性的論斷:空間智能将成為 AI 亟待攀登的下一座高峰。當前以大型語言模型為核心的 AI 雖能娴熟生成文字與圖像,卻始終困在 “語言的牢籠” 中紙上談兵,缺乏對現實空間、物理規律與因果關系的深層理解。而解鎖空間智能,将讓 AI 真正像人類一樣感知、推理并行動,開啟全新發展階段。

  一、現狀之困:語言型 AI 難跨現實鴻溝

  李飛飛直言,當下以大型語言模型和圖像分類器為主導的 AI 時代已觸及發展天花闆。這類 AI 在閱讀、寫作、模式識别等領域成績斐然,但一旦對接物理世界,便暴露出諸多根本性局限。

  即便是最先進的多模态大模型,在估算距離、方向、尺寸等基礎空間任務上,表現甚至不如随機水平。它們既無法在複雜空間中規劃最優路線、辨識捷徑,也難以穩定預判 “物體下落” 這類基礎物理規律。更明顯的短闆在于動态生成領域,AI 創作的視頻往往開篇驚豔,卻會在幾秒内喪失畫面連貫性,難以符合現實世界的物理邏輯。

  這些缺陷讓 AI 難以真正賦能人類的創造性工作。無論是輔助學生拆解複雜的分子空間結構,協助建築師實時優化建築空間布局,還是幫導演、遊戲設計師搭建邏輯自洽的虛拟場景,當前的 AI 都還遠未達到實用标準,始終隔着一道難以逾越的現實鴻溝。

  二、核心突破:空間智能搭建認知與行動的橋梁

  在李飛飛眼中,空間智能絕非簡單的技術升級,而是人類認知體系的 “建構腳手架”,更是驅動想象、創造與推理的核心能力。正是憑借這種能力,人類能輕松完成停車時的車距估算、在擁擠人群中自如穿行等動作 —— 而這背後,正是想象、感知與行動的深度融合,實現了從 “知道概念” 到 “理解本質” 的關鍵跨越。

  對于 AI 而言,空間智能意味着突破語言的邊界。它能讓機器跳出 “隻識别畫面” 的淺層模式,進而理解事物間的關聯、意義與重要性。這種能力的落地,将為多個領域帶來颠覆性變革:醫療領域中,AI 可精準感知人體組織的空間結構;藝術創作中,能協助構建更具沉浸感的場景;科學探索裡,可模拟複雜的空間物理實驗。可以說,空間智能将讓 AI 從單純的工具,升級為能與人類協同探索世界的夥伴。

  三、實現路徑:以世界模型打通空間智能落地通道

  如何讓 AI 真正具備空間智能?李飛飛給出的核心方案是突破現有大型語言模型範式,構建一種能深度理解世界的 “世界模型”。這種模型不僅要解讀語義,更要能在幾何、物理和動态規則層面,連貫地 “想象” 并 “重建” 世界,實現多模态感知、場景預測與環境交互的全方位能力。

  目前,行業已形成三大研究方向:生成三維物體與場景的 3D 生成模型、模拟動态過程的物理引擎,以及通過交互學習成長的具身智能系統。但能整合這三類能力的通用世界模型,仍處于起步探索階段。

  李飛飛創立的 World Labs 正緻力于攻克這一難題。其研發的世界模型已實現關鍵突破,既能在語義與幾何層面解讀複雜 3D 場景,推理其中的物理屬性與交互邏輯,還能生成可探索的連貫虛拟空間,且所有交互行為都嚴格遵循物理與幾何規律。該團隊開發的 Marble 平台,更是将這一技術落地:創作者無需掌握專業 3D 建模技能,就能快速搭建并編輯完整虛拟世界。這一突破,标志着 AI 正從 “生成零散圖像” 穩步邁向 “構建完整世界”。

  四、未來圖景:空間智能重塑人與世界的共處模式

  “距自然界第一次在遠古動物中孕育出空間智能,已過去近五億年。如今,我們有幸成為可能賦予機器同樣能力的一代技術人。” 李飛飛在文中感慨道。空間智能不僅會改寫 AI 的功能邊界,更将重塑人類與世界的相處方式。借助世界模型,機器将徹底擺脫被動分析的角色,轉向主動規劃與自适應調整。倉庫機器人能靈活避開動态變化的庫存障礙,自動駕駛汽車可預判行人的移動軌迹提前規避風險,數字助理未來甚至能讀懂人類手勢與空間語境,實現更自然的交互。

  具體到不同領域,其變革價值更為清晰:

  創意領域:導演、遊戲設計師可自由搭建虛拟叙事空間,建築師能實時可視化建築結構與比例,普通創作者和學生也能借助虛實結合技術,在三維空間中實現創意表達;

  機器人領域:空間智能成為具身智能的核心支撐,機器人可在虛拟環境中完成高效訓練,精準理解空間關系與人類意圖,無論是實驗室裡的精密操作,還是家庭中的陪護服務,都能實現安全協作。未來,從微觀的納米醫療機器人到靈活的軟體探測機器人,都将具備精準的環境感知能力;

  科教醫療領域:AI 可模拟複雜科學實驗加速研發進程,在醫療影像診斷中精準定位病竈;課堂上,能将抽象的分子結構、遙遠的曆史場景具象化,讓學生 “沉浸式” 理解知識。

  李飛飛特别強調,空間智能的終極目标絕非取代人類,而是強化人類的專業判斷、創造力與共情力。具備空間智能的 AI,将助力人類攻克疾病難題、創新叙事形式、關懷脆弱群體,讓技術真正服務于人性。從解讀語言到理解空間,從生成文字到構建世界,AI 正告别 “紙上談兵”,邁入一個真正能讀懂現實、賦能現實的新時代。

免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
    本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.

猜你喜歡

5499元起!大疆發布全新AI超幅掃拖機器人ROMO 2系列:一口氣4款

大疆今日正式推出全新AI超幅掃拖機器人——DJIROMO2系列,包含ROMOP2和ROMOA2。該系列以“家淨,即入佳境”為理念,深度整合大疆在空間感知與智能家居領域的技術積澱,将貫穿清潔全鍊路的AI

AI 正在取代這 8 類工作,第一批受影響的人已經出現

随着生成式AI技術的快速普及,職場變革已從預言走向現實。國際勞工組織數據顯示,全球四分之一崗位面臨AI轉型沖擊,國内相關研究也表明,我國約9.6%的崗位将被AI直接替代,第一批受影響的從業者已顯現,其

4個月前

最新聲明!豆包手機助手詳解授權原則與數據保護措施

1月26日,豆包手機助手官方發文:“我們理解外界對于手機助手安全與隐私的關注。豆包手機助手嚴格遵循用戶授權與合規的原則,僅在用戶明确授權的前提下調用必要能力。此外,豆包手機助手在雲端處理用戶手機屏幕内

豆包手機

5個月前

馬化騰:騰訊唯一花錢投入比較多的就是AI

據媒體報道,在今日舉行的騰訊年會上,董事會主席馬化騰表示,2025年是“AI大年”,行業競争激烈。面對多方面業務挑戰,騰訊堅持穩紮穩打,集中資源進行戰略性投入,其中“唯一花錢投入比較多的就是AI”。為

騰訊

5個月前

三星宣布AI OLED Bot概念機器人亮相CES 2026

1月4日消息,今日,三星顯示宣布,将在2026年國際消費電子展(CES2026)上展示其新一代OLED産品。據介紹,三星顯示将在CES2026期間面向全球客戶舉辦一場私人展覽,集中展示多款OLED概念

宇樹科技完成上市輔導,A股“人形機器人第一股”臨近

從春晚舞台的“秧Bot”到資本市場的敲門聲,宇樹科技正以加速度奔向IPO。近日,中國證監會官網顯示,宇樹科技IPO上市輔導工作已正式完成。這家今年春節因機器人亮相春晚而家喻戶曉的科技企業,從7月中旬啟

2025-11-20