Google Earth推出基於Nano Banana 2的全新圖像生成功能 一鍵生成逼真AI場景與歷史風貌
重點摘要
Google Earth推出基於Nano Banana 2的全新圖像生成功能,全球網頁端用戶可在地圖上輸入指令,將真實地點重塑為逼真AI場景。此功能可應用於歷史教學、房地產規劃及趣味體驗,例如復原龐貝古城街景或模擬未來建築,現已正式上線。
Google Earth 近日正式推出全新的 AI 圖像生成功能,這項技術整合了衛星影像、航空照片與 3D 實景地圖資料,讓使用者能夠直接在網頁版地圖上,針對世界各地的真實地點進行視覺重塑。透過生成式 AI 的輔助,一般使用者不再需要專業繪圖軟體或影像編輯技能,只要在地圖上選定位置、輸入描述性指令,系統就能產出與實際地形深度契合的擬真圖像,為空間資訊的呈現方式開啟全新可能。 這項功能的核心,是 Google 旗下代號 Nano Banana 2 的 AI 圖像生成模型。與過去單純以文字生成圖片的工具不同,Nano Banana 2 在 Google Earth 的應用場景中,會先讀取目標區域的真實地理數據,包括建築物輪廓、地貌起伏與街道格局,再根據使用者的描述生成視覺內容。換句話說,AI 並非憑空繪製一張風景畫,而是在既有的地景基礎上進行改造與延伸,這使得產出的圖像具備高度真實感與空間一致性。 實際操作上,使用者只需在網頁版 Google Earth 中逐步放大到想探索的區域,找到目標地點後點擊「建立影像」(Create image)按鈕,並輸入想要呈現的場景描述,系統便會即時運算並生成對應畫面。無論是將現代城市街區改造成復古風貌,或是為空曠地帶設計虛擬建築,都能在短時間內獲得視覺化成果。此一流程大幅降低了 3D 建模與概念設計的進入門檻,也讓地圖不再只是平面導航工具,而是具備創造力的視覺平台。 在教育應用方面,這項功能為歷史教學帶來極具潛力的變革。過去學生學習古代文明時,只能依賴文字敘述與靜態圖片想像歷史場景;如今教師可以帶領學生觀察世界遺產地點,並輸入諸如「重現西元 78 年龐貝古城的繁華街景」這類指令,系統便能將眼前的廢墟遺跡,一鍵還原為充滿羅馬帝國時代氛圍的立體景象。這種沉浸式的視覺體驗,有助於學生更具體地理解歷史事件發生的空間脈絡。 更進一步的是,該功能結合了 Gemini 模型的底層檢索能力,使系統不再只是生成美觀的圖片,還能在處理地標建築時,同步產出包含關鍵歷史資訊的直觀圖表。例如,當使用者選定某座古建築並要求視覺化呈現時,AI 可以額外整理出與該建築相關的歷史因果脈絡,以視覺化資訊圖的方式輔助說明。這項整合讓教學素材的準備更加快速,也讓抽象知識與具體空間產生連結。 除了教育領域,房地產開發與城市規劃也能從中受益。在傳統流程中,開發團隊要向客戶傳達設計構想,往往需要委託設計師繪製模擬圖,或製作實體模型,過程耗時且成本高昂。如今規劃者可以在 Google Earth 上直接選定實際基地,例如東京某塊閒置空地,輸入將該地改造為複合式商業設施的願景描述,系統便能在原有地貌上即時渲染出具備高精緻度的 3D 設計效果。 這項能力對於地貌條件的評估特別有價值。以湖畔木屋為例,使用者可以指定建築座落於山坡與水岸之間,AI 會根據該地真實的等高線與水域分佈,生成符合自然環境的建築樣貌,讓團隊在動工之前,就能更直觀地檢視建物與周邊地形的融合程度。如此一來,前期溝通與方案評估的效率將大幅提升,也減少因視覺認知落差而導致的設計反覆修改。 對一般大眾而言,這項功能同時提供了打破現實框架的趣味體驗。使用者可以將熟悉的場景轉化為完全不同的視覺風格,例如把 Google 山景城園區一瞬間變成充滿賽博龐克風格的科幻都市,親眼感受想像中的未來世界。這種創作模式賦予地圖更多娛樂性與個人化色彩,也讓地理探索從單純的資訊查詢,延伸為具有故事性的視覺旅程。 目前,這項影像生成功能已正式向全球網頁版 Google Earth 使用者開放,無須額外安裝軟體,只要透過瀏覽器即可使用。從教育、都市規劃到大眾娛樂,這項技術正在重新定義地圖的角色,使地理空間資訊不再只是靜態的記錄,而是可以互動、可以重塑、可以幻想的動態介面。隨著生成式 AI 持續演進,未來這類空間視覺化工具的應用範圍,勢必還會更加廣泛。
Related
相關文章
阿里發佈語音識別新模型,醫療詞彙"聽中率"破 95%,曾拿全球最低錯字率
阿里巴巴發布語音識別大模型 Qwen-Audio-3.0-ASR-Flash,主打精準辨識專業詞彙,醫療場景「聽中率」突破 95.36%,並曾以 1.7% 錯字率拿下全球第一。模型提供三個版本,涵蓋實時語音、離線轉寫等場景,已透過阿里雲百鍊平台開放使用。
Claude“闖出”測試環境?Anthropic承認AI模型曾入侵三家機構系統
AI資訊AI新閒資訊正文Claude“闖出”測試環境?Anthropic承認AI模型曾入侵三家機構系統發布於AI新閒資訊時間 :Jul 31, 2026閱讀 :1分鐘Anthropic發佈最新安全報告披露,在內部安全測試過程中,旗下Claude系列模型曾因測試環境配置問題意外訪問互聯網,並未經授權進入三家不同機構的生產系統。事件涉及Claude Opus4.
字節跳動 Seedance 2.5 發佈:30 秒一鏡到底,AI 視頻開始會講故事了
字節跳動正式推出 Seedance 2.5 影片生成模型,單次生成時長從 15 秒翻倍至 30 秒,並能多輪延長且維持人物、場景與風格一致。該模型強化長敘事與多模態參考能力,支援單次輸入最多 30 張圖片、10 段影片與 10 段音頻,可同時還原多人形象與聲音。Seedance 2.5 將陸續上線即夢 AI 與豆包專業版,API 也將接入火山方舟,鎖定影視、廣告、教育等多元場景。
阿里千問發佈Qwen-Audio-3.0-ASR-Flash,語音識別攻克專業場景"最後一公里"
阿里通義千問發布語音識別大模型Qwen-Audio-3.0-ASR-Flash,主打長音頻上下文記憶與內建多行業詞庫,醫療、IT等專業術語無需配置即可精準識別。該模型支援30餘種語言,並整合語音潤色功能,已在阿里雲百鍊平台開放調用。同步推出的Streaming版本鎖定即時場景,延遲僅300毫秒,系列先前於評測拿下全球第一。
PolyAI Releases Dialog-RSN-1: An Audio-Native Dialog Model That Fuses Turn-Taking, Speech Recognition, Function Calling, And Response
PolyAI has introduced Dialog-RSN-1, a dialog model that perceives the caller’s audio directly instead of reading a transcript.
200個任務、1700萬幀!大曉ACE-Data-0把真實家庭場景變成物理智能「數據引擎」
近日,基於全球首創的具身模型信息密度定律與以人為中心的環境式數據採集方案2.0,並依託環境式採集引擎ACE,大曉機器人聯合南洋理工大學 S-Lab 重磅開源 L5 級多模態具身物理智能數據集 ACE-Data-0。