
赛博版「言出法随」迎来全新突破。昨日,谷歌将最新图像生成模型 Nano Banana 2 正式集成至 Google Earth 网页版。

然而,因生成效果过于逼真引发专家强烈反对,该功能上线不到一天即被谷歌紧急撤回。在加强安全防护措施后,新功能再次发布。
Nano Banana 2 新玩法:重塑地理视觉体验
用户无需借助 Photoshop 或其他 AI 工具,只需在 Google Earth 中点击右上角的"Create image"按钮,即可基于当前视角生成定制化图像。

时光倒流:重现历史场景
该功能让历史教学从文字阅读转向视觉沉浸。教师可输入指令如“生成公元 78 年庞贝古城原貌”,系统即刻将现代遗迹还原为繁华的古罗马街景,帮助学生直观感知两千年前的世界。
虚拟导游:定制化信息图解
用户无需离开地球界面即可获取深度信息。例如输入“创建自由女神像信息图并标注关键史实”,后台 Gemini 将检索数据,Nano Banana 则在数秒内生成包含建造年份、材料等事实的可视化图表。
城市规划:专业级方案预览
建筑师与规划师可通过自然语言指令直接呈现设计方案。如“将东京某空地改造为含公共空间的商业区”,系统会将荒芜地块渲染为高质量的 3D 城市绿洲,助力客户预判项目效果。
建筑预览:未来家园可视化
针对个人建房需求,用户可放大任意空地并输入“添加一座可持续材料的现代湖畔小屋”,系统将生成照片级效果图,确保新建筑完美融入真实地形环境。
创意改造:畅想未来都市
除了实用场景,用户亦可发挥想象。输入“将谷歌园区改造为拥有发光步道和飞行交通舱的科幻乌托邦”,整个区域瞬间变身赛博朋克风格的未来都市。
玩家实测:从惊叹到反思
科技媒体编辑 David Gewirt 测试后发现,该功能虽趣味十足但存在局限。他将美国独立纪念馆提示为"500 年后的末日废墟”,昔日殿堂瞬间变为断壁残垣。

随后,他进一步要求“让费城新年游行被僵尸、邪恶小丑和外星机甲占领”,并在后续指令中调整为“愉快氛围”,生成了极具戏剧张力的未来节日场景。


尽管实验效果惊艳,David 指出这目前仍非可靠的专业工具。主要缺陷在于新功能暂不支持“街景视角”(Street View),且生成的图像缺乏空间几何严谨性,被部分专业人士戏称为精致的"AI 泔水”(AI Slop)。
目前,因滥用风险,谷歌已紧急撤回该功能进行安全升级。
技术解密:从“无中生有”到“地理空间约束”
与传统 AI 绘图仅靠概率拼凑像素不同,集成于 Google Earth 的 Nano Banana 2 引入了“地理空间约束”(Geospatial Grounding)机制。
物理底图的实时锚定
模型输入并非普通图片,而是包含“卫星原图 +3D 高程网格 + 相机参数”的复合矩阵。生成过程严格遵循三大原则:
- 地形不可篡改:山峦、湖泊及建筑基座必须符合真实地理坐标与比例。
- 透视精准契合:新增元素需无缝嵌套进三维地形,杜绝悬浮感。
- 主体高度一致:支持多主体渲染,确保视角切换时视觉逻辑不崩塌。
这种基于真实地理条件的生成方式,使得单张图像渲染耗时约两分钟。
世界知识库的检索增强
Nano Banana 2 背后连接着谷歌庞大的搜索与地理知识库。当用户请求复原历史或标注地标时,模型会自动检索文化背景与地理常识,填充建造年份、材料尺寸等准确信息。但需注意,AI 生成的信息图虽显专业,其事实准确性仍需人工核实。
高保真细节与文本渲染
模型支持 2K 至 4K 高清输出,具备强大的文字渲染能力,可直接在地标上生成排版清晰、无乱码的科普信息图。操作流程上,谷歌实现了极致简化:支持前后对比查看、通过"Refine image"迭代优化,并可一键保存为永久标记点(Placemark),保留相机视角供他人访问。

战略意义:谷歌 Gemini 的差异化突围
在 OpenAI GPT-image-2、Midjourney 等竞品混战之际,谷歌选择了截然不同的路径。

谷歌的核心护城河并非单纯算法,而是二十年积累的专有空间数据集——覆盖全球的卫星影像、航拍照片及 3D 地形模型。将 Nano Banana 2 嫁接于此,创造了基于真实经纬度、海拔和物理视角的 AI 可视化新品类。
正如凯文·凯利预言的“镜像世界”,谷歌正通过 Nano Banana 2 为物理世界覆盖一层“可被提示词改写的数字皮肤”。这场竞争已从单纯的“画得好看”升级为“改造地球”,而后者正是其他厂商难以企及的领域。
参考资料:
编辑:大卫

