近日,Meta公司发布了名为“Make-A-Scene”的新型图像生成AI。该技术虽借鉴了经典DALL-E模型,但扎克伯格团队已为其注入了全新的创新元素。
Meta新AI的灵感与定位
Meta一贯善于从新兴技术中汲取灵感并加以超越。尽管DALL-E凭借文本生成艺术的能力广受欢迎,但Meta研究人员致力于开发一款更普惠的工具,让缺乏专业绘画技能的用户也能创作作品,从而丰富元宇宙的沉浸式体验,Make-A-Scene应运而生。
值得注意的是,与追求逼真的DALL-E 2不同,Make-A-Scene生成的图像更具手绘艺术感。Meta旨在通过这种独特的视觉风格帮助创作者脱颖而出,并以一种前所未有的方式推动数字艺术的民主化,降低艺术创作门槛。
Make-A-Scene的核心特性
相比传统DALL-E仅支持文本输入,Make-A-Scene允许用户通过草图精准控制场景构图。用户可在界面中指定各元素的位置与大小,草图将作为最终成像的关键指引。同时,系统也保留了纯文本生成设计的功能。
该模型特别强化了对动物、物体等关键图像特征的学习能力,输出图像分辨率高达2048×2048像素。目前,Make-A-Scene仍处于封闭测试阶段,仅限受邀用户体验,尚未对外开放。

