新闻
Meta全新自研图像模型来了!不用反复调提示词,首次引入Agent自动改图
1 分钟阅读
来源:zhidx.com
智东西 编译 | 茄子 编辑 | 程茜 智东西7月9日消息,7月7日Meta正式发布首款由超级智能实验室(Meta Superintelligence Labs,MSL)研发的多模态生成模型——Muse Image。Meta同时亮相了视频生成模型Muse Video,并展示了其生成的视频。不过,该模型目前仍处于测试阶段,尚未正式开放。 Muse Image是Meta将Agent(智能体)能力引入图像生成领域一次探索。不同于传统AI绘图工具根据提示词直接生成图片,Muse Image更像一个AI智能体,不仅能够生成、编辑图片,还会根据任务需要自主搜索信息、调用代码工具,并不断优化生成的结果。 Meta放出了许多由Muse Image和Muse Video生成的图片和视频,包括在活动的人物、动物与人物同框的画面以及人物与食物、风景等元素结合的复杂场景。 下图均为Muse Image生成的图像,涵盖戴墨镜的人物吃汉堡、人物与动物共处一桌,以及人物与石柱、蓝天白云等风景的融合场景。 ▲Muse Image生成的人物及动物和风景图像(图源:Meta) 下图是Muse Video生成的人物在厨房倒水的视频片段。 ▲Muse Video生成的人物视频(图源:Meta) 据外媒TechCrunch报道,Muse Image此前内部代号为“Mango”,属于Meta正在打造的Muse系列AI模型。Meta超级智能实验室负责人Alexandr Wang称,Muse Image具备Agentic能力,能够与Muse Spark大语言模型协同工作,能在生成图片前完成推理、搜索和规划能力。 ▲Alexa