前言 目前,大多数 AI 图像编辑工具都依赖 纯文本 Prompt 来描述需要修改的内容以及具体的修改方式。 然而,当图像编辑任务变得更加复杂时,编写 Prompt 很快就会变得繁琐。更重要的是,有时候仅靠文本很难准确指出图像中需要编辑的具体位置。 例如,假设我想对下面这张图片进行多项修改: 让模特拿着一个指定的物品 将她的鞋子颜色改为红色 将她的服装替换为指定的衣服 将背景环境修改为咖啡厅 使用传统的纯文本方式,我可能需要编写这样的 Prompt: 让模特举起手并拿着 Image 1 中的咖啡杯,将她的鞋子改为红色,将她的服装替换为 Image 2 中的服装,并将背景修改为咖啡厅。 标注 & 评论编辑 我通过一种新的交互方式简化了这一流程。 用户不再需要编写很长的 Prompt ,只需要 直接在图片上放置标记点,并在对应的输入框中简要描述希望进行的修改 。 这样,就可以通过视觉标注准确告诉模型 在哪里 进行修改,同时使用简短的文本指令说明 要修改什么 。 实现方法与实际测试 1. 选择图像编辑...