如何用文字生成图片
只需三步,而真正关键的决定都在第二步。一张可用的图片和一张差点意思的图片,区别大多在于模型选择和画幅,而不是提示词的长短。
- 01
描述画面,而不是想法
写明主体、取景、光线和风格。关于氛围的形容词,远不如关于画面里有什么、光从哪里来的具体名词管用。
- 02
选择模型和画幅比例
不同模型的擅长之处差别很大——照片级写实、插画、图片内文字、忠实还原的产品外形。表单列出了每款模型支持的比例,所以请在生成之前而不是之后,选好你真正要发布的画幅。
- 03
生成、对比、优化
每次生成都会进入你的作品库,所以你可以一次发出几种写法,并排评判。在图片生成图片中编辑最好的那张,通常比从头重写提示词更快。
图片工作室比单纯的提示词输入框多了什么
切换模型无需重写
更换模型时,提示词、参考图和参数都会一并带过去,所以在两款模型上测试同一个创意只需点一下,而不用从头重建。
角色始终是同一个人
用你自己的照片保存一次角色,并在每个提示词中引用它。用文字描述一张脸,无论描述得多精确,每次生成出来的都是一张不同的脸。
用参考图,而不只是文字
附上一张参考图来指定风格、构图或产品的真实外形。这就是“要我们的包装”和直接把包装拿给它看之间的区别。
按发布规格输出
竖版、方形、4:5 和宽屏都是一等公民。你不用事后把方图裁成快拍画幅,也不会因此丢掉构图。
原地完成后期
对生成的图片进行超分、重新打光或编辑,无需导出到另一个工具,再到别处重新上传。
离动态只差一步
作品库里的任何一张图片都可以成为视频的首帧,这是从静态概念到动态画面最短的路径。
大家用文字生成什么
概念图与氛围图
为一次营销活动或一个场景做视觉探索,在正式委托制作之前先生成十几个方向。
社交媒体创意
按每个平台需要的精确比例生成帖子和快拍画面,不用在设计环节来回折腾。
背景与底板
生成用于合成产品或人物的环境,并与你现有素材的光线相匹配。
封面图
为视频制作吸睛的静态封面,以多个变体进行测试,而不是只设计一版然后听天由命。
文章配图
与品牌风格一致的文章和演示文稿配图,直接生成,而不必购买授权。
视频的首帧
有意识地先生成一张静态图,让由它延展出的视频从一开始就是正确的构图。
别人用过的起点提示词
每个模板都是一组已经验证有效的提示词和参数。打开一个,换掉主体,就能当作你自己的来运行。
给图片写提示词,和给视频写提示词是两门不同的手艺
图片模型只需要满足一帧画面,所以它会回报那些视频模型用不上的细节。镜头语言、光线方向、表面质感和配色都能落实到画面里——而同样细节堆满的视频提示词,往往会生成一个不断改变主意的片段。如果你是从写视频提示词转过来的,最有用的调整是:对画面更具体,对故事更少着墨。
负面提示词通常是症状,而不是解药。当结果总是出现你不想要的东西时,原因更多是正面描述有歧义,而不是少了排除项——“一面素净的清水混凝土墙”比一长串“背景里不要有什么”管用得多。先把正面提示词改到不再有提升,再去用负面提示词,而不是反过来。
选对模型比任何一次重写提示词都更有效。照片级写实、干净的矢量风插画、图片内清晰可读的文字、忠实还原的产品外形,是四种不同的长处,没有哪一款模型能样样领先。把同一段提示词交给两款模型各跑一次,只花几个积分就能直接回答这个问题,比再加一轮形容词快得多。
最后,把有效的东西保存下来。一段曾经产出好结果的提示词是可复用的资产,它背后的角色或参考图也是。能稳定出图的人,并不是每天早上都写出更好的提示词;而是换掉主体,重复运行一小批已经验证过的提示词。
文字生成图片常见问题
- 文字生成图片是免费的吗?
- 是的,在免费积分额度内免费。每个账号一开始都有积分,可用于图片、视频和音频生成,无需绑卡。付费套餐提供更多积分、更高分辨率和无水印导出。
- 我能得到多高的分辨率?
- 取决于模型,之后还可以用超分工具把任何结果放得更大。用于印刷或大屏展示时,先以模型的最佳尺寸生成再超分,而不是一开始就要求一个非常规的尺寸。
- 能两次生成同一个角色吗?
- 能。用参考照片保存一个角色,并在每个提示词中提到它。这是在一组图片中保持同一张脸的可靠方法。
- 模型能在图片里写字吗?
- 有些可以,大多数只能写个大概。凡是文字必须准确的内容——logo、价格、标题——先生成不带文字的图片,再到排版工具里添加。
- 图片可以商用吗?
- 可以,在付费套餐下依照服务条款使用。你仍需对提示词负责——尤其是,不得在未经本人同意的情况下生成真实人物的肖像。