AI文字生成视频
写下你想看到的画面,拿回来的就是视频素材。不需要摄像机、不需要素材库、不需要时间线——只要一段提示词、一个模型,以及你要发布的画幅比例。
- 从提示词到成片
- 每个镜头自选模型
- 可复用的角色
- 竖版、方形和宽屏
如何把文字变成视频
大部分工作由提示词完成。这三步就是完整的流程,而画质差异通常来自第二步。
- 01
写一个镜头,而不是一个故事
描述一个连续的镜头:主体、它在做什么、镜头运动、光线和风格。描述一连串事件的提示词,得到的片段会试图把每件事都做一遍,结果每件都做不好。
- 02
选择模型和输出规格
选一款长处与镜头相匹配的模型——动作、人脸或风格化——然后设置时长和画幅比例。表单只提供该模型支持的组合。
- 03
生成、查看、迭代
生成在后台运行,所以你可以为同一个提示词排队多个变体,在作品库里并排比较,而不用一个一个地等。
什么让一次文字生成视频真正可用
内置提示词指导
编辑器会显示该模型自己的提示词长度上限,并标出模型经常忽略的提示词部分,让你在花积分之前就发现问题,而不是花完之后。
角色保持一致
在提示词中引用一个已保存的角色,每个片段中都会出现同一张脸。这就是一组互不相干的镜头与一个读起来浑然一体的系列内容之间的区别。
切换模型无需重写
更换模型时,提示词、参考图和参数都会一并带过去,所以用同一个创意对比两款模型只需点一下,而不用从头重建。
排队多个变体
生成不会阻塞页面。为同一个镜头提交三种写法,继续工作,等结果出来后放在一起评判。
原地完成后期
超分到 2K 或 4K、重新构图为另一个画幅比例,或者把结尾早了一拍的片段延长——都不用先导出到另一个工具。
声音在同一个页面
从音频工作室添加AI生成的配音、音乐或音效,使用同一套积分和同一个作品库。
什么时候适合用文字生成视频
现实中不存在的场景
一个你拍不到的地点、一个没有任何素材的概念、一个风格化的世界——任何本来就没有东西可拍的情况。
开场钩子
短视频最开头的三秒,生成十几个变体,直到其中一个能抓住注意力。
分镜与提案
动态分镜能在任何拍摄排期或预订之前,就向客户展示一段镜头序列的意图。
空镜与插入镜头
与现有剪辑风格相匹配的补充镜头,按时间线需要的精确时长生成。
风格化讲解视频
为那些做成幻灯片或素材片段会显得平淡的概念,制作抽象或插画风格的动态画面。
广告变体
同一个信息用几种方式拍出来,让一次营销活动不用再加一天拍摄,就能测试多个创意。
别人用过的起点提示词
每个模板都是一组已经验证有效的提示词和参数。打开一个,修改提示词,就能当作你自己的来运行。
写出经得住模型考验的提示词
大多数令人失望的文字生成视频结果,都来自要求一个场景而不是一个镜头的提示词。一个只生成四到十二秒的模型无法讲述一连串事件;它能做到的,是令人信服地呈现一个连续的瞬间。只写一个主体、一个动作、一种镜头运动和一种光线条件的提示词,效果始终好于描述一部小电影的提示词。
第二个值得养成的习惯,是具体描述画面,而不是故事。“缓慢推近窗台上的一只陶瓷马克杯,清晨逆光,浅景深”给了模型一个需要解决的构图。“一个温馨的早晨场景”则什么抓手都没给它,每次生成的结果都会偏向不同方向,迭代就会变得像碰运气,而不是有方向地推进。
最后,把一致性当作准备工作的问题,而不是提示词的问题。如果同一个人、同一个产品或同一种风格必须出现在多个片段中,就把它保存一次——作为角色或参考图——然后引用它。用文字重新描述一张脸,无论描述得多仔细,每次得到的都是一张不同的脸,因为文字不是锚点,参考图才是。
文字生成视频常见问题
- 文字生成视频是免费的吗?
- 是的,在免费积分额度内免费。每个账号一开始都有积分,可用于视频、图片和音频生成,使用时无需绑卡。付费套餐提供更多积分、更高分辨率和无水印导出。
- 一次生成需要多长时间?
- 大多数任务在一到三分钟内完成,具体取决于模型、时长以及服务商的繁忙程度。生成在后台运行,所以你可以继续排队更多提示词,或者关掉页面稍后回来查看结果。
- 能在多个片段中保持同一个角色吗?
- 能。用你自己的照片保存一个角色,然后在每次生成中引用它。这是在一个系列中保持同一张脸的可靠方法——用文字描述同一个人,每次生成出来的都是另一个人。
- 可以生成多长、什么画幅比例的视频?
- 每个片段的时长一般在四到十二秒之间,并可根据模型选择 9:16、1:1、4:5 和 16:9。提交之前,表单会显示可用的组合。
- 生成结果可以商用吗?
- 可以,在付费套餐下依照服务条款使用。你仍需对写进提示词的内容负责——尤其是,不得在未经本人同意的情况下生成真实人物的肖像。