文字轉影片 AI
寫下你想看到的畫面,就能得到對應的影片。不需要攝影機、不需要素材庫、不需要時間軸——只要一段提示詞、一個模型,以及你要發布的畫面比例。
- 從提示詞到完成的片段
- 每個鏡頭自選模型
- 可重複使用的角色
- 直式、方形與寬螢幕
如何把文字變成影片
大部分的工作由提示詞完成。這三個步驟就是整個流程,而品質的差異通常來自第二步。
- 01
描述鏡頭,而不是故事
描述一個連續的鏡頭:主體、它正在做什麼、運鏡方式、光線與風格。描述一連串事件的提示詞,只會得到一段每件事都想做、卻每件都做不好的影片。
- 02
選擇模型與輸出規格
挑選強項與鏡頭相符的模型——動態、臉部或風格化——再設定長度與畫面比例。表單只會提供該模型支援的組合。
- 03
生成、檢視、迭代
生成在背景進行,所以你可以把同一段提示詞的多個變化版本排入佇列,在作品庫中並排比較,而不必一個一個等。
什麼讓一次文字轉影片的生成真正可用
內建提示詞指引
編輯器會顯示該模型本身的提示詞長度上限,並標出模型經常忽略的提示詞內容,讓你在花點數之前就知道,而不是事後才發現。
一致的角色
在提示詞中引用已儲存的角色,同一張臉就會出現在每段影片中。這正是一組互不相干的鏡頭,和一個看起來是同一支作品的系列之間的差別。
切換模型不必重寫
更換模型時,你的提示詞、參考圖與設定都會一併沿用,所以用同一個想法比較兩個模型只要點一下,不必從頭重建。
一次排入多個變化版本
生成不會鎖住頁面。把同一個鏡頭的三種寫法都送出,繼續工作,等結果出來再一起評估。
原地完成後製
提升到 2K 或 4K、重新構圖為其他畫面比例,或延長結束得稍早的片段——都不必先匯出到其他工具。
聲音也在同一頁
從音訊工作室加入生成的配音、音樂或音效,使用同一份點數和同一個作品庫。
什麼時候適合用文字轉影片
不存在的場景
無法實地拍攝的地點、沒有任何影像素材的概念、風格化的世界——任何本來就沒有東西可拍的情況。
開場吸睛片段
短影音最前面的三秒鐘,生成十幾個版本,直到其中一個能抓住注意力。
分鏡與提案
動態分鏡,在任何拍攝排程或預約之前,就讓客戶看懂一段內容的意圖。
B-roll 與插入鏡頭
與既有剪輯風格一致的補充鏡頭,依時間軸需要的精確長度生成。
風格化說明影片
用抽象或插畫式的動態呈現概念,避免做成投影片或素材影片時顯得平淡。
廣告變化版本
同一個訊息用多種方式呈現,讓行銷活動不必多安排一天拍攝,就能測試不只一種創意。
寫出經得起模型考驗的提示詞
多數令人失望的文字轉影片結果,都來自要求一整個場景、而不是一個鏡頭的提示詞。一個只生成四到十二秒的模型,無法敘述一連串事件;它能做到的,是令人信服地維持一個連續的瞬間。只指定單一主體、一個動作、一種運鏡方式與一種光線條件的提示詞,效果穩定優於描述一部小電影的提示詞。
第二個值得養成的習慣,是具體描述畫面,而不是故事。「緩慢推近窗台上的陶瓷馬克杯,清晨逆光,淺景深」給了模型一個要解決的構圖;「一個溫馨的早晨場景」則讓它無所依循,每次生成的結果都會往不同方向偏移,讓迭代感覺像碰運氣,而不是有方向的調整。
最後,把一致性當成設定問題,而不是提示詞問題。如果同一個人、商品或風格必須出現在不只一段影片中,就把它儲存一次——作為角色或參考圖——然後引用它。用文字重新描述一張臉,不論描述得多仔細,每次得到的都會是不同的臉,因為文字不是錨點,參考圖才是。
文字轉影片常見問題
- 文字轉影片是免費的嗎?
- 是的,在免費點數範圍內。每個帳號一開始都有點數,可用於影片、圖片與音訊生成,使用時不需綁定信用卡。付費方案會提供更多點數、更高解析度,以及無浮水印的匯出。
- 一次生成需要多久?
- 多數生成會在一到三分鐘內完成,實際時間取決於模型、長度與服務供應商的繁忙程度。生成在背景進行,所以你可以繼續排入更多提示詞,或關閉分頁之後再回來查看結果。
- 可以讓同一個角色出現在多段影片中嗎?
- 可以。用你自己的照片儲存一個角色,然後在每次生成中引用它。這是讓同一張臉貫穿整個系列的可靠方法——用文字描述同一個人,每次生成都會變成不同的人。
- 可以生成多長、什麼比例的影片?
- 每段片段的長度一般為四到十二秒,並可依模型選擇 9:16、1:1、4:5 與 16:9。送出前,表單會顯示可用的組合。
- 生成結果可以商用嗎?
- 可以,依據服務條款,在付費方案下即可。你仍需對提示詞中的內容負責——特別是不得在未經本人同意的情況下生成真實人物的肖像。