◆這一課會用到的工具
每一項都可以免費開始。如果你在操作當天發現某個工具改成付費,直接改用清單裡的其他免費工具,不需要為了作業付費。
- Grok Imagine免費額度有限
用一句話生成圖片或短影片,體驗「第一次用 AI 生影片」
- Canva(影片與圖片)免費可開始
把圖片組成短影片、加字幕與音樂;也可做簡報與社群圖
- 手機內建相簿的「回憶/影片」功能免費可開始
完全不需註冊任何 AI 服務,也能把照片+字幕+音樂變成一支短影片
- ChatGPT免費可開始
對話、文案、摘要、腳本、辦公文件、網頁草稿
- 專業 AI 影片工具(進階選擇)選用付費
長片、虛擬主播、專業配音等進階需求
1教材
先讀一遍,不用背,看得懂就好。
這一課你會做出人生第一支 AI 短影片,而且全程不花錢。先講清楚原因:影片是所有 AI 應用裡最容易讓新手把時間和免費額度燒光、卻做不出能用東西的一塊。所以我們的順序是「先看懂地圖,再動手」— 前半段把觀念弄清楚,後半段用免費工具真的生成一段畫面,讓你親眼看到它的厲害與它的破綻。
第一個要打破的誤會是:「AI 影片」不是一件事,而是五件不同的事,難度和成熟度差非常多。一、寫腳本與分鏡;二、上字幕(把說出來的話自動變成文字);三、配音(把文字唸出來,也就是文字轉語音);四、剪輯輔助(自動找出精彩片段、自動剪掉停頓與贅字);五、直接生成畫面(用一段文字長出一段影片)。前四項今天已經很好用,第五項還在很不穩定的階段。
為什麼直接生成畫面這麼難?因為影片不只是很多張圖,它多了一個維度:時間。一張圖只要「這一格好看」;一段影片要「每一格都好看,而且前後要接得起來」。人走路時腳步不能突然變成三隻、杯子不能中途換顏色、同一個人的臉在第 2 秒和第 5 秒要是同一張臉。這件事叫「連戲」,是目前最大的瓶頸。
除了連戲,直接生成畫面還有四個實際的限制:一、單次生成的長度通常很短,做長片要靠很多段拼接;二、口型對不上,特別是中文的嘴型幾乎對不準;三、畫面裡的文字招牌一樣會變成亂碼;四、可控性低 — 你很難精準指定「第 3 秒鏡頭往左搖」,往往要生很多次碰運氣,時間與額度成本都很高。
相對地,前四項為什麼好用?因為它們處理的是「文字」或「已經存在的畫面」,不需要無中生有。腳本本來就是文字,AI 最強的就是文字;字幕是把聲音轉成文字,這是一個有標準答案的任務;配音是把文字唸出來,語音技術已經很成熟;剪輯輔助是在你既有的素材裡找位置,也不需要創造新畫面。
所以對零基礎的人來說,投資報酬率最高的順序非常清楚:先做腳本,再做字幕,再做旁白稿與配音,畫面用你自己拍的、用前兩課學會的 AI 圖片,或用今天要試的 AI 生成短片段。一支用手機拍的實拍畫面 + 好腳本 + 準確字幕,效果遠勝於一支畫面很炫但東拼西湊、看不懂在講什麼的生成影片。生成畫面是配角,腳本才是主角。
最後講錢,因為這件事最容易勸退新手。這門課的原則是:你不需要先買任何訂閱、點數或 API,就能完成每一堂的作業。今天要用的生成工具都走免費入口,但你要有心理準備 — 免費額度會用完,各家的免費政策也隨時會改。所以我給你三條路,由上往下退:第一條是能生成短片段的免費 AI 工具(需要註冊,額度有限);第二條是用免費線上工具把幾張圖組成影片;第三條是用你手機相簿內建的「回憶/影片」功能。三條路都能交出作業,差別只在畫面是生成的還是你自己的。任何一條走不通,就往下一條走,不要卡在那裡。
一支能被看完的短影片,結構通常只有三段:前三秒的「鉤子」(讓人不划走的第一句話)、中間的主體(一支影片只講一件事,不要貪心)、最後的行動呼籲(你希望觀眾做什麼:留言、私訊、點連結)。這三段全部是文字工作,全部可以請 AI 幫你寫初稿再由你改。
字幕還有一個很多人低估的價值:大多數人是在沒有聲音的情況下滑影片的。沒有字幕,你的內容等於沒被聽到。所以如果你今天只能做一件事,做字幕的效益比生成任何炫目畫面都高。
最後是誠信與查證。AI 換臉、AI 合成聲音已經被用在詐騙上 — 這叫「深偽」(deepfake)。三件事請記住:不要用 AI 合成任何人(包含你自己家人)的臉或聲音去做他沒說過的話;對外發布的 AI 生成畫面要誠實標示;看到令你震驚的影片,先查來源與日期再相信。課程鐵則今天一樣成立:AI 的答案會影響決策時,一定要自己查證。
2實作示範
- 開場先說明今天的免費原則:畫面顯示三條路的清單(AI 生成短片段/圖片組影片/手機相簿回憶影片),停留 3 秒。強調:三條都不用付費,走得通哪條就走哪條。
- 打開瀏覽器,網址列輸入 chatgpt.com,逐字輸入腳本需求:「我要拍一支 30 秒的手機短影片,主題是我家巷口的早餐店。請用三段結構寫腳本:前三秒鉤子、中間只講一件事、結尾行動呼籲。用表格輸出,欄位為:秒數、畫面內容、口白台詞。」按 Enter。
- 表格出現後鏡頭停 4 秒,滑鼠依序指過三個欄位,口白:這張表就是腳本,也是等一下要生成哪些畫面的依據。
- 接著輸入:「請把這份腳本裡最適合用 AI 生成的一個畫面,寫成一句英文的影片生成提示詞,描述主體、動作、鏡頭、光線,不要有文字招牌。」按 Enter,畫面停在產出的英文提示詞上。
- 另開分頁進入 grok.com,畫面停 2 秒讓學員看清楚網址。若出現登入頁,口白說明:這個工具需要先用帳號登入,免費額度有限;如果你不想註冊,等一下的第二條路完全不需要。
- 登入後在介面中找到 Imagine(圖片/影片)功能入口,滑鼠移到該入口停 2 秒,口白說明圖片與影片兩種模式的差別。
- 把畫面 4 產出的英文提示詞貼進輸入框,選擇影片模式,按下生成。鏡頭停在等待畫面,口白提醒:生成需要時間,而且免費額度會扣一次。
- 結果出現後播放該段影片,鏡頭停 5 秒,口白帶學員一起看三件事:主體對不對、動作自不自然、有沒有出現扭曲或亂碼文字。
- 修改提示詞再生成一次:在原句尾端加上鏡頭與光線描述(例如 slow pan, warm morning light),送出後與第一次結果並排比較,口白強調:同一個主體、換一句描述,結果差很多,這就是提示詞的價值。
- 示範額度用完或無法使用時的替代路徑:切換到免費線上工具,上傳三張自己拍的照片,加入字幕與背景音樂,直接組成一支 30 秒影片,鏡頭停在時間軸畫面 3 秒。
- 再示範最後保底路徑:打開手機相簿內建的「回憶/建立影片」功能,選三張照片、套用一個樣式,直接產生一支短片,口白強調:這條路不需要任何帳號、不需要任何額度。
- 把生成或組好的畫面與前面的腳本、字幕放在一起,畫面停在完成的影片檔上,字幕壓上:「先免費做出一支,再決定要不要進階工具。」
3可直接複製的提示詞
按一下就能複製,貼到 AI 的輸入框裡直接用。
我要拍一支 60 秒的手機短影片,主題是(填入你的主題),觀眾是(填入你的觀眾)。請用三段結構寫腳本:前三秒鉤子、中間只講一件事、結尾行動呼籲。請用表格輸出,欄位為:秒數、畫面內容、口白台詞。
這支影片的前三秒鉤子太平淡。請給我五個不同版本的第一句話,每句 15 個中文字以內,風格分別是:提問式、數字式、反常識式、痛點式、故事開頭式,並各說明適合什麼觀眾。
請把上面腳本裡的口白改寫成一段可以直接照著唸的逐字稿,語氣親切自然,句子短,全部使用口語,不要出現任何括號、標題或舞台指示,總長度控制在 60 秒可唸完。
請把這段旁白拆成字幕行,每行不超過 14 個中文字,一行一個完整語意,不要在句子中間斷開,用編號依序列出。
根據這份腳本,列出我用一支手機就能拍到的畫面清單,每一項說明拍什麼、大約幾秒、直式還是橫式,總數不超過 8 項,不要包含任何需要特殊器材或後製特效的畫面。
請把這份腳本裡最適合用 AI 生成的一個畫面,寫成一句英文的影片生成提示詞,明確描述主體、動作、鏡頭運動與光線,長度一句話,畫面中不要出現任何文字或招牌。
請把上面那句英文提示詞,在不更換主體的前提下改寫成三個版本,分別強調:鏡頭緩慢橫移、清晨暖光、以及近距離特寫。三句都要控制在一句話以內。
4換我試試
在完全不付費的前提下,做出你人生第一支 AI 短影片:先用文字 AI 完成腳本、旁白與字幕,再走三條免費路其中一條把畫面做出來,最後合成一支 20 到 40 秒、可以播放的影片。
- 打開瀏覽器進入 chatgpt.com 或 gemini.google.com,用你的 email 註冊或登入(ChatGPT 不登入也能先問)。
- 貼上:「我要拍一支 30 秒的手機短影片,主題是(填入你的主題),觀眾是(填入你的觀眾)。請用三段結構寫腳本:前三秒鉤子、中間只講一件事、結尾行動呼籲。用表格輸出,欄位為:秒數、畫面內容、口白台詞。」
- 接著要旁白與字幕:「請把口白改寫成可直接朗讀的逐字稿,再拆成每行不超過 14 個中文字的字幕行,用編號列出。」把結果存到記事本。
- 請 AI 幫你寫生成提示詞:「請把這份腳本裡最適合用 AI 生成的一個畫面,寫成一句英文影片生成提示詞,描述主體、動作、鏡頭與光線,畫面中不要有任何文字招牌。」
- 第一條路:進入 grok.com,登入後找到 Imagine 功能,切到影片模式,貼上剛剛那句英文提示詞並生成。看結果,然後在提示詞尾端加上鏡頭與光線描述(例如 slow pan, warm morning light)再生成一次,比較兩次差異。
- 如果第一條路走不通(需要付費、額度用完、或你不想註冊),直接改走第二條路:用免費線上影片工具(例如 canva.com 的免費方案),上傳三到五張你自己拍的照片,加上剛剛的字幕與一段免費音樂,組成一支 30 秒影片。
- 如果第二條路也走不通,走第三條保底路:打開手機相簿內建的「回憶/建立影片」功能,選三到五張照片、套一個樣式,直接產生短片,再用手機剪輯 App 把字幕加上去。
- 把畫面與字幕合起來輸出成一個影片檔,命名為「我的第一支AI短影片_v1」,並確認可以正常播放。
- 寫下三行檢核:我走的是第幾條路、我在畫面裡看到的一個破綻是什麼、哪些畫面是 AI 生成的(要誠實標示)。
- 最後記一筆花費:確認整個過程你付了 0 元。如果任何一步被要求付款,停下來換下一條路,不要付費完成作業。
5你應該會做出什麼
- 你手上有一支真的、可以播放的短影片檔案,長度約 20 到 40 秒,而且從頭到尾沒有付過任何費用。
- 你有一份腳本表(秒數/畫面內容/口白台詞)、一段旁白逐字稿,以及每行不超過 14 個中文字的字幕行。
- 你至少實際送出過一次 AI 影片生成,並且看過它的結果 — 或是在額度不足時,成功改走圖片組影片、或手機相簿內建影片的替代路徑,同樣交出成品。
- 你做過一次「同一個主體、換一句提示詞」的比較,能具體說出兩次結果差在哪裡(例如鏡頭移動、光線、主體是否穩定)。
- 你能指出自己這支影片裡至少一個生成畫面的破綻(動作不自然、物件變形、文字亂碼),並說明為什麼那是目前技術的正常現象。
- 你清楚知道自己走的是三條路的哪一條,以及如果免費額度用完了,下一條路是什麼。
- 你在影片說明或筆記中誠實標示了哪些畫面是 AI 生成的。
6隨堂測驗
選一個答案,馬上看到解析。答錯也沒關係,解析才是重點。
一位完全沒有影片經驗的店家老闆,想在這個週末推出一支介紹自家產品的短影片。以現階段的技術成熟度來說,下列哪一個做法最務實、成功率最高?
7這一課的重點筆記
- 免費三條路(由上往下退):AI 生成短片段 → 免費工具圖片組影片 → 手機相簿回憶影片。
- 任何一步被要求付費,就換下一條路。這門課的作業不需要買訂閱、點數或 API。
- 免費額度會用完,各家免費政策也會改;換工具是正常操作,不是你做錯了。
- AI 影片=五件事:腳本、字幕、配音、剪輯輔助、生成畫面。難度與成熟度完全不同。
- 前四項現在就很好用,第五項(生成畫面)仍不穩定。
- 生成畫面難在「時間」這個維度:連戲不穩,臉會變、物件會變、動作會斷。
- 四個實際限制:單次長度短、中文口型對不準、畫面文字亂碼、鏡頭難以精準控制。
- 零基礎最佳順序:腳本 → 字幕 → 旁白配音 → 畫面用實拍或 AI 圖片。
- 短影片三段結構:前三秒鉤子、中間只講一件事、結尾行動呼籲。
- 字幕效益最高:多數人是關著聲音在滑手機,沒字幕等於沒被聽到。
- 深偽(deepfake)=AI 合成的假臉假聲,已用於詐騙;不要讓任何人說他沒說過的話。
- 對外發布 AI 生成畫面要誠實標示;看到震驚的影片先查來源與日期。
- 鐵則不變:AI 的答案會影響決策時,一定要自己查證。
這一課對你有幫助嗎?
你的回饋會直接影響我們接下來要先改哪一課。不需要留下姓名或 email。