全Gemini 生成嘅MV,我都係第一次。
有興趣想玩嘅跟我完整教學🫶
話說果日旅行返到香港已經係半夜,雖然話想瞓到自然醒係奢望,
但點都估唔到會比呢個原因打亂咗節奏🫠
Biiru 大早爆門入嚟叫醒我,竟然係為咗問包餅乾過期未🙄… 氣頂呀大佬!即刻要作首歌洩洩憤😤
雖然唔係專業MV,但夠玩夠過癮,最方便係唔洗錢,一個Gemini 搞掂哂!
以下係我生成MV 嘅完整流程,整個過程用Gemini 不同功能分開生成再集合而成,
所以如果你只係想生成一首歌,或者一段影片,絕對可以獨立取用個別流程。
Gemini 免費版每日可以生成10段分別30秒嘅音樂,但好難將10段連貫,如果好想一氣呵成生成完整一首歌嘅話,付費版plus 都足以夠用,最長可生成3分鐘歌曲。
💡 參考 Prompt:
【你是一位熱愛韓國K-Pop元素歌曲的製作人,你需要根據以下內容生成中文國語歌詞。你擅長製作 2026年韓國kpop 歌風和節奏,而你對韓國K-Pop防彈少年團的歌曲風格十分熟悉。現在我給你一段呀媽睡不飽的故事,你將內容濃縮成歌曲為2分半鐘的歌詞並要可放在歌內(最好有押韻和意思深厚一些),歌曲想要用普通話唱出來。而我負責提供內容和情感,你要寫出歌詞,感覺和格式,歌曲風格要參考韓國防彈少年團新專輯AIRANG 的歌。 主要故事內容:媽媽同小朋友去完旅行好攰,回港後第二天早上好想睡晚一點,但兩兄弟早早就起床,媽媽叫他們出廳自己玩,但兒子竟然突然間衝入房叫醒媽媽,媽媽以為有什麼突發事,原來是入來問餅乾到期未。 情緒起伏:累,無奈,嬲怒、搞笑】
極快就生成出第一首歌詞,你可以提供歌手及歌曲作為參考,但Google 比較謹慎,提及人名好大機會因侵權問題拒絕你,所以你提供人名時註明「將人名轉為專業音樂語言代表該歌手風格」,亦可將你心愛團隊或曲風交比Gemini 叫佢整理出語速切換、哲學隱喻與歇斯底里的情感爆發等等細節。

由於step 1 生成歌詞時已包括段落及歌曲風格,所以將整份歌詞貼上就OK,
完成咗嘅歌曲,想配埋畫面做個MV 就要繼續睇落去。

強烈建議以動物作為第一次,因為普通動物及昆蟲係咪都一樣,出錯率極低。如果你想特別少少,可以生成辨識度比較高嘅特徵。
💡 動物參考 Prompt:
【生成一張角色參考圖。要求:需要生成三視圖、乾淨背景、清晰五官、真實比例、適合後續AI 影片一致性。 角色描述: 一隻青草綠色的螳螂,大慨一隻男人食指長度。為角色身上創建易於辨識的生活痕跡,不論正、側、背都必須一致。 角色神態:高傲、冷、眼神尖銳 風格:真實高像數拍攝 】
人物嘅話我未做到完全同真人一樣樣,所以加入特徵好重要。另外,AI 經常出現特徵混亂,尤其是當你嘅影片出現多角色時,之後我會再講點樣落prompt 減少衣個甩漏情況。
預備一張清晰嘅正面半身圖,如果有全新就更好,然後上載到Gemini。如果想生成人貌角色圖最好用垂直9:16 ,AI會比較清晰睇到人樣細節冇咁易混淆或變樣。
💡 人物四視圖參考 Prompt:
【生成一張角色參考圖。 要求:100%採用原圖樣貌生成四視圖、乾淨背景、清晰五官、真實比例、真實樣貌、分別是前面正面左側、右側、背面,適合後續AI 影片一致性,不要生成左右同一側。 角色描述: 一個4歲男孩,身高為96cm。 角色神態: 愛露牙笑 風格: 真實高像數拍攝 衣著:帶黑色眼鏡、穿可愛淺黃色卡通睡衣】
*gen 到滿意就下載相片備用
Google flow 每個單鏡頭係4-8秒,免費版total 30秒就夠用,如果好似我整段3分鐘,就需要額外加入延長鏡頭,衣部份之後先會再講。)
💡 人物故事參考 Prompt:
【你是一位具有20年經驗的專業導演,你需要幫我寫一個適合在Google flow 生成影片的文字版story board,故事大鋼: 主題是講述媽媽陪小朋友去完旅行很累,回港後第二天早上好想睡晚一點,但兩兄弟早早就起床,媽媽叫他們出廳自己玩,但兒子竟然突然間衝入房叫醒媽媽,媽媽以為有什麼突發事,原來是入來問餅乾到期沒有。影片片長約2分半鐘,需要五格分鏡。 請用表格輸出,每一格包括:場景編號、畫面內容、角色動作、鏡頭語言、情緒。 情緒起伏:累,無奈,嬲怒、搞笑】
💡 動物故事參考 Prompt:
【你是一位具有20年經驗的專業導演,你需要幫我寫一個適合影片生成的文字版story board,主題是講述一隻螳螂的一天生活。影片片長約半分鐘,需要四格分鏡。 請用表格輸出,每一格包括:場景編號、畫面內容、角色動作、鏡頭語言、情緒。】
生成嘅storyboard 格式分明,雖然我嘅大綱好簡單,但佢都生成咗「甦醒 ➔ 潛伏 ➔ 捕食 ➔ 歸途」。然後你可以再話俾佢聽,你想點樣增加或者減少佢生成嘅內容。 例如:【以下是場鏡內容更改,請以我補充資料作基礎,然後重新生成storyboard: 場景編號03 改為螳螂被1隻男人的手捉起放入了透明膠袋。其他內容你可根據我更改的場鏡延伸創作】。

由於之前生成嘅storyboard 係為生成影片而設,提示詞會涉及運境,所以去到衣一個部份就要將提示詞稍為改一下。 為免你自己混亂,喺Gemini 開一個新對話,逐個情景storyboard 完整copy & paste 註明【生成靜態圖像指令】,不過為咗減少出錯及增加準確度,我習慣落prompt 落得仔細d,所以我會引用原句並加多少少【把以下用於google flow 影片的指令修改成適合google flow 生圖的文字指令,不能有運鏡變化 】。
然後將指令貼上Google flow 對話框,揀選「圖像」「Nano Banana 」「x1」。
另外,注意你想要嘅影片係橫向定垂直,做情景圖時已經要決定好。
⚠️ 落prompt 同時要注意: 將提示詞內所有提及角色嘅字眼都輸入 @,再喺角色欄揀返你設定嘅角色。
💡 參考 Prompt 1 (簡單俐落版):
【電影級寫實劇照,35mm膠片拍攝,帶有自然膠片顆粒感。中景構圖,簡潔乾淨而且明亮的主臥套房放著旅行歸來後雜亂的行李箱。強烈的白色陽光透過半開的白色窗簾照進來。地板上散落著打開的行李箱和衣服。前景焦點:疲憊的 @媽媽(已上傳並改好名嘅角色)縮在厚重的純棉被窩裡,躺在闊大的雙人床上、背對鏡頭,呈現深沉睡姿。背景焦點:木門微微打開一條縫,帶著眼鏡的弟弟 @Soju(已上傳並改好名嘅角色)從狹窄的門縫中露出一半臉,帶著好奇的眼神向內張望。高度細緻的材質紋理,自然光影,淺景深,8K畫質。】
*Google flow 最高支援為4K,提示詞內輸入8K 係用黎要求畫面精細度
💡 參考 Prompt 2 (分區域精準版):
【整體場景:高清、真實的角色和明亮主臥室套房電影劇照。 [區域一:背景門口(唯一)] 房門被推開,站在門口的是一個特定的小男孩 @Soju(特徵必須精確引用其黃色睡衣參考圖,包括黑框圓眼鏡)。此區域嚴禁出現任何成人女性或第二個媽媽。 [區域二:中景焦點:床上] @媽媽 坐在床上,上半身彈起,表情失神慌張,手捂頭,穿著已上載的角色圖:駝色睡衣。床上不應有其他人。 [區域三:中景焦點:床邊] 站在床邊前景的是一個特定的小男孩 @Biiru 拿著一袋餅乾,特徵必須精確引用其藍色睡衣參考圖),面向 @媽媽 大聲喊叫,嘴巴張大。 嚴禁生成重複的媽媽角色、嚴禁背景門口出現女性、嚴禁前景的小孩看起來像女孩、嚴禁角色特徵混淆、嚴禁睡衣圖案錯誤。】
參考 prompt 1 & 2 係兩個唔同層次嘅提示詞,最大分別係角色數量,prompt 1 簡單俐落好快就gen 到滿意嘅場境,但prompt 2 我頭尾試咗8次先成功,所以用AI 其實唔懶得,試錯太多落prompt 越落越詳細,最後要分區域先令AI 頭腦清晰多D。
✨ 溫馨提示:

黎到最後一部份,所有情景已經滿意 ready,以下落黎繼續用 Google flow。
用返第一個情景比你對比,影片需要落嘅指令相對簡潔,當然你prompt 越仔細,就會生成越接近你想要嘅嘢:
💡【電影級寫實畫面。旅行歸來後雜亂的主臥室。 @媽媽 縮在被窩裡沉沉大睡。戴眼鏡的4歲小男孩 @Soju 從狹窄的門縫中靜靜看著,眼神充滿好奇。】
享受過程🫶 期待你嘅成品~