陳乃誠 · 大乃老師

2026-06-03 · AI 工具與工作流

Gemini Omni 影片模型:多數人只用了一成的 5 大隱藏用法

改真實影片、用箭頭指揮鏡頭、多語翻譯、自己查資料做 explainer、文字黏在 3D 空間——Omni 五個多數人沒在用的強項,附可偷 prompt。

你手上的 Gemini 影片功能,可能只開了一成

資料來源:Paul J Lipsky〈5 Mind Blowing Omni Use Cases〉

我花了 13 分鐘看完這支國外的 Omni 教學影片,心情有點複雜。

複雜在於——我以前用 Gemini 生影片,只拿來讓數位分身講兩句話、做點搞笑短片。作者一句話打醒我:「如果你只拿它玩 avatar,你只用了它一成的能力。」

那另外九成是什麼?我整理成五個多數人沒在用的強項。

一、它會「改」你拍的真實影片

不是憑空生成,是你上傳一段 10 秒實拍,叫它改。

作者上傳自己一個人的海灘空景,一句「在我後面加一大群人」,沙灘瞬間塞滿人潮。更狠的是反覆迭代:先生一版,再對著那一版說「改成晴天」「鏡頭拉遠變空拍」,它接著上一版改,不是打掉重練。

二、鏡頭運動,用箭頭就能指揮

上傳一張靜態圖,在圖上畫幾個箭頭標出鏡頭要怎麼走,它就真的讓鏡頭沿著箭頭穿過樹叢、鑽過橋下,像真的空拍機。

prompt 只有一句:「鏡頭跟著參考圖裡的箭頭走,一鏡到底,把箭頭從畫面移除。」

三、同一段話,五種語言一次到位

作者要跟朋友說生日快樂,用自己的 avatar 一口氣錄了法文、西班牙文、拉丁文。

對國中現場很有畫面感——做雙語教材、給新住民家長的影片通知,門檻一下子降下來。

四、你不給資料,它自己去查

這點最震撼。你不用餵內容,只說「做一支解釋火箭怎麼飛的影片」,它自己把知識找齊、配旁白,還自動放一個講解員在右下角。

「解釋地震怎麼發生」也一樣一句話搞定。這根本是現成的課堂 explainer 產生器。

五、文字會「黏」在 3D 空間裡

上傳一段你拍的花,叫它標出花的各部位,文字會固定在立體空間中——鏡頭怎麼轉,標籤都黏在對的位置,不會飄走。

拉回教學現場

工具越來越強,真正的差距不在「會不會用」,而在「主動不主動去摸」。

柯維七習慣的第一個習慣是「主動積極」——不是等研習通知、等別人整理懶人包,而是今晚就打開 Flow,丟一段影片進去改改看。

多數人用不到那九成,不是做不到,是從來沒按下那個加號。

我的結論

AI 影片不是拿來取代誰,是把「我有畫面但不會做」的人,門檻砍掉九成。

你會的,從來不是軟體;是願不願意先動手的那一下。