視訊生成領域又迎來一次重要更新。Google DeepMind 今天正式推出 Veo 3.1,這是其視訊生成模型的第三個主要版本。相比前代,這次升級的重點非常明確:讓生成的視訊更連貫、更富有創意,同時給使用者更強的控制權。
如果你曾嘗試過AI視訊生成,大概會對「閃爍」和「變形」頭痛不已——角色臉部在幀間突變,背景物體莫名消失。Veo 3.1 試圖解決這些核心痛點。根據官方演示,新模型在 幀間一致性 上有了質的飛躍,角色和場景元素能夠穩定保持,視訊看起來更像實拍而非一堆飄忽不定的畫素。
豎屏視訊與社交媒體的崛起
一個值得注意的變化是,Veo 3.1 終於原生支援 豎屏視訊生成。這背後顯然是 TikTok、Instagram Reels、YouTube Shorts 等短格式視訊平臺的推波助瀾。過去,視訊生成模型大多預設輸出橫屏寬高比,創作者不得不手動裁剪或重新構圖,往往損失重要內容。現在,從提示詞到輸出,豎屏生成一氣呵成,大大縮短了內容生產鏈路。
對普通創作者來說,這意味著你直接用文字描述一個「咖啡館窗邊的手衝咖啡特寫,豎屏,電影感燈光」,Veo 3.1 就能輸出一條可直接釋出的豎屏短片,無需後期二次處理。
更細顆粒度的控制
除了一致性和格式,Veo 3.1 在可控性上也下了功夫。使用者現在可以通過引數微調 鏡頭運動(推拉搖移)、角色微表情 以及 光照變化。舉個例子,如果你希望鏡頭從人物面部緩慢拉遠到全景,並且光線從清晨轉為黃昏,Veo 3.1 可以在單次生成中實現這種複雜的動態變化。
Google 還強調,團隊在訓練資料中進行了更嚴格的 負樣本篩選,以減少有害內容和偏見。這在商業應用中尤為重要——品牌不希望自己的廣告視訊出現不可控的奇怪畫面。
實際影響:誰需要 Veo 3.1?
- 社交媒體內容創作者:豎屏支援 + 高一致性,意味著你可以在幾分鐘內生成一個產品演示或Vlog片段,無需拍攝團隊。
- 廣告與營銷人員:精準的鏡頭控制和場景一致性,適合製作原型視訊或A/B測試創意方案。
- 獨立電影人:快速視覺化分鏡頭指令碼,探索不同運鏡和色調的可行性。
當然,Veo 3.1 目前仍處於早期訪問階段,並非人人可用。Google 通過 Vertex AI 平臺提供 API 呼叫,這意味著它更偏向於專業使用者和開發者。對於普通使用者,或許還需要等待整合到更親民的產品中。
競爭格局與展望
視訊生成賽道已經非常擁擠:OpenAI 的 Sora、Runway Gen-3、Pika 2.0 都是強勁對手。Veo 3.1 的優勢在於 Google 的生態——與 Gemini 模型 的潛在整合、YouTube 的資料積累,以及強勁的 TPU 算力。不過,Sora 尚未公開可用,Runway 和 Pika 則早已開放給創作者。Veo 3.1 能否後來居上,還要看其開放速度和定價策略。
從技術角度看,Google 這次在 一致性 上下的功夫值得關注。如果實際效果與宣傳相符,它可能會成為第一個讓「AI視訊不閃爍」的可用方案。對任何靠視訊吃飯的人來說,這都值得關注。
總的來說,Veo 3.1 不是一次顛覆性的創新,而是一次紮實的迭代——它在最關鍵的問題上做出了改進,並且精準地切入了當前最熱門的豎屏內容需求。如果你是視訊創作者,並且能接觸到 Vertex AI,現在就應該去申請試用。市場變化很快,下一個爆款視訊或許就誕生於你的鍵盤。











評論
暫無評論
成為第一個評論的人