Veo 3.1: Google 視訊生成模型迎來重大升級

Veo 3.1: Google 視訊生成模型迎來重大升級

Olivia Hughes
185
original

Google DeepMind 釋出 Veo 3.1,大幅提升視訊生成的一致性、創造力和控制力。新模型支援豎屏視訊,並對鏡頭運動、角色表情等細節有了更精準的操控,為內容創作者帶來專業級工具。

視訊生成領域又迎來一次重要更新。Google DeepMind 今天正式推出 Veo 3.1,這是其視訊生成模型的第三個主要版本。相比前代,這次升級的重點非常明確:讓生成的視訊更連貫、更富有創意,同時給使用者更強的控制權。

如果你曾嘗試過AI視訊生成,大概會對「閃爍」和「變形」頭痛不已——角色臉部在幀間突變,背景物體莫名消失。Veo 3.1 試圖解決這些核心痛點。根據官方演示,新模型在 幀間一致性 上有了質的飛躍,角色和場景元素能夠穩定保持,視訊看起來更像實拍而非一堆飄忽不定的畫素。

豎屏視訊與社交媒體的崛起

一個值得注意的變化是,Veo 3.1 終於原生支援 豎屏視訊生成。這背後顯然是 TikTok、Instagram Reels、YouTube Shorts 等短格式視訊平臺的推波助瀾。過去,視訊生成模型大多預設輸出橫屏寬高比,創作者不得不手動裁剪或重新構圖,往往損失重要內容。現在,從提示詞到輸出,豎屏生成一氣呵成,大大縮短了內容生產鏈路。

對普通創作者來說,這意味著你直接用文字描述一個「咖啡館窗邊的手衝咖啡特寫,豎屏,電影感燈光」,Veo 3.1 就能輸出一條可直接釋出的豎屏短片,無需後期二次處理。

更細顆粒度的控制

除了一致性和格式,Veo 3.1 在可控性上也下了功夫。使用者現在可以通過引數微調 鏡頭運動(推拉搖移)角色微表情 以及 光照變化。舉個例子,如果你希望鏡頭從人物面部緩慢拉遠到全景,並且光線從清晨轉為黃昏,Veo 3.1 可以在單次生成中實現這種複雜的動態變化。

Google 還強調,團隊在訓練資料中進行了更嚴格的 負樣本篩選,以減少有害內容和偏見。這在商業應用中尤為重要——品牌不希望自己的廣告視訊出現不可控的奇怪畫面。

實際影響:誰需要 Veo 3.1?

  • 社交媒體內容創作者:豎屏支援 + 高一致性,意味著你可以在幾分鐘內生成一個產品演示或Vlog片段,無需拍攝團隊。
  • 廣告與營銷人員:精準的鏡頭控制和場景一致性,適合製作原型視訊或A/B測試創意方案。
  • 獨立電影人:快速視覺化分鏡頭指令碼,探索不同運鏡和色調的可行性。

當然,Veo 3.1 目前仍處於早期訪問階段,並非人人可用。Google 通過 Vertex AI 平臺提供 API 呼叫,這意味著它更偏向於專業使用者和開發者。對於普通使用者,或許還需要等待整合到更親民的產品中。

競爭格局與展望

視訊生成賽道已經非常擁擠:OpenAI 的 Sora、Runway Gen-3、Pika 2.0 都是強勁對手。Veo 3.1 的優勢在於 Google 的生態——與 Gemini 模型 的潛在整合、YouTube 的資料積累,以及強勁的 TPU 算力。不過,Sora 尚未公開可用,Runway 和 Pika 則早已開放給創作者。Veo 3.1 能否後來居上,還要看其開放速度和定價策略。

從技術角度看,Google 這次在 一致性 上下的功夫值得關注。如果實際效果與宣傳相符,它可能會成為第一個讓「AI視訊不閃爍」的可用方案。對任何靠視訊吃飯的人來說,這都值得關注。

總的來說,Veo 3.1 不是一次顛覆性的創新,而是一次紮實的迭代——它在最關鍵的問題上做出了改進,並且精準地切入了當前最熱門的豎屏內容需求。如果你是視訊創作者,並且能接觸到 Vertex AI,現在就應該去申請試用。市場變化很快,下一個爆款視訊或許就誕生於你的鍵盤。

Veo3.1Google DeepMindAI視訊生成豎屏視訊視訊一致性視訊控制社交媒體內容Vertex AI

分享

評論

0
0/500 字元

暫無評論

成為第一個評論的人

探索更多

相似工具

Dreamina

Dreamina

Dreamina 是一款集生成影象、動畫視訊與創意視覺設計於一體的線上創作平臺,由 CapCut 團隊支援。與傳統的影象或視訊製作軟體不同,Dreamina 通過簡單的文字提示或上傳素材,讓使用者在瀏覽器中快速生成符合設想的視覺作品。它能從文字描述衍生影象、將靜態圖轉為動態視訊,甚至結合 AI 聲音與動畫效果,為視覺創作者和內容生產者提供便捷的創作入口。

Vheer

Vheer

Vheer 是一個線上的 AI 影象 / 設計工具平臺,提供文字轉影象(Text-to-Image)、影象轉影象(Image-to-Image)、視訊生成、頭像/動漫/紋身圖案生成、背景移除等功能。

ImagineArt

ImagineArt

ImagineArt(域名 imagine.art)是一個以生成式 AI 為核心的創意工具套件 / 平臺,主要用於生成與編輯影象、視訊等視覺內容。官網稱可以 「創造人工智慧藝術,將你的想象變成現實」

Lovart

Lovart

Lovart將創意需求自動化為設計成果,把複雜的創作流程簡化為「說一句話,出一個作品」。其多模型融合、無限畫布和可編輯輸出等特點,讓使用者在單一平臺上完成從構思到落地的整個創作過程,是一款集AI繪畫、圖片生成、文生圖、視訊製作、品牌設計於一體的綜合性創作工具。

Symphony Creative Studio

Symphony Creative Studio

Symphony Creative Studio 是 TikTok 推出的一款AI 驅動的創意視訊工具,旨在幫助廣告主和內容創作者快速生成符合 TikTok 平臺風格的原創短視訊。

通義萬相

通義萬相

通義萬相 是阿里雲 / 通義體系下針對視覺創作(影象 / 視訊)的 AI 生成工具 / 模型。使用者通過輸入文字提示 or 上傳影象,可以生成富有風格、創意的影象或短視訊。它具備多模態能力(文字 ↔ 影象 ↔ 視訊)並提供給開發者 API 介面,可以被整合進其他產品與服務。它的發展正在從影象生成擴充套件到視訊生成、音畫同步、配音等。

開源專案

palmier-pro: macOS 上專為 AI 打造的視訊編輯器

palmier-pro 是一個開源的 macOS 視訊編輯器,專為 AI 工作流設計。它利用本地 AI 模型實現智慧剪輯、場景檢測和自動字幕生成,讓視訊編輯更高效。適合獨立創作者和開發者自定義。

ArcReel: 開源AI視訊工作臺,小說轉視訊

ArcReel 是一個基於 AI Agent 的開源視訊生成工作臺,能將小說自動轉化為角色、場景、道具,再生成劇本、分鏡圖並最終合成視訊。它通過跨鏡頭角色與場景一致性技術,確保敘事連貫,支援 Veo 3.1、Grok、Seedance 等模型,適合內容創作者和開發者。

MoneyPrinterTurbo: 短視訊自動生成流水線

主要用於自動生成短視訊,將文案生成、配音、畫面素材拼接、視訊輸出幾件事串起來。更接近一種「流水線式內容生成工具」

waoowaoo: 工業級AI影視生產全流程平臺

waoowaoo 是首個工業級開源 AI 影視生產平臺,專注於可控影視製作,支援從短視訊到長篇電影的好萊塢標準工作流,基於 TypeScript 構建,提供 AI Agent 驅動的全流程創作能力。

Wan2.2: 文字影象轉視訊AI框架

它是一個用於 視訊生成 / 視訊合成 / 文字 / 影象 → 視訊 的 AI 模型庫 / 框架,支援多種任務(Text → Video、Image → Video、Text+Image → Video 等)

Jaaz: 開源創意工具,本地靈活創作影象視訊設計

Jaaz 是一個面向創意 /影象 /視訊 /佈局設計 /多模態內容的開源工具 /平臺 /框架,目標是讓使用者在本地 /混合環境中,用更靈活、可控的方式進行創作(影象 + 視訊 + 畫布設計 + prompt 自動優化等)