视频生成领域又迎来一次重要更新。Google DeepMind 今天正式推出 Veo 3.1,这是其视频生成模型的第三个主要版本。相比前代,这次升级的重点非常明确:让生成的视频更连贯、更富有创意,同时给用户更强的控制权。
如果你曾尝试过AI视频生成,大概会对“闪烁”和“变形”头痛不已——角色脸部在帧间突变,背景物体莫名消失。Veo 3.1 试图解决这些核心痛点。根据官方演示,新模型在 帧间一致性 上有了质的飞跃,角色和场景元素能够稳定保持,视频看起来更像实拍而非一堆飘忽不定的像素。
竖屏视频与社交媒体的崛起
一个值得注意的变化是,Veo 3.1 终于原生支持 竖屏视频生成。这背后显然是 TikTok、Instagram Reels、YouTube Shorts 等短格式视频平台的推波助澜。过去,视频生成模型大多默认输出横屏宽高比,创作者不得不手动裁剪或重新构图,往往损失重要内容。现在,从提示词到输出,竖屏生成一气呵成,大大缩短了内容生产链路。
对普通创作者来说,这意味着你直接用文字描述一个“咖啡馆窗边的手冲咖啡特写,竖屏,电影感灯光”,Veo 3.1 就能输出一条可直接发布的竖屏短片,无需后期二次处理。
更细颗粒度的控制
除了一致性和格式,Veo 3.1 在可控性上也下了功夫。用户现在可以通过参数微调 镜头运动(推拉摇移)、角色微表情 以及 光照变化。举个例子,如果你希望镜头从人物面部缓慢拉远到全景,并且光线从清晨转为黄昏,Veo 3.1 可以在单次生成中实现这种复杂的动态变化。
Google 还强调,团队在训练数据中进行了更严格的 负样本筛选,以减少有害内容和偏见。这在商业应用中尤为重要——品牌不希望自己的广告视频出现不可控的奇怪画面。
实际影响:谁需要 Veo 3.1?
- 社交媒体内容创作者:竖屏支持 + 高一致性,意味着你可以在几分钟内生成一个产品演示或Vlog片段,无需拍摄团队。
- 广告与营销人员:精准的镜头控制和场景一致性,适合制作原型视频或A/B测试创意方案。
- 独立电影人:快速可视化分镜头脚本,探索不同运镜和色调的可行性。
当然,Veo 3.1 目前仍处于早期访问阶段,并非人人可用。Google 通过 Vertex AI 平台提供 API 调用,这意味着它更偏向于专业用户和开发者。对于普通用户,或许还需要等待集成到更亲民的产品中。
竞争格局与展望
视频生成赛道已经非常拥挤:OpenAI 的 Sora、Runway Gen-3、Pika 2.0 都是强劲对手。Veo 3.1 的优势在于 Google 的生态——与 Gemini 模型 的潜在整合、YouTube 的数据积累,以及强劲的 TPU 算力。不过,Sora 尚未公开可用,Runway 和 Pika 则早已开放给创作者。Veo 3.1 能否后来居上,还要看其开放速度和定价策略。
从技术角度看,Google 这次在 一致性 上下的功夫值得关注。如果实际效果与宣传相符,它可能会成为第一个让“AI视频不闪烁”的可用方案。对任何靠视频吃饭的人来说,这都值得关注。
总的来说,Veo 3.1 不是一次颠覆性的创新,而是一次扎实的迭代——它在最关键的问题上做出了改进,并且精准地切入了当前最热门的竖屏内容需求。如果你是视频创作者,并且能接触到 Vertex AI,现在就应该去申请试用。市场变化很快,下一个爆款视频或许就诞生于你的键盘。











评论
暂无评论
成为第一个评论的人