谷歌最强视频生成 AI 模型 Veo3 亮相:制作背景音、人物对话都不在话下

2025-05-21 发布 · 浏览39次 · 点赞0次 · 收藏0次
感谢网友 软媒用户1053564 的线索投递!

5 月 21 日消息,在今年的 I/O 开发者大会上,谷歌发布新一代视频生成模型 Veo3,这也是其首个可生成视频背景音效的模型。它不仅能合成画面,还能为鸟鸣或街头交通等场景配上相应的音效,甚至还可生成人物对话。

谷歌称,Veo 3 在物理模拟与口型同步方面也表现优异。目前,该模型仅面向美国地区的 Gemini Ultra 用户,以及 Vertex AI 的企业用户开放,也已集成进谷歌的 AI 影视制作工具 Flow 中。

用户仍可为 Veo 2 提供人物、风格、场景或物体的图像参考,并通过 Flow 使用镜头控制功能进行旋转、缩放,甚至将画面从竖屏调整为横屏,或在视频中添加、删除元素。

当前用户越来越难以辨别 AI 生成内容,谷歌为此推出了 SynthID Detector。用户可上传媒体文件以检测其是否包含 SynthID 水印,这是谷歌用于识别 AI 作品的标记工具。不过,目前并非所有图像生成模型都支持这一水印。

谷歌 I/O 开发者大会仍在进行,将保持关注。

2025 谷歌 I/O 开发者大会专题

谷歌最强视频生成 AI 模型 Veo3 亮相:制作背景音、人物对话都不在话下 - AI 资讯 - 资讯 - AI 中文社区

声明:本文转载自IT 之家,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里。本站拥有对此声明的最终解释权。如涉及作品内容、版权和其它问题,请联系我们删除,我方收到通知后第一时间删除内容。

点赞(0) 收藏(0)
0条评论
珍惜第一个评论,它能得到比较好的回应。
评论

游客
登录后再评论
  • 鸟过留鸣,人过留评。
  • 和谐社区,和谐点评。