IT之家 04月10日 15:03
谷歌 Veo 2 升级可生成更具电影感视频,文本、音频 AI 同步升级
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_guoji1.html

 

谷歌发布了Veo 2等AI视频工具的更新,旨在提升视频生成和编辑能力。Veo 2新增了修复和外扩功能,可以移除视频中的干扰元素和扩展画面。同时,Veo 2还引入了电影拍摄技巧预设和插值功能,方便用户创作电影质感画面。谷歌还升级了文本转图像模型Imagen 3的编辑功能,并推出了文本转音乐模型Lyria的私人预览版。此外,谷歌还推出了合成语音模型Chirp 3的定制语音功能,以及Gemini 2.5 Flash模型,提升处理速度。

🎬Veo 2新增修复和外扩功能:修复功能可以移除视频中不想要的元素,外扩功能则可以扩展视频画面,并用AI生成的片段填充新增空间,与原始片段自然融合,类似于Adobe的生成式扩展功能。

🎥Veo 2引入电影拍摄技巧预设和插值功能:用户可以在生成画面时选择电影拍摄技巧预设,指导镜头构图、拍摄角度和节奏,例如延时效果、无人机视角等。插值功能则可以在两个静态图像之间创建视频过渡,填充新的帧。

🖼️Imagen 3编辑功能升级:谷歌升级了文本转图像模型Imagen 3的编辑功能,声称可以“显著”提升自动移除物体的效果,使移除干扰元素后的结果看起来更加自然。

🎵音频领域更新:谷歌推出了文本转音乐模型Lyria的私人预览版,并为合成语音模型Chirp 3推出了“即时定制语音”功能,Chirp 3能够从10秒的音频输入中生成“逼真的定制语音”。

⚡Gemini 2.5 Flash模型:谷歌推出了Gemini 2.5 Flash模型,该模型会根据任务的复杂程度“自动调整处理时间”,以便为简单请求提供更快的结果。

IT之家 4 月 10 日消息,谷歌为其视频 AI 模型 Veo 2 推出新功能,旨在帮助用户更轻松地生成具有电影质感的画面以及编辑真实视频。这些新增的 Veo 2 功能目前可通过谷歌云的 Vertex AI 平台进行预览,与此同时,谷歌还对文本转图像生成器 Imagen 3 以及音频相关 AI 模型进行了更新。

据IT之家了解,Veo 2 的新功能包括修复功能(inpainting)和外扩功能(outpainting)。谷歌表示,修复功能可以自动移除视频中的“不想要的背景图像、标志或干扰元素”,而外扩功能则能够将原始视频的画面进行扩展,该工具会用 AI 生成的视频片段填充新增的空间,使其与原始片段自然融合,类似于 Adobe 为图像提供的生成式扩展功能。

此次更新还允许 Veo 2 用户在生成画面时,将电影拍摄技巧预设与文字描述一同选用,以便指导最终结果中的镜头构图、拍摄角度和节奏。例如,预设包括延时效果、无人机视角以及模拟不同方向的镜头平移等。

此外,Veo 2 新增了一种插值功能,能够为两个静态图像之间创建视频过渡,为开头和结尾序列填充新的帧。

Adobe 的竞争产品 Firefly 视频模型也具备一些类似的功能,其生成式 AI 视频扩展功能于上周在 Premiere Pro 中推出。谷歌还在其 AI 生成的输出中加入了 SynthID 数字归属水印,类似于 Adobe 的内容凭证系统。不过,Adobe 进一步承诺其工具完全可用于商业用途,因为它们是基于授权和公有领域内容进行训练的,而谷歌在训练其 AI 模型时大量抓取了网络上的内容,无法达到这一标准。

在文本转图像模型 Imagen 3 方面,谷歌对其编辑功能进行了更新,声称可以“显著”提升自动移除物体的效果,使移除干扰元素后的结果看起来更加自然。Veo 2 和 Imagen 3 已被包括欧莱雅和卡夫亨氏在内的公司用于营销内容制作。卡夫亨氏的数字体验负责人贾斯汀・托马斯表示,过去需要八周才能完成的任务,现在只需八小时。

在音频领域,谷歌推出了其文本转音乐模型 Lyria 的私人预览版,并为其合成语音模型 Chirp 3 推出了“即时定制语音”功能。谷歌称,Chirp 3 现在能够从 10 秒的音频输入中生成“逼真的定制语音”,并且正在推出一项新的转录功能预览,该功能可以识别并分离出多人对话中的各个说话者,从而为多参与者的谈话提供更清晰的转录。

这些更新只是谷歌今日宣布的一系列 AI 相关消息中的一部分。谷歌效率优化型 Flash 模型的最新版本 Gemini 2.5 Flash 即将登陆 Vertex AI。谷歌表示,Gemini 2.5 Flash 会根据任务的复杂程度“自动调整处理时间”,以便为简单请求提供更快的结果。

此外,谷歌本周还将更新其面向企业的 Agentic AI 工具,使 AI 代理能够在不同平台(如 PayPal 和 Salesforce)之间相互沟通并执行任务。同时,谷歌云市场将推出一个新板块,供企业浏览和购买由第三方谷歌合作伙伴构建的 AI 代理。

Fish AI Reader

Fish AI Reader

AI辅助创作,多种专业模板,深度分析,高质量内容生成。从观点提取到深度思考,FishAI为您提供全方位的创作支持。新版本引入自定义参数,让您的创作更加个性化和精准。

FishAI

FishAI

鱼阅,AI 时代的下一个智能信息助手,助你摆脱信息焦虑

联系邮箱 441953276@qq.com

相关标签

谷歌 AI视频 Veo 2 Imagen 3 Lyria
相关文章