AIGC宇宙 AIGC宇宙

谷歌计划融合 Gemini 与 Veo 模型,打造全能 AI 助手

作者:远洋
2025-04-13 08:53
谷歌DeepMind CEO透露,计划将Gemini AI与Veo视频生成模型融合,提升AI对物理世界的理解能力。Gemini已支持多模态,可生成图像、文本和音频,行业正朝“全能”模型发展。#AI技术##谷歌Gemini#
感谢谷歌 DeepMind 首席执行官 Demis Hassabis 在由领英联合创始人 Reid Hoffman 共同主持的播客节目 Possible 中透露,谷歌计划将旗下的 Gemini AI 模型与 Veo 视频生成模型进行融合,以此提升 Gemini 对物理世界的理解能力。

谷歌计划融合 Gemini 与 Veo 模型,打造全能 AI 助手

Hassabis 表示:“我们从一开始就将 Gemini 这一基础模型打造为多模态模型,因为我们有着构建一个通用数字助手的愿景,这个助手能够在现实世界中真正为你提供帮助。”

目前,整个 AI 行业正逐渐朝着“全能”模型的方向发展,这些模型能够理解和整合多种媒体形式。谷歌最新的 Gemini 模型不仅可以生成图像和文本,还能生成音频;而 OpenAI 在 ChatGPT 中的默认模型如今也能创建图像,包括宫崎骏风格的艺术作品。亚马逊也宣布计划在今年晚些时候推出一款“任意到任意”的模型。

据AI在线了解,这些“全能”模型需要大量的训练数据,包括图像、视频、音频、文本等。Hassabis 暗示,Veo 的视频数据主要来源于谷歌旗下的 YouTube 平台。他说道:“通过观看大量的 YouTube 视频,Veo 2 能够了解世界的物理规律。”此前,谷歌曾向 TechCrunch 表示,其模型可能会根据与 YouTube 创作者达成的协议,使用“部分”YouTube 内容进行训练。据报道,该公司去年扩大了服务条款的部分内容,以便获取更多数据来训练其 AI 模型。

相关标签:

相关资讯

谷歌 Veo 2 视频生成模型入驻 Gemini,用户可创建 8 秒 720p 视频

谷歌宣布将Veo 2视频生成AI模型引入Gemini Advanced订阅服务,用户可创作8秒720p视频并分享至社交平台。同时,Google Labs整合Veo 2推出Whisk Animate功能,静态图秒变动画。AI视频工具崛起也引发创意行业担忧。#谷歌AI##视频生成#
4/16/2025 7:31:28 AM
远洋

谷歌领跑 AI 视频生成赛道:抢先 OpenAI Sora 推出 Veo 模型,可生成 1080P 高清视频

谷歌公司昨日(12 月 4 日)发布博文,宣布在 Vertex AI 平台上,以私测预览版的形式,面向企业开放最新的生成式 AI 视频模型 Veo,助力企业内容创作流程。
12/5/2024 8:14:30 AM
故渊

ComfyUI 难度骤降一倍!揭秘谷歌Gemini 2.0 Flash的史诗级更新

最近,谷歌一口气对 AI 模型能力做了一次大升级,其中最吸引我的是 Gemini 2.0 Flash (Image Generation) ,这个模型对设计师来说,实用性很强。 更多新模型的介绍:. 被低估的谷歌?
3/26/2025 1:55:56 AM
彩云Sky
  • 1