Google 刚刚发布 Gemini Omni:全球首个全能 AI 视频大模型

5 月 20 日
 WickedZX
Google 刚刚发布 Gemini Omni ,我这两天也顺手做了个专题站研究了一下。



目前看下来,它和之前很多 AI 视频模型最大的区别,是开始强调“持续理解 + 交互式编辑”。

上传视频后,可以直接让 AI:
替换背景、修改角色服装、切换动画风格、保留动作但改变镜头语言,模型会基于上下文持续编辑,而不是每次重新生成全部内容。

另外 Gemini Omni 现在已经开始统一处理:
文本、图像、视频、音频。

Google 很明显正在把:
搜索、推理、多模态生成、Agent ,
全部往 Gemini 这一套体系里整合。

感觉接下来 AI 产品形态可能会变化很大。[Gemini Omni]( https://www.gemini-omni.net)
938 次点击
所在节点    推广
4 条回复
flyxq
5 月 20 日
你这网址不太对
hedion
5 月 20 日
hedion
5 月 20 日
准确的网址应该是这个
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-omni/
你说的这个网址不会是自己搭的吧
longxinglink
5 月 20 日
能炼化成 10 铜币吗



@flyxq

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1214155

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX