ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

谷歌推出Gemini Omni:只需动嘴 AI自动帮你改大片

时间:2026-05-20 20:05:51来源:快科技编辑:快讯

5月20日消息,在Google I/O 2026上,谷歌正式发布Gemini Omni模型。该模型支持文本、图像、音频、视频作为输入,实现跨模态生成与编辑。

其中在音频方面,目前该模型初期仅支持语音输入,但Google表示未来将很快扩展更多类型的音频输入能力。

首发产品Gemini Omni Flash已在Gemini应用上线,后续将向企业客户开放API。

该模型核心卖点在于深度视频编辑能力。用户通过自然语言指令即可对生成内容持续迭代,包括添加或删除对象、切换摄像机角度、修改环境与风格。

得益于模型对物理规律的理解以及对历史、科学、文化知识的整合,生成的视频在角色、场景及视觉逻辑上高度连贯,甚至能推测后续情节。用户亦可创建个人数字分身,并将其植入视频中。

谷歌在安全领域同步布局,所有通过Omni生成的视频均会自动嵌入SynthID数字水印,支持通过Google搜索及Chrome验证。

Gemini Omni Flash 现已面向拥有 Google AI Plus/Pro/Ultra 订阅的用户在 Gemini 应用和 Google Flow 中推出。它还免费向希望混剪 YouTube Shorts 的用户以及 YouTube Create 应用用户推出。

Google DeepMind负责人哈萨比斯表示,该模型正推动AI从单纯的任务执行向通用人工智能(AGI)迈进。

更多热门内容
马斯克深度访谈:AI五年内或超人类,工作金钱将变样,未来何去何从?
在马斯克的认知里,AI(数字超级智能)就像是物理学中的黑洞,是一个不可逆且会吞噬一切原有社会法则的“奇点”。 这场90分钟访谈,表面上讨论的是AI、机器人和商业竞争,但更深层讨论的是:人类未来会变成什么样…

2026-08-02

谷歌Gemini Robotics 2发布:一个模型实现全身控制,跨硬件协作成亮点
该模型继承自 Gemini Robotics 1.5的运动迁移技术,即便新机器人平台在形状、传感器与自由度上与训练分布差异显著,该模型也能在不到 200 个演示样本、几小时时间内完成适配,大大降低了部署难度…

2026-08-02

华为MatePad Pro Max涨价,iPhone18e与Air2曝光,OPPO新机入网,手机市场新动态
值得一提的是,报告指出,苹果将从今年起清晰化一年双发策略:秋季发布最高端的Pro系列和折叠屏iPhone;春季则集中更新标准版、Air与e系列,以均衡全年的市场热度。 另一方面则是DRAM与NAND闪存在全…

2026-08-02