谷歌2026 I/O大会发布Gemini Omni模型 一句话指令即可编辑视频内容
IT之家 5 月 20 日消息,在今日的 2026 谷歌 I/O 开发者大会上,谷歌正式发布了 Gemini Omni 模型。 GeminiOmni 宣称能“从任何输入生成任何输出”,支持对话式编辑,用户可…
在2026年谷歌I/O开发者大会上,科技巨头谷歌正式推出了一款名为Gemini Omni的全新人工智能模型,引发行业广泛关注。这款模型被描述为具有“从任何输入生成任何输出”的强大能力,标志着生成式AI技术迈入新阶段。
Gemini Omni的核心创新在于其对话式编辑功能。用户只需通过自然语言指令,即可实时修改视频内容中的角色形象、场景背景等关键元素。这种交互方式突破了传统视频编辑的技术门槛,使非专业用户也能轻松完成复杂的内容创作。
大会同期宣布了Gemini Omni家族的首个衍生模型——Gemini Omni Flash。该轻量化版本即日起将在Gemini移动应用、Google Flow协作平台以及YouTube Shorts短视频服务中落地应用。开发者社区将通过后续开放的API接口,获得将这项技术集成到各类应用中的能力。
据现场演示显示,Gemini Omni Flash在保持核心功能的同时,显著提升了响应速度和资源效率。这项技术突破有望重新定义短视频创作流程,为内容生产者提供更高效的工具支持。随着API服务的逐步开放,预计将催生大量基于该技术的创新应用。
(来源:小熊科技)免责声明:本文内容来源于第三方或整理自互联网,本站仅提供展示,不拥有所有权,不代表本站观点立场,也不构成任何其他建议,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容,不承担相关法律责任。如发现本站文章、图片等内容有涉及版权/违法违规或其他不适合的内容, 请及时联系我们进行处理。
