谷歌旗下DeepMind团队近日正式推出视频生成AI模型“Gemini Omni Flash”,目前已面向开发者开放,可通过Google AI Studio和Gemini API获取,当前处于公开预览阶段。
Omni Flash支持文本、图像和视频的混合输入,其最大特色在于能够以自然语言对话方式进行视频编辑。用户通过组合多种输入模态,可在保持场景连贯性的前提下灵活调整画面内容。

该模型还深度融合了Gemini本身所具备的广泛知识储备——无论是历史事件还是生物学概念,都能被精准融入视频生成过程,使输出内容更具信息深度。此外,模型还能依据提示词,将文字或图形元素与视频内的动态动作同步联动。
定价方面,Omni Flash按照生成时长计费,每秒钟视频收费0.10美元,与Veo 3.1 Fast处于同一水平。当前版本支持最长10秒的视频生成,未来计划拓展至更长时间的创作。
需要留意的是,该预览版暂不支持上传音频参考素材,也无法对已生成的场景进行延长。虽然API规范允许上传最长3秒的参考视频,但目前该功能尚无法正确运行。同时,在涉及镜头切换或平移运动的复杂场景中,角色的形象一致性仍有待改善。
同一天,谷歌还发布了图像生成模型“Nano Banana 2 Lite”,该模型可在4秒内完成从文本到图像的生成。开发者通过Interactions API能够将两款模型串联使用——先由Nano Banana 2 Lite生成图像,再将其输入Omni Flash转化为动态视频,并且可在保留会话历史的前提下,最多进行三次连续编辑。
为提升内容可追溯性,Omni Flash生成的每段视频均嵌入SynthID数字水印。用户通过Gemini应用、Chrome浏览器中的Gemini功能或谷歌搜索,均可便捷查验内容是否由AI生成。(新闻来源:moguravr、VRAR星球编译)
商务合作:13146398132
媒体合作:13341147250
爆料投稿:editor@vrarworld.cn
版权声明:本文为VRAR星球原创,任何单位及个人未经授权不得转载,否则将依法追究侵权责任。
如需转载请联系13341147250 / editor@vrarworld.cn 申请授权,转载时请注明来源并保留VRAR星球原文链接。
本文部分图片及视频来源于互联网,如涉及侵权请联系我们删除。

全美首例!纽约州1240家法院联手封杀智能眼镜,连处方镜片也不放过

填补国内空白!盐南企业这款国产设备赋能AR/VR产业

《奥特曼光之守护VR展》7月10日成都首站,用”碎片收集+分支剧情”探索复购新模型

Magic Leap战略转型,以波导技术加速AI显示眼镜未来

MR空间解谜游戏《Squingle Arcade》登陆Meta Quest,免费畅玩

BOE(京东方)发布业绩预告:2026上半年净利预增超五成

Meta 计划 9 月量产自研 AI 芯片 Iris

Pixel-Flo 获700万美元种子轮融资,推动微LED转移技术商业化

乐奇Rokid正式登陆日本市场,全日本75家门店及主要电商同步开售

谷歌发布了视频生成AI“Gemini Omni Flash”,现可通过Gemini API使用

天马推出全球首款3.16英寸Micro-LED透明圆屏

谷东智能PVG研发取得新突破:光波导少一层,视场扩大到45°

Solos发布AirGo A6智能眼镜,主打轻量化与隐私保护,AirGo V2同步全球开售

Raontech获海外AR眼镜LCoS开发合同,总价值最高达77亿韩元

千问AI眼镜迎来版本更新:高德打车、外卖闪购等重磅功能上线,打造全天候智能生活助手

高效黄光LED AR眼镜,获得国家科学技术奖一等奖!

苹果停止开发平价XR显示器项目,三星显示终止相关研发

中交四航院 VR技术解锁智慧港口升级新场景