编译 / VRAR星球 R星人
8 月 26 日,科技媒体 The Decoder 昨日(8 月 26 日)发布博文,报道称谷歌 DeepMind 推出全新 Gemini 2.5 Flash 图像编辑模型,在 Gemini 应用中可根据文字指令,在保持人物与动物的外观一致的情况下,提高修改图片的精度。
与此前的原生图像生成工具相比,它在根据文字进行图像修改时的准确率更高,甚至在多项任务中优于 ChatGPT 所用的 GPT-4o,让其能更好地基于复杂文字编辑图像。
据悉,新模型的亮点是“角色一致性”功能。在生成多张图像后,即便人物姿势、背景或光线发生变化,也能保持同一人、动物或物体的外观一致。这对于创建系列照片、产品多角度展示尤其有价值,适合品牌素材与产品目录的批量制作。

目前,开发者可通过 Gemini API、Google AI Studio 与 Vertex AI 试用,费用为每百万输出 token 30 美元,单张图像成本约 0.039 美元。(新闻来源:IT之家)
商务合作:13146398132
媒体合作:13341147250
爆料投稿:editor@vrarworld.cn
版权声明:本文为VRAR星球原创,任何单位及个人未经授权不得转载,否则将依法追究侵权责任。
如需转载请联系13341147250 / editor@vrarworld.cn 申请授权,转载时请注明来源并保留VRAR星球原文链接。
本文部分图片及视频来源于互联网,如涉及侵权请联系我们删除。

舜宇光学19亿“联姻”歌尔光学,加速AI/AR光学赛道整合

谷歌发布会透露:三款智能眼镜待发布,2027年将发布双目显示版

为Gemini AI装上“眼睛”:谷歌与XREAL联合发布Project Aura

特斯拉Optimus机器人演示时摔倒手忙脚乱“摘VR头显”,暴露并非完全AI驱动

《黑袍纠察队》官方VR衍生游戏《触发警告》宣传片公开

AStation将于12月16日举办第二届技术分享会

科技赋能文旅融合:影核签约云南,共建XR大空间数字体验新阵地

昀光科技完成A轮融资 正式启动12英寸硅基OLED产线建设

Meta收购超2.3亿元融资AI硬件公司

为Gemini AI装上“眼睛”:谷歌与XREAL联合发布Project Aura

全黑色苹果Vision头显部件曝光,或为Vision Air设计

扎克伯格官宣!苹果前VP执掌Meta AI硬件新部门

Meta收购超2.3亿元融资AI硬件公司

全球首款8K全景无人机,影石影翎A1开售首日国内销售额超2000万

《恐惧子午线》在1月发售前公布多人游戏模式

VR游戏《守护者:星陨》将于明年发布抢先体验版,看起来像VR版《地狱潜者 2》

理想汽车OTA 8.1开启推送:支持绑定理想AI眼镜

Meta MR眼镜发布时间推迟至2027年,26年将发布一款新的可穿戴设备