4 月 23 日,Character.AI 公司在 X 平台发布推文,宣布推出 AvatarFX 模型,能够让静态图片中的人物“开口说话”。用户只需上传一张图片并挑选一个声音,平台即可生成会说话、会移动的形象。这些形象还能展现情感,呈现出令人惊叹的真实感和流畅度。
公司表示,这得益于一种名为“SOTA DiT-based diffusion video generation model”的先进 AI 模型。该模型经过精心训练,结合音频条件优化技术,能高效生成高质量视频。
AvatarFX 的技术亮点在于其“高保真、时间一致性”的视频生成能力。即便面对多角色、长序列或多轮对话的复杂场景,它也能保持惊人的速度和稳定性。与 OpenAI 的 Sora 和 Google 的 Veo 等竞争对手相比,AvatarFX 并非从零开始或基于文本生成视频,而是专注于将特定图片动画化。
这种独特的工作流程为用户提供了新颖体验,但也带来了潜在风险。用户可能上传名人或熟人照片,制作看似真实的虚假视频,引发隐私和伦理争议。(新闻来源:IT之家)
商务合作:13146398132
媒体合作:13341147250
爆料投稿:editor@vrarworld.cn
版权声明:本文为VRAR星球原创,任何单位及个人未经授权不得转载,否则将依法追究侵权责任。
如需转载请联系13341147250 / editor@vrarworld.cn 申请授权,转载时请注明来源并保留VRAR星球原文链接。
本文部分图片及视频来源于互联网,如涉及侵权请联系我们删除。
Meta新发明靠肌肉信号控制设备,戴个手环就能隔空操控电脑
Brilliant Labs将于7月31日发布新款AI眼镜
阿里眼镜AR/AI更多信息泄露,主板电池后置,采用衍射光波导
阿里首款自研AI眼镜正式发布,含带显示和不带显示两款,支持高德导航、支付宝看一下支付等功能
消息称OpenAI准备在8月初发布新一代GPT-5模型
《动物公司》成为收入第五高的Quest游戏,每日活跃用户数最高达到50万
经典科普IP《十万个为什么》拥抱XR技术,首个成果将于年内全球首发
南宁市青秀山风景区启动“XR时空任意门”
广州:发展VR/AR体育赛事,打造沉浸式观赛场景,宣传冠军元宇宙讲堂