编译 / VRAR星球 R星人
8 月 28 日消息,腾讯混元今天午间宣布开源端到端视频音效生成模型 Hunyuan-Foley,用户只需输入视频和文字,就能为视频匹配电影级音效。
根据官方介绍,HunyuanVideo-Foley 不仅打破了 AI 生成的视频只能“看”不能“听” 的局限,让无声 AI 视频成为历史,更是真正做到了“看懂画面、读懂文字、配准声音”,带来沉浸式视听体验。这款音效生成工具可广泛应用于短视频创作、电影制作、广告创意和游戏开发等场景。
据悉,混元团队开发了一个全面的数据处理管道,能够自动化标注和过滤收集的音视频数据,构建了约 10 万小时级的高质量 TV2A 数据集,为模型训练提供了强大支撑,使得模型拥有强大的泛化能力,能够在各种复杂的视频条件下生成音画一致、语义对齐的高质量音频,包括音效与背景音乐。生成的音频能够与无声视频相结合,极大提升了视频的真实感和沉浸感。(新闻来源:IT之家)
商务合作:13146398132
媒体合作:13341147250
爆料投稿:editor@vrarworld.cn
版权声明:本文为VRAR星球原创,任何单位及个人未经授权不得转载,否则将依法追究侵权责任。
如需转载请联系13341147250 / editor@vrarworld.cn 申请授权,转载时请注明来源并保留VRAR星球原文链接。
本文部分图片及视频来源于互联网,如涉及侵权请联系我们删除。
央视发布智能眼镜半年报,上半年京东平台智能眼镜成交量同比增长超10倍
传Meta九月将推新款Ray-Ban AI眼镜,蓝思科技独家供应核心部件
24小时募资50万美金:中国Rokid凭一款“绿屏眼镜”杀入全球市场
大朋AI眼镜开启预定,9月26日正式预售
传腾讯内部在研智能眼镜项目,方向为类Even Realities G1产品形态
北京卫视专访亮亮视野吴斐:用AR字幕翻译眼镜助力无障碍社会建设
全球首款,纳米盒AI智能学习眼镜即将上市
床垫品牌丝涟举办汽车影院活动,融合VR沉浸式影片与智能床舒适观影体验
腾讯混元开源端到端AI模型Hunyuan-Foley:视频+文字=“电影级”音效
央视发布智能眼镜半年报,上半年京东平台智能眼镜成交量同比增长超10倍
传Meta九月将推新款Ray-Ban AI眼镜,蓝思科技独家供应核心部件
24小时募资50万美金:中国Rokid凭一款“绿屏眼镜”杀入全球市场
大朋AI眼镜开启预定,9月26日正式预售
传腾讯内部在研智能眼镜项目,方向为类Even Realities G1产品形态
北京卫视专访亮亮视野吴斐:用AR字幕翻译眼镜助力无障碍社会建设
全球首款,纳米盒AI智能学习眼镜即将上市
床垫品牌丝涟举办汽车影院活动,融合VR沉浸式影片与智能床舒适观影体验
腾讯混元开源端到端AI模型Hunyuan-Foley:视频+文字=“电影级”音效
央视发布智能眼镜半年报,上半年京东平台智能眼镜成交量同比增长超10倍
传Meta九月将推新款Ray-Ban AI眼镜,蓝思科技独家供应核心部件
24小时募资50万美金:中国Rokid凭一款“绿屏眼镜”杀入全球市场
大朋AI眼镜开启预定,9月26日正式预售
传腾讯内部在研智能眼镜项目,方向为类Even Realities G1产品形态
北京卫视专访亮亮视野吴斐:用AR字幕翻译眼镜助力无障碍社会建设
全球首款,纳米盒AI智能学习眼镜即将上市
床垫品牌丝涟举办汽车影院活动,融合VR沉浸式影片与智能床舒适观影体验
腾讯混元开源端到端AI模型Hunyuan-Foley:视频+文字=“电影级”音效