腾讯混元开源AI模型Hunyuan-Foley:视频+文字=“电影级”音效
创始人
2025-08-28 14:13:01
0

IT之家 8 月 28 日消息,腾讯混元今天午间宣布开源端到端视频音效生成模型 Hunyuan-Foley,用户只需输入视频和文字,就能为视频匹配电影级音效

根据官方介绍,HunyuanVideo-Foley 不仅打破了 AI 生成的视频只能“看”不能“听” 的局限,让无声 AI 视频成为历史,更是真正做到了“看懂画面、读懂文字、配准声音”,带来沉浸式视听体验。这款音效生成工具可广泛应用于短视频创作、电影制作、广告创意和游戏开发等场景。

文字描述:Engine revving loudly and accelerating.

文本描述:Rustling and crunching of leaves and twigs under the fox kit's paws.

混元团队开发了一个全面的数据处理管道,能够自动化标注和过滤收集的音视频数据,构建了约 10 万小时级的高质量 TV2A 数据集,为模型训练提供了强大支撑,使得模型拥有强大的泛化能力,能够在各种复杂的视频条件下生成音画一致、语义对齐的高质量音频,包括音效与背景音乐。生成的音频能够与无声视频相结合,极大提升了视频的真实感和沉浸感。

IT之家附有关链接如下:

  • 体验入口:https://hunyuan.tencent.com/video/zh?tabIndex=0
  • 项目官网:https://szczesnys.github.io/hunyuanvideo-foley/
  • 代码:https://github.com/Tencent-Hunyuan/HunyuanVideo-Foley
  • 技术报告:https://arxiv.org/abs/2508.16930
  • Hugging Face:https://huggingface.co/tencent/HunyuanVideo-Foley

相关内容

最新资讯

中国女游客遭韩国民宿房东深夜闯... 韩国当地时间8月19日深夜,中国游客李小姐在韩国仁川订的民宿房间内休息,遭遇民宿房东肢体骚扰,房东擅...
2025新鲁科版七年级物理上册... 2025年学生将迎来新版教材,新教材将更加重视思维和阅读!为了方便广大学生在暑假预习新学期的课本知识...
长春师范大学成人高考几年可以毕... 题目长春师范大学成人高考毕业之路探索学业的旅程与收获 在我国,成人高考作为一种重要的继续教育途径,为...
GPT-5宝可梦对战创下951... 在宝可梦游戏界,一个前所未有的里程碑近日被创造。人工智能新星GPT-5在经典游戏《宝可梦水晶》中,以...
全球最火暗黑萝莉,第二季没让人... 时隔三年,《亚当斯一家》衍生剧《星期三》第二季终于回归。这部剧第一季首播时就一炮而红,超越《怪奇物语...
重磅交易!曝广东男篮签约崔永熙... 北京时间8月28日消息,据悉,今日上午,经过漫长的谈判,广东宏远和广州龙狮达成了一系列交易。 广东宏...
合肥市双岗小学:探秘蔚来制造 ... 8月24日,合肥市双岗小学四(4)中队雏鹰小队的队员们,在安徽省发展改革委主办、中国新闻网全程直播的...