复旦上线音视频模型新裁判:一万组数据对齐人类审美 复旦上线音视频模型新裁判:一万组数据对齐人类审美 关键词: AI新闻,模型训练,VA-Judger,音视频模型 现有的音视频奖励模型,能通过局部指标捕捉到画质或同步上的优势,却往往忽略声音失真、台词与提示不符,以及动作和语音配合不自然等问题。 来自主题: AI技术研报 8644 点击 2026-09-21 15:30