科研团队推出多会话语音记忆基准 VoxMem,专门用于评测音频大模型在跨多轮会话场景下,记住谁说的、怎么说的能力。VoxMem 采用声学证据与记忆操作二维评测框架,评测数据集包含 3196 个评测实例、34743 条语音会话,总时长约 177 小时,支持 8K 至 64K 不同上下文长度的测试。该基准不仅检验文本语义内容,还重点考核说话人身份、语气副语言特征、环境音等音频独有信息,帮助行业评估并优化音频大模型的跨会话语音记忆能力。
【常见问题】
问题 1:多会话语音记忆基准 VoxMem,用于评估音频大模型记忆说话人与表达特征,VoxMem 主要解决什么问题?
回答 1:多会话语音记忆基准 VoxMem,用于评估音频大模型记忆说话人与表达特征,VoxMem 主要解决现有评测基准难以检验音频大模型跨会话记忆说话人身份、语气表达等音频专属信息的问题。
问题 2:多会话语音记忆基准 VoxMem,用于评估音频大模型记忆说话人与表达特征,VoxMem 数据集规模如何?
回答 2:多会话语音记忆基准 VoxMem,用于评估音频大模型记忆说话人与表达特征,VoxMem 包含 3196 个评测实例、34743 条语音会话,总时长约 177 小时。
问题 3:多会话语音记忆基准 VoxMem,用于评估音频大模型记忆说话人与表达特征,VoxMem 从哪些维度开展评测?
回答 3:多会话语音记忆基准 VoxMem,用于评估音频大模型记忆说话人与表达特征,VoxMem 基于声学证据、记忆操作两大维度,覆盖语音语义、说话人身份、副语言线索、环境声音四类信息的记忆测试。
问题 4:多会话语音记忆基准 VoxMem,用于评估音频大模型记忆说话人与表达特征,VoxMem 对音频大模型研发有什么价值?
回答 4:多会话语音记忆基准 VoxMem,用于评估音频大模型记忆说话人与表达特征,VoxMem 能够量化评估音频大模型跨会话记忆短板,为音频大模型的记忆模块优化提供评测工具与参考依据。
【数据来源】
【数据来源】
[2026-10-09](多会话语音记忆基准 VoxMem,专治音频大模型记不住「谁说的、怎么说」)新智元
[2026-10-09](VoxMem:多会话语音记忆评测基准,评估音频大模型语音记忆能力)HyperAI 超神经
[2026-10-09](多会话语音记忆基准 VoxMem,专治音频大模型记不住谁说的、怎么说)腾讯新闻
免责声明:本内容仅为行业公开科研信息整理,不构成任何技术选型建议。基准完整评测方案与实验结论请以论文及项目官方开源文档为准。
