论文Agent 与开发者09:40SepRQ 开源:无掩码多尺度语音分离 SSL 框架做语音分离或说话人日志的可以看看,SepRQ 开源了,参数才 85.68M 却在 SUPERB 上超过 WavLM,还支持三人混合语音分离。#SepRQ#WavLM#语音分离#自监督学习1 个信源在谈事件专题aarXiv cs.LG@Séverin Baroudi 等 3 人2 个信源在谈原文稍后读已读值得跟进有用关注 SepRQ
论文精选09:28深度伪造语音检测器到底在听什么?可解释性研究揭示不同模型依赖的线索做语音安全或深度伪造检测的开发者,这篇论文能帮你理解不同模型的实际决策逻辑,避免盲目调参——看完你会知道该关注环境音还是音素质感。#深度伪造检测#可解释性#语音安全#WavLMaarXiv cs.LG@Vojtěch Staněk 等 6 人原文稍后读已读值得跟进有用关注 深度伪造检测