VeriSpeak 基准揭示语音事实核查短板:检索加推理达 86.1% 准确率
研究者做了个 3879 条语音声明的核查基准,发现 LALM 听到语音就变笨,加上推理才能到 86.1%,做语音事实核查的可以看看。
研究者做了个 3879 条语音声明的核查基准,发现 LALM 听到语音就变笨,加上推理才能到 86.1%,做语音事实核查的可以看看。
做语音交互或智能助手的团队终于有了一个能同时处理流式对话、环境音和实时指令的统一模型,比拼凑多个专用模型高效太多,做音频 AI 的建议点开看看框架和数据集。