模型精选73°

Edge0开源Audio8-ASR-Infinite:中英文流式语音识别模型,支持7x24小时不间断转写

精选理由

Edge0开源的流式语音识别模型,中英文都能转,延迟几百毫秒,显存占用恒定不爆内存,直播听写可以直接跑起来。

Edge0开源了流式语音识别模型Audio8-ASR-Infinite,支持中英双语,转写延迟低至几百毫秒。模型采用循环滑动缓存机制,使计算延迟和显存占用保持恒定,避免长音频转写时的漂移和内存溢出问题。内置语义活动检测,能识别真实停顿、结巴与说话结束。该模型适合长时间直播听写和高响应实时语音交互场景,支持7x24小时不间断运行。

图片来源 · Gorden Sun
原文 · Gorden Sun

Edge0开源Audio8-ASR-Infinite:超低延迟实现中英文7x24小时不间断语音转写

这是一款面向实时场景的原生流式语音识别模型,支持中英双语,转写延迟低至几百毫秒。它借助循环滑动缓存机制,使计算延迟和显存占用始终保持恒定,解决了长音频转写容易漂移和内存溢出的痛点。模型还内置语义活动检测,能精准识别真实停顿、结巴与说话结束,特别适合长时间直播听写与高响应实时语音交互等场景。

模型:https://t.co/hUKH7yMpYE