MOSS-VL+Kimi K3串起bug排查链路,自动整理录屏报告,Coding Agent直接定位修复,省去人工反复看视频的麻烦。
MOSS-VL是一个面向持续视频流的11B模型,可以将44秒录屏转化为结构化Bug报告,包含复现步骤和异常时间点。通过Herdr将报告传递给Coding Agent,无需人工反复查看录屏即可定位源码并修复。MOSS-VL提供NF4量化版本,可在单张RTX 4090上本地部署,也可通过LlamaFactory进行UI适配微调。
最近收到不少用户发来的 bug 录屏,我用 MOSS-VL + Kimi K3 串了一条自动排查链路,再不用来回拖进度条了。 一段用户操作录屏发过来,真正费时间的往往不是改代码,而是先还原: 1. ...
最近收到不少用户发来的 bug 录屏,我用 MOSS-VL + Kimi K3 串了一条自动排查链路,再不用来回拖进度条了。 一段用户操作录屏发过来,真正费时间的往往不是改代码,而是先还原: 1. 用户做了什么? 2. 问题从哪一秒开始? 3. 到底报了什么错? 这次我把一段 44 秒的录屏以视频流送进 MOSS-VL。它直接整理出了一份结构化 Bug Report: - 复现步骤:输入 → 清空 → 点击 - 异常时间:00:20 - Console 中的 TypeError 和相关变量 然后我通过 Herdr,把报告交给另一个 pane 中运行的 Coding Agent。 Agent 不需要再从头看完整段视频,可以直接根据时间点、操作路径和报错变量定位源码。 整条链路大概是:用户录屏 → MOSS-VL 生成结构化报告 → Kimi K3 定位并修复 → E2E 验证 这里真正负责看录屏的是 MOSS-VL,一个面向持续视频流的 11B 模型,可以在画面持续输入的过程中边看边理解。它提供了 NF4 量化版本,单张 RTX 4090 就可以本地部署;需要适配自家产品 UI 和控件时,也可以通过 LlamaFactory 进行微调。不想部署还也可以接 API,目前每天登录还会赠送 100credits API: shorturl.at/jtt6U Github: github.com/OpenMOSS/MOSS-… 这次最直观的感受是:原本需要人工反复查看录屏、整理复现步骤的工作,现在可以直接变成 Coding Agent 能继续处理的上下文。 Your browser does not support the video tag. 🔗 View on Twitter 💬 1 🔄 0 ❤️ 4 👀 904 📊 3 ⚡