全部动态
AI 相关资讯全量信息流 · 17328 条
9月22日
Browser Use 推出开源浏览器代理 Ultrafast,4 天获 15k GitHub 星
Browser Use 放出的开源浏览器代理,找航班 7 秒跑完只花 $0.0039,4 天拿下 15k 星,代码可直接上手试。
开源库 DocJev 发布:按语义边界切分文档,速度达 gpt-5.6-luna 的 6 倍
做文档切分可以试试 Jerry Liu 新开源的 DocJev,比 luna 快 6 倍、准确率相当,还带可视化页面。
System One Model:TypeSafe CEO 谈软件内的可靠决策
Latent.Space 新一期采访 TypeSafe CEO Jev,聊为什么聊天机器人做不成可靠自动化,观点挺反共识。
LlamaIndex 为 LlamaParse Extract 新增逐字段 Grounded Confidence 置信度评分
LlamaParse 抽文档每个字段都带置信度分数了,低分转人工、高分自动过,批量审核省人力。
Jev 在 Vercel AI Gateway 免费开放至 9 月 25 日
Jev 在 Vercel AI Gateway 免费到 9 月 25 日,官方还配了表单路由模板,想自动分流表单提交可以直接套用。
Lovable 创始人 Anton Osika:harness 专攻 Web 应用开发,按需路由 OpenAI/Anthropic 模型
Lovable 创始人亲自安利:写 Web 应用时 harness 会自动在 OpenAI 和 Anthropic 模型间挑合适的,还自动带上调试数据。
Xiaomi MiMo-V2.6 三款模型上线 OpenRouter
小米三款 MiMo-V2.6 上线了,Pro 主打编程智能体,UltraSpeed 版输出快 10 倍,都在 OpenRouter 能调。
Grok 4.7 上线 Devin,FrontierCode 1.1 Extended 得分 59.4%
Devin 现在能调用 Grok 4.7 了,Cognition 实测它在难的后端工程任务上表现好,写后端的可以试试。
Agent Arena 分析 20840 条轨迹:编码智能体差评首因是代码跑不通
Arena 拆了 20840 条编码智能体反馈:69% 差评是代码跑不通,Fable 5.1 比 Astra 更少被吐槽。
SemIf 在 JevBench 上以 75.4 分逼近 jev 的 74.7 分
jev 这类新决策模型有了开源平替,SemIf 基于 Qwen3.5,本周 LangSmith Gateway 免费用。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档