#LangSmith
Monday 的 Sidekick 能边干活边迭代,比如分析 CSV、画地图,靠 LangSmith 沙盒隔离环境,看他们怎么做的。
LangChain创始人讲Agent怎么搭:模型权重自持,harness可配置,评估用Harbor,LangSmith跑数据飞轮,干货多。
红杉活动上,LangChain创始人聊了智能体三件套:框架、模型、上下文。他说越偏离模型训练数据,越该自己造框架。还演示了LangSmith Engine怎么做评估。
LangChain 要在硅谷办 LangSmith 实操活动,有 Expedia 嘉宾,能亲手部署应用,想玩转 Agent 调试的可以去。
LangChain 创始人要出教程了,讲托管深度智能体,还问大家想要长视频还是短视频列表,想学这块的可以去提意见。
LangChain 给 LangSmith 网关加了数据保护,请求发出前自动识别并替换 PII 和密钥,企业用户可申请测试。
想给LLM应用做监控评估?这篇把Langfuse、LangSmith、Braintrust、Arize的追踪深度、评估、生产监控和定价都对比了,直接照着选。
LangChain 新出的终端工作流:直接搭 Deep Agent,发到 LangSmith 托管,还能用 Harbor 跑验证,挺省事。
想学 LLM 评估的别错过,Dor Cohen 会讲 monday.com 怎么用 LangSmith 同时跑线上和离线评测,10 月 13 日伦敦见。
LangSmith 网关现在直接支持 Kimi 3 了,拿你现有的 API key 就能跑,不用另外搞权限,Fireworks 提供算力。
LangSmith用trace帮你把智能体调试看得明明白白,一键部署省掉几个月编排,MadrigalPharma案例从12周压到2周。
Spring Health 的工程总监要讲怎么用 LangSmith 抓心理咨询里的危机信号和模型幻觉,9月24日 Interrupt NYC 现场见。
想看语音智能体怎么调试?这个演示用 Google ADK + Gemini Live,再用 LangSmith 看清楚工具调用和 token 花费,直观。
有人发推说deepagents在LangGraph和LangSmith中间被忽略了。如果你正在选智能体框架,可以关注下deepagents,它可能比你想的更能打。
看看德铁咨询怎么把超大图纸拆给视觉Agent,还用LangSmith查它到底看见了啥。
LangChain 的 LangSmith 新增网关功能,能统一管理多个模型的 API 调用。如果你在用 LangChain,看看怎么配置这个网关吧。
LangChain 发了新网关,能控制花销和速率,还能自动给数据脱敏,跟编程代理直接连,甚至支持 kimi-k3,干活更方便了。
Similarweb分享了一套实用评估框架,用确定性检查+LLM评分+忠实性对比搞定开放性问题评估,还能用LangSmith追踪。
OpenWiki现在能通过LangSmith traces自动学习编码代理怎么用你的代码库,然后自动更新wiki。再也不用手动维护了!
如果你用 Claude Code 或 Codex 写代码,OpenWiki 这次更新能通过 LangSmith 追踪数据看懂代理哪里卡壳,帮你写出更准的 wiki。两条命令就能跑起来。
看看 CreditGenie_US 怎么用 LangSmith 的追踪和 Insights 功能,把上千条日志变成精准测试题,快速修 agent 的问题。