实测Grok bot发现要绑信用卡、用量烧得快,三个Agent一周吃掉32%,Super Grok Heavy要300刀一个月。想尝鲜不如先看Bloome。
#Agent
这篇论文搞了个MemSecBench,专门测AI记忆会不会被黑,结果84%的案例恶意记忆都能长存,而且不同记忆系统差别很大,做AI安全的朋友应该看看。
如果你用Agent做编程助手,这个思路很实用:别让Hook自动commit,让Agent自己判断什么时候该提交,省得一堆垃圾commit。
阿里云Qoder开源了Better Harness,能帮你分析和改进编程Agent的工作流程,适配Claude Code等工具,实测覆盖30个GitHub项目。
ElevenLabs 的 Agent 现在能在电话、短信、WhatsApp 上保持一致了,不用为每个渠道单独调教,省事不少。
HuggingFace 老大直接向 OpenAI 要数据、要算力,为了研究 Agent 攻击,这事关 AI 安全,值得一看。
给 termany.sh 加个 ACTIVE 标签就能秒切 Agent 窗口,还能直接 SSH 部署服务器,终端党可以试试
AnySearch 给个人开发者每天 1000 次免费搜索,认证后翻倍到 2000 次,还能接 Agent 和 AI 工作流,省下搜索 API 费用。
Replit 这次更新很实用,能用语音指挥Agent,还能从Claude或Slack直接开始写代码,再也不用手动交代技术栈了。
LangChain 团队用三年实战告诉你,图工程不是新噱头,而是做 agent 的硬核技能,想搞复杂 agent 的可以看看。
Mastra CEO聊了为什么Agent开发该用TypeScript,还提醒Token成本陷阱,都是实战干货,值得一听。
这篇文章点破了FDE背后的商业模式——先让你用Agent,再拿走你的工作。看看模型公司怎么一步步把企业Skills变成模型的养分。
dotey分享了GUI自动化测试两种思路,传统Playwright和Agent Computer Use。后者成本高但能替代人工,适合复杂场景。