论文Agent 与开发者13:38TAIP 引擎为 CI 流水线中的 LLM 安全审计提供持续保障CI 里用 LLM 审代码不放心?这篇给出把审计证据版本化、策略一改就 1.1ms 内重算保障态势的工程方案,数据还挺扎实。#LLM#RepoAudit#gpt-4o-mini#CI/CDaarXiv: OpenAI@Guy Lupo 等 7 人原文稍后读已读值得跟进有用关注 LLM
行业多源确认精选23:41LangSmith发布大模型使用报告LangChain团队发布的大模型使用报告,显示gpt-4o-mini使用率最高,DeepSeek V4 Flash是唯一上榜的开源模型。#LangSmith#gpt-4o-mini#gpt-4.1-mini#DeepSeek V4 Flash3 个信源在谈事件专题官方账号LangChain@LangChainAI4 个信源在谈原文稍后读已读值得跟进有用关注 LangSmith
论文10:55输出分散是否引发认知修订?机器集体的黑盒耦合诊断这篇论文出个黑盒诊断,看LLM集体输出分散时是不是真改观点,结果GPT和Gemini相反:Gemini 94%在复读,GPT 24%。#gpt-4o-mini#gemini-2.5-flash#智能体#集体智能aarXiv cs.AI@Molood Arman原文稍后读已读值得跟进有用关注 gpt-4o-mini
模型10:17CO-LMLM:基于连续查询的有限记忆语言模型CO-LMLM用360M参数打平gpt-4o-mini,事实准确度比Claude还高,这是用更小模型做更好知识检索的路线。#CO-LMLM#LMLM#知识库#gpt-4o-miniaarXiv cs.LG@Yair Feldman 等 8 人原文稍后读已读值得跟进有用关注 CO-LMLM