#LLM
共 791 条 · 7 天 48 条 · 30 天 187 条
9月30日
9月29日
arXiv 论文提出 MoralLedger:道德历史可线性操纵 LLM 道德决策
研究者做了个 MoralLedger 框架,发现你之前干过啥会改变 LLM 的道德判断,还能沿一个内部方向直接干预改写它的选择,比单纯改提示词管用。
arXiv 研究:分析 200 万条 LLM 引用数据,找出页面被引用的关键因素
搞 SEO 或 AEO 的朋友该看看:分析了 200 万条 ChatGPT、Claude 等引用数据,发现堆 FAQ、加结构化数据没啥用,内容和用户提问匹配度才是关键。
9月28日
Prompt Minimization:压缩提示词长度而不损失输出质量
arXiv 上这篇论文教你把提示词砍到最短还不掉输出质量,还给了三个可操作的压缩框架,写 prompt 的人可以看看怎么省 token。
论文09:19
实证研究:LLM 在日志异常检测中的性能、效率与鲁棒性一篇把 LLM 做日志异常检测的选型问题拆开讲的论文:哪类适配策略有效、量化掉不掉点、噪声下稳不稳,做运维或 AIOps 的可以看看。
9月26日
Reasoning from scratch 第5讲:对数概率打分与自我改进
Raschka 又更新了,这期手把手教你用 PyTorch 算 token 概率给模型答案打分,还搭了一个 self-refinement 循环,最后跑 MATH-500 看效果。
用户用 Qwen3.8-Flash-Next-Uncensored 破解 IDM 引发授权争议
有人花 5 欧元租 GPU,让无审查版 Qwen 三十分钟改一个字节就破解了 IDM,这帖子把 AI 逆向能力聊得很具体。
9月25日
Gary Marcus 与 Nate Silver 隔空争论 LLM 是否只是"随机鹦鹉"
Gary Marcus 和 Nate Silver 打起嘴仗了,吵的是现在的大模型到底还算不算"随机鹦鹉",两边观点都挺典型,看看你站谁。
SAGE:用拓扑引导缓解大模型长程推理偏差
一篇讲怎么修大模型长程推理的方法论文,用代数稀疏化加双曲空间嵌入两种结构引导,12 个基准、7 个模型家族验证,Andrews-Curtis 问题提升 8 倍,代码已开源。
9月24日