#Chain-of-Thought
共 13 条 · 7 天 1 条 · 30 天 6 条
信息流里打上「Chain-of-Thought」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月9日
9月25日
论文09:48
层级贝叶斯分析显示:推理模型规模扩大能力递减,效率几乎不变这项研究拿 DeepSeek-R1-Distill 全系列做实验,结论挺扎心:模型变大只是解题能力强了一点,推理消耗的 token 一点没省,想靠堆规模提效率可能走不通。
9月23日
研究提出延续式因果测试:CoT 在难题上才真正影响答案
拿 Gemma、Llama、DeepSeek 三个模型做了个挺狠的测试:简单题模型根本不看自己的推理,难题上错误会一路传到底,这对做 CoT 监控的人是个警告。
9月18日
谷歌 Deepmind 提出可见思维链是 AI 安全优势,但透明度正在消失
谷歌 Deepmind 发表观点,说 AI 模型显示思考过程(比如 Chain-of-Thought)对安全有好处,但现在很多模型(比如 GPT-4)正在减少这种透明度。
9月15日
7月28日
7月16日
论文10:40
Deep Interaction:一种高效的大推理模型人机交互方法这篇论文提出 Deep Interaction,让你可以直接改推理步骤的错误,不用推倒重来。实验说 STEM 任务上纠错成功率涨 25%,token 还省 40%,挺实用的方法。
6月25日
6月20日
6月17日
6月16日
论文10:43
RDS Fusion:混合神经符号门控与压缩CoT推理的讽刺检测框架这篇论文提出了RDS Fusion,不用微调就能在讽刺检测上达到和微调BERTweet一样的水平,还在难数据集上比很多监督方法强。
5月12日