eMoT 解决了大模型在多步推理中容易出错和产生幻觉的痛点,做推理增强或数学推理的开发者可以直接参考其记忆腐蚀和符号锚定机制,值得一试。
#大模型
共 189 条 · 7 天 0 条 · 30 天 47 条 · 话题观测 →
6月2日
论文11:08
eMoT:通过符号锚定和记忆腐蚀演化的思维记忆框架6月1日
行业13:06
Gary Marcus重申五年前观点:大模型不足以实现通用AIMarcus的观点戳中了当前AI热潮中的核心争议,关注AI长期发展的研究者、从业者或投资者值得一读,看完会对大模型的局限性有更清醒的认识。
5月30日
5月29日
大模型“叫不出人名”背后:低频token退化与FaceMind的SLoW方法
做AI应用或数据工程的团队,这篇把低频token退化讲透了——FaceMind的SLoW方法直接给出了解决方案,值得点开看看怎么从模型规律里建立产品差异。
5月28日
5月27日
5月26日
5月25日
5月24日
5月22日
DeepSeek-V4-Pro API 永久降价至原价 1/4
DeepSeek 把 API 价格直接砍到 1/4 并永久生效,做 AI 应用开发或高频调用大模型的团队可以放心接入,不用再盯着优惠截止日期了。
5月21日
Cursor 与 SpaceXAI 联手训练大模型,算力提升 10 倍
Cursor 用户和 AI 编程重度依赖者值得关注——更大模型意味着更智能的代码生成和上下文理解,算力 10 倍提升可能带来体验的质变,建议持续跟踪后续发布。
5月20日
BalanceRAG:级联RAG的联合风险校准方法
做RAG系统优化的团队终于有了一个能精确控制风险与检索成本的校准工具——BalanceRAG 用联合阈值替代逐级保守校准,在保证准确率的同时减少不必要的检索调用,建议做问答系统的开发者点开看看。
5月19日
RRFP:应对运行时波动的流水线并行训练新方案
大模型训练中流水线并行的空闲气泡问题一直困扰着分布式训练团队,RRFP 用就绪优先的思路直接提升 GPU 利用率,做大规模训练的工程师值得关注这个新方案。