7月28日
11:42
11:42官方账号arXiv cs.LG@Kart-Leong Lim
传统随机变分推理(SVI)依赖共轭后验假设,难以处理非共轭情形。新方法PYPM-GGD基于常数步长随机梯度上升,无需闭式变分后验期望,仅要求可微分。借鉴Adam引入自适应步长,提升随机设置下的收敛性。在MIT67和SUN397数据集上使用ResNet特征,与深度聚类算法相比,聚类指标达到或超越现有最佳方法。
推荐理由:这篇论文提出了一种新的贝叶斯非参数学习方法PYPM-GGD,用自适应步长处理非共轭后验,在MIT67和SUN397上聚类效果不错,比传统SVI更灵活。
7月21日
11:47
11:47官方账号arXiv cs.LG@Kyungseon Lee, Hankyo Jeong, Kunwoong Kim, Kwanho Lee, Yongdai Kim
论文定义了子组公平性差距,并推导出协方差代理精确匹配该差距。提出COVA-FC算法,通过连续松弛实现梯度优化,解决多敏感属性下子组数量指数增长和少数实例问题。实验在基准数据集上显示COVA-FC在成本和公平性之间取得竞争性权衡,并在子组和更高阶边际设置中提升计算效率。
推荐理由:这篇论文用协方差方法解决了子组公平聚类的计算难题,COVA-FC比现有方法更快更稳定,做公平聚类研究可以看看。
6月8日
11:00
11:00官方账号arXiv cs.LG@Mohammadreza Sadeghi, Sareh Soleimani, Zihan Wang, Narges Armanfard
本文提出无监督持续聚类(UCC)问题,并引入前向-后向知识蒸馏持续聚类方法(FBCC)。该方法通过持续教师网络和轻量级任务特定学生,在无标签且不存储旧数据的情况下,学习新聚类同时保留已有聚类结构。实验表明,FBCC在四个基准数据集上持续优于现有持续学习方法,显著减少灾难性遗忘。这是首个专门针对无监督持续聚类的研究,解决了该领域缺乏聚类特定目标的问题。
推荐理由:做无监督学习和持续学习的团队终于有了聚类场景的专用方案——FBCC 不依赖标签和旧数据就能保持聚类结构,做数据流聚类或隐私敏感场景的开发者可以直接参考实验设置。
5月29日
13:02
13:02官方一手arXiv: DeepSeek@Haochen Yang, Ke Zhao, Mengyuan Ma, Xingyu Lu, Xiangfeng Wang, Hong Qian
精选
OptSkills 是一种面向优化建模与求解的智能体系统,通过聚类问题原型而非表面叙事来提升泛化能力。它利用大语言模型自动从自然语言中提取优化问题,并在聚类内探索多样建模与求解配置,将成功轨迹蒸馏为可复用的工作流技能。在多个数据集上达到 68.27% 的微平均准确率,在 MIPLIB-NL 基准上以 26.91% 超越 DeepSeek-V3.2-Thinking 4.53%。该系统还支持在分布外场景下通过新轨迹扩展技能库,代码和技能已开源。
推荐理由:做运筹优化或自动化建模的团队终于有了能应对问题类型变化的通用方案——OptSkills 通过原型聚类和技能蒸馏解决了传统方法对叙事变体敏感的问题,值得在复杂优化任务中试试。