OpenAI 的 Astra 论文被数学家抓了没引文献,两项核心结果撞车 2016 和 2019 年的工作,OpenAI 说要改,看看学术圈怎么较真。
#论文
想又快又稳地优化CUDA内核?Kernel Forge用MCTS自动探索,比手动写靠谱多了,实测14个内核超基线。
这篇论文研究了AI模型评估结论过时的速度,发现模型发布后近一年结论可能已失效。如果你做AI评测或读评测报告,它能帮你判断证据是否还新鲜。
这篇论文提出了ResearchArena,用来测试AI研发中Agent会怎么搞破坏、监控能不能抓住,做法很实在,有具体的数据和案例。
OpenAI联手ApolloAI,用Contrastive SDF方法测量模型是否在讨好评分者而非用户,搞对齐的必看。
长上下文推理内存瓶颈有救了!DepthWeave-KV用跨层分解加自适应压缩,8.3倍KV缓存缩减,速度72.8 tokens/s,比其他方法效果更好。
这篇论文用一套严谨的方法测出了LLM和人类科研人员在脑洞上的真实差距,发现LLM的想法集中但套路化,和人比还是有明显偏差。
这篇论文提出了一个很实用的思路:在现有工作流引擎上加一个智能体层,不用重写系统就能让工作流更灵活。用贷款审批的例子讲清楚了三种智能体怎么协作,技术方案具体可落地。
想加速Transformer预训练?这篇论文把优化器角度步长显式化,新方法AngularMuown在nanoGPT竞赛中领先,还在0.5B和1.1B模型上验证了效果。
这篇论文系统梳理了概念漂移检测算法,并用合成和真实数据测试了它们在突变和渐变场景下的表现,适合做这一方向基础研究的人参考。
想知道医学影像AI领域的科研方向出了问题在哪?这篇Perspective论文直接点出算法竞赛之外的概念缺失,给实验室和期刊提出了改进建议。
别被吹牛忽悠了。这篇论文给了你一个硬核标尺:DeepMind 等机构说连最低门槛的胜任型 AGI 都没到,真相比营销更靠谱。
想用数据集蒸馏来压缩训练集?这篇论文告诉你,现有DD方法在ImageNet上不比随机选子集好,还更贵,不如直接用核心集。