10:24官方一手arXiv: DeepSeek@Lie Li, Wen Li, Junxiao Shen, Gusheng Hu精选MAPLE是一个即插即用的MoE专家分配框架,可在不修改权重不重训练的前提下,按层重新分配路由专家预算。其核心是封闭式灵敏度引导分配,并用灵敏度约束的遗传搜索进一步优化。在DeepSeek-MoE-16B上,MAPLE仅用75%专家即在ARC-E上从65.09提升至71.40,ARC-C从48.49提升至51.50,BoolQ从80.03提升至82.38。通过SGLang部署,单GPU端到端延迟降低32.2%,吞吐量提升47.4%。AI模型MAPLEDeepSeek-MoE-16BSGLang推荐理由:MAPLE这个插件能让MoE大模型少开专家还更准,DeepSeek-MoE-16B用75%专家就能超原版,还快32%,不用改权重就能用。原文稍后读已读值得跟进有用关注 MAPLE
01:57Alex Albert@alexalbert__78°Anthropic 发布 Opus 5 模型,在多个领域提升 token 效率的同时,进一步拉高了智能水平。团队投入大量工作优化该模型,使其在编码任务上表现优于 Fable 5。用户反馈使用体验流畅。AI模型Opus 5Fable 5推理模型10 个信源在谈事件专题推荐理由:Anthropic 新模型 Opus 5,token 更省、智商更高,写代码比 Fable 5 顺手,值得试试。原文稍后读已读值得跟进有用关注 Opus 5
22:19官方账号Logan Kilpatrick@OfficialLoganK76°Gemini 3.5 Flash 在 APEX-Agents-AA 基准测试中排名第一,超越了参数规模更大的模型。该基准专注于智能体能力评估,Gemini 3.5 Flash 以较小模型实现了领先性能,展示了高效架构的优势。这一结果对智能体开发领域具有重要意义,表明模型效率与性能可以兼得。AI模型Gemini 3.5 Flash智能体基准测试推荐理由:智能体开发者可以关注:Gemini 3.5 Flash 用更小参数实现了更强性能,意味着更低成本和更快响应,值得在项目中尝试。原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash