论文Agent 与开发者10:48PPO-HRAP:混合感知策略优化算法PPO-HRAP算法通过混合策略优化,在控制风险的同时提升交易回报,特别适合波动市场环境。#PPO-HRAP#强化学习#交易算法#风险控制aarXiv cs.AI@Duong Hien Chi Kien, Thanh Trung Huynh原文稍后读已读值得跟进有用关注 PPO-HRAP
技巧Agent 与开发者12:45供应链风险预防引擎:从输入指标到实时干预想了解如何用技术手段提前发现供应链中的欺诈行为,这篇文章讲得很具体。#供应链#欺诈预防#风险控制#实时干预Tech Collective SEA@Tech Collective原文稍后读已读值得跟进有用关注 供应链
论文Agent 与开发者精选10:22LLM自我提问框架提升风险控制效果这篇论文介绍了一种叫CoSQ的新方法,能让大语言模型在不确定时主动不回答问题,这个方法在多个模型上测试过,效果不错。#Chain-of-Self-Questioning#提示词工程#风险控制aarXiv cs.AI@Ali Şenol原文稍后读已读值得跟进有用关注 Chain-of-Self-Questioning
论文11:52LLM在线安全监控:简单阈值报警器媲美高级方法这篇论文直接用阈值加风险控制就能搞定LLM安全监控,效果不输那些复杂方法,适合快速落地。#LLM#风险控制#安全监控#红队测试aarXiv cs.AI@Mona Schirmer 等 6 人原文稍后读已读值得跟进有用关注 LLM
论文10:40局部总体风险证书:一种风险可控的模型更新方法这篇论文用置信带兜底,保证模型更新不会越改越差,适合需要稳妥迭代的场景。#风险控制#模型更新#置信带#理论分析aarXiv cs.LG@Mingzhi Song原文稍后读已读值得跟进有用关注 风险控制