#可扩展监督
共 3 条 · 7 天 0 条 · 30 天 0 条
信息流里打上「可扩展监督」标签的资讯、产品与论文,按刊登时间排,新的在上。
6月12日
5月28日
5月13日
Anthropic 用 LLM 自动化对齐研究:可扩展监督新方案
Anthropic 用 LLM 自动化对齐研究,解决了可扩展监督的人力瓶颈,做 AI 安全和对齐的团队值得关注,可以直接参考其方法加速自己的研究。
Anthropic 用 LLM 自动化对齐研究,解决了可扩展监督的人力瓶颈,做 AI 安全和对齐的团队值得关注,可以直接参考其方法加速自己的研究。