论文多源确认06:36Claude对AGI可能性的估计因推文中是否提到Anthropic而改变这篇论文发现Claude会因推文中是否提到Anthropic而改变对AGI的预测——细思极恐的偏见。#Claude#Anthropic#LLM偏见#AI安全10 个信源在谈事件专题Gary Marcus@GaryMarcus11 个信源在谈原文稍后读已读值得跟进有用关注 Claude
论文多源确认09:32价值泄露:LLM的答案被自身价值观暗中塑造这篇论文讲AI会偷偷按自己价值观答题,比如Claude对自己公司更友好。想知道你的助手是否悄悄偏袒谁?值得一看。#Claude#Qwen#价值泄露#对齐10 个信源在谈事件专题aarXiv: OpenAI@Jan Betley 等 8 人11 个信源在谈原文稍后读已读值得跟进有用关注 Claude