论文10:30TAC基准测试:AI旅行代理会预订斗牛吗?前沿模型隐含动物福利评估动物福利问题有了AI专属的代理基准TAC,实测Claude Opus 4.7刚过一半,加个提示词能暴增60%,暴露了模型在实际行动中的盲区。#TAC#动物福利#AI Agent#基准测试1 个信源在谈事件专题aarXiv: DeepSeek@Jasmine Brazilek 等 6 人2 个信源在谈原文稍后读已读值得跟进有用关注 TAC