02:50techcrunch@Lorenzo Franceschi-Bicchierai网络安全研究者突然无法使用OpenAI的Trusted Access for Cyber(TAC)项目,该项目为经过审核的用户提供更少的防护限制的模型,多个研究机构受到影响,该项目的访问权限被突然撤销,影响到了已通过审核的特定用户群体,这一变更导致合作方无法继续使用原本约定的服务模式。行业OpenAITACcybersecurity10 个信源在谈事件专题推荐理由:朋友间可以说OpenAI突然不让合作伙伴用他们的TAC项目了,之前合作的能少受限的模型现在没了访问权,和之前约定好的不一样了,得关注他们为啥这么改。原文稍后读已读值得跟进有用关注 OpenAI
10:30官方一手arXiv: DeepSeek@Jasmine Brazilek, Oliver Tulio, Joel Christoph, Miles Tidmarsh, Carol Kline, Arturs Kanepajs新基准TAC(Travel Agent Compassion)测试AI代理在12个旅行预订场景中是否避免动物剥削选项,涵盖6类动物剥削,扩展至48个样本以控制价格、评分和位置干扰。7个前沿模型得分均低于64%的随机水平,最佳Claude Opus 4.7为53%。在系统提示中加入一句福利意识语句后,Claude和GPT-5.5提升47-63个百分点,GPT-5.2提升26个百分点,DeepSeek和Gemini提升不到12个百分点。对前两名模型的288条基底记录审计未发现评估意识,表明低分并非因识别出测试。论文TAC动物福利AI Agent1 个信源在谈事件专题推荐理由:动物福利问题有了AI专属的代理基准TAC,实测Claude Opus 4.7刚过一半,加个提示词能暴增60%,暴露了模型在实际行动中的盲区。原文稍后读已读值得跟进有用关注 TAC