论文多源确认72°10:30ABC-Bench:评估LLM智能体的生物安全能力基准这是首个系统评估LLM智能体在生物安全关键任务上能力的基准,做AI安全或生物计算的研究者值得关注——它揭示了当前模型在复制已知协议时很强,但在创新推理上仍有短板。#生物安全#LLM智能体#基准测试#DNA组装7 个信源在谈事件专题aarXiv: OpenAI@Andrew Bo Liu 等 6 人8 个信源在谈原文稍后读已读值得跟进有用关注 生物安全