模型Agent 与开发者22:16AI需CoT监控因不可靠Gary Marcus谈AI可靠性问题,解释为什么需要CoT监控,以及真正的核心挑战是什么。#CoT#Gary Marcus#AI可靠性#监控Gary Marcus@GaryMarcus原文稍后读已读值得跟进有用关注 CoT
论文11:23大语言模型推荐的认识论依据研究这篇论文提出了评估LLM推荐可信度的认识论担保框架,帮你判断何时该相信AI建议。#LLM#epistemic warrant#认识论担保#AI可靠性aarXiv cs.AI@Shai Vardi, João Sedoc原文稍后读已读值得跟进有用关注 LLM
模型73°02:43神经符号AI结合可靠性与能力Gary Marcus转推的神经符号AI概念,解释如何结合ML与确定性软件优势。#神经符号AI#William Tunstall-Pedoe#机器学习#确定性软件Gary Marcus@GaryMarcus原文稍后读已读值得跟进有用关注 神经符号AI
行业72°10:58加里·马库斯谈当前AI:智能但不靠谱,改变有限想知道为什么AI很牛但世界没变?看看马库斯一针见血的分析:智能不等于可靠,不能自主干活就没法颠覆一切。#Gary Marcus#AI可靠性#自主系统#行业观点Gary Marcus@GaryMarcus原文稍后读已读值得跟进有用关注 Gary Marcus
行业71°10:56Gary Marcus:AI虽聪明但不可靠,世界未变是因前提有误Gary Marcus一句话点透:AI再聪明,不可靠也是白搭。只有编码数学这种能验证的地方才是AI的用武之地。#Gary Marcus#AI可靠性#自主系统#编码Gary Marcus@GaryMarcus原文稍后读已读值得跟进有用关注 Gary Marcus
行业11:48Marcus评AI模型悖论:基准高分与现实应用差距大Gary Marcus一句话点破AI行业的真实痛点:基准测试再强,一到真实场景就露怯。适合关心AI落地效果的人。#Gary Marcus#Derek Thompson#AI可靠性#基准测试Gary Marcus@GaryMarcus原文稍后读已读值得跟进有用关注 Gary Marcus
论文13:00Nature Medicine研究指出医疗AI基准高分不等于临床就绪别被医疗AI的高分骗了,Nature Medicine这篇研究告诉你基准测试和真实临床差距有多大。#GPT-5.5 Pro#医疗AI#Nature Medicine#基准测试Gary Marcus@GaryMarcus原文稍后读已读值得跟进有用关注 GPT-5.5 Pro