00:43elvis@omarsar0Octen在DeepResearch Bench上得分比OpenAI、Gemini、Grok和Perplexity高10到17分。它能在3分钟内返回带来源的完整报告,而其他工具需要长达一小时。Octen同时实现了速度和准确性,这在网页搜索中罕见。AI产品OctenDeepResearch Bench搜索10 个信源在谈事件专题推荐理由:Octen的网页搜索又快又准,3分钟出报告,比OpenAI等快得多,基准还高10多分,做AI搜索的值得看看。原文稍后读已读值得跟进有用关注 Octen
11:54Gary Marcus@GaryMarcusGary Marcus 分享《金融时报》文章,质疑扩展计算规模能否解决 AI 的根本准确性难题。文章指出,尽管算力投入持续增加,但大模型在事实核查和推理任务上仍频繁出错。Marcus 认为依赖更大规模数据与参数并非提升可靠性的出路。该观点挑战了当前主流的大规模训练范式。行业Gary Marcus计算量准确性推荐理由:FT的分析文章,Gary Marcus 转评,核心观点很明确:堆算力解决不了AI的准确率问题,值得看看他为什么这么讲。原文稍后读已读值得跟进有用关注 Gary Marcus