14:03官方账号Greg Brockman@gdbgdb在X平台分享ChatGPT使用体验,称其进行研究和事实核查非常彻底。该推文获得351次点赞、58条回复和69次收藏,浏览量超1.5万。gdb表示ChatGPT在核查事实细节方面表现出色,但未透露所用版本。技巧ChatGPTgdb事实核查推荐理由:OpenAI的gdb说用ChatGPT做研究查证特别爽,体验很赞,推文三百多赞,你也试试?原文稍后读已读值得跟进有用关注 ChatGPT
04:05官方一手OpenAI Blog(博客/媒体)Axel Springer、Le Monde等新闻机构使用OpenAI的GPT-4等工具来辅助事实核查、内容摘要和个性化推荐。英国《卫报》采用AI进行评论审核,将有害内容识别效率提升50%。纽约时报利用AI生成音频版文章,覆盖更多用户。这些案例表明AI正在帮助新闻业在降低成本的同时提升报道质量与受众覆盖。行业OpenAI新闻机构GPT-410 个信源在谈事件专题推荐理由:OpenAI分享了Axel Springer、Le Monde等新闻机构用GPT-4做事实核查和内容摘要的真实案例,很直观。原文稍后读已读值得跟进有用关注 OpenAI
09:38官方账号arXiv cs.AI@Haoxuan Li, Tianci Gao, Jianhe Li, Yang Fan, Runze Shi, Weiran Wang, Tianxiang Zhao, Zezhao Wu, Xiaoyang Jiang, Qihui Zhang, Jia Li, Xiao Xiao, Kai Du, Xiaoxuan Jia, Chao Xie, Lu MiBrainPilot 是一个完全开源的多智能体系统,旨在自动化脑科学发现过程。该系统包含一个统一脑科学知识库(7233个索引条目)和技能库(72个可复用方法单元),覆盖七个研究领域。每个步骤记录在Graph of Trace中,提供可审计的日志,同时Auditor agent负责检查编造内容。在Agents' Last Exam的三个脑科学任务及自建基准BrainPilotBench-v0上,BrainPilot使用开源骨干模型达到与SOTA框架相当的性能,且成本更低。论文BrainPilot多智能体脑科学推荐理由:脑科学研究有多繁琐你懂的,BrainPilot开源出来帮你自动查文献、做分析、防编造,性能不输顶级框架还省钱。原文稍后读已读值得跟进有用关注 BrainPilot
03:03techcrunch@Sarah PerezElon Musk宣布X平台将推出更新,当用户对帖子进行点赞、回复或转发后,若该帖子被添加Community Notes,系统会通过直接消息(DM)通知用户。这一功能旨在解决社区事实核查常滞后于虚假信息传播的批评。目前该更新尚未正式上线,但已通过Musk的推文公开。AI产品XElon MuskCommunity Notes推荐理由:你之前点赞转发的帖子可能已经被辟谣了,X现在会直接发私信提醒你,省得你一直蒙在鼓里。原文稍后读已读值得跟进有用关注 X
06:28AK@_akhaliqData Journalist Agent是一个能将结构化数据自动转化为多模态报道的智能体,输出包括图表、文本和视频。它内置事实核查机制,每一条数据均可追溯原始来源。这个智能体旨在提升数据新闻的生产效率和可信度。AI模型Data Journalist Agent智能体多模态推荐理由:这个Data Journalist Agent能自动把数据做成带验证的图文视频报道,做数据新闻的不用手动整合多模态了原文稍后读已读值得跟进有用关注 Data Journalist Agent
10:12SuperTechFans(博客/媒体)Hacker News 热议 AI 提升白领生产力可能带来四天工作制,但评论指出收益多被资本攫取,员工面临裁员风险而非休假。YouTube 宣布从 2026 年 5 月起自动为逼真 AI 视频打标,但用户担忧低质高刺激内容让儿童与老人沉迷。Anthropic 发布 Claude Opus 4.8,小幅改进编码与推理,但社区更看好小模型强化方法。前沿 LLM 在事实核查上分歧显著,缺乏“我不知道”选项削弱可信度。FBI 拘捕藏有约四千万美元金条的 CIA 高官,舆论聚焦低级失误。行业AI 生产力四天工作制AI 标签10 个信源在谈事件专题推荐理由:AI 生产力提升的分配问题直接关系到每个白领的未来,做技术或管理的读者看完会反思自己的处境;YouTube 的 AI 标签政策影响内容生态,创作者和用户都该了解。原文稍后读已读值得跟进有用关注 AI 生产力
15:37官方账号Decoder@Jonathan Kemper精选北京大学研究人员发现,GPT、Gemini等主流AI模型在文档分析中经常给出正确答案,但引用的文本段落并不支持其结论。这种现象被称为“归因幻觉”,在法律、医学等需要严格引用来源的领域存在风险。为系统检测这一问题,团队推出了首个专门基准测试CiteVQA。该研究揭示了AI在推理与引用之间的不一致性,对依赖AI进行事实核查的用户具有警示意义。论文归因幻觉CiteVQAGPT推荐理由:做文档分析或事实核查的开发者要注意了——AI可能答对了但引用了错误来源,北大这个新基准能帮你识别这类风险,建议点开了解如何防范。原文稍后读已读值得跟进有用关注 归因幻觉
13:05官方账号Greg Brockman@gdbEthan Mollick 在 X 上分享使用 GPT-5.5 Pro 进行事实核查的体验,称其能准确追踪整章内容中的关键引用。该模型擅长捕捉细微差别,但会频繁指出“大致正确但忽略细节 X”的问题。这表明 GPT-5.5 Pro 在学术写作、内容审核等需要高精度事实验证的场景中具有实用价值。AI产品GPT-5.5 Pro事实核查学术写作7 个信源在谈事件专题推荐理由:做学术写作或内容审核的团队,GPT-5.5 Pro 能帮你省下大量人工核查时间,建议试试整章投喂的体验。原文稍后读已读值得跟进有用关注 GPT-5.5 Pro
21:36官方账号Simon Willison’s Weblog(博客/媒体)纽约时报发布编辑注,承认一篇报道中错误地将 AI 生成的摘要当作加拿大保守党领袖 Pierre Poilievre 的真实引文。该 AI 工具生成了对 Poilievre 政治观点的总结,并以引号形式呈现,记者未核实其准确性。文章现已更正,引用了 Poilievre 在 4 月演讲中的真实内容。此事件凸显了 AI 在新闻业中可能引发的幻觉和事实核查风险。行业AI 伦理幻觉新闻业推荐理由:新闻编辑室和内容创作者必须警惕 AI 工具生成虚假引文的风险——纽约时报的这次失误是活生生的教训,做事实核查的团队建议仔细看。原文稍后读已读值得跟进有用关注 AI 伦理