09:29官方一手arXiv: DeepSeek@Ahmed Ryan, Md Erfan, Akond Ashfaque Ur Rahman, Md Rayhanur Rahman一项初步研究让6个开源权重LLM各尝试证明CoqStoq基准中的100个定理,每个定理只有一次机会,温度设为0,并用Coq内核验证结果。Gemma 4成功验证12个定理,Llama 3.3验证8个,DeepSeek Coder V2 Lite验证1个,Qwen 3.5、Mistral Small 3.1和GPT-OSS均未通过验证。全部21个成功结果覆盖15个不同定理,其中11个是标准Coq策略未能解决的。所有被验证的定理都只有短或中等人写参考证明,长证明定理无一成功。600次尝试中共产生21个内核验证证明,总体成功率3.5%。论文CoqGemma 4Llama 3.3推荐理由:这几个开源模型里Gemma 4最会写Coq证明,但100道题也只过12道,别指望它们太靠谱。原文稍后读已读值得跟进有用关注 Coq
09:28官方一手arXiv: DeepSeek@Zhuo Xie, Haoze Ni精选论文提出多源证据共识验证框架MECV,用于修正AI生成新闻摘要中的幻觉。MECV聚合源文档、维基百科和开放网页检索三类异构证据,并引入多LLM陪审团机制,通过矛盾感知共识评分评估事实可靠性。在SummEdits基准上使用GPT-4o-mini和DeepSeek-Chat作为验证模型、Qwen-Plus作为编排器进行实验。结果显示MECV在保持摘要语义结构的同时提升了事实一致性,跨源共识可作为识别事实不确定性的有效信号。论文MECVSummEditsGPT-4o-mini推荐理由:这篇论文解决AI摘要瞎编的问题,用多源证据+多模型投票来纠错,在SummEdits上验证有效,做新闻聚合的可以看看。原文稍后读已读值得跟进有用关注 MECV
09:25官方账号arXiv cs.AI@Modhurita Mitra, Jan-Willem Versteeg, Maarten D. Schermer, Shiva Nadi Najafabadi, Marie L. De Bruin, Lourens T. Bloem该论文提出一个基于schema的框架,用生成式AI从非结构化文本中提取层级化、嵌套式信息,并自动与金标准做语义评估。在卫生技术评估机构NICE的文档上,该框架用Claude Opus 3成功提取了14个属性中的12个,F1分数超过90%。提取单个文档的时间比人类领域专家快约30倍。研究还验证了该框架在不同生成式AI模型间的通用性,以及在不同HTA组织和语言间的可迁移性。论文Claude Opus 3NICE信息提取推荐理由:这篇论文用Claude Opus 3从NICE文档里自动提取结构化信息,F1超90%,速度比人工快30倍,做医疗评估的朋友可以看看。原文稍后读已读值得跟进有用关注 Claude Opus 3
09:23官方账号arXiv cs.AI@Eoin Cummins, Zhongyi Huang, Alexandre D'Hooge, Zhuoro Mo, Yaolong Ju论文发布SheetSage-A2S数据集,含61小时音频、9,468个片段,覆盖6,066首流行歌曲,是首个面向流行音乐的音频到乐谱数据集。研究者采用MuQ预训练特征提取模型与数据增强,提升泛化能力。在古典音乐Quartets集上实现4.98%符号错误率,显著优于现有最优方法的15.3%。在SheetSage-A2S流行音乐数据集上达到20.92%符号错误率,为后续研究提供强基准。数据集、模型和代码已在GitHub公开。论文SheetSage-A2SMuQ音频转乐谱推荐理由:这篇论文搞了个流行音乐专用的音频转乐谱数据集,用MuQ预训练模型,古典乐错误率从15.3%降到4.98%,还公开了代码,想做的可以直接上手。原文稍后读已读值得跟进有用关注 SheetSage-A2S
09:22官方账号arXiv cs.AI@Saugat Adhikari, Ashok Prasad Neupane, Pramish Paudel, Ajad Chhatkuli, Danda Pani PaudeliARCS 框架用迭代智能体强化学习,让预训练场景生成器适配自然语言任务要求。它采用两阶段策略:先用通用奖励预训练提升物理合理性,再用 LLM 生成的奖励程序做任务特定微调。实验在可步行性、可达性和间隙约束任务上提升了约束保真度,同时场景多样性保持竞争力。iARCS 生成的数据还能反过来改进基础生成器。AI模型iARCS3D场景生成强化学习推荐理由:iARCS 用强化学习让 3D 场景生成器听懂自然语言要求,走路、够东西这些约束都能满足,还能提升基础生成器。原文稍后读已读值得跟进有用关注 iARCS
09:21官方账号arXiv cs.AI@J. de Curtò, Dayani Plasencia, Diego Sánchez, I. de Zarzà这项研究通过输入消融测试,检查视觉语言模型(VLM)在零样本控制中是否真正依赖视觉输入。在9个直接控制模型、6个结构化局部VLM和1个VLM-MPC层级中,分析了32,874次评分调用。结果显示多数直接控制模型表现负面,常数SLOW策略甚至优于脚本几何控制器。图像仅确定性正对照以0.090米MAE和精确镜像等变性估算前车间距,证明视觉刺激信息充分。后验对称一致性守护者选出的模型在272帧上达到0.954平衡准确率,弃权时提升至0.973。论文VLM视觉语言模型具身智能推荐理由:这篇论文用消融实验戳穿了VLM做零样本控制的假象,多数模型其实没在看图像。还给出了一个能到0.973准确率的守护方案,想搞具身智能的值得看。原文稍后读已读值得跟进有用关注 VLM
09:18官方账号arXiv cs.AI@Thomas H. Costello, Nathaniel Rabb, Michael Nicholas Stagnaro, Gordon Pennycook, David Rand在2024年7月特朗普刺杀未遂和2025年9月Charlie Kirk刺杀事件后,美国成年人(实验1 N=472,实验2 N=1035)与LLM进行多轮对话,其阴谋论信念相比对照组显著下降。对照组分别与LLM讨论无关话题或查看静态事实表。干预效果在1至2个月后的后续危机事件中仍可观测到,对不同阴谋论的信念同样降低。研究提示,基于LLM的对话干预能在重大事件后即时抑制错误信息。论文LLM阴谋论错误信息推荐理由:这篇论文让LLM当对话对手,跟人聊几轮就能把阴谋论信念聊下来,比干看事实清单管用,效果还能延续一两个月。原文稍后读已读值得跟进有用关注 LLM
09:16Genspark@genspark_ai精选今年AI智能的单位成本下降约10倍,但企业AI账单不降反升。原因并非单价上涨,而是智能体进入生产:一个会自主研究、规划、修改的智能体可消耗数百万token,而普通聊天机器人仅消耗数千。Genspark 认为,真正的优化指标应是每个成功任务的成本,而非每token成本。行业Gensparktoken智能体1 个信源在谈事件专题推荐理由:Genspark 算账:token 单价降了 10 倍,智能体任务烧 token 太狠,总账单反而涨。省钱得盯单次任务成本,别只看单价。原文稍后读已读值得跟进有用关注 Genspark
09:12官方账号Replit@ReplitReplit在X上宣布,一场由14,075人同时参与的AI直播课程被吉尼斯世界纪录认证为最大AI视频课程。该活动由@KanzHire发起,所有参与者在线共同完成构建。Replit官方账号发布了这一消息,并祝贺了KanzHire及所有到场者。行业Replit吉尼斯纪录AI教育推荐理由:Replit组织了一万四千多人的AI直播课,直接破了吉尼斯纪录,看看他们怎么做到的。原文稍后读已读值得跟进有用关注 Replit
09:11Tw93@HiTw93Kami v1.12是一个稳定性更新,没有新模板或新外观。新版会在排版前先规划文档结构。它只修改用户指定的部分,已批准的页面保持不变。工具会如实告知检查了哪些内容、跳过了哪些内容。构建失败时不会覆盖上一份可用的PDF文件。AI产品Kami文档排版PDF推荐理由:Kami v1.12更稳了,排版前先规划,只动你让它动的地方,构建失败也不毁旧PDF,适合经常处理文档的人。原文稍后读已读值得跟进有用关注 Kami
08:47Notion@NotionHQEdgecity是一个为期一个月的快闪村庄,聚集了1000人共同构建和测试新的生活方式。Notion官方采访了其创始人,展示了他们如何用Notion管理这个项目。他们的共享日历每15分钟更新一次,同时使用智能体来整合共享上下文。这体现了Notion在复杂社区协作中的具体应用。技巧EdgecityNotion智能体推荐理由:看看Edgecity怎么用Notion管1000人的快闪村,日历15分钟一更,还有智能体帮忙同步信息。原文稍后读已读值得跟进有用关注 Edgecity
08:46官方账号Replit@ReplitReplit 官方宣布,Clerk Pro 客户现可为 Replit 应用配置 Okta 或 Entra ID 作为身份提供商。用户只需让智能体设置 SSO,支持 OIDC 和 SAML 两种协议。该功能在 10 月 1 日前免费使用。AI产品ReplitClerkOkta推荐理由:Replit 现在能用 Okta 或 Entra ID 单点登录,让智能体配置就行,10月1日前不收钱,试试呗。原文稍后读已读值得跟进有用关注 Replit
08:45IT之家(博客/媒体)DeepSeek 宣布近期整体上调 API 定价,预计涨幅较大,按输入输出 Token 分缓存命中情况计费。OpenAI 将 ChatGPT 免费用户默认模型升级为 GPT-5.6 Luna,并为 Plus 和 Pro 用户更新聊天界面。字节跳动被曝正讨论训练超 5 万亿参数模型,由 Seed Foundation 负责人项亮主导。宇树科技科创板发行价定为 150.8 元/股,市盈率 219.23 倍。苹果上调多款设备以旧换新折抵价,最高达 25%。行业DeepSeekOpenAIGPT-5.610 个信源在谈事件专题推荐理由:DeepSeek API 要大涨价,OpenAI 免费用户用上 GPT-5.6 Luna,字节还打算训 5 万亿参数模型,这条早报全都有。原文稍后读已读值得跟进有用关注 DeepSeek
08:43Geek@geekbbOpenAI 宣布 GPT-5.6 Sol 现在为 Plus 和 Pro 用户提供即时与深度推理,响应更准确、更聚焦。免费版和 Go 用户从明天起可无限使用 GPT-5.6 Luna 进行文本聊天。这是 GPT-5.6 系列首次向免费层级开放无限使用,降低了高端模型的体验门槛。AI产品GPT-5.6ChatGPTOpenAI10 个信源在谈事件专题推荐理由:OpenAI 把 GPT-5.6 Luna 免费了,明天起无限聊,Plus/Pro 用户还能用 Sol 的推理模式。原文稍后读已读值得跟进有用关注 GPT-5.6
08:41IT之家(博客/媒体)精选AMD 于 8 月 7 日公告计划收购 AI 推理芯片初创公司 Taalas。Taalas 的芯片针对单一 AI 模型定制,基于 Meta 的 Llama 3.1 模型,采用台积电成熟工艺和高速 SRAM,特定模型输出速度比传统 GPU 快数千倍。该方案牺牲通用性以换取更低成本和更高速度,且芯片绑定特定模型无法升级。Taalas CEO 称其平台可将任意 AI 模型转化为定制硅片,并能在 2 个月内完成新模型适配。Taalas 自 2023 年成立以来累计融资 2.19 亿美元,交易规模未披露。行业TaalasAMD收购推荐理由:AMD 要收购 Taalas,这家公司做定制 AI 推理芯片,比 GPU 快几千倍,但绑定单个模型,适合想了解 AI 芯片新路线的人。原文稍后读已读值得跟进有用关注 Taalas
08:16Amjad Masad@amasadAirtable被作者看作无代码运动兴起与衰落的完整注脚。他回忆曾与投资者反复争论,坚持UI永远无法构建任意软件,普及软件开发必须解决代码本身的问题。当时这种观点被视作妄想,如今正在成为现实。行业Airtable无代码Amjad Masad推荐理由:Amjad Masad这帖子把无代码的局限说得很清楚:Airtable的起落证明光靠界面拼不出任意软件,最终还得回到代码本身。原文稍后读已读值得跟进有用关注 Airtable
08:11a16z@a16z71°a16z官方账号发布访谈视频,vLLM维护者、Inferact CEO Simon Mo与合伙人Matt Bornstein讨论开源权重模型的价值。Simon Mo认为世界不能被专有API垄断,闭源模型成本过高,而开源权重允许企业自行控制基础设施、扩展模型或添加护栏。他提到,控制问题近两年一直重要,成本问题从近几个月开始凸显,例如语音智能体公司需要自有模型保证响应时间。访谈还提及vLLM目前在任意时刻运行于约50万块GPU上,并讨论了Kimi K3的发布与开源模型许可证变化。行业开源模型vLLMInferact10 个信源在谈事件专题推荐理由:Simon Mo是vLLM作者,他讲开源权重模型怎么在成本和控制上赢过闭源API,还吐槽专有API宕机问题,适合做线上服务的开发者。原文稍后读已读值得跟进有用关注 开源模型
08:10Paul Graham@paulgPaul Graham在X上发帖(17238次查看)称,用更抽象的语言编写代码能降低LLM生成时的token成本。他认为LLM并不排斥前缀表示法,这也是抽象语言值得尝试的原因(该帖有35条评论)。这条推文获得161个赞、6次转发和42次分享。技巧Paul GrahamLLMtoken成本推荐理由:Paul Graham说,想让LLM写代码更省token,就换更抽象的语言,连前缀表示法它也不怕。原文稍后读已读值得跟进有用关注 Paul Graham
08:06IT之家(博客/媒体)82°消息源@synthwavedd在X平台爆料,OpenAI目标下周发布内部代号为mewfour的Astra模型。该模型是OpenAI自GPT-4.5以来训练的最大预训练模型。其内部版本已解出10个重要开放数学问题,按Sol API费率计算消耗约2,000美元词元成本。该模型可组织和协同AI智能体,面向长周期、高难度任务的推理与协作工作流。AI模型OpenAIAstraGPT-4.510 个信源在谈事件专题推荐理由:OpenAI下周可能要发Astra,是GPT-4.5以来最大模型,能解10道数学难题,还能调度智能体干活。原文稍后读已读值得跟进有用关注 OpenAI
07:50Fireworks AI@FireworksAI_HQFireworks AI官方账号预告了MongoDB将于8月13日12:30至20:00在旧金山Pier 48举办The Persistent Context Sprint Hackathon。参赛者要在不到一天的时间内完成构建,并在全球舞台上展示成果。报名入口为cerebralvalley.ai/e/persistent-c…。行业MongoDBFireworks AIPersistent Context推荐理由:MongoDB周四旧金山办黑客松,半天做demo能上台秀。Fireworks AI吆喝,想玩可报名。原文稍后读已读值得跟进有用关注 MongoDB
07:49IT之家(博客/媒体)82°杰夫·迪恩在谷歌效力27年后离职,与桑杰·格马瓦特、郭乐、奥里奥尔·维尼亚尔斯共同创办公益性公司Discovery Loop。该公司定位为利用人工智能加速科学研究,通过自动化完整实验循环来提升创新效率。首轮融资由Radical Ventures和Khosla Ventures共同领投,Alphabet、Kleiner Perkins、Lightspeed和Doerr Capital参与投资。迪恩是谷歌第30位员工,离职前担任首席科学家。行业Jeff DeanDiscovery Loop谷歌10 个信源在谈事件专题推荐理由:Jeff Dean离开谷歌另起炉灶,叫上几位老同事搞了个AI科研公司Discovery Loop,目标是把实验自动化,加速科学发现,Alphabet还投了钱。原文稍后读已读值得跟进有用关注 Jeff Dean
07:48IT之家(博客/媒体)SpaceX 与特斯拉将首期投入 168 亿美元(约合 1,136.05 亿元人民币),在得克萨斯州格赖姆斯县建设 Terafab 先进 AI 芯片制造基地。SpaceX 表示将自建天然气发电厂和超大型电池阵列为厂区供电,不接入得州电网机构 ERCOT 的主电网。该公司还回应环保担忧,称不会推高其他用电户电费、耗尽当地水源或导致纳瓦索塔河水位下降。SpaceX 确认拥有纳瓦索塔河抽水站,计划将雨水引入吉本斯溪水库。行业SpaceX特斯拉Terafab2 个信源在谈事件专题推荐理由:SpaceX 和特斯拉投 168 亿美元建 AI 芯片厂,还要自建发电厂供电,不接得州主电网。有看头。原文稍后读已读值得跟进有用关注 SpaceX
07:46官方账号Greg Brockman@gdbEthan Bloch在GPT-5.2上开展的个人财务AI实验获得良好结果。OpenAI的个人财务基准曾显示,从5.3到5.5版本有巨大提升,该实验如果今天运行成绩会更好。目前模型已推进到5.6,作者称虽无外部基准,但性能更优。AI模型GPT-5.2OpenAI个人财务10 个信源在谈事件专题推荐理由:OpenAI的人说GPT-5.6在个人财务上更强了,还有5.2的实验结果和5.3到5.5的基准对比,想了解AI理财能力的可以看。原文稍后读已读值得跟进有用关注 GPT-5.2
07:44IT之家(博客/媒体)76°英伟达为应对HBM内存供应短缺,考虑降低Rubin Ultra GPU的HBM配置。据The Information援引3名知情人士,英伟达已测试至少3种低HBM配置,容量低于最初公布规格。TrendForce分析称,NVIDIA可能从HBM4E下调至HBM4,或将12Hi HBM降至8Hi。这一调整影响Rubin Ultra性能,但英伟达正从其他方面弥补。行业NVIDIARubin UltraHBM4E8 个信源在谈事件专题推荐理由:英伟达HBM不够用,Rubin Ultra可能要降配,从HBM4E降到HBM4。想了解性能缩水多少,看这个。原文稍后读已读值得跟进有用关注 NVIDIA
07:41Fireworks AI@FireworksAI_HQFireworks AI 与 MongoDB 将于8月13日在旧金山 Pier 48 举办“The Persistent Context Sprint Hackathon”,活动时间为当地 12:30 至 20:00。参赛者可在一天内完成构建,并有机会在全球舞台展示。主办方通过 CerebralValley 平台开放报名。本次活动聚焦持久上下文(persistent context)主题,适合开发者参与。行业Fireworks AIMongoDB黑客松推荐理由:想一天做出 demo 上全球舞台,8月13日旧金山 Pier 48 有 MongoDB 和 Fireworks AI 联办的黑客松,报名链接在活动页。原文稍后读已读值得跟进有用关注 Fireworks AI
07:32techcrunch@Lucas Ropek76°据TechCrunch报道,OpenAI尚未发布的AI智能音箱设备定价在300至400美元之间。该设备定位为高端智能音箱,与苹果HomePod等产品形成竞争。目前OpenAI官方尚未确认具体规格与功能细节,但推测将深度集成其AI能力。AI产品OpenAI智能音箱AI硬件10 个信源在谈事件专题推荐理由:OpenAI要出智能音箱了,说卖300到400美元,比HomePod还贵,想知道它凭啥卖这么贵可以关注下。原文稍后读已读值得跟进有用关注 OpenAI
07:28Richard Socher@RichardSocherRecursive AI任命Laura Moss为首席财务官。她曾在Cohere担任SVP Finance超过三年。她还在Google工作逾七年,涉及技术基础设施和YouTube财务。她拥有沃顿商学院MBA和杜克大学生物医学工程学士学位。行业Recursive AILaura MossCohere推荐理由:Richard Socher的Recursive AI请来Cohere前SVP Finance Laura Moss当CFO,谷歌干过7年,负责管钱,大模型烧钱节奏要加快。原文稍后读已读值得跟进有用关注 Recursive AI
07:22IT之家(博客/媒体)76°彭博社马克·古尔曼爆料,OpenAI 首款 AI 硬件采用甜甜圈造型,大小约等于冰球,体积约 115.8 立方厘米。该设备售价预估在 300 到 400 美元(约合 2029 至 2705 元人民币),计划 2027 年发布。它本质上是没有显示屏的智能音箱,由 OpenAI 与前苹果设计师乔纳森·伊夫合作开发,面向家庭场景。硬件配备可移动部件、灯光、摄像头和传感器,交互方式类似 ChatGPT 语音模式,将使用更先进的模型。AI产品OpenAIChatGPTAI硬件10 个信源在谈事件专题推荐理由:古尔曼说 OpenAI 和苹果前设计师在搞甜甜圈 AI 音箱,纯语音操作,2027 年卖 300 美元起。原文稍后读已读值得跟进有用关注 OpenAI
07:17IT之家(博客/媒体)英伟达在2026年黑帽大会上宣布开源cuFile API及其底层存储软件栈。cuFile是GPUDirect Storage技术的接口组件,2021年7月随CUDA Toolkit 11.4发布。该技术通过DMA让NVMe等存储设备直接向GPU传数据,绕过主内存中转,延迟可低至毫秒级。这能缓解AI推理中GPU因等待数据而闲置的“GPU饥饿”问题,也有助于RAG和智能体AI快速读取大型数据集。英伟达还发布了覆盖40家存储与闪存厂商的Storage-Next倡议。AI产品英伟达cuFileGPUDirect Storage推荐理由:英伟达把cuFile开源了,SSD能直接给GPU喂数据,游戏和AI推理都不容易卡了,搞存储的可以看看。原文稍后读已读值得跟进有用关注 英伟达
07:13官方账号Greg Brockman@gdb71°OpenAI 推出 Codex Security Review 研究预览版。该功能会自动审查 GitHub 拉取请求中的安全漏洞,并利用仓库上下文直接在 PR 中给出可操作的修改建议。开发者可通过 learn.chatgpt.com/docs/security 文档启用自动审查。OpenAI 表示这是提升代码与公司整体安全性的计划之一。AI产品CodexGitHubOpenAI10 个信源在谈事件专题推荐理由:OpenAI 给 Codex 加了自动安全审查能力,直接在每个 GitHub PR 上挑毛病并写评论,团队不用手动盯代码了。原文稍后读已读值得跟进有用关注 Codex
07:12官方账号Greg Brockman@gdb精选72°Black Hat 演讲围绕 OpenAI-Hugging Face 事件展开,用时间线还原了事件的发展过程。演讲者总结了该事件对 AI 安全实践的几点启示,包括防御和响应方面的教训。完整视频可在 YouTube 观看。行业OpenAIHugging FaceBlack Hat10 个信源在谈事件专题推荐理由:Black Hat 上这场演讲把 OpenAI 和 Hugging Face 那次风波从头到尾捋了一遍,适合想知道安全团队怎么复盘的人。原文稍后读已读值得跟进有用关注 OpenAI
07:11Jerry Liu@jerryjliu0AI初创公司Explabs AI今日在Y Combinator(YC)正式上线。该公司宣称其自动化服务可将AI成本降低最多97%,同时质量提升50%。该服务基于hillclimbing(爬山算法),面向任意agentic任务。创始人Silen Naihin是AutoGPT项目早期参与者。AI产品Explabs AIYCAutoGPT推荐理由:Explabs AI上线YC了,做AI任务自动化优化的,说成本能砍97%、质量还能涨50%,听着挺猛,来瞅瞅。原文稍后读已读值得跟进有用关注 Explabs AI
06:56IT之家(博客/媒体)81°OpenAI 于 8 月 7 日更新 ChatGPT,免费用户默认模型升级为 GPT-5.6 Luna。Plus 和 Pro 用户的常规对话界面启用 GPT-5.6 Sol,官方称其回答的事实准确性更高、重点更突出。新界面加入思考深度滑动条,用户可调节每条回复的推理强度。下周起免费用户将获得无限次文本聊天权限,复杂问题可通过“思考”按钮调用高级推理能力。文件上传和图像生成等工具的使用限制仍然存在。AI产品ChatGPTGPT-5.6OpenAI10 个信源在谈事件专题推荐理由:OpenAI 把免费用户默认模型换成了 GPT-5.6 Luna,下周起无限次聊天随便用,Plus 用户还能用滑动条调思考深度。原文稍后读已读值得跟进有用关注 ChatGPT
06:45官方账号Cohere@cohereCohere宣布与滑铁卢大学合作推出新的AI转型与变革管理证书课程。该课程面向希望帮助组织采用AI的学生,重点覆盖安全与负责任的使用实践。Cohere总部位于多伦多,此次合作旨在培养加拿大下一代AI人才。行业Cohere滑铁卢大学AI转型推荐理由:Cohere和滑铁卢大学出了个AI转型管理证书,专门教企业怎么安心落地AI,想学这类技能可以关注。原文稍后读已读值得跟进有用关注 Cohere
06:41Google AI Developers@googleaidevsAntigravity 提供一组命令,用于在 CLI 中导航、管理后台任务、配置工具并运行研究子代理。这些命令由官方账号 @googleaidevs 在 X 上推荐,并附有一篇详细文章。使用这些 Antigravity 命令可以减少手工操作,让 CLI、后台任务和研究子代理的调度更连贯。技巧AntigravityCLI智能体推荐理由:Antigravity 官方发了一组命令,能帮你顺手搞定 CLI 导航、后台任务和研究子代理,省得来回折腾。原文稍后读已读值得跟进有用关注 Antigravity
06:40官方账号Simon Willison@simonw精选Simon Willison 在 X 上询问,ChatGPT 中的 GPT-5.6 Instant 对应 OpenAI API 的具体模型标识。这条推文已有 849 次浏览,但截至当前仍无官方解答。OpenAI 在 ChatGPT 与 API 之间的模型命名存在差异,开发者需要自行确认对应关系。AI模型GPT-5.6 InstantOpenAIChatGPT10 个信源在谈事件专题推荐理由:OpenAI 模型命名总绕晕人,Simon 这条提问正好点破,想弄懂 ChatGPT 和 API 对应关系可以看下。原文稍后读已读值得跟进有用关注 GPT-5.6 Instant
06:39官方一手@OpenAIDevs@OpenAIDevs72°OpenAI 推出 Codex Security Review 研究预览,可深入审查 GitHub 拉取请求中的安全问题。它利用仓库上下文信息,直接在 PR 中呈现可行动的安全发现。开发者可以配置自动审查功能,相关文档已在 learn.chatgpt.com 上公开。该工具当前处于研究预览阶段,面向开发者群体开放试用。AI产品CodexGitHubOpenAI10 个信源在谈事件专题推荐理由:OpenAI 出了个新工具,能自动扫 GitHub PR 的安全漏洞,直接在 PR 里给结果,适合开发团队试试。原文稍后读已读值得跟进有用关注 Codex
06:16官方账号LangChain@LangChainAI精选Backops AI 推出面向供应链与复杂运营的 AI 原生处理层。其智能体可端到端处理理赔申报、邮件读取和系统更新等运营流程。该初创公司使用 LangSmith 跟踪多步骤智能体运行,并通过评估器与性能指标捕捉回归问题。目前 BackOps 正在招聘相关人员。AI产品BackopsLangSmith智能体推荐理由:Backops AI 用智能体处理理赔、邮件、系统更新,靠 LangSmith 防回归。他们在招人。原文稍后读已读值得跟进有用关注 Backops
05:49a16z@a16z精选a16z的Yoko Li表示,最先跑通的智能体循环是编码循环。原因是代码既可编辑又可执行:智能体能修改一个函数、运行程序、读取测试失败并重试。她认为循环取决于两个轴:工件的可编辑性和结果的可验证性。代码通常落在右上角,易编辑且有强验证器;开放式图像生成落在左下角,难以修复单点决策或验证结果更接近用户意图。行业a16z智能体agent loops推荐理由:a16z的Yoko Li讲清了智能体循环:编码先跑通,因为代码能改能验,图像生成就差在可验证性。观点挺实在。原文稍后读已读值得跟进有用关注 a16z
05:44Notion@NotionHQEdge Esmeralda是一个为期一个月的快闪村,1000人聚在一起构建并试验新的生活方式。创始人使用Notion来管理整个项目,包括一个每15分钟自动刷新的日历。他们还用智能体将共享上下文应用到决策和协作中。Notion官方采访了创始人,公开了这套运行机制。技巧Edge EsmeraldaNotion智能体推荐理由:看看Edge Esmeralda的创始人怎么用Notion管一个千人的临时村落,日历15分钟自动更新,智能体还能把共享上下文派上用场。原文稍后读已读值得跟进有用关注 Edge Esmeralda