17:43官方账号arXiv cs.AI@Jin Lu, Xuening Han, Yang Zhong, Lin Tan, Kevin Luo, Andrew Gacek, Neha RungtaVICBench 面向代码漏洞检测,包含 100 个经人工专家与智能体工作流双重验证的漏洞引入提交,对应 100 个 CVE,覆盖 88 个项目的 Python、Java、C++ 代码。该基准涵盖 48 种 CWE 类型,修复补丁平均 38.6 行,漏洞引入提交平均 252.5 行,复杂度高于此前数据集。评测中,现有最先进的 V-SZZ 和 LLM4SZZ 算法 F1 值仅为 33.3%-40.1%,表明自动化检测仍需大量人工介入。VICBench 能更可靠地评估漏洞检测方法的真实表现。论文VICBenchCVE漏洞检测推荐理由:VICBench 搞了个 100 个真实漏洞提交的基准,覆盖 Python/Java/C++,平均改动比旧数据集大不少,测漏洞检测用它更靠谱。原文稍后读已读值得跟进有用关注 VICBench
17:43官方账号arXiv cs.AI@Saman Marandi, Yu-Shu Hu, Mohammad Modarres该研究提出利用检索增强生成和大语言模型,从系统描述中自动构建动态主逻辑模型,并表示为知识图谱(KG-DML)。方法沿DML层级进行定向检索,保留功能依赖和显式逻辑关系,支持故障向上传播和向下依赖追踪。验证应用于一座退役沸水反应堆的低压冷却剂注入系统,重复运行结果一致。多级评估覆盖各层精度、召回率、逻辑门一致性与结构完整性,证明自动化构建可将技术文档转为可用于诊断和可靠性分析的可执行功能模型。论文DML知识图谱RAG推荐理由:这篇论文讲怎么用RAG和LLM把技术文档自动变成知识图谱,用在反应堆诊断上,跑得还稳,搞可靠性的可以看看。原文稍后读已读值得跟进有用关注 DML
17:43orange.ai@oran_geDeepSeek V4 Pro 0813正式版发布。从评测指标看,该模型有两项指标超越Fable,多项指标超越Opus 4.8。Fable仍被认为是难以逾越的高山,但V4 Pro的推理成本比Fable便宜约100倍。官方强调这是涨价前的价格,后续可能调整。AI模型DeepSeekV4 ProFable推荐理由:DeepSeek出了V4 Pro 0813,多项跑分超过Opus 4.8,比Fable便宜100倍,想省钱又想要性能的可以看看。原文稍后读已读值得跟进有用关注 DeepSeek
17:43IT之家(博客/媒体)约克大学与卡尔加里大学分析了Reddit上2023年2月至2026年3月间的3801个LLM热门帖子,筛选出446个AI编程安全相关帖子及6000多条评论。研究显示2025年7月是问题帖子数量最多的月份。按工具划分,Cursor报告的问题最多,其次是Claude、Codex、Copilot等。Cursor多涉及运行安全和未授权数据访问,而Claude的问题主要与第三方工具集成风险相关。论文CursorClaudeAI编程9 个信源在谈事件专题推荐理由:约克大学和卡尔加里大学扒了6000条Reddit评论,发现AI编程工具里Cursor出事最多,Claude的第三方集成风险也高,用AI写代码的可以看看。原文稍后读已读值得跟进有用关注 Cursor
17:43官方账号arXiv cs.AI@Kazi Nabiul Alam, Pooneh Bagheri Zadeh, Akbar Sheikh-AkbariSGNet 用分组卷积和深度空间路径分离光谱与空间特征,引入通道挤压激发与空间门控双注意力。在自建 16 天冷藏三文鱼片数据集上,准确率 97.8%,MAE 0.64 天,参数仅 4.75M。相比 ResNet-50 和 Vision Transformer,参数降低 5 至 18 倍。消融实验证明了各组件贡献,面向工业实时预测的域感知设计有效。论文SGNet高光谱成像鱼类新鲜度推荐理由:SGNet 只 4.75M 参数,就达到 97.8% 准确率,比 ResNet-50、ViT 小 5-18 倍,适合工业鱼类新鲜度检测。原文稍后读已读值得跟进有用关注 SGNet
17:43Scott Wu@ScottWu46精选Hone 是一家新公司,创始团队来自 Cognition、Mercor、Ramp 和 OpenAI。Hone 构建能持续创造、编排并改进智能体和软件的 AI,目标是在数周至数月内承担组织级成果。团队认为,模型能力与经济价值之间的差距在扩大,需要围绕组织成果而非单个任务重构工作。Scott Wu 在 X 上转发该公告,并表示“有时你就是知道”。AI产品HoneOpenAICognition10 个信源在谈事件专题推荐理由:OpenAI、Cognition 老将成立 Hone,说要用 AI 长期打理组织目标,专治模型强但落地难的问题。原文稍后读已读值得跟进有用关注 Hone
17:43官方账号arXiv cs.AI@Avijit Roy, Proma Roy论文以孟加拉语为例,分析AI教育工具在低连接环境中的结构性障碍。孟加拉语占全球人口近4%,但全球网页内容占比不足0.5%。主要多语语料库中,英语与孟加拉语的训练token比例达67:1。孟加拉语的元音附标文字还带来额外的token化惩罚,加剧数据短缺。农村地区个人互联网普及率为36.5%,城市为71.4%,形成连接排斥。论文孟加拉语低资源语言tokenization推荐理由:这篇论文讲孟加拉语在AI基建里的吃亏,67:1的token差距和36.5%的农村联网率是硬数据。原文稍后读已读值得跟进有用关注 孟加拉语
17:43向阳乔木@vista8用户对比Grok 4.6与DeepSeek v4 Pro 0813,称前者一次成功率略高。价格上DeepSeek v4 Pro 0813更有优势。作者指出测试主观且生成随机,实际还需生产环境长期验证。AI模型GrokDeepSeek模型对比推荐理由:有人拿Grok 4.6和DeepSeek v4 Pro 0813比了比,说成功率Grok稍好,但DeepSeek便宜不少,预算有限选它更香。原文稍后读已读值得跟进有用关注 Grok
17:42techcrunch@Aisha MalikFacebook正式推出独立的Creator Studio应用。新应用内置Facebook的AI创作者助手。该助手根据内容风格、表现、受众互动和目标提供个性化推荐。AI产品FacebookCreator StudioAI助手推荐理由:Facebook把Creator Studio做成独立App了,还内置AI助手,能按你的风格和粉丝互动给推荐,做内容可以去试试。原文稍后读已读值得跟进有用关注 Facebook
17:42lmarena.ai@lmarena_aiArena.ai近期公开了关于AutoEval的更多细节。该推文由Arena.ai官方账号发布,并附带了相关链接。AutoEval的具体技术方案与评测基准尚未在推文中展开。目前这条推文已有550次浏览,读者可点击原文查看AutoEval的完整信息。AI产品AutoEvalArena.ai模型评估推荐理由:Arena.ai发了AutoEval的更多细节,想知道这评估工具是干嘛的,直接看原文。原文稍后读已读值得跟进有用关注 AutoEval
17:42The Rundown AI@therundownaiPaul Conyngham用ChatGPT和AlphaFold设计个性化mRNA癌症疫苗,治疗自家救援犬Rosie的肿瘤,多个肿瘤出现缩小。他由此创立Gamgee(YC S26),为其他狗狗提供个性化疫苗。目前Gamgee的试验已在澳大利亚启动,并面向全球接收病例。AI产品ChatGPTAlphaFoldGamgee推荐理由:Paul用AI聊天工具和AlphaFold给自家狗搞出了癌症疫苗,现在开了公司Gamgee,专门给狗做个性化mRNA疫苗,澳洲已经开测,全球都能申请。原文稍后读已读值得跟进有用关注 ChatGPT
17:42Geek@geekbbX 用户 @geekbb 发帖称,在日常使用环境中已体验不出 DeepSeek-V4-Pro-0813 与 DeepSeek-V4-Flash-0731 的区别。他认为 Pro 版相比 Flash-0731 没有明显优势,并缺少 Flash-0731 发布时的惊艳感。该帖已获得 1519 次浏览、4 条评论和 2 个点赞。AI模型DeepSeek-V4-Pro-0813DeepSeek-V4-Flash-0731DeepSeek推荐理由:有人拿 Pro 和 Flash 日常对比,说没啥区别,想升级的可以看看再决定。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Pro-0813
17:42官方账号NVIDIA AI@NVIDIAAI72°CrowdStrike 定制 NVIDIA Nemotron 3.5 Lightning,用于网络安全 agent 工作流。该模型达到分析师级准确率,训练速度更快、计算需求更低。它能自动关闭最高 88% 的良性检测,让安全团队专注真实威胁。AI模型Nemotron 3.5 LightningCrowdStrikeNVIDIA10 个信源在谈事件专题推荐理由:CrowdStrike 用 Nemotron 3.5 Lightning 做了安全智能体,自动关掉 88% 误报,训练快又省算力。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
17:42Viking@vikingmutevikingmute在推文中总结了七条产品原则:产品要小,只关注一个点。从自身真实需求出发,不凭空想象。AI产品需支持BYOK或集成本地agent。沟通用邮件和Issue,不建群,支持直接退款。技巧vikingmute产品设计BYOK推荐理由:这哥们做产品挺实在:小、便宜、支持退款,AI产品要BYOK,用邮件沟通不扯淡。原文稍后读已读值得跟进有用关注 vikingmute
17:42lmarena.ai@lmarena_ai精选DeepSeek-V4-Pro (Max) 在 Code Arena: WebDev 的 AutoEval 中获得 1607 分,总分第 8,开放权重模型中排第 2。该成绩仅次于 GPT-5.6 Sol 的 1622 分和 Kimi K3 (Max) 的 1674 分。其定价为每百万 tokens 输入 $0.435、输出 $0.87,低于 Opus-4.8 的 $5/$25 和 GLM-5.2 的 $1.4/$4.4。目前该分数为早期 AutoEval 结果,后续会随真人投票收敛。AI模型DeepSeekV4-ProCode Arena10 个信源在谈事件专题推荐理由:DeepSeek 又发新模型了,V4-Pro (Max) 在编码榜上排开源第二,比贵得多的 Opus-4.8 还强,价格只要零头。原文稍后读已读值得跟进有用关注 DeepSeek
17:41elvis@omarsar0精选一项研究追踪了1,867个仓库中247,694条指令的生命周期,发现CLAUDE.md等指令文件会无限增长。追加一条指令无需成本,而删除一条需付出指数级验证成本,因此无人删除。文件中的提示词在生命周期内增长超过三倍,每次提交净增4.9条指令。研究者提出用注释记录指令理由,在可验证环境中消除了99.3%的多余指令,并将真实智能体指令遵循度提升至多23.1%。论文CLAUDE.mdAGENTS.md提示词工程推荐理由:这条论文用24万条指令数据告诉你CLAUDE.md为什么越写越长,还给了注释法这个解法,提升多到23%。原文稍后读已读值得跟进有用关注 CLAUDE.md
17:41Guillermo Rauch@rauchgSeedance 2.5 已集成到 Vercel AI Gateway,开发者可通过统一 API 调用该视频生成模型。Vercel 联合创始人于 X 平台发布了这一消息,并附有演示视频。目前官方尚未公布 Seedance 2.5 的具体版本差异和性能基准。AI产品SeedanceVercelAI Gateway推荐理由:Vercel 把 Seedance 2.5 接到了自家 AI Gateway 上,想用视频生成模型的话,直接调 API 就行,省去自己部署的麻烦。原文稍后读已读值得跟进有用关注 Seedance
17:41orange.ai@oran_ge博主整理了6个照片类Skill,包含photo-abstract-editorial、heytea-style、gc-minimal-zine-poster、ip_illustration_for_yourself、photo-revival和tait-crt-interface-skill。每个Skill都有独立使用链接,例如go.colaskill.com/abs。heytea-style可生成喜茶风格海报,photo-revival能把日常废片重绘成手绘插画。这些Skill均基于提示词控制,可复用到多种创意场景。技巧colaskillphoto-abstract-editorialheytea-style推荐理由:博主发了一组照片处理用的skill,链接直接给你,有做喜茶海报的、有把废片变手绘的,比自己写提示词省事多了。原文稍后读已读值得跟进有用关注 colaskill
17:41官方账号arXiv cs.LG@Zhao Su, Yuxin Xia, Haoran Li, Jun Shen, Qi Zhu, Qingguo Zhou, Binbin YongKolmogorov-Arnold网络(KAN)用可学习单变量函数替换标量权重以增强非线性逼近,但每个连接独立函数导致参数冗余。HYDRA将输入映射到Poincaré球的双曲空间,在切空间执行KAN更新,并用低秩原型块跨隐藏维共享函数变换。在八个基准数据集上,HYDRA在保持竞争性或更优预测性能的同时,提高了参数效率和表示可解释性。论文HYDRAKAN双曲空间推荐理由:这篇论文提出HYDRA,给KAN“减负”,参数更省还不掉点,双曲空间让表示更可解释。做KAN相关研究的可以看看。原文稍后读已读值得跟进有用关注 HYDRA
17:41AI产品黄叔@PMbackttfuture一位用户在X上吐槽,Agent数量稍多内存就爆,计划下一台换更大内存。该推文在X上目前只有1次点赞,却获得了236次浏览。这236次浏览说明这个痛点并非个例。技巧智能体内存多Agent推荐理由:这位老哥的吐槽太真实了,Agent一开多内存直接爆表,想搞多Agent的朋友得先掂量下自己电脑内存。原文稍后读已读值得跟进有用关注 智能体
17:41IT之家(博客/媒体)中芯国际2026年第二季度营收30.06亿美元,同比增长36.1%。归母净利润4.79亿美元,同比大增261.7%。毛利率25.3%,产能利用率达93.7%。月产能增至1,096,500片等效8英寸晶圆。行业中芯国际晶圆代工财报推荐理由:中芯国际Q2财报:营收30亿美元,净利暴涨261.7%,产能利用率93.7%。看芯片代工风向,这份财报信息量足。原文稍后读已读值得跟进有用关注 中芯国际
17:41idoubi@idoubiccThinkAny 项目方分享了新代码仓库地址 github.com/thinkany-ai/ds…,仓库名以 ds 开头。消息由 @idoubicc 在 X 平台发出,目前浏览量 76。推文未说明仓库用途,完整代码和 README 需前往 GitHub 查看。AI产品ThinkAnyGitHub开源推荐理由:ThinkAny 刚放了个新仓库链接,还没说用途。想抢先看代码的话,直接点 GitHub 链接就行。原文稍后读已读值得跟进有用关注 ThinkAny
13:03Geek@geekbb精选DeepSeek V4 Pro-0813 发布后,有开发者认为其表现不如预期惊艳,未达到美国一线模型水平。评论指出,小模型如 DeepSeek-V4-Flash、Qwen 27b 和 GLM-5.2 在同尺寸下表现出色,而大模型可能因训练算力不足显得对齐不够。该观点将 V4 Pro 的落差归因于欠训和算力短缺,而非架构缺陷,并预期随着算力增加会逐步改善。AI模型DeepSeekV4 ProGLM6 个信源在谈事件专题推荐理由:DeepSeek V4 Pro 到底行不行?这条推文用公开数据聊了聊它为什么不够惊艳,顺便夸了 Flash 和 GLM-5.2,观点挺实在。原文稍后读已读值得跟进有用关注 DeepSeek
12:40AI Will@FinanceYF5xAI 官方账号发布 Grok 4.6,称其具备前沿智能水平。官方表示,Grok 4.6 相比上一代 Grok 4.5 有显著改进,但价格维持不变。目前官方尚未公布具体基准测试数据。AI模型Grok 4.6Grok 4.5xAI推荐理由:xAI 悄悄发了 Grok 4.6,说是比 4.5 强不少,还维持原价。用过 4.5 的可以关注下,没准能直接升级。原文稍后读已读值得跟进有用关注 Grok 4.6
12:39AI Will@FinanceYF5精选xAI 在 Grok 4.5 基础上进行了更长的补充训练,加入推理、工程和高级技术数据,并让 Grok 4.5 重新生成 SFT 轨迹。强化学习阶段覆盖知识工作、通用编程、内核优化、网页开发和 CAD 等任务,目标直指复杂工程技术场景。AI模型Grok 4.5xAI推理模型推荐理由:xAI 把 Grok 4.5 又练了更长一轮,还专门强化编程、内核和 CAD,想搞技术活的话可以看看。原文稍后读已读值得跟进有用关注 Grok 4.5
12:07官方一手AI 热点 · 原创(博客/媒体)70°8月13日凌晨,DeepSeek毫无预兆地丢出大招——DeepSeek-V4-Pro正式版(0813) 悄然上线,API、网页端、APP全量同步! 📊 硬核数据:从“吊车尾”到“屠榜王” V4 Pro正式版在Agent能力上的提升,已经不是“升级”,而是“换物种”。直接看数据: 基准测试 V4-Pro正式版 V4-Pro预览版 提升幅度 DeepSWE(长周期软件工程) 62.7 12.8 暴涨4…general10 个信源在谈事件专题原文稍后读已读值得跟进有用
09:43IT之家(博客/媒体)8月13日,Twitch确认亚马逊一直使用其直播内容训练AI模型,并宣布用户可进入隐私设置选择退出。Twitch社区负责人Mary Kish在直播中表示预计用户会强烈反弹,实时聊天区随即被数百条反对留言刷屏。多名Twitch主播在X上批评这一做法,并质疑退出开关默认处于“同意”状态。Twitch首席产品官Mike Minton称不清楚亚马逊具体使用了哪些内容。亚马逊于2014年收购Twitch。行业TwitchAmazonAI训练1 个信源在谈事件专题推荐理由:Twitch亲口承认亚马逊在用你的直播训练AI,现在能关掉了,赶紧去隐私设置里把开关拨掉。原文稍后读已读值得跟进有用关注 Twitch
07:20官方账号NVIDIA AI@NVIDIAAI精选NVIDIA 发布全新 MoE 模型 Nemotron 3.5 Lightning。distil labs 作为欧洲发布合作伙伴,对其进行了微调。该团队将微调版与 4 个可比 MoE 模型在 6 项任务上对比,未微调时排名第三,微调后跃居第一。完整数值与失败场景已公布在 distil labs 博客上。AI模型Nemotron 3.5 LightningNVIDIAdistil labs10 个信源在谈事件专题推荐理由:NVIDIA 的 Nemotron 3.5 Lightning 微调后,在 6 项任务上超过 4 个同类 MoE 模型拿了第一。想知道怎么调出来的,可以看这篇。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
05:27Fish Audio@FishAudioFishAudio 在官方账号发布了 4 种商用声音类型的推荐视频,面向需要 AI 配音的商业用户。该视频展示了不同的声音风格,供用户在选择商用语音时参考。具体声音类型和适用场景未在文字中说明,需观看视频了解。AI产品FishAudioAI配音商用语音推荐理由:FishAudio 官方推荐的四种商用声音,做配音选型可以直接参考,省得自己一个个试。原文稍后读已读值得跟进有用关注 FishAudio
05:10Claude@claudeaiClaude 官方账号今日发布安全提醒:浏览器代理可被网页中隐藏的指令欺骗,导致执行非预期操作。Anthropic 表示已构建防御机制,同时建议用户自行采取若干安全习惯。相关防护建议已更新至 Claude 支持文档。用户应警惕不可信网页中的潜在指令注入。技巧ClaudeAnthropic浏览器代理10 个信源在谈事件专题推荐理由:Claude 官方提醒,网页里藏指令能骗过浏览器代理,他们已经加了防御,还教你自己怎么防。玩代理的可以看看。原文稍后读已读值得跟进有用关注 Claude
04:58Julien Chaumond@julien_c精选73°开源社区迎来开放权重模型密集发布潮。DeepSeek-V4-Flash-0731(304B MoE)在Terminal-Bench 2.1上从61.8升至82.7,逼近Opus-4.8。Meta发布首个开放智能体模型Muse-Glimmer-30B,支持完全本地运行,采用Apache 2.0。Liquid AI LFM2.5-2.6B以2.69B参数在M5 Max上达220 tok/s,内存占用低于2.5GB。MiniMax-H3支持原生立体声音频,可生成2K/15秒视频。Mistral Shieldstral-1.0-3B在HarmBench上得分99.4,超过LlamaGuard-4-12B和ShieldGemma-9B。AI模型DeepSeekMetaNVIDIA10 个信源在谈事件专题推荐理由:开源模型大爆炸!DeepSeek、Meta、NVIDIA一口气发了十几个新模型,从推理到视频到语音都有,性能还紧追闭源。原文稍后读已读值得跟进有用关注 DeepSeek
04:58Google Gemini App@GeminiApp精选Gemini官方X账号宣布,未来数周内将推出一批新的MCP连接。这些连接可将旅行规划、项目管理、待办清单等外部服务直接接入Gemini。官方博客(goo.gle/3TTbF8s)提供了具体接入方式的说明。AI产品GeminiMCP连接服务推荐理由:Gemini要支持MCP连接了,旅行、项目、待办都能直接接,挺实用。原文稍后读已读值得跟进有用关注 Gemini
04:27Geek@geekbb精选SpaceXAI正式发布Grok 4.6。官方称其性能较Grok 4.5有显著提升,定价保持同一水平。该模型主打前沿智能能力,已开放使用。AI模型Grok 4.6SpaceXAI模型发布推荐理由:Grok 4.6来了,比4.5强不少,价格没涨,终端里就能直接用。原文稍后读已读值得跟进有用关注 Grok 4.6
04:27Windsurf@windsurf_aiDevin 官方账号宣布桌面版应用今日开放下载。用户可以直接访问 devin.ai/download 获取 Devin 客户端。Devin 作为 AI 编程助手,此前提供网页版服务。Devin 桌面版的具体功能细节尚未公布,建议实际下载体验。AI产品Devin编程助手桌面应用推荐理由:Devin 桌面版能下载了,想用 AI 编程助手的话,直接去 devin.ai/download 拿一个试试。原文稍后读已读值得跟进有用关注 Devin
03:57官方一手marktechpost@Sana Hassan精选AllenAI 的 Open Instruct 框架支持在 16GB 显存上完成 LLM 后训练全流程。教程覆盖 SFT、DPO、RLVR 和 GRPO 四种主流方法。验证器(verifier)被用于评估模型输出质量。无需分布式计算基础设施,单卡即可运行。技巧Open InstructTulu 3AllenAI推荐理由:想自己微调模型又没大显卡?这份教程教你在 16GB 显存上跑完 SFT、DPO、GRPO 全流程,用的还是 AllenAI 的开源框架。原文稍后读已读值得跟进有用关注 Open Instruct
03:57IT之家(博客/媒体)71°DeepSeek 官网 API 文档的“模型 & 价格”页面新增了 DeepSeek-V4-Pro-0813 模型,该模型支持非思考与思考模式。此前 7 月 31 日,DeepSeek-V4-Flash 正式版 API 上线公测,官方当时表示 V4-Pro 正式版将尽快发布。此次新增的 0813 版本疑似为 V4-Pro 的预览或正式版本。AI模型DeepSeekDeepSeek-V4-ProAPI10 个信源在谈事件专题推荐理由:DeepSeek 悄悄上了个新模型版本,支持思考和普通模式,刚更新了 API 文档,想试的可以看看。原文稍后读已读值得跟进有用关注 DeepSeek
03:27官方一手歸藏(guizang.ai)@op741871°DeepSeek V4 Pro 正式版 0813 已发布。从流传的测试成绩来看,DeepSeek V4 Pro 依然相当爆炸。目前官方尚未公布 DeepSeek V4 Pro 的具体基准得分。社区对 DeepSeek V4 Pro 的讨论热度很高。AI模型DeepSeekV4 Pro基准测试推荐理由:DeepSeek 又发新版本了,V4 Pro 0813 的社区测试成绩看着很猛,想感受下有多强就点进来吧。原文稍后读已读值得跟进有用关注 DeepSeek
03:27官方一手歸藏(guizang.ai)@op7418精选SpaceX AI 发布 Grok 4.6 模型,官方称其达到前沿智能水平。相比 Grok 4.5,Grok 4.6 在相同价格下性能显著提升。定价为每百万输入 token 2 美元、每百万输出 token 6 美元。Twitter Premium+ 会员可通过 Grok Build 授权免费使用。AI模型Grok 4.6SpaceX AIGrok 4.58 个信源在谈事件专题推荐理由:想用前沿模型又嫌贵?Grok 4.6 比 4.5 强但价格不变,输入百万才 2 美元,Twitter 会员还能白嫖。原文稍后读已读值得跟进有用关注 Grok 4.6
02:57Y Combinator@ycombinator精选Physical Intelligence 联合创始人 Chelsea Finn 在 YC Startup School 2026 上分享了通用机器人的研发经验。她表示强化学习将机器人吞吐量提升了 2 倍。其系统已能自主运行数小时,无需人类全程监护。她认为机器人正进入 GPT 时代,从专用模型走向跨任务、跨机器人、跨环境的通用系统。AI模型Physical IntelligenceChelsea Finn通用机器人推荐理由:Chelsea Finn 在 YC 活动上讲强化学习让机器人效率翻倍,还能连续干活几小时,想了解通用机器人怎么落地可以听听。原文稍后读已读值得跟进有用关注 Physical Intelligence
01:57IT之家(博客/媒体)76°SpaceXAI 发布 Grok 4.6,在 Artificial Analysis Intelligence Index 上与 GPT-5.6 Sol 取得相同成绩。该模型在 Grok 4.5 基础上强化长时智能体任务,可处理资料研究、大型代码库和产品构想落地。训练数据包含筛选后的模型生成推理数据与工程数据,并经历比 Grok 4.5 更长的补充训练。Grok 4.6 已上线 Cursor、Grok Build 和 API,每百万输入 Token 定价 2 美元、输出 6 美元,首周两项服务用户获得两倍内含使用额度。AI模型Grok 4.6GPT-5.6 SolSpaceXAI10 个信源在谈事件专题推荐理由:SpaceXAI 的 Grok 4.6 发布,跑分追平 GPT-5.6 Sol,长流程编程和搭应用更强,已上线 Cursor,首周额度翻倍。原文稍后读已读值得跟进有用关注 Grok 4.6