19:42The Rundown AI@therundownaiOpenAI预览了其前沿模型的速度提升。Anthropic的AI智能体之间展开“地盘争夺战”。Rowan尝试让AI对自己进行审计。还有教程演示如何构建自我更新的“第二大脑”工作流。行业OpenAIAnthropic智能体10 个信源在谈事件专题推荐理由:今天有OpenAI提速、Anthropic智能体互怼,还有自我更新的第二大脑教程,快看看!原文稍后读已读值得跟进有用关注 OpenAI
18:33IT之家(博客/媒体)据 36 氪 8 月 14 日报道,腾讯混元资深研究员徐灿已转岗至微信 WeLM 团队。徐灿此前在混元 LLM 体系中担任后训练方向负责人,并为微软小冰、必应、WizardLM 和 Phi-3 等项目贡献过核心技术。微信原生 AI 助手“小微”已于 6 月灰度上线,近期还在招聘 WeLM 推理优化及 Agent 方向研究员。此次转岗预计将补充微信 WeLM 在训练、推理和复杂任务执行方面的研发力量。行业腾讯微信WeLM推荐理由:微信把腾讯混元资深研究员徐灿挖到 WeLM 团队,小微助手已经上线,还在招推理和 Agent 方向的人,微信 AI 要提速了。原文稍后读已读值得跟进有用关注 腾讯
18:14AI Will@FinanceYF5据TickerTrends追踪,OpenClaw在企业账户绝对数量上仍保持领先。但最近4周Hermes Agent的采用速度明显更快,增长动能更强。追踪数据显示两者在增长速度上的差距正在缩小。行业OpenClawHermes AgentTickerTrends2 个信源在谈事件专题推荐理由:TickerTrends的最新数据说OpenClaw企业账户还领先,但Hermes Agent最近4周涨得更快,两者差距在缩小,看看你押哪个。原文稍后读已读值得跟进有用关注 OpenClaw
18:03IT之家(博客/媒体)荣耀产品线总裁方飞8月14日在微博表示,Robot Phone是AI时代手机新物种的第一代探索,强调手机将从“应用的容器”走向“智能体的舞台”。8月12日发布的荣耀Robot Phone是全球首款机器人手机,12GB+512GB定价9999元,16GB+1TB定价12999元。该机与ARRI合作,后置三摄包括2亿像素4D云台主摄和2亿像素潜望式长焦,并首发自研影像芯片荣耀驭光H1。硬件上搭载第五代骁龙8至尊版和6.31英寸1.5K直屏,内置端侧大模型YOYO,可识别用户情绪、习惯与环境。AI产品荣耀 Robot PhoneARRIYOYO1 个信源在谈事件专题推荐理由:荣耀出了个会感知环境的Robot Phone,9999元起,带2亿像素云台、YOYO大模型,还和ARRI合作,挺新鲜。原文稍后读已读值得跟进有用关注 荣耀 Robot Phone
17:26官方一手歸藏(guizang.ai)@op741872°智谱发布GLM-5.3,基于743B基础模型仅做后训练,未重新预训练。新版本重点提升安全能力,针对模型防御场景做了优化。长程任务执行显著增强,包括终端操作、工具调用及大型代码库修复。在开源模型中,其网络安全能力达到新水平。AI模型GLM-5.3智谱智能体10 个信源在谈事件专题推荐理由:智谱发了GLM-5.3,没重新预训练就靠后训练把安全和长程任务拔高一大截,搞智能体或代码修复的值得看看。原文稍后读已读值得跟进有用关注 GLM-5.3
17:14向阳乔木@vista8一条关于Token银行与Agent接单平台的帖子在X上引发12条回复、1469次浏览和11次收藏。发帖者设想将用不完的Token交给Agent替别人跑任务,换取积分或金钱,结算方式明确提了“积分或钱”两种。12条回帖中无人举出已成型的平台案例,默认该模式尚未落地。该需求指向Token余缺调剂,类似算力期货的设想,但目前仅3个点赞,热度有限。行业Token银行算力交易智能体推荐理由:有个帖在X上问:闲置Token能不能存起来生息,或让Agent接单变现?好像还没人做成,但思路挺像算力期货。原文稍后读已读值得跟进有用关注 Token银行
16:23官方一手Pandaily@contact@pandaily.com (Pandaily)DAC 2026上,Synopsys发布L1-L5自主等级路线图。Cadence推出AuraStack超级智能体,Siemens EDA发布物理验证的Fuse智能体。Kimi K3用48小时自主完成芯片设计。中国厂商Xpeedic、XEPIC、UniVista正在跟进智能体EDA。行业SynopsysCadenceKimi K35 个信源在谈事件专题推荐理由:三大EDA巨头在DAC 2026同时亮出智能体方案,Kimi K3已经连续干了48小时芯片设计,中国厂商也在抢这波机会。原文稍后读已读值得跟进有用关注 Synopsys
16:19官方一手pandaily@contact@pandaily.com (Pandaily)Shenhai Zhiren 完成5亿元人民币A轮融资,新投资方包括 GGV Capital 和 Cathay Capital 旗下基金。老股东 BYD、Lightspeed China 继续跟投。其 Phoenix 600 电缆埋设机器人可在3000米深海作业,已获阿联酋电信1亿元订单。公司还发布了水下智能体模型 SEAgent 1.0。行业Shenhai ZhirenPhoenix 600SEAgent推荐理由:Shenhai Zhiren拿下5亿融资,Phoenix 600深海机器人获阿联酋1亿订单,还发布SEAgent水下智能体,挺猛。原文稍后读已读值得跟进有用关注 Shenhai Zhiren
15:42小互@imxiaohu精选DeepSeek Harness 的源码显示,它不再把 Prompt 当作一段 System Prompt,而是做成一个运行时(Runtime),通过 Identity、Persona、Tool Guidance、Runtime Context 等模块动态组装。每个能力(如 shell、filesystem、web)都自带 Tool + Schema + Prompt Guidance,由能力负责者告诉模型怎么用。Prompt 还分了 Global Prompt、Agent Scope、Agent-specific Override 三层,支持继承和覆盖。同时,Runtime Context 与稳定 Prompt 分离,cwd、git 状态等动态信息单独注入,避免频繁修改 System Prompt。作者认为 Tool Schema 本身就是 Prompt Engineering,模型最终看到的是 Instructions、Context、Capabilities 的统一组装。技巧DeepSeekHarnessPrompt工程推荐理由:做 Agent 的看看:DeepSeek Harness 把 Prompt 当程序,能力自带 Prompt 指导,分三层作用域,比巨大 system prompt 优雅。原文稍后读已读值得跟进有用关注 DeepSeek
15:36IT之家(博客/媒体)芯擎科技于8月12日宣布车规级7纳米AI加速芯片“天工100”(NNA100)全面量产,并已向整车厂和Tier1批量供货。该芯片提供96 TOPS INT8算力和102GB/s独立LPDDR5内存带宽,支持3B-7B大模型或多个4B模型同时运行。它采用插卡式外挂形态,兼容PCIe4.0和USB3.2接口,无需改动原车机软硬件即可为存量车型升级AI算力。芯片通过AEC-Q100 Grade3和ISO26262 ASIL-B认证,硬件成本较双控AI BOX方案至少减半。AI产品天工100芯擎车规级AI芯片推荐理由:芯擎发了款外挂式车规AI芯片,不用换整车SoC,插卡就能让老车跑大模型,96 TOPS算力,成本还砍半。原文稍后读已读值得跟进有用关注 天工100
15:14Geek@geekbbZ.ai发布开源模型GLM-5.3,基于743B基础模型进行后训练。官方称其编码与智能体能力达到顶级水平,并在网络安全领域为开源模型树立新标准。社区讨论中,有网友希望其定价能压低Grok 4.6和DeepSeek V4 Pro。AI模型GLM-5.3Z.ai智能体10 个信源在谈事件专题推荐理由:GLM-5.3开源发布了,743B后训练,主打编码和网络安全。蹲个价格,看它能不能背刺Grok和DeepSeek。原文稍后读已读值得跟进有用关注 GLM-5.3
14:56ollama@ollamaZ.ai 发布开源模型 GLM-5.3,通过 743B 基础模型后训练实现顶级编码与智能体能力。该模型在网络安全领域设立新标准,成为开放模型的新标杆。Ollama 宣布将在其正式开放发布时提供支持,技术博客已公开细节。AI模型GLM-5.3Z.aiOllama10 个信源在谈事件专题推荐理由:GLM-5.3 来了,743B 底座,编码和网络防御能力很强,Ollama 也已宣布支持,想试的可以直接上手。原文稍后读已读值得跟进有用关注 GLM-5.3
13:43mem0@mem0aiMem0 将于8月14日在旧金山举办 Context Corner 2.0 开发者午餐会,活动时间为12:00-13:30 PDT。活动聚焦 AI 记忆与智能体,面向正在构建或实验相关技术的开发者。现场提供午餐,参与者可与同行交流。报名链接通过 Luma 平台,名额有限。行业Mem0智能体AI记忆推荐理由:Mem0 在旧金山办线下午餐会,聊 AI 记忆和智能体,8月14日中午,开发者朋友可以去现场边吃边聊。原文稍后读已读值得跟进有用关注 Mem0
12:27官方一手arXiv: DeepSeek@Xiangfeng Sun, Ceyu Xu, Ningzhi Ai, Zeyu Zhu, Yiyang Yuan, Yuan Xie74°论文提出一种性能异常驱动的自动研究流程,通过反复询问预取器失败原因,迭代构建混合预取器MoP。该流程消耗1.91亿DeepSeek V4 Pro tokens,并自动合成多个专用子预取器。在SPEC CPU2006和SPEC CPU2017上,MoP相比无预取实现61.1%的几何平均IPC加速。相比人类设计的Alecto、Berti和Pythia,MoP分别高出14.5%、21.6%和23.6%。RTL综合显示其占用110KB存储和0.0347平方毫米面积。论文MoPDeepSeek V4 Pro硬件预取10 个信源在谈事件专题推荐理由:这篇论文让AI Agent自己找预取器失败原因并造新方案,结果比人类设计的Alecto和Berti还强,值得看看。原文稍后读已读值得跟进有用关注 MoP
12:23Genspark@genspark_ai76°Google 今日发布 Gemini 3.7 Flash,这是面向编码和智能体的工作模型。Genspark 从当天起在 AI Chat、Code agent 和 Genspark Claw 中提供该模型,距 3.6 Flash 发布仅三周。新模型在软件工程、网页开发和复杂知识任务上提升明显,编码和智能体表现优于 3.6 Flash。其输入价格每百万 token 0.75 美元,输出每百万 token 3.75 美元,约为 3.6 Flash 发布价的一半。用户可一键切换,无需额外设置。AI模型Gemini 3.7 FlashGensparkGoogle1 个信源在谈事件专题推荐理由:Google 刚发的 3.7 Flash,Genspark 当天就能用,编码和 agent 更强,价格砍半,想试的直接切。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
12:22官方账号arXiv cs.AI@Yaxin Luo, Haobin Jiang, Jialv Zou, Xu Huang, Wenhao Yan, Haodong Li, Zhengrong Yue, Jing Li, Xiaofu Chen, Xiaohan Zhao, Jiacheng Liu, Jiacheng Cui, Zhiqiang Shen, Xiaotong LiAutoDesign是面向长周期智能体设计的框架,能将多模态源转化为结构化媒体输出,聚焦论文到海报生成任务。该框架引入PosterBench基准,主轨含100篇论文,横跨五个学科,验证子集含10篇。在主轨上AutoDesign得分78.32,超过闭源系统Claude Design 7.45分。在七个受控配置中,加入DesignHarness将平均得分由54.99提至67.39,提升12.4%。完全自主循环中它执行253次工具调用和11轮编辑,40分钟内成本低于3美元。论文AutoDesignPosterBenchClaude Design2 个信源在谈事件专题推荐理由:AutoDesign能自动把论文变海报,PosterBench上比Claude Design高7.45分,40分钟成本不到3美元。原文稍后读已读值得跟进有用关注 AutoDesign
12:21官方账号arXiv cs.AI@Bobo Li, Hao Fei, Tianjie Ju, Mong-Li Lee, Wynne HsuOmniScientist是端到端的多模态AI科学家系统,可直接处理图像、信号、音频、视频、3D结构等原始证据。系统由感知层和三个自主智能体(构思、实验、写作)组成,通过代码检查保障新颖性与统计有效性。在覆盖5个学科家族、4类证据的36个真实数据案例中,系统全部完成从原始数据到编译手稿,平均论文得分为6.3。与仅接收预计算标量特征的盲变体相比,直接感知在7个评估维度全部占优,并在85%的成对比较中胜出。论文OmniScientist多模态智能体推荐理由:OmniScientist直接读图像、视频、3D原始数据,36案例全跑通,均分6.3,对比实验85%胜出。原文稍后读已读值得跟进有用关注 OmniScientist
12:18Fireworks AI@FireworksAI_HQ精选DeepSeek-V4-Pro-0813已在Fireworks上线,提供Day-0使用。该模型面向智能体与工具增强工作流,在Terminal Bench 2.1、Cybergym和DeepSWE基准上超越Opus 4.8,成本效率最高达6倍。它在Vals Index的Coding和Legal基准上与领先前沿模型持平。Fireworks建议Pro-0813用于重推理与编码,Flash-0731用于预算较低的任务。AI模型DeepSeek-V4-Pro-0813Fireworks智能体推荐理由:DeepSeek-V4-Pro刚在Fireworks上线,跑智能体和编码任务比Opus 4.8强,成本效率还高6倍,可以试试。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Pro-0813
12:10官方账号arXiv cs.AI@Shangao Li, Yao Zhang, Volker Tresp, Yuanyuan YangQuoteBench 用 56 个单次任务、14 个事故来源族,验证 LLM 编程智能体在生成命令与执行传输之间的边界。同一回复经新增解析器后,成功率下降 55.4 到 73.2 个百分点;六种配置在披露边界后恢复 30.4 到 60.7 个百分点,另两种恢复为零或负值。GPT-5.6-sol 的匹配分数仅 -3.6 点,但实际隐藏了 -64.3 点损坏和 +60.7 点补偿。部署配置会重排模型顺序,26 对可比模型中有一对明确反转,另有四对处于单任务边缘。论文建议评估命令型智能体时报告模型配置、生成合同、执行路径、操作点和最终状态验证器,而非只给匹配分数。论文QuoteBenchGPT-5.6-sol编程助手推荐理由:这篇论文用 QuoteBench 拆穿了只看匹配分数的假象,原来 GPT-5.6-sol 的分数是负 64 和正 60 抵消出来的,部署配置一变排名就翻,评估编程智能体前该看看。原文稍后读已读值得跟进有用关注 QuoteBench
11:51宝玉@dotey精选用户将一段提示词写入 ~/.claude/CLAUDE.md,让 Fable 5 主代理自动多开 Opus 子代理执行实现类工作。Fable 5 只负责需求澄清、方案拆解、任务分发和结果验收。这样默认使用 Fable 5 High 时,Token 消耗不算厉害。作者不用 Opus 5,因为速度太慢且 Token 消耗巨大。技巧ClaudeFable 5Opus6 个信源在谈事件专题推荐理由:在 CLAUDE.md 里加一段话,让 Fable 5 指挥 Opus 干活,省 Token 又不慢。可以试试。原文稍后读已读值得跟进有用关注 Claude
11:50小互@imxiaohuDeepSeek发布了名为Harness的底层框架,代码托管在GitHub上。该框架采用插件化设计,支持程序运行时安全加载、卸载和替换插件,并保证依赖关系正确,且有论文进行数学证明。但安装依赖命令行,界面只有WebUI,对普通用户不友好。开发者Gorden Sun认为,考虑到涨价,整体不如直接订阅Codex。AI产品DeepSeekHarnessCodex推荐理由:DeepSeek出了个叫Harness的Agent底层框架,插件机制挺硬核但安装麻烦,有人实测后说不如花钱订Codex,想省事的可以看看。原文稍后读已读值得跟进有用关注 DeepSeek
11:49AI产品黄叔@PMbackttfuture该推文宣传Agent社群,聚焦Agent自动化运营。推文数据仅显示340次查看、1个点赞和0条转发。除这些数字外,推文未给出更多细节。行业Agent社群智能体自动化运营推荐理由:想找Agent自动化运营的同好?这个社群可以关注,不过现在信息还太少。原文稍后读已读值得跟进有用关注 Agent社群
11:43Aravind Srinivas@AravSrinivas精选Perplexity宣布将Sonar迁移至Agent API。该API在保持联网搜索的基础上,新增多步研究、代码执行、内建工具,并可通过单一接口访问多种模型。在BrowseComp和WideSearch基准上,Agent API的得分超过Sonar最佳成绩的两倍。AI产品PerplexityAgent APISonar推荐理由:做联网搜索Agent?Perplexity Agent API支持多步研究、代码执行,基准分翻倍,值得一试。原文稍后读已读值得跟进有用关注 Perplexity
11:39小互@imxiaohu73°ChatGPT 和 Codex 新增 Computer History 功能,启用 Computer Use 后记录点击、打字、切换应用等交互事件,不截屏不录音。Computer History 会将操作整理为时间线,并根据重复动作主动建议生成技能和自动化。3 个用例中,用户可查询最后查看的 Google Doc 名称、确认文档是否已分享给 Josh 和 Priya、以及生成上午时间分配回顾。AI产品ChatGPTCodexComputer History推荐理由:ChatGPT 和 Codex 现在能记录电脑操作历史,还会建议把重复动作做成自动化,找文件查记录很实用。原文稍后读已读值得跟进有用关注 ChatGPT
11:29官方账号arXiv cs.LG@Zhe Ye, Hantao Lou, Yuechun Sun, Peiyang Song, Zhengxu Yan, Timothe Kasriel, Qingyang Zhang, Kaiyu Yang, Soonho Kong, Jingxuan He, Dawn Song精选Vero是首个评估仓库级联合实现与证明合成的基准,包含43个多模块实例。实例来自Python、Dafny、Verus和Coq的真实仓库,覆盖密码协议到分布式系统等领域。每个实例基于Lean 4,支持仅证明和代码加证明两种评估模式。最强智能体配置仅完整解决27/43个实例,在最高难度仓库上未闭合任何规格。论文VeroLean 4形式化验证推荐理由:Vero拿43个真实仓库考AI写代码加形式化证明,最强配置只过了27个,想看看代码生成靠谱程度的可以来测测。原文稍后读已读值得跟进有用关注 Vero
11:18官方账号arXiv cs.LG@Nestor R. Barraza, Gabriel Pena这篇论文从信息论视角分析机器学习决策系统的内在性能上限。作者用Fano型下界刻画分类的最小误差,用Cramér-Rao不等式给出参数估计的精度极限。研究指出,独立假设、遍历性和分布稳定性等隐含条件会显著影响推断结论的有效性。论文还基于马尔可夫随机场和势函数表示来建模数据中的依赖机制,并把LLM集成智能体架构视为反馈驱动的随机过程。最终强调预测能力扩展的前提是建立充分的数据模型,算法学习必须服从信息论极限。论文Fano界Cramér-Rao不等式马尔可夫随机场推荐理由:这篇论文把“模型为什么有性能天花板”从信息论和交互角度讲得很清楚,做LLM智能体的可以看看它怎么把系统当随机过程分析。原文稍后读已读值得跟进有用关注 Fano界
11:00shao__meng@shao__meng72°Gemini 3.7 Flash 从 Preview 升级为 GA,正式开放使用。它在多个基准上大幅提升:DeepSWE 从 49.0% 升至 65.3%,FrontierCode 从 34.4% 升至 43.6%,AutomationBench 从 17.0% 升至 30.4%。价格同步下调 50%,每百万 tokens 输入 0.75 美元、输出 3.75 美元。该模型已成为 Google AI Studio、Antigravity 和 Gemini App 的默认模型。AI模型Gemini 3.7 FlashGoogle DeepMind智能体推荐理由:Gemini 3.7 Flash 转正了,编码和智能体跑分大涨,价格还砍半。生产环境被 Preview 并发坑过的话,可以上手试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
10:54爱范儿@李超凡DeepSeek V4 Flash 之后,大模型开始卷智效比。智效比关注模型在Agent任务中的效率表现。爱范儿这篇文章探讨了如何根据智效比挑选模型。技巧DeepSeek V4 Flash智能体推理效率5 个信源在谈事件专题推荐理由:DeepSeek V4 Flash 之后挑模型得看智效比了,这篇文章给你讲清 Agent 场景下怎么选高智效模型。原文稍后读已读值得跟进有用关注 DeepSeek V4 Flash
10:43掘金本周最热@万少76°DeepSeek于8月13日发布首款Agent产品DeepSeek Harness(dsh),以MIT协议开源,对标Claude Code和Codex。内测期间769位开发者报名,约300个社区插件已出现。教程共2万字,从安装Node.js 22开始,讲解如何用npx启动dsh web,并覆盖界面布局、工作区、权限等入门操作。dsh允许AI读写本地文件、执行命令,与ChatGPT网页版不同。技巧DeepSeekHarnessdsh推荐理由:DeepSeek昨晚开源了Harness,对标Claude Code,还配了2万字中文教程。想试agent框架的可以直接上手,不用自己摸索。原文稍后读已读值得跟进有用关注 DeepSeek
10:23官方一手Pandaily@contact@pandaily.com (Pandaily)DeepSeek Harness 于8月13日晚8:30发布开发者预览并开源,当前版本为v0.1。产品提供四种预设工作模式,采用一切皆插件的架构设计。官方将其核心思想概括为“模型+Harness=智能体”。这次开源被认为是今年最具雄心的智能体开源项目之一。AI产品DeepSeekHarness智能体推荐理由:DeepSeek 把 Harness 开源了,四个工作模式直接搭智能体骨架,插件随便接,玩起来很有野心。原文稍后读已读值得跟进有用关注 DeepSeek
10:19官方一手pandaily@contact@pandaily.com (Pandaily)8月13日,DeepSeek正式发布V4 Pro模型,并同步推出Harness开发者预览。Harness基于Cordis插件系统构建,将每个智能体能力封装为插件。该项目以MIT许可证开源,开发者可自由修改与商用。Harness提供append-only会话日志,可完整追踪智能体运行轨迹,便于调试与审计。AI产品DeepSeekHarnessV4 Pro推荐理由:DeepSeek把Harness以MIT开源了,插件化架构,每个能力都是插件,还有完整轨迹日志,适合自己折腾智能体的朋友。原文稍后读已读值得跟进有用关注 DeepSeek
09:41IT之家(博客/媒体)腾讯控股将从 Meta 手中收购 AI 开发商 Manus 的股份,成为最大股东。2025 年 3 月蝴蝶效应公司推出 Manus,6 月总部迁至新加坡并停止中国境内服务。4 月国家发展改革委外商投资安全审查机构禁止 Meta 收购,8 月 11 日 Manus 宣布脱离 Meta 独立运营。7 月已有消息称腾讯考虑入股,此次股权变动在监管主导下进行,腾讯仍为少数股东。行业腾讯ManusMeta推荐理由:腾讯接盘 Meta 的 Manus 股份成为大股东,监管主导、Meta 退出,从爆火到被禁的来龙去脉这篇讲得清楚。原文稍后读已读值得跟进有用关注 腾讯
08:59SuperTechFans(博客/媒体)精选Zed 发布全新多人协作编码环境 Delta,基于 DeltaDB 构建,可实时同步对话与代码工作树。评论能锚定在任意代码行并随代码演变更新,智能体可直接参与对话线程解释或修复问题。Delta 支持云端运行,关闭笔记本后智能体仍继续工作,通过链接分享线程可在浏览器打开。该应用以对话而非编辑器为中心,目前私人测试已开始邀请用户。AI产品ZedDelta智能体推荐理由:Zed 发布 Delta,专为 AI 智能体协作设计,评论跟代码走,可云端运行,适合智能体开发。私人测试开放。原文稍后读已读值得跟进有用关注 Zed
07:32IT之家(博客/媒体)76°谷歌于当地时间 8 月 13 日推出 Gemini 3.7 Flash 模型,专为编程与 Agents 场景打造,距离 3.6 Flash 发布仅约三周。该版本在软件工程、知识工作及网页开发工作流方面大幅提升,输入价格降至每百万 Token 0.75 美元,输出价格降至每百万 Token 3.75 美元。即日起,Gemini Spark 面向 160 多个国家和地区的 Google AI Pro 及 Ultra 订阅用户接入该模型,并新增针对 CBRN 与网络攻击滥用场景的安全防御机制。AI模型Gemini 3.7 Flash谷歌智能体推荐理由:谷歌把 Gemini 3.7 Flash 价格砍到 3.6 的一半,编程和智能体场景变强了,还直接给 Spark 用上,搞开发可以试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
05:17Poe@poe_platform72°Gemini 3.7 Flash 已在 Poe 平台上线。这是 Google 推出的高频工作模型,主打快速推理,覆盖编程与智能体场景。其上下文窗口为 1M token,可处理文本、图像、音频和视频。Poe 用户现在即可直接体验。AI模型Gemini 3.7 FlashPoeGoogle推荐理由:Google 的 Gemini 3.7 Flash 上 Poe 了,1M 上下文,跑代码和 Agent 都快,想试就去 Poe 找。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
05:11官方账号Cursor@cursor_ai精选72°Cursor宣布Firetiger团队正式加入。双方将共同开发能跟随代码进入生产环境并自动修复故障的智能代理。这次整合让Cursor的AI代理能力从代码生成延伸到部署后运维。行业CursorFiretiger智能体10 个信源在谈事件专题推荐理由:Cursor把Firetiger团队收了,他们要做能盯生产环境、出问题自己修的代理,和别家只写代码的不一样。原文稍后读已读值得跟进有用关注 Cursor
04:23Fireworks AI@FireworksAI_HQ精选Arcee AI 宣布开源 nac,这是一个用于长时间运行任务的 agent harness,现已以 Apache 2.0 协议发布在 GitHub 上。同时,Arcee 推出开放模型 API 的 beta 版本。Fireworks AI 参与合作,在 Arcee 平台上提供 Kimi-K3 模型供用户试用。nac 专为开发者处理复杂多步骤的工程工作负载而设计。AI产品Arcee AInacFireworks AI5 个信源在谈事件专题推荐理由:Arcee 开源了 agent 工具 nac,能跑长时间任务,还出了 API 测试版,Fireworks 上也就能用 Kimi-K3 了。原文稍后读已读值得跟进有用关注 Arcee AI
04:02Philipp Schmid@_philschmid78°谷歌发布Gemini 3.7 Flash,在Zapier的AutomationBench基准上拿下30%得分,成为首个突破30%的模型。三周前Gemini 3.6 Flash得分19.8%,这次每任务成本仅增加3美分。在营销、财务、销售、支持四个领域表现领先,其中营销38%、财务37.5%。但在运营领域仍落后,Opus 5以50%保持领先。AI模型Gemini 3.7 FlashAutomationBenchZapier推荐理由:谷歌突袭发布Gemini 3.7 Flash,AutomationBench拿到30%,比贵一倍的模型还强。做智能体自动化任务可以试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
03:55Aravind Srinivas@AravSrinivas75°xAI发布的新模型Grok 4.6现已集成到Perplexity和Perplexity Computer,面向Pro和Max用户开放。Perplexity在WANDR基准上使用Perplexity Computer harness测试其作为协调器的表现,结果显示Grok 4.6位于性能与成本的帕累托前沿。在WANDR上,Grok 4.6匹配Fable 5的结果,但成本降低超过60%。AI模型Grok 4.6PerplexityxAI推荐理由:Perplexity官推宣布Grok 4.6上线,当协调器用,效果追平Fable 5,成本却低六成,Pro和Max用户直接能用。原文稍后读已读值得跟进有用关注 Grok 4.6
03:53Aravind Srinivas@AravSrinivas83°谷歌在3.6 Flash发布三周后推出Gemini 3.7 Flash。新版本在编码和智能体任务上进步明显,软件工程、知识工作与网页开发均有提升。其首发价格为3.6 Flash原价的一半。模型现已通过Gemini API、Google AI Studio与Antigravity开放使用。AI模型Gemini 3.7 Flash谷歌智能体推荐理由:谷歌新出的3.7 Flash只要3.6一半价格,编码和智能体更强,适合做子智能体跑任务。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash