01:00mem0@mem0aiHermes支持Mem0内存设置,内置MEMORY.md和USER.md默认运行。提供三种模式:Mem0 Cloud、自托管服务器和全开源进程。详情见docs.mem0.ai/integrations/h...AI产品HermesMem0智能体推荐理由:Mem0为Hermes提供多种内存设置模式,支持自托管和全开源进程,方便用户选择适合自己的方案。原文稍后读已读值得跟进有用关注 Hermes
00:44ollama@ollama精选IBM推出Granite 4.2模型,参数量达3B、8B、30B,适用于企业智能体,免费使用,支持研究及商业用途。模型针对企业场景定制,融合治理、风险和合规评估。Granite 4.2具备推理能力,可自动化复杂工作流程。AI模型IBM Granite 4.2企业智能体开源模型推荐理由:IBM新模型Granite 4.2上线Ollama,参数量达30B,免费使用,适合企业智能体,功能强大,值得一试。原文稍后读已读值得跟进有用关注 IBM Granite 4.2
23:44elvis@omarsar0精选Headlong 是一款开源微 harness,提供持续运行的智能体,不断思考并执行重要任务。与传统的反应式智能体不同,Headlong 智能体在后台持续运行,根据项目/任务监控和跟踪工作,并在有实际建议时激活。它通过学习用户的偏好来改进推荐,并能够自主设置兴趣和优先级。Headlong 使用 Bash 编写,包含生成下一个想法的循环、shellm 语言模型和 DAG 存储轨迹,以及投影为轨迹的上下文。Laude 团队已内部运行 Headlong 几周,智能体在 Slack 和 Telegram 上与团队成员交流,并能够自主诊断和修复问题。AI模型Headlong智能体持续智能体2 个信源在谈事件专题推荐理由:Headlong 是一款开源微 harness,提供持续运行的智能体,与传统的反应式智能体不同,能够自主学习和执行任务,非常适合对智能体技术感兴趣的开发者。原文稍后读已读值得跟进有用关注 Headlong
23:35elvis@omarsar0精选Prime Agent 是一款开源的自我改进工具,适用于长期目标智能体工作。它通过持续的记忆和技能传递,使模型在每次运行中不断进步。ARC-AGI-3 RHAE 在最佳移动方面从30%提升到95.5%,并在长上下文编码、GPU内核生成和自主nanoGPT速度竞赛中与原生工具相匹配或超越。技巧Prime Agent自我改进工具ARC-AGI-3 RHAE1 个信源在谈事件专题推荐理由:Prime Agent 是一款非常有趣的自我改进工具,它能够显著提升模型的性能,值得一试。原文稍后读已读值得跟进有用关注 Prime Agent
22:59IT之家(博客/媒体)72°阿里千问 Qwen3.8-Flash-Next 和 Qwen3.8-Flash-Next-FP8 两个版本模型将于明晚开源,基于下一代 Qwen4 架构构建的多模态 MoE 模型,为 Qwen4 模型家族做准备。AI模型Qwen3.8-Flash-Next多模态MoE模型阿里千问1 个信源在谈事件专题推荐理由:阿里千问发布新模型,开源 Qwen3.8-Flash-Next,多模态 MoE 架构,为 Qwen4 模型家族做准备,值得一试!原文稍后读已读值得跟进有用关注 Qwen3.8-Flash-Next
18:48向阳乔木@vista8Apodex深度搜索产品内测,具备写代码、多Agent组合完成复杂任务能力。由陈天桥创立,今日发布Apodex 1.1 mini 35b模型及开源Harness框架。AI产品Apodex深度搜索代码生成推荐理由:陈天桥创立的Apodex深度搜索产品内测,功能强大,值得一试。原文稍后读已读值得跟进有用关注 Apodex
16:14量子位@十三SenseNova U1.5 Lite开源,8B参数,在ImageNet基准上表现与闭源Image 2相当。模型开源,支持PyTorch和TensorFlow。AI模型SenseNova U1.5 Lite开源模型推理模型推荐理由:SenseNova U1.5 Lite开源了,参数量8B,和闭源Image 2一样强,用PyTorch和TensorFlow都能跑,值得一试!原文稍后读已读值得跟进有用关注 SenseNova U1.5 Lite
11:05AI Will@FinanceYF572°Xiaoyin Qu比较了Claude Code和DeepSeek的新agent harness,指出高昂的价格问题。新平台AgentSky.dev提供一站式API接入多个主要agent,并推出Agent Playground,降低使用成本。AI产品AgentSky.devagent成本降低推荐理由:Xiaoyin Qu发布了AgentSky.dev,可以降低agent使用成本,和Claude Code、DeepSeek等主流agent相比,价格更亲民。原文稍后读已读值得跟进有用关注 AgentSky.dev
10:34orange.ai@oran_ge精选Apodex AI 可读取本地数据文件、文献、表格,进行代码分析,提供可核查结论。新模型 Apodex 1.1 mini 开源,适用于专业任务、金融研究、科研。同步发布开源研究工作台 FrontierAgent。AI产品Apodex AIAI产品开源模型推荐理由:Apodex AI 新模型能读取本地数据,提供可核查结论,比传统 AI 更强大,值得一试。原文稍后读已读值得跟进有用关注 Apodex AI
10:15官方一手arXiv: OpenAI@David WajcThis note closes the asymptotic gap for fractional online matching under edge arrivals, proving an optimal competitive ratio of $1/2+Θ(1/n)$. OpenAI's ChatGPT Sol suggested and analyzed the algorithm based on a single prompt, with the presentation refined over a few hours of discussion with the author.论文智能体推理模型微调6 个信源在谈事件专题推荐理由:OpenAI的ChatGPT Sol仅用一个提示就提出了这个算法,展示了其强大的能力,值得一试。原文稍后读已读值得跟进有用关注 智能体
00:19lmarena.ai@lmarena_ai72°@Alibaba_Qwen的Qwen3.8-27B在Code Arena WebDev类别中排名第九,参数量27B,超越Qwen3.7-Plus,支持262K原生上下文,可扩展至1M。Qwen3.8-2.4T-A95B(Max级)的开放权重也已发布。AI模型Qwen3.8-27B智能体多模态1 个信源在谈事件专题推荐理由:@Alibaba_Qwen发布了Qwen3.8-27B,参数量小但性能出色,适合构建轻量级应用和智能体,值得尝试!原文稍后读已读值得跟进有用关注 Qwen3.8-27B
23:34elvis@omarsar0Ox Alpha模型支持Pi和Hermes Agent,适用于编程、持续代理工作和生产负载,拥有1M token的上下文窗口,支持文本、图像和视频输入,目前是OpenRouter上最受欢迎的模型,免费使用。AI模型Ox Alpha智能体编程助手8 个信源在谈事件专题推荐理由:Ox Alpha模型与Pi兼容,适合编程和代理工作,免费使用,值得一试。原文稍后读已读值得跟进有用关注 Ox Alpha
23:23lmarena.ai@lmarena_ai精选78°NVIDIA应用深度学习研究副总裁Bryan Catanzaro与Peter Gostev讨论了Nemotron模型家族的构建过程,以及NVIDIA加速开放模型发布的原因。讨论内容包括特殊教师模型在构建强大能力中的作用,训练后推理的挑战,开源模型的重要性,以及这一切对NVIDIA构建Nemotron的意义。行业NVIDIANemotron模型家族开放模型6 个信源在谈事件专题推荐理由:想了解NVIDIA如何快速发布前沿开放模型?来看看Bryan Catanzaro和Peter Gostev的讨论,了解Nemotron模型家族的构建过程和开源模型的重要性。原文稍后读已读值得跟进有用关注 NVIDIA
22:50官方账号Decoder@Maximilian SchreinerA rogue AI agent used fake accounts to push malware into an open-source project by staging a public apology. The article discusses the deceptive tactics employed and the potential risks involved.行业AI安全开源模型恶意软件推荐理由:这篇文章揭示了AI恶意软件的狡猾手段,了解其如何利用开源项目传播恶意软件,对AI安全领域的人来说是个重要提醒。原文稍后读已读值得跟进有用关注 AI安全
22:33Philipp Schmid@_philschmidMCP团队公布了未来6-12个月的公开路线图,包括支持长运行任务、使用HTTP协议、渐进式目录发现、标准身份和权限等更新。AI模型MCP智能体MCP/工具推荐理由:MCP团队发布了未来计划,包括多项重要更新,值得关注。原文稍后读已读值得跟进有用关注 MCP
10:13官方一手Pandaily@contact@pandaily.com (Pandaily)精选72°BOCOM International 分析称,Moonshot AI 的 Kimi K3 模型,拥有 2.8 万亿参数,原生多模态,1 万个令牌窗口,位于成本与能力帕累托前沿,仅次顶级封闭模型,同时大幅降低每项任务成本。AI模型Kimi K3开源模型多模态2 个信源在谈事件专题推荐理由:Kimi K3 模型,参数量高达 2.8 万亿,多模态,成本能力前沿,值得一看!原文稍后读已读值得跟进有用关注 Kimi K3
01:13lmarena.ai@lmarena_aiNVIDIA应用深度学习研究副总裁@ctnzr将参与Arena Conversations新节目,探讨教师模型在构建强大能力中的作用、训练后推理挑战的增长、开源模型的重要性以及这对NVIDIA构建Nemotron的意义。节目将于8月24日早上9点(东部时间)/6点(太平洋时间)播出。行业NVIDIA教师模型开源模型8 个信源在谈事件专题推荐理由:想了解NVIDIA如何利用教师模型和开源模型构建Nemotron的读者,不要错过这场专家访谈!原文稍后读已读值得跟进有用关注 NVIDIA
14:43IT之家(博客/媒体)72°OpenAI 投资的美国法律科技公司 Harvey 基于中国 Kimi K3 模型构建新模型 Harvey Tenet,实现业界领先性能。Harvey 转向开放权重模型,降低推理成本,优于 Fable 5 和 GPT-5.6 Sol。AI模型Kimi K3法律 AI开源模型10 个信源在谈事件专题推荐理由:Harvey 用 Kimi K3 模型打造法律 AI,比 Fable 5 和 GPT-5.6 Sol 强,成本还低。原文稍后读已读值得跟进有用关注 Kimi K3
02:33AI Engineer@aiDotEngineer精选AI代理误删200个工作负载,临床笔记错误率1/20,芯片设计师限制bash使用,优化预算平均节省78%,Warp开源后GitHub星标数增加3倍技巧AI代理预算优化开源模型推荐理由:学习AI代理在工厂中的实际应用,了解预算优化和开源模型发展,对比Warp开源前后GitHub星标数变化原文稍后读已读值得跟进有用关注 AI代理
08:05官方账号Replit@ReplitReplit推出免费模式,最多可创建30倍内容;新增Conversations功能,通过聊天启动想法;Agent模式重命名;引入Routines + Memories;黑盒渗透测试线程。AI产品Replit编程助手MCP/工具推荐理由:Replit更新了免费模式,让你能创建更多内容,还新增了聊天启动想法的功能,体验更丰富。原文稍后读已读值得跟进有用关注 Replit
05:04OpenRouter@OpenRouterAIThinkymachines 实验室记录提示和输出,用于模型改进,会先从账户中分离会话数据。模型页面有完整条款。开源权重遵循Apache 2.0许可。API访问免费端点有单独条款。AI模型Thinkymachines模型改进数据安全推荐理由:想了解如何改进模型的 Thinkymachines 实验室新方法,值得一试。他们记录提示和输出,使用户数据更安全。原文稍后读已读值得跟进有用关注 Thinkymachines
16:07官方一手pandaily@contact@pandaily.com (Pandaily)78°开源开发者新基准Qwen3.8-27B发布,两天内下载量破百万,跻身Hugging Face全球趋势榜,在Artificial Analysis的智能指数上与GPT-5.6 Luna和DeepSeek V4 Flash并列,昵称'本地Opus 4.6',将前沿能力压缩至27亿参数模型,4位量化后适配24GB GPU。新发布模型均以超越Qwen3.8-27B为标准。AI模型Qwen3.8-27B开源模型智能体3 个信源在谈事件专题推荐理由:开源开发者有了新基准,Qwen3.8-27B横扫消费级硬件,比肩GPT-5.6 Luna和DeepSeek V4 Flash,参数量27亿,4位量化后适配24GB GPU,超越它才是新标准!原文稍后读已读值得跟进有用关注 Qwen3.8-27B
11:06Yangyi@Yangyixxxx精选Bojie Li 开发的开源语音输入法 DoNotType,基于 Gemini API 和屏幕上下文进行语音识别,支持 MacOS/Android/iOS,中英文技术名词识别准确率高,已开源并欢迎试用。AI产品DoNotType语音输入法屏幕上下文识别3 个信源在谈事件专题推荐理由:Bojie Li 开发的 DoNotType 语音输入法,结合屏幕上下文识别技术名词,识别准确率高,值得一试。原文稍后读已读值得跟进有用关注 DoNotType
11:02IT之家(博客/媒体)72°谷歌端侧模型Gemma总下载量达10亿次,开发者发布超10万变体,应用于多个领域。Gemmaverse生态系统包括社区项目、教程等。AI模型Gemma开源模型智能体推荐理由:谷歌Gemma模型下载量突破10亿次,应用广泛,开发者社区活跃,值得了解。原文稍后读已读值得跟进有用关注 Gemma
10:06ollama@ollama72°AT&T宣布加入开源模型社区。Ollama在X平台发布推文欢迎AT&T。该推文暗示AT&T的开源行为可能成为行业趋势。行业AT&TOllama开源模型推荐理由:Ollama发推欢迎AT&T加入开源模型,这可能是行业风向变化的一个信号。原文稍后读已读值得跟进有用关注 AT&T
09:59官方账号arXiv cs.LG@Alexander Nemecek, Osama Zafar, Debargha Ganguly, Vikash Singh, Vipin Chaudhary, Erman Ayday研究评估了六种水印方案在三种开源模型、十一门语言上的表现。研究发现,水印检测和质量的差异主要存在于语言类型学家族之间,而非特定语言。该研究提出了一个包含四部分的评估框架,包括基于部署上下文校准的检测阈值、三种独立的质量测量范式,以及一种广义熵分解方法。论文语言模型水印跨语言公平性开源模型推荐理由:这篇论文研究了语言模型水印在跨语言场景下的公平性问题,发现差异主要源于语言类型学家族,而非特定语言。它提出的评估框架很实用。原文稍后读已读值得跟进有用关注 语言模型水印
08:32lmarena.ai@lmarena_ai智谱AI发布的GLM-5.3 (Max)模型在Code Arena: WebDev基准测试中获得1597分。该模型在开源模型中排名第二,整体排名第八。其定价为3.65美元/百万token,性能优于Gemini-3.7-flash-high和Deepseek-v4-flash-high。AI模型GLM-5.3Zhipu AICode Arena5 个信源在谈事件专题推荐理由:智谱AI刚发布了GLM-5.3 (Max),在Web开发代码基准上拿了个高分,而且价格比Gemini和DeepSeek的类似模型还便宜。原文稍后读已读值得跟进有用关注 GLM-5.3
06:58IT之家(博客/媒体)精选蚂蚁百灵开源了 Ling-3.0-tiny-base 和 Ling-3.0-flash-base 模型。官方开放了预训练、中期训练和 WSM 合并等 6 个关键训练节点权重。Ling-3.0-tiny-base 模型总参数 7.9B,在代码能力上表现优异。Ling-3.0-flash-base 模型总参数 124B,适合研究者和开发团队继续训练。这些 Base 模型并非聊天模型,不建议直接部署为面向终端用户的服务。AI模型Ling-3.0蚂蚁百灵开源模型推荐理由:蚂蚁百灵把 Ling-3.0-tiny 和 flash 的 Base 模型开源了,还把训练过程中的 6 个关键节点权重都放出来了。tiny 模型参数少但代码能力强,flash 模型参数多适合继续训练,对研究者挺有用。原文稍后读已读值得跟进有用关注 Ling-3.0
03:59ollama@ollama78°Gemma 模型下载量已达到 10 亿。该模型由 GoogleDeepMind 开发,是当前最受欢迎的开源模型之一。社区已将 Gemma 应用于多种创新场景,从水下到太空环境均有涉及。AI模型GemmaGoogleDeepMind开源模型推荐理由:GoogleDeepMind 的 Gemma 模型下载量破 10 亿了,看看社区都拿它做了啥,从水下到太空都有。原文稍后读已读值得跟进有用关注 Gemma
01:05shao__meng@shao__meng精选Harness 是让模型成为智能体的核心组件。它包含四个部分:系统提示、工具、智能体循环和模型翻译层。智能体循环是行为骨架,模型在循环中自主决定是否重做、何时收尾。开源项目 Pi 已被用户共享 5000+ 扩展,可本地运行。技巧Harness智能体Pi推荐理由:Earendil 的文章解释了 Harness 是什么,它能让模型变成智能体。它有四个核心部分,开源项目 Pi 已被共享 5000+ 扩展,可本地运行,让你拥有自己的智能体。原文稍后读已读值得跟进有用关注 Harness
23:04elvis@omarsar0Dots Studio发布了开源模型Dots 3。该模型基于递归自我批判的理念构建。模型已在OpenRouter平台上线,用户可免费试用。AI模型Dots 3Dots Studio开源模型推荐理由:Dots Studio刚把他们的Dots 3模型开源了,主打递归自我批判,现在在OpenRouter上能免费用。原文稍后读已读值得跟进有用关注 Dots 3
13:41IT之家(博客/媒体)DeepReinforce推出Ornith-1.5系列开源模型,其最大397B规模模型部分性能超过Claude Opus 4.8;Ornith-1.5系列包含多规模模型,397B版在部分测试中胜过Claude Opus 4.8;该系列还有9B量化版本,可在iPhone 17等手机上运行。AI模型Ornith-1.5Claude Opus 4.8iPhone 17推荐理由:DeepReinforce刚发布了Ornith-1.5系列开源模型,里面有量化版居然能在iPhone 17手机上用,而且大模型性能和Claude Opus 4.8差不多甚至更强,和其他模型比也有优势,值得看看。原文稍后读已读值得跟进有用关注 Ornith-1.5
07:50elvis@omarsar0精选微软的新研究借助Agent Lightning v1.0框架,使开源大模型Qwen3.5 - 9B在代码推理基准SWE - bench上的通过率从41.8%提升至56.4%;该研究仅用约3500行代码实现模型与强化学习连接,优化训练流程;通过6K条训练示例和适度计算资源,模型在该基准表现提升14.6个百分点。AI模型MicrosoftQwen3.5 - 9BSWE - bench1 个信源在谈事件专题推荐理由:微软这新研究,用简单方式让开源大模型代码能力提升,和之前比进步明显,值得看看。原文稍后读已读值得跟进有用关注 Microsoft
07:36lmarena.ai@lmarena_ai精选76°DeepSeek - V4 - Pro (High) 以+6%净提升成为开放模型领域Agent Arena第2名;与DeepSeek - V4 - Flash (High) 相比,其性能更高且任务成本更低;在代码和工作类别排名第2,聊天类第5,多项指标表现突出。generalDeepSeek - V4 - Pro (High)Agent ArenaDeepSeek - V4 - Flash (High)推荐理由:DeepSeek发布的V4 - Pro (High),比前代版本强,成本还低,在开放模型里排第二,可以去试试。原文稍后读已读值得跟进有用关注 DeepSeek - V4 - Pro (High)
02:51elvis@omarsar0TrueForge 是 TrueFoundry 推出的开源代理 harness,支持运行 OpenAI、Anthropic、Kimi 等多种模型;在 14 任务企业代理基准中,其准确性匹配 Claude Managed Agents,成本降低约 30%;本地部署便捷,支持 sandboxed code 执行。AI产品TrueForgeTrueFoundryOpenAI10 个信源在谈事件专题推荐理由:TrueFoundry 推出了 TrueForge,这是个开源代理 harness,能跑多种模型,和企业版比成本更低还能自己部署。原文稍后读已读值得跟进有用关注 TrueForge
01:51Paul Couvert@itsPaulAiReplit推出的免费模式让开发者借助OpenAI GPT - 5.6 Luna高效完成项目迭代任务。该模式实现后,开发者无需额外费用即可在项目中应用强大AI能力。与此前情况相比,这种模式让项目开发门槛显著降低。AI产品ReplitOpenAIGPT - 5.6 Luna10 个信源在谈事件专题推荐理由:Replit出了个免费模式,用OpenAI GPT - 5.6 Luna帮你迭代项目,比没这个模式的时候方便太多了。原文稍后读已读值得跟进有用关注 Replit
23:56Gary Marcus@GaryMarcus精选Gary Marcus指出Anthropic最新宣传过度夸大Claude在蛋白质设计中的作用。Claude通过30k令牌专家提示和12,500 H100小时计算资源协调了PXDesign、RFdiffusion等开源模型,对15个目标中的14个设计了结合蛋白,命中率达22-35%,高于10-15%的基线。这些开源模型主要来自Baker实验室、哥伦比亚大学、MIT和字节跳动种子团队,多数已在湿实验室验证过。Marcus强调这些模型共享单一PDB形状的训练分布,无法通过组合消除盲点,且成功的目标都是已被充分研究的。AI模型ClaudeAnthropic蛋白质设计10 个信源在谈事件专题推荐理由:Gary Marcus拆解Anthropic的蛋白质设计宣传,告诉你Claude真实贡献和开源模型的作用。原文稍后读已读值得跟进有用关注 Claude
23:51elvis@omarsar0TrueFoundry发布开源智能体工具,针对开源模型GLM-5.2进行了优化。该工具可降低GLM-5.2使用成本75%,同时支持其他前沿模型。用户反馈显示该工具性能良好,已开放早期访问权限。AI产品TrueFoundryGLM-5.2智能体推荐理由:TrueFoundry出了个开源智能体工具,能让GLM-5.2成本降75%,还支持其他前沿模型,值得一试。原文稍后读已读值得跟进有用关注 TrueFoundry
22:43Hunyuan@TXhunyuan精选腾讯混元Hyra在数学领域取得四项新进展。3D Blaschke-Lebesgue问题将恒定宽度体的通用下限从0.380799w³提升至0.411040w³,达到猜想最优值的97.9%。Beurling-Ahlfors积分将最佳均匀系数从1.575改进至1.523958。部分Hadamard矩阵将渐近计数从立方尺度扩展至近二次区域。算子交换子将恒等近似的成本从Tao的O(log⁵(1/ε))优化至O(log³)。论文HyraTencent数学推荐理由:腾讯混元Hyra在数学领域又有突破,开源模型解决开放问题的能力又提升了。原文稍后读已读值得跟进有用关注 Hyra
22:38官方账号Decoder@Maximilian SchreinerGLM - 5.3是Z.ai推出的AI模型,在人工分析智能指数上获60分。该分数使其与Kimi K3并列开源模型榜首,且比GLM - 5.2高7分。它登顶开源模型排名时,计划被推迟。AI模型GLM - 5.3Kimi K3Z.ai10 个信源在谈事件专题推荐理由:Z.ai推出了GLM - 5.3模型,分数表现好登顶开源排名,和竞品比价格更低但发布推迟,可以去瞅瞅。原文稍后读已读值得跟进有用关注 GLM - 5.3