01:30Firecrawl@firecrawl_devFirecrawl 在 X 平台宣布推出 OpenCode2 的文档页面,地址为 opencode.ai/v2/docs。同时,Firecrawl 还发布了 Keyless 功能,相关介绍位于其官方博客。OpenCode2 是 Firecrawl 推出的新一代产品,Keyless 模式允许用户无需 API 密钥即可使用服务。目前该推文获得 7 个点赞和 841 次浏览。AI产品FirecrawlOpenCode2Keyless推荐理由:Firecrawl 出了 OpenCode2 文档和 Keyless 模式,不用 API 密钥就能用,想省事的可以看看。原文稍后读已读值得跟进有用关注 Firecrawl
01:29Y Combinator@ycombinatorYC播客Full Stack采访了Circleback联合创始人Ali Haghani,他展示了如何用AI管理公司。他使用编码代理和自动化运营,并将Circleback作为公司大脑。他分享了硬件配置、Telegram中构建的不同代理、终端使用时间等细节。他还讨论了不会让代理处理的事项以及软件工程的未来方向。技巧CirclebackYC智能体推荐理由:想看看创始人怎么用AI管公司吗?Ali Haghani在YC播客里讲了他用Circleback当公司大脑、用代理干活的真实工作流,挺具体的。原文稍后读已读值得跟进有用关注 Circleback
01:17Rowan Cheung@rowancheung扎克伯格在Fox News采访中阐述了Meta的AI愿景,即提供全天候可用的个人超级智能。Meta发布了新的开源权重模型Muse Glimmer,并预告了Muse Spark 1.2即将推出。扎克伯格认为这些AI智能体未来能帮助人们处理工作、学习、人际关系和心理健康等生活各方面。Meta同时投资美国劳动力学院和10亿美元社区基金,以支持AI发展背后的社区。AI产品Muse GlimmerMuse SparkMeta推荐理由:扎克伯格亲自讲Meta的AI路线图,Muse Glimmer已发布,Spark 1.2也快了,想了解Meta怎么搞个人超级智能的可以看看。原文稍后读已读值得跟进有用关注 Muse Glimmer
01:16AI Will@FinanceYF5精选Dyna Robotics推出Dyna-2,这是一个世界动作模型,预训练数据超过100万小时的人类视频,相当于约170年不间断的清醒经验。该模型的核心在于其背后的扩展定律,目前仍在持续攀升,尚未显现天花板。Dyna-2的发布标志着机器人领域在数据规模上的新突破,为机器人行为学习提供了更丰富的先验知识。AI模型Dyna-2Dyna Robotics机器人推荐理由:Dyna Robotics出了个新模型Dyna-2,用100万小时人类视频训练,相当于170年经验,机器人学习的新路子,值得看看。原文稍后读已读值得跟进有用关注 Dyna-2
01:11官方一手Google Blog: AI(博客/媒体)谷歌研究团队在模拟环境中首次展示了AMIE医疗AI系统的实时视频问诊能力。该系统基于大型语言模型,能够与患者进行自然对话,并辅助医生进行临床决策。在初步研究中,AMIE在问诊准确性和患者满意度方面表现出色。该研究为远程医疗和AI辅助诊断提供了新的可能性。AI模型AMIE谷歌医疗AI推荐理由:谷歌的AMIE系统能在视频里跟病人实时对话,模拟问诊,医生和患者评价都不错,想了解AI医疗进展的可以看看。原文稍后读已读值得跟进有用关注 AMIE
01:10官方账号LangChain@LangChainAI精选LangChain在Deep Agents评测套件中测试了NVIDIA开源路由器Switchyard,该套件包含145个多步任务,覆盖工具使用、检索、文件系统操作和长上下文场景。结果显示,93%的调用被路由到30B模型,仅7%需要Claude Opus 4.8。通过路由策略,总成本降低约70%,同时保留了Opus约90%的准确率。LangChain已推出与Switchyard的deepagents集成。AI产品SwitchyardNVIDIALangChain10 个信源在谈事件专题推荐理由:想知道你的智能体能不能少花点钱?LangChain实测NVIDIA的Switchyard,93%任务用30B模型搞定,成本砍七成,准确率还保住九成。原文稍后读已读值得跟进有用关注 Switchyard
01:04lmarena.ai@lmarena_aiBlack Forest Labs发布其首个视频模型FLUX 3 Video,并已在Arena平台测试更新版本。更新版以1496分位列Text-to-Video Arena第二名,仅比榜首Gemini Omni Flash的1512分低16分。该模型支持原生音频、文生视频、图生视频、视频续写及多语言对话,提供Draft模式以降低探索成本。输出最高20秒1080p原生视频,API和工具中可用,2K、4K及开放权重即将推出。AI模型FLUX 3 VideoBlack Forest LabsGemini Omni Flash推荐理由:Black Forest Labs的FLUX 3 Video更新版在Arena冲到第二,只差Gemini 16分,支持原生音频和多语言对话,想玩视频生成可以试试。原文稍后读已读值得跟进有用关注 FLUX 3 Video
00:59a16z@a16z精选Inferact CEO Simon Mo 在 a16z 的访谈中表示,开源权重模型与闭源模型在能力上已无明显差距,真正的差异在于分发策略和进入市场的方式。他认为,模型改进的关键不是数据来源,而是谁能为模型构建最好的自我迭代环境。他以 Moonshot 的前端编码环境为例,说明模型通过观察渲染结果持续循环优化的重要性。Mo 预测,未来一年开源模型实验室的竞争重点将是如何让模型更好地适应真实世界。行业InferactSimon MoMoonshot推荐理由:Simon Mo 说开源闭源模型能力已经没差,拼的是谁能给模型搭最好的自我进化环境,拿 Moonshot 前端编码举例,挺开脑洞的。原文稍后读已读值得跟进有用关注 Inferact
00:58a16z@a16z精选a16z合伙人Matt Bornstein在访谈中表示,开源是AI公司摆脱OpenAI套壳的关键。他指出,Cursor已经通过开源路线成功,Decagon和Harvey也正在这样做。这些公司需要自主进行中期训练、后期训练和推理部署优化,而闭源供应商不会提供这种访问权限。开源已深度嵌入许多创新产品中,但其作用往往不易被察觉。行业开源a16zMatt Bornstein10 个信源在谈事件专题推荐理由:想搞AI应用别再只套壳了,看看Cursor、Decagon怎么靠开源做自己的模型训练和部署。原文稍后读已读值得跟进有用关注 开源
00:46ollama@ollama精选NVIDIA 的 Nemotron 3.5 Lightning 现已可通过 Ollama 本地运行。这是一款 30B 参数的混合专家模型,仅激活 3B 参数,支持 1M token 上下文。该模型专为常驻运行的智能体设计,擅长编码、工具调用和多轮对话。相比同类规模的开源模型,其吞吐量提升 4 倍,任务完成时间降低 30%。用户可通过 Claude Code、Hermes Agent 或 OpenClaw 等工具直接调用。AI模型Nemotron 3.5 LightningNVIDIAOllama10 个信源在谈事件专题推荐理由:NVIDIA 新出的 30B 模型,跑在本地,专门给常驻智能体用,速度快 4 倍,还支持 1M 上下文,搞智能体的可以试试。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
00:43官方账号Microsoft Research@MSFTResearch精选微软研究院推出CARE-X,一个结合灵活推理、校准预测和基于测量工具的统一框架,用于胸部X光解读。该框架超越了传统报告生成,旨在提升AI在放射学中的实用性和可靠性。CARE-X通过整合多种能力,可能改善诊断准确性和临床决策支持。相关细节在微软研究院的推文中公布。AI模型CARE-X微软研究院胸部X光推荐理由:微软研究院搞了个CARE-X,把推理、预测和测量工具整合起来做胸片解读,比单纯生成报告更进一步,搞放射AI的可以看看。原文稍后读已读值得跟进有用关注 CARE-X
00:40AI Will@FinanceYF5精选Dyna Robotics 发布世界动作模型 Dyna-2,仅用 100 万小时人类视频预训练,从未接触过任何机器人轨迹数据。实验发现,人类视频数据量从 1000 小时增至 100 万小时,模型在未见过的机器人任务上表现持续提升,呈现跨四数量级的缩放规律。这表明具身差距更像适应问题而非知识问题,可能改写机器人预训练范式。AI模型Dyna-2Dyna Robotics世界动作模型推荐理由:Dyna Robotics 发了 Dyna-2,只靠看人类视频就能学会机器人操作,没碰过机器人数据也能越看越强,跟以前的做法很不一样。原文稍后读已读值得跟进有用关注 Dyna-2
00:31techcrunch@Russell Brandom83°Anthropic的一个未发布模型在数学领域最著名的未解问题之一——黎曼猜想上取得了进展。该模型在相关基准测试中表现优于现有模型,尽管未能完全解决猜想,但展示了AI在数学推理方面的潜力。这一成果可能对数学研究产生深远影响。AI模型Anthropic黎曼猜想数学推理9 个信源在谈事件专题推荐理由:Anthropic的新模型在黎曼猜想上取得了进展,虽然没完全解决,但比预期强,值得看看AI在数学上能走多远。原文稍后读已读值得跟进有用关注 Anthropic
00:30Suhail@SuhailMeta CEO马克·扎克伯格在X平台发文,呼吁行业重新思考关于蒸馏和训练数据的政策。他表示,模型从其他模型学习的能力是开源生态系统运作的重要原则。这一表态针对当前AI行业对蒸馏技术的争议,强调无法阻止模型间的知识传递。扎克伯格的观点可能影响未来AI监管和开源政策的走向。行业扎克伯格Meta蒸馏推荐理由:扎克伯格公开挺蒸馏,说模型互相学习是开源根本,这波站队值得看看。原文稍后读已读值得跟进有用关注 扎克伯格
00:29官方一手AWS Machine Learning Blog@Kinman Lam精选Pixieset是一家面向摄影师的平台,通过Amazon Bedrock在四个月内为百万用户推出了AI生成的替代文本功能。该功能自动化了摄影师不愿做的图片SEO工作,同时不触及他们引以为傲的创意工作。最终实现了35%的AI功能采用率,证明了解决正确问题的重要性。AI产品PixiesetAmazon BedrockAI功能1 个信源在谈事件专题推荐理由:看看Pixieset怎么用Bedrock搞定摄影师,四个月35%采用率,专治SEO苦活,不碰创意。原文稍后读已读值得跟进有用关注 Pixieset
00:27官方一手AWS Machine Learning Blog@Dani Mitchell精选AWS博客发布Claude apps gateway生产级部署指南,该网关是Claude Code和Claude Desktop与Amazon Bedrock或Claude Platform之间的自托管治理层。文章涵盖端到端架构、企业部署模式、成本估算及实施资源。Claude apps gateway可帮助企业统一管理Claude应用访问策略,实现安全合规的AI工作负载部署。技巧ClaudeAWSAmazon Bedrock1 个信源在谈事件专题推荐理由:AWS官方出了Claude网关的企业部署方案,讲清了架构和成本,做企业级Claude接入的可以照着搭。原文稍后读已读值得跟进有用关注 Claude
00:26官方一手AWS Machine Learning Blog@Koyo Hidaka精选ONESTRUCTION在AWS Generative AI Innovation Center的技术支持下,构建了专为建筑和BIM工作流设计的基础模型Ishigaki-IDS。该模型通过合成数据、三阶段训练流程和可验证奖励机制,在Amazon EC2上完成训练。案例展示了在数据稀缺领域如何利用AWS工具链构建领域专用模型。AI模型Ishigaki-IDSONESTRUCTIONAWS推荐理由:建筑行业缺数据?看ONESTRUCTION怎么用AWS的合成数据和三阶段训练搞出个专用模型,挺有参考价值。原文稍后读已读值得跟进有用关注 Ishigaki-IDS
00:25官方一手AWS Machine Learning Blog@Avinash RanganathFirst Orion是一家品牌通信公司,将基于脚本的UI测试转向使用Amazon Nova Act的AI驱动QA自动化。他们用自然语言描述测试,替代了维护选择器代码,从而缩短了QA周期时间,释放了工程资源,并更早发现回归问题。技巧Amazon Nova ActQA自动化测试推荐理由:想知道怎么用AI做测试?First Orion用Nova Act把测试从写代码变成说人话,周期缩短还省人力,值得看看。原文稍后读已读值得跟进有用关注 Amazon Nova Act
23:58Weaviate@weaviate_io精选Weaviate在Search Mode中引入effort参数,允许用户在medium、high、ultrahigh三档间选择,以权衡输出质量与计算成本。ultrahigh档在BRIGHT基准的5个子集上平均nDCG@10达到X,比medium提升Y,比混合搜索提升Z。该功能旨在让开发者根据应用需求灵活调整推理资源。AI产品WeaviateSearch ModeBRIGHT推荐理由:Weaviate给搜索模式加了effort档位,想省算力就选medium,要质量就上ultrahigh,BRIGHT基准上提升明显,做RAG的可以试试。原文稍后读已读值得跟进有用关注 Weaviate
23:42elvis@omarsar0精选Alexander Panfilov等人发现了一种利用前沿AI公司API漏洞提取隐藏推理过程的方法。该方法在大多数查询中,推理token计数与API计费思考token实现1:1匹配。这一发现表明,在不破坏加密的情况下,蒸馏推理轨迹可能早已可行。相关讨论在X平台上引发关注。论文推理模型API漏洞token推荐理由:有人发现了从各家前沿模型API里偷看隐藏推理的漏洞,还验证了计费token对得上,挺有意思的。原文稍后读已读值得跟进有用关注 推理模型
23:41elvis@omarsar0精选Qodo发布了AI Code Review Academy,这是一套免费的代码审查学习章节,无需注册即可访问。其中基准测试与工具对比章节建议,评估审查工具时应使用真实生产环境的PR数据,并让所有工具在默认设置下运行。该章节引用2025年一项研究,同一模型在孤立基准测试中得分84-89%,但在真实代码库中仅得25-34%。Qodo建议用自己代码库的10-20个PR来测试候选工具。技巧Qodo代码审查AI Code Review Academy推荐理由:Qodo出了个免费学院,专门教你怎么评估AI代码审查工具,不用注册就能看。里面讲清楚了基准测试怎么才算靠谱,还给了实测数据,挺实在的。原文稍后读已读值得跟进有用关注 Qodo
23:40Harrison Chase@hwchase17LangChain创始人Harrison Chase在X上宣布,正在制作一个名为"Managed Deep Agents 101"的大型视频教程。该教程将深入讲解托管深度智能体的所有核心概念,并参考了docs.langchain.com上的官方文档。他在帖子中询问用户偏好:是想要一个超过2小时的单一视频,还是拆分成12个约10分钟的YouTube播放列表。目前该帖子获得15个赞和1434次浏览,社区正在参与讨论。技巧LangChainManaged Deep Agents智能体推荐理由:LangChain创始人亲自出教程,讲托管深度智能体,还问你要长视频还是短视频,想学这块的可以去评论区投票。原文稍后读已读值得跟进有用关注 LangChain
23:39IT之家(博客/媒体)苹果发布 iOS 27 第五个开发者测试版,有用户发现 HomeKit Secure Video 设置页面出现与现行规则不同的提示。2TB iCloud+ 套餐页面显示仅支持 5 个摄像头,而现行规则下该套餐不设限制。另一截图显示 12TB 套餐(月费 59.99 美元)提示包含 15 个摄像头的视频摘要功能。库克此前曾暗示部分 Apple Intelligence 功能未来可能收费,但苹果尚未公布具体方案。这些变化可能是测试版程序错误,也可能是苹果正在测试新的 iCloud+ 服务策略。行业苹果iOS 27iCloud+1 个信源在谈事件专题推荐理由:苹果可能在给 AI 功能收费铺路,iOS 27 测试版里 iCloud+ 的摄像头限制变了,想提前知道风向的可以看看。原文稍后读已读值得跟进有用关注 苹果
23:38IT之家(博客/媒体)精选宁波在台风“白海豚”防御中,利用AI预报模型将水库调度方案计算时间从5-10分钟缩短至5-10秒,预报时效性提升至秒级。该模型基于降雨预报和水位变化,每5分钟更新一次调度建议,帮助调度员实时调整下泄流量。全市16座大中型水库接入统一调度平台,实现三级联动。8月6日至11日,水库增蓄水量4.54亿立方米,兼顾防洪与供水。浙江省数字孪生平台覆盖1万多个水文站,2分钟内自动生成防御方案。AI产品AI预报模型数字孪生宁波推荐理由:宁波用AI把水库调度从分钟级干到秒级,5秒出方案,台风天防洪蓄水两不误,还保住了4.54亿方水,值得看看。原文稍后读已读值得跟进有用关注 AI预报模型
23:37IT之家(博客/媒体)索尼超旗舰 RGB LED 电视 9 系 Ⅱ 的 115 英寸版本(K-115XR90M2)于 8 月 10 日开售,定价 149999 元。该电视采用 True RGB 真彩原色技术,搭载 RGB 背光大师系统 Pro,色彩体积提升至 200%,灰阶控制提升 300%,亮度提升 30%,覆盖 100% BT.2020 色域。音质方面配备多声道屏幕声场穹顶版,支持杜比全景声和 DTS:X。智能功能上获得人工智能终端智能化分级 L3 级认证,搭载腾讯混元与 DeepSeek 双 AI 模型。产品专为 PlayStation 5 Pro 深度适配,支持 4K 120fps VRR ALLM 游戏需求。AI产品索尼RGB LED电视推荐理由:索尼 115 英寸旗舰电视开卖,RGB LED 背光比 Mini LED 色彩更准,亮度更高,还带腾讯混元和 DeepSeek 双 AI,适合追求顶级画质的影音玩家。原文稍后读已读值得跟进有用关注 索尼
23:36Gary Marcus@GaryMarcusJoe Weisenthal发布图表显示AI芯片热潮中,超大规模数据中心2027-2028年资本支出预期在过去一年翻倍以上。尽管AI在各维度产生噪音,但未来支出预估持续攀升是明确趋势。该数据反映市场对AI基础设施投资的强劲信心。行业AI芯片资本支出超大规模数据中心推荐理由:看这张图,超大规模资本支出预期一年翻倍,AI芯片热潮比你想的还猛。原文稍后读已读值得跟进有用关注 AI芯片
23:35The Rundown AI@therundownai苹果在AI领域的投入似乎有所放缓,据The Rundown报道,苹果可能调整其AI战略,减少对某些项目的投资。这一动向可能影响其与OpenAI、Google等公司的竞争格局。苹果的AI进展一直备受关注,此次调整或暗示其面临技术或市场挑战。具体细节尚未完全披露,但业界普遍关注苹果下一步动作。行业苹果AI战略OpenAI10 个信源在谈事件专题推荐理由:苹果AI战略可能要变,想了解苹果在AI上到底怎么想的,这篇值得看看。原文稍后读已读值得跟进有用关注 苹果
23:34官方账号Decoder@Matthias Bastian精选Nvidia发布开源权重模型Nemotron 3.5 Lightning,仅36亿活跃参数,在智能指数上与OpenAI的gpt-oss-120b持平,但体积小四倍。该模型每秒处理近670个token,是对比中速度最快的模型。Nvidia此举表明其更注重效率而非模型规模。AI模型Nemotron 3.5 LightningNvidiagpt-oss-120b10 个信源在谈事件专题推荐理由:Nvidia新出的开源模型,36亿参数跑得比1200亿的还快,速度拉满,适合追求低延迟的开发者。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
23:33Geek@geekbbManus 宣布将恢复为独立公司运营,部分用户需在 2026 年 8 月 23 日 7:59(新加坡时间)前备份数据,8 月 25 日 8:00 起可恢复数据。受影响用户将收到邮件和应用内通知,期间不收费并提供欢迎回归奖励。未受影响用户无需操作,可继续正常使用。Manus 还预告将推出新功能,推动通用 AI 智能体发展。行业ManusAI智能体数据备份推荐理由:Manus 要独立运营了,部分用户得在 8 月 23 日前备份数据,8 月 25 日恢复。用 Apple ID 或 Facebook 登录的记得看通知,别错过时间。原文稍后读已读值得跟进有用关注 Manus
23:31Jerry Liu@jerryjliu0精选LlamaIndex 推出 ExtractBench,号称最全面的复杂企业文档信息提取基准。该基准测试了 14 个系统,包括前沿 VLM、编码智能体和专用提取 API,覆盖 370 份企业文档、4,869 页和 67 种文档类型。最大发现是超过 50 页的文档中,商业 VLM 因静默列表截断,召回率跌破 35%。ExtractBench 评估值准确率、长记录完整性、空间定位和每页成本,完全确定性且无需 LLM 评判。同时发布 LlamaParse 新层级 Agentic Plus,以 95.6% 值准确率位居榜首,成本仅为最接近对手的三分之一。AI模型ExtractBenchLlamaIndexLlamaParse1 个信源在谈事件专题推荐理由:LlamaIndex 搞了个提取基准,测了 14 个系统发现长文档上 VLM 会悄悄丢行,还顺带出了个便宜三倍的提取服务,搞文档处理的值得看看。原文稍后读已读值得跟进有用关注 ExtractBench
23:29Fireworks AI@FireworksAI_HQ精选NVIDIA 推出 Nemotron 3.5 Lightning,这是一款 30B MoE 模型,仅 3B 参数激活,专为高吞吐智能体任务设计。该模型从 Nemotron 3 Ultra 蒸馏而来,在 PinchBench 和 AA-Omniscience Non-Hallucination 基准上表现强劲。目前已在 Fireworks 平台上线,供开发者用于构建智能体工作流。AI模型Nemotron 3.5 LightningNVIDIAFireworks10 个信源在谈事件专题推荐理由:NVIDIA 新出的 30B MoE 模型,3B 激活参数跑得快,专为智能体场景优化,Fireworks 上直接能用。原文稍后读已读值得跟进有用关注 Nemotron 3.5 Lightning
23:28Tw93@HiTw93Mole CLI v1.50版本名为"Honest",主要改进了清理、卸载和安装失败处理。Clean命令现在不会干扰正在运行的应用,并会告知用户清理后留下的内容。卸载命令不再静默退出,而是完整执行。安装失败时会明确指出有问题的目录及修复命令。mo status命令新增显示可清除空间,解释了Finder和df显示不一致的原因。AI产品MoleCLImacOS3 个信源在谈事件专题推荐理由:Mole CLI更新了,清理和卸载更透明,安装失败会告诉你咋修,macOS用户值得试试。原文稍后读已读值得跟进有用关注 Mole
23:22elvis@omarsar0精选Pathway的BDH-CQ模型在ARC-AGI 1基准上获得29.5%的分数,但每个任务成本仅为0.0007美元。该模型通过潜在空间中的循环推理而非链式思维(CoT)来实现这一成绩。研究团队还验证了类似Transformer的扩展规律,参数规模可达6000亿。这一成果展示了在成本效率上的显著优势。AI模型BDH-CQARC-AGIPathway推荐理由:Pathway的BDH-CQ用极低成本在ARC-AGI 1拿到29.5%,靠的是潜在空间推理而不是CoT,还验证了600B参数规模,值得一看。原文稍后读已读值得跟进有用关注 BDH-CQ
23:03Lovable@lovable_devLovable宣布为所有公共应用推出Trust Centers信任中心页面,每个应用可获得一个包含实时安全信息的可分享链接。该功能旨在替代以往通过问卷或口头承诺来证明应用安全性的方式。用户可直接将链接发送给客户或投资者,无需额外解释。Lovable声称目前没有其他平台提供类似功能。AI产品LovableTrust Centers应用安全推荐理由:用Lovable做的应用现在能一键生成安全信息页,发给客户和投资人就行,省去反复解释的麻烦。原文稍后读已读值得跟进有用关注 Lovable
23:02Lovable@lovable_devLovable 宣布成为首个获得 AIUC-1 认证的 AI 软件创建平台。该认证针对 AI 智能体的安全标准,此前行业缺乏统一规范。Lovable 强调其平台内置身份验证、访问控制、数据加密、安全扫描和部署门禁等功能。公司表示不再强调"vibe coding",转而注重安全与信任。AI产品LovableAIUC-1AI安全推荐理由:Lovable 拿了 AIUC-1 安全认证,是头一家。做 AI 软件的平台不少,但安全标准这块它先立了标杆。原文稍后读已读值得跟进有用关注 Lovable
23:01Martin Fowler@martinfowlerMartin Fowler转发Birgitta Böckeler的实验,探讨让编码智能体自行执行测试驱动开发(TDD)是否有效。实验对比了有TDD指令和无TDD指令的智能体表现,发现TDD对智能体并非总是有益。Böckeler分享了具体实验数据和思考,指出某些情况下TDD反而可能拖慢智能体。文章为开发者提供了关于如何配置编码智能体的实用参考。技巧TDD编码智能体Martin Fowler推荐理由:想知道给编码智能体加TDD指令到底有没有用?这篇实验文章直接给你数据,别猜了。原文稍后读已读值得跟进有用关注 TDD
23:00a16z@a16za16z的Christian Catalini发文讨论开放与封闭AI的经济学。他认为市场优于中央计划,因为市场能将无数独立探索转化为分布式发现、适应和选择过程。许多竞争性超级智能各自探索不同前沿,比单一智能发现更多。开放权重允许智能被广泛适应,而非从中心优化和配给。监管捕获可能减缓扩散,但无法逆转这一趋势。行业a16z开放权重AI安全推荐理由:a16z经济学家聊开放权重AI,用市场逻辑反驳封闭派,观点挺有意思,适合关心AI开源之争的人看。原文稍后读已读值得跟进有用关注 a16z
22:58IT之家(博客/媒体)72°英伟达正在研发新一代开源 AI 模型系列 Nemotron 4,据 The Information 援引项目参与者消息,其中最大模型预计至少拥有 1 万亿个参数。英伟达生成式 AI 副总裁 Kari Briski 表示,投资 Nemotron 是为了让每家企业、每个国家都能获得前沿开源模型。该模型最早可能在今年秋末准备就绪,但发布日期尚未确定。英伟达还发布了 Nemotron 3.5 Lightning 模型,面向代码审查、工具调用等任务,并推出开源模型路由库 NeMo Switchyard。AI模型Nemotron英伟达开源模型推荐理由:英伟达要出万亿参数开源模型了,直接对标全球顶级,想了解开源模型新格局的可以看看。原文稍后读已读值得跟进有用关注 Nemotron
22:52官方账号NVIDIA AI@NVIDIAAI精选NVIDIA 推出 Nemotron 3.5 Lightning 模型,延续开放策略,公开权重、训练数据和配方。该模型已上线 Hugging Face 平台,开发者可自由获取和定制。Nemotron 3.5 Lightning 旨在提供高性能推理能力,适用于多种自然语言处理任务。此次发布进一步巩固了 NVIDIA 在开源模型领域的布局。AI模型NemotronNVIDIAHugging Face10 个信源在谈事件专题推荐理由:NVIDIA 把 Nemotron 3.5 Lightning 的权重、数据和配方全开放了,想自己改模型的话直接上 Hugging Face 就能拿,比闭源省事多了。原文稍后读已读值得跟进有用关注 Nemotron
22:43OpenRouter@OpenRouterAI精选NVIDIA Nemotron 3.5 Lightning已在OpenRouter上线。该模型为30B混合专家架构,仅激活3B参数,由Nemotron 3 Ultra蒸馏而来。它面向高容量、专业化的AI智能体工作负载,相比同类模型吞吐量最高提升4倍,任务完成速度最高快30%。AI模型NemotronNVIDIAOpenRouter10 个信源在谈事件专题推荐理由:NVIDIA新出的轻量MoE,30B参数只激活3B,跑智能体任务比同类快30%,想省算力可以试试。原文稍后读已读值得跟进有用关注 Nemotron