15:13Geek@geekbb精选Pi-Agent教程共10章,逐章解析Agent Loop、工具系统、消息系统、事件驱动、会话管理和上下文工程。每章从概念定义、源码实现、设计意图三层展开。提供三种阅读方式:Web在线版(带三栏配图)、本地Markdown和PDF离线版。技巧Pi-Agent智能体Agent Loop推荐理由:想自己写Agent?这个教程把Pi-Agent的源码都拆开了,每章讲概念、源码和为什么这么设计,适合动手党。原文稍后读已读值得跟进有用关注 Pi-Agent
13:01向阳乔木@vista8作者开发了一个视频生成Skill,计划每天发布一个大模型知识解读视频。第一期用通俗语言解释“蒸馏”概念,帮助外行理解。该Skill可自动化生成科普内容,降低AI知识传播门槛。技巧蒸馏视频生成科普推荐理由:想搞懂啥是蒸馏?这哥们做了个视频生成工具,每天讲一个AI概念,第一期专治小白看不懂。原文稍后读已读值得跟进有用关注 蒸馏
12:36Geek@geekbb该 Claude 技能只需用户输入一句话,即可自动判断选择广告还是纯解说模式,进行一轮简短的网络调研,撰写配音脚本,将脚本拆分成 10 秒一段的剪辑提示词,最后通过 MaxFusion MCP 的 Google Omni 模型生成每段视频。整个流程无需手动干预,从需求到成品一步到位。技巧ClaudeMaxFusion MCPGoogle Omni推荐理由:把一句话丢给 Claude,它自己就能调研、写脚本、剪视频,连 Google Omni 视频生成都帮你调好了,省事。原文稍后读已读值得跟进有用关注 Claude
11:12Yangyi@Yangyixxxx这篇帖子介绍了使用NewMax的抖音连接器,结合@dontbesilent 的对标法来拆解分析爆款视频。作者还提到如果使用dbskill工具,分析效果会明显提升。核心观点是:在模型能力接近时,工具的选择决定了Agent的上限。技巧NewMax抖音连接器dbskill推荐理由:想拆解抖音爆款?试试NewMax连接器搭配对标法,再用dbskill提效,实操干货。原文稍后读已读值得跟进有用关注 NewMax
07:51ChatGPT@ChatGPTapp@coreyching在视频中演示了ChatGPT Work的最新插件功能,可连接Gmail和Google日历等工具。用户通过简单配置,能让ChatGPT自动读取邮件摘要、创建日程或发送提醒。该功能目前已在ChatGPT Work中上线,30条回复和11次转发表明其关注度。技巧ChatGPT插件工作流推荐理由:想知道怎么让ChatGPT帮你管邮件和日程?这个教程手把手教你连插件,几秒钟搞定自动化。原文稍后读已读值得跟进有用关注 ChatGPT
05:09elvis@omarsar0精选Cursor团队使用多个AI代理从835页手册重建SQLite的Rust版本,通过100%测试集。成本因模型组合不同而相差15倍。实践建议:用前沿模型做分解和架构设计,用便宜模型执行具体实现。注意代理协调中的偏差和失败。技巧CursorSQLiteRust6 个信源在谈事件专题推荐理由:Cursor团队实战分享:如何搭配不同模型,用最小成本完成高难度编程任务,成本能差15倍。原文稍后读已读值得跟进有用关注 Cursor
04:33Lenny Rachitsky@lennysanElizabeth Stone认为系统思维是AI时代最重要的技能,它能帮助工程师和设计师跨领域构建共享能力。她指出系统思维可以通过退后一步看问题来学习,比如思考任务如何服务更大业务目标。她提到Netflix文化中的“keeper's test”主要用于正面绩效对话,多数情况下答案会是“我会拼命留你”。她强调高人才密度、激进透明和“上下文而非控制”是Netflix“卓越操作系统”的核心。技巧NetflixElizabeth Stone系统思维推荐理由:听听Netflix高管怎么用系统思维应对AI浪潮,还有keeper's test的正面用法,很实用。原文稍后读已读值得跟进有用关注 Netflix
04:12elvis@omarsar0精选该帖子提出一个后训练技巧:训练长周期智能体(long-horizon agents)时无需使用长周期 rollout。可以在短任务(short tasks)上训练,这类任务奖励成本低且验证容易。然后利用框架(harness)将能力扩展8-32倍,显著降低训练成本。技巧post-traininglong-horizon agentsshort tasks推荐理由:这篇帖子讲了个后训练小诀窍:短任务训练就能让智能体扩展到8-32倍的长周期,省时省力,值得试试。原文稍后读已读值得跟进有用关注 post-training
02:13向阳乔木@vista8该项目qiao由开发者joeseesun发布,提供了一个在Codex中集中使用多种AI模型的方案。用户可通过统一接口切换不同模型,无需在多个工具间跳转。代码已开源在github.com/joeseesun/qiao,支持自定义配置。技巧Codexjoeseesunqiao推荐理由:想在一个编辑器里用不同AI模型?试试qiao这个开源项目,能直接在Codex里切换,省事。原文稍后读已读值得跟进有用关注 Codex
02:00向阳乔木@vista8用户vista8发布了一个Skill,可在Codex中通过一句话调用Grok、Kimi、Claude三个模型执行任务。该Skill自动调用本机CLI执行并返回结果给Codex,合规安全。安装指令为npx skills add joeseesun/qiaomu-model-cli。用户可根据模型优势分工,例如用K3做前端、Grok 4.5做搜索、Claude Opus 4.8做Fable叙事。技巧CodexGrokKimi推荐理由:想在一个编辑器里用上Grok、Kimi、Claude?装这个Skill,一句话调不同模型干活,不用来回切换了。原文稍后读已读值得跟进有用关注 Codex
01:48官方一手AWS Machine Learning Blog@Don Barber精选AWS DeepRacer新增bootloader,开发者可安装或升级自定义OS。该bootloader能延长设备寿命,社区已发布基于它的发行版(如Ubuntu 22.04)。用户需按教程烧录bootloader并安装系统。技巧AWS DeepRacerbootloader自定义OS推荐理由:老DeepRacer能装新系统了,用新bootloader重装一遍,车又能跑最新ROS和AI软件,省一笔买新设备的钱。原文稍后读已读值得跟进有用关注 AWS DeepRacer
01:34官方账号LangChain@LangChainAILangChain发布概念指南,阐述团队治理AI代理需考虑的完整系统要素。涵盖认证、审计日志、速率限制、回退机制和集中支出控制等基础支柱。指南帮助开发者建立全面的代理治理框架。技巧LangChain智能体AI安全推荐理由:LangChain发了篇指南,教你治理AI代理要管认证、日志、限流、回退和花钱,很实用。原文稍后读已读值得跟进有用关注 LangChain
01:25官方一手AWS Machine Learning Blog@Ebbey Thomas精选AWS与NVIDIA合作,展示如何通过Amazon Quick作为入口,结合NVIDIA NeMo Agent Toolkit构建供应链风险智能体工作流。该方案让业务用户从Quick仪表板和知识上下文出发,获得引导式缓解建议。示例中,智能体可分析供应商中断风险并推荐替代方案。整个过程无需复杂编码,直接利用NeMo Agent Toolkit的预构建智能体模板。技巧Amazon QuickNVIDIA NeMo Agent Toolkit智能体6 个信源在谈事件专题推荐理由:AWS和NVIDIA联手,帮你用Quick仪表板加上NeMo Agent Toolkit,快速搭一个能自动分析供应链风险的智能体,不用写代码。原文稍后读已读值得跟进有用关注 Amazon Quick
01:02Milvus@milvusio精选MemSearch 是一个开源Agent记忆库,最新功能 Memory-to-Skill 可从Agent历史中自动挖掘重复出现的流程(如调试、API集成、发布),生成候选技能文件。系统将每个带场景、反馈和结果的事件抽象为技能草案,用户可在审查后安装到 Claude Code、Codex 等Agent的 skill 目录。该功能解决了开发者将知识存RAG、体验存记忆层、流程存技能文件的分离问题,实现记忆向技能的自动转化。技巧MemSearchMilvusMemory-to-Skill推荐理由:Milvus 团队开源了 MemSearch,新增 Memory-to-Skill 功能,能自动从Agent历史里挖出重复工作流生成技能文件,直接给 Claude Code、Codex 用,省得手动整理。原文稍后读已读值得跟进有用关注 MemSearch
00:57Qdrant@qdrant_engine精选HubSpot基于Qdrant构建了VAST向量搜索服务,管理超过20B向量,覆盖5个区域,服务38个团队。架构包含150个集群、2000多个pod,单个集合达9.5B向量,写入速度5000/s峰值100K/s。为解决Helm的局限性,他们开发了针对Qdrant的Kubernetes operator,实现了分片管理、复制和生命周期自动化,集群创建从小时级缩短至分钟级。在一项3B+点的BM42稀疏向量集合上,资源偏差降低了65%。技巧QdrantHubSpotVAST推荐理由:HubSpot分享了如何用Qdrant处理20B+向量搜索,自己写K8s operator搞定Helm搞不定的集群管理,集群创建从小时变分钟,资源偏差降65%。硬核实战经验。原文稍后读已读值得跟进有用关注 Qdrant
00:52向阳乔木@vista8AI编程工具Codex的前端审美不佳,OpenCodex项目允许用户自由切换后端模型。支持非OpenAI模型如Kimi K3(OAuth)、Grok 4.5(OAuth)、GLM 5.2。用K3做前端设计,切GPT sol5.6做后端,还能随时调用Grok 4.5搜索X信息。该项目在GitHub上开放,热度已有1534次浏览。技巧CodexOpenCodexKimi K310 个信源在谈事件专题推荐理由:Codex用户注意,OpenCodex可以让你用K3、Grok等模型做前端,GPT做后端,切换超方便。原文稍后读已读值得跟进有用关注 Codex
23:14elvis@omarsar0有用户分享使用LLM的经验,指出仅靠单次提示(one-shot)无法完成复杂任务。成功应用LLM需要从业者对问题有深入的理解和直觉。期待有更多关于方法论的报告。技巧LLM提示词工程经验分享推荐理由:用LLM别想一步到位,得懂业务。老手的经验,新手值得看。原文稍后读已读值得跟进有用关注 LLM
23:01官方账号LangChain@LangChainAI悉尼·朗克尔(Sydney Runkle)在 LangChain 推文中用一句话解释了 Deep Agents 的概念。该推文附带视频,已有 2400 次浏览和 13 个点赞。目前有 1 条评论和 2 个收藏。技巧LangChainDeep Agentssydneyrunkle推荐理由:LangChain 的 Sydney Runkle 一句话说清 Deep Agents 概念,带视频讲解,适合快速了解。原文稍后读已读值得跟进有用关注 LangChain
22:51Philipp Schmid@_philschmid精选Phil Schmid在aiDotEngineer世博会上分享了为何依赖直觉检查智能体技能会导致生产故障,并提出了自动化评估方案。他建议添加负面测试用例以防止无关提示的关键词劫持。技能文件超过500行会降低模型推理质量,应保持精简。使用毫秒级正则断言在10-20个生产提示上验证结果。通过消融测试比较有/无技能时的表现,判断何时可退役技能。技巧智能体自动化评估测试推荐理由:别再靠感觉测智能体了,Phil Schmid告诉你用负面用例、500行限制和毫秒级正则来搞自动化评估,实用干货。原文稍后读已读值得跟进有用关注 智能体
22:11官方账号LangChain@LangChainAICoinbase工程经理Evan Kormos在Interrupt大会上分享,其开发者支持团队基于自托管的LangSmith平台,构建了一个能自我改进的智能体系统。该系统利用LangSmith的追踪与反馈能力,自动优化对话流程。该会话视频在YouTube上发布,展示了企业级智能体落地的实际案例。技巧LangSmithCoinbase智能体推荐理由:Coinbase用LangSmith搭了个能自我进化的支持智能体,想看大厂怎么落地AI客服?这个实战分享值得一看。原文稍后读已读值得跟进有用关注 LangSmith
21:06Qdrant@qdrant_engineQdrant和Future AGI将于8月6日18:30 CEST举办线上研讨会,主题为“为什么我的RAG代理越来越差?”。内容涵盖构建RAG代理、迁移嵌入模型、去除重复和碎片化分块、添加晚期交互重排序等。每次变更前后都会对比评估分数,以验证实际效果。技巧QdrantFuture AGIRAG推荐理由:想知道RAG代理为什么变差?Qdrant和Future AGI在8月6日直播调试,从构建到修复,每一步看分数变化,很实用!原文稍后读已读值得跟进有用关注 Qdrant
20:15Dify@dify_aiDify团队在博客中总结了四个降低AI成本的实践模式:为每个任务选择合适规模的模型、用注解回复缓存重复答案、自托管以获得可预测容量、按节点追踪成本延迟和质量。文章指出AI成本不随使用量线性增长,而是随未优化的架构膨胀。这些技巧帮助团队将预算花在关键环节,而非盲目削减开支。技巧DifyLLMLLMOps推荐理由:Dify团队总结了四个省钱又高效的AI部署模式,尤其适合企业开发者控制成本。原文稍后读已读值得跟进有用关注 Dify
20:13Geek@geekbb一个名为Best-Claude-Code-Status的开源工具用Rust开发,能在终端中一行显示Claude Code当前使用的模型、工作目录、Git分支与变更状态以及上下文占用百分比。该工具专为Claude Code用户设计,占用资源极低,刷新快速。开发者公布了截图,已有750次查看和4个点赞。技巧Claude CodeRust状态栏3 个信源在谈事件专题推荐理由:终端里有个Rust写的Claude Code状态栏,一行就告诉你模型、目录、Git和上下文占用,超实用。原文稍后读已读值得跟进有用关注 Claude Code
20:09Yangyi@Yangyixxxx博主使用桌面Agent NewMax,在14分钟内从Reddit搜索并提取了20个冷门赚钱方法。演示中无PPT,仅通过Agent自动操作完成。该Agent可对比其他类似工具如WorkBuddy的效果。展示了桌面Agent在信息挖掘场景下的实用性。技巧NewMax桌面AgentReddit推荐理由:这个NewMax桌面Agent真能干活,14分钟就从Reddit挖出20个赚钱点子,省了自己刷帖的时间。原文稍后读已读值得跟进有用关注 NewMax
18:39掘金本周最热@SameX精选文章分享了在 HarmonyOS 应用中使用 relationalStore 的5个工程决策,包括将 RdbStore 设计为应用级单例并复用初始化 promise 避免并发问题,合理选择 securityLevel(S1 适合普通业务数据),以及使用 CREATE TABLE IF NOT EXISTS 和 ALTER TABLE 处理 Schema 迁移。还提到 securityLevel 从 S1 到 S4 影响加密与跨设备同步,选低等级性能更好。最后指出设计阶段需预判未来加字段以避免老用户崩溃。技巧HarmonyOSrelationalStore本地数据库推荐理由:讲的是 HarmonyOS 里 relationalStore 真正上线的坑,单例、安全等级、加字段怎么不崩,踩过的人才写得出来。原文稍后读已读值得跟进有用关注 HarmonyOS
18:21Viking@vikingmute精选作者用 Kimi 3 开发一个包含 React UI、Rust 核心和 Swift bridge 的录屏软件,测试其编程能力。Kimi 3 通过多 agent 并行执行了 5-6 小时,完成 300 多个自动化测试。最终实现了屏幕、摄像头和音频录制,自动记录点击和输入事件,支持自动缩放、多尺寸导出和多种背景。作者评价其能力接近 Opus 4.8 和 5.5,部分场景达 5.6 Sol 水平。技巧Kimi 3编程助手智能体4 个信源在谈事件专题推荐理由:Kimi 3 实战开发复杂录屏,多 agent 跑 6 小时、1M 上下文、300 多测试,效果接近 Opus 5.5,值得编程党看看。原文稍后读已读值得跟进有用关注 Kimi 3
16:13向阳乔木@vista8开发者Ziwen利用OAuth将Kimi k3模型直接接入Codex编辑器。用户无需API密钥,只需在Kimi Code中完成OAuth认证即可在模型选择器中使用k3,旁边还有Sol 5.6模型。该方法利用已有的订阅,无需额外付费。技巧Kimi k3CodexOAuth10 个信源在谈事件专题推荐理由:用OAuth把Kimi k3接进Codex,省了API密钥,直接在编辑器里切换用,挺方便的。原文稍后读已读值得跟进有用关注 Kimi k3
15:43Geek@geekbb这个开源项目(hungnv26/claude-code-dashboard)教你用闲置 iPad 或 iPhone 制作墙面状态板,实时显示 Claude Code 的 API 用量额度和正在运行的会话。用户可以直接在平板上操控会话,查看额度消耗。该项目在 X 上获得 1280 次浏览,是一个实用的 DIY 方案。技巧Claude Code编程助手状态监控推荐理由:家里有闲置 iPad 别吃灰了,挂墙上当 Claude Code 的监控屏,用量和会话一目了然,还能直接点操作,超方便。原文稍后读已读值得跟进有用关注 Claude Code
13:21Geek@geekbb这个开源项目提供了一套工具,能让 Claude Code、Codex、Cursor 等 AI Agent 把 Markdown 格式的公众号文章直接排版成原生 HTML,粘贴到公众号编辑器后不会丢失样式。它整合了从选题、写作、排版、封面生成到多账号草稿箱管理的完整工作流。项目地址在 GitHub 上,用户只需在 Agent 中调用即可自动化排版流程。技巧Claude CodeCodexCursor4 个信源在谈事件专题推荐理由:想用 AI Agent 自动排公众号?这个开源项目能把 Markdown 转成粘进去不掉样式的 HTML,还带着整条选题到封面流程,比你手动调快多了。原文稍后读已读值得跟进有用关注 Claude Code
13:08berryxia@berryxia有用户分享在 WorkBuddy 中接入 kimi K3 模型的具体步骤。需在 ~/.workbuddy 目录下新建 models.json,并填入包含 url、apiKey 等字段的配置。配置中需要设置 supportsToolCall、supportsImages、supportsReasoning 为 true。替换 API Key 后重启 WorkBuddy 即可正常使用。该方法可避免手动添加可能出现的兼容问题。技巧kimi K3WorkBuddyAPI配置10 个信源在谈事件专题推荐理由:想用 kimi K3 但 WorkBuddy 没法直接添加?跟着这个三步配置法,替换 API Key 就能用,亲测有效。原文稍后读已读值得跟进有用关注 kimi K3
11:49小互@imxiaohu精选布拉格经济大学Tomáš Bruckner发现,AI模型无法生成真正随机数,每个模型有固定偏好的数字。GPT-4o偏爱42、37、57,Claude Sonnet 5几乎只说47,Qwen3-Max在30次采样中每次都答42。利用这一特征可以作为模型指纹,在OpenRouter等聚合商处验证实际调用的模型。该方法将常见缺陷转化为识别手段。技巧OpenRouterGPT-4oClaude Sonnet 5推荐理由:聚合商可能偷偷换模型,你输入一个随机数,看它回答哪个数字就能认出是谁,实测GPT-4o、Claude、Qwen各有偏好。原文稍后读已读值得跟进有用关注 OpenRouter
11:12Geek@geekbb该项目利用Python和HyperFrames,将7-9张手绘母图自动合成为35-45秒的竖屏短视频,默认40秒、720×960分辨率、30fps。先用make_lineart.py从彩色母图提取对齐黑白线稿,再用build_story.py生成可渲染页面,生图模型仅运行一次。代码已开源在GitHub。技巧HyperFramesPython视频生成推荐理由:想自动把手绘线稿变成动画短视频?这个开源工具用Python加HyperFrames就能搞定,效果挺酷的。原文稍后读已读值得跟进有用关注 HyperFrames
10:16cat@_catwu一位用户分享了用于Claude Cowork的日历管理提示词。该提示词要求每周会议少于20小时、自动去重冲突、并参考过去周用户取消的会议类型。晚餐不计入20小时限制。提示词会构建可优化的技能,并在更新邀请前询问用户。技巧Claude Cowork提示词工程日历管理2 个信源在谈事件专题推荐理由:有人搞了个很实用的Claude Cowork提示词,能自动管日历、去重、限会议时长,还学你习惯。原文稍后读已读值得跟进有用关注 Claude Cowork
09:24官方一手marktechpost@Michal Sutter文章对比了6款在单张24GB GPU上以Q4_K_M量化运行的开放权重模型,包括Qwen3.6、Gemma 4、Mistral Small、gpt-oss-20b和DeepSeek-R1-Distill。每个模型列出了VRAM占用、许可协议和擅长任务。例如Qwen3.6在代码生成方面表现突出,DeepSeek-R1-Distill推理能力较强。读者可根据需求选择适合的本地模型。技巧Qwen3.6Gemma 4Mistral Small1 个信源在谈事件专题推荐理由:想用24GB显卡跑本地模型?这篇文章直接对比了6款主流开源LLM,告诉你选哪个干哪种活,省得自己试。原文稍后读已读值得跟进有用关注 Qwen3.6
01:44Jerry Liu@jerryjliu0Jerry Liu 认为创建自定义通用 harness 价值不大,但针对特定任务的自定义 harness 可以满足准确性/成本/延迟等生产约束,例如编码领域先验、模型混合和 UX。他建议先用 Codex 或 Claude Code 引导工作流,然后蒸馏成更具体的实现。相比通用智能体提示,任务专用方案效果更好。技巧CodexClaude Code编程助手推荐理由:Jerry Liu 说通用 harness 不如任务专用,先用 Codex/Claude Code 打底再蒸馏,实践性很强。原文稍后读已读值得跟进有用关注 Codex
01:06官方账号Hugging Face@huggingfaceHuggingFace 将于本周二举办 Local AI 线上活动,邀请 @TheAhmadOsman 和 @MikeBradleyAI 分享硬件搭建与本地推理现场演示,@alexocheema 和 @0xSero 讲解如何为硬件选择模型、模型压缩及 REAPs 方法。活动旨在帮助开发者从零搭建本地 AI 环境,涵盖实用技巧与经验。技巧HuggingFace本地部署推理部署推荐理由:想自己跑大模型?HuggingFace 这场活动从硬件配到模型压缩全讲,还有现场演示,别错过。原文稍后读已读值得跟进有用关注 HuggingFace
21:55官方账号Simon Willison@simonw精选Simon Willison分享了一个技巧:通过预加载脚本打印出claude二进制捆绑的Bun版本。只需创建包含console.log("embedded bun:", Bun.version)的TypeScript脚本,设置环境变量BUN_OPTIONS="--preload=/tmp/bun-version.ts",然后运行claude --version即可看到版本号。当前显示为1.4.0,即Bun的Rust版canary版本。这个方法比手动查找更直接可靠。技巧claudeBun命令行技巧3 个信源在谈事件专题推荐理由:想确认claude用的Bun版本?照这个搞个脚本跑一下就行,不用翻文档。原文稍后读已读值得跟进有用关注 claude
14:52官方账号Stability AI@StabilityAIStability AI 与 MusicHackspace 合作举办免费实践工作坊,教用户利用 Stable Audio 3.0 构建自定义音频应用和工作流。参与者可学习如何超越提示工程,实现生成式音频的深度集成。工作坊面向开发者和创作者,无需付费即可动手操作。技巧Stable AudioStabilityAIMusicHackspace推荐理由:想用 Stable Audio 3.0 做自己的音频工具?这个免费工作坊手把手教你搭建自定义应用,别错过。原文稍后读已读值得跟进有用关注 Stable Audio
14:51Geek@geekbbyuwen-publish-precheck 是一款发布前审核工具,支持抖音、小红书、视频号等平台。它通过词面预检和AI语境判定两层检测,而非简单违禁词匹配。规则源自42条官方规则和72条原文引文,并用38篇真实过审稿校准尺度。工具会指出哪句有问题并给出修改建议。技巧yuwen-publish-precheck抖音小红书推荐理由:发抖音、小红书前用它审一遍,能避免被限流。它按官方规则检查,还带AI语境判断,比单纯屏蔽词库靠谱。原文稍后读已读值得跟进有用关注 yuwen-publish-precheck
12:57Yangyi@Yangyixxxx作者Yangyi分享其所有发布内容均为AI根据上下文和探讨生成的记录,强调人机协同的核心在于提供有效角度和有价值的提问。他指出,通过高质量提问可以挖掘AI知道的但你不知道的信息,从而产出有价值的文本。文中提及FDE方法论,面向企业AI落地场景。技巧人机协同提示词工程写作技巧推荐理由:想知道怎么让AI写出像人写的东西?看看这位老哥的经验:关键在于你会不会提问,而不是AI本身。原文稍后读已读值得跟进有用关注 人机协同