03:55Martin Fowler@martinfowler这篇文章讨论了企业软件开发和周末应用开发的不同,提到周末开发侧重快速实现需求而企业开发需考虑长期治理和复杂流程,文中还引用了专家观点说明治理环节的重要性,以及代理执行在效率上的体现,对比中明确了两者在目标和应用场景上的差异。论文martinfowler企业软件开发应用开发推荐理由:martinfowler发文讲企业软件开发和普通应用的差异,能帮你明白两者不一样的地方,和普通开发比更系统。原文稍后读已读值得跟进有用关注 martinfowler
16:40宝玉@dotey公开 skill 只在生图、PPT 办公等超高频需求上提供稳定标品,很难完全对齐个性化需求。日常 AI 工作里,最优 agent 通常是用户自己长期迭代、手搓出来的。如果要使用公开 skill,往往会选择宝藏博主或朋友做的个性化版本。因此,关注 skill 不如关注创作者本人的方法论和理念,@dotey 就为此写了《图解 Skill》。技巧skill智能体个人IP推荐理由:dotey说别迷信公开skill,好agent都是自己手搓的。他把方法论写成《图解 Skill》,想提升AI工作流的可以看看。原文稍后读已读值得跟进有用关注 skill
01:43lmarena.ai@lmarena_aiAgent Arena团队发布一篇博客,详细说明了其评估平台中使用的因果追踪方法论。该方法论旨在分析智能体在竞技场中的行为决策原因,提升可解释性。博客提供了技术实现与案例应用的具体说明。论文Agent Arena因果追踪方法论推荐理由:Agent Arena团队发了新博客,讲因果追踪如何帮你搞懂智能体行为,适合做Agent评估和可解释性研究的同学。原文稍后读已读值得跟进有用关注 Agent Arena
18:13Yangyi@YangyixxxxFDE方法论是一套专门面向企业AI落地的系统化流程,涵盖需求分析、数据准备、模型选型与部署评估等关键环节。该方法论针对企业级场景提出了可操作的步骤和决策模板,帮助避免常见陷阱。技巧FDE企业AIAI落地推荐理由:如果你在公司做AI落地,FDE这套框架能帮你少走弯路,把需求到落地的每一步理清楚。原文稍后读已读值得跟进有用关注 FDE
13:49Ethan Mollick@emollick该推文指出开放科学和透明方法论在AI论文撰写中带来更多好处。行业开放科学方法论推荐理由:一条关于开放科学价值的简短点评。原文稍后读已读值得跟进有用关注 开放科学
08:43lmarena.ai@lmarena_aiAgent Arena 团队发布了关于其因果追踪方法论的博客文章,详细解释了如何通过因果分析评估智能体性能。该方法旨在揭示智能体行为背后的因果机制,帮助开发者理解模型决策过程。这一研究对于提升智能体系统的可解释性和可靠性具有重要意义,尤其是在复杂任务场景中。论文智能体因果追踪方法论推荐理由:做智能体评估的开发者可以了解这套因果追踪方法,它解决了黑箱模型难以解释的问题,值得点开看看具体实现。原文稍后读已读值得跟进有用关注 智能体
10:04shao__meng@shao__meng83°Claude Code 负责人 Boris Cherny 与产品负责人 Cat Wu 在一周年访谈中分享了产品演进的核心方法论。他们强调将错误写入持久化规则而非口头纠正,使 Agent 能长期自主运行。Verification 被重新定义为 Agent 亲自运行验证结果,而非传统单元测试。团队已全面转向 Auto Mode,认为模型从 4.6 起已能自主规划,且独立分类模型做安全拦截比人工审批更有效。组织层面,Anthropic 内部已将 AI 置于流程中心,角色融合(产品、设计、DevRel 都写代码)成为常态,未来工程师的主战场将从 IDE 转向 Agent 编排界面。AI产品Claude CodeCoding Agent方法论10 个信源在谈事件专题推荐理由:Claude Code 团队把一年踩坑经验浓缩成几条可复用的工程纪律,做 Agent 开发的团队看完能直接优化自己的 workflow。原文稍后读已读值得跟进有用关注 Claude Code
01:54lmarena.ai@lmarena_aiAgent Arena 发布技术博客,详细介绍了其方法论,并深入分析了人类如何委托、纠正和引导智能体。该研究揭示了人机协作中的关键交互模式,为构建更可靠的智能体系统提供了实证基础。博客内容对智能体开发者、人机交互研究者以及关注 AI 安全与可控性的团队具有重要参考价值。AI产品智能体人机交互方法论推荐理由:做智能体产品的团队值得一读——它揭示了人类在实际使用中如何与智能体互动,这些模式直接影响产品设计和用户体验。原文稍后读已读值得跟进有用关注 智能体
11:45官方账号arXiv cs.AI(学术论文)本文针对当前AI评估中普遍存在的“苹果与橙子”式比较问题,提出了一种可重复的流程,将高层级AI使用用例转化为详细评估场景。该方法通过结构化的AI用例工作表(包含用例、行业、用户、预期结果、预期影响和关键绩效指标六大要素)从领域专家处获取用例,并结合LLM提示与人工审核的三阶段扩展管线,将用例扩展为107个场景。文中以美国金融服务业为例,展示了网络防御、开发者生产力、金融犯罪聚合等用例的转化过程。核心贡献在于通过人工检查点确保场景的操作基础性和人类中心设计原则,为更一致、有意义的AI评估范式提供支持。论文AI评估方法论金融服务业推荐理由:该研究直面AI评估领域的方法论碎片化问题,提出的结构化流程和人类中心设计原则为业界提供了可操作的标准化评估框架,尤其对金融等高风险行业的AI系统评估具有直接参考价值。原文稍后读已读值得跟进有用关注 AI评估