8月23日
00:04
00:04官方账号Simon Willison’s Weblog博客/媒体
精选
使用编码代理的关键技能是自信地指导他们进行更改,并验证这些更改是否正确应用。有时这需要审查他们所写的每一行代码,但还有其他方法可以达到这个目标。审查每一行代码从未是验证软件更改的最有效方式。
推荐理由:想要提高代码审查效率,可以尝试使用编码代理,它不仅能帮你审查代码,还能以更高效的方式验证更改的正确性。
8月22日
03:33
03:33官方一手Google Research: Blog资讯
Google Research发布了一款AI工具,可从可穿戴传感器数据中优先排序候选生物标志物,提高健康监测效率。该工具基于生成式AI,旨在帮助研究人员识别与疾病相关的关键指标。工具名为Generative AI,已应用于健康与生物科学领域。
推荐理由:Google Research推出的Generative AI工具,能从可穿戴设备数据中筛选出关键生物标志物,对健康监测领域的研究人员来说是个大帮手,比传统方法更高效。
00:38
00:38官方账号Simon Willison’s Weblog博客/媒体
精选
Thomas Ptacek提倡为即使是个人工具的最小版本也构建真正的原生用户界面,因为编码代理降低了获得可用GUI的成本。他分享了关于自己编写的带宽和GPU监控macOS任务栏应用程序的经验,并鼓励将CLI转换为原生应用,这可能会改变你的思维方式。
推荐理由:Thomas Ptacek分享了他的经验,鼓励将CLI转换为原生应用,这是一个值得尝试的改变!
8月7日
09:25
09:25官方账号arXiv cs.AI@Modhurita Mitra, Jan-Willem Versteeg, Maarten D. Schermer, Shiva Nadi Najafabadi, Marie L. De Bruin, Lourens T. Bloem
该论文提出一个基于schema的框架,用生成式AI从非结构化文本中提取层级化、嵌套式信息,并自动与金标准做语义评估。在卫生技术评估机构NICE的文档上,该框架用Claude Opus 3成功提取了14个属性中的12个,F1分数超过90%。提取单个文档的时间比人类领域专家快约30倍。研究还验证了该框架在不同生成式AI模型间的通用性,以及在不同HTA组织和语言间的可迁移性。
推荐理由:这篇论文用Claude Opus 3从NICE文档里自动提取结构化信息,F1超90%,速度比人工快30倍,做医疗评估的朋友可以看看。
8月4日
12:50
12:50官方账号arXiv cs.AI@Taye Akinrele, Sindhuja Penchala, Noorbakhsh Amiri Golilarz, Sudip Mittal, Shahram Rahimi
该论文提出一种针对生成式与智能体AI认知能力差距的分类法综述,围绕持久状态建模、目标导向自主性、自我监控与控制、环境交互、学习与适应五个维度组织现有研究。论文回顾了各维度的最新进展,指出常见局限,并提出自适应认知智能架构(ACIA)作为统一框架。还讨论了以认知为中心的评价方向,为迈向长期可靠推理和持续学习的认知AI提供路线图。
推荐理由:这篇综述把生成式和智能体AI的认知短板按五个维度梳理清楚了,还给了个ACIA架构思路,适合想系统了解认知AI研究现状的人。
7月31日
7月21日
7月17日
07:00
07:00Justine Moore@venturetwins
72°
Netflix CEO 透露,公司已在 300 多部作品中实际使用 AI 进行制作。其中,生成式 AI 工具被用于关键镜头(key shots),这些镜头原本因成本过高会被舍弃。Netflix 还发布了一部纪录片,包含 17 分钟的 AI 增强片段,展示了 AI 在影视制作中的落地效果。

推荐理由:Netflix 已经实打实把 AI 用在 300 多部片子里,连纪录片里 17 分钟都是 AI 增强的。以后看电影可能会更便宜、更精良。
7月16日
21:45
21:45官方账号Simon Willison’s Weblog博客/媒体
Linus Torvalds 在 Linux 媒体邮件列表中明确表态,Linux 内核社区不会排斥 AI 工具。他认为 AI 已经证明自身的实用性,一年前尚有争议,如今已无可置疑。他警告反对者可以 fork 分支或离开项目。这一立场标志着主流开源项目对 AI 辅助开发的正式接纳。
事件专题

推荐理由:Linus 亲自发话,Linux 内核开发将拥抱 AI 工具。这对所有开发者是个明确信号,别再纠结‘AI 该不该用’了。
7月1日
04:26
04:26官方账号Runway ML@runwayml
Runway 宣布集成 Gemini Omni Flash 模型,支持用户通过文本提示、图片或视频输入来生成和编辑视频内容。该功能允许用户使用自然语言或现有素材创作任意视频。用户可在 Runway 平台直接使用,或通过 Agent 调用 Omni 能力。
推荐理由:Runway 把 Gemini Omni Flash 塞进视频工具里了,用一句话、一张图或一段视频就能编辑和生成新内容,省掉繁琐剪辑。
6月25日
22:22
22:22官方账号Decoder@Maximilian Schreiner
保险公司开始使用扩散模型等生成式AI技术进行灾难建模,可生成数万个历史数据中不存在的合理天气事件。他们希望借此进行更精确的风险评估。然而研究人员警告称,AI生成的模拟事件可能存在幻觉和销售逻辑误导,影响实际决策准确性。

推荐理由:保险公司用生成式AI做灾害建模,能补历史数据缺漏,但小心AI幻觉和销售套路,实际效果还得看验证。
6月24日
6月12日
6月11日
6月10日
09:52