8月13日
17:56
17:55
17:55官方账号Simon Willison’s Weblog博客/媒体
精选
alchemy-utils 0.1a0 是 sqlite-utils 的数据库无关移植,基于 SQLAlchemy 支持 PostgreSQL、SQLite 和 DuckDB。该项目由 Codex 与 GPT-5.6 Sol Ultra 协作生成,保留了 insert、upsert、create 等核心 API。通过 uvx 可直接对 PostgreSQL 表执行 rows 命令,或把 CSV 导入 DuckDB。导入旧金山全部树木数据耗时从首轮近 1 小时优化至约 35 秒。
推荐理由:Simon Willison 发布了 alchemy-utils,相当于多数据库版 sqlite-utils,支持 PostgreSQL 和 DuckDB,一行命令导入查询,CSV 导 DuckDB 仅 35 秒。
17:55
17:55官方账号NVIDIA AI@NVIDIAAI
72°
英伟达宣布推出开源权重模型 Nemotron 3.5 Lightning。Deep Cogito 表示该模型继续推动开放模型生态,并宣布加入英伟达后训练合作伙伴生态。此次合作聚焦开源权重与可定制模型,旨在让前沿智能更易获取。
事件专题

推荐理由:英伟达出了开源版 Nemotron 3.5 Lightning,Deep Cogito 马上加入了它的后训练伙伴计划。想搞开源模型定制化的,这条有信息量。
17:55
17:55官方账号NVIDIA AI@NVIDIAAI
Uniphore实测NVIDIA Nemotron 3.5 Lightning在企业级智能体工作负载中的表现。与参数规模相近的Gemma 4 31B IT相比,Nemotron 3.5 Lightning吞吐量提升5倍,准确率也有明显增长。Uniphore已将其纳入Business AI Cloud高流量路径的评估范围。
事件专题

推荐理由:NVIDIA新模型在企业任务上直接碾压Gemma 4,吞吐量翻5倍,跑真实负载的数据很硬核。
17:55
17:54
17:54官方账号Decoder@Matthias Bastian
Pangram数据显示,谷歌Gemini的市场份额从12%跌至1.9%。OpenAI的ChatGPT保持超过50%的份额。Anthropic的Claude从4.3%增长至14.9%。Similarweb和OpenRouter的数据也证实了Gemini的下滑趋势。
事件专题

推荐理由:三家数据机构都指向同一个结果:Gemini在掉队,ChatGPT和Claude在抢地盘。具体数字都在这里,看一眼就明白。
17:54
17:54AI Will@FinanceYF5
75°
Grok 4.6正式发布,延续4.5的定价策略。新版本在Agent能力和编程任务上有所提升,并能更长时间处理复杂任务。在AA Intelligence Index基准上,Grok 4.6得分追平GPT-5.6 Sol。API价格为每百万输入Token 2美元,输出Token 6美元。
推荐理由:Grok 4.6发布,价格不变,Agent和编程更强,AA Intelligence Index追平GPT-5.6 Sol,API输入2美元/百万Token。
17:54
17:54官方账号arXiv cs.LG@Aleksandra Kalisz, Jack Simons, Krisztina Sinkovics, Noam Ghenassia, Shikha Surana, Henry Moss, Paul Duckworth
蛋白质结构预测基础模型在某些靶标上仍不可靠,外部 oracle 可纠正错误但成本高昂。一篇论文系统对比了 FK-steering、DPO、Best K-of-N 和最新提出的 O3 四种预算分配方法。在钙调蛋白(1CLL)和大肠杆菌天冬氨酸转氨甲酰酶(9EEH)两个靶标上,没有单一方法在所有预算下都占优。O3 在低预算时最有效,而 FK-steering 和 DPO 随预算增加表现更好。该研究给出了针对实际 oracle 预算约束的可操作建议。
推荐理由:做蛋白质结构预测的可以看看这篇,它对比了四种 oracle 预算分配方法,告诉你低预算用 O3,高预算用 FK-steering 和 DPO,挺实用。
17:54
17:54官方账号Cohere@cohere
精选
Cohere 宣布其视觉模型 North Micro Vision 已集成至开源微调框架 Axolotl。用户无需自备 GPU 或服务器,即可直接开始训练该模型。Axolotl 官方文档已提供 Cohere 模型的配置说明,地址为 docs.axolotl.ai。这降低了视觉模型微调的门槛。
推荐理由:想微调 Cohere 的视觉模型 North Micro Vision?现在用 Axolotl 就能跑,不用自己买显卡,直接上手试试吧。
17:53
17:53官方账号Decoder@Matthias Bastian
xAI 发布 Grok 4.6,在 Artificial Analysis 智能指数上得分 61,与 GPT-5.6 Sol 持平,仅次于 Claude Opus 5。在智能体任务中,Grok 4.6 完成复杂工作流平均约 53 步,而 Claude Opus 5 需要约 103 步。Grok 4.6 的 API 价格比 OpenAI 最强模型低 60% 以上。
事件专题

推荐理由:xAI 的 Grok 4.6 跑分追平 GPT-5.6,智能体任务比 Claude 更省步数,价格还便宜一大截,想换 API 的可以看看。
17:52
17:52Qdrant@qdrant_engine
Qdrant 宣布将于8月20日下午5点(中欧时间)在 Discord 举办 Office Hours,介绍 1.19 版本的新功能和更新。活动包含开放问答和社区讨论环节,参与者可以带着自己的项目和问题交流。官方博客已发布 1.19 更新的更多细节,供用户提前查阅。

推荐理由:Qdrant 新版 1.19 要来了,8月20日有官方答疑,想第一时间了解向量数据库新功能就去 Discord 听,还能直接问问题。
17:52
17:52techcrunch@Lucas Ropek
Anthropic 为 Claude 推出了新的水印系统。部分用户在社交媒体上抱怨,称该系统会暴露他们在工作或课程中偷偷使用 AI 的行为。这些水印可能帮助雇主或老师检测 AI 生成的文本。目前 Anthropic 尚未回应争议。
事件专题

推荐理由:Anthropic 给 Claude 加了水印,专门抓用 AI 偷懒的人。不少用户已经在吐槽了,看看你有没有中招。
17:52
17:51
17:51andrew chen@andrewchen
Andrew Chen 在 X 上分享 Deepseek v4 flash 0731 在双 DGX Spark 上的本地运行体验。他表示生成速度约为 50 tok/s,首字延迟(TTFT)很低。他认为这是目前最适合 prosumer 级用户的本地 AI 配置。
事件专题

推荐理由:Andrew Chen 说这套是目前最强家用本地 AI 配置:双 DGX Spark 跑 Deepseek v4 flash 0731 约 50 tok/s。
17:51
17:51向阳乔木@vista8
精选
Deepseek V4 Pro 0813在网友vista8的测试中完成了三个任务。第一个任务调用3个Skill完成网站开发、子域名解析和上线。第二个任务模仿60种设计风格生成Bento卡片图。第三个任务用Three.js制作3D打砖块游戏。
推荐理由:vista8用Deepseek V4 Pro 0813跑了三个活:网站部署、60种设计风格、3D游戏,视频挺直观。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。