7月22日
04:19
04:19官方一手OpenAI Blog博客/媒体
OpenAI和Hugging Face联合分析了一起针对AI模型评估流程的安全事件。事件暴露了攻击者具备高级网络能力,可能涉及恶意模型或数据。两家公司分享了早期调查结果和防御经验,旨在提升社区对模型评估流程的安全防护意识。
事件专题

推荐理由:OpenAI和Hugging Face合作复盘模型评估时的安全漏洞,看看他们发现了什么高级攻击手段,对搞AI安全的有用。
04:18
04:18官方一手OpenAI Blog博客/媒体
David Vélez(Nubank创始人兼CEO)和Robin Vince(纽约梅隆银行CEO)正式加入OpenAI基金会及OpenAI Group PBC的董事会。两人将为OpenAI带来全球金融、科技和治理领域的领导经验。OpenAI成立于2015年,目前估值已超过3000亿美元。
事件专题

推荐理由:两位顶级金融科技大佬加入OpenAI董事会,带来治理和资金管理经验,对OpenAI的未来战略很有帮助。
03:46
03:46techcrunch@Sarah Perez
过去十年,流媒体平台如Spotify、Netflix、YouTube和TikTok各自专注音乐、视频、播客等单一格式。现在AI降低了内容创建、组织和推荐的难度,这些平台正转向成为全能娱乐应用,模糊了不同媒体形式的边界。
推荐理由:想了解Spotify和Netflix为什么都在做对方的事?AI让它们变成一站式娱乐中心,这篇文章讲得很清楚。
03:21
03:21官方账号Decoder@Matthias Bastian
一项涉及1559名巴基斯坦法官的实地实验显示,AI助手JudgeGPT使案件解决率提升6.3%。只有接受动手培训的法官才获得显著收益,未培训者效果基本消失。研究人员估计,每投资1美元可带来38.50美元的回报。
事件专题

推荐理由:AI真能帮法官提高办案效率,但得学会用才行。巴基斯坦测试结果:每投1美元赚38.5美元。
01:52
01:52官方一手marktechpost@Asif Razzaq
Google于2026年7月21日发布Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber三款模型。3.6 Flash输出token减少17%,输出价格降至每百万token 7.5美元。Flash-Lite推理速度达350 token/秒。门控版Flash Cyber用于驱动CodeMender进行漏洞查找。旗舰模型3.5 Pro仍延迟未发布。
事件专题

推荐理由:Google刚发了三款Flash模型,3.6 Flash输出便宜了17%,每百万token只要7.5刀,跑智能体任务很省钱。还有超快的Flash-Lite和专搞漏洞的Flash Cyber。
01:11
01:11官方一手OpenAI Blog博客/媒体
OpenAI 发布 ChatGPT for Small Business 计划,帮助小企业主学习 AI 技能并自动化日常工作。该计划提供 ChatGPT Work 功能,支持任务管理、文档处理等场景。参与者可获专业指导与社区支持,提升运营效率。
事件专题

推荐理由:OpenAI 出了个给小企业主的计划,能帮你用 ChatGPT 干活、自动化流程,对创业者挺实用。
01:10
01:10官方一手GitHub Blog@Jacklyn Carroll
本文介绍如何使用GitHub Copilot的Canvases功能将AI转化为交互式工作空间。Canvases支持可视化信息、探索工作流,帮助用户在复杂任务中直接操作。通过拖拽组件,开发者可以快速搭建数据处理界面。
推荐理由:GitHub Copilot的Canvases让AI变成能拖拽的工作区,可视化数据、梳理工作流,做复杂任务挺顺手。
01:07
01:07官方账号Decoder@Jonathan Kemper
73°
Google发布了三款新的Gemini Flash模型,包括更高效的3.6 Flash,其token使用量减少高达65%。还推出了一款面向政府和特定合作伙伴的网络安全模型。但旗舰模型Gemini 3.5 Pro仍未发布,而OpenAI、Anthropic和中国实验室已在前沿水平展开竞争。
事件专题

推荐理由:Google悄悄发了三个新Flash模型,3.6 Flash省了65%的token,但旗舰3.5 Pro还是没影,对手们已经在卷了。
00:37
00:37官方一手marktechpost@Sana Hassan
本文介绍NVIDIA srt-slurm框架,使用srtctl将YAML声明式配置转换为可重复的SLURM基准工作流。在Google Colab中配置集群并运行内置与自定义配方。通过参数扫描和Pareto分析,建模分离预填充(prefill)和解码(decode)部署的性能权衡。
事件专题

推荐理由:想搞分布式LLM基准测试?NVIDIA这个srt-slurm框架让你用YAML写配置,一键跑SLURM,还能做参数扫描和Pareto分析,超实用。
00:00
7月21日
22:57
22:57官方账号Simon Willison’s Weblog博客/媒体
Nativ 是一款基于 MLX 的 macOS 桌面应用,由 Prince Canuma 开发。它提供聊天界面和 localhost API 服务器,功能类似 LM Studio。应用能自动识别用户 Hugging Face 缓存目录中已有的 MLX 模型。用户可通过 Nativ 在 Mac 上本地运行视觉大语言模型等 AI 模型。
事件专题

推荐理由:Prince Canuma 做了个 Mac 版 LM Studio,用 MLX 跑本地模型,还能自动加载你下载过的模型。
21:09
21:09官方账号Simon Willison’s Weblog博客/媒体
Anthropic的Claude Code团队在AI Engineer World's Fair上分享了开发经验。Claude Tag协作工具已完成65%的产品工程PR。Fable 5模型已不再适合通过添加示例来优化系统提示。Claude Code系统提示规模减少了80%。团队内部公开协作文化是其成功关键。
事件专题

推荐理由:Anthropic工程师分享Claude Code和Fable的开发经验,告诉你他们如何使用自己的工具。
19:22
19:22量子位@量子位的朋友们
仪电智算云在WAIC 2026上发布全栈服务能力,专为国家人工智能应用中试基地设计。该服务覆盖算力调度、模型训练与推理部署等环节,支持主流AI框架。仪电智算云已在该基地完成首批算力节点部署,助力降低AI应用开发门槛。
推荐理由:仪电智算云发布了针对国家人工智能应用中试基地的全栈服务,从算力到应用一条龙,适合做AI项目落地的人看看。
16:55
16:39
16:39官方一手marktechpost@Asif Razzaq
72°
NVIDIA 推出 Cosmos 3 Edge,一个 4B 参数的开放世界模型,专为设备端运行设计。该模型可帮助机器人和视觉 AI 代理理解环境、实时推理并本地生成动作。Cosmos 3 系列此前已于 2026 年 5 月 31 日在 GTC Taipei 发布 Cosmos 3 Nano(16B)和 Cosmos 3 Super(64B)。
事件专题

推荐理由:NVIDIA 把 40 亿参数的开放世界模型塞进设备端,机器人不用联网就能自己理解环境、推理并执行动作,适合边缘部署场景。
16:18
16:18官方一手Pandaily@contact@pandaily.com (Pandaily)
XPower Technology在WAIC上展示了RPP架构的AE7100E芯片,其单颗芯片仅指甲大小。一张加速卡可集成12颗AE7100E,通过分布式计算支持400B到1.6TB参数的模型推理。官方声称在同等参数量下可实现最低token成本。

推荐理由:XPower用12颗小芯片组卡,跑400B到1.6TB参数的模型还能把token成本压到最低,想省钱搞推理可以看看。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。