8月19日
22:38
22:38官方账号Decoder@Maximilian Schreiner
GLM - 5.3是Z.ai推出的AI模型,在人工分析智能指数上获60分。该分数使其与Kimi K3并列开源模型榜首,且比GLM - 5.2高7分。它登顶开源模型排名时,计划被推迟。
事件专题

推荐理由:Z.ai推出了GLM - 5.3模型,分数表现好登顶开源排名,和竞品比价格更低但发布推迟,可以去瞅瞅。
01:24
8月18日
17:05
17:05官方账号阿里通义 Qwen@Alibaba_Qwen
Qwen-3.8-27b与Gemini-3.7-flash进行对比测试。Qwen-3.8-27b生成的水面模拟效果更一致、视觉更惊艳。该模型在3090显卡上运行,使用Q5量化版本。
事件专题

推荐理由:Alibaba_Qwen发布了Qwen3.8-27B,单提示就能生成惊艳效果,对比Gemini-3.7-flash表现更好,还能在本地3090显卡上运行。
16:36
16:36官方账号阿里通义 Qwen@Alibaba_Qwen
精选
Qwen3.8-27B 在 ArtificialAnlys Intelligence Index 中获得 52 分。该模型性能与 GPT-5.6 Luna (max) 持平。Qwen3.8-27B 是一个开源权重模型。它支持在本地运行,甚至能通过 WebGPU 在浏览器中运行。
事件专题

推荐理由:阿里 Qwen3.8-27B 性能追平 GPT-5.6 Luna,还能在浏览器跑。
15:30
15:30官方一手marktechpost@Michal Sutter
精选
Nous Research 为 Hermes Agent 推出 Bot Mode,该模式将单一代理会话列表替换为命名机器人名册。每个机器人都是一个真正的 Hermes 配置,拥有独立的聊天、记忆、技能和固定模型。Bot Mode 现已捆绑并在 Hermes Desktop 中默认启用。Hermes Agent 是 MIT 许可的开源代理。
推荐理由:Nous Research 给 Hermes Agent 加了 Bot Mode,每个机器人有独立记忆和技能,还能固定模型,现在桌面版默认开启,玩开源代理的可以试试。
02:15
02:15官方一手AWS Machine Learning Blog@Venu Kanamatareddy
精选
NVIDIA Nemotron 3.5 Lightning 已可在 Amazon SageMaker JumpStart 中部署。这是一款面向高并发智能体工作负载的开源模型,采用 30B 参数的 MoE 架构,其中活跃参数为 3B。该模型可提供最高 4 倍的吞吐量提升,以及最高 30% 更快的任务完成速度。开发者可通过 SageMaker JumpStart 一键启动部署。
事件专题

推荐理由:英伟达的新开源模型,30B MoE 但只跑 3B 活跃参数,放在 SageMaker 上直接部署,专为智能体高频调用设计,吞吐量翻 4 倍,适合跑大批量任务的人。
8月17日
17:06
17:06量子位@思邈
该世界模型支持24FPS视频画面的实时生成。该模型还能以48kHz采样率输出立体声音频。这一24FPS与48kHz的组合,让世界模型具备了同步音画能力。官方宣布模型即将完全开源,开发者可获得24FPS视频与48kHz音频的生成能力。
推荐理由:这个新模型能同时生成24帧视频和48kHz立体声,比之前无声的世界模型多了一路声音,而且马上开源,可以自己跑一跑。
10:16
10:16官方账号arXiv cs.LG@Syed Abdul Haseeb Qadri, Bjarne C. Hiller, Felix Blanke, Vanja Sophie Cangalovic, Kutalmış Coşkun, Amin Mirzaei, Tom Siegl, Sebastian Bader, Thomas Kirste, Martin Becker
CytoBERT是一个开源的细胞计数数据基础模型,支持可变标记面板。它在15个人类数据集、超过5000万个细胞上自监督预训练。通过标记标准化,模型学会跨数据集的细胞间标记关系。在样本级分类任务上微调后,证明了跨异质细胞计数数据集的迁移学习可行。代码已公开在GitHub。
推荐理由:流式细胞数据太杂不好统一?CytoBERT在5000万细胞上预训练,换数据集微调即用,避免从头训练。
07:26
07:26Guillermo Rauch@rauchg
精选
Vercel对GLM 5.3进行了网络安全能力评估。该模型在DeepsecBench基准中得分最高,是开源模型中的第一名。其运行成本仅为分数相近的专有模型的1/3。这使得防御性安全任务可以至少3倍频次地运行deepsec.sh脚本。
事件专题

推荐理由:Vercel测了GLM 5.3,网络安全评分是开源模型里最高的,价格只要别家三分之一,跑deepsec.sh能多跑三倍,防御岗可以关注。
06:39
06:39官方账号Simon Willison’s Weblog博客/媒体
精选
阿里Qwen发布Apache 2许可的Qwen 3.8 27B视觉模型,官方基准显示其超越Qwen 3.6 27B和闭源Qwen 3.7-Plus。作者在M5 Max MacBook Pro和DGX Spark上用LM Studio运行17GB Q4_K_M量化版,发现默认xhigh推理强度会消耗大量上下文。生成一张SVG用了22,276个推理token和21分钟,关闭推理后同一提示词仅需137秒。
事件专题

推荐理由:阿里新出的Qwen 3.8 27B开源模型本地可跑还带视觉,但默认爱钻牛角尖。关掉推理后同样的活从21分钟变2分钟,值得折腾。
8月16日
8月15日
12:33
12:33官方账号阿里通义 Qwen@Alibaba_Qwen
Qwen3.8-27B是阿里开源模型,目前可在NVIDIA RTX Spark上本地运行。开发者能够直接下载、部署这款27B模型,并基于它构建应用。推文显示该模型在RTX Spark上运行流畅,为本地AI开发提供了新选择。
事件专题

推荐理由:阿里把Qwen3.8-27B开源了,还能在RTX Spark上本地跑,下载就能部署,不用走云端。
12:33
12:33官方账号阿里通义 Qwen@Alibaba_Qwen
精选
阿里 Qwen 团队发布 Qwen3.8-27B,定位为适合笔记本的模型,但能力达到前沿水平。该模型已上线 LM Studio,用户可直接下载体验。本地运行约需 17GB 存储空间,门槛较低。官方称其在同等尺寸模型中实现能力跃升。
事件专题

推荐理由:Qwen 出的新模型,27B 参数在笔记本上就能跑,LM Studio 里直接下,想本地玩大模型的可以试试。
03:06
03:06ollama@ollama
阿里 Qwen 团队与 Ollama 达成合作,Qwen3.8-27B 模型已上架 Ollama 平台。用户可直接通过 Ollama 运行该模型。据官方说法,Qwen3.8-27B 在各种 harness 下都能稳定输出。开发者可通过 Ollama 调用该模型进行编程等任务。
事件专题

推荐理由:Qwen 最新模型 Qwen3.8-27B 上架 Ollama 了,想本地跑模型的直接开整,官方说怎么测都稳,去试试。
02:57