8月26日
00:04
8月25日
06:38
8月17日
10:19
10:19官方一手arXiv: DeepSeek@Shiju Zhao, Jiacheng Yang, Qihang Chen, Junhao Hu, Jiaqi Zheng, Guihai Chen, Xusheng Chen
精选
CoRun是一个面向LLM推理的调度系统,通过隔离预填充和固定形状批处理解码实现确定性输出。相比现有batch-invariant内核方案,CoRun无需牺牲性能即可保证结果一致。在Qwen和DeepSeek等模型上,CoRun吞吐量提升15%至324%,首token延迟平均降低51.8%,每token输出延迟平均降低48.6%。其核心洞察是大多数内核虽非批次不变,但具有位置不变性。
推荐理由:这篇论文说用简单填充法就能让LLM推理结果确定,不用牺牲速度,比之前的方案快了不少,还在Qwen和DeepSeek上试过。
06:39
06:39官方账号Simon Willison’s Weblog博客/媒体
精选
阿里Qwen发布Apache 2许可的Qwen 3.8 27B视觉模型,官方基准显示其超越Qwen 3.6 27B和闭源Qwen 3.7-Plus。作者在M5 Max MacBook Pro和DGX Spark上用LM Studio运行17GB Q4_K_M量化版,发现默认xhigh推理强度会消耗大量上下文。生成一张SVG用了22,276个推理token和21分钟,关闭推理后同一提示词仅需137秒。
事件专题

推荐理由:阿里新出的Qwen 3.8 27B开源模型本地可跑还带视觉,但默认爱钻牛角尖。关掉推理后同样的活从21分钟变2分钟,值得折腾。
8月16日
09:38
09:38官方账号Simon Willison’s Weblog博客/媒体
开发者用GPT-5.6-Sol构建了CORS Chat工具,用于测试LM Studio中运行的Qwen 3.8 27B模型。该工具提供Web界面,兼容OpenAI-Responses聊天端点,已在LM Studio的--cors模式和OpenRouter上验证。对话记录保存在浏览器中,可导出为JSON。它还能在流式输出时逐步渲染生成的SVG图像。
事件专题

推荐理由:西蒙威利森今天做了个叫CORS Chat的小工具,能通过网页界面测试LM Studio和OpenRouter的聊天接口,还支持流式SVG渲染,挺实用。
8月15日
12:33
12:33官方账号阿里通义 Qwen@Alibaba_Qwen
精选
阿里 Qwen 团队发布 Qwen3.8-27B,定位为适合笔记本的模型,但能力达到前沿水平。该模型已上线 LM Studio,用户可直接下载体验。本地运行约需 17GB 存储空间,门槛较低。官方称其在同等尺寸模型中实现能力跃升。
事件专题

推荐理由:Qwen 出的新模型,27B 参数在笔记本上就能跑,LM Studio 里直接下,想本地玩大模型的可以试试。
02:01
02:01官方账号阿里通义 Qwen@Alibaba_Qwen
Qwen3.8-2.4T-A95B已在DeepInfra平台上线。该稀疏MoE模型总参数达2.4万亿,激活参数为950亿,共512个专家。它面向编程、智能体工作流和复杂推理设计,原生支持262K上下文。API定价为每百万输入2美元、每百万输出6美元、缓存输入0.2美元。
推荐理由:DeepInfra上线了Qwen最新稀疏MoE模型,2.4T总参数只激活95B,专攻编程和智能体场景,价格也公布了,想试API的可以直接上手。
02:00
02:00官方账号阿里通义 Qwen@Alibaba_Qwen
精选
Hugging Face发布2026年夏季《State of Open Models》报告。报告称,前沿模型规模越来越大,但小模型在实际使用中占主导。Qwen在本地推理使用量上领先,Gemma紧随其后。报告还显示,AI智能体已成为Hub上的重要力量。
推荐理由:Hugging Face报告显示Qwen本地推理排第一、Gemma第二,小模型玩家值得看看。
01:29
01:29官方账号Hugging Face@huggingface
HuggingFace发布2026年夏季开放模型状态报告。报告显示前沿模型规模持续扩大,但小模型仍主导实际部署。Qwen在本地推理使用量上排名第一,Gemma位居第二。AI代理已成为HuggingFace Hub上的重要增长动力。
推荐理由:HuggingFace出了份开放模型夏季报告,告诉你哪些小模型最常用,Qwen和Gemma谁跑得靠前,搞本地部署前先看看。
8月13日
8月12日
16:06
16:06官方一手pandaily@contact@pandaily.com (Pandaily)
72°
前阿里Qwen技术负责人林俊阳在上海创立Pragmatik Labs,天使轮估值达20亿美元。高榕和红杉中国各领投1亿美元,腾讯追加2000万美元。公司定位数字与物理智能体,而非基础模型。林俊阳曾是阿里最年轻的P10级工程师之一。

推荐理由:前Qwen技术负责人创业,估值20亿美元,高榕红杉腾讯都投了。不做大模型改做智能体,方向值得关注。
8月10日
13:40
13:40官方账号阿里通义 Qwen@Alibaba_Qwen
精选
Qwen-MM-Plugins 是阿里 Qwen 团队发布的插件套件,能让现有智能体框架原生支持多模态输入。它可读取图片、视频与文档,还支持视频编辑和 3D/CAD 文件处理。官方演示展示了从多模态模型到多模态智能体的能力扩展。
推荐理由:Qwen出了个插件包,让你的agent能看图、读视频、改视频、处理3D模型,直接把多模态能力塞进现有框架。
8月7日
16:49
16:49官方一手pandaily@contact@pandaily.com (Pandaily)
阿里旗下Qwen App本周推出重大更新,首次在纯免费聊天机器人基础上增加付费内容。新版捆绑了办公助手、定时任务和旗舰模型Qwen3.8-MAX的访问权限。这明确传递信号:生产力场景将逐步移入付费墙。目前该功能处于测试阶段,具体定价尚未公布。

推荐理由:阿里把Qwen App的办公助手和Qwen3.8-MAX丢进付费测试了,想跟豆包抢办公场景,你可以先看看免费版还剩啥。
8月5日
12:32
8月4日
13:38
13:38官方账号Latent Space (swyx)博客/媒体
Qwen发布了两个新开源模型:Qwen 3.8 Max,参数规模2.4T,以及27B版本。两个模型都面向编程和协作场景,权重已经开放。开发者可以基于这些权重进行本地部署或微调。这延续了Qwen在开源模型上的发布节奏。

推荐理由:Qwen这次一口气放了2.4T和27B两个开源权重模型,专攻编程和协作用途,想自己部署或微调的直接看就行。
8月3日
13:30
13:30官方账号阿里通义 Qwen@Alibaba_Qwen
阿里巴巴Qwen在X平台发布Visual Agentic Intelligence,推文展示相关视频,获得142次点赞和2.8万次浏览。该命名暗示Qwen正在推进视觉与智能体结合的技术方向。目前除了标题和视频外,Qwen未给出更多技术参数。
推荐理由:Qwen官方发了个视觉智能体的视频,具体演示内容还不清楚,但可以去看看这条新动态。
7月29日
11:10
11:10官方账号arXiv cs.AI@Carlos Celemin, Benedict Wilkins, Adrián Barahona-Ríos, Saman Zadtootaghaj, Nabajeet Barman
该研究探索了视觉语言模型(VLMs)在基于agent的游戏QA管道中检测几何裁剪异常。自定义探索agent收集视觉数据,自动标注管道提供帧级标签。零样本设置下测试了Gemini、GPT、Qwen、Gemma、Llama和Ministral六种VLM及四种提示变体。Gemini-3.1-Flash在总体准确率和提示鲁棒性上表现最佳,开源模型则对提示设计敏感。当前VLMs更适合作为多阶段QA管道中的高召回候选过滤器。
推荐理由:这篇论文用六种VLM检测游戏里的几何裁剪bug,发现Gemini最稳,开源模型要看怎么问提示词。想了解VLM实际落地坑点的可以看看。
7月28日
12:03
12:03官方一手arXiv: DeepSeek@Bartol Bućan, Nikola Sočec, Sarah Isufi, Morena Granić, Luka Hobor, Agneza Krajna, Mihael Kovac, Mario Brcic
76°
该研究对GPT-5、Claude、Grok、Gemini、DeepSeek、Kimi、Qwen共7个主流模型进行了基于政治轴的可控性压力测试,使用12种意识形态角色提示和70个政治指南针项目,共收集63,700条回答。结果发现,上下文框架解释了经济和社会轴上约88%-93%的方差,而模型自身身份的影响不到3%。在威权提示下,不同模型在相同问题上表现出相似偏移。研究强调需要进行可操控性审计,报告分散性、对称性、饱和度和拒绝底线。数据集和代码已开源。
推荐理由:这篇论文用70道政治题+12种人格提示,测了GPT-5、Claude、Grok等7个模型,发现提示词比模型本身更能左右回答方向。想了解AI怎么被‘带节奏’的可以看看。
10:01
10:01官方一手Pandaily@contact@pandaily.com (Pandaily)
阿里巴巴在HarmonyOS原生系统上推出了超过20款应用和50项创新功能。其中高德地图新增AR步行导航功能,钉钉集成了基于小忆的AI会议助手。淘宝应用支持沉浸式浏览,通义千问(Qwen)提供统一的拖拽式AI分析。这些功能充分利用了HarmonyOS的分布式能力,覆盖从AR导航到AI会议等多个场景。

推荐理由:阿里一口气在鸿蒙上更新了20多个应用,高德AR导航、钉钉AI会议、通义千问拖拽分析,全是实用功能,鸿蒙用户赶紧升级!