7月2日
20:29
20:29官方账号vLLM@vllm_project
72°
Qwen3.6-27B-NVFP4模型在vLLM上可用,针对NVIDIA Blackwell GPU优化。该检查点将GPU内存需求降低约2.5倍。模型拥有27B参数,采用混合注意力机制。在MMLU Pro上得分86.3,GPQA Diamond上得分85.5。仅支持vLLM作为运行时引擎。
事件专题

推荐理由:Qwen3.6-27B-NVFP4来了!在Blackwell上内存减半,MMLU Pro 86.3分,用vLLM就能跑,开源模型本地AI更省显存。
13:13
7月1日
10:56
6月30日
13:16
13:16AI Will@FinanceYF5
Lindy转向DeepSeek V4,Cursor改用Kimi K2.5,Coinbase采用GLM-5.2和Kimi 2.7。Shopify和Airbnb选择Qwen,Uber Eats使用Qwen2,Siemens同时测试DeepSeek和Qwen。Microsoft正在测试DeepSeek V4。这表明中国AI模型在西方企业中的采购趋势加速。
事件专题

推荐理由:Lindy、Cursor、Coinbase这些大厂都在把AI任务切到DeepSeek、Kimi、Qwen上,连微软都在测试DeepSeek V4,中国模型在西方变主流了。
6月29日
18:22
18:22官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云举办Qwen全球AI黑客马拉松,总奖金池超过70,000美元。参赛者需在Devpost平台注册,选择5条赛道之一,利用Qwen API构建Agent并提交作品。赛事面向全球开发者,旨在推动基于Qwen模型的创新应用开发。

推荐理由:阿里云拿出7万美元办黑客马拉松,五条赛道任选,用Qwen API搭Agent就能参赛。动手能力强的话值得一试。
17:47
17:47官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云推出新的AI零售解决方案,基于Qwen模型,可跨所有触点理解客户,将碎片化洞察转化为个性化沉浸式体验,驱动可量化的零售增长。该方案已在大规模场景验证。

推荐理由:阿里云出了个新零售AI方案,基于Qwen模型,能跨各触点理解顾客,把零散数据变成个性化体验,还能量化增长效果。
13:50
13:50官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里巴巴云Qwen团队将于2026年6月30日举办Qwen Live第一集直播,主题为Agent-First。Qwen云负责人Linlin Kong与产品经理Pan Gu、Xijue将分享从零构建智能体云平台的经验。直播将重新定义面向非人类用户的开发者体验,并探讨大规模人机协作的新范式。

推荐理由:想搞智能体云平台?Qwen这期直播讲从零搭建、非人类用户开发体验,做agent的开发者别错过。
6月26日
04:52
04:52官方账号LangChain@LangChainAI
LangChain与Fireworks AI合作,基于阿里巴巴Qwen模型微调了一个法官模型。该模型用于检测用户交互中的“感知错误”(Perceived Error)。具体微调方法和评估结果已在LangChain博客文章中发布。
推荐理由:LangChain和Fireworks用Qwen搞了个裁判模型,专门抓对话里的感知错误,挺实用的,去博客看具体数据吧。
6月23日
22:09
22:09官方账号LangChain@LangChainAI
精选76°
LangChain与Fireworks AI合作,微调阿里Qwen模型构建了trace judge,用于检测生产trace中的“感知错误”。该judge在性能上匹敌或超越前沿模型,同时运行成本降低100倍。相关研究成果已发表在LangChain Labs博客。
推荐理由:LangChain搞了个低成本trace judge,用阿里Qwen微调,性能不输顶级模型还便宜100倍,做trace监控的可以看看。
6月18日
19:09
19:09官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云在东京启用了第5个数据中心,同时将Model Studio平台引入日本市场。该平台支持企业使用最新Qwen模型构建下一代AI智能体。此举旨在加强日本代理式AI时代的基础设施建设。

推荐理由:阿里云在日本搞大事了:新开第五座数据中心,还把Model Studio带过去,让企业直接用Qwen模型造智能体。
10:07
10:07官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云日本区域经理Takeshi Kurita与CyberAgent高管Takahito Naito探讨如何通过Qwen模型降低企业生成式AI成本。双方分享了基于Alibaba Cloud的Agentic Cloud策略的实际部署经验。会议聚焦于企业级AI模型的高效运用与未来方向。

推荐理由:阿里云和CyberAgent聊用Qwen降成本,有实战干货,搞企业AI的可以听听。
09:21
09:21官方一手arXiv: DeepSeek@Yifu Ding, Jiacheng Wang, Ge Yang, Yongcheng Jing, Jinyang Guo, Xianglong Liu, Dacheng Tao
精选
该论文针对混合专家(MoE)模型部署时内存和推理开销大的问题,提出一种结构剪枝框架。方法将剪枝比率分配转化为通道分数覆盖最大化问题,通过归因近似高效求解。在DeepSeek和Qwen MoE模型上实验,结合4-bit量化后,50%或25%结构化剪枝仍保持模型准确率。在Qwen3-30B-A3B上,内存占用减少5.27倍,优于现有基线。
推荐理由:想省显存又怕掉精度?这篇论文用通道级剪枝加4-bit量化,把MoE模型体积砍到1/5还能保住性能,DeepSeek和Qwen都能用。
03:55
03:55官方账号LangChain@LangChainAI
LangChain测试显示,Alibaba Qwen基础模型配合良好提示在感知错误分类任务上性能接近前沿模型。使用LoRA SFT微调后,模型性能接近或超过前沿模型。实验表明微调能使开源模型与顶级闭源模型竞争。

推荐理由:LangChain实测:Qwen基础版+好提示就能追平顶级模型,微调后甚至超越。开源模型潜力很大!
00:35
00:35Geek@geekbb
从2022年期待本地运行ChatGPT-3.5,到2026年DeepSeek、Qwen、GLM、Kimi每月发布旗舰模型。本地部署模型列表包括GLM-4、DeepSeek R1/V3、Qwen3、Kimi-K2、GPT-oss-120b、Qwen3.7-Plus、Kimi-K2.7、Deepseek-V4、GLM-5.2等九个版本。迭代速度远超预期,社区感叹没有尽头。
推荐理由:这帖子把2022到2026国产模型进化史盘得清清楚楚,DeepSeek、Qwen、GLM、Kimi每月一个旗舰,本地部署清单都快十个版本了,AI发烧友必看。
6月17日
12:53
12:53官方账号阿里云 Alibaba Cloud@alibaba_cloud
Flink Forward Asia 2026 将于6月26-27日在深圳华侨城洲际酒店举办,主题为'Real-time Data Power Future AI'。大会汇聚70+演讲者,来自阿里云、Qwen、字节跳动、腾讯、LinkedIn等公司。设有AI Native、多模态流、智能体、推理加速等深度议题。现场提供独家周边礼品,免费注册已开放。

推荐理由:阿里云办的Flink大会今年在深圳,主题是实时数据加AI,有70多个大厂专家讲多模态和智能体,做流处理的别错过。
09:31
09:31官方一手arXiv: DeepSeek@Siyue Chen, Yifu Guo, Yuquan Lu, Zishan Xu, Jiaye Lin, Jianbo Lin, Siyu Zhang, Cheng Yang, Junxin Li, Yujia Li, Yu Huo, Ruixuan Wang
该论文提出了LLM代码推理的内部生命周期概念:模型先在早期层中酝酿答案,使其线性可解,然后在后期层分化为四种解析结果——已解析、过度处理、错误解析、未解析。研究对Qwen、Llama、DeepSeek三个架构的16个模型进行了6类代码推理任务的层析探针和上下文剥离解码(CSD)实验。结果显示已解析平均仅41.5%,且函数调用任务中,调用深度从1层增至3层时已解析率从61.1%骤降至2.5%。所有模型的酝酿持续时长稳定在24%-42%,但解析成功率随模型能力和规模变化。
推荐理由:这篇论文用层析探针找到了LLM做代码推理时“酝酿”到“解析”的秘密,发现即便准确率相近,内部失败模式也截然不同,值得想理解推理本质的人读。
6月16日
6月15日
18:06
18:06官方账号阿里云 Alibaba Cloud@alibaba_cloud
在ATxEnterprise2026会议上,阿里巴巴云展示了基于Qwen的AI名片互动功能。该功能吸引了大量与会者,并赢得Crowd Magnet Award(人气磁铁奖)。会议还聚焦企业AI及云数据创新话题。

推荐理由:阿里云用Qwen做的AI名片在展会上获了人气奖,挺有意思的,看看他们怎么玩的。
17:51
17:51官方账号阿里云 Alibaba Cloud@alibaba_cloud
阿里云使用其Qwen和Wan模型创作了一支展示阿联酋文化的AI视频。视频融合了沙漠、阿拉伯书法、传统待客之道和迪拜现代天际线。Qwen是阿里云的大语言模型,Wan是视频生成模型。该视频通过Model Studio平台生成,体现AI连接传统与创新的能力。

推荐理由:阿里云用自家Qwen和Wan生成了一支阿联酋风情视频,把沙漠、书法和摩天楼全串起来了,展示AI视频创作能力。