8月4日
12:33
12:10
12:10官方一手arXiv: DeepSeek@Wen Zan, Jiaqi Zhang, Jianchao Tan, Hong Liu, Cunguang Wang, Xiang Li, Duyue Ma, Guanyu Wu, Yifan Lu, Fengcun Li, Yerui Sun, Peng Pei, Yuchen Xie, Xunliang Cai
LongCat Sparse Attention(LSA)提出流式感知索引、跨层索引和分层索引三种策略,解决DeepSeek Sparse Attention的O(L^2)计算开销和内存访问不连续问题。LSA在69B-A3B到560B-A27B规模模型上,与全注意力性能持平。LSA支持原生训练最长100万token的上下文,并支撑LongCat-2.0(1.6T-A48B)的开发。团队开源了LongCat-Flash-Lite-Sparse(69B-A3B)。
推荐理由:DeepSeek稀疏注意力有个瓶颈,LongCat这套新方案用流式感知和跨层索引把它治了,跑长文本不慢,还开源了个69B模型,可以试试。
11:21
11:21官方账号阿里通义 Qwen@Alibaba_Qwen
81°
阿里巴巴的Qwen3.8 Max已在OpenRouter上线。该模型有2.4万亿参数、950亿激活参数,主打长程编程、研究和多模态智能体任务。开放权重预计下周发布,这是Qwen Max级模型第一次开源。
推荐理由:Qwen3.8 Max已上线OpenRouter,2.4万亿参数、950亿激活,下周还首次开源Max级权重,想试的可以蹲。
09:47
09:47OpenRouter@OpenRouterAI
79°
阿里旗舰模型 Qwen3.8 Max 已在 OpenRouter 上线。它拥有 2.4T 总参数,激活参数为 95B。Qwen3.8 Max 面向长时程编码、科研和多模态智能体任务优化。官方计划下周开放权重,这是 Qwen Max 级模型首次开源。
推荐理由:阿里把 2.4T 参数的 Qwen3.8 Max 放 OpenRouter 了,下周开源,长时程编码和多模态智能体都能用,想体验可以直接去跑。
07:36
07:36lmarena.ai@lmarena_ai
在LMSYS Text-to-Video Arena排行榜中,MiniMax-H3获得1455分,与Muse Video的1458分仅差3分,并列总榜第三。Hailuo-2.3以1260分排在第23位,Hailuo-02-pro以1228分排在第29位。MiniMax-H3比排名紧随其后的最佳开源模型高出283分,表现亮眼。
事件专题

推荐理由:MiniMax-H3这回冲到了视频生成基准第三,离Muse Video就差3分,还比其它开源模型高出一大截,值得看看。
03:57
03:57Julien Chaumond@julien_c
interconnectsai 团队发布 Artifacts Hub,一个跟踪开放 AI 生态重要模型的 Web 界面。Artifacts Hub 汇总模型信息,让用户快速了解哪些模型值得关注。相关推文已获得 671 次浏览。

推荐理由:interconnectsai 做了个 Artifacts Hub,专门跟踪开放 AI 生态的重要模型,想了解开源模型动态可以上去看看。
01:43
8月3日
21:27
19:21
19:21官方账号Decoder@Jonathan Kemper
74°
阿里巴巴发布旗舰模型Qwen3.8-Max,总参数达2.4万亿。该模型可自主执行跨数天的复杂任务,包括复现研究论文和设计芯片。与常见闭源模型不同,Qwen3.8-Max采用开放权重,团队计划下周公布权重文件。

推荐理由:阿里那个2.4万亿参数的Qwen3.8-Max要开源了,能自己搞芯片设计,下周放权重,想玩长任务的盯紧点。
16:39
16:00
16:00官方一手pandaily@contact@pandaily.com (Pandaily)
79°
阿里巴巴发布Qwen3.8-Max正式版,参数量达2.4万亿。该模型支持1M上下文窗口,可执行长时间运行的智能体任务。官方称其编码与办公能力显著提升,跻身全球第一梯队。开源权重预计一周内公布,开发者可下载使用。

推荐理由:阿里发了Qwen3.8-Max,2.4T参数加1M上下文,做长任务Agent很强,而且下周就开源了,能直接玩。
15:59
15:59官方一手pandaily@contact@pandaily.com (Pandaily)
MiniMax 在 HuggingFace 上开源 H3-Base 权重,采用 33B 参数的稠密单流 Omni-Transformer 架构。该模型配备 16 倍空间和 4 倍时间压缩 VAE,本地运行只需两张 RTX 5090 显卡。其 API 定价仅为 Seedance 2.0 的三分之一。H3 在基准测试中直接对标 Seedance 2.0,展示了开源视频生成模型的竞争力。

推荐理由:MiniMax 把 H3 开源了,33B 参数,两张 RTX 5090 就能本地跑,API 价格只有 Seedance 2.0 的三分之一,想玩视频生成的可以试试。
14:39
13:29
12:24
12:23
12:08
12:08orange.ai@oran_ge
71°
MiniMax 将开源视频生成模型海螺 H3 的权重公开至 Hugging Face。据称该模型在生成效果上达到 Seedance 2.0 的约 80% 水准。作为开源视频生成模型,H3 目前处于 SOTA 级别,性能领先同类开源方案。
事件专题

推荐理由:MiniMax 把海螺 H3 开源了,效果据说有 Seedance 2.0 的八成,是目前开源视频模型里最强的,Hugging Face 上直接就能下载。
10:35
10:35IT之家博客/媒体
阿里巴巴今日发布千问 Qwen3.8-Max,参数规模达 2.4 万亿。官方称其在编程、真实办公、长程任务与多模态智能体方面实现提升。该模型能以极少人工介入端到端完成复杂开放目标。模型权重将于下周开源。

推荐理由:千问新模型 Qwen3.8-Max 有 2.4 万亿参数,编程办公更强,端到端自主干活,下周还开源。
09:54
09:54官方一手pandaily@contact@pandaily.com (Pandaily)
清华团队开源VeriLoop Coder-E1,基于Qwen3.6-27B模型。模型在SWE-bench Verified获得85.20分,SWE-bench Pro为62.38分,Terminal-Bench 2.0达76.40分,DeepSWE为33.63分。该模型采用窄领域PEFT和Self-Harness技术,实现仓库级代码修复的可验证递归自改进。

推荐理由:清华开源了个能自己改代码的模型VeriLoop Coder-E1,SWE-bench拿85.2分,比很多大模型都强,想搞代码修复的可以试试。
09:48
09:48官方一手pandaily@contact@pandaily.com (Pandaily)
71°
DeepSeek-V4-Flash-0731正式发布并开源,参数量304B,性能评分82.7。该模型超越V4-Pro预览版,定价为0.14/0.28美元。在VulcanBench基准上位列第一,HuggingFace热度榜第二。官方称其表现媲美Claude Opus-4.8。
事件专题

推荐理由:DeepSeek把304B的V4-Flash开源了,性能打平Claude Opus-4.8,价格还便宜,快去试试。
8月2日
22:17
22:17官方账号Nathan Lambert: Interconnects@Florian Brand
开放模型系列第23期介绍了Laguna S2.1、Inkling和Kimi K3。这三个模型展示了开源权重在帕累托前沿上的竞争力,兼顾性能与效率。文中指出,训练强模型的能力正在快速扩散到更多团队。
事件专题

推荐理由:三个新开源模型:Laguna S2.1、Inkling和Kimi K3,这期合集讲清楚了它们好在哪。